GEOZ

最新文章

共 1462 篇
MCP 协议:AI 应用的 USB-C 接口,安全连接数据与工具

MCP 协议:AI 应用的 USB-C 接口,安全连接数据与工具

BLUF
MCP(Model Context Protocol)是一个开放标准,旨在让AI模型安全、标准化地连接各种数据源和工具,被形象地称为“AI应用的USB-C接口”。它基于JSON-RPC,支持多种传输方式,提供安全可控的架构和丰富的生态,适合开发者、企业架构师快速集成。
GEO技术2026/9/27
中美AI治理对话与OpenAI智能体越权事件:同一天的两条信号

中美AI治理对话与OpenAI智能体越权事件:同一天的两条信号

BLUF
这是一份AI领域每日新闻汇总,涵盖中美两国元首关于人工智能的对话、OpenAI智能体越权访问澳大利亚政府系统、Black Forest Labs发布机器人动作模型、谷歌Gemini虚拟人功能上线、以及多篇arXiv论文和开源项目动态。内容涉及政策、安全、产品、模型和学术研究等多个方面。
AI 搜索观察2026/9/26
语义搜索工程实践:混合搜索与查询改写比模型选型更决定成败

语义搜索工程实践:混合搜索与查询改写比模型选型更决定成败

BLUF
语义搜索通过BERT等预训练模型将文本向量化,解决了传统关键词搜索中一词多义、同义不同词和上下文关联三大痛点。本文从系统架构设计、混合搜索策略、上下文感知实现到生产环境问题排查,系统梳理了语义搜索的工程实践要点,并给出了向量数据库选型、效果评估指标和前沿方向探索的具体建议。
GEO技术2026/9/26
TPU v6e 跑 Gemma 4 决策推理:比 L4 快一倍,成本却贵 3.7 倍

TPU v6e 跑 Gemma 4 决策推理:比 L4 快一倍,成本却贵 3.7 倍

BLUF
本文手把手教你在单颗 Google Cloud TPU v6e 芯片上,用 vLLM 部署 Gemma 4 系列模型,并运行 Jev 风格的决策模型。文章对比了 TPU v6e 与 NVIDIA L4 GPU 的推理表现,发现 26B-A4B 模型在 TPU 上决策延迟为 27-33 毫秒,远快于 L4 的 61 毫秒,但按需计费成本更高,推荐使用 12B 模型。
实验与实测2026/9/25
企业级 AI Agent 上生产,卡住团队的到底是什么?

企业级 AI Agent 上生产,卡住团队的到底是什么?

BLUF
这份白皮书系统总结了企业级 AI Agent 从架构设计到生产落地的全生命周期实践,涵盖构建、运行、治理和调优四大篇章。内容面向开发者、架构师和技术管理者,提供从概念到案例的完整参考,帮助团队应对工程化、规模化和组织化挑战。
AI大模型2026/9/24