GEOZ

标签:DeepSeek

查看包含 DeepSeek 标签的所有文章。

共 188 篇
AI Agent 与 Agentic AI 到底差在哪:康奈尔团队从架构层面拆清了

AI Agent 与 Agentic AI 到底差在哪:康奈尔团队从架构层面拆清了

BLUF
AI Agent和Agentic AI经常被混为一谈,但两者在定义、架构和应用上有本质区别。康奈尔大学团队在一篇综述中系统梳理了这两个概念:AI Agent是执行单一任务的自主软件实体,而Agentic AI则是多个专业化Agent协作实现复杂目标的系统级智能。文章还分析了各自的应用场景、面临的挑战以及改进方案。
AI大模型2026/9/21
从预训练到推理部署:大语言模型全流程技术拆解

从预训练到推理部署:大语言模型全流程技术拆解

BLUF
这篇综述论文系统梳理了大语言模型(LLM)的训练与推理技术,涵盖数据预处理、训练架构、预训练任务、并行训练、模型微调,以及模型压缩、并行计算、内存调度和结构优化等推理部署技术。文章旨在帮助研究人员和工程师掌握LLM开发、部署和应用所需的知识,并探讨了LLM的未来发展方向。
AI大模型2026/9/21
AI 爬虫 robots.txt 配置:大部分站长其实什么都不用改

AI 爬虫 robots.txt 配置:大部分站长其实什么都不用改

BLUF
这篇文章是一份面向网站管理员和开发者的实操指南,系统讲解了 2026 年主流 AI 爬虫(如 GPTBot、PerplexityBot、DeepSeekBot 等)的识别与 robots.txt 配置方法。核心观点是:对大多数网站而言,允许 AI 爬虫访问利大于弊,因为 AI 引用能带来高转化流量,而屏蔽则会让内容在 AI 搜索中彻底消失。文章还提供了屏蔽、部分屏蔽、测试验证的完整步骤和常见错误清单。
GEO技术2026/9/21
单卡 MI300X 跑 Gemma 4 E2B:64 流吞吐破万,每美元 2713 tok/s

单卡 MI300X 跑 Gemma 4 E2B:64 流吞吐破万,每美元 2713 tok/s

BLUF
本文提供了一份在 AMD Instinct MI300X 上部署 Gemma 4 E2B 模型的完整指南。通过 AMD Developer Cloud 获取 GPU 资源,并使用 vLLM 进行服务化,同时配套了一套基于 Python MCP 的工具集来简化部署管理。文章详细记录了从环境准备、镜像选择、服务启动到性能测试的全过程,并给出了关键的性能数据。
实验与实测2026/9/21
在 Apple Silicon Mac 上用 container CLI 跑 Debian 13 并调用本地 Ollama 大模型

在 Apple Silicon Mac 上用 container CLI 跑 Debian 13 并调用本地 Ollama 大模型

BLUF
本文详细介绍了如何在 Apple Silicon Mac 上使用 Apple 的 container CLI 创建 Debian 13 虚拟机,并配置该虚拟机通过网络调用 Mac GPU 上运行的 Ollama 本地大模型。文章涵盖了从安装 container、构建带 init 的 Debian 镜像、启动虚拟机到配置 Ollama 监听的完整步骤,并提供了性能测试结果和常见问题解决方案。
实验与实测2026/9/21