GEOZ

标签:DeepSeek

查看包含 DeepSeek 标签的所有文章。

共 188 篇
OpenClaw 上下文压缩让 Agent 失忆:五层记忆模型与四套修复方案

OpenClaw 上下文压缩让 Agent 失忆:五层记忆模型与四套修复方案

BLUF
OpenClaw 的上下文压缩(Compaction)在节省 Token 的同时,会把 Session 启动时读取的项目规范、安全约束等关键上下文一并压缩掉,导致 Agent 突然“失忆”、行为退化。本文完整复现该问题,剖析五层记忆模型与压缩机制,并给出 memoryFlush、SOUL.md 安全规则、Compaction-Safe 设计等四套修复方案。
GEO技术2026/9/20
大语言模型核心原理:Transformer、训练方法与AI代理

大语言模型核心原理:Transformer、训练方法与AI代理

BLUF
这篇文章通俗易懂地介绍了大型语言模型(LLM)的核心概念,包括Transformer架构、GPT的工作原理、三阶段训练方法以及提示工程等关键技术。同时,文章还探讨了AI代理和多模态LLM的前沿趋势,并给出了程序员将LLM应用于实际开发的建议。最后附带了学习资源推荐和进阶资料推广。
AI大模型2026/8/10
DeepSeek-R1 用纯强化学习训练推理模型,性能直追 OpenAI o1

DeepSeek-R1 用纯强化学习训练推理模型,性能直追 OpenAI o1

BLUF
DeepSeek发布新一代推理模型DeepSeek-R1系列,包括通过纯强化学习训练的DeepSeek-R1-Zero和优化后的DeepSeek-R1,在数学、编程和推理任务上性能媲美OpenAI o1。此外,还开源了基于Qwen和Llama的蒸馏版本(1.5B至70B),其中32B模型超越o1-mini。文章详细介绍了模型架构、训练方法和基准测试结果。
DeepSeek2026/7/27
DeepSeek-V4预览版发布:百万Token上下文成标配,Pro版性能对标顶级闭源模型

DeepSeek-V4预览版发布:百万Token上下文成标配,Pro版性能对标顶级闭源模型

BLUF
DeepSeek-V4预览版正式发布,包括Pro和Flash两个版本。Pro版拥有1.6T总参数量(49B激活),性能媲美顶级闭源模型;Flash版284B总参数量(13B激活),兼顾速度与成本。两个版本均支持1M上下文长度,并且采用了创新的Token压缩和DSA稀疏注意力机制。API已更新,旧模型将于2026年7月24日后退役。
DeepSeek2026/7/27