GEOZ

最新文章

共 1462 篇
DeepSeek-R1 用纯强化学习训练推理模型,性能直追 OpenAI o1

DeepSeek-R1 用纯强化学习训练推理模型,性能直追 OpenAI o1

BLUF
DeepSeek发布新一代推理模型DeepSeek-R1系列,包括通过纯强化学习训练的DeepSeek-R1-Zero和优化后的DeepSeek-R1,在数学、编程和推理任务上性能媲美OpenAI o1。此外,还开源了基于Qwen和Llama的蒸馏版本(1.5B至70B),其中32B模型超越o1-mini。文章详细介绍了模型架构、训练方法和基准测试结果。
DeepSeek2026/7/27
DeepSeek-V4预览版发布:百万Token上下文成标配,Pro版性能对标顶级闭源模型

DeepSeek-V4预览版发布:百万Token上下文成标配,Pro版性能对标顶级闭源模型

BLUF
DeepSeek-V4预览版正式发布,包括Pro和Flash两个版本。Pro版拥有1.6T总参数量(49B激活),性能媲美顶级闭源模型;Flash版284B总参数量(13B激活),兼顾速度与成本。两个版本均支持1M上下文长度,并且采用了创新的Token压缩和DSA稀疏注意力机制。API已更新,旧模型将于2026年7月24日后退役。
DeepSeek2026/7/27
AI三年巨变:从专用工具到通用大模型

AI三年巨变:从专用工具到通用大模型

BLUF
本文系统梳理了AI的定义、分类以及三年来从深度学习到生成式AI、多模态大模型的巨大跃迁,并展望了通用人工智能(AGI)的雏形。无论你是技术新手还是专业人士,都能快速掌握AI当前的核心能力与技术逻辑。
AI大模型2026/7/23
Gemini 3.6 Flash 降价16%,但 API 废弃了 temperature:开发者如何迁移?

Gemini 3.6 Flash 降价16%,但 API 废弃了 temperature:开发者如何迁移?

BLUF
本文介绍了Gemini 3.6 Flash和3.5 Flash-Lite模型的新特性、定价、API变更及迁移方法。3.6 Flash在复杂代理和多模态任务上更强且成本更低,3.5 Flash-Lite是3.5系列最快最便宜的模型。两个模型均支持100万token上下文窗口、思考能力和Computer Use工具。开发者需移除弃用的采样参数(temperature/top_p/top_k)并避免以model角色结束请求。
Gemini2026/7/23
AI代码生成:效率提升背后,版权与责任盲区不容忽视

AI代码生成:效率提升背后,版权与责任盲区不容忽视

BLUF
AI代码助手能大幅提升效率,但开发者往往忽略了一个关键问题:AI生成的代码版权归谁?如果出现问题,谁来担责?本文深入分析了美国法院判例、工具合同条款、赔偿缺口以及欧盟监管要求,揭示了当前法律框架下的责任盲区,并为企业如何规避风险提供了实用建议。
行业追踪2026/7/23
AI 代理作弊实录:奖励劫持如何让测试变绿却保留 bug

AI 代理作弊实录:奖励劫持如何让测试变绿却保留 bug

BLUF
当一个AI代理被告知让测试通过,它可能直接修改测试本身而不是修复代码——这就是奖励劫持。本文深入分析代理循环中的“操控器”环节:如果操控器仅仅输出“让测试通过”,代理就会优化这个表面目标;而好的操控器会保留原始目标并附加失败的断言,引导代理修复实际代码。通过对比好的和坏的操控器,揭示了如何避免代理作弊。
实验与实测2026/7/23