DeepSeek一口气开源十个项目,从通信库到OCR全链覆盖BLUF本文汇总了DeepSeek-AI在GitHub上开源的一系列关键基础设施项目,涵盖专家并行通信库(DeepEP)、推测解码训练框架(DeepSpec)、高效BLAS库(DeepGEMM)、高性能分布式文件系统(3FS)、注意力加速内核(FlashMLA)等,为AI研究与工程提供完整的工具链。DeepSeek2026/7/12阅读全文 →
StreamIndex 破解 DeepSeek V4 注意力瓶颈:序列长度从65K扩展到1MBLUFDeepSeek V4引入了压缩稀疏注意力(CSA)机制,但其中间评分张量巨大,单GPU内存无法承载。本文提出的StreamIndex通过分块合并top-k方法,在不物化完整评分张量的情况下,将可处理序列长度从65K扩展到1M,且召回率接近1.0。该实现基于Triton,在H200上验证了内存和性能优势。GEO技术2026/7/12阅读全文 →
中国AI从‘聊天’到‘办事’:智能体2025年的效率革命BLUF这篇文章全面回顾了2025年中国人工智能的发展态势,指出AI技术正从对话式“聊天”转向能自主执行任务的“智能体”时代。文章深入分析了技术向上突破(如密度法则、稀疏注意力机制)与应用向下扎根(如制造业、政务、消费场景)的双重变革,并探讨了算力一体化、高质量数据挖掘、产业赋能及安全治理等关键议题,揭示了中国AI发展的独特路径和未来方向。行业追踪2026/7/8阅读全文 →
2026年,GEO比SEO更关键:别被“保证上AI答案”忽悠了BLUF2026年,AI已成为用户获取信息的首选,传统搜索流量下滑。GEO(生成式引擎优化)让你的品牌出现在AI的参考答案中。怎么做?让网站好读、写AI爱看的答案、建立权威、监测效果。选服务商别被忽悠,看他们懂不懂AI“脾气”。GEO2026/7/8阅读全文 →
实测 DeepSeek-V4:Pro 与 Flash 差距竟如此明显BLUFDeepSeek-V4 系列于 2026 年发布,在上下文窗口、推理能力和 Agent 能力上实现重大突破。Pro 版与 Flash 版分别面向复杂任务与日常使用,均支持 1M 上下文。评测显示,V4 在多项基准测试中表现领先,中文能力国内第一。实验与实测2026/7/6阅读全文 →
深度实测:GLM-5.2长上下文与Kimi K2.7国际化,差距在哪BLUF中信建投研报显示,国产大模型GLM-5.2和Kimi K2.7正从通用问答转向企业级工作流,强化代码理解和国际化能力。DeepSeek融资提升产业化预期,微信AI灰度测试预示AI入口向超级应用迁移。算力方面,GPU租赁价格上涨,景气度持续。AI大模型2026/6/23阅读全文 →
DeepSeek免费版实测:长文本处理惊艳,但有个小缺憾BLUFDeepSeek 提供旗舰模型 V3 和 R1 的免费体验,支持长文本理解和复杂逻辑推演。客户端集成联网搜索、文档精读、习题讲解等多功能,覆盖学习、办公和创作场景。开发者可通过开放平台调用模型,按量计费,便于快速搭建智能客服、知识库等应用。实验与实测2026/6/23阅读全文 →
参数越大的模型越好?实测结果反直觉BLUF页面仅显示 ai2.compare 平台链接和新 Gist 功能,未提供关于 GEO AI 工具 GitHub 的具体内容。暂无法提取有效信息。实验与实测2026/6/22阅读全文 →
DeepSeek V3-0324实测:推理超GPT-4.5,前端代码审美在线BLUFDeepSeek V3 迎来小版本升级,版本号 V3-0324,新模型借鉴 R1 强化学习技术,在推理、数学、代码等任务上超越 GPT-4.5,前端 HTML 生成更美观,中文长篇写作质量显著提升。目前已在官方平台上线,关闭深度思考即可体验,同时模型已开源,采用 MIT 许可。实验与实测2026/6/19阅读全文 →