GEOZ

标签:生成式引擎优化

查看包含 生成式引擎优化 标签的所有文章。

共 423 篇
同一个 GPT-4,换个接口解决率从 11% 跳到 18%:Harness 才是被低估的性能杠杆

同一个 GPT-4,换个接口解决率从 11% 跳到 18%:Harness 才是被低估的性能杠杆

BLUF
Harness 是包裹在 LLM 外层的工程层,由工具集、上下文管理和执行环境三部分组成,决定了模型是只能聊天还是能自主完成任务。它是不改变模型权重就能大幅提升性能的关键杠杆,与模型权重同等重要。本文梳理了 Harness 的概念、设计原则、与训练侧的关系,并给出从提示工程到 Harness 工程的演进链条。
GEO技术2026/9/22
提示词写得好,AI 输出质量能差出几条街

提示词写得好,AI 输出质量能差出几条街

BLUF
提示词是与AI沟通的语言,输入越具体输出越精准。本文系统讲解提示词的核心结构(任务、背景、格式、示例)、三种基础类型、角色扮演技巧、常见错误修正,并提供10个高频场景模板和Python代码示例,帮助技术从业者快速掌握提示词工程的基本功。
AI大模型2026/9/22
谷歌AI搜索正在偷走你的学习过程,这三个维基百科工具想把它还回来

谷歌AI搜索正在偷走你的学习过程,这三个维基百科工具想把它还回来

BLUF
作者对谷歌全面转向AI搜索表示担忧,认为这会影响出版商流量、限制用户视野,并阻碍深度学习。为此,她推荐了三款免费无广告的替代工具:MiniGladys(快速查找官方网站和社交媒体链接)、Wikipedia Seismograph(基于维基百科浏览量数据追踪公众兴趣峰值)和Wiki-Guided Google Search I & II(利用维基百科相关主题和词频生成精准搜索查询)。这些工具旨在提供更可控、更透明的搜索体验。
AI 搜索观察2026/9/21
Qwen3.8 开源:Qwen-Max 级能力首次下放,推理深度可调

Qwen3.8 开源:Qwen-Max 级能力首次下放,推理深度可调

BLUF
Qwen3.8 是 Qwen 系列最新开源模型,首次将 Qwen-Max 级能力开放给社区。它在编码、专业工作、研究和长周期智能体任务上大幅提升,支持通过 reasoning_effort 调节推理深度,并通过 preserve_thinking 保留历史推理上下文。模型权重已在 Hugging Face 和 ModelScope 发布,包含 27B 和 2.4T-A95B 两个版本。
AI大模型2026/9/21
上下文工程落地实战:为什么塞满窗口反而让 Agent 变笨

上下文工程落地实战:为什么塞满窗口反而让 Agent 变笨

BLUF
上下文工程(Context Engineering)关注的是每次调用 LLM 之前,窗口里该放哪些信息、用什么结构放、什么时候放、什么时候撤。它和 Prompt Engineering 的区别在于:后者关心指令怎么写,前者关心调用前的信息组装。文章系统讲解了上下文失效的原因、评估指标、运行时加载策略、长任务上下文管理,以及工程落地的五个模块和原则。
GEO技术2026/9/21