GEOZ
专注GEO生成式引擎优化、知识库,覆盖AI技术、搜索可见性、结构化数据与内容优化实践。
首页
最新文章
RSS
菜单
Entity
Reasoning RL
推理强化学习,对模型的推理过程进行强化学习,以客观结果(答案对错、测试通过)作为奖励,不需要人工标注。
相关文章
适合想了解大模型从零训练全流程的工程师