GEOZ

标签:DeepSeek

查看包含 DeepSeek 标签的所有文章。

共 188 篇
从Word2Vec到GPT-3:Embedding如何成为大模型的翻译官

从Word2Vec到GPT-3:Embedding如何成为大模型的翻译官

BLUF
Embedding是将文本、图像等数据转换为语义向量的核心技术,经历了从Word2Vec到BERT、GPT的动态嵌入演进,并扩展至多模态。本文系统介绍了Embedding的概念、发展历程、常见模型及实际应用示例,帮助读者深入理解大模型处理流程中的关键环节。
AI大模型2026/10/8
AI 工具怎么选:ChatGPT、Gemini、Kimi、豆包、DeepSeek 按场景拆解

AI 工具怎么选:ChatGPT、Gemini、Kimi、豆包、DeepSeek 按场景拆解

BLUF
这是一篇AI工具专题的总览页,把ChatGPT、Gemini、Kimi、豆包、DeepSeek等主流AI工具按「懂概念→选模型→按场景用→上平台」重新组织。文章覆盖了工具选型、国内访问方案、写作/画图/PPT/编程等场景推荐,以及提示词入门和合规提示。适合想系统了解AI工具全貌、快速找到对应教程的技术读者。
AI大模型2026/10/4
把 Gemma 4 塞进 T4 小实例:单请求只慢两成,并发一上来性价比就翻车
置顶

把 Gemma 4 塞进 T4 小实例:单请求只慢两成,并发一上来性价比就翻车

BLUF
本文是系列教程的第四部分,指导如何在 Amazon SageMaker 最小的 GPU 实例(NVIDIA T4)上部署 Gemma 4 模型。通过打补丁解决 Turing 架构的共享内存限制,并使用 MCP 工具简化 vLLM 部署管理。实测显示 T4 的解码速度是 L4 的 0.77 到 0.82 倍,但答案完全一致,且 12B 是能容纳的最大版本。
实验与实测2026/10/1