GEOZ

标签:Gemini

查看包含 Gemini 标签的所有文章。

共 138 篇
AI 工具怎么选:ChatGPT、Gemini、Kimi、豆包、DeepSeek 按场景拆解

AI 工具怎么选:ChatGPT、Gemini、Kimi、豆包、DeepSeek 按场景拆解

BLUF
这是一篇AI工具专题的总览页,把ChatGPT、Gemini、Kimi、豆包、DeepSeek等主流AI工具按「懂概念→选模型→按场景用→上平台」重新组织。文章覆盖了工具选型、国内访问方案、写作/画图/PPT/编程等场景推荐,以及提示词入门和合规提示。适合想系统了解AI工具全貌、快速找到对应教程的技术读者。
AI大模型2026/10/4
单张 TPU v5e 跑 12B 模型:重打包 Gemma 4 QAT 权重实测

单张 TPU v5e 跑 12B 模型:重打包 Gemma 4 QAT 权重实测

BLUF
本文提供了一份分步指南,教你如何将 Google 量化感知训练(QAT)的 Gemma 4 权重重新打包,以便在单块 Google Cloud TPU v5e 芯片上通过 vLLM 部署。重打包后的模型在分类、数学、工具调用等任务上表现与 bf16 相当,甚至优于 Google 官方的 4-bit 导出,同时支持从 E2B 到 26B 的所有尺寸。
实验与实测2026/10/3
把 Gemma 4 塞进 T4 小实例:单请求只慢两成,并发一上来性价比就翻车
置顶

把 Gemma 4 塞进 T4 小实例:单请求只慢两成,并发一上来性价比就翻车

BLUF
本文是系列教程的第四部分,指导如何在 Amazon SageMaker 最小的 GPU 实例(NVIDIA T4)上部署 Gemma 4 模型。通过打补丁解决 Turing 架构的共享内存限制,并使用 MCP 工具简化 vLLM 部署管理。实测显示 T4 的解码速度是 L4 的 0.77 到 0.82 倍,但答案完全一致,且 12B 是能容纳的最大版本。
实验与实测2026/10/1
开发者冒充者综合征的真正根源,以及提示注入为何像 SQL 注入

开发者冒充者综合征的真正根源,以及提示注入为何像 SQL 注入

BLUF
这是 DEV 社区编辑团队每周精选的 Top 7 文章汇总,涵盖用 Next.js 和 Three.js 重建 3D 版 DEV、开发者冒名顶替综合征的真实根源、基于 audio.cpp 的自托管音乐工作室 Miso、好注释的四种类型、WebMCP 与 AI CEO 模拟器、前端架构的统一模型,以及提示注入与 SQL 注入的对比。适合想快速了解海外开发者社区热点话题的技术人阅读。
AI 搜索观察2026/9/30