Entity
Transformer
A deep learning neural network architecture using self-attention mechanisms for sequence processing.
术语属性
- Architecture Type:Neural network
- Key Mechanism:Self-attention
- Application:Natural language processing, sequence modeling
- Introduced:2017
相关文章
大语言模型核心原理:Transformer、训练方法与AI代理LLM引用:技术原理与实战详解大模型应用:技术原理与实战详解大模型学习路线:从零入门大模型应用开发AI三年巨变:从专用工具到通用大模型大模型的“涌现能力”:为什么参数到了一定规模就突然变聪明?DeepSeek 把 AI 推理成本打下来了:大模型八年进化实录从零手撸GPT:中文翻译版《LLMs-from-scratch》开源了大语言模型怎么用?2026年零基础入门教程(附API调用)谷歌域名重定向技术原理是什么?2026年GEO优化最佳实践检索增强生成(RAG)如何解决AIGC的核心挑战?2026年技术架构与应用解析大语言模型GPT、LLaMA和PaLM哪个更好用?(附技术架构对比)