Entity
Transformer
A deep learning neural network architecture using self-attention mechanisms for sequence processing.
术语属性
- Architecture Type:Neural network
- Key Mechanism:Self-attention
- Application:Natural language processing, sequence modeling
- Introduced:2017
相关文章
从GPT到ChatGPT:大模型四步构建流程与真实成本拆解Happy-LLM是Datawhale推出的系统性大语言模型语言模型进化史:从统计计数到自注意力的跃迁大语言模型核心原理:Transformer、训练方法与AI代理LLM引用:技术原理与实战详解大模型应用:技术原理与实战详解大模型学习路线:从零入门大模型应用开发AI三年巨变:从专用工具到通用大模型大模型的“涌现能力”:为什么参数到了一定规模就突然变聪明?DeepSeek 把 AI 推理成本打下来了:大模型八年进化实录从零手撸GPT:中文翻译版《LLMs-from-scratch》开源了大语言模型怎么用?2026年零基础入门教程(附API调用)