Entity
Transformer
A deep learning neural network architecture using self-attention mechanisms for sequence processing.
术语属性
- Architecture Type:Neural network
- Key Mechanism:Self-attention
- Application:Natural language processing, sequence modeling
- Introduced:2017
相关文章
从Word2Vec到GPT-3:Embedding如何成为大模型的翻译官AGI 这个词比深度学习早出现了十年,为什么直到 GPT-4 才被认真讨论程序员转大模型:一条从 API 调用到生产级 Agent 的工程路线图大语言模型从原理到落地:幻觉与提示注入才是真正的坑从预训练到推理部署:大语言模型全流程技术拆解从GPT到ChatGPT:大模型四步构建流程与真实成本拆解Happy-LLM是Datawhale推出的系统性大语言模型语言模型进化史:从统计计数到自注意力的跃迁大语言模型核心原理:Transformer、训练方法与AI代理LLM引用:技术原理与实战详解大模型应用:技术原理与实战详解大模型学习路线:从零入门大模型应用开发