CodeRoadMap
路线图学习路径文章题库资源社区

浏览

首页路线图学习路径知识库题库文章资源社区我的学习
CodeRoadMap

中文编程学习导航:路线图、讲义与题库,进度可同步。

路线图学习路径文章题库社区

© 2026 CodeRoadMap

津ICP备2026012044号-1|coderoadmap@126.com
开发路线图/AI 智能体开发路线图/Transformer 模型与大语言模型
阶段一

Transformer 模型与大语言模型

节点说明与学习资源

Transformer 模型是一种神经网络,可以一次性读取全部输入数据(例如句子中的单词),而不是逐段处理。它们使用「attention(注意力)」机制来找出输入中哪些部分彼此最为相关。这使它们能够很好地学习语言中的模式。当 Transformer 在极大规模文本上完成训练后,我们称之为 Large Language Model(LLM,大语言模型)。LLM 可以回答问题、撰写文本、翻译语言以及编写代码,因为它在训练期间见过大量示例。AI 智能体将这些模型作为其「大脑」,向 LLM 输入任务或 prompt,获取文本或计划,然后据此采取行动。这种结构帮助智能体理解目标、分解步骤并根据反馈调整,使其适用于聊天机器人、研究助手和自动化工具等场景。

下一节点 →分词(Tokenization)