基础概念 · 01-03
大语言模型(Large Language Model)
在海量文本和代码上训练出来、擅长理解和生成语言的大型神经网络。
大语言模型(Large Language Model)
在海量文本和代码上训练出来、擅长理解和生成语言的大型神经网络。
一、是什么
- 在海量文本和代码上训练出来、擅长理解和生成语言的大型神经网络。
- 类比:像一个读过很多文本、能接着往下写的概率机器。
- 关键澄清:
| 它不是什么 | 它是什么 |
|---|---|
| 不是装满事实的数据库 | 根据上下文预测下一个 token 的模型 |
二、为什么重要
- 它是 ChatGPT、Claude、Copilot 和多数 Agent 的基础大脑。
- 不懂它会怎样:把 LLM 当数据库用,会忽略幻觉、上下文和验证问题。
三、日常怎么理解
- 用一句话讲给非技术朋友听:LLM 的本事是“接话和推演”,不是“永远知道真相”。
- 常见场景:问答、摘要、翻译、代码生成、工具调用。
四、常见误解
| 误解 | 真相 |
|---|---|
| 模型越大就一定越聪明 | 规模重要,但数据、训练方法、对齐和使用方式同样重要。 |
五、延伸阅读
- 本知识库相关:Token、上下文窗口、Transformer 架构
- 06-Knowledge: 01-大语言模型.md: `
- Wikipedia: Large language model
- Attention Is All You Need
适用场景与行动
场景:适合用来建立 AI 核心概念的共同语言。
适合谁:非技术创业者、AI 产品使用者、内容与业务负责人
下一步:先用一句话复述这个概念,再判断它和你的业务场景有什么关系。
这张卡片由杨思远基于真实工作流和实测经验整理。
如发现信息过时或有误,可通过 /contact 反馈。