基础概念 · 01-03

大语言模型(Large Language Model)

杨思远 / 思行致远 · 2026/6/29 · 置信度:高
LLM大语言模型模型基础

在海量文本和代码上训练出来、擅长理解和生成语言的大型神经网络。

大语言模型(Large Language Model)

在海量文本和代码上训练出来、擅长理解和生成语言的大型神经网络。


一、是什么

  • 在海量文本和代码上训练出来、擅长理解和生成语言的大型神经网络。
  • 类比:像一个读过很多文本、能接着往下写的概率机器。
  • 关键澄清:
它不是什么它是什么
不是装满事实的数据库根据上下文预测下一个 token 的模型

二、为什么重要

  • 它是 ChatGPT、Claude、Copilot 和多数 Agent 的基础大脑。
  • 不懂它会怎样:把 LLM 当数据库用,会忽略幻觉、上下文和验证问题。

三、日常怎么理解

  • 用一句话讲给非技术朋友听:LLM 的本事是“接话和推演”,不是“永远知道真相”。
  • 常见场景:问答、摘要、翻译、代码生成、工具调用。

四、常见误解

误解真相
模型越大就一定越聪明规模重要,但数据、训练方法、对齐和使用方式同样重要。

五、延伸阅读

适用场景与行动

场景:适合用来建立 AI 核心概念的共同语言。

适合谁:非技术创业者、AI 产品使用者、内容与业务负责人

下一步:先用一句话复述这个概念,再判断它和你的业务场景有什么关系。

这张卡片由杨思远基于真实工作流和实测经验整理。

如发现信息过时或有误,可通过 /contact 反馈。