知识库:AI 到底是什么
不讲数学公式,也不堆黑话。每个概念都回答四件事:它是什么、为什么重要、可以打个什么比方、别人通常误解成什么样。
完全零基础?先按这个顺序读 8 篇
按这个顺序读,20 分钟就能听懂身边人说的绝大多数 AI 词。读完直接去做第一篇教程。
- 1大模型Large Language Model用海量文本训练出的巨型神经网络,靠「看着上文预测下一个词」生成连贯自然的文字。
- 2提示词Prompt你交给模型的任务说明,包含角色、任务、材料和输出格式,直接决定结果质量的上限。
- 3TokenToken模型切分文本后的最小计量单位,介于字符与词之间;长度、计费和响应开销都按它算。
- 4上下文窗口Context Window模型单次能同时「看到」的文本总量上限,含系统指令、历史对话和本轮输入,超出部分会被截断。
- 5幻觉Hallucination模型用「看起来该这么答」代替「确认这是真的」,于是会一本正经地编造不存在的引用和数字。
- 6多模态Multimodal模型同时接收文字、图片、音频等不同形式的信息,并用同一套系统理解和产出这些内容的能力形态。
- 7思维链Chain-of-Thought让模型先输出推理步骤再给结论的方法,把中间过程外显出来,用于提升多步推理类任务的表现。
- 8检索增强生成Retrieval-Augmented Generation先把你的资料切成片段建索引,提问时先检索出相关段落,再连同问题一起交给模型作答的方案。
基础概念
4 个概念
大模型Large Language Model
入门用海量文本训练出的巨型神经网络,靠「看着上文预测下一个词」生成连贯自然的文字。
5 个关联概念
读这一篇上下文窗口Context Window
进阶模型单次能同时「看到」的文本总量上限,含系统指令、历史对话和本轮输入,超出部分会被截断。
5 个关联概念 · 相关术语 1 条
读这一篇TokenToken
入门模型切分文本后的最小计量单位,介于字符与词之间;长度、计费和响应开销都按它算。
4 个关联概念 · 相关术语 1 条
读这一篇评测基准Benchmark
入门用一套固定题目和标准判分给模型打分,榜单上的名次和各家的宣传口径都是由它算出来的。
4 个关联概念
读这一篇提示词与交互
5 个概念
提示词Prompt
入门你交给模型的任务说明,包含角色、任务、材料和输出格式,直接决定结果质量的上限。
5 个关联概念
读这一篇温度Temperature
进阶控制输出随机性的参数:越低越保守稳定,越高越发散有创意,但出错概率也随之上升。
4 个关联概念 · 相关术语 1 条
读这一篇思维链Chain-of-Thought
进阶让模型先输出推理步骤再给结论的方法,把中间过程外显出来,用于提升多步推理类任务的表现。
4 个关联概念 · 相关术语 2 条
读这一篇系统提示词System Prompt
入门在你开口之前就设定好 AI 身份、说话方式和边界的指令,它的优先级高于对话中的任何内容。
4 个关联概念 · 相关术语 1 条
读这一篇提示词注入Prompt Injection
进阶把指令藏在网页、文档或图片里,诱导 AI 违背你原本的要求、照着隐藏指令办事的攻击手法。
4 个关联概念
读这一篇模型原理
6 个概念
幻觉Hallucination
入门模型用「看起来该这么答」代替「确认这是真的」,于是会一本正经地编造不存在的引用和数字。
5 个关联概念 · 相关术语 2 条
读这一篇微调Fine-tuning
深入用特定领域的数据继续训练已有模型,让它固定掌握某种格式、口吻与任务模式,输出更稳定。
4 个关联概念 · 相关术语 1 条
读这一篇对齐Alignment
深入让模型行为符合人类意图与使用规范的一整套训练和约束手段,覆盖有用、诚实、无害三个方向。
4 个关联概念
读这一篇模型蒸馏Distillation
深入让大模型当老师,用它的输出训练一个更小的模型,把某一部分能力压进更小的体积里。
4 个关联概念
读这一篇模型量化Quantization
深入把模型里存放数字的位宽从高位宽降到低位宽,体积随之明显变小,跑起来也更省显存和内存。
4 个关联概念
读这一篇混合专家模型Mixture of Experts
深入把模型拆成多组专家子网络,每个词只交给其中几组处理,总量大但每次真正参与计算的部分很小。
4 个关联概念
读这一篇工程与集成
6 个概念
检索增强生成Retrieval-Augmented Generation
进阶先把你的资料切成片段建索引,提问时先检索出相关段落,再连同问题一起交给模型作答的方案。
5 个关联概念 · 相关术语 1 条
读这一篇模型上下文协议Model Context Protocol
深入让不同 AI 应用以统一方式连接数据库、文件与外部工具的协议,把「怎么接」变成通用接口。
5 个关联概念 · 相关术语 1 条
读这一篇向量数据库Vector Database
深入按语义相似度而非关键词存取数据的系统,把内容转成数值向量,比较时看「意思有多接近」。
4 个关联概念
读这一篇嵌入(向量表示)Embedding
进阶把文字、图片等对象映射成一串能衡量语义距离的数值,意思越接近,这串数值在空间里就靠得越近。
4 个关联概念 · 相关术语 2 条
读这一篇语义检索Semantic Search
进阶不比对关键词,而是按意思的接近程度找出最相关的资料,让换一种说法也能搜到同一条内容。
4 个关联概念
读这一篇文档切分Chunking
进阶把长文档拆成大小合适的小块再建索引,切法直接决定了之后能检索到哪一段。
4 个关联概念
读这一篇能力与形态
5 个概念
多模态Multimodal
入门模型同时接收文字、图片、音频等不同形式的信息,并用同一套系统理解和产出这些内容的能力形态。
3 个关联概念 · 相关术语 1 条
读这一篇Agent 智能体AI Agent
进阶让模型不止给建议,而是自己拆解目标、规划步骤、调用工具、执行任务并检查结果的自动化系统。
5 个关联概念 · 相关术语 1 条
读这一篇开源与闭源Open-weight vs. Closed-weight
进阶闭源指权重不公开、只能走官方服务;开源指权重可下载,可本地部署或微调,按许可证约定使用。
4 个关联概念 · 相关术语 2 条
读这一篇文字识别OCR
入门把图片、扫描件、拍照件里的文字识别出来变成可复制、可检索的文本,多数「看图」功能都从这一步开始。
4 个关联概念 · 相关术语 1 条
读这一篇语音合成Text-to-Speech
入门把文字转换成接近人声的朗读输出,让文本材料从「能看」变成「能听」,主要用于提升可及性。
4 个关联概念
读这一篇