智客百科
读懂 AI 概念与技术术语,沿着关联内容找到工具和实践。
91个词条
显示 91 / 91 个词条
清空搜索 ×AI 概念
28-
AGI(通用人工智能)
AGI · 通用人工智能
AGI(Artificial General Intelligence) 指在 任何 人类能做的认知任务上达到或超过 人类水平的人工智能。与当前"窄 AI"(每个任务单独训练的模型…
-
AI Agent
智能体 · Agent
AI Agent 是能自主感知环境、做出决策、执行动作的人工智能系统。LLM Agent 通常以大语言模型为"大脑",配合工具调用、记忆、规划能力完成复杂任务。
-
AI 对齐(Alignment)
对齐 · AI alignment
AI 对齐 是让 AI 系统的行为与人类意图、价值观、期望保持一致的研究领域。 这是 llm 训练流程的核心目标之一,也是当前 AI 安全研究最前沿的课题。
-
AI 搜索(Answer Engine)
answer engine · AI 搜索
AI 搜索 (答案引擎,Answer Engine)指用 LLM 直接生成答案,而不是返回 10 条蓝色链接的搜索产品。代表:Perplexity、You.com、Phind、秘塔…
-
Constitutional AI (宪法式 AI)
Constitutional AI · CAI
Constitutional AI (CAI) 是 Anthropic 2022 年提出的训练范式, 目标是用 AI 反馈(RLAIF) 替代 人类反馈(RLHF),同时保留对齐效…
-
MCP(Model Context Protocol)
Model Context Protocol · 模型上下文协议
MCP(Model Context Protocol)是 Anthropic 在 2024 年底开源的开放协议, 标准化 LLM 应用与外部工具 / 数据源的连接方式。可以理解为"…
-
MoE(混合专家)
Mixture of Experts · 混合专家
MoE(Mixture of Experts,混合专家)是一种"用稀疏激活换更大参数量"的模型架构: 把 Transformer 里的 FFN 层替换成 N 个"专家"子网络,每个…
-
RLVR (可验证奖励的强化学习)
RLVR · Reinforcement Learning with Verifiable Rewards
RLVR 是 2024 年起兴起的大模型强化学习新范式:奖励信号 不需要人类 判断,而是由 机器可验证的程序 给出。例如:
-
System 1 / System 2 (双系统思维)
System 1 · System 2
System 1 / System 2 是心理学家 Daniel Kahneman 在《思考,快与慢》 (Thinking, Fast and Slow, 2011) 里提出的认知…
-
Transformer 架构
变换器 · 自注意力
Transformer 是 2017 年 Google 团队在论文 Attention Is All You Need 中提出 的神经网络架构。它彻底改变了自然语言处理领域,是现代…
-
上下文学习 (In-Context Learning)
In-Context Learning · ICL
上下文学习 (ICL) 是大语言模型最重要的能力之一:在 prompt 里放几个 "输入-输出示例"或"指令",模型就能在 不更新权重 的前提下完成任务。 它把"训练"和"推理"的…
-
世界模型 (World Model)
World Model · 世界模型
世界模型 是 AI 研究里的一个 愿景性概念:让模型建立对 真实世界 运作方式 的内部表征,包括物理规律、空间几何、因果关系、社会动态。 具备世界模型的 AI 可以在"脑内"模拟行…
-
代码生成(Code Generation)
code-gen · AI 编程
代码生成 指 LLM 根据自然语言描述写出可运行代码的能力。是当前 LLM 最成熟、最有商业价值的应用方向之一。
-
函数调用(Function Calling)
工具调用 · Tool Use
函数调用(Function Calling)让 大语言模型 以结构化 JSON 形式输出"调用哪个工具、传什么参数",再由宿主程序执行实际工具(如查数据库、调 API、跑代码)。
-
合成数据 (Synthetic Data)
合成数据 · Synthetic Data
合成数据 是用模型(通常是更强大的模型或专门生成器)创造的训练数据, 而不是从真实世界抓取的。当真实数据稀缺(医疗、稀有语种、专业领域)、 成本太高(人类标注)、或隐私敏感(用户对…
-
多模态(Multimodal)
多模态模型 · MLLM
多模态模型 能同时处理多种类型的数据:文本、图片、音频、视频。代表工作: GPT-4V / GPT-5、Claude 3.5 Sonnet、Gemini 1.5、Qwen-VL、L…
-
大语言模型
LLM · 大模型
大语言模型(Large Language Model,LLM)是在海量文本上预训练的、参数规模 通常在数十亿到数万亿之间的 Transformer 语言模型。代表工作包括 GPT …
-
工具调用 (Tool Use)
工具调用 · Tool Use
工具调用 (Tool Use) 是让 LLM 在生成回复之外, 主动决定调用外部 工具 (搜索、数据库、API、shell、浏览器等)并把工具结果整合进答案 的能力。它把 LLM …
-
思维链(Chain-of-Thought)
CoT · 思维链
思维链(Chain-of-Thought, CoT)是让 大语言模型 在给出最终答案前显式输出 中间推理步骤的提示技巧。能显著提升复杂任务(数学、逻辑、规划)的准确率。
-
投机解码 (Speculative Decoding)
Speculative Decoding · Speculative Decoding
投机解码 是 2023 年起流行的 LLM 推理加速技术,核心思想:
-
推理模型(Reasoning Model)
推理大模型 · o1
推理模型 是专门针对"慢思考"任务优化的大模型:在给出最终答案前,会先生成 大量"思考 token"(chain-of-thought),把内部推理过程摊开来。代表:OpenAI …
-
提示工程(Prompt Engineering)
提示词工程 · prompt 设计
提示工程 是设计输入给 大语言模型 的指令,让模型产出期望结果的技术。 即使有了最强大的模型,糟糕的 prompt 也会让输出惨不忍睹。
-
机制可解释性 (Mechanistic Interpretability)
Mechanistic Interpretability · 机制可解释性
机制可解释性 (Mech Interp) 是 AI 安全与对齐研究里的一支:试图 逆向工程 transformer 内部的"电路" ——把模型看作可分解的计算图, 找到哪个 att…
-
标度律 (Scaling Laws)
Scaling Laws · 标度律
Scaling laws 描述了大模型在 参数量 N、训练 token D、算力 C 与 测试 loss L 之间存在的 幂律关系。经验上:
-
检索增强生成
RAG · 检索增强
检索增强生成(Retrieval-Augmented Generation, RAG)是一种把外部知识库 接入 LLM 的范式。模型不直接靠参数记忆回答问题,而是先从知识库 "检索…
-
模型校准 (Calibration)
模型校准 · Calibration
校准 是衡量"模型自报的置信度是否真实反映其准确率"的指标。一个 完美校准的模型说"我有 80% 把握",就意味着它在 100 次这种判断里真的 有 80 次是对的。
-
结构化输出 (Structured Output)
结构化输出 · Structured Output
结构化输出 是让 LLM 输出 符合预设 schema 的结构化值 (通常是 JSON) 而不是自由文本的能力。它把 LLM 从"会说话的文本生成器"变成"可编程的 函数调用器"—…
-
自博弈 (Self-Play)
自博弈 · Self-Play
自博弈 (Self-Play) 是强化学习的一种训练范式:让智能体 与自己 的副本对战 / 协作,通过胜负 / 反馈信号不断进化。它是人类最强 AI 系统的核心方法之一——从 Al…
基础设施
9-
Docker
Docker · 容器
Docker 是当前事实标准的容器化平台。把应用 + 依赖 + 配置打包成镜像, 一处构建,到处运行。是 LLM 服务部署( vllm / ollama / 微服务)的主流形态。
-
Elasticsearch
ES · Elastic
Elasticsearch (简称 ES)是基于 Apache Lucene 的分布式搜索引擎,也是当前最流行的 全文检索 + 日志分析平台。AWS 出品的 OpenSearch …
-
Hugging Face
HuggingFace · HF
Hugging Face (huggingface.co)是 AI 领域的"GitHub + AWS":开源模型托管、 数据集、Spaces(demo)、Inference 服务一…
-
LangChain
LangChain · LangGraph
LangChain 是当前最流行的 LLM 应用开发框架,覆盖从原型到生产的完整链路。 核心模块:langchain-core(抽象)/ langchain(集成)/ langgr…
-
LlamaIndex
LlamaIndex · GPT Index
LlamaIndex 是专注于 LLM 与私有数据对接的框架,是 RAG 应用的主流选择。 相比 LangChain 更"专注",API 设计更优雅。
-
Ollama
Ollama
Ollama 是把开源 LLM 跑在本地 / 边缘的最简单工具。一行命令拉模型、跑起来、 暴露 OpenAI 兼容 API。
-
pgvector(PostgreSQL 向量扩展)
pgvector · pgvector
pgvector 是 PostgreSQL 的开源向量检索扩展(GitHub 上 5k+ stars)。 让 PostgreSQL 直接支持 vector 类型 + ivfflat…
-
vLLM
vLLM
vLLM 是 UC Berkeley RISELab 开源的高吞吐 LLM 推理引擎,论文 PagedAttention 让它成为业界事实标准。
-
向量数据库(Vector Database)
vector DB · 向量库
向量数据库 是专门存储和检索高维向量的数据库系统。 Embedding 后 的文档 / 图像 / 用户特征都存在这里,支持最近邻(ANN)检索。
安全
4-
提示注入(Prompt Injection)
prompt injection · 提示注入攻击
提示注入 是 LLM 应用最严重的安全威胁:攻击者在用户输入或外部数据(网页、邮件、 文档)里塞恶意指令,让 LLM 执行越权操作(泄露系统 prompt、调危险工具、改输出等)。
-
数据投毒(Data Poisoning)
data poisoning · 数据投毒
数据投毒 指攻击者在 pretraining / SFT / RLHF 数据里注入恶意样本, 让训练出来的 LLM 带有后门、偏见、隐藏行为。是供应链攻击在 AI 领域的具体形式。
-
红队评估(Red Team)
red team · 红队
红队评估 指组织专门团队(内部或外部)模拟攻击者,主动尝试突破 AI 系统的 安全 / 对齐 / 隐私边界。是 OpenAI / Anthropic / Google DeepMi…
-
越狱(Jailbreak)
jailbreak · 越狱
越狱 (Jailbreak)指用精心构造的 prompt 绕过 LLM 的安全对齐,让模型输出 原本应该拒绝的内容(暴力、色情、危险操作、隐私信息等)。 与 prompt-inje…
技术术语
27-
BLEU / ROUGE(文本生成评测指标)
BLEU · ROUGE
BLEU 和 ROUGE 是 NLP 文本生成任务最经典的两类自动评测指标。在 LLM 时代 仍有参考价值,但 必须配合人工评估。
-
BM25
BM25 · Okapi BM25
BM25(Best Matching 25)是经典的信息检索排序算法,基于词频和文档长度归一化。 在 LLM 时代,BM25 仍是 RAG 检索的关键组件 —— 与向量检索互补。
-
CUDA(GPU 编程)
CUDA · GPU 编程
CUDA 是 NVIDIA 的 GPU 并行计算 API。深度学习几乎完全依赖 CUDA(虽然 AMD ROCm 和 Apple Metal 在追赶,但生态规模差一个数量级)。
-
DPO
Direct Preference Optimization · 直接偏好优化
DPO(Direct Preference Optimization)是 RLHF 的简化版:用偏好对 (chosen vs rejected)直接训练,跳过奖励模型和 PPO。论…
-
Embedding 向量
向量 · 向量化
Embedding 是把任意数据(文本、图片、音频、用户行为)映射到固定维度的 稠密向量空间中的表示。在这个空间里:
-
FlashAttention
Flash Attention · FlashAttention-2
FlashAttention 是 Tri Dao 等人 2022 年提出的 attention 算法重写:保持数值 精度的情况下,把 attention 的显存读写降到最低,长序列…
-
KV Cache
KV 缓存 · Key-Value Cache
KV Cache(Key-Value Cache)是 推理 阶段的关键优化: 把已经处理过的 token 的 Key 和 Value 矩阵缓存下来,避免每生成一个新 token 都…
-
LoRA
Low-Rank Adaptation · 低秩适配
LoRA(Low-Rank Adaptation)是一种参数高效微调(PEFT)方法:冻结原模型参数, 在每层插入低秩矩阵作为可训练的"旁路"。原始论文 LoRA: Low-Ran…
-
Mamba(状态空间模型)
状态空间模型 · SSM
Mamba 是 2023 年提出的新一代序列建模架构,用选择性状态空间(Selective State Space Model)替代 自注意力。核心论文 Mamba: Linear…
-
PPO(近端策略优化)
PPO · Proximal Policy Optimization
PPO(Proximal Policy Optimization)是 OpenAI 2017 年提出的强化学习算法, 是当前 RLHF 第二阶段的主流选择。
-
RLHF
Reinforcement Learning from Human Feedback · 人类反馈强化学习
RLHF(Reinforcement Learning from Human Feedback)是 微调 的高级形式:用人类偏好数据训练一个"奖励模型"(Reward Model)…
-
SWE-bench
SWE-bench · SWE-bench Verified
SWE-bench(Software Engineering Benchmark) 是当前最权威的代码工程能力评测: 让模型修复真实 GitHub 项目里的 issue,提交 pa…
-
Token(词元)
词元 · tokens
Token 是大语言模型处理文本的最小单位。一个 token 大约对应 0.75 个英文单词 或 1-2 个中文字符。模型不认识字符,只认识 token ID。
-
上下文窗口(Context Window)
上下文长度 · context length
上下文窗口 是 大语言模型 一次能"看到"的最大 token 数。超出窗口的 早期内容会被截断,模型无法直接引用。
-
分词(Tokenization)
分词器 · tokenizer
分词(Tokenization)是把原始文本切分成模型能理解的 token 序列的 过程。每个 LLM 在 pretraining 前就锁定了自己的 tokenizer,决定了模型…
-
困惑度(Perplexity)
PPL · perplexity
困惑度(Perplexity, PPL)是评估语言模型最基础的指标。它衡量模型对一段文本 的"惊讶程度"——困惑度越低,模型越"懂"这段文本。
-
幻觉(Hallucination)
幻觉 · 一本正经胡说八道
幻觉 指 大语言模型 生成看似合理但实际错误或无中生有的内容。包括:
-
微调(Fine-tuning)
微调 · fine-tune
微调 是在已经 pretraining 好的 大语言模型 基础上,用特定数据集继续训练, 让模型适配特定任务、领域或风格。
-
模型推理(Inference)
推理 · LLM serving
推理 是训练好的模型被实际使用的过程(相对于训练 / fine-tuning)。LLM 推理 涉及大量优化,目标是最小化延迟和成本。
-
模型蒸馏(Distillation)
distillation · 模型蒸馏
模型蒸馏 是把大模型(teacher)的知识"蒸馏"到小模型(student)的过程。 学生模型通过学习教师模型的"软标签"(概率分布而不是硬标签)获得接近教师的性能, 但参数量小…
-
模型量化(Quantization)
量化 · GPTQ
量化 是把模型权重从高精度(FP32/FP16)转低精度(INT8/INT4/FP8)的过程, 大幅降低显存占用和推理延迟。代价是轻微的精度损失。
-
监督微调(SFT)
SFT · Supervised Fine-Tuning
监督微调(SFT)是 微调 最常见的形式:在(指令,回答)配对数据 上训练,让模型学会"按指令回答"。
-
结构化输出(JSON Mode)
JSON mode · structured output
结构化输出 指让 LLM 严格按照预定义 schema(通常是 JSON)输出, 而不是自由文本。是把 LLM 集成到传统软件系统的关键技术。
-
自注意力机制
注意力 · Self-Attention
自注意力(Self-Attention)是 Transformer 架构 的核心计算单元。 它让序列中的每个位置都能"看到"序列中所有其他位置,并根据相关性分配不同的 权重。
-
评测基准(Benchmark)
benchmark · 评测
Benchmark 是用来客观衡量模型在特定能力上表现的标准测试集。每个严肃的 LLM 发布都会附带它在主流 benchmark 上的得分。
-
重排序(Rerank)
rerank · 重排
重排序(Rerank)是 RAG 检索流程的第二步:用更强的模型对初筛结果 精排,把真正最相关的片段提到前面。
-
预训练(Pretraining)
预训练
预训练 是 大语言模型 训练流程的第一阶段:用海量无标注文本(万亿 token 级别), 让模型通过"下一个 token 预测"任务自监督学习语言知识和世界知识。
模型与产品
23-
Anthropic
Anthropic · Anthropic AI
Anthropic 是 2021 年成立的前沿 AI 安全公司,由前 OpenAI 研究副总裁 Dario Amodei 和 Daniela Amodei 兄妹联合创立。从 Ope…
-
ChatGPT
ChatGPT · chat.openai.com
ChatGPT 是 OpenAI 于 2022 年 11 月发布的对话式 AI 产品,是首个引爆 LLM 消费级 应用的里程碑。短短两个月内月活突破 1 亿,至今仍是用户量最大的 …
-
Claude
Anthropic · Claude 3.5
Claude 是 Anthropic 公司开发的大语言模型系列,以安全性、推理能力、长上下文著称。 最新版本 Claude 3.5 / Claude 4 系列在代码、写作、分析任务…
-
Cohere
Cohere · Cohere Command
Cohere 是加拿大 AI 公司(2020 年成立),专注企业级 LLM 与 RAG 工具。 Command 系列是其主力 LLM 产品,Rerank v3 是业界 RAG 重排…
-
Cursor
Cursor · Cursor IDE
Cursor 是 Anysphere 公司出品的 AI-first 代码编辑器,基于 VS Code fork。 2024-2025 年成为最受开发者欢迎的 AI 编程工具,ARR…
-
DeepSeek
DeepSeek · DeepSeek V3
DeepSeek 是深度求索公司发布的大语言模型系列,2024-2025 年凭 V3 / R1 在 全球开源圈引起轰动 —— 用极低成本训练出逼近 GPT-4 / Claude 的…
-
Fireworks AI
Fireworks AI · Fireworks
Fireworks AI 是 2022 年成立于美国的前沿模型推理平台公司, 专注 把开源 / 商用大模型以最低延迟、最低价格提供给开发者。在 生成式 AI 应用爆发期,它和 To…
-
GPT-5
GPT-5 · OpenAI GPT-5
GPT-5 是 OpenAI 于 2025 年发布的旗舰大语言模型,是 GPT 系列的最新代。 相比 GPT-4 在推理能力、长上下文、工具使用、多模态等方面有显著提升。
-
Gemini
Google Gemini · Gemini 1.5
Gemini 是 Google DeepMind 在 2023 年底发布的大语言模型系列,是 Google 应对 GPT-4 / Claude 的旗舰武器。最新版本 Gemini …
-
Google DeepMind
DeepMind · Google DeepMind
Google DeepMind 是 Google 旗下的人工智能研究实验室,前身是 2010 年 在伦敦成立的 DeepMind Technologies,2014 年被 Goog…
-
Groq
Groq · Groq LPU
Groq 是美国 AI 推理芯片 + 云服务公司,自研 LPU(Language Processing Unit) 推理芯片,以"极致低延迟"著称。在 LLM API 市场是 Op…
-
Llama
LLaMA · Meta Llama
Llama 是 Meta(Facebook)发布的开源大语言模型系列,是当前开源 LLM 的标杆。 最新版本 Llama 3.x 系列在多项 benchmark 上接近闭源旗舰。
-
Meta AI
Meta AI · FAIR
Meta AI 是 Meta (Facebook 母公司) 旗下的人工智能部门,2013 年由 Yann LeCun 牵头成立 FAIR (Facebook AI Research…
-
MiniMax
MiniMax · 稀宇科技
MiniMax (上海稀宇科技有限公司)是国内领先的多模态大模型创业公司, 2021 年成立,专注大语言模型、视频生成、语音合成三大方向。公司同时 维护国内版 海螺 AI 和国际版…
-
Mistral AI
Mistral · Mistral 7B
Mistral AI 是法国巴黎的 AI 公司(2023 年成立),专注开源大模型与推理优化。 是欧洲最强、全球第二的开源 LLM 提供者(仅次于 Meta 的 Llama)。
-
NVIDIA
NVIDIA · 英伟达
NVIDIA 是由 Jensen Huang (黄仁勋) 1993 年创立的 GPU 与加速计算公司, 2010 年代靠深度学习押注 CUDA,从游戏显卡公司转身成 AI 基础设施…
-
OpenRouter
OpenRouter · 模型路由
OpenRouter (openrouter.ai)是 AI 模型 API 聚合平台,把 OpenAI / Anthropic / Google / Meta / Mistral …
-
Stability AI
Stability AI · Stable Diffusion
Stability AI 是 2019 年成立于伦敦的开源生成式 AI 公司,由 Emad Mostaque 联合创立。2022 年发布 Stable Diffusion 是开源文…
-
Together AI
Together AI · Together
Together AI 是 2022 年成立于旧金山的前沿模型云平台, 口号"去中心化 AI",专注 开源大模型的训练 + 推理 + 微调一体化服务。 公司由早期 Apache T…
-
TypeSafe AI
TypeSafe AI · Jev
TypeSafe AI 是 2026-09-15 离开隐身模式的 AI 实验室,由前 OpenAI 研究员 Diogo Almeida 创立——他正是 RLHF 和 Instruc…
-
Whisper
Whisper · OpenAI Whisper
Whisper 是 OpenAI 于 2022 年开源的自动语音识别(ASR)模型。凭借出色的多语种 鲁棒性和开源可用性,迅速成为业界 ASR 事实标准。
-
xAI
xAI · Grok
xAI 是 Elon Musk 2023 年成立的 AI 实验室,目标是"理解宇宙的真实结构"。 Musk 此前离开 OpenAI 董事会并多次公开批评其安全性,xAI 成立后定位…
-
通义千问(Qwen)
Qwen · 通义千问
Qwen(通义千问)是阿里云发布的大语言模型系列,中文能力是当前开源模型最强之一。 最新版本 Qwen2.5 系列在 MMLU、C-Eval、HumanEval 等多项基准上超过同…
没有匹配的词条 — 换个关键词试试。浏览全部词条