AI黑话词典(2026年3月版),建议收藏

Odaily星球日报发布于2026-03-11更新于2026-03-11

文章摘要

AI黑话词典(2026年3月版)整理了AI领域高频基础及进阶词汇,帮助读者快速理解行业术语。基础词汇包括LLM(大语言模型)、AI Agent(智能体)、多模态、提示词、生成式AI、Token、上下文窗口、记忆、训练、推理执行、工具调用和API。进阶词汇涵盖Transformer架构、注意力机制、智能体工作流、子智能体、可复用能力模块、机器幻觉、延迟、护栏、氛围编程、参数、强推理模型、模型上下文协议、微调、蒸馏、检索增强生成(RAG)、事实对齐、向量嵌入和基准测试。这些术语涉及模型原理、应用场景及技术挑战,建议收藏以备查阅。

原创 | Odaily 星球日报(@OdailyChina)

作者|Golem(@web 3_golem)

现在,币圈人要是不关注 AI,很容易遭群嘲(对,我的朋友,想想你为啥会点进来)。

你是否对 AI 的基础概念一窍不通,每句话里的缩写都问下豆包啥意思啊?你又是否在 AI 线下活动中对各种专有名词一头雾水,还要假装没掉线?

虽然在短时间内一脚跨入 AI 行业不现实,但知道下 AI 行业高频基础词汇总是不亏的。幸运了,接下来这篇文章就是为你准备的↓真诚建议你熟读并收藏。

基础词汇(12)

LLM(大语言模型)

LLM 核心是用海量数据训练出来、擅长理解和生成语言的深度学习模型,它能处理文本,现在也越来越能处理其他类型内容。

与之相对的是 SLM(小语言模型)——通常强调成本更低、部署更轻、本地化更方便的语言模型。

AI Agent(AI 智能体)

AI Agent 指的不只是“会聊天的模型”,而是能理解目标、调用工具、分步执行任务、必要时还能做规划和验证的系统。Google 将 agent 定义为能基于多模态输入进行推理并代用户执行动作的软件。

Multimodal(多模态)

其 AI 模型不是只读文字,而是能同时处理文本、图片、音频、视频等多种输入输出形式。Google 明确把多模态定义为处理和生成不同类型内容的能力。

Prompt(提示词)

用户给模型输入的指令,是最基础的人机交互方式。

Generative AI(生成式 AI / AIGC)

强调 AI“生成”而不是单纯分类或预测,生成式模型可以根据 prompt 生成文本、代码、图像、表情包、视频等内容。

Token(令牌)

这是 AI 圈最像“Gas 单位”的概念之一。模型不是按“字数”理解内容,而是按 token 处理输入输出,计费、上下文长度、响应速度,通常都和 token 强相关。

Context Window(上下文窗口 / 上下文长度)

指模型一次性能“看到”和利用的 token 总量,也可称为模型在单次处理时能考虑或“记住”的 token 数量。

Memory(记忆)

让模型或 Agent 保留用户偏好、任务上下文、历史状态。

Training(训练)

模型从数据中学习参数的过程。

Inference(推理执行)

和训练相对,指模型上线后接收输入并生成输出的过程。行业里常说“训练很贵,推理更费钱”,因为真实商业化阶段很多成本发生在 inference。相关训练/推理区分也是主流厂商讨论部署成本时的基础框架。

Tool Use / Tool Calling(工具调用)

意思是模型不只输出文字,而是可以去调用搜索、代码执行、数据库、外部 API 等工具,这已经被当成 Agent 的关键能力之一。

API(接口)

AI 产品、应用、Agent 接第三方服务时的基础设施。

进阶词汇(18)

transformer(变换器架构)

一种让 AI 更擅长理解上下文关系的模型架构,也是今天大多数大语言模型的技术底座,最大的特点是能同时看整段内容里每个词和其他词的关系。

Attention(注意力机制)

它是 Transformer 最关键的核心机制,作用就是让模型在读一句话时,自动判断“哪些词最值得重点看”。

Agentic / Agentic Workflow(智能体式 / Agent 化工作流)

这是最近很热的说法,意思是一个系统不再只是“一问一答”,而是带有一定自主性地拆解任务、决定下一步、调用外部能力。很多厂商把它当成“从 Chatbot 走向可执行系统”的标志。

Subagents(子智能体)

一个 Agent 再拆出多个专职小 Agent 去处理子任务。

Skills(可复用能力模块)

随着 OpenClaw 爆火,这个词近明显变得常见,这是给 AI Agent 的可安装、可复用、可组合的能力单元/操作说明书,但也特别提醒有工具滥用和数据暴露风险。

Hallucination(机器幻觉)

意为模型一本正经地胡说八道,“感知到并不存在的模式”从而生成错误或荒谬输出,这是模型看似合理、实则错误的过度自信输出。

Latency(延迟)

模型从收到请求到输出结果所花的时间,属于最常见的工程黑话之一,一聊落地和产品化就会频繁出现。

Guardrails(护栏)

用于限制模型/Agent 能做什么、什么时候停、什么内容不能输出。

Vibe Coding(氛围编程)

这个词也是如今最火爆的 AI 黑话,意为用户直接靠对话表达需求,AI 来写代码,而用户不需要具体懂如何写代码。

Parameters(参数)

模型内部用于存储能力和知识的数字规模,常被用来粗暴衡量模型体量,“百亿参数”“千亿参数”都是 AI 圈最常见的唬人说法。

Reasoning Model(强推理模型)

它通常指更擅长多步推理、规划、验证、复杂任务执行的模型。

MCP(模型上下文协议)

这是近一年非常热的新黑话,作用类似给模型和外部工具/数据源之间建立通用接口。

Fine-tuning / Tuning(微调)

是在基础模型上继续训练,让它更适应特定任务、风格或领域。Google 术语表直接把 tuning 和 fine-tuning 作为相关概念。

Distillation(蒸馏)

把大模型的能力尽量压缩给小模型,像是让“老师”教会“学生”。

RAG(检索增强生成)

这几乎已经成了企业 AI 的基础配置。微软把它定义为“搜索 + LLM”的模式,用外部数据来给回答做 grounding,解决模型训练数据过时、不了解私有知识库的问题。目的是把回答建立在真实文档和私有知识上,而不是只靠模型自己回忆。

Grounding(事实对齐)

常和 RAG 一起出现,意思是让模型回答建立在文档、数据库、网页等外部依据上,而不是只靠参数记忆“自由发挥”。微软在 RAG 文档中明确把 grounding 作为核心价值。

Embedding(向量嵌入 / 语义向量)

就是把文字、图片、音频等内容编码成高维数字向量,以便做语义相似度计算。

Benchmark(基准测试)

用一套统一标准去测试模型能力的评测方式,也是各家模型最爱拿来“证明自己很强”的排行榜语言。

热门币种推荐

相关问答

Q什么是LLM?

ALLM(大语言模型)是用海量数据训练出来、擅长理解和生成语言的深度学习模型,能处理文本,现在也越来越能处理其他类型内容。

QAI Agent与普通聊天模型的主要区别是什么?

AAI Agent不只是“会聊天的模型”,而是能理解目标、调用工具、分步执行任务、必要时还能做规划和验证的系统。

QRAG的主要作用是什么?

ARAG(检索增强生成)通过“搜索+LLM”模式,用外部数据给回答提供事实依据,解决模型训练数据过时、不了解私有知识库的问题,确保回答建立在真实文档和私有知识上。

Q什么是Hallucination(机器幻觉)?

AHallucination指模型一本正经地胡说八道,感知到并不存在的模式从而生成错误或荒谬输出,是模型看似合理实则错误的过度自信输出。

QToken在AI领域的作用是什么?

AToken是AI处理输入输出的基本单位,模型按token而非字数理解内容,计费、上下文长度、响应速度等通常都与token强相关。

你可能也喜欢

如何让自己变得让人工智能永远也无法取代

面对人工智能的冲击,许多人担心工作被取代。然而,真正的威胁在于个人对他人和系统的依赖,以及由此产生的“薪资奴役”——即为生存而从事无意义、枯燥的工作。摆脱这种困境的关键,不是抵制技术,而是成为拥有高自主性的“不可受雇”个体。 文章提出了成功抵御AI替代的五个核心要素:自主性(主动行动的能力)、品味(判断事物价值的经验)、说服力(让他人关注你工作的能力)、毅力(坚持并从错误中学习)和迭代(根据反馈持续改进)。这些能力无法仅通过理论学习获得,必须通过实践来培养。 要启动转变,首先要彻底改变环境,重塑身份认同。其次,应选择一个能获得真实、快速反馈的实践领域,例如创业。在众多技能中,内容创作(媒体)比编写代码更具优势,因为其价值是主观的,需要独特的审美和判断力,这正是AI目前难以完全复制的。 具体行动上,可以从三个步骤开始: 1. **挖掘原始素材**:反思自己长期痴迷的知识领域、轻松解决的难题或童年被压抑的兴趣,找到独特的个人经验。 2. **确立反向思考主轴**:找出你坚信但主流观点错误的地方,或行业内普遍忽视的“皇帝新衣”,形成独特的批判性视角。 3. **立即发布**:将前两步的思考融合,撰写并发布第一个核心内容(如帖子、视频),勇敢接受真实世界的反馈,并在此基础上持续学习和迭代。 最终,抵御AI的关键在于构建一份与自身身份深度契合的毕生事业,通过持续的内容创作和真实互动,建立无法被自动化取代的独特价值和影响力。行动,从今天发布第一个想法开始。

marsbit3小时前

如何让自己变得让人工智能永远也无法取代

marsbit3小时前

通过掷骰子离线保管比特币密钥:并非人人愿意为之

文章探讨了通过投掷骰子生成比特币钱包种子短语的安全方法及其现实挑战。核心观点如下: **1. 骰子提供物理熵源** 骰子结果由众多微小变量决定,理论上虽可预测,但实践中无法被攻击者复制或计算,从而提供高质量的随机性。每个六面骰子投掷约产生2.585比特熵,50次投掷即可满足典型12词助记词(128比特熵)的安全需求。 **2. Coldcard漏洞事件凸显手工熵源的价值** 近期Coldcard硬件钱包因固件漏洞导致其内部随机数生成器存在缺陷,致使约1128枚比特币被盗。但那些**完全**通过足量骰子投掷生成种子短语的用户未受此漏洞影响,因为他们的主密钥未使用有缺陷的生成器。 **3. 重要警示:手工种子并非万能保护** 安全研究员指出,即使用户使用骰子生成了安全的种子,若他们使用了Coldcard的其他功能(如生成纸钱包、克隆密钥、共享签名密钥、密码等),这些**衍生密钥**仍可能调用有漏洞的随机数生成器,从而存在风险。安全种子不保证设备生成的所有秘密都安全。 **4. 手工生成熵源的现实局限性** 尽管数学上可靠,但该方法对大多数用户并不友好: * **过程繁琐易错**:需投掷50-99次,精确记录,任何输入错误都会导致钱包完全不同。 * **引入新风险**:用户可能在记录、转换过程中泄露信息,或使用有偏的骰子/投掷方式。 * **用户体验差**:难以想象大规模推广需要用户手动投掷近百次骰子。安全措施需适应现实生活场景和普通用户的知识水平。 **5. 给用户的建议** 受影响的Coldcard用户应: * 更新固件至最新版。 * 检查是否使用过有漏洞的功能生成了次级密钥或密码,如有则需立即更换。 * 考虑采用多签方案,使用不同厂商的设备分散风险。 **结论**:手工投掷骰子生成熵源是技术娴熟用户的一个有效安全选项,但其过程复杂、容易出错,不适合作为主流用户的默认方法。长远目标是依赖安全、透明且无需专业知识的硬件/软件随机数生成方案。

cryptonews.ru6小时前

通过掷骰子离线保管比特币密钥:并非人人愿意为之

cryptonews.ru6小时前

交易

现货

热门文章

从H2A到A2A:AI Agent经济体与Crypto新机遇

6月17日,哈佛大学独立研究员、美国AI科学院(NAAI)通讯院士、比特币基金会终身会员韩锋做客火币HTX《大咖讲堂》第三期,以《从H2A到A2A》为主题,分享了其对Agent经济、Crypto基础设施及数字社会未来发展的思考。

533人学过发布于 2026.07.01更新于 2026.07.01

从H2A到A2A:AI Agent经济体与Crypto新机遇

美股TradFi:传统金融在AI IPO浪潮下的稳健锚点

2026年,美股IPO市场重回高热度。本文梳理即将上线或受关注的热门赛道龙头,分析具备投资潜力的交易标的及其逻辑,并探讨宏观趋势与相关风险。

2.5k人学过发布于 2026.07.08更新于 2026.07.08

美股TradFi:传统金融在AI IPO浪潮下的稳健锚点

相关讨论

欢迎来到HTX社区。在这里,您可以了解最新的平台发展动态并获得专业的市场意见。以下是用户对AI(AI)币价的意见。

活动图片