ADK.wang AI & 软件技术百科
全库汇聚全球 22,000+ 核心技术词条,深度引证上千本行业权威学术专著,涵盖大模型原理、云原生、架构设计与工程效能。
22,077
全量学术技术词条
9 大
核心专业领域体系
10,000+
权威专著深度引证
100%
原书精粹与工业对齐
专业技术领域分类
共 1516 篇词条低资源微调
LoRA
DeepSeek提供强大的模型微调技术,低资源微调(LoRA)、增量学习、梯度检查点机制和分布式训练框架相互配合,可为用户提供高效定制方案。
修正线性单元
ReLU
前三层的激活函数(表示为基于Activation类的实例的附加层)是非常常见的,称为 修正线性单元 (ReLU),其定义如下: 这个函数的主要优点是,虽然是非线性的,但它具有x>0的恒定梯度。
公共代理程序
Common Agent
IBM Systems Director对安装了公共代理程序(Common Agent)的系统提供以下功能。
加性噪声模型 (ANM)
因果推理 : 基础与学习算法一 4.1.4 非线性加性噪声模型 现在描述的是加性噪声模型( ANM ),这是 SCM 类的一个不那么极端的限制,.这种结 构因果模型仍然强大到足以使原因-效果推断可行。
区别
Skills vs System Prompt
它和System Prompt有什么区别(Skills vs System Prompt) 你可能会想:这不就是一个System Prompt吗?写一堆指令让AI遵守,有什么新鲜的? 区别很大。
区间向量
Range vector
·区间向量(Range vector):一组时间序列,每个时间序列包含一段时间范围内的样本数据。
原始序列图
Sequence Diagram
原始序列图(Sequence Diagram) 在多语言 RAG 系统中,语言标记的全链路传递至关重要。
去噪扩散策略优化 (DDPO)
去噪扩散策略优化(DDPO)是一种使用强化学习来微调扩散模 型并提高生成图像质量的方法。
可逆分词
Reversible Tokenization
生 成 式预 训 练的 误差 反向 传播 过 程 GPT系列都采用了基于数据压缩的可逆分词 (Reversible Tokenization)方法(参见4.2.3节),为了说明生成 式预训练的误差反向传播过程,此处简化词的初始嵌入表示。
均匀分布 (IID)
使用随机梯度下降时,训练实例必须独立且均匀分布 (IID),以确保平均而言将参数拉向全局最优值。
大白话大模型人类反馈强化学习 (RLHF)
大白话大模型人类反馈强化学习(RLHF) - 基于人类偏好的优化 我们用训练小海豚表演来解释"人类反馈强化学习",就像用小鱼奖励教会海豚完美的后空翻!
大白话大模型参数规模
Parameter Scale
大白话大模型参数规模(Parameter Scale) - 模型可训练参数总量 我们用乐高城堡来解释“参数规模”,就像数积木块一样简单!
大白话大模型少样本学习
Few-shot Learning
大白话大模型少样本学习(Few-shot Learning) - 少量示例引导推理 我们用教小外星人学地球规则来解释“少样本学习”,就像只给它看几个例子就能举一反三!
大白话大模型微调
Fine-tuning
大白话大模型微调(Fine-tuning) - 特定任务的有监督训练 我们用教机器人当小厨师来解释“微调”,就像给它上烹饪特训班!
大白话大模型思维链
Chain-of-Thought
大白话大模型思维链(Chain-of-Thought) - 分步推理提示技术 我们用做数学题的思考过程来解释“思维链”,就像把解题步骤一步一步说出来一样简单!
大白话大模型指令微调
Instruction Tuning
大白话大模型指令微调(Instruction Tuning) - 指令响应优化训练 我们用教小狗狗学指令来解释"指令微调",就像训练狗狗从"随便叫"变成"精准完成动作"!
大白话大模型提示工程
Prompt Engineering
大白话大模型提示工程(Prompt Engineering) - 设计优化输入提示 我们用魔法咒语说明书来解释“提示工程”,就像教你怎么念咒语才能让机器人听懂你的愿望!
大白话大模型温度参数
Temperature
大白话大模型温度参数(Temperature) - 控制生成随机性 我们用冰淇淋机旋钮来解释“温度参数”,就像调节机器人的“脑洞大小”一样简单!
大白话大模型解码策略
Decoding Strategy
大白话大模型解码策略(Decoding Strategy) - 文本生成采样方法 我们用冰淇淋机按钮游戏来解释“解码策略”,就像选择怎么挤出不同形状的冰淇淋一样好玩!
大白话大模型词嵌入
Word Embedding
大白话大模型词嵌入(Word Embedding) - 词语的向量化表示 我们用乐高积木来解释“词嵌入”,保证像搭积木一样直观!
大脑模块
Brain
这 个大脑模块 (Brain) 是 AI Agent 智能行为的核心,是一个高度集成的系统,负 责处理信息、做出决策和规划行动。
大语言模型智能体
LLM-based Agent
大语言模型智能体(LLM-based Agent) 谷歌的Transformer技术和OpenAI的GPT预训练技术凭借规模定律(Scaling Law)的优势,使大语言模型展现出强大的语言理解能力和解决通用问题的能力。
存储容量跟踪
Storage Capacity Tracking
要启用CSI存储容量跟踪(Storage Capacity Tracking)特性,就需
属性预过滤器
SimplePropertyPreFilter
利用 JSON.toJSONString 方法序列化指定属性字段,主要通过设置属性预过滤器 (SimplePropertyPreFilter)的包含属性字段列表(includes)实现。