ADK.wang AI & 软件技术百科
全库汇聚全球 22,000+ 核心技术词条,深度引证上千本行业权威学术专著,涵盖大模型原理、云原生、架构设计与工程效能。
22,077
全量学术技术词条
9 大
核心专业领域体系
10,000+
权威专著深度引证
100%
原书精粹与工业对齐
专业技术领域分类
共 1516 篇词条数据存储空间
LocalTensor
核内数据存储空间 核内数据存储空间(LocalTensor)用于存放AI Core 中内部存储(Local Memory)的数据。
数据空间
GlobalTensor
外部存储数据空间 外部存储数据空间(GlobalTensor)用来存放AI Core 外部存储(Global Memory)的全局数 据。
文本嵌入模型
Text Embedding Model
.检索 检索模块的核心能力是实现检索增强生成所需要的模块,包括文档加载器(Document Loader)、文本分割(Text Splitter)、文本嵌入模型(Embedding Model)、矢量存储(Vector Store)和检索召回(Retrie...
普斯普剂 (PCP)
在故事开头,一个叫A.J.的男子在普斯普剂(PCP)的作用下,产生幻觉,闯入了一栋他认为是自己的房子。
晶圆级引擎 (WSE)
已经出现了一些针对人工智能应用进行调整的硬件,如图形处理单元(GPU)、张量处理 单元(TPU)和晶圆级引擎(WSE)。
智能体系统
Pi Agent
https://github.com/inclusionAI/ASearcherv 判断技术潜力和未来展望 InfoQ:判断技术潜力从单个Agent到多智能体系统(Multi-Agent),在实际落 地过程中面临哪些新的挑战和机遇? 吴翼:目前来看,mul...
智能实验室
Future Intelligence Lab
作者简介 未来智能实验室 ( Future Intelligence Lab )由多名国内顶尖高校的博 士、硕士组成,专注于大模型的研发与创新,聚焦自然语言处理、深 度学习、计算机视觉和多模态学习等领域。
有注意力缺陷多动症 (ADHD)
~17岁的孩子中,8%有学习障碍,7%有注意力缺陷多动症(ADHD)。
有限状态 (FST)
Completion Suggester 使用有限状态转换( FST )查找提示词。
查询切词
Query Tokenization
.用户查询切词 用户查询切词(Query Tokenization)是指将用户输入的查询字符串 分割成一系列可管理的单元,通常是单词、短语或其他有意义的元 素,其统称为“词项”(Tokens)。
梯度优化
Gradient Method
这允 许对程序中的参数的基于梯度优化(Gradient Method),通常使用梯度下降或其他基于高阶微 分信息的学习方法。
梯度提升算法
Gradient Boosting Algorithm
· 梯度提升算法(Gradient Boosting Algorithm)。
梯度累积
Gradient Accumulation
此外 , 训练层还需要优化计算效率 , 例如通过梯度累积 ( Gradient Accumulation ) 降低显存消耗 , 或者采⽤混合精度训练 ( FP16+FP32 ) 加速收敛。
梯度裁剪
Gradient Clipping
那么,深度神经网络是如何应对这两大难题的呢? 1. 梯度裁剪 梯度裁剪(Gradient Clipping)又称为梯度剪切,顾名思义,就是减掉多余的部分,主要是针对梯度爆炸提出的方法。
概率推理
Gaussian error model
第14 章 时间上的概率推理 (Gaussian error model)来涵盖连续和离散版本。
模型微调 (SFT)
首先针对开源日志,大语言模型已经有了不错的分析能力、利用模型微调(SFT)技 术可以小幅提升对于开源组件日志的解析能力,但实际上随着基座模型的更新迭代,提 升幅度往往不如新一代的基座模型,因此开源大语言模型的评测工作也变得尤为重要。
模型服务
Model Serving
> > ● 模型服务 (Model Serving)、 模型评分 > (Model Scoring)、 模型推理 (Model Inference)和 模型预测 (Model > Prediction)在深度学习背景下是可以互换使用的术语。
模型适配
Models
.模型I/O 模型I/O模块的核心能力是通过设计模型适配(Models)、提示词模板 (Prompt Templates)和输出解析器(Output Parsers)这3个模 块,适配不同大模型框架的调用。
欧洲人工智能学会
European Association for AI
Intelligence,SIGAI,其前身为SIGART)、欧洲人工智能学会(European Association for AI) 以及人工智能和行为模拟协会(Society for Artificial Intelligence and Simula...
求平均值 (AVERAGE)
其中,聚合方式主要有原始数据(RAWDATA)、计数(COUNT)、去重计数(COUNT DISTINCT)、求和(SUM)、求平均值(AVERAGE)、求最大值(MAX)、求最小值(MIN)等,如图5-6所示。
注意力解码器 (RNN)
I love llamas 词嵌入 编码器 (RNN) 注意力解码器
测量 (OGSM)
目的、目标、策略、测量(OGSM)之间的关系非常紧密,有这么几层关系: 1.目的是主体前进的大致方向,目标是实现目的的量化标准,策略是实现目标的具体方法,测量是实现策略的量化标准。
混合专家架构
MoE
( 1 )混合专家架构( MoE )优化: DeepSeek-V3 采用最新的 MoE 架 构,通过动态路由机制实现专家选择的高效性与准确性。
混合器
TokenMixer
MB 由未指定的token 混合器(TokenMixer)和一个MLP 块组成,可以表示为 1 MB MLP TokenMixer i i i i X X X 其中, i X 是输入到第i 个MB 的中间特征。