ADK.wang AI & 软件技术百科
全库汇聚全球 22,000+ 核心技术词条,深度引证上千本行业权威学术专著,涵盖大模型原理、云原生、架构设计与工程效能。
22,077
全量学术技术词条
9 大
核心专业领域体系
10,000+
权威专著深度引证
100%
原书精粹与工业对齐
专业技术领域分类
共 1516 篇词条大模型是人工智能 (AI)
大模型是人工智能(AI)的一个分支,而“人工智能” 概念的首次提出则源于1956年美国达特茅斯会议,这个概念到现在已经发展很多 年了。
大模型是大规模语言模型
Large Language Model
大模型是什么? 大模型是大规模语言模型(Large Language Model)的简称。
头条
Science Headline News
年,北京通用人工智能研究院(以下简称通研院)与北京大学的合作研究成果 “实时双向人机价值对齐”(Bidirectional human-robot value alignment)登 上Science头条(Science Headline News),如图...
奖赏网络 (RM)
它负责 ChatGPT 预训练中微调的部 分,首先在人类的帮助下训练一个奖赏网络(RM),RM 对多个聊天回复的质量进行排序,从 而增加 ChatGPT 对话信息量,使其回答具有人类偏好。
套利管理公司
Arbitrage Management Company
[1] 套利管理公司(Arbitrage Management Company)利用《击败市场》中的对冲概念获利。
女性主义国际联盟 (FINRRAGE)
”抵制生殖工程与遗传工程的女性主义国际联盟(FINRRAGE)宣传单里这些无关痛痒的短语,如果从行动来看,就是通往双行道的路标,需要的时候,就让那个被损害的他者成为老师。
如命名实体 (NER)
本章讲述如何微调标记分类任务的语言模型[如命名实体识别(NER)、词性标注(POS)和问题回答(QA)系统]。
如嵌入
Embedding
例如,可以在文档数据库中执行逆规范化,但这个过程采用了不同的术语表达,如嵌入(Embedding)。
如归纳 (IC)
基于独立的方法 基于独立的方法,如归纳因果 ( IC) 算法 、 SGS (以发明者 Spirtes 、 Glymour 和 U9 ♦ 因果推理 : 基础与学习算法 Schemes 名字命名)和 PC 算法假设分布对潜在的 DAG 是忠实的。
如探索性测试
Exploratory Testing
选择“X 模型”这一名称是由于X一般代表未知,而Marick也认为他的观点并不足以支撑一个完整的模型,但已经含有一个模型所需要的部分主要内容,包括模型中的一些亮点,如探索性测试(Exploratory Testing)。
如正电子发射断层成像扫描 (PET)
通过用各类脑成像技术,如正电子发射断层成像扫描(PET)、单光子发射计算机断层显像扫描(SPECT)、功能磁共振成像(fMRI)或定量脑电图(QEEG),对患有注意力缺陷多动症的儿童、青少年和成人进行检测,我们能发现大部分患者脑内都存在这种明显的“不活跃”。
如深度确定性策略梯度 (DDPG)
深度强化学习算法原理和神经网络结构在设计上也存在着交叉融合和互相学习,如深度确定性策略梯度(DDPG)算法和行动者-批评家(AC)算法具有同样的算法设计思想。
如渐进幅度剪枝
Gradual Magnitude Pruning
图9.9 SparseGPT重建算法的可视化 (图片来源:论文 “SparseGPT: Massive Language Models Can Be Accurately Pruned in One-Shot”) 大多数现有的剪枝方法,如渐进幅度剪枝 (G...
如简单句子嵌入对比学习
SimCSE
存在许多方法,如简单句子嵌入对比学习(SimCSE)、 10 对比张力(CT)、 11 基于 Transformer 的序列去噪自动编码器(TSDAE)、 12 以及生成伪标签(GPL)。
如精确匹配 (EM)
它会 使用不同的评估方法,如精确匹配 (EM) 评分和基于LLM 的奖励函数。
如非对称模式 (AMP)
包括编码块、变换块的最小尺寸和最大尺寸,帧内、帧间预测编码时变换块的最大划分深度,对4:4:4采样格式的三个通道分量是否单独编码,是否需要帧内强滤波,帧间预测过程中的某些限制条件[如非对称模式(AMP)的使用、时域MV预测的使用]是否使用量化矩阵,是否需要...
子智能体
Local Network
图中的智能体分成了两类,一类是中心主智能体(Global Network),另一类是子智能体(Local Network)。
字嵌入
Word Embedding
在前面我们讲解了Word2Vec算法,这是自然语言处理中较为常用的对字符进行转换的方法,即将“字”转换成“字嵌入(Word Embedding)”。
字符流转变为标记
Token
词法、语法分析 词法分析是将源代码的字符流转变为标记(Token)集合的过程,单个字符是程序编写时的最小元 素,但标记才是编译时的最小元素。
字节豆包大语言模型 (WIP)
AI、百川大语言模型、字节豆包大语言模型(WIP)、MINIMAX、Groq和Ollama等模型。
孟山都公司是橙剂
Agent Orange
与陶氏化学公司一样,孟山都公司是橙剂(Agent Orange)的主要生产商。
学习平台
ByteLearning
学 学习 习资 资源:搭建内部学习平台(ByteLearning),上线 “Agent
学习推理
Self-Taught Reasoner
此外,研究者还设计了一种使模型自我提升能力的方法 [57] ,名为自学习推理( Self-Taught Reasoner)。
学习网络 (DQN)
脚本main.py将环境、深度双Q学习网络(DQN)和智能体的代码按照逻辑整合在一起,实现基于增强学习的无人驾驶车。