ADK.wang AI & 软件技术百科
全库汇聚全球 22,000+ 核心技术词条,深度引证上千本行业权威学术专著,涵盖大模型原理、云原生、架构设计与工程效能。
22,077
全量学术技术词条
9 大
核心专业领域体系
10,000+
权威专著深度引证
100%
原书精粹与工业对齐
专业技术领域分类
共 1516 篇词条Oriented Programming (OOP)
LLMs to help their company’s engineers, including Chat-Oriented Programming (CHOP), API-based automation, AI agents, assistants ...
活跃用户数 (MAU)
DeepSeek可以说是一个现象级的AI产品,根据“AI产品榜”网 站的数据,上线20天,DeepSeek日活跃用户数(DAU)超2000万,用户数达到 ChatGPT的40%(见图1-22)。
量空间模型
Vector Space Model
向 量 索引 向量索引也称为向量空间模型(Vector Space Model),是一种用于文本检索的索 引技术,它将文档表示为高维向量,每个维度表示一个词语在文档中出现的频率或 权重。
扩散模型
Latent Diffusion Model
成式对抗网络以外,另外两种模型是2013年由迪德利克·金马(Diederik Kingma)提出的变分自编码器(Variational Auto Encoder,VAE)以及2015年由雅沙·索尔迪克斯坦(Jascha Sohl-Dickstein)提出的...
编码
Unary Code
图11-2 NLI任务的孪生网络结构图 从图11-2中我们可以看出,该网络结构主要包含4层:词表示层(Embedding Layer)、编码层(Encoder Layer)、融合层(Aggregated Layer)和预测层(Predict Layer)。
Command Line Interface (CLI)
可以用以下 `pip` 命令安装 TensorFlow Serving Python API: > `$ pip install tensorflow-serving-api` 安装完成后,便能开始使用 SavedModel Command Line In...
机器
Maschinismus
加利福尼亚大学伯克利分校认知心理学教授艾莉森·高普妮克 (Alison Gopnik)在近期的文章(第一作者为Yiu)中也指出,大模型是一种模仿 机器(Imitation),缺乏认知推理所需的创造力(Innovation),许多人类婴儿 都能完成的任务,大...
式人工智能 (GAI)
生成式人工智能( AI )目前处于 期望膨胀期 ,预计将在 2~5 年 内产生巨大效益 到 2026 年, Gartner 预测超过 80% 的企业将使用生成式 AI 的 API 或模型,或在生产环境中部 署支持生成式 AI 的应用,而在 2023 年初这...
提示词工程
Prompt Engineering
目前,尝试解决LLM领域专业化问题的方法分为3类:外部增强(External Augmentation)、提示词工程(Prompt Engineering)和模型微调(Model Fine-Tuning),如图5-1所示。
张量处理单元 (TPU)
在训练机器学习模 型时,图形处理单元(GPU)、张量核心、张量处理单元(TPU)和现场可编程门阵列(FPGA) 等机器学习的专用硬件组件比传统CPU 快数百倍(Vasilache et al., 2014; Jouppi et al., 2017)。
慕课 (MOOC)
作为教育从业者,我听说和亲历过多次技术浪潮对教育领域的冲击:从50年前的电视教学假想到20世纪90年代互联网的爆炸式增长,再到十几年前的慕课(MOOC)浪潮,如今生成式AI又开始重塑知识生产模式……似乎每一次技术登场都曾引发“颠覆教育”的恐慌,但事实证明,...
马太效应
Matthew effect
社会学家罗伯特·默顿(Robert Merton)把这种已经拥有更多的人未来也能够得到更多的现象称为马太效应(Matthew effect),正如《圣经》中所说:“凡有的,还要加给他,叫他有余;凡没有的,连他所有的,也要夺去。
政策 (QE)
在美國的第一波衝擊 ,開始於房市崩盤,然後蔓延成更廣泛的信用緊縮,並以雷曼兄弟申請破產及啟動「問題資產救助計畫」(Troubled Asset Relief Program; TARP)和量化寬鬆政策(QE)作收。
循环单元 (GRU)
常用的预训练模型有Word2Vec、BERT、NEZHA等,用来表征Token的语义信息;而下接结构如双向长短时记忆(BiLSTM)网络、双向门控循环单元(BiGRU)、R-Transformer [1] 、空洞卷积(IDCNN) [2] 等模型结构则是用...
掩码语言建模 (MLM)
值得注意的是,BERT模型采用的掩码语言建模(MLM)与下一句预测(NSP)双任务训练框架,展现了预训练模型在语义理解维度的全新可能,这种技术路线差异实质上反映了生成式与判别式模型在应用场景上的分野。
梯度消失
Vanishing Gradients
图7.27 循环神经元 3.梯度消失 梯度消失(Vanishing Gradient)主要出现在激活函数的梯度非常小的情况下,因为反向传播过程中权重乘以这些梯度时,随着网络进一步深入会导致梯度逐渐消失。
参数高效微调 (PEFT)
为了解决这个问 题,我们探索了使用量化技术,在较小的GPU上运行大型模型的推理,并讨论了参数高效微调 (PEFT)技术,以减少计算和磁盘空间的需求。
注意力缺陷障碍 (ADD)
要是考虑到她的“冲动”有可能是受到伤害的结果,那么把蒂娜说成是“反叛的”,是不是有点误导呢?她认为在公众场合与成年人或是同伴有性举动是正常的,又该如何解释这一令人困惑的现象呢?该如何解释她语言表达迟缓的现象呢?要是她真的是注意力缺陷障碍(ADD),那么受到...
状态机
State Machine
与前面介绍的基于“对话” 的框架(如 AutoGen 和 CAMEL)不同,LangGraph 将智能体的执行流程建模为一种状态机(State Machine), 并将其表示为有向图(Directed Graph)。
集团 (USB)
就是这么一个在其开发者眼里“平淡无奇"的应用, 却在全球范围引发了一场始料未及的智能化“海啸"! 200万… 500万… 1 000万… 3 000万… 瑞士跨国投行瑞银集团(UBS)发布的一份研究报告 显示,ChatGPT上线仅仅2个月后— 2023年1...
Exploratory Data Analysis (EDA)
to use that time for Exploratory Data Analysis (EDA),
Large Language Models (LLM)
eneral, corporations are on the precipice of something really, really big. Comparing RAG with Model Fine-Tuning#nEstablished Lar...
无线局域网 (WLANA)
准是居于主导地位的局域网标准,主要定义了IEEE 802.X协议簇,其中IEEE 802.3为以太网标准协、IEEE 802.4为令牌总线网(Token Bus)标准、IEEE 802.5为令牌环网(Token Ring)标准、IEEE 802.11为无线...
知识蒸馏
Knowledge Distillation
❷ 模 型 的 性能 优化 : AI训练师可以采用一系列技术手段来减小模型的体积、降低 计算复杂度并提高运行速度,包括模型剪枝(Model Pruning)、模型量化(Model Quantization)、知识蒸馏(Knowledge Distillat...