被遗忘权
Definition
被遗忘权使用户有权要求从数据库和 AI 训练集中移除其个人信息。在机器学习中实施这一权利具有挑战性,因为模型可能已经将从这些数据中学习到的知识固化在参数中。
Summary
一项 …
欢迎使用 AI术语词典 — 一部全面的多语种人工智能术语参考工具。
被遗忘权使用户有权要求从数据库和 AI 训练集中移除其个人信息。在机器学习中实施这一权利具有挑战性,因为模型可能已经将从这些数据中学习到的知识固化在参数中。
一项 …
在人工智能中,当模型学习并放大训练数据中存在的社会偏见时,就会产生刻板印象。这可能导致歧视性结果,例如将某些职业与特定性别联系起来。
一种概括性的、往往过于简化的 …
课程学习模仿人类教育过程,以结构化的顺序呈现训练数据,通常从简单样本开始,并逐渐增加复杂度。这种方法有助于神经网络更好地收敛并提高泛化能力。
一种训练策略,模型先 …
模型提取涉及查询目标机器学习模型的 API,以推断其内部结构、权重或决策边界。攻击者利用这些查询构建一个代理模型,从而窃取知识产权或绕过安全限制。
一种攻击方式, …
数据最小化是一项核心的隐私原则,要求组织将数据收集限制在充分、相关且必要的范围内。在人工智能领域,这意味着设计能够减少不必要数据依赖的模型。
仅收集和处理特定目的 …
Wumpus World 是 Russell 和 Norvig 的 AI 教科书中引入的一个基于网格的环境。智能体必须在网格中导航以寻找金子,同时避开陷阱和一个名为 Wumpus …
XLM-RoBERTa(跨语言语言模型 RoBERTa)是由 Meta AI 开发的大规模多语言模型。它通过在一个涵盖 100 多种语言的多样化数据集上进行预训练, …
后门攻击涉及使用特定的模式(称为触发器)对机器学习模型的训练数据进行投毒。虽然模型在干净数据上表现正常,但在检测到触发器时会激活错误的行为,例如将特定图像错误分类为指定标签, …
零样本提示涉及直接通过文本提示要求预训练语言模型完成任务,而不提供任何少样本示例或进行额外的微调。该模型利用其在大规模数据上学习到的通用知识和指令遵循能力来生成响应, …
泽滕策略是一种基于规则的博弈方法,用于多智能体谈判。它计算智能体为推动其首选结果而愿意承担的最大风险,定义为智能体在坚持立场时可能遭受的效用损失与其在妥协时的效用损失之比, …
TensorBoard 是一套用于检查和理解 TensorFlow 运行过程和计算图的 Web 应用程序套件。它提供了可视化损失和准确率等指标随时间变化的工具,以及查看模型图的功 …
TensorFlow Hub 是一个发布和复用机器学习组件的平台。它允许开发者访问针对图像分类、文本嵌入等各种任务预训练的模型。
一个用于可复用机器学习模块的仓 …
当机器学习模型相对于较旧的数据点不成比例地赋予近期观测值更高权重时,就会发生时间偏差。这通常是由于数据分布的非平稳性或特定的训练协议所致。
一种系统性误差,模型倾 …
文本分类是一种监督学习任务,算法为无结构的文本数据分配预定义的类别。常用技术包括朴素贝叶斯、支持向量机和深度学习模型。
根据内容或语义含义将文本归类到不同组织组的 …
在计算机科学和深度学习中,张量是一种数学对象,它将标量、向量和矩阵推广到更高维度。它由其秩(维度数量)和形状等特征定义。
一种多维数组,是深度学习框架中的基本数据 …
符号回归是一种回归分析类型,旨在找到通常表示为树结构的数学表达式,以最优地拟合观测数据。与传统回归不同,它不预设函数形式。
符号回归是一种搜索最佳拟合数据集的数学 …
在人工智能中,符号级代表一种高级抽象,其中知识使用离散符号而非连续数值进行编码。这种方法对于基于符号的推理至关重要。
符号级是指离散符号在AI系统中代表概念、对象 …
符号人工智能(常被称为GOFAI,即“老式好AI”)依赖于操纵符号和规则来进行推理和问题解决。与连接主义方法不同,它赋予系统明确的逻辑处理能力。
符号人工智能是一 …
双曲正切(Tanh)函数是一种非线性激活函数,常用于神经网络。它将输入值压缩到(-1, 1)区间内,提供零中心的输出,这有助于加速收敛。
Tanh(双曲正切)是一 …
文生图(T2I)生成涉及使用深度学习模型(如扩散模型或GANs),根据自然语言提示合成图像。这些模型学习文本与图像之间的相关性。
T2I …