反向传播

来源:图片由作者提供;作者:斯蒂芬·怀特洛;

反向传播是一种用于训练神经网络的方法。其工作原理是将模型的输出与正确答案进行比较,计算误差,然后将该误差向后传递至网络,以调整其内部参数。通过大量示例的训练,模型会逐渐得到改进。反向传播是现代深度学习背后的关键技术之一。

词袋模型

来源:图片由供稿方提供;作者:斯蒂芬·怀特劳;

“词袋模型”是机器学习中一种简单的文本表示方法。它忽略语法和词序,仅统计各词的出现次数。 例如,在“词袋”模型中,“AI 帮助企业”和“企业帮助 AI”可能看起来非常相似。虽然它不如现代语言模型复杂,但在某些文本分类任务中仍然很有用。

基础模型

图片来源:供图;作者:斯蒂芬·怀特劳;

基础模型是指已在广泛数据集上经过训练,但尚未针对特定用途进行专门优化的AI模型。 例如,通用语言模型可先经过训练用于文本预测,随后通过微调转变为实用助手、法律摘要生成器或编程工具。基础模型是构建更专业化系统的基石。

贝叶斯人工智能

图片来源:供图;作者:斯蒂芬·怀特劳;

贝叶斯人工智能利用概率来处理不确定性。与仅给出单一答案不同,贝叶斯方法能够随着新证据的出现而更新其信念。这在医学、预测、垃圾邮件检测和风险分析中非常有用。其基本思路很熟悉:当出现新信息时,我们会修正自己对可能性的判断。

束搜索

图片来源:供图;作者:斯蒂芬·怀特劳;

束搜索是一种用于人工智能系统生成序列(如文本或翻译)的技术。模型不会每次都只选择最可能的下一个单词,而是保留多个可能选项并进行探索。这可以改善最终输出结果。这有点像在选择最佳行程之前,先考虑几条可能的路线。

BERT

图片来源:供图;作者:斯蒂芬·怀特劳;

BERT是一款在当前这波大型对话式AI工具兴起之前开发的影响力深远的语言模型。它通过从两个方向分析上下文中的单词(而非简单地从左到右阅读),帮助计算机理解文本。BERT被广泛应用于搜索、分类和语言理解任务中,为更先进的语言模型铺平了道路。

偏见

图片来源:供图;作者:斯蒂芬·怀特劳;

在人工智能领域,偏见可以有多种含义。从技术角度而言,它可能指模型中内置的假设;从社会角度而言,则指影响个人或群体的非公平或失真的结果。这两种含义都至关重要。一个有用的AI系统需要建立在正确的技术假设基础上,但必须避免有害的社会偏见。

大数据

图片来源:供图;作者:斯蒂芬·怀特劳;

大数据是指规模极其庞大、结构极其复杂或变化极其迅速的数据集,传统方法难以处理。人工智能从大数据中获益匪浅,因为许多机器学习系统在更多示例的训练下性能会得到提升。然而,数据越多并不总是越好。质量低劣、存在偏见或不相关的数据仍可能导致人工智能表现不佳。