跳到主要内容
返回课程

第 5 周 · 第 3 课 · 50-60 分钟

调查人工智能内容,并做出一个伦理决定

学会通过找到原始出处、核对上下文、独立确认,来核实人工智能生成的内容和网上的内容,然后在人的监督和申诉权之下做出一个伦理决定。

材料
在网页浏览器中打开的这节课 · 纸和笔,或者一个记事应用
本课
进行中

会自动保存在这台设备上

你将能够做到

  • 给深度伪造和错误信息下定义,并说明它们如何误导人。
  • 通过找到一个说法的原始出处并核对上下文来核实它。
  • 使用来自彼此独立且可信来源的独立确认。
  • 说明为什么人工智能的重要决定需要人的监督和申诉权。

想一想

网上流传着一段视频,画面中一位著名科学家说了非常惊人的话。看起来、听起来都很真。在相信它或转发它之前,你会想先核实什么?

如今人工智能已经能造出以假乱真的图像、视频和音频,所以「看起来是真的」已经不足以让人相信一样东西了。

做个预测

预测一下:如果同一个惊人说法出现在五个账号上,而它们都是照抄同一条帖子,这算不算五次独立确认?

深度伪造
由人工智能制作或篡改的照片、视频或音频,让某个人看起来在说或在做他其实并没有说过、做过的事。
错误信息
传播开来的虚假或有误导性的信息,不论转发的人是否有意欺骗。
原始出处
一个说法、一段引语或一张图片在被复制或转发之前,最早真正出现的地方。
上下文
围绕某件事的完整来龙去脉,也就是何时、何地、为何发生,它赋予一个事实真正的含义。
独立确认
用两个或更多彼此独立、并非互相照抄的可信来源来核对一个说法。
人的监督
由人来复核人工智能的重要决定并对其负责,而不是让软件自己说了算。
申诉
你有权要求由人来复核、并在必要时更改人工智能对你做出的某个决定。

深度伪造与错误信息:为什么「看起来是真的」不算证据

深度伪造是指人工智能制作或篡改出来的照片、视频或音频,让某个人看起来在说或在做他从未做过的事。由于人工智能在这方面越来越强,一段视频完全可能看着、听着都很有说服力,实际上却是假的。

错误信息是指传播开来的虚假或有误导性的信息。它不一定是深度伪造,转发的人也未必想误导别人:一张真实的照片配上虚假的说明照样会流传。无论哪种情况,办法都一样:不要仅仅因为某样东西看着像真的、或者很多人转发过,就去相信它。

  • 一段视频里,人物的口型和声音被人工智能改动,伪造出一句引语。
  • 一张真实的旧照片被重新转发,并谎称是今天发生的事。
  • 一个编造出来的「统计数字」,被重复太多次,以至于开始让人觉得是真的。

找到原始出处,核对上下文

要核实一个说法,就把它追溯到原始出处,也就是它在被复制、转发之前最早真正出现的地方。一段引语的截图不是出处;真正的报道、视频或官方页面才是。如果你根本找不到任何原始出处,那就是一个警示信号。

然后核对上下文:何时、何地、为何发生。一张真实的照片如果年代久远、来自别的地方,或者缺了周围的来龙去脉,同样可能误导人。上下文正是把一个孤零零的事实,变成一个诚实的事实的东西。

  • 把一句引语追溯到它被剪出来的那场完整访谈。
  • 发现一张「突发」照片其实是好几年前某场活动的。
  • 读完整段声明后发现,那句引语是从半句话里截断的。

独立确认:彼此独立的来源,而不是回声

单一来源可能出错,所以有分量的说法需要独立确认:两个或更多彼此独立、并非互相照抄的可信来源。十个账号转发同一条帖子,仍然只是一个来源在回声,而不是十次确认。

要做独立确认,就去找那些自己独立得出这一说法的报道或记录:另一家新闻机构、一个官方页面、一位专家。如果彼此独立的来源都一致,这个说法为真的可能性就大得多。如果只有一个来源提到它,就继续保持谨慎。

  • 两家不同的新闻机构,各自独立地报道了同一件事。
  • 一家官方机构在自己的页面上确认自己发布的消息。
  • 发现五个「来源」最后都指向同一条帖子。

人的监督与申诉权

人工智能可以帮忙标记可能的伪造内容或整理信息,但它会出错,所以重要的决定需要人的监督,也就是由一个人来复核这个决定并对它负责。当一个决定会影响某人的生活时,这一点最为要紧,比如把一条帖子标记为虚假、给作业评分,或者封禁一个账号。

受人工智能决定影响的人,也应当拥有申诉权:可以要求由人来复核这个决定,并在人工智能弄错时予以更改。监督和申诉,正是我们让人、而不是软件,掌控重要决定的方式。

  • 在任何帖子被删除之前,由人来复核人工智能标记出来的内容。
  • 学生请老师重新核对一道由人工智能评分的答案。
  • 在人工智能误封账号之后,用户向人工客服提出申诉。

例题讲解

调查一段惊人的爆红视频

  1. 转发之前先停一停。这段视频既惊人又煽情,而这恰恰是错误信息传播最快的时候。
  2. 找到原始出处。去搜索完整视频或官方声明,而不只是别人转发的那个短片段。
  3. 核对上下文。你会发现这段片段是从一场更长的演讲里剪出来的,而那位讲者说的其实是相反的意思;这句引语被断章取义了。
  4. 做独立确认。去找一个彼此独立且可信的来源。没有任何独立媒体报道过这个惊人说法,这是一个强烈的信号,说明它并不属实。
  5. 在监督与申诉之下作决定。因为事关重大,是由一位人工审核员、而不是人工智能自己来复核并把它标注为具有误导性,而发帖者如果拿得出真实证据,可以提出申诉。

要点:在对一个严肃说法采取行动之前,先按出处和上下文核实,再做独立确认,并让人保持在掌控之中、留有申诉的途径。

网络内容核查清单

一个四步流程,用于在相信或转发之前核查一个说法。第 1 步:找到原始出处(它最早出现的地方,而不是一张截图)。第 2 步:核对上下文(何时、何地、为何发生)。第 3 步:做独立确认(两个或更多彼此独立、并非互相照抄的可信来源)。第 4 步:在人的监督之下作决定,并保留申诉权。任何一步没通过,就不要把它当作真的转发出去。

按顺序走完这四步;某一步没通过的说法,就不该被当作真的转发出去。

真正的确认与回声之别
你找到了什么算独立确认吗?
同一条原帖被转发了五次不算,是一个来源在回声
两家不同的新闻机构,各自独立报道算,是独立的
一家官方机构确认自己发布的消息算,是可信来源
一个没有附任何出处的匿名账号不算,相信之前先核实

一张表,用来分辨真正的独立确认和一个来源的回声。同一条原帖被转发五次:不是独立的,因为它们都追溯到同一个来源。两家不同的新闻机构各自独立报道:是独立的,因为它们分别得出了这一说法。一家官方机构确认自己发布的消息:既独立又可信。一个没有出处的匿名账号:不算确认,要谨慎对待。

活动

内容调查与伦理决定

用出处和上下文方面的证据去调查虚构的帖子,然后作为伦理委员会审议若干被提出的人工智能系统,并设计一套申诉流程。

  1. 第 1 部分 — 调查帖子:做完这七项来源与语境的检查,再对每一条下判断。
  2. 第 2 部分 — 伦理委员会:权衡一个被提议的 AI 系统,做出决定,并选择防护措施。
  3. 第 3 部分 — 设计申诉流程:一个人怎么知道 AI 参与了、怎么拿到解释、怎么让人来复核。

Every post, school, and person here is fictional. No real accounts are visited. Don't put personal details in your notes.

第 1 部分 · 调查这些帖子

靠「手画得怪」「文字很别扭」这类视觉破绽来识别 AI 内容并不可靠;核查来源、日期和原始语境才可靠。

  • 美术社分享了一张 AI 做的海报,并且说明了

    AI 生成的插画,如实标注

    一张色彩鲜艳的插画,画的是机器人在作画,配文写得很清楚:「本插画由美术社用 AI 生成」。

    说法: 这张海报图是用 AI 工具做的。

    证据(7 项检查中有 7 项看着没问题)

    • 没问题:是谁发布的? 发布者:学校美术社(具名)。
    • 没问题:能找到原始来源吗? 能找到原始来源。
    • 没问题:日期对吗? 日期和原件对得上。
    • 没问题:配文和原始语境对得上吗? 配文和原始语境对得上。
    • 没问题:有证据吗? 提供了支持性的证据。
    • 没问题:有独立可靠的来源证实吗? 有独立可靠的来源证实。
    • 没问题:它是不是先煽动情绪,再谈证据? 它没有用情绪催你。
    你的判断:
  • 「我们镇上昨晚被淹了!」——配一张很有冲击力的照片

    真实图片配上有误导性的说明

    一张真实的水淹街道照片,配文却说这是昨晚发生在读者所在的镇上。

    说法: 这张水灾照片拍的是我们镇上昨晚的情况。

    证据(7 项检查中有 1 项看着没问题)

    • 有问题:是谁发布的? 发布者:匿名账号。
    • 没问题:能找到原始来源吗? 能找到原始来源。
    • 有问题:日期对吗? 日期和原件对不上。
    • 有问题:配文和原始语境对得上吗? 配文改变或歪曲了原始语境。
    • 有问题:有证据吗? 没有提供任何支持性证据。
    • 有问题:有独立可靠的来源证实吗? 没有独立来源证实。
    • 有问题:它是不是先煽动情绪,再谈证据? 它先煽动情绪,再谈证据。
    你的判断:
  • 「机器人要接管学校了!」

    真实图片被放进了错误的语境

    一张机器人比赛的照片,配文暗示机器人正在取代老师。

    说法: 这所学校里机器人已经取代了老师。

    证据(7 项检查中有 2 项看着没问题)

    • 有问题:是谁发布的? 发布者:粉丝博客。
    • 没问题:能找到原始来源吗? 能找到原始来源。
    • 没问题:日期对吗? 日期和原件对得上。
    • 有问题:配文和原始语境对得上吗? 配文改变或歪曲了原始语境。
    • 有问题:有证据吗? 没有提供任何支持性证据。
    • 有问题:有独立可靠的来源证实吗? 没有独立来源证实。
    • 有问题:它是不是先煽动情绪,再谈证据? 它先煽动情绪,再谈证据。
    你的判断:
  • 校长「证实」以后再也不留作业了

    编造的引语

    一条纯文字帖子,引用了一句据说是校长说的话。

    说法: 校长说作业从此被永久取消。

    证据(7 项检查中有 0 项看着没问题)

    • 有问题:是谁发布的? 发布者:表情包主页。
    • 有问题:能找到原始来源吗? 找不到原始来源。
    • 有问题:日期对吗? 日期无法核实。
    • 有问题:配文和原始语境对得上吗? 配文改变或歪曲了原始语境。
    • 有问题:有证据吗? 没有提供任何支持性证据。
    • 有问题:有独立可靠的来源证实吗? 没有独立来源证实。
    • 有问题:它是不是先煽动情绪,再谈证据? 它先煽动情绪,再谈证据。
    你的判断:
  • 「科学展取消了——就在今天!」

    日期造假

    一张通知的截图,日期写的是今天,内容是某个活动取消。

    说法: 科学展今天取消。

    证据(7 项检查中有 2 项看着没问题)

    • 有问题:是谁发布的? 发布者:转发的截图。
    • 没问题:能找到原始来源吗? 能找到原始来源。
    • 有问题:日期对吗? 日期和原件对不上。
    • 没问题:配文和原始语境对得上吗? 配文和原始语境对得上。
    • 有问题:有证据吗? 没有提供任何支持性证据。
    • 有问题:有独立可靠的来源证实吗? 没有独立来源证实。
    • 有问题:它是不是先煽动情绪,再谈证据? 它先煽动情绪,再谈证据。
    你的判断:
  • 「90% 的学生宁愿要机器人也不要作业」

    没有原始来源的说法

    一个用大字写出的统计数字,既没有链接也没有说明是哪项研究。

    说法: 90% 的学生宁愿要机器人也不要作业。

    证据(7 项检查中有 2 项看着没问题)

    • 有问题:是谁发布的? 发布者:未知。
    • 有问题:能找到原始来源吗? 找不到原始来源。
    • 有问题:日期对吗? 日期无法核实。
    • 没问题:配文和原始语境对得上吗? 配文和原始语境对得上。
    • 有问题:有证据吗? 没有提供任何支持性证据。
    • 有问题:有独立可靠的来源证实吗? 没有独立来源证实。
    • 没问题:它是不是先煽动情绪,再谈证据? 它没有用情绪催你。
    你的判断:
  • 学区发布了科学展的官方日程

    有可靠原始来源支持的说法

    学区官网上的一份日程表,日期和联系方式都写得很清楚。

    说法: 科学展的日期就是学区官网上写的那天。

    证据(7 项检查中有 7 项看着没问题)

    • 没问题:是谁发布的? 发布者:学区(官方网站)。
    • 没问题:能找到原始来源吗? 能找到原始来源。
    • 没问题:日期对吗? 日期和原件对得上。
    • 没问题:配文和原始语境对得上吗? 配文和原始语境对得上。
    • 没问题:有证据吗? 提供了支持性的证据。
    • 没问题:有独立可靠的来源证实吗? 有独立可靠的来源证实。
    • 没问题:它是不是先煽动情绪,再谈证据? 它没有用情绪催你。
    你的判断:
  • 「马上转发,否则你们班的旅行就没了!!!」

    专门设计来引发情绪反应的帖子

    一条全是大写字母的帖子,语气紧迫,要求在「来不及」之前赶紧转发。

    说法: 转发这条帖子就能保住你们班的旅行。

    证据(7 项检查中有 0 项看着没问题)

    • 有问题:是谁发布的? 发布者:匿名连锁帖。
    • 有问题:能找到原始来源吗? 找不到原始来源。
    • 有问题:日期对吗? 日期无法核实。
    • 有问题:配文和原始语境对得上吗? 配文改变或歪曲了原始语境。
    • 有问题:有证据吗? 没有提供任何支持性证据。
    • 有问题:有独立可靠的来源证实吗? 没有独立来源证实。
    • 有问题:它是不是先煽动情绪,再谈证据? 它先煽动情绪,再谈证据。
    你的判断:

这个活动没法完美识别 AI 生成的内容,它也不打算这么做:它核查的是来源和语境,这才是真正靠得住的。

第 2 部分 · AI 伦理委员会

提案: 根据学生以前借过的书来推荐图书馆的书。

预期的好处: 帮学生发现可能会喜欢的书。

可能出现的错误: 推荐范围太窄(信息茧房); 漏掉和过去选择不同的书

受影响的人: 学生, 图书管理员

风险等级: 低。 一个简单的「本月热门」书架,用的数据少得多,效果却差不了多少。

你的决定

你会要求的防护措施

第 3 部分 · 设计一个申诉流程

高风险的 AI 需要有渠道,让人能理解并质疑一个决定。来设计一个:

6 个部分里已设计好 0 个,把剩下的补齐,申诉流程就完整了。

检查你的理解

回答这些题,检验你能否核实内容,并就监督和申诉进行思考。

  1. Question 1. 把核实一个惊人说法的各个步骤排成合理的顺序。

    1. 1.找到这个说法出自的原始出处
    2. 2.核对上下文:何时、何地、为何发生
    3. 3.用两个或更多独立来源加以确认
    4. 4.决定该怎么做,并由人来复核这个决定
  2. Question 2. 下面哪一项才是对一个说法的真正独立确认?

  3. Question 3. 处理这个人工智能决定,最负责任的做法是什么?

    一个学校应用用人工智能标记它认为是抄袭的作文。它标记了普里娅的作文,而那篇其实是她自己写的。

已回答 0 / 3

自己动手试试

写一份核实指南

做一份简短的指南,让朋友在转发一条爆红帖子之前,能用它来判断这条帖子是否可信。

  1. 写下这四个步骤:原始出处、上下文、独立确认,以及人工复核。
  2. 为每一步加上一个朋友可以问自己的、简单直白的问题。
  3. 加上一句话,说明什么时候一个决定需要人的监督和申诉的途径。

做到这样就算成功

  • 四个核实步骤按清晰的顺序都出现了。
  • 每一步都有一个简单、能用得上的问题。
  • 指南中提到了人的监督和申诉权。

反思

输入时会保存在这台设备上

请不要写私人信息。你的回答只保存在这个浏览器里,不会发送到任何地方。

小结

因为人工智能能够伪造并传播极具说服力的内容,所以要按出处和上下文核实、做独立确认,并让人保持在掌控之中、拥有申诉权。

  • 深度伪造和错误信息意味着「看起来是真的」并不算证据。
  • 把说法追溯到原始出处,并核对它周围的上下文。
  • 独立确认需要彼此独立的来源,而不是同一条帖子的复制品。
  • 人工智能的重要决定需要人的监督和申诉权。

七至八年级延伸内容

当速度和准确彼此拉扯

在网上,抢先往往比说对更能吸引注意力,所以误导性内容可能在还没人核实之前就传开了。认真核实需要时间,而节奏飞快的信息流并不奖励这种时间。

描述一种情形:抢着转发的压力,与核实一个说法所需的步骤发生冲突。平台或个人可以做些什么,让「准确的选择」比「快的选择」更容易?

完成这一课

  • Attempt the knowledge check(未完成)
  • Save a reflection (recommended)(未完成)

先做一下知识检查,才能完成这一课。