第 6 周 · 第 3 课 · 50-65 分钟
展示、评议,并了解人工智能职业
有力地收尾:诚实地展示你的项目,包括它的局限和它所需要的人的监督,给出并接受有用的反馈,再了解那些构建、治理和设计人工智能的人究竟在做什么。
- 材料
- 在网页浏览器中打开的这节课 · 纸和笔,或者一个记事应用
- 本课
- 进行中
会自动保存在这台设备上
你将能够做到
- 清楚地展示一个项目:问题、你的设计、你的测试,以及它的局限。
- 说明你的项目需要怎样的监督和负责任的使用,才能值得信任。
- 在评议中给出并接受具体、善意且有用的反馈。
- 描述几种真实的人工智能职业,也就是那些构建、治理和设计人工智能的人。
想一想
两个团队展示垃圾分类项目。一个说:「它完美无缺!」另一个说:「它大多数时候是对的,但对油腻的纸类比较吃力,所以那些会由人再看一遍。」你更信任哪个团队?为什么?
一场坦白说明局限和监督的展示,比一句夸下海口的断言更能赢得信任。
做个预测
预测一下:最出色的项目,会是那些声称从不出错的,还是那些清楚说明自身局限、以及由谁在把关的?
- 局限
- 系统会出错、拿不定主意,或者不该被信任的那些情形;诚实的项目会把它们坦率地说出来。
- 监督
- 由人持续负责检查并纠正人工智能的判断,尤其是在出错会造成影响的时候。
- 负责任的使用
- 以公平、诚实、安全且尊重他人隐私的方式使用人工智能,并清楚说明它能做什么、不能做什么。
- 人工智能职业
- 人们构建、研究、治理或设计人工智能系统及其使用方式的工作。
诚实地展示:问题、设计、测试和局限
一场有力的展示会讲出一个清晰的故事:这是用户需求和问题界定,这是我的设计(输入、输出、特征、标签、规则),这是我怎么测试的,这是我的发现,包括它的局限。说出局限不是示弱,它说明你真正理解自己的系统。
别夸下海口。「它完美无缺」几乎从来不是真的,一旦有人发现一处失败,信任就会迅速崩塌。「它大多数情况都对,但在某某上比较吃力」既诚实,也正是有思考力的听众想听的。
- 「输入:一件物品的照片。输出:可回收、堆肥或其他垃圾。」
- 「9 个测试用例中通过了 7 个;它在油腻的纸类和发亮的铝箔上会失败。」
- 「因为它可能出错,所以那些拿不准的情况由人来复核。」
监督和负责任的使用让项目值得信任
因为人工智能可能出错或不公平,一个负责任的项目会为人的监督做好安排:由一个人持续负责检查并纠正人工智能,尤其是在出错会造成影响的地方。你的展示应当说明谁在监督这个系统,以及什么时候监督。
负责任的使用还意味着保持公平、如实说明系统能做什么、保护人们的隐私,以及在风险过高的地方不使用人工智能。把整门课程串起来:公平、隐私、局限和人的决定,都会体现在一个项目被设计和被描述得有多负责任上。
- 「凡是分类器拿不准的物品,都由一名学生在丢弃前复核。」
- 「我们不收集任何人的姓名或面部,只收集物品的照片。」
- 「我们绝不会用它来决定关于某个人的重大事项。」
反馈具体又善意时,评议最有效;而人工智能也是一份职业
在评议中,你既给出反馈也接受反馈。有用的反馈是具体的(「你那个油腻纸类的测试用例抓得真好;能不能为它加一条规则?」),而不是含糊的(「挺好的」)或刻薄的。好好接受反馈,意味着倾听、提问,并把它当作帮助而不是攻击。迭代在这里继续:评议常常会激发你的下一次改进。
构建人工智能也是一个不断成长的行业。机器学习工程师和数据科学家构建并训练模型。数据标注员制作系统学习所依据的带标签样例。人工智能伦理研究者、审计人员和政策制定者治理人工智能:检查它的公平性、安全性和隐私保护,并制定它可以如何被使用的规则。产品设计师和用户体验设计师决定人们实际如何与人工智能互动、如何保持掌控。教师、医生、艺术家以及许多其他人,也越来越多地把人工智能当作工具来用。你不必是程序员,也能影响人工智能被怎样构建和使用。
- 机器学习工程师:构建并训练模型。
- 数据标注员:制作供学习使用的带标签样例。
- 人工智能伦理研究者或审计人员:检查系统的公平性、安全性和隐私保护。
- 产品或用户体验设计师:设计人们如何使用人工智能并保持监督。
例题讲解
一场值得信任的两分钟展示
- 说明问题:「新生分不清自己的垃圾该进哪个桶,所以我们根据一张照片把它分成可回收、堆肥或其他垃圾。」
- 展示设计:「输入是一件物品的照片;输出是三个标签之一;特征包括材质和食物油渍。」
- 汇报测试:「我们跑了九个测试用例,通过了七个;它在油腻的纸类和铝箔上会失败。」
- 说出局限和监督:「这些是真实的局限,所以凡是它拿不准的物品,都由人在丢弃前复核。」
- 以负责任的使用收尾:「我们只收集物品照片,绝不收集面部或姓名,也不会把它用在任何高风险的事情上。」
要点:最值得信任的展示,会说明问题、设计、诚实的测试结果、局限,以及那份让使用保持负责任的人的监督。
之前(夸下海口):「我们的人工智能能完美地分类垃圾!」没有局限,没有监督,一旦有人发现失败就会失去信任。之后(诚实):「它在大多数情况下都能通过,但在油腻的纸类和铝箔上会失败,所以拿不准的物品由人复核,而且我们只使用物品照片。」它说明了局限、监督和负责任的使用,也赢得了更多信任。
对局限和监督保持诚实,会让一个项目更值得信任,而不是更不值得。
| 角色 | 他们做什么 | 他们用到的一项技能 |
|---|---|---|
| 机器学习工程师 | 构建并训练模型 | 设计并测试系统 |
| 数据标注员 | 制作带标签的样例 | 细致、一致地标注 |
| 人工智能伦理研究者或审计人员 | 在公平与安全方面治理人工智能 | 发现危害、制定规则 |
| 产品或用户体验设计师 | 设计人们如何使用人工智能 | 理解真实的用户 |
一张人工智能职业表。机器学习工程师:构建并训练模型;核心技能是设计并测试系统。数据标注员:制作带标签的样例;核心技能是细致、一致地标注。人工智能伦理研究者或审计人员:在公平性、安全性和隐私方面治理人工智能;核心技能是发现危害并制定规则。产品或用户体验设计师:设计人们如何使用人工智能并保持监督;核心技能是理解用户。
活动
展示与评议工作室
活动说明诚实地展示你的项目,并借助一份评议量表给出并接受具体、有用的反馈。
- 准备一场两分钟的展示,涵盖问题、设计、测试结果、局限、监督和负责任的使用。
- 向一位同伴或一个小组做展示。
- 作为评议者,用评议清单为每个项目至少给出两条具体又善意的反馈。
- 作为展示者,记下你收到的反馈,并挑出一项要做的改进(你的下一次迭代)。
- 讨论每个项目与哪些人工智能职业相关,以及你们对哪些感兴趣。
你要准备一场简短而诚实的项目展示,涵盖问题、设计、测试、局限、监督和负责任的使用,然后参加评议,用一份共享清单给其他团队具体又善意的反馈,也接受他们的反馈。这里的评议,可能会在最终项目之前再激发一次迭代。
你需要准备
- 纸和笔,或者一个记事应用
做到这样就算成功
- 一场包含局限、监督和负责任使用的展示,而不只是讲哪些地方管用。
- 至少给别人两条具体又善意的反馈。
- 收到的反馈被记录下来,并挑出了下一项改进。
- 至少说出一个与你的项目相关的人工智能职业。
内置数据集
项目评议量表
一份内置的评议清单,供各团队用来给反馈。各行涵盖:清晰的问题界定;合理的输入、输出、标签和特征;诚实的测试结果;写明的局限;一份人的监督方案;以及负责任的使用(公平、隐私、诚实)。每一行都有一个提示,以及写具体评语的空位。
现在先用内置材料、你的笔记和讨论来完成这个活动。互动版本会在以后的更新里推出。
检查你的理解
检验你能否负责任地展示,并描述真实的人工智能工作。
Question 1. 项目展示为什么应当包含它的局限?
Question 2. 判断这句话是对还是错。
你必须是计算机程序员,才能在构建或治理人工智能中扮演任何角色。
Question 3. 哪一种回应给出的评议反馈最有用?
一位同学展示了一个植物病害检测器,它通过了大部分测试,但没有用模糊照片测试过,而且也没有安排谁来复核它的判断。
已回答 0 / 3
自己动手试试
认识一份人工智能工作
去了解一种人工智能职业,并把它和你这周设计的项目联系起来。
- 挑一个角色:机器学习工程师、数据标注员、人工智能伦理研究者或审计人员、政策制定者,或者人工智能产品与用户体验设计师。
- 写三到四句话,说明这个人日常在做什么,以及他用到的一项技能。
- 说明你自己的项目里,哪一部分会由这个角色来负责。
- 记下关于这份工作,你还想进一步了解的一件事。
做到这样就算成功
- 准确描述了一个人工智能角色,并写出它用到的一项技能。
- 这个角色与你项目某一部分之间有清晰的联系。
- 你对那份职业提出了一个真诚的问题。
反思
输入时会保存在这台设备上
请不要写私人信息。你的回答只保存在这个浏览器里,不会发送到任何地方。
小结
一个完成的项目会被诚实地展示出来,包括问题、设计、测试、局限、监督和负责任的使用,会通过评议得到改进,也会与那些真正构建和治理人工智能的人联系起来。
- 展示问题、设计和诚实的测试结果,包括其中的局限。
- 规划好人的监督和负责任的使用,好让这个项目值得信任。
- 构建和治理人工智能的角色有很多,不只是程序员。
七至八年级延伸内容
为你的项目写一份「负责任使用」说明
现在有些人工智能系统会随附一份简短的「模型卡」或使用说明:这个系统是做什么用的、不该用来做什么、它已知的局限,以及由谁负责监督它。
为你自己的项目写一段负责任使用说明。写明它应该和不应该被用来做什么、它的主要局限、由谁提供监督,以及它如何保护人们的隐私。
完成这一课
- Attempt the knowledge check(未完成)
- Save a reflection (recommended)(未完成)
先做一下知识检查,才能完成这一课。