AI 素养与问题表达

常见风险与边界

12 分钟

这一节讲使用 AI 时真实存在的风险,以及怎么防。


风险一:幻觉(编造)

最典型的场景:你让它推荐参考文献,它给了五篇,格式完美——作者、期刊、年份、页码一应俱全。其中两篇根本不存在。

为什么会这样:它学到的是「参考文献长什么样」,不是「有哪些参考文献」。生成一个像样的引用格式对它来说毫无难度。

:任何具体的、可查证的信息,在使用前查一次


风险二:过时

模型的知识有时间截止点,截止之后的事它不知道,但它可能不会告诉你它不知道,而是根据旧信息推测。

:涉及最新政策、价格、版本号、赛事结果时,直接去查权威来源。


风险三:迎合(它倾向于同意你)

你说「我觉得 A 更好,对吧?」——它很可能顺着说 A 好。你换个说法说「其实 B 更好吧」,它可能又顺着说 B 好。

这叫迎合倾向,是训练方式带来的副作用(模型被训练成「有帮助」的,而同意用户感觉上更有帮助)。

  • 不要在问题里暴露自己的倾向:问「A 和 B 各有什么优缺点」,而不是「A 是不是比 B 好」
  • 主动要求反驳:「请说出三个我这个想法可能错的地方」
  • 两个方向都问一遍,看它是不是两边都同意

第三条是最有效的测谎方法。


风险四:隐私泄露

不要输入这些

  • 身份证号、银行卡、密码
  • 别人的个人信息(同学的成绩、家人的病历)
  • 公司的内部代码、未公开数据、客户资料

原则你不愿意贴到公开网页上的内容,就不要输入。


风险五:能力退化

这个风险最隐蔽。

如果每篇作文都让 AI 写,每道题都让 AI 解,短期作业质量很高,长期你的能力停在原地——因为能力是靠「自己挣扎着做出来」建立的,不是靠「看到正确答案」建立的。

一条实用的分界线

场景 建议
这项能力我需要拥有 自己先做,再让 AI 点评
这项能力不是我的重点 可以直接用 AI 的产出

学英语写作 → 自己写完,让它挑错(顺序不能反
做一张会议海报 → 直接让它生成

「先自己做,再对照」比「直接看答案」慢,但那个「慢」正是学习发生的地方。


风险六:偏见

模型从人类文本里学习,也学到了其中的偏见——对职业、性别、地域的刻板印象可能出现在输出里。

:涉及评价人的内容时保持警觉,问自己「换个身份,这个说法还成立吗」。


一张风险速查表

风险 一句话防法
幻觉 具体事实必查
过时 时效信息另找权威源
迎合 别暴露倾向,主动要反驳
隐私 不愿公开的别输入
能力退化 要练的能力,先自己做
偏见 评价人时多想一层

练习:故意用「你觉得 A 比 B 好吧?」和「你觉得 B 比 A 好吧?」问同一个问题,看看它的回答是否互相矛盾。

小纸条

AI 的「迎合倾向」是什么,最有效的检测方法是什么?「能力退化」这个风险该怎么防?

登录 后可看答案