怎么衡量两个词像不像?
计算机原理 · 小纸条
选一章打印。双面打印(按长边翻页)后沿虚线剪开,每张卡片正面题目、背面答案。
这为什么划算?
"涌现"是什么意思?
怎么减轻说错话的问题?
什么任务绝不能只靠它?
它和监督学习最大的不同是什么?
生活里有这个两难吗?
举一个例子。
招聘模型可能有什么偏见?
哪些场景必须可解释?
参考答案(家长):通用能力训练一次能被无数任务复用。
参考答案(家长):算向量夹角余弦,你在线代里学过。
参考答案(家长):给它可靠的资料作参考,让它基于资料回答并给出出处。
参考答案(家长):规模跨过某个门槛后,突然具备了之前完全不会的能力。
参考答案(家长):反馈是延迟的、稀疏的,而且要自己去探索。
参考答案(家长):涉及事实数据、法律医疗、以及需要负责的决定。
参考答案(家长):按"清理垃圾数量"奖励,机器人可能自己制造垃圾再清理。
参考答案(家长):有,比如总去熟悉的餐馆还是试新店。
参考答案(家长):医疗、司法、信贷、招聘等影响个人权益的决定。
参考答案(家长):历史数据里某类人少,模型就会延续这种少。
怎么减少这种风险?
这对你意味着什么?
写下你的答案。
说说哪个概念最让你意外。
说出分布式的两个动机。
单机上不会遇到的问题举三个。
为什么"不知道"比"坏了"更麻烦?
把这八条抄下来。
怎么缓解?
这对设计有什么要求?
参考答案(家长):用它做决定前,你要能对结果负责。
参考答案(家长):去标识化、加差分隐私噪声、限制模型记忆能力。
参考答案(家长):常见的答案是反向传播其实就是链式法则加复用。
参考答案(家长):能说清"解决什么问题"才算懂。
参考答案(家长):部分失败、消息乱序、时钟不一致。
参考答案(家长):扩展能力和容错能力。
参考答案(家长):写代码时对照,能避开大量坑。
参考答案(家长):没坏和坏了但没回应,在你看来完全一样。
参考答案(家长):接口必须幂等,才敢重试。
参考答案(家长):自适应超时,根据实际延迟分布动态调整。
这个记录要存多久?
那怎么判断顺序?
它能判断什么?
两个向量互不小于对方说明什么?
复制的核心难题是什么?
同步复制和异步复制的区别?
它能保证不丢数据吗?
冲突怎么解决?
读写各要多少个才保证读到最新?
分片和复制能同时用吗?
参考答案(家长):用逻辑时钟,只关心因果关系而非绝对时间。
参考答案(家长):至少覆盖可能的重试窗口,通常几分钟到几天。
参考答案(家长):这两个事件是并发的,没有因果关系。
参考答案(家长):能判断"A 一定发生在 B 之前",但判断不了并发。
参考答案(家长):同步等从库确认才返回,安全但慢;异步快但可能丢数据。
参考答案(家长):写入怎么同步到所有副本,且中途出错怎么办。
参考答案(家长):按时间戳取一个、保留两个让用户选、或者用能自动合并的数据结构。
参考答案(家长):主和那个从同时坏才会丢,概率大幅降低。
参考答案(家长):能,通常每个分片再各自复制几份。
参考答案(家长):读的数量加写的数量大于总副本数。