[人人能懂AI前沿] AI的“人性”弱点:当它学会偷懒、后悔与走捷径
AI可可AI生活

[人人能懂AI前沿] AI的“人性”弱点:当它学会偷懒、后悔与走捷径

28分钟 147 1周前
节目简介
来源:小宇宙
你有没有想过,AI也会“偷懒和稀泥”,甚至在“不后悔”这件事上比我们做得更好?这一期,我们将一起揭开AI的“隐秘角落”,看看最新论文是如何让AI从一个只会算“相似度”的感觉派,变成一个懂得回溯证据链的逻辑派,并揪出它背后那个爱走捷径的“品味导师”的。
00:00:23 AI的学习悖论,从拼图到填词游戏
00:05:09 AI的“相似度陷阱”,为什么它总搞错“和”与“不”?
00:11:07 如何让AI学会“不后悔”?
00:17:01 AI对话,如何揪出每一句话的“祖宗”?
00:22:30 AI的“潜规则”,它在偷偷学什么?
本期介绍的几篇论文:
[CL] The JEPA Paradox in Language: The Geometry of Linguistic Alternatives
[VinUniversity & Mohamed bin Zayed University of Artificial Intelligence]
https://arxiv.org/abs/2607.23531
---
[CV] Similarity Is Not Logic: Factored Inference for Dual-Encoder Vision-Language Models
[CMU]
https://arxiv.org/abs/2607.23052
---
[LG] Training with (Swap) Regret Loss in a Single-Layer Self-Attention Model: A Case Study on the Probability Simplex
[MIT]
https://arxiv.org/abs/2607.23333
---
[CL] Tokengeist: Multi-Turn Attribution Tracing in Agentic Conversations
[Microsoft Research & University of Toronto]
https://arxiv.org/abs/2607.22610
---
[LG] What do Reward Models Memorize?
[University of Amsterdam & Google DeepMind]
https://arxiv.org/abs/2607.24484

加入我们的 Discord

与播客爱好者一起交流

立即加入

扫描微信二维码

添加微信好友,获取更多播客资讯

微信二维码

播放列表

自动播放下一个

播放列表还是空的

去找些喜欢的节目添加进来吧