[人人能懂AI前沿] 内部辩论、传承超越和“笨”办法
AI可可AI生活

[人人能懂AI前沿] 内部辩论、传承超越和“笨”办法

25分钟 84 1周前
节目简介
来源:小宇宙
想知道AI的“大脑”里,是不是真的在上演一场场激烈的内部辩论?为什么有时候教它,掐头去尾、只给起点和终点,反而能让它学得更快?而面对超级难题,又是怎样一个“笨办法”在引导它一步步走向正确答案?本期节目,我们将深入几篇最新论文,聊聊AI“师傅”如何带出超越自己的“徒弟”,并揭开为什么你手机里的AI和新闻里的跑分冠军,可能是两回事。
00:00:31 AI的“自我否定”,我们误解了它的工作方式
00:05:22 老师傅的旧地图,怎么给新车导航?
00:10:17 你用的AI,和新闻里的AI,是两回事
00:16:00 为什么掐头去尾,反而教得更好?
00:19:50 为什么聪明的AI,也需要一个笨办法?
本期介绍的几篇论文:
[CL] LLM Layers Immediately Correct Each Other
[UC Berkeley]
https://arxiv.org/abs/2609.07876
---
[LG] Eliciting Weak-to-Strong Generalization with On-Policy Reverse Distillation
[KAIST AI]
https://arxiv.org/abs/2609.08798
---
[AI] API Benchmark Scores Do Not Reliably Transfer to Chatbot Interfaces
[Stanford University]
https://arxiv.org/abs/2609.08861
---
[CL] Revisiting Complete Reasoning Traces for Post-Training
[NAVER AI Lab]
https://arxiv.org/abs/2609.07103
---
[LG] Long-Horizon Language Model Reinforcement Learning via Progressive Point Matching
[UC Berkeley]
https://arxiv.org/abs/2609.07303

加入我们的 Discord

与播客爱好者一起交流

立即加入

扫描微信二维码

添加微信好友,获取更多播客资讯

微信二维码

播放列表

自动播放下一个

播放列表还是空的

去找些喜欢的节目添加进来吧