主播
节目简介
来源:小宇宙
当AI学会了“活在当下”,不再被历史包袱拖累时,我们人类自己又该如何避免被它悄悄“废掉”核心能力呢?本期节目,我们不仅要探讨如何用一把特制的尺子去衡量AI是否真的懂我们的“不开心”,还将揭秘如何培养出一个靠谱的AI“批评家”,让它实现高效的自我进化。最后,我们会一起探寻训练AI时那个神秘的“档位”,看看这些最新论文将如何刷新我们对人机协作与AI成长的认知。
00:00:33 让AI学会“活在当下”
00:05:00 AI越来越聪明,但它真的懂你的“不开心”吗?
00:09:24 那个替你干活的AI,正在悄悄“废掉”你
00:13:48 AI的成长烦恼,一个“批评家”的自我修养
00:20:39 训练AI的秘密“档位”
本期介绍的几篇论文:
[AI] SKILL.state: Scalable Long-Horizon Agent Skills
[Google LLC & Purdue University]
https://arxiv.org/abs/2608.26263
---
[CL] HealthBench-Psych: A Mental Health Subset of OpenAI's HealthBench
[Beth Israel Deaconess Medical Center]
https://arxiv.org/abs/2608.25071
---
[AI] AI Agents Push Humans Out of the Loop
[Hugging Face]
https://arxiv.org/abs/2608.23642
---
[LG] Best Practice Critic Optimization
[National University of Singapore & Tencent Hunyuan]
https://arxiv.org/abs/2608.23566
---
[LG] Effective Learning Rate Governs Loss Dynamics in Language Model Pretraining
[Peking University & Ant Group]
https://arxiv.org/abs/2608.24814
00:00:33 让AI学会“活在当下”
00:05:00 AI越来越聪明,但它真的懂你的“不开心”吗?
00:09:24 那个替你干活的AI,正在悄悄“废掉”你
00:13:48 AI的成长烦恼,一个“批评家”的自我修养
00:20:39 训练AI的秘密“档位”
本期介绍的几篇论文:
[AI] SKILL.state: Scalable Long-Horizon Agent Skills
[Google LLC & Purdue University]
https://arxiv.org/abs/2608.26263
---
[CL] HealthBench-Psych: A Mental Health Subset of OpenAI's HealthBench
[Beth Israel Deaconess Medical Center]
https://arxiv.org/abs/2608.25071
---
[AI] AI Agents Push Humans Out of the Loop
[Hugging Face]
https://arxiv.org/abs/2608.23642
---
[LG] Best Practice Critic Optimization
[National University of Singapore & Tencent Hunyuan]
https://arxiv.org/abs/2608.23566
---
[LG] Effective Learning Rate Governs Loss Dynamics in Language Model Pretraining
[Peking University & Ant Group]
https://arxiv.org/abs/2608.24814