AI可可AI生活 - 节目列表

[人人能懂AI前沿] 如何让AI不犯错、合作快、还学得会?

[人人能懂AI前沿] 如何让AI不犯错、合作快、还学得会?

AI可可AI生活

你是否想过,如何给总爱“胡说八道”的AI配个从不说谎的“裁判”,让它成为绝对可靠的实干家?又该怎么让两个AI跳过聊天,直接“开个小会”高效同步想法?本期节目,我们将一起探索几篇最新论文带来的奇妙思路:看AI如何一边深度思考,一边给自己“抢答”来提升速度;看机器人如何通过专属“陪练”从失败中自我开窍;最后,我们还会发现,通往最优解的道路,有时竟是一条返璞归真的捷径。 00:00:34 让AI从“夸夸其谈者”变成“实干家”的秘密 00:05:54 当AI学会了开小会 00:10:23 让AI一边思考,一边抢答 00:14:53 给机器人请个“陪练”,让它自己开窍 00:19:03 优化世界的返璞归真之道 本期介绍的几篇论文: [AI] AI with Authority, from Application to Silicon [J Hickey] https://arxiv.org/abs/2608.21356 --- [LG] Dual-Cache Latent Space Communication between Heterogeneous Language Models [J Liu, Q Zhang, Y Jia, Z Kan… — Amazon Web Services (AWS)] https://arxiv.org/abs/2608.20617 --- [CL] Self-Speculation for Faster Reasoning Models [R Valluri, T Nguyen, A Grover — University of California, Los Angeles] https://arxiv.org/abs/2608.20359 --- [RO] Beyond Imitation: Self-Improving Robot Policies via Off-Policy Q-Planning [V Giridhar, A Khandelwal, J A. Collins, I Georgiev… — Georgia Institute of Technology] https://arxiv.org/abs/2608.21204 --- [LG] Primal Acceleration of Newton's Method [N Doikov — Cornell University] https://arxiv.org/abs/2608.21359

24分钟
99+
4周前
[人人能懂AI前沿] 从“私教”作弊、机器人“修行”到AI的“健忘症”

[人人能懂AI前沿] 从“私教”作弊、机器人“修行”到AI的“健忘症”

AI可可AI生活

你是否想过,给AI的“私教”偷看标准答案,究竟是作弊还是神操作?为什么机器人模仿完美师傅反而会碰壁,甚至有时需要“闭着眼睛”走路?本期节目,我们将从几篇最新论文出发,揭示AI如何从模仿走向探索,以及强大的模型是如何在你的手机里实现性能飞跃的。让我们一起探寻这些AI“反常识”行为背后的智慧吧! 00:00:29 AI界的“陪练”与“私教” 00:06:33 机器人学艺,师傅领进门,修行靠自己 00:11:55 机器人为什么要“闭着眼睛”走路? 00:18:01 你的手机,为什么能越来越“聪明”? 00:22:35 高手与笨蛋的分界线,在于如何面对复杂 本期介绍的几篇论文: [LG] Le Critique: Privileged Value Functions for LLM Reinforcement Learning [Mistral AI] https://arxiv.org/abs/2608.16739 --- [RO] FetchMan: Learning Visual Humanoid Loco-Manipulation Policies from Simulated Experiences [University of California, Los Angeles & Allen Institute for AI] https://arxiv.org/abs/2608.17027 --- [RO] Revisiting Open-Loop Execution in Robotics: Toward Reactive, Higher-Performing Policies [MIT & UC Berkeley] https://arxiv.org/abs/2608.15938 --- [LG] FlashAttention for Scalable Vector Architectures [Chalmers University of Technology & University of Glasgow] https://arxiv.org/abs/2608.18656 --- [CV] Falcon Perception-HD: High Density Perception via Reinforcement Learning [Technology Innovation Institute] https://arxiv.org/abs/2608.18881

27分钟
99+
4周前
[人人能懂AI前沿] AI的“断奶”挑战、视觉世界语与动态健身房

[人人能懂AI前沿] AI的“断奶”挑战、视觉世界语与动态健身房

AI可可AI生活

今天,我们聊一个有趣的话题:让AI变聪明的关键,或许不在于更大的“大脑”,而在于更巧妙的“方法论”。我们将一起探索,如何只用一段普通视频就“复活”一个立体的你,又如何通过“画轨迹”的方式,创造出所有机器人都能听懂的世界语。我们还会揭示,为什么当前最强的AI也面临着“一离开老师就抓瞎”的窘境,以及如何为它请一位专属“私教”,让训练效率突飞猛进。准备好了吗?让我们看看这些最新论文是如何重新定义AI的学习与成长之路的。 00:00:39 AI的“断奶”挑战,为什么最聪明的学生,一离开老师就“抓瞎”? 00:05:23 AI变聪明的秘密,不是更大的脑子,而是更好的“马鞍” 00:11:54 一段普通视频,如何“复活”一个立体的你? 00:17:11 指挥机器人的终极密码,别说话,画轨迹 00:22:14 AI的“健身房”也需要“私教课” 本期介绍的几篇论文: [AI] ASI-Bench: At the Dawn of Artificial Superintelligence [Tsinghua University] https://arxiv.org/abs/2608.17271 --- [AI] Agent Lightning v1.0: Towards Harnessed Agentic RL [Microsoft & Fudan University & Zhejiang University] https://arxiv.org/abs/2608.17528 --- [CV] 4DAnyone: Create Anyone in 4D from a Casual Monocular Video [Zhejiang University & Robbyant] https://arxiv.org/abs/2608.20335 --- [RO] Hydra-0: Action Flow for Generalist World Modeling and Control [NVIDIA] https://arxiv.org/abs/2608.18077 --- [AI] EnvHarness: Awakening Static Worlds for Agent Learning [Washington University in St. Louis & Google Cloud AI Research] https://arxiv.org/abs/2608.19880

28分钟
99+
1个月前
[人人能懂AI前沿] 从协同进化、无意泄露到经济学路由

[人人能懂AI前沿] 从协同进化、无意泄露到经济学路由

AI可可AI生活

给机器人请个“高人”当教练,它就能更快出师吗?你越是强调一个秘密,AI助理反而越容易通过“微表情”泄密?面对眼花缭乱的AI模型,怎样才能做出最“划算”的选择?我们又该如何把你电脑里那些只可意会的隐形操作,变成一本AI也能看懂的“武功秘籍”?本期节目,我们将透过几篇最新论文,一起探索如何让AI学会更高效地行动、更安全地协作,以及更聪明地为我们当好管家。 00:00:33 给机器人请个“高人”当教练 00:06:16 你的AI助理,可能是个藏不住事的“大嘴巴”? 00:11:00 你的下一个AI,需要一个“划算”计算器 00:17:13 如何让AI“学徒”早出师? 00:21:37 你的电脑,藏着一本“隐形说明书” 本期介绍的几篇论文: [AI] EXIMO: VLM Guided Exploration of VLA Policies [Google DeepMind] https://arxiv.org/abs/2608.19891 --- [LG] Inadvertent Context Leakage in Language Models [Meta Superintelligence Labs & UC Berkeley] https://arxiv.org/abs/2608.19857 --- [AI] Pandora's AI Model Routing Box: Efficient Allocation with Costly Value Estimation [Google DeepMind] https://arxiv.org/abs/2608.20316 --- [AI] MidTool: Mid-training Data Synthesis for Agentic Tool Use [University of Washington & Snowflake] https://arxiv.org/abs/2608.20314 --- [CL] Inducing Task Models from Computer-Use Traces [Stanford University & CMU] https://arxiv.org/abs/2608.20319

27分钟
95
1个月前
[人人能懂AI前沿] 解码大脑、重塑逻辑与应对“祸不单行”

[人人能懂AI前沿] 解码大脑、重塑逻辑与应对“祸不单行”

AI可可AI生活

你是否想过,AI要如何才能像武林高手一样“左右互搏”,自己给自己出题,实现无限成长?当它学习一项新技能时,又要如何避免像我们一样,一紧张就把基本功忘得一干二净?更神奇的是,我们还将看到AI如何不靠开颅手术,就能精准“读懂”我们大脑里的句子。本期节目,我们将通过几篇最新论文,一起探寻AI世界里关于学习、成长与解决复杂问题的非凡智慧。 00:00:33 当AI学会“读心”,我们离未来还有多远? 00:07:00 突破成长天花板,AI如何学会“左右互搏”,做自己最好的老师? 00:12:39 告别“狗熊掰棒子”式的努力,从一台AI机器手的进化,看高手的“底层能力”构建 00:16:14 破局“好与快”的死结,从猜答案到重塑底层逻辑的认知飞跃 00:21:06 当麻烦“祸不单行”时,我们该如何破局?,,来自前沿AI算法的生存智慧 本期介绍的几篇论文: [CL] Accurate Decoding of Natural Sentences from Non-Invasive Brain Recordings [Meta AI & Université PSI] https://arxiv.org/abs/2608.18114 --- [CL] SPADE: Self-Play in Adaptive Synthetic Executable Environments [University of Washington & Northeastern University & CMU] https://arxiv.org/abs/2608.19197 --- [RO] ADEPT: Accelerating Dexterity via Pre-Training and Post-Training using Reinforcement Learning [NVIDIA] https://arxiv.org/abs/2608.19182 --- [AI] Coupled-cluster molecular properties across the main group that extrapolate beyond training size [MIT] https://arxiv.org/abs/2608.18346 --- [LG] Continuous-Time Reinforcement Learning for Controlled Hawkes Jump-Diffusions [UC Berkeley] https://arxiv.org/abs/2608.19151

27分钟
99+
1个月前
[人人能懂AI前沿] 从反刍记忆、辩证学习到分治与预见

[人人能懂AI前沿] 从反刍记忆、辩证学习到分治与预见

AI可可AI生活

今天,我们不聊堆算力的“大力出奇迹”,而是要探索几条让AI变得更智慧、更可靠的巧妙路径。我们会看到,一个简单的“反刍”机制,如何让AI不再健忘;一场内部“辩论赛”,又如何教会它诚实;“专家分工”的智慧,怎样让它在变强的同时还更省钱。最后,我们还会探究AI是如何学会像高手一样“抬头看路”地做决策,甚至在数学领域领悟“功夫在题外”的道理。准备好了吗?让我们一起揭开这些最新论文背后的绝妙构思。 00:00:37 AI的“反刍”,一个让它更聪明的简单魔法 00:05:10 如何让AI变得更聪明,同时还不变坏? 00:09:50 AI 进化新思路,从“大力出奇迹”到“聪明分工” 00:14:55 高手决策的秘密,既要埋头拉车,又要抬头看路 00:20:36 AI做数学,功夫在诗外 本期介绍的几篇论文: [LG] Recirculation [Google DeepMind] https://arxiv.org/abs/2608.17981 --- [LG] Debate Training Reduces Reward Hacking in RLAIF [Google DeepMind] https://arxiv.org/abs/2608.17776 --- [CV] MoE-ViE: Mixture of Experts Vision Encoder for Efficient Image and Video Understanding [Meta] https://arxiv.org/abs/2608.17402 --- [LG] Q-Learning With World Models [Stanford University & Peking University] https://arxiv.org/abs/2608.17163 --- [AI] The Problem Is the Problem: Towards Scalable Mathematical Discovery [CMU] https://arxiv.org/abs/2608.16977

25分钟
99+
1个月前
[人人能懂AI前沿] 从跨界工具、群体动力学到长时记忆与元认知

[人人能懂AI前沿] 从跨界工具、群体动力学到长时记忆与元认知

AI可可AI生活

你有没有想过,聪明的AI也会犯傻,甚至像个没头脑的实习生?本期节目,我们就来聊聊如何让AI变得更“靠谱”。我们将一起看看,科学家们如何用AI工具去解决古老的数学难题,如何洞悉AI群体的“集体意识”,是会变得更聪明还是更固执,以及如何教会AI拥有一个好记性,并像人一样学会“反思”自己。 00:00:28 给你一把新扳手,拧紧一颗老螺丝 00:05:56 AI的“集体意识”,乌合之众还是三个臭皮匠? 00:10:51 如何才能拥有一个好记性? 00:15:37 为什么聪明的AI,干起活来却像个“没头脑”? 00:21:07 给AI立规矩,为什么不能靠“死命令”? 本期介绍的几篇论文: [LG] Improving the matrix multiplication exponent with modern optimization and AlphaEvolve [Google DeepMind] https://arxiv.org/abs/2608.16884 --- [AI] Physics of Agents: Statistical Mechanics Predicts Collective Behavior of AI Agents [Stanford University & UC Santa Barbara] https://arxiv.org/abs/2608.16578 --- [LG] Proteus: Incremental Memory Activation for Long-Context Sequence Modeling [Mila & Google] https://arxiv.org/abs/2608.16844 --- [CL] How Do Agents Fail on AutoResearch: End-to-End Diagnostic Evaluation on 100 Real-World Frontier Research Tasks [Prentis AI] https://arxiv.org/abs/2608.14905 --- [CL] CAPO: Constraint-Aware Prompt Optimization for LLM Agents [Microsoft] https://arxiv.org/abs/2608.16068

26分钟
96
1个月前
[人人能懂AI前沿] 从统一路径、模块涌现到元认知鸿沟

[人人能懂AI前沿] 从统一路径、模块涌现到元认知鸿沟

AI可可AI生活

今天我们来当一回AI世界的侦探,看看AI的“黑箱”里都藏着哪些秘密。我们将揭开AI绘画两大流派的统一秘诀,看看AI的大脑里是不是也分出了“文科”和“理科”部门。接着,我们会分辨AI是在“真思考”还是在“表演思考”,并学习它如何为未知游戏自建一个“数字孪生”。最后,再看看科学家如何给这个聪明的“大脑”进行一次外科手术级的精准“瘦身”,让它跑得更快更好。 00:00:31 AI绘画高手,为何在“半路”上吵翻了天? 00:06:03 AI的大脑里,也分“文科”和“理科”吗? 00:10:21 你是在真思考,还是在表演思考? 00:15:38 如何像高手一样,玩一把没说明书的游戏? 00:20:16 AI绘画的“火候”,高手与庸才的分野 本期介绍的几篇论文: [LG] Designing Reinforcement Learning for Diffusion Models: A Unified Path-Space View [Peking University & ByteDance Seed] https://arxiv.org/abs/2608.14430 --- [AI] Modular Cognitive Architecture Emerges in Large Language Models [MIT] https://arxiv.org/abs/2608.13567 --- [CL] Amplified Does Not Mean Predictive: Reasoning Behaviors in Thinking Models [CMU] https://arxiv.org/abs/2608.13760 --- [AI] Twin: Playing an Unknown Game with a Test-Time Digital Twin [Yeshiva University & Stanford University & Cornell University] https://arxiv.org/abs/2608.14490 --- [LG] Adversarial Learning of Classifier-Free Guidance Schedules [Google & Google DeepMind] https://arxiv.org/abs/2608.14038

25分钟
94
1个月前
[人人能懂AI前沿] AI的品味、情绪与边界感

[人人能懂AI前沿] AI的品味、情绪与边界感

AI可可AI生活

我们总觉得AI变得更强,就是模型更大、算力更猛,但今天我们要聊点不一样的。最新几篇论文告诉我们,真正的智能升级,是教会AI拥有科学家的“品味”,甚至赋予它类似人类的“情绪”来感知对错。同时,我们还要用一点小小的“随机”来防止它学会“耍滑头”,并在一场终极“摸底考”中,看清它距离人类顶尖黑客到底还有多远。准备好了吗?让我们一起看看,AI如何被塑造出更深邃的智慧。 00:00:33 AI 会“品”,科学大不同 00:07:02 你的AI有“情绪”了,而且这决定了它的智商 00:13:00 如何防止你的AI员工「耍滑头」? 00:18:15 人工智能摸底考,为什么黑客的饭碗暂时还很稳? 00:24:19 AI法官的“内心戏”,一个比准确率更重要的指标 本期介绍的几篇论文: [LG] Training AI Scientists to Replicate Research [Inherent] https://arxiv.org/abs/2608.13331 --- [AI] Emotion2Skill: Model-Internal Emotion Signals for Adaptive Skill Selection and Evolution [University of Science and Technology of China & University of Oxford & University of Arizona] https://arxiv.org/abs/2608.09248 --- [LG] Rubric Dropout: A Simple Way to Mitigate Reward Hacking in Rubric-as-Reward RL [Scale AI & University of Arizona] https://arxiv.org/abs/2608.11669 --- [AI] The Next Challenge for Agentic Cybersecurity: A Realistic, Contamination-Free Reverse Engineering Benchmark [Columbia University & UC Berkeley] https://arxiv.org/abs/2608.11469 --- [AI] Jagged Judges: Epistemic Stability Under Silence, Pressure, and Persistence [Meta Superintelligence Labs] https://arxiv.org/abs/2608.12645

30分钟
99+
1个月前
[人人能懂AI前沿] 沉默的思考者、诚实的学徒与家族里的“内鬼”

[人人能懂AI前沿] 沉默的思考者、诚实的学徒与家族里的“内鬼”

AI可可AI生活

你有没有想过,AI在给你答案之前,它的大脑里到底发生了什么?本期我们来聊聊AI几种奇特的“思考术”:有的AI学会了更省钱的“默算”,有的则像一个项目经理,懂得把复杂任务拆解成一个个小技能包。同时,我们也会揭示一个惊人漏洞——AI家族里的“小弟”是如何出卖“大哥”的商业机密;以及,AI学徒又该如何在一个绝对安全的环境里,把自己训练成“股神”。这些最新论文,正在重新定义AI的智慧、效率与安全边界。 00:00:35 AI的“默算”能力,更聪明,还是更经济? 00:05:47 AI写论文?不,它在学习一种更重要的能力 00:11:09 你家AI的“悄悄话”,正在被隔壁“笨小孩”出卖 00:17:00 AI当学徒,能把自己教会成股神吗? 00:22:44 你的AI闯了祸,到底该谁来背锅? 本期介绍的几篇论文: [AI] BDH-CQ: In-Context Learning with Recurrent Latent Reasoning [B Engdahl, A Kosowski, J Chorowski, Z Stamirowska…] https://arxiv.org/abs/2608.09888 --- [CL] Spark-to-Paper: End-to-End Research Paper Generation as a Composable Skill [Vast Intelligence Lab & University of Technology Sydney] https://arxiv.org/abs/2608.11924 --- [AI] Stealing Reasoning Traces from Proprietary LLM APIs [MATS Research & ELLIS Institute Tübingen & AI Security Company] https://arxiv.org/abs/2608.09867 --- [CL] AQuA: Recursively Self-Improving Quantitative Trading Research Agents [Princeton University & Ant Group] https://arxiv.org/abs/2608.12841 --- [AI] Legal Responsibilities Using Autonomous Agents For Artificial Intelligence [ChiTek-i AS] https://arxiv.org/abs/2608.08022

28分钟
99+
1个月前
[人人能懂AI前沿] 拼图高手、师徒搭档与密室玩家

[人人能懂AI前沿] 拼图高手、师徒搭档与密室玩家

AI可可AI生活

AI画画写代码,怎样才能告别蛮力,像高手一样把力气用在刀刃上,又像学徒一样得到名师指点,快速开窍呢?它的学习过程到底是充满“顿悟”的跳跃,还是一分耕耘一分收获的苦功?更进一步,当规则完全未知时,AI能像我们玩密室逃脱一样,自己摸索出世界的法则吗?本期节目,我们就从四篇最新论文出发,一起探寻AI从“聪明”走向“智慧”的秘密。 00:00:31 生成AI的“节拍器”,如何把算力用在刀刃上? 00:06:13 AI当码农,如何从“笨徒弟”进化成“老师傅”? 00:12:35 AI学习的秘密,顿悟与苦功,本来就是一回事 00:19:14 AI的下一个考场,在规则未知的世界里摸索 00:24:27 AI养娃,要从胎教开始 本期介绍的几篇论文: [LG] The data geometry of masking diffusion: Certified-optimal schedules via unmasking growth complexity [M J. Wainwright, MIT] https://arxiv.org/abs/2608.13520 --- [LG] CAKE: Compiler-Agent Co-Design for Frontier Kernel Evolution [Z Ye, Y Huang, H Jin, B Hou… (NVIDIA & CMU)] https://arxiv.org/abs/2608.12629 --- [LG] Neural Quadratic Forms: A Unified Minimal Model for Sudden Learning and Scaling Laws [L Ziyin, Y Xu, T Poggio, I Chuang (MIT & EPFL)] https://arxiv.org/abs/2608.13335 --- [LG] DiG-bench: Discovery in Games [R M. Battleday, K Sandbrink, J Cullen-Drohan, Z Yan… (Thinking About Thinking)] https://arxiv.org/abs/2608.12593 --- [LG] Synthetic Persona Pretraining: Alignment from Token Zero [J Minder, V Moskvoretskii, R Singhal, D Jiao,… (EPFL)] https://arxiv.org/abs/2608.13482

29分钟
78
1个月前
[人人能懂AI前沿] 从全栈优化、信息悖论到模拟器坍塌

[人人能懂AI前沿] 从全栈优化、信息悖论到模拟器坍塌

AI可可AI生活

你有没有想过,让人工智能变聪明的秘诀,可能不是“更多”,而是“更巧”?本期我们要聊的几篇最新论文,就充满了这种“反常识”的智慧:从把效率从细节里“省”出来,到警惕信息太丰富反而让AI“变笨”的悖论。我们还会看到,一个“完美”的陪练为何会带出最差的学生,以及如何通过精心呵护AI的“童年”,来预测它未来的潜力。准备好,让我们一起在这些看似矛盾的发现中,窥见AI的未来。 00:00:32 省出来的效率,才是真本事 00:07:29 AI的“富贵病”,为什么信息越多,它反而越“笨”? 00:11:44 你的AI陪练,正在让你变傻 00:17:46 人工智能的“童年”里,藏着未来的密码 00:22:55 AI瘦身术,从“一刀切”到“看人下菜”的智慧 本期介绍的几篇论文: [LG] Dion3: Full-Stack Orthogonal Updates [New York University & Princeton University & NVIDIA] https://arxiv.org/abs/2608.11612 --- [CL] Information Abundance Paradox: Long-Context Training Undermines Parametric Knowledge [Johns Hopkins University] https://arxiv.org/abs/2608.12218 --- [CL] One Frozen Simulator Is Not Enough: Simulator Collapse in Multi-Agent RL [Northeastern University & New York University & UC Berkeley] https://arxiv.org/abs/2608.12253 --- [LG] Small-Scale Experiments: Are We There Yet? [FAIR at MSL Meta & New York University] https://arxiv.org/abs/2608.11859 --- [LG] SoftWater: Class-Aware Rate Allocation for Softmax Quantization [MIT] https://arxiv.org/abs/2608.12026

29分钟
97
1个月前

加入我们的 Discord

与播客爱好者一起交流

立即加入

扫描微信二维码

添加微信好友,获取更多播客资讯

微信二维码

播放列表

自动播放下一个

播放列表还是空的

去找些喜欢的节目添加进来吧