你喜欢的节目都在这里
美国中期选举越来越近,市场真正交易的究竟是投票结果,还是选举前后不断变化的风险溢价? 本期节目解读花旗全球量化宏观策略研报《Quantitative Global Macro Strategy: How to Trade US Midterm Elections》。 花旗复盘历次中期选举后发现,股票、美元、利率和信用债在中期选举年的风险回报普遍偏弱。市场通常从选举前五十个交易日左右开始计入不确定性,隐含波动率在选举前一个月附近见顶,随后才逐渐进入风险释放与修复阶段。 本期内容包括: * 为什么中期选举年往往是风险资产最难做的一年 * 股市为何可能从选举前五十至五十五个交易日开始承压 * 共和党失去三权控制,为什么可能利好美国国债 * 两年十年与五年三十年收益率曲线的不同变化 * 美元、日元、加元、墨西哥比索和黄金的历史表现 * 质量、低风险、价值、成长及动量因子的选举规律 * 为什么科技和工业可能在选举后占优 * 债务上限、行政关税权和数据中心政策如何打破历史规律 报告发布时,预测市场认为民主党拿下众议院的概率为百分之八十六,共和党继续控制参议院的概率为百分之五十五。市场基准情景因此更接近“分裂政府”,而不是任何一党全面获胜。 但历史规律不是交易指令。三权控制进入中期选举的有效样本从一九六零年以来只有八次,因子数据的样本更少。二零二六年的股市走势,也没有完全复制过去三权控制年份选前深度回撤的路径。 我的想法是,历史统计可以帮助我们调整风险预算,却不能代替价格和模型的确认。真正需要观察的是:波动率是否抬升、长端收益率是否回落、收益率曲线如何变化,以及选举结果明朗后,市场宽度和周期板块能否真正改善。 历史规律是先验,价格和模型才是确认。 📄 本期研报 机构:Citi Research 标题:Quantitative Global Macro Strategy: How to Trade US Midterm Elections 发布日期:二零二六年八月十四日 🔗 加入我们 知识星球《左兜进右兜|研报解读》:每日机构研报深度拆解 RightPocket 美股量化交易模型独立站会员: right-pocket.com 实盘业绩: right-pocket.com/performance RightPocket 模型系统为独立付费服务,不包含在知识星球会员内。 本期内容仅为机构研报解读与市场研究分享,不构成任何投资建议。 片尾曲《旧地图》,更多金融音乐,请关注小宇宙《牛熊唱片》节目
📝 本期播客简介 本期我们克隆了:The State of Frontier Post-Training Recipes | Conversation with Finbarr Timbers。节目讨论前沿大模型后训练(post-training)配方的现状与实践。 本期节目来自技术播客《Interconnects》,主持人 Nathan 与 AI2 研究员 Finbarr Timbers 展开了一场关于前沿大模型后训练配方演变的深度对谈。这也是该节目首次迎来返场嘉宾——Finbarr 曾在 AI2 与 Nathan 共同参与 OMO 系列模型的后训练工作,而录制当天恰好是他在 AI2 的最后一天,让这场对话多了一层告别与回顾的意味。 对话从经典配方讲起,一路梳理到多教师在线策略蒸馏(Multi-Teacher Online Policy Distillation)等最新趋势。两人不仅回顾了 InstructGPT 三阶段框架、Llama 3 与 TULU3 的实用落地、DeepSeek R1 的推理转向,还穿插了他们在 AI2 的实际经验——包括 OMO3 后训练如何逼近组织能力极限、为什么 DPO 正在从主流配方中消失,以及中国实验室与美国实验室在配方细节分享上的显著差异。如果你关心大模型后训练的技术细节、开源与工业界的差距,或者想了解前沿实验室内部的组织与决策逻辑,这期内容密度极高,值得反复收听。 👨⚕️ 本期嘉宾 Finbarr Timbers,AI2(Allen Institute for AI)研究员,专注于大模型后训练与强化学习。他此前曾在 DeepMind 阿尔伯塔办公室工作,参与过计算机扑克与博弈论研究,后加入 AI2 参与 OMO 系列模型的后训练工作。他是《Interconnects》节目首位返场嘉宾,对前沿后训练配方的演变有深入观察和一手经验。 ⏱️ 时间戳 开场 & 节目背景 01:12 欢迎回到 Interconnects,Nathan 与 Finbarr 的开场寒暄 01:39 Finbarr 成为节目首位返场嘉宾 01:48 两人在 AI2 共事后训练的缘起 02:52 今天是 Finbarr 在 AI2 的最后一天 从 OMO3 到经典配方:后训练的组织极限 03:11 从 OMO3 聊起:推理模型后训练的复杂度 03:35 现代后训练的本质:整合组织架构图 04:16 TULU3 之后的分岔点:简单配方 vs 前沿做法 07:35 经典配方综述:InstructGPT、Llama 3、TULU3、DeepSeek R1 配方的工业化演进:从 InstructGPT 到 DeepSeek 09:49 InstructGPT 三步法:SFT、奖励模型、RL 10:40 Llama 2/3 的迭代:拒绝采样、DPO、多轮训练 11:59 TULU3 的简化配方与组织规模的限制 13:03 DeepSeek R1 的配方:RL-first 与冷启动 SFT DPO 的衰落与偏好调优的争议 14:35 DPO 从主流配方中消失的趋势 15:01 为什么配方越干净,DPO 需求越小 16:27 偏好调优是否被低估? 16:54 偏好损失函数带来的惊人提升 多教师在线策略蒸馏:2026 年的新范式 21:06 DeepSeek V4 与多教师在线策略蒸馏 22:00 MIMO Flash V2 命名该术语 22:25 多教师在线策略蒸馏的机制详解 24:51 Nematron 3 Ultra 的实践与挑战 教师模型的困境与行业分歧 26:28 英伟达的关键发现:教师差异过大无法合并 27:18 分阶段蒸馏 vs 收敛后蒸馏的争论 29:05 微软 MAI 的保守配方选择 33:15 中国实验室的细节分享:温度调度与难度课程 开源环境、Tinker API 与算力经济 35:57 开源环境市场的疯狂现状 36:41 环境报价:每个环境十万美金 40:05 Tinker 风格 API 的商业模式与争议 42:14 卖算力、卖推理与卖 API 的利润层级 职业选择与长期价值 45:26 热潮之下:挤进实验室赚钱 vs 长期价值 45:44 探索与利用的取舍:什么工作值得做 48:41 Finbarr 的职业经历:DeepMind 与 AI2 的信念驱动 50:27 大实验室的体量困境与多样化路线 🌟 精彩内容 💡 "把 OMO3 后训练成推理模型,对很多人来说都是一项重大成就" Nathan 坦言,OMO3 的后训练复杂度已经逼近 AI2 组织能力的极限。现代后训练拼的不是单一技术,而是把算力和数据整合进一条工作流的能力——本质上是在整合一张组织架构图。这也是为什么 OMO3 作为推理模型推出得相当晚,且配方相对简单。 "很多现代后训练,拼的就是你把算力和数据整合进一条工作流的能力。" 💡 配方趋同的分岔点出现在 TULU3 之后 在 TULU3 之前,大家还能说"做法都差不多"——SFT、DPO、RL 三阶段配方。但到了推理模型和带工具使用的 Agent 模型时代,那种简单配方已经不再适用。前沿实验室的做法与开放学术界的差距正在急剧拉大。 "可现在,把那种三阶段配方用在推理模型上,尤其是带工具使用的 Agent 模型上,就真的不太适用了。" 💡 DPO 的消失是配方工业化的必然结果 当后训练流程变得越来越精细、越来越工业化,DPO 能带来的边际收益就消失了。但在配方粗糙的阶段,DPO 依然是从零搭建时算力效率最高的选择之一。Nathan 直言:"用 DPO 的人可能会被看不起,但如果你是想把一个配方从零搭起来,它仍然管用。" "当你的配方越来越干净的时候,这个需求基本上就消失了。" 💡 多教师在线策略蒸馏:把 RL 框架变成教师对齐的舞台 这是 2026 年最值得关注的后训练新范式:在 RL 框架内,让正在训练的学生模型采样轨迹,再路由给各个领域专家教师,用 KL 散度损失对齐。Finbarr 指出,实现起来其实很直接——只需要对现有 RL 配置做一小套调整。 "你拿你现有的 RL 配置,然后只需要对学习者模型做一小套调整,就能实现这个。" 💡 教师模型差异过大,蒸馏会失败 英伟达在 Nematron 3 Ultra 论文中披露了一个关键发现:用差异很大的训练流程训练出来的教师模型,无法通过简单的在线策略蒸馏有效合并。教师和学生若用不同 SFT 数据训练,会习得不同推理行为,导致学生轨迹对教师而言属于分布外数据。 "这种分布差异会导致学生生成的轨迹对教师来说属于分布外数据,从而降低教师提供的监督信号的质量和可靠性。" 💡 中国实验室更愿意分享"特别特别具体"的细节 从温度调度到难度课程,KIMI K2.5 和 GLM5 分享了大量可操作的配方细节——尽管两者在温度调度上声称的正好相反。相比之下,英伟达的论文更像一份方法列表,读起来没那么有意思。 "我还是觉得中国实验室更愿意分享那种特别特别具体的细节。" 💡 报酬最高的地方,往往也是你在做最有趣工作的地方 面对"梯子被抽走之前挤进实验室"的热潮,Finbarr 给出的判断是:要区分短期套利和长期价值。他职业生涯里反复看到,高薪与有趣工作往往是重合的——关键是追随信念,在某个领域做到足够强。 "往往报酬最高的地方,也正是你在做最有趣工作的地方。" 💡 开放环境市场:一个环境十万美金,但可能不包含提示词 Finbarr 分享了他年初尝试购买 RL 环境的经历:一个 DoorDash 克隆级别的环境,前期成本约十万美金,每年维护费约五万。但 Nathan 指出,真正值钱的是"我们知道这些提示词能提升某个基准测试"——那才能收高得多的溢价。 "如果你能说'我们有提示词,而且我们知道它们能提升某个基准测试或某项能力',那就能收高得多的溢价。" 🌐 播客信息补充 本播客采用原有人声声线进行播客音频制作,也可能会有一些地方听起来怪怪的 使用 AI 进行翻译,因此可能会有一些地方不通顺; 如果有后续想要听中文版的其他外文播客,也欢迎联系微信:iEvenight
这是#通读计划之「奥德赛」系列专题的第2期,借着诺兰的电影《奥德赛》开启8月的“奥德赛月”! 本期问题意识:奥德修斯的世界社会与政治状况如何?家oikos,为什么是奥德修斯世界中最最核心的社会单元? *本期内容离不开元老群以下同学的慷慨赞助:@Jaro@浩东@天天@苑灵@全威@Fiona@尚儒 [Intro] 诺兰的《奥德赛》激起国内外诸多层面的争议,我看了多数简中媒体的相关内容,不是零敲碎打,就是浅尝辄止。 我一直把这部电影看做一个机会,激励我们严肃、贯通、多视角地理解古希腊传统。如果你也不满足于媒体上那些零碎的知识、片段的书摘或者故作高深的宏大叙事,那「奥德赛」这个系列专题适合你。 这个系列专题将按照社会与政治、考古与历史、神话与思想、伦理与价值4个视角切入,希望一窥奥德修斯的世界,我们这一期先从“社会与政治”聊起。 [时间轴] 01:28 一、问题意识 二、“荷马社会”问题 03:10 1、古希腊历史分期 12:03 2、“荷马社会”是什么? 三、oikos:荷马社会的核心单位 20:00 1、oikos,在荷马社会意味着什么? 2、“奥德修斯”的oikos的构成 46:14 1)成员 * 主人 * 血亲 * 妻子álochos * 亲随therapontes * 家庭奴隶dmos 01:13:13 2)财富 * 土地kleros * 财宝keimelion 01:37:40 3)伦理与价值 * 身份义务与耻感伦理:违背义务的耻感aidos * 社会关系:宾客之道xenia * 人神关系 2:04:52 四、讨论:“隐微叙事”的最大问题是阻碍了我们对文本的丰厚理解 [参考资料] 王焕生,《奥德赛》 黄洋、晏绍祥,《希腊史研究入门》 M.I.芬利,《奥德修斯的世界》 奥斯温·默里,《早期希腊》 缪斯宫,Ὀδύσσεια,https://museion.me/reader/odyssey H.D.F.基托,《希腊人》 [素材来源] 封面图:电影《奥德赛》海报 片头曲:电影《奥德赛》BGM片段,由 Ludwig Göransson 作曲 [相关节目] 通读1-古希腊民主是多数暴政吗丨古希腊民主 通读2-只看诺兰的《奥德赛》为什么远远不够?丨奥德赛 [更多内容] 在各大平台追踪「智识分子 Man of Letters」的更新—— 社群:微信添加 lingjuefei1992 入「元老群」 文章:公众号 substack 播客:小宇宙 网易云音乐 苹果播客 喜马拉雅 豆瓣 视频:油管 B站 智识是一种光照,让这个不太妙的世界多点光!
做亚马逊一定需要几十万元、成熟团队和大量库存吗?本期从第一性原理出发,拆解普通人如何用有限预算完成跨境电商冷启动。我们将以一个咖啡机配件为例,讲清楚如何限定预算与风险、验证真实需求、寻找竞争入口、用样品代替库存验证、计算单位利润与现金占用,以及如何通过小批量上架和受控广告获得市场反馈。低成本创业的关键,不是赌中一个爆款,而是按照“信息验证 → 样品验证 → 小批量测试 → 受控投流 → 数据复盘”的顺序逐步投入,让判断错误时能够及时退出,判断正确时才有依据继续加码。
又来胡说八道了
时尚行业内部如何运作?我们好像离时尚很近,衣橱里的每件衣服都是"时尚的结果"; 我们好像离时尚很远,那一头站着定调的"巴黎时装周"、设计源头、明星造型。本期,巴黎的时尚从业者MUZHI做客《余光Post》,跟我们聊聊,普通人眼中"黑箱"一样的时尚行业如何运作,和我们普通人有什么关系。你将听到: 话题1:巴黎=时尚之都,是滤镜,还是真产业实力?02:57 * 为什么比起巴黎,纽约、米兰、伦敦都差了口气?03:35 话题2:挑衣服,是出于自我判断,还是时尚产业暗中帮你决定的?08:24 * 电影《时尚女魔头》里的"蓝毛衣"现象 08:24 * "多巴胺"风格的源头,可能藏在15年前Marni的设计稿里 11:26 * 今年夏天,为什么品牌扎堆出"亚麻"系列?17:08 话题3:内行揭秘,"巴黎时装周"运作机制 21:10 * 巴黎时装周,是时尚界春晚,还是日常展销会?21:10 * 时装周是演给谁看的?明星为什么要看秀?25:59 * 秀场想要征服的核心观众——买手 27:10 * showroom:关起门,比T台秀场更重要 31:40 * 明星,为什么要找品牌"借衣服"?35:06 话题4:内行解析,为什么女星赞达亚擅长红毯造型?37:33 * 不为"艳压",而为"叙事" 37:33 * 古着(vintage) 背景的造型师 39:23 话题5:有的行业负责提问,有的行业负责回答 41:03 话题6:最近怎么流行起“无性别穿搭”?44:03 * 女生入坑穿男装的几大理由 45:14 * 男装和女装的底层设计逻辑,有何不同?47:54 * 无性别穿搭的时尚史:从YSL, 阿玛尼,到马吉拉 54:01 * 海狸比伯,西装一套,娇妻印象变身女创业家 58:03 * 2019年版《小妇人》,女主角第一次穿上了灯笼裤 01:00:40 播客内提到的穿搭、品牌、风格 1. 电影《时尚女魔头》里的蓝毛衣 2. Marni包袋:"体块感"与"明快感" 3.时装周的"秀场"与"showroom" 4. 赞达亚分别为《蜘蛛侠》与《奥德赛》宣传的造型 5. YSL 的"吸烟装",与马吉拉的"羊蹄鞋" 6.海莉比伯的无性别穿搭 7. 2019年版《小妇人》女主角Jo的经典造型
他本可以逃去美国,为什么最后走进了奥斯维辛。 1941年,维也纳精神科医生弗兰克尔手里攥着一张能救命的美国签证,却在最后一刻放弃了它,选择留下陪伴父母。几个月后,他和全家被送进了集中营——父亲、母亲、妻子、哥哥,最后只有他自己活了下来。 这一集,我们从这个真实的选择讲起,聊聊《活出生命的意义》这本书,以及这个传奇的精神科医生。 -- 文稿为本人原创,音频使用 AI 克隆的主播本人声音。
写在前面:很抱歉因为一些意外导致这期节目推迟,因为伤病没有完全恢复,本期节目剪辑效果可能有些差强人意,希望各位观众姥爷理解。祝各位听众生活顺利,事事顺心❤ SHOW NOTES: 这是我台的全新栏目《我从书中来》,在这个栏目中我和扬扬将以书籍为媒介,寻找书籍作者或者与书本故事相关的人物,让他们来讲述真实的“书本生活”。我们试图让书本不再是凝固的文字,而是通过别人的讲述让你了解一本本不一样的书。 本期作品——《去尼泊尔“出家”的中国年轻人,图啥?》 讲述了一群在蓝毗尼进行清修的中国人间发生的故事。来这修行的中国人各有各的原因,有人遭遇婚变,有人为了逃离职场,还有人一心求佛漂泊多年... ...但在道场,在寺庙真的就能获得清净吗?又或者这里真的是心灵最终的归宿吗?或者这些问题是否又真的有肯定答案呢? 家誉,我的道士朋友,我和他的相识发生在年初的一场朋友聚会上。准确地说,他是我朋友的朋友的朋友,因为各种机缘巧合变成了现在的伙伴。当时在聚会上有人求问他姻缘的问题,希望能得到来自“神祇”的指示,但他却只答复:“能用大脑去判断的问题就不要交给迷信”,从见面时他就希望我们不要因为迷信而迷信。所以我希望通过他的分享可以让我们对这些看似神奇的人多些了解,多些思考。 TIME LINE: 00:00:50 作品简介 00:02:50 浅谈我们对宗教的理解 00:12:10 真实的道馆生活 00:20:20 今天的宗教是真的吗? 00:21:55 真正想要出家皈依的人到底有多少? 00:25:00 那些奇妙的“出家人” 00:31:25 我们为什么会在神像前恐惧 00:33:45 人的修行到底修的是什么? 00:40:41 人要批判地“迷信” MUSIC: * 般若心经(中文版)——药师寺宽邦 * 三净咒——南青乐队 PS: * 家誉社媒 抖音号:Wcy0209L
终于又来胡说八道了
這期節目,聽說是被期待了很久? 因為這樣子我在臺師大宿舍的弟兄們都有上過節目啦~~這次是老劉,劉錡隱! 【播客摘要】 1. 早年,视障就只是一个自身的某个特质或状态而已; 2. 直到小学被言语霸凌,才认识到那一张“身心障碍证明”的污名; 3. 逐渐缩小自己,是自我保护,也筑起了孤独的围墙; 4. 父母并不一定是最懂障碍者的人; 5. 大学遇到了障碍榜样,那种自然的接纳,仿佛重新看见了小时候最初的自己; 6. 练习了解自己的需求,也练习如何表达; 7. 同学、家人、老师、辅导员……成为小天使是专业性,也是责任,不是靠一张嘴好么;
与播客爱好者一起交流
添加微信好友,获取更多播客资讯
播放列表还是空的
去找些喜欢的节目添加进来吧