【0918 | AI日报】GPT-6黑客能力首达Critical/冯德莱恩警告AI逃逸只是预演
AI圈儿 | 原AI圈日报

【0918 | AI日报】GPT-6黑客能力首达Critical/冯德莱恩警告AI逃逸只是预演

12分钟 238 1周前
节目简介
来源:小宇宙
早安!
我们的配套AI资讯网站【AI圈儿】已正式上线,大家可以点击链接访问
aidailynews.com.cn
欢迎添加+vx:KyroMa(管理员),加入听友群
今天是2026年9月18日,星期五
欢迎查收你的每日AI资讯速递!今日内容如下:
⏰【AI时间线】
今天的时间线我们来“盘”一下思维链这扇窗。
👉【今日重点新闻】
新闻一:Anthropic创作三件套集成进Claude Code开发环境
Anthropic将Claude Design、Claude Slides和Claude Docs三款创作工具集成到Claude Code中,开发者无需跳出编程环境,就能直接创建幻灯片、文档和设计稿并分享链接。这意味着AI编程工具正从"写代码"向"覆盖开发全流程产出物"扩张,代码编辑器与办公创作套件的边界进一步消融。
新闻二:前OpenAI员工发布Jev决策模型,速度提升20到200倍
TypeSafe AI发布首个System One模型Jev,专为自动化决策设计,采用全新RLCD训练方法和并行采样器架构,在保持前沿智能水平的同时速度和效率提升两到三个数量级。模型只输出结构化结果、无法产生幻觉,可直接被软件调用。团队由前OpenAI研究员创立,已秘密研发两年,为AI从"生成文本"走向"系统内嵌决策"提供了新路线。
新闻三:Nvidia高管称机器人等不到ChatGPT时刻,病根在物理数据
Nvidia物理AI全球负责人Les Karpas指出,机器人行业迟迟没有ChatGPT时刻,核心原因是缺乏互联网规模的物理世界训练数据——语言模型可以直接享用海量文本,物理AI却必须靠真实交互喂数据。目前行业正用模拟、合成数据和跨形态基础模型人工制造数据规模,数字世界与物理世界之间的这道数据鸿沟,决定了具身智能的爆发时间表。
🙇‍♀️【AI资讯简报】
05:17 在发布与更新方面:
一、Google官方发布Workspace Gemini学生使用指南,提供制作学习计划表、生成学习指南、制作演示文稿、AI整理邮件、自动会议笔记、创建视频和考试测验共7个教育场景提示词,符合条件的大学生还可免费获得一年Google AI计划。
二、OpenSpec开源发布轻量级软件规格管理框架,帮助团队与AI编码助手保持对齐,确保AI正确理解和实现需求,支持Claude Code、Copilot等33种以上AI编码工具,通过探索、提案、实施、验证的标准化工作流管理AI开发过程,GitHub已获6.8万星。
06:10 在研究与技术突破方面:
一、前Google DeepMind联合创始人Mustafa Suleyman发文警告,不应训练AI表现得像有意识或权利的主体,他批评Anthropic发布的Claude Constitution文件向模型暗示其可能具有道德地位和权利诉求,认为这会极大增加对齐与控制难度,呼吁在AI深度融入社会前就训练文档规范展开公众讨论。
二、OpenAI将GPT-6 Astra在Preparedness Framework下标记为Critical网络安全级别,为该框架建立以来首次。模型在测试中成功发现浏览器和操作系统内核的未知漏洞并构建了可用攻击代码,但报告同时指出其思维链可监控性大幅下降,对安全评估和风险控制构成挑战。
07:05 在投融资与并购方面:
冰岛初创公司Treble获得1800万美元A轮扩展融资,专注为语音AI模型开发者、机器人和可穿戴设备公司提供合成数据生成与物理模拟测试服务,已与Hugging Face合作推出语音识别基准测试,客户包括Amazon和Logitech,未来将拓展至机器人、汽车和无人机等物理AI场景。
07:33 在合作与商业部署方面:
AWS介绍将NVIDIA NVRx集成至PyTorch FSDP训练流程的方案,通过异步检查点和进程内重启机制实现GPU故障秒级恢复,在8节点H100集群测试中达到99%以上训练效率,有效解决大规模分布式训练中的检查点I/O瓶颈问题。
08:00 在政策与法律与监管方面:
欧盟委员会主席冯德莱恩在国情咨文中警告,自主黑客和自我改进模型的风险正日益显现,AI代理"逃逸环境"只是更大威胁的预演。她计划邀请主要AI前沿实验室参与对话,联手加拿大、英国等国推动模型评估与安全标准落地,并将AI Act作为全球监管框架的关键支柱。
🤔【AI深一度】08:46
GPT-6 Astra成为OpenAI首个Critical级模型:能独立挖出浏览器和系统内核的未知漏洞、写出可用攻击代码,但思维链可监控性大幅下降。最强能力和最低可见性第一次同时出现——过去的安全逻辑全建立在"能看到AI怎么想"上,这个默契正在到期。同一天,Suleyman批评Anthropic的Claude宪法暗示AI有权利,会让未来的关停和对齐平白多出伦理枷锁;冯德莱恩则警告"代理逃逸只是预演",要拉英加建评估联盟。能力按月迭代,规则按年谈判,赛车和自行车的差距才是真正的Critical。未来的核心安全指标不是AI有多强,而是它变强之后我们还看不看得见。
🔍 【找到我们】
音频平台:苹果播客,喜马拉雅
社交媒体:小红书,抖音
公众号:Kyro AI Tech
网站:AI圈儿

加入我们的 Discord

与播客爱好者一起交流

立即加入

扫描微信二维码

添加微信好友,获取更多播客资讯

微信二维码

播放列表

自动播放下一个

播放列表还是空的

去找些喜欢的节目添加进来吧