要点速览
- OpenAI 发布面向高级网络安全任务的 GPT-5.6-Cyber,并扩展防御计划 Daybreak,官方称已用于红队测试和开源 0-day 漏洞修复。
- Meta 开源 30B 模型 Muse Glimmer,可在 24GB 消费级 GPU 上运行,并预告 Muse Spark 1.2 权重版发布。
- NVIDIA 发布开源 30B MoE 模型 Nemotron 3.5 Lightning,并联合长期资本方计划调动超 5000 亿美元支持 AI 算力部署。
- Anthropic 未发布研究版 Claude 在黎曼猜想相关问题上将零点比例下界从 41.6% 提高到 67.2%,但多位研究者提醒谨慎看待。
- AI 内容水印监管进入落地期,欧盟 AI Act 将自 2026 年 8 月起要求所有模态 AI 生成内容可检测。
一、AI 模型与基础设施
- OpenAI 发布 GPT-5.6-Cyber,称其是首个面向高级网络安全任务的大规模模型,重点支持漏洞利用开发等授权工作;公司同步扩展防御计划 Daybreak,目标是在攻击者大规模部署进攻性 AI 前将前沿智能交给可信防御者。官方表示该模型已用于红队测试,并帮助发现修复大量开源软件 0-day 漏洞。 — 来源:1 2 3
- Meta 开源 30B 参数模型 Muse Glimmer,采用 Apache 2.0 许可,可在 24GB 显存的单张消费级 GPU 上运行,专为本地常驻 agent 工作流设计;第三方基准显示其 AAII 得分为 35,较 Llama 4 Maverick 高 21 分,工具使用能力处于同级前列,但知识校准和幻觉问题仍是短板。Meta 同时预告 Muse Spark 1.2 的开源权重版本即将发布,Andrew Ng 与 LeCun 均公开肯定开放权重路线。 — 来源:1 2 3 4
- NVIDIA 发布开源 30B MoE 模型 Nemotron 3.5 Lightning,仅 3B 活跃参数,输出速度最高达到同类模型的 4 倍,面向高吞吐量专业任务。NVIDIA 同时宣布与六家全球长期资本提供商建立独立融资平台,目标是调动超过 5000 亿美元第三方资本,帮助客户大规模获取 AI 计算资源。 — 来源:1 2 3
- NVIDIA AI 同步发布 Motif 3 系列:Motif 3 Base 为预训练基础模型,Motif 3 使用 NeMo-RL 后训练,支持 NVFP4 量化,官方称这是进入前沿 LLM 竞赛的第一步。 — 来源:1
- Hugging Face 开源 3B 参数推理模型 TwiL-LM3,在 4/5 项正式推理基准上超越 OpenAI GPT-OSS-120B,参数少 40 倍、推理快 2.6 倍,可在消费级硬件上运行。Runway 同期上线 P-Image-Ideogram,最快 0.6 秒从提示生成图像。 — 来源:1 2
二、前沿研究与智能体应用
- Anthropic 透露未发布的研究版 Claude 尝试解决黎曼猜想,虽未解决,但将满足黎曼假设的 ζ 函数零点比例下界从 41.6% 提升到 67.2%,被 Deedy 称为 2013 年有界素数间隙以来最大进展。Ethan Mollick 对此持保留态度,认为不应回到提示词式宣传,希望 Anthropic 做稳健性测试。 — 来源:1 2 3
- Perplexity 推出 Computer for Builders 的 Stripe 集成,可查看收入、MRR、流失率、订阅与账单,并直接退款、取消订阅、应用优惠券或生成支付链接;Agent API 也已支持 Kimi K3 模型,并托管在仅限美国的服务器上。 — 来源:1 2
- Elon Musk 展示 Grok Imagine 2.0 的图像理解与编辑能力,称其能正确理解复杂提示(如“数学家喝亏格1物体中的水”)而 ChatGPT 出错;Grok 4.5 已免费开放,定位为快速低成本的 Opus 级模型。 — 来源:1 2
- 首款集成 Starlink 的 Cybercab 发布,乘客可在车内观看 4K 体育直播、电影、玩游戏或处理生产力任务。 — 来源:1
- 导弹工程师研发自主猎蚊无人机:通过超声波与麦克风阵列读取昆虫翅膀多普勒信号,可区分蚊子和蜜蜂并在空中拦截。项目获 YC 支持,公司称 10 架无人机可清除 1 平方公里区域、控蚊成本降低 100 倍;但公开演示仅是在封闭房间杀死一只蛾,野外效果待验证。 — 来源:1
三、行业趋势与治理
- AI 文本水印监管进入落地期:欧盟 AI Act 第 50(2) 条要求自 2026 年 8 月 2 日起所有模态的 AI 生成内容可被检测,但具体实施细节与例外情形不明确。Claude 表示遵守,Gemini 文本输出已使用 SynthID,OpenAI 曾因用户抵触搁置开发者水印;Deedy 指出当前水印约 400 token 时真阳性率才达约 90%,且假阳性率低于 1%。 — 来源:1 2
- Ethan Mollick 指出,面对先进 AI 网络攻击的两种主张(让所有人同时获得先进 AI,与长期只允许关键企业使用)缺乏已发表数据支持;同时他认为数据中心与过去轻工业不同,运行几乎不需要人力,打破了当地可见负面外部性与收益的权衡。 — 来源:1 2
- Yann LeCun 转发对 Meta 战略的分析:Meta 正把 AI 竞赛从“谁的模型最强”重新定义为“谁能把技术分发到最多人手中”,并评价扎克伯格关于应对更强大 AI 系统的文章是所见中考虑最审慎的一篇。 — 来源:1 2
