要点速览
- OpenAI发布GPT-5.6系列(Sol/Terra/Luna)及ChatGPT Work代理,性能与效率显著提升。
- xAI发布Grok 4.5,多项基准测试领先,成本效率优于对手,并公布未来更新计划。
- Andrew Ng与Yann LeCun分别批评美国AI审查制度和呼吁保护开源,开源与专有AI路线之争加剧。
- NVIDIA展示与OpenAI合作、DGX Spark硬件表现及AI基础设施五层蛋糕比喻。
- Hugging Face公布Build Small黑客松结果与Gemma加速挑战,本地模型效率提升。
一、模型发布与性能
- OpenAI发布GPT-5.6系列:Sol为SOTA模型,Terra和Luna在更低价格下提供优秀表现,在编程、知识工作、网络安全和科学领域突出,且使用更少token和成本。同时推出ChatGPT Work(由Codex驱动),可跨应用和文件操作,长时间专注完成复杂任务。GPT-5.6已集成至微软Copilot Chat、Copilot、M365应用、GitHub和Foundry。— 来源:1 2 3 4
- xAI发布Grok 4.5,在多个基准测试(AutomationBench-AA、Terminal-Bench v2、Harvey Legal、SWE Marathon等)中超越其他前沿模型,成本效率显著优于对手。具备强大代理和编码能力,Grok Build功能持续改进。未来计划:上下文窗口扩展至1M tokens、2T参数基础模型本月完成训练、推理速度通过自研C/C++映射至GB300翻倍等。— 来源:1 2
- NVIDIA发布Flex-Forcing视频生成方法及Qwen3.6量化版本,实现2.5倍加速,27B模型可在24GB显存上运行。— 来源:1 2
二、开源与AI治理争议
- Andrew Ng引用“无需许可创新”观点,批评美国AI治理中非正式、不透明的模型审查制度,认为“自愿”协议实为强制,开源开发者难以合规;警告若走向“限制直到允许”模式,开源模型将灭亡,并可能引发类似Clipper Chip的战争。— 来源:1
- Yann LeCun强调开源是美国科技主导的基石,必须抵抗限制开源的努力,反对权力集中在少数专有AI提供商手中。同时批评特朗普削减高等教育经费将减少PhD候选人,削弱美国创新能力。— 来源:1 2
三、AI基础设施与行业动态
- NVIDIA展示与OpenAI合作:GPT-5.6在NVIDIA GB200和GB300 NVL72系统上训练运行,NVIDIA团队使用ChatGPT Work自动化工作流。Jensen Huang将AI基础设施比作五层蛋糕,当前数千亿美元投入但瓶颈在电网,能源是智能时代约束条件。DGX Spark硬件无散热问题,统一内存架构最大化每瓦token价值。— 来源:1 2
- Hugging Face公布Build Small黑客松结果(946个应用,22个获奖者)及Gemma加速挑战(单张A10G上推理快5倍,最快491.8 TPS)。llama.cpp新增DFlash支持投机解码,本地模型性能提升。— 来源:1 2 3
