要点速览
- OpenAI发布首款自研AI芯片Jalapeño,与Broadcom合作,专为LLM工作负载设计。
- NVIDIA NeMo AutoModel基于Transformers v5,可将MoE模型训练吞吐量提升3.4-3.7倍。
- Hugging Face机器人数据集从1000增长至6万个,发布HIW-500人形机器人数据集(500+小时)。
- NVIDIA在最新超算TOP500中驱动81%的系统,AI训练吞吐量是其他平台总和的两倍。
- Anthropic推出Claude Tag,允许在Slack中作为团队成员协作。
- xAI Grok Build推出Firecrawl和MongoDB官方插件。
一、AI硬件与基础设施
- OpenAI宣布设计并制造了首款自研AI芯片Jalapeño,与Broadcom合作,专为ChatGPT、Codex、API及未来agent产品的LLM工作负载设计。OpenAI认为芯片是AI经济的基础,自研芯片可扩展全栈平台并扩大AI普及。— 来源:1
- NVIDIA在最新超算排名中,驱动了TOP500中81%的系统及89%的新系统,AI训练吞吐量是其他平台总和的两倍,推理吞吐量三倍,并包揽Green500中能效最高的8个系统。— 来源:1
- Hugging Face的公共机器人数据集从2025年初的1000个增长到6万个,流式传输速度可达约1326 MB/s;同时发布HIW-500,最大开源人形机器人远程操作数据集,包含500+小时、23K+ episode、10+ TB数据,覆盖12个家庭的10+种家务任务。— 来源:1 2
二、模型与性能突破
- NVIDIA发布NeMo AutoModel,基于HuggingFace Transformers v5,支持专家并行、DeepEP和TransformerEngine等优化,可将MoE模型训练吞吐量提升3.4-3.7倍。— 来源:1 2
- NVIDIA AI展示FastVideo在单个RTX 5090上实现5秒480P视频端到端生成仅需1.8秒,基于FastWan-QAD模型。— 来源:1
三、产品与应用创新
- Anthropic推出Claude Tag新功能,允许团队在Slack中将Claude作为团队成员加入,通过标记和委派任务协作。该功能将AI从工具变为同事,但Ethan Mollick指出其带来锁定风险(隐性知识依赖)和安全风险(权限误用),且按token计费难以控制成本。— 来源:1 2
- xAI Grok Build Marketplace推出Firecrawl官方插件(可搜索网页、抓取交互)和MongoDB官方插件(查询数据、优化索引)。— 来源:1 2
- Runway发布Seedance 4K、Seedance Mini、Kling 3.0 Turbo视频模型,并提供30%折扣;新增广告本地化功能,上传图片即可生成多语言版本。— 来源:1 2
- OpenAI DevDay 2026开放申请,将于9月29日在旧金山举行,截止日期7月10日。— 来源:1
