要点速览
- OpenAI 预告 GPT-5.6 Sol 的 Ultrafast 模式,速度提升至 14 倍,先在 API 向部分客户推出。
- Perplexity 发布多项更新:Agent API 性能倍增、Search as Code 成本降低 10%,并推出 Web Search Benchmarks。
- 国产模型 GLM-5.3(700B)发布受关注,GLM 5.2 在 AI Gateway 免费提供。
- Paul Graham 观察微调开源模型重新流行,并指出 token 付费模式下速度是明智策略。
- OpenAI Foundation 投入 1 亿美元开展公共卫生项目,目标将四个州丙肝治愈率翻倍。
- 消费者 AI 代理机会被点名为未来 12 个月爆发方向。
一、AI 模型与基础设施
- OpenAI CEO Sam Altman 预告 GPT-5.6 Sol 的 Ultrafast 模式,速度提升至 14 倍,将先通过 OpenAI API 向部分客户推出。这一动作加剧了推理速度竞赛,也呼应了“按 token 付费时更快模型更划算”的策略逻辑。 — 来源:1
- Perplexity CEO 表示已在 Wide-And-Deep-Research 基准上测试 Grok 4.6,称其位于性能与成本 Pareto 前沿,现已对 Perplexity Pro 和 Max 用户开放。 — 来源:1
- GLM 系列新版本受关注:Aravind Srinivas 赞赏 GLM-5.3(基于 743B 基础模型的 700B 参数)在编码、代理能力和网络安全方面的突出表现;同时 GLM 5.2 通过 Blackbox AI 在 AI Gateway 上免费提供,最高 500 TPS,免费持续至 8 月 27 日。 — 来源:1 2
- Yohei 注意到 DeepSeek Harness 以 MIT 许可证开源,将所有组件(模型、工具、技能、会话、沙盒、文件系统、循环、编排和 UI)实现为插件,模块化设计值得关注。 — 来源:1
二、AI 代理与开发者工具
- Perplexity 发布多项代理与搜索更新:Agent API 新增多步研究、代码执行、内置工具和多模型接入,Sonar 迁移后在 BrowseComp 和 WideSearch 上得分较最佳 Sonar 翻倍以上;Search as Code 优化后单任务成本降低近 10%;并推出 Web Search Benchmarks 供模型搜索能力排名。 — 来源:1 2 3
- Vercel CEO Guillermo Rauch 预测,一条命令将所有编码代理连接到 AI Gateway 将成为大规模使用编码 AI 的默认方式,优势包括高可用、模型可选、更低成本、可观测性和 ZDR,并能配置 Claude Code 和 Codex 等现有工具。 — 来源:1
- Replit CEO Amjad Masad 表示,仅添加编程工具链就几乎解决了 ARC-AGI-3,编程使 LLM 获得泛化能力;他还提到 WhisperAI 用 Replit Agent 构建并在 6 个月内达到七位数年经常性收入,Replit 入选 Inc. 5000 第 24 名。 — 来源:1 2
- Greg Isenberg 认为最大的消费者 AI 机会是帮用户解决长期拖延的琐碎事项:AI 代理承担找上下文、做决定、起草消息等 90% 工作,用户只需确认发送;切入场景包括保修返利、服务切换、学校表格等,并预计未来 12 个月将出现大量此类应用。 — 来源:1
三、趋势、观点与社会影响
- Paul Graham 观察:一年前微调开源权重模型被认为浪费时间,因为模型公司新版本很快会超越,但现在微调开源模型似乎重新流行,反映出行业对开源模型策略的重新评估。 — 来源:1
- Paul Graham 指出,当客户按 token 付费时,让模型跑得更快是非常明智的策略——这与 OpenAI 推出 14 倍速模式形成呼应。 — 来源:1
- Paul Graham 提出一个亟待讨论的问题:大量旧软件漏洞正被修复关闭,而情报和执法机构依赖这些漏洞获取访问权限,一旦失去该途径将怎么办。 — 来源:1
- OpenAI Foundation 启动 AI for Civil Society and Philanthropy,首期投入 1 亿美元与 Common Health Coalition 合作,目标将阿拉巴马、伊利诺伊、路易斯安那和马萨诸塞州的丙肝治愈率翻倍。 — 来源:1
- Reid Hoffman 自曝曾私下资助 UBI 实验且零媒体曝光,认为这比任何声明更能证明品格,为全民基本收入提供个人实践案例。 — 来源:1
