2026-08-29
📰 10 条要闻 🌐 14 个权威信源 ⏰ 24-48h 实时
OpenAI 公布自研推理芯片 Jalapeño 首批测试结果,显示在匹配用户体验条件下, Jalapeño 相比对比系统可实现最高 4.1 倍交互性能提升(/watt),端到端延迟降低最高 3.6 倍,且同一架构兼顾高吞吐与低延迟。芯片跨模型运行 GPT-OSS 120B、DeepSeek R1 和 Kimi K2.5 1T 均有效,OpenAI 称之为全栈优势的具体证明,预计未来数月扩大部署。
智谱 AI 于 8 月 14 日发布 GLM-5.3,延续 GLM-5.2 基座但通过大规模后训练实现能力跃升。在 Terminal-Bench 3.0 上得分从 4.6 升至 28.3,编程效率体感提升 50%,网络安全任务接近 Claude Mythos 5。编程与 Agent 能力已接近 Anthropic Claude Fable 5,官方承诺两周内(即 8 月 28 日前后)开放完整权重,同时 ZCode 用户突破 100 万。
Anthropic 于 8 月 27 日宣布将 Model Hardware Standard(MHS)研究预览版开放给首批科研实验室和先进制造商。MHS 是一份共享规范,旨在让 AI agents 安全地操控物理设备、机器人等真实世界硬件,被视为具身智能安全标准化的重要一步,Anthropic 表示这是 AI 走向物理世界的基础设施级规范。
据《晚点 LatePost》等媒体 8 月 6 日报道,字节跳动正在讨论训练参数规模超 5 万亿的大模型,将超越月之暗面 Kimi K3 的 2.8 万亿参数,成为国内已知最大参数计划。字节 CEO 梁汝波同时强调坚持大模型自研,拒绝使用模型蒸馏加速研发,表示接受短期在榜单上落后于 Kimi、DeepSeek 等竞品。
DeepSeek 于 8 月 21 日推出 V4 Flash-Vision-Exp,开始支持图像输入,为视觉推理实验版本。此前 DeepSeek 自 7 月 31 日发布 V4 Flash(综合能力指数 50 分逼近 GLM-5.2 Max 的 51 分,价格仅为后者十五分之一),8 月 16 日启用峰谷计费,定价策略持续调整。
Google DeepMind 于 8 月发布 Gemini 3.5 Transcribe(Omni 1.1 Flash 变体),主打智能语音转文字,可将音频转录为符合语言习惯的文本,显著提升流畅性和可读性,支持中文普通话及多种方言(东北官话、北京官话、粤语等),在噪音环境中优于前代模型。
月之暗面于 8 月 4 日正式向开发者发布通知,kimi-k2.5 模型及更早期的 moonshot-v1 系列模型 API 将于 8 月 31 日正式下线(kimi-k2 系列已于 5 月 25 日下线)。官方建议迁移至 kimi-k3(旗舰版)、kimi-k2.6(通用)或 kimi-k2.7-code(编程专用)及其高速版,标志着月之暗面产品线全面转向新一代架构。
光本位科技于 8 月 28 日宣布完成新一轮数十亿元融资,估值达到近 200 亿元人民币,成为全球融资规模最大、产品研发和商业化进度最快的光计算公司之一。光计算被视为突破 GPU 算力瓶颈的潜在路径,该笔融资显示资本对后硅时代计算架构的持续关注。
OpenAI 于 8 月 26 日发布博文,详细阐述 Hugging Face 平台遭遇的安全事件,分析开源模型托管生态中的供应链风险,呼吁行业共同应对 AI 安全挑战。OpenAI 同时联合 Anthropic、Google 签署公开信,号召建立「全球网络防御总动员」机制,用 AI 能力武装防御方,应对日益复杂的 AI 网络攻击。
第二届世界机器人运动会于 8 月 26 日正式闭幕,智元(EndoBot)首次参赛即以 18 金 16 银 12 铜登顶金牌榜和奖牌榜双料第一。智元是国内具身智能代表企业,其在机器人运动会上的表现被视为国产具身智能技术实力的重要标志。