
DeepSeek V4 正式版发布:性能逼近 Opus 4.8,定价仅为 Fable 5 的 1/57
模型2026年8月2日
DeepSeek V4 GA 正式版上线:Pro/Flash 双版本、百万上下文与峰谷计费,SWE-bench 80.6% 逼近 Opus 4.8,附旧 API 迁移指南。

DeepSeek V4 GA 正式版上线:Pro/Flash 双版本、百万上下文与峰谷计费,SWE-bench 80.6% 逼近 Opus 4.8,附旧 API 迁移指南。

OpenClaw 背后的极简编码智能体 Pi:最短系统提示词加四个核心工具,靠扩展系统让 Agent 自己扩展自己。

围绕 DeepSeek 前缀缓存设计的开源编码 Agent:长会话缓存命中 90%+、输入成本约 1/5,单个 Go 二进制,终端/浏览器/编辑器三端通用。

Simon Willison 的轻量评测套件 smevals:目录即评测、YAML 配任务、脚本当裁判,还能让编码智能体自己搭评测。

MiniMax 正式发布通用多模态生成模型 H3,可统一理解文本、图像、视频与音频,生成最高 2K 分辨率、15 秒的原生立体声视频,并计划开放权重。

OpenAI 首次确认下一代模型家族 Astra:内部版本解出十个十年未解的数学难题,Lean 形式化验证全部通过,算力成本约 2000 美元。

vLLM 宣布对 2.8 万亿参数的 MoE 模型 Kimi K3 提供 Day-0 支持,配合 DSpark 投机解码,单用户吞吐最高达 370 tok/s。

vLLM Semantic Router 公布下一阶段方向:从模型间路由走向可训练、可评测、可移植的 Mixture-of-Models(MoM)模型系统。