要点速览
- GPT-5.6 Sol 在 Design Arena 夺冠(Elo 1353),并确认保留在 ChatGPT 订阅中。
- Grok 4.5 多项基准领先,被评价为 Opus 级别且成本更低、速度更快,已集成到 Perplexity Computer。
- Perplexity 计划采用 Nvidia Vera CPU,代理编码任务提速 1.5 倍。
- John Carmack 推出 atp 传输协议,比 rsync 快 2.9–4.8 倍,支持多源 bonding。
- Hugging Face 发布 Kimi-K2.6/K2.7-Code 的 DSpark speculators,吞吐量提升超 130%。
一、AI 模型竞争升温
- GPT-5.6 Sol 发布并取得瞩目成绩:在 Design Arena 获得第一名(Elo 1353),被 Sam Altman 称为里程碑。OpenAI 确认该模型将保留在 ChatGPT 订阅中(Go、Plus、Pro),直到推出更好的模型。Greg Brockman 演示了使用 GPT-5.6 Sol 在 Cursor 中设置 Blender MCP 制作逼真浮空 MacBook,无需 Blender 经验;还展示了一个 Codex 技能,可自动分析初创公司、寻找早期客户并生成个性化报告。— 来源:1 2 3 4 5
- Grok 4.5 在多个基准上表现优异:在 SWE-Atlas-QnA 基准取得最高分,视频工作室评估从 6/33 提升至 23/33,被评价为 Opus 级别且成本更低、速度更快。Aravind Srinivas 表示 Perplexity 已将 Grok 4.5 集成到 Perplexity Computer 中,用户用它构建个性化播客播放器,成本仅约 11 美元。— 来源:1 2 3 4 5
二、前沿基础设施与传输协议
- Perplexity 计划采用 Nvidia Vera CPU:Aravind Srinivas 透露,该 CPU 在代理编码任务上比传统 CPU 快 1.5 倍,预计增益超过 50%,详细指标即将发布。— 来源:1
- John Carmack 推出 atp 传输协议:基于 RaptorQ fountain codes,atp 将文件转化为符号流,任意 K 个符号即可重构文件,消除重传。在严格测试中,atp 比优化后的 rsync 快 2.9–4.8 倍(高损耗下约 1.9 倍),支持多台机器同时向一个接收器喷洒不同符号流(bonding),发送者死亡时可重新分配修复窗口。— 来源:1
- Hugging Face 发布 Kimi-K2.6/K2.7-Code 的 DSpark speculators,在 batch-size-1 评估中平均吞吐量分别提升 155% 和 136%。同时,ZeroGPU demos 和应用已对所有用户开放。— 来源:1 2
