要点速览
- Meta 发布 30B 开源多模态模型 Muse Glimmer(Apache 2.0),并预告 Muse Spark 1.2 开放权重。
- Hugging Face 提供 day-0 支持,称“Meta is back”;Ethan Mollick 认为开源 Spark 是近一年最好的非中国开源权重模型。
- NVIDIA AI 在 GB200 上实现 Qwen 3.5 25K tokens/s/gpu 的生产级服务性能。
- Elon Musk 透露 Grok Build 一体化创作环境,并预测 AI 代理流量将需要 Starlink 提供 50-250 倍带宽。
- Greg Brockman 展示 Codex 合同省钱实例,Hamel Husain 发布投机解码优化工具 specspecs。
一、开源模型与AI基础设施
- Meta 宣布发布开源多模态模型 Muse Glimmer,30B 参数、120K+ 上下文窗口,面向长时间运行代理,单 GPU 可达 20K tokens/sec,采用 Apache 2.0 许可证,可在 24GB VRAM 或消费级硬件上运行;同时宣布将发布最新基础模型 Muse Spark 1.2 的开放权重。Hugging Face 为 Muse Glimmer 提供 day-0 支持,在 transformers 和 llama.cpp 中完成集成,并通过 DFlash 实现 2-4 倍加速;NVIDIA AI 也欢迎 Meta 重新发布开放模型。 — 来源:1 2 3 4
- 开源社区对 Meta 回归表示欢迎,Hugging Face 称“Meta is back”,并转发“人人都应获得超级智能访问权”的开放 AI 理念;Ethan Mollick 评价 Meta 开源的 Spark 模型是“重大新闻”,认为它是近一年来最好的非中国开源权重模型,但仍未达到中国开源模型的前沿、且落后于闭源前沿,未来取决于能否持续发布新模型。 — 来源:1 2
- NVIDIA AI 宣布已完成 Qwen 3.5 在 vLLM 中的优化,为 Qwen 3.8 发布做准备,在 GB200 系统上实现 25K tokens/s/gpu 的生产级服务性能。 — 来源:1
二、AI产品与应用
- Elon Musk 介绍 Grok Build 正在成为一体化创作环境,用户可在工作流内直接用 Grok Imagine 生成图片和视频,无需在多个 AI 工具间切换;并称 Grok 4.5 在设计工具日常使用量上大幅领先同类模型,且角色一致性表现出色。 — 来源:1 2 3
- Greg Brockman 分享 Codex 可以用来阅读合同细则以省钱,并举例有人因此每年电费节省约 6000 美元;他还表示瓶颈越来越在于清楚自己到底想要什么。 — 来源:1 2
- Demis Hassabis 分享 WeatherNext 模型研究,该模型能以高准确率预测气旋路径和强度,平均为防灾争取额外 24 小时准备时间。 — 来源:1
- Hamel Husain 发布 specspecs 工具,用于解决投机解码中盲目运行会浪费被拒绝草稿 token 计算的问题,强调工程可观测性。 — 来源:1
三、关键观点与趋势
- Elon Musk 预测 AI 代理产生的互联网流量将远超人类,Starlink V3 及 V4 未来十年可提供比今天多 50-250 倍的全球带宽,用于连接数十亿未上网人群和大量数字及物理机器人。 — 来源:1
- Ethan Mollick 批评 ChatGPT Work 和 Claude Cowork 的假设,认为它们隐藏了非程序员无法像程序员一样思考的信息,应该像优秀产品经理那样向用户解释决策;他还指出 AI 与学术期刊的争论过度聚焦当前或过去的性能,而忽视未来几年几乎必然达到的水平。 — 来源:1 2
- swyx 提醒应定期删除积累的 AI skills,因为它们会消耗上下文,甚至与其它技能产生不可预料的交互;这反映了长期使用 AI 代理时的维护经验。 — 来源:1
