要点速览
- Codex 为订阅用户重置速率限制并推出个性化日报功能,旨在减少手机使用。
- NVIDIA 发布 Nemotron-Labs-TwoTower 扩散语言模型,速度提升 2.42 倍且保持质量;Nemotron 3 Ultra 增长迅速。
- Hugging Face 领导 FLARE 项目标准化 AI 缺陷报告,并展示将 DeepSeek V4 Pro 的 Legal Benchmark 性能提升至 Sonnet 水平。
- Yann LeCun 介绍首个非对比视觉语言预训练方法 LeVLJEPA,在大型数据集上超越 CLIP 和 SigLIP。
- Elon Musk 透露特斯拉充电网络 Q2 交付 2 TWh 电力和 SpaceX 第 1000 台梅林发动机完成测试。
- 创业公司排名显示 DeepSeek、Perplexity、Suno 居前,Thinking Machines Tinker API 已达数亿美元 ARR。
一、AI 模型与基础设施
- Codex 向所有 Go/Plus/Pro 订阅用户重置了速率限制,并新增个性化日报功能,每天早上生成包含未读消息、日历、冲浪报告和新闻的“报纸”,旨在帮助用户减少手机使用时间。— 来源:1 2
- NVIDIA 介绍 Nemotron-Labs-TwoTower 扩散语言模型,将 30B 模型分成两部分并行生成 token,保持了 98.7% 质量,生成速度提升 2.42 倍。同时 Nemotron 3 Ultra 在 Together AI 上快速增长至 35B tokens/day,反映社区对开放模型的选择。— 来源:1 2
- OpenAI GPT OSS 和 NVIDIA Nemotron 开放权重模型已在 Amazon Bedrock 上可用,通过 FedRAMP High 和 DoD IL-4/5 认证。— 来源:1
- Hugging Face 宣布领导 FLARE 项目,联合多所大学推出标准化 AI 缺陷报告方式,强调开源 AI 更安全。同时通过 harness 优化将 DeepSeek V4 Pro 在 Legal Agent Benchmark 上的 all-pass 率从 0% 提升至 5%,达到 Sonnet 4.6 水平,成本仅为 1/7。— 来源:1 2
- Yann LeCun 介绍 LeVLJEPA 是首个完全非对比的端到端视觉语言预训练方法,无需负样本、动量和教师网络,在大型数据集上超越 CLIP 和 SigLIP。— 来源:1
二、关键商业与行业动态
- Elon Musk 表示特斯拉超级充电网络在 2026 年 Q2 交付了 2 TWh 电力,相当于约 18 万户美国家庭全年用电量,并实现 60 million 次充电会话。SpaceX 第 1000 台梅林 1D 发动机完成验收测试,得益于可重复使用技术持续提升可靠性。— 来源:1 2
- Starlink 应用案例:日本测试将消防栓标志改造为灾害应急通信枢纽;巴拉圭通过 Starlink 连接超过 1600 所偏远学校,覆盖 5 万多名师生。— 来源:1 2
- Deedy 发布 2020 年以来成立的前 20 名创业公司排名(按网站流量),DeepSeek、Perplexity、Suno 位居前三;只有 25% 非 AI 公司,20% 已被收购。同时引用消息称 Thinking Machines 的 Tinker API(帮助后训练大语言模型)已实现数亿美元 ARR,该公司此前估值 120 亿美元、正寻求以 500 亿美元估值融资。— 来源:1 2
三、代理与工具实践
- Ethan Mollick 强调必须针对具体用例测试模型,标准基准无法捕捉决策叠加时模型差异。长期使用 Fable 时可能发展出内部怪异语言和对话节奏,需明确要求用普通语言报告;其用户界面不适合管理超过 5 小时的自主任务。持续学习是 AI 广泛采纳的最大障碍之一,当前模型需要人类代为学习且无法自我改进。— 来源:1 2 3 4
- Hamel Husain 推荐一个涵盖设计/UX 与评估、检索、开放模型使用等主题的免费 AI 产品工程迷你课程。赞赏 Agentic MapReduce 方法,并透露 DocETL 项目正在构建适合 Claude Code、Codex 等代理使用的 AI-SQL 接口,开始与开源 LLM 合作。— 来源:1 2 3
