要点速览
- GLM-5.2 发布,编码和智能体能力显著提升,支持100万上下文窗口,采用MIT开源许可,API定价不变,性能与Opus 4.8相当。
- Cursor 被SpaceX以600亿美元收购,成为AI应用层标志性退出事件。
- NVIDIA 与Azure合作,在8,192块Blackwell GPU上7.07分钟完成Llama 3.1 405B训练,创MLPerf纪录。
- Midjourney 宣布6月17日公布首个硬件项目,将在旧金山举办线下发布会。
- Yann LeCun 提出Temporal Difference in Vision (TDV)新范式,无需增强、掩码或像素重建即匹配密集任务SOTA。
- Ethan Mollick 指出开源模型在编码上滞后闭源8-12个月,防御Mythos级模型的窗口仅4-8个月。
一、模型发布与性能
- GLM-5.2 正式发布,在编码和智能体任务上取得显著提升,支持100万上下文窗口,提供两种推理努力级别,基于MIT开源许可,API定价保持不变。Hugging Face确认其性能与Opus 4.8相当。Ethan Mollick实测发现GLM-5.2在着色器任务中出现错误,而GPT-5.2表现更好,揭示了基准测试无法捕捉的质量差异。— 来源:1 2 3
- xAI 发布 Grok Imagine Video 1.5,一款图像转视频模型,具有更清晰的真实感、更好的物理效果和更快的生成速度。同时Grok 4.3已上线Amazon Bedrock,在幻觉率和工具调用方面处于行业领先地位。— 来源:1 2
- GPT-5.2 与 GLM-5.2 的对比测试显示,GLM-5.2在复杂任务上仍存在错误,而GPT-5.2在诗意写作中能更好地将约束融入主题,凸显了闭源模型在精细质量上的优势。— 来源:1
二、基础设施与训练里程碑
- NVIDIA 与 Azure 合作达成MLPerf训练重大里程碑:在8,192块Blackwell GPU(GB200 NVL72)上仅用 7.07分钟 完成Llama 3.1 405B训练目标,刷新行业纪录。— 来源:1
- NVIDIA Research 推出 SpatialClaw,一种无需训练的空间推理代理,通过编写Python代码组合感知模块,在20个基准上平均比先前方法高出 11.2个点,且在不同模型骨干上表现稳定。— 来源:1
- NVIDIA 与 Google Cloud 合作为IneffableLabs构建超级学习器,提供Vera Rubin NVL72集群以支持其超级智能使命。— 来源:1
- OpenAI 分享了一项新研究方法:在发布前通过模拟使用去标识化的真实用户请求来预测模型在真实世界中的行为,旨在提升模型发布前的安全评估。同时,OpenAI评估团队负责人讨论了基准测试趋于饱和及被策略性应对的问题。— 来源:1 2
三、商业与生态动态
- Cursor 被 SpaceX 以 600亿美元 收购,成为AI应用层标志性退出事件,证明基于AI模型构建应用能获得巨大回报。— 来源:1
- Midjourney 宣布将于6月17日下午6点PT公布首个硬件项目,并在旧金山举办线下发布会,提供少量现场邀请名额。— 来源:1
- OpenAI 的 Codex 功能(Computer use、Chrome扩展、个性化记忆、Chronicle)正在向欧洲经济区、英国和瑞士的用户推出,扩大AI Agent的应用范围。— 来源:1
- Anthropic 发布了关于追踪Claude Code扩展的经济研究框架,探讨用户画像、任务价值变化及领域专业知识对代码辅助工具经济影响的方法。— 来源:1
四、前沿研究与关键洞察
- Yann LeCun 提出 Temporal Difference in Vision (TDV) 新范式,无需数据增强、掩码或像素重建即可学习表征,在密集任务上匹配当前最优方法,并呈现“越弱假设、更多数据、更好结果”的扩展规律。— 来源:1
- Ethan Mollick 分析指出,假设开源模型在编码上落后闭源 8-12个月,则针对Mythos级模型的系统加固窗口仅剩 4-8个月,因此现在拥有可公开防御用的Mythos级模型至关重要。他还批评了GDPval-AA v2基准:让AI评估其他AI基于公开题目的做法缺乏信息量,且人类ELO评定方式不透明。此外,他透露泄露财务数据显示OpenAI服务客户的毛利率超过40%,但训练成本极其昂贵,自动化AI研究可能是提高训练效率的途径。— 来源:1 2 3
- Ethan Mollick 演示了AI实时在屏幕上绘制图形、高亮像素点充当个人导师的用法,并指出AI界面并不直观,解释如何使用涉及许多技巧和陷阱。— 来源:1
- Hugging Face 多项发布:通过代理协作将Gemma 4的吞吐量从每秒100个token提升至 超过500个token;与NVIDIA合作发布包含30万比利时人物的合成数据集Nemotron-Personas-Belgium;推出Crosby Intelligence法律AI项目;Transformers.js支持在JavaScript中运行前沿模型;huggingface_hub v1.19.0推出Trusted Publishers功能实现无密钥CI/CD认证。— 来源:1 2 3 4 5
