要点速览
- OpenAI内部使用Codex代理处理复杂长期任务,预示代理将重塑工作方式。
- Midjourney发布--preview预览V8.2美学,big-batch draft模式速度提升24倍。
- Hugging Face TRL v1.7.0加速1.25倍并节省16GB显存,LFM2.5 230M在浏览器达1400 tok/s。
- Ethan Mollick实验显示Opus 4.7在14小时完成端到端编码任务,成本仅251美元。
- NVIDIA AdaVoMP从少量照片生成1024³分辨率交互式虚拟世界。
一、AI代理与工作流自动化
- OpenAI表示其内部各部门正在使用Codex代理处理更复杂、更长期和跨职能的工作,这预示着代理工具未来可能重塑工作方式。— 来源:1
- Runway推出Agent 2.0,支持从简单提示生成完整的营销简报和活动资产,用户可分析性能数据优化创意并跨平台扩展,目标是成为最强大的自主代理。— 来源:1
- Ethan Mollick介绍实验:Opus 4.7在14小时内完成人类工程师需2-17周的端到端编码任务,成本251美元,表明AI编码能力进步迅速。— 来源:1
二、图像与视频生成突破
- Midjourney发布两项图像更新:在prompt中添加--preview可预览V8.2美学与个性化效果;更新big-batch draft模式,支持--sref random,探索风格空间速度提升24倍。此前V8.1的big-batch draft模式可生成24张低价低分辨率图像,点击Vary可获取全分辨率版本。— 来源:1
- NVIDIA AI宣布AdaVoMP(ICML 26),从少量照片生成物理真实感的交互式虚拟世界,支持1024³高空间分辨率,物体可交互且可变形。— 来源:1
三、模型效率与开源生态
- Hugging Face发布TRL v1.7.0,带来连续批处理加速使GRPO和RLOO提升1.25倍并节省16GB显存,同时支持MoE后训练、新GMPO训练器等。Liquid AI的LFM2-VL模型现可在TRL中训练。此外,通过agentic WebGPU优化,LFM2.5 230M模型在浏览器中实现1400 tok/s超高推理速度,Apertus Mini(1.5B)在浏览器达80+ tps。— 来源:1 2 3
- NVIDIA与Linux Foundation及行业伙伴推出Akrites网络安全项目,保护关键开源软件免受AI驱动的网络威胁。— 来源:1
- Yann LeCun观察到过去几周大型企业纷纷要求内部部署模型并基于GLM-5.2进行后训练,开源模式正在获胜。— 来源:1
