要点速览
- Hugging Face开源1T模型,在单节点8 GPU上实现1000+ tps,采用FP4量化和DFlash技术;同时MiniMax M3(428B参数,23B激活)开源上架Hugging Face。
- Perplexity将Deep Research作为原生技能集成到Computer中,Pro和Max用户可用,基于Search as Code架构。xAI推出Grok Build Plugin Marketplace beta,支持MongoDB、Vercel、Sentry等插件。
- Yann LeCun反对Anthropic保留提示词和使用数据的新政策,认为涉及公司IP,不可接受。
一、AI模型与基础设施
- Hugging Face开源了一个1T参数模型,在单节点8 GPU上实现1000+ tps,采用FP4量化和DFlash技术,并开放权重。— 来源:1
- MiniMax M3开源模型发布,参数规模约428B,激活约23B,支持文本、图像和视频推理的长上下文多模态,已在Hugging Face上架,并提供免费GPU加速端点。— 来源:1 2
- Claude 5(Fable)生成了一个可玩的阿尔卑斯冰川山谷日出场景,仅用数学,无网格或模型,耗时约30分钟、500k tokens、2500行代码、成本约25美元。— 来源:1
- NVIDIA Research发布MotionBricks,包含35万+运动片段,支持每秒15000帧的实时角色动画,也适用于机器人领域。— 来源:1 2
二、产品与平台更新
- Perplexity将Deep Research作为原生技能集成到Computer中,Pro和Max用户可使用;基于Search as Code架构,模型编写代码并行执行数千次检索步骤,在各项基准测试中超越传统深度研究。同时Plan Mode已对所有Computer用户发布,通过提问明确需求并连接正确数据源。— 来源:1 2 3
- xAI推出Grok Build Plugin Marketplace beta阶段,支持MongoDB、Vercel、Sentry等插件,用户可通过终端利用MongoDB插件探索数据和构建向量搜索、用Vercel插件部署和构建应用、用Sentry插件查找和修复错误。— 来源:1
- OpenAI Codex现在支持保存速率限制重置以便日后使用,并开始向Go、Plus、Pro和Business用户提供一次免费重置。— 来源:1 2
- NVIDIA推出AI Enterprise政府级软件,为团队提供安全、生产就绪的AI部署基础,解决合规问题。— 来源:1
