要点速览
- NVIDIA在Blackwell平台用NVFP4精度训练Llama 3,速度比FP8快1.31-1.73倍且零精度损失。
- 本地模型能准确回答71.3%的真实世界查询,多模型混合工作负载将成为主流。
- Zepto提交印度上市申请,估值70-100亿美元,成立仅5年,收入翻倍至约24亿美元。
- Perplexity联合Quartr推出原生MCP连接器,提供43个工具访问15000+上市公司数据。
- 新基准FrontierCode衡量代码可维护性,Opus 4.8得分仅13.8%,AI编程能力从6次重试降至2次。
一、AI模型与训练效率
- NVIDIA在Blackwell平台上使用NVFP4精度训练Llama 3 8B和405B模型,速度相比FP8提升1.31-1.73倍,且零精度损失,显著提高训练效率。— 来源: 1
- Hugging Face发布Mellum2(MoE架构,低延迟高吞吐)、Qwen3.5量化检查点(针对Apple硬件优化),并预告Qwen3.7模型。— 来源:1 2 3
- Yann LeCun发布VLA-JEPA模型,结合JEPA世界模型学习动作相关动态,仅用13个示例微调即可实时运行。— 来源:1 2
二、本地模型与多模型工作负载
- Hugging Face指出AI行业正从单模型转向多模型工作负载,本地模型准确率达71.3%,能耗成本远低于前沿API;Yann LeCun也引用Stanford研究确认此数据,强调大多数任务无需前沿模型。— 来源:1 2
- Hugging Face预计模型路由技术增长迅速,到2026年AI代理将主要在命令行中运行,已更新
hfCLI支持代理语言。— 来源:1 2 - Ethan Mollick指出Apple最新Siri AI版本在本地与云端模型协同方面不足,设备端模型能力有限。— 来源:1
三、行业动态与商业里程碑
- 印度杂货配送公司Zepto提交上市申请,估值约70-100亿美元,成立仅5年;去年收入翻倍至约24亿美元,亏损率减半至-26%,近5000万用户,用8年达到Swiggy的规模和市值。— 来源:1
- Perplexity联合Quartr推出原生MCP连接器,提供43个工具获取15,000+上市公司的IR数据、实时和历史财报会议记录及文件。— 来源:1
- Perplexity宣布Billion Dollar Build竞赛(1500个团队,决赛6月9日)和Billion Pound Build竞赛(截止7月6日),团队可争夺100万英镑Perplexity Computer积分。— 来源:1 2
- NVIDIA与苹果合作,将Private Cloud Compute扩展到Google Cloud并使用NVIDIA GPU,推进私有AI前沿。— 来源:1
