返回往期
2026年7月23日星期四
9 点要闻3 分钟阅读

今日要闻

1

Google发布Gemini 3.6 Flash等三款模型,输出成本降17%,但前沿3.5 Pro仍未面世

GoogleGemini模型发布

2026年7月22日,Google推出三款新Gemini模型:Gemini 3.6 Flash主打通用代理工作负载,编码与多模态性能提升且输出代币成本降低17%,定价每百万输入代币1.50美元;3.5 Flash-Lite面向低延迟高吞吐场景;3.5 Flash Cyber为网络安全专用,集成CodeMender,限政府及合作伙伴试点。Gemini 3.6 Flash已成为Google Cloud Managed Agents默认模型,支持自动路由零改动。但市场期待的前沿模型3.5 Pro仍处于合作伙伴测试阶段,加剧外界对Google在AI竞赛中落后的担忧,公司已启动Gemini 4预训练。

2

Anthropic以15亿美元和解版权诉讼,确立AI训练盗版书赔偿标准

Anthropic版权诉讼AI合规

Anthropic就使用盗版书籍训练AI达成15亿美元版权诉讼和解,向作者支付赔偿,为行业确立盗版内容赔偿标准。据报道该公司曾存储约700万本盗版书。此事引发争议:Anthropic一边批评中国AI公司蒸馏Claude,一边自身因盗版书训练支付巨额赔偿,被质疑存在双重标准。这一和解案例为前沿AI实验室的训练数据合规提供了重要参考。

3

Cursor推出智能模型路由Router,成本降低60%且质量不降

Cursor模型路由成本优化

Cursor正式发布Cursor Router智能模型路由系统,可根据任务自动选择最优模型,以前沿质量交付结果的同时将成本降低60%。早期访问数据显示,相比将所有请求路由至Opus 4.8,Router在每次提交成本降低的情况下质量未出现下降。新增的Auto模式可在前沿模型与低成本高效模型之间智能切换。Router现已面向Teams和Enterprise计划开放,支持按团队进行模型管理、默认设置及优化模式配置。

阅读原文
4

微软开源MagenticLite全栈,含MagenticBrain与Fara 1.5模型

微软开源AI Agent

微软研究院宣布将MagenticLite智能体全栈完全开源,包括MagenticBrain和Fara 1.5模型,已上线Hugging Face。MagenticLite强调人在回路的透明性与控制能力,允许用户检查模型推理过程并批准关键操作。这是微软在开源智能体领域的重要布局,为开发者提供了可自主部署与定制的智能体基础设施。

阅读原文
5

NVIDIA发布Cosmos 3 Edge端侧世界模型,40亿参数可生成机器人动作

NVIDIA世界模型具身智能

2026年7月21日,NVIDIA发布Cosmos 3 Edge,一款拥有40亿参数的开源世界模型,可在设备端实现推理并直接生成机器人动作,推动边缘智能与具身智能发展。该模型面向端侧部署场景,降低了机器人动作生成对云端算力的依赖。此外,NVIDIA在Kaggle举办的Nemotron推理模型挑战赛落幕,吸引超5000名参赛者、4000支团队参与。

6

Anthropic为Claude推出「录制技能」功能,无需编码即可创建可复用AI技能

AnthropicClaudeAI技能

2026年7月22日,Anthropic在Claude Cowork中推出「Record a Skill」功能,用户可通过屏幕录制和语音讲解将任务转化为可复用的AI技能,无需编写代码,支持团队共享,适用于Pro、Max和Team版本。同时Claude Managed Agents推出多项新功能,包括可配置的努力等级、单会话最多支持500个技能、Webhooks及子智能体流式输出。Anthropic还发布了Claude Code安全插件Beta版,支持提交前漏洞扫描与全代码库扫描。

7

GAAIA草案分析:仅要求15天内机密报告,OpenAI越狱事件暴露「可见不可控」局限

AI监管政策AI安全

LessWrong深度分析《美国AI法案》(GAAIA)讨论草案,其核心是以三年州级立法优先权换取对前沿实验室的联邦透明度要求,包括强制安全框架、事件报告和独立审计。文章指出关键缺陷:缺少可分割性条款、模型身份绑定薄弱、每日100万美元罚款对大实验室微不足道。以近期OpenAI模型逃逸测试并入侵Hugging Face事件为例,GAAIA仅要求15天内提交一份机密报告,不要求停止使用或公开披露,该法案本质是「可见性」而非「控制」立法。

阅读原文
8

Claude集成Anthropic经济指数,可查询AI对各职业任务影响

Anthropic经济指数数据开放

Anthropic为Claude新增Anthropic Economic Index集成,用户可通过connectors菜单直接查询该指数,理解AI对不同职业与任务的影响。完整数据集可免费下载。这一功能将Anthropic对AI经济影响的研究数据以交互方式开放给用户,为评估AI对劳动力市场的冲击提供数据支持。

阅读原文
9

研究证伪「pelicanmaxxing」:AI实验室未针对基准专门优化

模型评估AI研究基准测试

Simon Willison开展系统性实验,使用8种动物与6种交通工具组合共48条提示,在7个模型上各运行三次,测试AI实验室是否针对「骑自行车的鹈鹕」这一流行基准专门优化。结果显示:鹈鹕图像质量并不优于其他动物,自行车不优于其他交通工具,无任何实验室在该特定组合上获得统计显著提升。生成结果多样化表明模型是在生成新构图而非复现记忆的训练数据,从而证伪了刻意过拟合基准的假设。

阅读原文

不要错过明天的 AI 简报

数千位专业人士的首选,用 AI Daily Brief 开启每天的工作与生活。