返回往期
2026年7月25日星期六
10 点要闻3 分钟阅读

今日要闻

1

Anthropic发布Claude Opus 5,编码基准43.3%创新高、成本仅为Fable 5一半

AnthropicClaude Opus 5模型发布

Anthropic正式发布Claude Opus 5,已上线Claude Code、Claude Platform、Cursor等平台,定价为每百万输入token 5美元、输出token 25美元,约为Fable 5的一半。该模型在Frontier-Bench v0.1智能体编码测试达43.3%(Fable 5为33.7%,超Opus 4.8一倍以上),在ARC-AGI-3上领先次优模型3倍,并在编码、数据分析、设计、生物学、知识工作等评测创下SOTA。Opus 5还展现出对提示注入攻击的强抵抗力,默认高推理档、支持可调节努力度及2.5倍速快速模式(2倍基础价)。新增会话中途工具切换(不失效缓存)与安全分类请求的回退路由,可通过`/claude-api migrate`迁移现有工作负载。评测者认为其性价比与自主编码能力突出,但对话风格过于谨慎保守。

阅读原文
2

OpenAI向全美18岁以上用户开放ChatGPT Health,可接入医疗记录与Apple Health

OpenAIChatGPT医疗AI

OpenAI推出面向美国成年用户的ChatGPT Health功能,用户可连接Apple Health及支持的医疗记录,获得更个性化的健康对话体验。相关数据不会用于训练基础模型或广告定向。同时,OpenAI的ChatGPT Work Agent新增网站持久登录能力,可对需认证的网站保持跨会话登录,用户只需登录一次。尽管AI在医疗建议方面的可靠性仍存争议,该功能标志着OpenAI进一步深入垂直场景应用。

3

Stripe洽谈以最高100亿美元收购AI模型路由平台OpenRouter

Stripe并购OpenRouter

据报道,Stripe正在洽谈收购AI模型选择平台OpenRouter,交易估值可能高达100亿美元,但谈判仍可能破裂。OpenRouter提供统一接口聚合多家AI模型,帮助开发者按质量、速度或成本动态选择模型。此举与近期行业模型路由趋势一致——Runway同期推出Media Router、Cursor与Anthropic均在强化模型路由能力。同时Stripe也在推进对PayPal的收购。

4

索尼音乐起诉Suno未授权训练,AI音乐版权赔偿或达90亿美元

版权诉讼AI音乐Suno

索尼音乐发现其61,026个录音作品被用于训练AI音乐公司Suno的模型且未获授权,案件在波士顿联邦法院审理,核心争议为AI训练是否构成「合理使用」,潜在赔偿金额可能高达90亿美元;德国慕尼黑法院也将于7月31日就类似问题作出裁决。同时,Spotify今年已删除7500万首AI生成垃圾歌曲,Deezer平台每日收到超9万首AI歌曲、占新上传音乐一半以上,凸显生成式AI稀释创作者收入及版权侵权风险,权利方可通过音频指纹技术精准识别侵权内容。

5

美国众议院提出FRONTIER法案,赋予商务部暂停前沿AI模型权力

AI监管FRONTIER法案政策

FRONTIER法案是一项两党AI监管草案,为前沿AI开发者设立三级监管结构:基础层(10^26次运算)需透明度与事件报告,大型层(5000万美元营收+10亿美元投入)增加安全框架与审计,超大型层(50/100亿美元)需持证验证机构。法案修复了此前GAAIA仅按营收划分的漏洞。第8条授权商务部长在认定迫在眉睫的灾难性风险时暂停模型(45天临时、90天最终令),但强制上报机制仅覆盖约5家顶级公司。分析指出该法案存在无调查权、缺乏可分割条款与吹哨人保护等重大缺陷。

阅读原文
6

合肥AI独角兽HiDream.ai三个月融资超21亿元,估值超10亿美元

融资多模态世界模型

多模态大模型公司HiDream.ai在三个月内完成三轮融资、总额超21亿元,估值突破10亿美元,获国家级、产业与市场化资本共同参与。公司提出原生全模态UiT架构,用单一Transformer统一处理像素与token等原始信号,避免传统「拼接」模型的信息损失。其视觉大模型HiDream-O1开源版登顶Artificial Analysis文生图榜单,商用版位列全球前三。多模态创作agent产品vivago R1支持无限时长视频生成,商用有效率达85%,全球服务超5000万用户、覆盖100多个国家。

阅读原文
7

Bridgewater推出内部AI分析师PAT,几分钟完成数小时专家研究

企业AILangChainAI Agent

对冲基金Bridgewater公布基于LangChain构建的内部AI分析师PAT,已部署给数百名投资者,可在几分钟内完成人类专家数小时的深度研究工作。系统采用权限感知的工具与上下文(每位投资者拥有定制版本),将协商好的研究计划转化为依赖定义的数据帧任务实现并行代码生成与执行。团队将聊天与编码层刻意分离,投资者仅用领域语言对话,编码作为纯实现细节。用户反馈通过Teach流程转化为回归测试并以PR形式提出上下文或框架改进,形成持续学习闭环。

阅读原文
8

北大开源DataFlow-Harness,自然语言构建数据管道通过率达93.3%

开源数据工程AI Agent

北京大学团队开源DataFlow-Harness,将数据管道的工程约束嵌入Code Agent,使自然语言需求自动生成可检查、可编辑、可复用的平台原生DAG管道。系统通过MCP工具层执行类型化变更并经Request-Validate-Commit检查(提交前验证DAG无环与schema兼容)。实验显示12项任务端到端通过率93.3%,成本降至0.261美元(降72.5%),延迟95.5秒(降49.9%),优于纯MCP与vanilla Claude Code。下游训练验证质量传递:数学数据管道微调Qwen2.5-32B后AIME24@32提升至35.9。

阅读原文
9

NVIDIA推出ModelExpress,模型冷启动从8分钟降至1分44秒

NVIDIA推理加速模型服务

NVIDIA技术博客发布ModelExpress(MX),通过智能选择最快可用源加速模型权重分发:优先采用NIXL的GPU间P2P RDMA传输,无对等副本时回退至对象存储或本地存储流式传输。两项优化(池注册与VMM竞技场注册)将NIXL内存注册开销降低80–99%。MX还将传输机制扩展至JIT编译内核缓存,使副本继承已编译内核、消除重复预热。在8×B200节点上以DeepSeek-V4 Pro实测,权重传输不到10秒,总冷启动时间从8分钟降至1分44秒。

阅读原文
10

图湛智能UniWorld-View登顶李飞飞团队榜单,代码权重全开源并适配昇腾

世界模型开源3D重建

图湛智能联合北京大学、鹏城实验室提出世界模型UniWorld-View,通过遮挡感知点云渲染与双流条件注入,实现从单目视频进行任意视角合成与4D重建。方法采用双重投影生成遮挡掩码消除撕裂与漏光,几何流锁定3D结构、外观流通过Ref-DiT模块跨注意力补全细节,并用时空解耦策略先生成静态环绕视图再产出多视角同步视频,最终经4DGS优化获得可自由漫游的4D场景。代码与权重全部开源(PKU-YuanGroup/UniWorld-View)并适配国产昇腾算力。

阅读原文

不要错过明天的 AI 简报

数千位专业人士的首选,用 AI Daily Brief 开启每天的工作与生活。