OpenAI暂停前沿RL训练两周,补强安全监控
OpenAI宣布将最新模型的强化学习训练暂停两周,并暂缓扩大部分前沿训练规模,包括计划中的最大型RL项目。公司称此举并非终止研发,而是为高风险训练补强行为监控、网络隔离、安全测试和研究环境防护,待安全、对齐与监测能力跟上模型进展后再恢复。官方未披露受影响模型、算力规模及确切重启日期,并表示未来前沿开发速度将更多取决于对安全措施的信心。
阅读原文OpenAI宣布将最新模型的强化学习训练暂停两周,并暂缓扩大部分前沿训练规模,包括计划中的最大型RL项目。公司称此举并非终止研发,而是为高风险训练补强行为监控、网络隔离、安全测试和研究环境防护,待安全、对齐与监测能力跟上模型进展后再恢复。官方未披露受影响模型、算力规模及确切重启日期,并表示未来前沿开发速度将更多取决于对安全措施的信心。
阅读原文Anthropic披露,Claude已自主为15个目标中的14个设计出全新蛋白结合剂,结果由外部合作伙伴完成实验验证。其设计成功率为22%至35%,高于材料所述该领域通常10%至15%的基线,显示通用模型可参与从目标理解到候选设计的科研流程。公司同时发布技术报告,并开放实验所用提示词与数据集,便于研究者复核方法、比较结果及开展后续研究;材料未说明具体许可或商业可用范围。
阅读原文Dynatrace宣布以约9.15亿美元收购AI可观测性公司Arize,交易重点是把模型输出、提示链路和智能体行为监控能力纳入其现有可观测性平台。合并后,企业可在同一运维体系中追踪传统应用、生成式AI模型及代理工作流,定位质量、性能与运行异常,提升生产环境中的审计和故障排查能力。材料未披露支付结构、预计完成时间、监管条件,以及Arize并入后的产品定价、品牌和人员安排。
Anthropic向投资者披露,截至7月其年化收入运行率达到650亿美元,较上年增长七倍以上,增长主要来自企业客户快速扩张。公司同时在推进IPO准备,但尚未确定时间表。该数字按当前收入速度年化外推,不等同于已实现的全年营收;现有材料也未提供净利润、现金流、客户数量、业务构成或审计口径。目前这一数据仍属于据报的投资者沟通信息,后续仍需正式财务披露确认。
OpenAI启动政府在国家安全领域使用AI的民主监督计划,未来一年将提供500万美元资源,并开展工具试点、培训、使用额度和专家咨询。计划提出三项原则:AI应增强而非取代人类及制度判断;政府AI应用应可追踪、可解释并便于授权监督者审查;监督机构也可负责任地使用AI提升能力。项目还将邀请政府、民间社会和技术专家参与,并以审查能力改善及公众信任变化衡量进展。
阅读原文LangChain为LangSmith推出Tuned Evaluators,可直接在生产追踪数据上自动评估智能体对话,首个指标为Perceived Error。该评估器会识别用户纠正、重复请求、前后矛盾、问题未解决及代理承认错误等隐性失败,无需团队自行编写裁判提示、配置模型凭证或维护推理设施。官方称其专用模型表现优于前沿模型,同时将评估成本降低82%;结果可用于筛选案例、聚类故障并建设回归测试集。
阅读原文研究团队在AppWorld上测试八款模型,发现智能体记忆并非越多越好:DeepSeek-V3.2使用完整指南后任务完成率提升9.5个百分点,较弱的gpt-oss-120b通过精选检索提升16.1个百分点,而已趋于饱和的GLM-5没有提升。对gpt-oss-120b而言,精选检索仅增加5%的Token,完整指南则多消耗约50%。研究建议依据模型剩余失败模式校准记忆剂量,并利用静态前缀缓存控制成本。
阅读原文Krea披露训练与部署Krea 2扩散模型的基础设施经验,其训练跨越数千块GPU,并将高频故障视为可观测性和恢复问题。团队监测GPU温度、Tensor Core利用率、InfiniBand等待与错误以及NVLink信号,用于识别普通利用率面板无法暴露的间歇性异常。系统每20至30分钟保存检查点,约1TB数据可在30秒内写入;同时使用Kubernetes与Kueue调度,在训练和在线推理之间迁移负载。
阅读原文Anthropic扩展Claude的办公执行能力:Claude现可在Gmail中发送邮件并进行线程式回复,也可管理Google Drive文件,相关操作由用户审批流程控制。公司同时将Claude Cowork开放至移动端和网页端,覆盖全部付费订阅计划,使用户无需限定在桌面环境即可调用协作功能。此次更新把邮件、文件和跨设备访问整合进Claude工作流,但材料未披露不同套餐的调用额度、地区限制、企业管理员策略或免费版开放安排。
阅读原文数千位专业人士的首选,用 AI Daily Brief 开启每天的工作与生活。