OpenAI称万名Agent用88小时解决Navier-Stokes难题
OpenAI宣布,约1万个协同Agent使用一款仍在训练、能力显著超过GPT-6 Astra的下一代模型,在88小时内完成Navier-Stokes千禧年难题的解答。团队给出解析证明及Lean形式化版本,描述流体涡旋向内螺旋并持续拉长,最终在有限时间形成奇点。OpenAI同时否认访问特定用户数据,并称其证明与Buckmaster、Alpöge团队的同期成果存在明显差异,但双方围绕时间线和学术归属仍有争议。
阅读原文OpenAI宣布,约1万个协同Agent使用一款仍在训练、能力显著超过GPT-6 Astra的下一代模型,在88小时内完成Navier-Stokes千禧年难题的解答。团队给出解析证明及Lean形式化版本,描述流体涡旋向内螺旋并持续拉长,最终在有限时间形成奇点。OpenAI同时否认访问特定用户数据,并称其证明与Buckmaster、Alpöge团队的同期成果存在明显差异,但双方围绕时间线和学术归属仍有争议。
阅读原文OpenAI向ChatGPT、ChatGPT Work与Codex的桌面、移动和网页用户推送Images 2.5,并在API上线Flare与Sunburst。Flare面向快速日常生成,延迟较GPT Image 2降低50%;Sunburst侧重高保真和精细编辑。新版改善多轮指令遵循、主体与构图保持,支持评论式局部修改、参考图和透明背景,并加入模板及Sketch功能,可用于照片编辑、设计、电商、广告与游戏素材工作流。
阅读原文Google DeepMind发布AlphaGenome Atlas,为人类基因组全部90亿种可能的单核苷酸变异预计算分子效应,形成约1 PB数据资源,规模为AlphaFold Database的30倍。其AVI评分融合AlphaGenome的调控预测与AlphaMissense的蛋白质改变信息,同时覆盖约2%的编码区和98%的非编码区,并可拆解染色质可及性、剪接及保守性等贡献。外部测试中,该资源在UK Biobank数据上多识别出22%的非编码关联。
阅读原文英伟达公布两个NVlabs项目,为Rust补齐原生CUDA内核开发路径:cuda-oxide面向SIMT线程模型,cutile-rs面向Tile抽象。两者利用Rust所有权和借用检查,在编译阶段拦截缓冲区别名、数据竞争及部分越界问题。cutile-rs支持稳定版Rust 1.89以上与CUDA 13.3,已发布至crates.io,并被Grout和mistral.rs采用;cuda-oxide仍需固定夜间工具链及定制LLVM。两个项目均处于Alpha阶段,尚未确认适合生产环境。
阅读原文LangChain在Deep 0.7中加入Managed Connections,允许开发者用一个参数指定Agent以共享身份或用户身份执行任务,平台自动处理OAuth授权、用户同意、令牌存储和刷新,减少跨服务权限接入代码。DeepAgents同时获得长期记忆层,可按运行、保存、加载的循环沉淀信息、技能与经验,避免每次任务从零开始;框架还内置分叉子Agent机制,使不同上下文能够隔离探索,再将结果返回主流程。
阅读原文Anthropic的ClaudeDevs团队公开其生产系统Claude Tag,该Agent在CI值班流程中担任首轮响应者,可自动读取告警、指标和日志,完成问题分类并生成结构化SITREP。系统持续维护lessons.md,把已处理事故的模式和解决办法沉淀为长期知识,用于改进后续响应。团队同时分享提示词模板与技能定义,供其他工程团队按照自身可观测性栈复用,展示了Agent在可靠性关键流程中的实际部署方式与记忆闭环。
阅读原文Anthropic披露WisprFlow、useactively和Pendo基于Claude Managed Agents开发会议准备、销售情报及产品分析功能。相关团队以结果量表定义目标,再由独立上下文验证正确性和信息归属,并在不确定时选择不输出;系统按账户、用户和组织划分多层记忆,同时使用沙箱工具、真实客户评测与模型迁移检查。实践还将批处理、模型选择和成本控制纳入部署,以平衡响应速度、费用、控制权与安全边界。
阅读原文LangChain推出Dcode相关课程并推广这一开源终端编码Agent,定位为封闭式编程助手的替代方案。Dcode可连接任意支持工具调用的模型,并允许用户在同一会话中切换模型,降低对单一供应商的依赖。工具会持续显示调用成本,在高费用线程形成前发出提示,并支持组织级支出上限;课程内容从安装和常用命令延伸至目标、技能、子Agent及团队分发配置,强调代码可检查和企业对内部智能资产的控制。
阅读原文数千位专业人士的首选,用 AI Daily Brief 开启每天的工作与生活。