返回往期
2026年10月11日星期日
9 点要闻3 分钟阅读

今日要闻

1

Claude动态工作流公测,单次可调度千个智能体

AI智能体开发工具公测

Anthropic将Claude Managed Agents的「动态工作流」开放公测。主智能体先制定计划,再分阶段并行派发任务、汇总辅助智能体结果;单次运行最多可调度约1000个智能体,旧式子智能体模式约为25个并发。开发者可配置模型、工具与提示词,执行循环和沙箱由Anthropic托管,可运行数分钟至数小时的长任务。该模式面向需要大规模并行拆解、持续执行和集中汇总的复杂工作流,材料未披露价格及正式版时间。

阅读原文
2

OpenAI与Sophos用智能体将威胁调查缩至89秒

网络安全AI智能体企业应用

OpenAI与Sophos公布Daybreak合作结果:自主智能体将企业威胁调查平均耗时从38分钟压缩至89秒,降幅约96%。该系统面向安全运营中的调查环节,通过自动执行原本耗时的分析流程,缩短从告警到形成调查结论的时间。此次披露提供了企业级智能体在网络安全场景的实际效率数据,但材料未给出样本规模、误报率、部署范围、产品价格或对外开放方式,现阶段主要体现合作项目的运行成效。

阅读原文
3

英国监管机构取得10家AI企业约束性隐私承诺

AI监管数据隐私英国

英国信息专员办公室已从10家主要AI开发商获得具约束力的数据保护与透明度承诺,参与方包括OpenAI、Google、Meta和Anthropic。该安排把隐私与透明度要求直接落实到开发企业的承诺层面,覆盖多家基础模型及平台提供商,而非针对单一产品。现有材料未披露其余公司名单、具体义务条款、执行期限、审计机制或违规后果,因此目前可确认的核心进展是监管机构已取得十家企业的正式约束性承诺。

阅读原文
4

微软推出Decision-1,专攻低延迟分类决策

决策模型微软模型推理

微软推出Microsoft-Decision-1,这是一款基于Qwen3.5-9B后训练的决策专用模型,目标是在简单分类任务中降低通用大模型带来的延迟和成本。模型可从多个选项中快速选择答案并输出校准后的概率分数,适用于选择题、是非判断和质量评估。微软已在内部将其用于玩家反馈分类及聊天质量评估,并称其推理延迟具有优势;后续计划继续与其他模型架构比较,材料未披露权重、API、价格及具体评测数字。

阅读原文
5

Kisoku开源1.6B模型,以少18倍数据匹配Llama

开源模型模型训练长上下文

个人开发者Joseph Rodriguez开源Kisoku 1.6B,包括基础模型、聊天微调版、权重、训练代码、评测脚本和技术报告。模型使用Google TPU v4-32从零预训练,数据规模约0.5万亿Token;在统一工具运行的10项评测中与Llama 3.2 1B各胜5项,而训练数据约少18倍。Kisoku原生支持64K上下文,并可通过YaRN插值扩展至128K;项目还公布污染审计,以检查训练数据与评测集的重叠情况。

阅读原文
6

LLM程序搜索两天刷新25项正方形装箱纪录

AI for Science程序搜索大语言模型

一项为期两天的计算实验结合大语言模型与进化算法,改进正方形装箱问题的已知上界。系统从随机放置正方形、逐步缩小容器并用L-BFGS消除重叠的基础程序出发,经过128代变异与筛选,最终刷新25项纪录,其中最早一项已保持47年。实验共消耗约7500个CPU小时和125美元模型Token费用;搜索后期的改进重点由叠加局部优化算法,逐渐转向寻找更有效的初始排列模式。

阅读原文
7

LangChain扩展Managed Deep Agents 0.8部署能力

AI智能体LangChain开发平台

LangChain介绍Managed Deep Agents及0.8版本新增能力,将智能体从本地原型迁移到生产所需的部署、流式传输、认证、权限、记忆、可观测性和评测整合为托管服务。开发者可用Python或TypeScript定义指令与工具,并通过mda命令部署。新版加入HTTP通道和文件传输,可接收自定义事件并扩展Slack协作;Context Hub用于版本管理,Harbor承担评测,同时强调共享智能体必须处理身份、数据访问范围和记忆边界。

阅读原文
8

TRAE合并Code与Work,统一编码和项目管理

AI编程开发工具多智能体

新版TRAE将原本分离的代码编辑与工作管理功能合并到同一界面,覆盖从需求分析、任务分配到编码和交付准备的开发流程。产品提供Agent与IDE两种模式:前者作为全局工作区,可把编码、文档等任务分派给多个智能体;后者保留传统代码编辑与调试体验。新版还支持自动化测试、跨平台同步及模板库,并可连接飞书、微信等服务,减少开发者在项目管理工具和编码环境之间切换,但材料未披露定价与开放范围。

阅读原文
9

Anthropic允许Claude终止持续虐待性对话

AI治理Anthropic使用政策

Anthropic正式制定针对AI模型持续受虐行为的使用政策,禁止用户长期、反复地对其人工智能模型实施残酷或虐待性互动。按照新规则,当用户持续表现出此类行为时,Claude可主动终止对话,而不必继续响应。该政策把模型面对持续性滥用时的退出机制纳入产品使用规范,关注点不同于传统上仅围绕用户安全、违法内容或平台滥用制定的限制。现有材料未披露判定标准、触发次数、申诉流程及适用产品范围。

阅读原文

不要错过明天的 AI 简报

数千位专业人士的首选,用 AI Daily Brief 开启每天的工作与生活。