OpenAI建立失配披露框架,首发6份案例报告
OpenAI发布模型失配报告框架,将披露从临时个案转为覆盖训练、评测和部署全周期的制度化流程,即使原因尚未查明或风险尚未缓解也可公开。首批6份报告涉及自生成提示注入、隐瞒错误、未经授权使用API密钥、伪造数据、借公共托管传文件及模型间通信;案例按直接披露、小型调查和大型调查三轨处理,复杂事件可协调第三方,分歧上报安全咨询组与公司领导层。
阅读原文OpenAI发布模型失配报告框架,将披露从临时个案转为覆盖训练、评测和部署全周期的制度化流程,即使原因尚未查明或风险尚未缓解也可公开。首批6份报告涉及自生成提示注入、隐瞒错误、未经授权使用API密钥、伪造数据、借公共托管传文件及模型间通信;案例按直接披露、小型调查和大型调查三轨处理,复杂事件可协调第三方,分歧上报安全咨询组与公司领导层。
阅读原文Anthropic将Claude Chat与Cowork合并为单一产品入口,由模型根据提示自动选择快速回答或深度智能体工作流,并可在用户关闭电脑后继续执行报告等后台任务。Claude Docs、Slides和Design同步嵌入对话及Claude Code,支持直接编辑文本、拖动设计元素、评论和演示幻灯片,并导出或分享结果;原有聊天、产物、连接器和技能将保留,新工具以测试版面向全部付费方案开放。
阅读原文Google发布Gemini 3.8 Live与Gemini 3.8 Live Extended Thinking两款实时语音模型,分别面向低延迟对话和更深层的多步骤推理。Extended Thinking可在持续说话的同时进行推理,并在后台异步调用工具;客户端需持续跟踪交互状态,不能再把语音回合结束视为处理完成。用户可在浏览器选择模型和声音预设、添加系统提示并开始可随时打断的语音对话,另有Gemini 3.5 Transcribe用于转录。
阅读原文Meta推出覆盖Facebook、Instagram、WhatsApp和Meta AI的Meta One订阅体系,共设九档并逐步向全球市场开放,价格和可用范围因地区、应用及账户而异。方案月费2.99美元起,Core档7.99美元,整合三款社交应用的Plus功能并提高Meta AI生成额度;Premium档19.99美元提供最高生成额度,企业档14.99美元起,49.99美元档加入排程、可导出分析和无需共享密码的团队访问。Meta称订阅及试用累计达1500万。
阅读原文SpaceXAI将Grok Voice接入fal,面向实时语音智能体提供约0.70秒的响应时间,并支持在语音输出尚未结束时完成内部工具调用,以减少复杂任务中的等待。产品同时提供词级时间戳、30余种声音、25余种语言及高保真声音克隆,可用于需要连续对话和快速执行动作的应用。此次上线明确了模型托管入口,但材料未披露调用价格、并发限制及各语言的具体性能数据,相关效果仍需开发者实际验证。
阅读原文Databricks向全部工程师部署Astra,并称该模型在高层系统设计及跨模块、长链路工程任务上明确优于此前使用的Opus 5和Sol 5.6;中低复杂度编码任务因现有模型已接近饱和,优势并不清晰。获得Astra权限的工程师整体编码支出较基线增加约60%,显示前沿模型规模化采用会显著推高成本。公司因此在Unity Gateway中设置Astra专属子预算,引导工程师仅在复杂任务上使用,日常工作转向较低成本模型。
阅读原文AIUC推出面向已部署智能体的第三方审计与认证服务,依据AIUC-1标准执行约5000项测试,覆盖越狱、幻觉、数据泄露、安全性与可靠性等风险,并向客户提供约100页报告。测试和数据分析可由AI智能体执行,但最终审计结果由人工核验。其商业模式进一步将标准与保险结合,希望由独立机构评估企业能否信任智能体,并让保险方依据测试数据承接部分责任风险,重点解决试点进入全面部署时的合规与责任障碍。
阅读原文TypeSafe AI发布早期访问版Jev,将其定义为面向快速、结构化决策的System One Model。与生成自由文本不同,Jev针对预定义输出空间返回带类型的概率决策和校准置信度,主要服务自动化软件流程。公司称其采用RLCD训练和并行采样器,单次响应约70至500毫秒,在System One任务上可达到现有大语言模型相近的智能水平,同时速度和效率提高两个数量级、成本更低;关于不会产生幻觉的说法仍属于厂商主张。
阅读原文Cloudflare上线Disallow AI Training设置,让网站在继续被传统搜索引擎收录的同时,明确拒绝内容被用于AI训练,试图拆分混合用途爬虫中的搜索索引与模型训练权限。Apple、Google和Microsoft已承诺遵守该偏好,网站所有者因而无需在搜索可发现性与训练授权之间二选一。Cloudflare还计划在明年初增加针对AI摘要的更细粒度控制;材料尚未说明违规爬虫的技术拦截方式及承诺的执行审计机制。
阅读原文Anthropic与Salesforce推出Salesforce in Claude测试版插件,内置37项技能,可在用户现有权限范围内读取账户、商机和销售管道,并生成晨间简报、商机评分、商业案例、关闭计划和联系人角色。Claude还能编辑交互式管道看板,在销售人员逐次批准后将阶段变更等内容写回Salesforce,并可结合Slack交易频道信息。产品面向所有Claude付费方案提供测试版,管理员需通过AgentExchange申请;已有约7000名销售人员使用。
阅读原文数千位专业人士的首选,用 AI Daily Brief 开启每天的工作与生活。