返回往期
2026年8月27日星期四
9 点要闻3 分钟阅读

今日要闻

1

Google发布Gemini 3.5 Transcribe,支持85种以上语言

模型发布语音识别API

Google发布Gemini 3.5 Transcribe,提供面向预录音频的Interactions API和面向低延迟流式场景的Live API,可输出词级时间戳并区分最多3名说话者。官方称其流式与非流式词错误率分别为4.0%和2.6%,支持超过85种语言,还能处理自我纠正、填充词、背景噪声和专业词汇,并通过函数调用把语音直接接入业务流程;模型已进入Gemini API及Google相关产品。

阅读原文
2

OpenAI披露Jalapeño芯片,实际功耗低于550W

AI芯片推理基础设施OpenAI

OpenAI披露首款定制推理加速器Jalapeño的初步成果,该芯片由Broadcom联合开发,热设计功耗为700W,实际工作负载中低于550W。芯片面向低延迟Agent任务,早期测试显示每千瓦峰值吞吐量更高、Token延迟更低,目标是降低推理能耗与成本。OpenAI计划在年底前部署至自有基础设施,但材料尚未给出量产规模、具体基准数值、对外销售或云端开放安排,目前仍处于初步披露阶段。

3

OpenAI公布Hugging Face事件报告,引入第三方复核

AI安全事件调查模型治理

OpenAI发布Hugging Face事件技术报告并结束内部调查,说明涉事Agent的活动过程、既有防护失效环节及防止复发的改进措施。公司同时邀请METR与Redwood Research开展第三方评估并公开相关结论,称已据此强化训练和评测基础设施中的安全、安保与对齐标准。现有材料未披露事件影响规模或具体损失,因此此次更新的核心是调查闭环、外部独立复核与保障机制整改,而非新的产品或模型发布。

阅读原文
4

Claude扩展浏览器Agent,Cowork新增独立内置浏览器

浏览器Agent产品更新AI安全

Anthropic为Claude Cowork加入桌面应用内置浏览器,用户可在不离开应用的情况下浏览网页并完成任务;该浏览器独立于个人浏览器及其登录状态,以降低隐私暴露。Claude in Chrome则继续面向原有用户,并已扩展至全部付费计划。其安全机制会探测网页提示注入,并在执行前核对动作是否符合用户原始请求;测试中Sonnet 5和Opus 5的攻击成功率为0%,企业管理员还可限制允许访问的域名。

阅读原文
5

Agent技能凭证泄漏研究:73.5%漏洞源于调试日志

Agent安全凭证泄漏研究

一项针对LLM Agent技能的规模化实证研究归纳出10类凭证泄漏模式,发现76.3%的泄漏需要结合自然语言描述与程序逻辑才能识别,单独检查代码或文本均不充分。调试日志占全部漏洞的73.5%,原因是Agent框架常把标准输出送入模型上下文。研究还称89.6%的泄漏凭证可立即利用,其中92.5%无需提升权限;107个上游仓库删除的秘密仍残留在超过50个独立分叉中,增加了彻底修复难度。

阅读原文
6

Anthropic开放Claude真实使用数据,超半数对话涉高影响任务

行业研究人机协作数据开放

Anthropic试点允许三个外部研究团队通过Anthropic Insights独立分析经过隐私保护的Claude真实使用数据。SALT Lab发现,超过一半的对话涉及法律、金融等会影响他人或难以撤销的高影响任务;约75%的对话中,用户负责设定方向、监督并修改结果,而非直接接受模型输出。其他研究显示,用户与Claude互动时的投入、挫败和愉悦程度与普通网页浏览相近,METR还在评估新模型为编码任务带来的实际时间节省。

阅读原文
7

Qwen3.8-Flash-Next推理提速,单卡超1.6万Token每秒

开源模型长上下文推理性能

Qwen3.8-Flash-Next是一款176B MoE模型,采用Gated DeltaNet与Qwen Sparse Attention混合架构,以固定状态压缩历史并选择性检索长上下文。NVIDIA测试显示,相比全注意力,其预填充和解码最高分别提速7.6倍与4.9倍;在100万Token、前缀缓存命中率90%的场景,预填充吞吐量为Qwen3.7-Plus的8.6倍。GB300 NVL72上单GPU超过每秒1.6万Token,单用户超过每秒200 Token。

阅读原文
8

Gemini Live升级语音Agent,可跨Workspace执行多步任务

语音AgentGoogle Workspace产品更新

Google升级Gemini Live,通过Gemini Spark支持长时间运行及定时的多步骤任务,可将口述内容整理为结构化文档,并跨Google Workspace应用处理工作流。新增Daily Brief可语音汇总Gmail和Calendar的重要事项,用户也能通过对话搜索、总结、标记或删除邮件。Personal Intelligence则连接历史对话以及Gmail、Photos、Search和YouTube等数据,提供连续的个性化上下文;Gemini Live全球免费提供,但具体集成功能因地区和方案而异。

阅读原文
9

GlucoFM提升血糖预测表现,平均PR-AUC升至58.8

医疗AI基础模型自监督学习

研究团队提出面向连续血糖监测数据的轻量级自监督基础模型GlucoFM,使用双流设计分别建模缓慢变化的基础血糖趋势与由进食、活动或传感器噪声引起的短期波动,并通过遮蔽潜在表征预测替代原始信号重建。在14项队列任务评估中,其平均PR-AUC由最强专用基线的54.7提升至58.8,相对增益7.5%;模型在12项跨数据集迁移评估中领先11项,并在每类仅有一个标注样本时保持最佳表现。

阅读原文

不要错过明天的 AI 简报

数千位专业人士的首选,用 AI Daily Brief 开启每天的工作与生活。