主流LLM API推理轨迹遭解密越狱,三家厂商已修复
研究人员披露一种「解密越狱」:同一供应商模型家族的加密推理块可跨模型重放,攻击者能把前沿模型轨迹交给防护较弱的同系模型,再诱导其逐字输出明文。该方法影响OpenAI、Anthropic和Google API,可暴露专有推理、个人信息、凭证及隐藏提示,并可能被用于模型蒸馏。研究还从公开会话中发现数十项API密钥、密码和邮箱;三家厂商已确认问题并完成修复。
阅读原文研究人员披露一种「解密越狱」:同一供应商模型家族的加密推理块可跨模型重放,攻击者能把前沿模型轨迹交给防护较弱的同系模型,再诱导其逐字输出明文。该方法影响OpenAI、Anthropic和Google API,可暴露专有推理、个人信息、凭证及隐藏提示,并可能被用于模型蒸馏。研究还从公开会话中发现数十项API密钥、密码和邮箱;三家厂商已确认问题并完成修复。
阅读原文NVIDIA与Apollo、BlackRock、Goldman Sachs等六家金融机构签署备忘录,计划以GPU作为债务抵押品,建立面向AI数据中心的独立融资工具,并推动超过5000亿美元第三方资本进入AI基础设施。Jensen Huang表示,NVIDIA可能为单个项目提供最高25%的融资支持。该安排旨在把计算设备转化为可融资资产,扩大客户建设能力;具体项目、落地期限及融资条款仍待后续协议确认。
NVIDIA发布面向长时智能体执行层的Nemotron 3.5 Lightning,模型总参数30B、每个token仅激活3B,针对工具调用、验证等高频低延迟任务优化。它结合MTP、DSpark、DFlash推测解码与NVFP4量化,并接入开源NeMo Switchyard路由库。LangChain测试显示,路由器可把93%的代理步骤交给该模型,在保留约90% Claude Opus 4.8准确率的同时将成本降低约70%。
阅读原文Google官方宣布,Gemini应用月活跃用户已突破10亿,Gemma开放模型家族累计下载量也达到10亿;DeepMind CEO Demis Hassabis称Gemini是公司增长最快的产品。补充信息显示,该统计口径主要指Gemini应用本身,Android预装用户计入,iOS活跃用户超过1亿。同期OpenAI表示ChatGPT月活也已超过10亿,头部通用AI助手进入同量级用户规模竞争阶段。
阅读原文微软研究院发布胸部X光统一视觉语言模型CARE-X,尝试把自由文本报告、可校准诊断概率和定量测量整合进单一系统。模型采用「双推理」架构:生成路径负责报告与解释,辅助分类头输出可调阈值的概率;训练中使用DAPO强化学习奖励临床正确性。对于主动脉扩张等依赖尺寸的判断,系统调用确定性测量工具替代目测估算。该成果仍属研究方案,尚未公布临床部署时间及医生对照量化结果。
阅读原文OpenAI推出ChatGPT Linux桌面应用预览,支持Ubuntu、Debian和Fedora,并提供.deb与.rpm安装包。该版本把ChatGPT、ChatGPT Work和Codex带到Linux桌面,可衔接浏览器工作流;同期新增跨智能体同步能力,用户可通过桌面端导入项目、聊天和插件,在ChatGPT Work与Codex之间延续工作上下文。产品当前仍处于预览阶段,官方未给出正式版时间、更多发行版适配计划或定价变化。
阅读原文Cursor联合创始人Michael Truell宣布Grok Bot进入早期测试,将其定位为可在用户工具中执行实际工作的AI队友。演示显示,用户可创建不同职责的对话式代理,连接Slack、Linear等服务,并给代理分配云端电脑完成网页构建、运行与部署;代理之间还能交接上下文,按时间或事件触发例行任务。产品目前仍不完整,演示者指出直接Slack机器人、文件支持和自建群聊等能力尚未提供。
阅读原文研究人员为macOS Virtualization.framework设计进程级Metal能力Shim,绕过虚拟机对GPU能力的保守上报,使llama.cpp启用SIMD-group矩阵与bfloat16优化内核。M1 Ultra测试中,TinyLlama生成速度最高提升16倍,Gemma 4 12B提升14倍,整体达到裸机性能的95%至99%。方案无需修改客户机内核,研究已公开供复现,但其依赖能力伪装,长期兼容性与生产稳定性仍需单独验证。
阅读原文丰田构建内部「R&D GPT」,以Deep Agents作为编排层,把企业文档、SQL数据、领域工具和组织技能汇集到单一代理命令中,用于车辆质量、制造与设计研究。示例中,代理可结合既有资料和业务数据调查特定车型的漆面腐蚀问题;丰田还把品牌、研究、制造和供应链知识封装为技能。系统借助LangSmith Polly与Insights观察端到端行为、使用模式和异常点,强调可观测性也是生产流程的一部分。
阅读原文NVIDIA发布JetPack 7.2.1,加入「Agentic Video Skills」抽象层,可让AI编码助手自动发现设备、配置、基准测试并验证视频流水线。新版同时提供PyNvVideoCodec 2.2,以GPU驻留内存实现Python硬件加速编解码,并通过ThreadedDecoder把解码延迟与AI推理解耦;还支持在现有T5000模块上模拟T3000性能,帮助人形机器人与边缘视频开发者提前评估目标平台及工作负载。
阅读原文数千位专业人士的首选,用 AI Daily Brief 开启每天的工作与生活。