返回往期
2026年10月8日星期四
10 点要闻3 分钟阅读

今日要闻

1

OpenAI推出GPT-6,搜索任务平均提前44%响应

模型发布AI产品OpenAI

OpenAI面向ChatGPT Plus、Pro、Business和Enterprise用户全球推出GPT-6,Free与Go层随后开放。核心新增Intelligent UI,可按问题动态生成图表、表单、按钮和工具,而非只返回静态文本;GPT-6 Instant在依赖网页搜索的任务中平均提前44%开始作答。付费层使用GPT-6 Sol,免费层使用GPT-6 Luna,并强化多轮越狱防护与局限性说明。

阅读原文
2

OpenAI公布722篇AI数学手稿,多项证明经Lean验证

AI研究数学形式化验证

OpenAI公布内部未发布前沿模型生成的722篇手稿,归为372个成果家族,覆盖数论、复杂性理论和数学物理;单项成果平均约消耗3小时ChatGPT Pro推理时间。官方已在GitHub提供修订与引用规范、10份推理摘要、尝试题目统计及多项Lean形式化证明,并表示会继续补充可机检证明、资助相关研讨会,供数学界复核,底层模型目前仍未公开。

阅读原文
3

Liquid AI开放d1决策模型,边缘推理低至16毫秒

开源模型边缘AI多模态

Liquid AI开放d1-3B和实验版d1-omni-600M权重,面向边缘设备的结构化决策,不按Token逐步生成,而以单次前向传播给出答案。d1-3B支持文本与图像,七项公开基准均分82.9,在Jetson AGX Thor上延迟16毫秒、高端GPU低于10毫秒;600M版本再加入音频,得分78.4,以约四分之一参数超过Decider 2B,代码要求transformers 5.14及以上。

阅读原文
4

OpenAI数学成果覆盖372类问题,公开推理与算力统计

AI科学研究开放OpenAI

OpenAI此次数学成果发布不仅提供论文正文,还公开模型推理摘要、尝试问题数量和以ChatGPT Pro使用量估算的计算成本,并制定后续论文修订与引用协议。许多证明已经转换为Lean形式化版本,可由计算机检查,其余形式化工作将持续更新。官方表示将资助研讨会与会议,研究AI生成数学成果的科学影响,并正探索负责任地开放底层模型,但未给出具体时间。

阅读原文
5

Google发布Nano Banana 2.1,上下文达100万Token

图像模型多模态Google

Google发布Gemini 3系列图像模型Nano Banana 2.1,基于Gemini 3.6 Flash,可接收文本与图像输入,并输出图像和文本,上下文窗口最高100万Token。模型已覆盖Gemini应用与API、Google AI Studio、Google搜索AI模式、Google Ads、Flow和Stitch,形成从消费者创作、搜索到广告和开发接口的多渠道可用性;材料未披露参数规模、价格或独立评测结果。

阅读原文
6

OpenAI Decisions API公测,决策速度最高提升10倍

开发者工具APIOpenAI

OpenAI将Decisions API推进至面向所有开发者的公开测试版,用于分类、路由和优先级判断,可接收文本及图像,并输出谓词、选项或评分三类结构化结果。官方称其决策速度最高可达通过Responses API调用GPT-6 Luna的10倍;输入价格为每100万Token 0.10美元,不收缓存读取、缓存写入及输出Token费用,开发文档和社区公告均已开放。

阅读原文
7

DeepSeek据报接近融资120亿美元,腾讯与宁德时代参投

融资DeepSeek资本市场

据二线媒体转述,DeepSeek接近完成120亿美元融资,规模超过最初500亿元人民币目标,腾讯与宁德时代被列为主要出资方,融资额后续可能达到1000亿元人民币。报道还称,公司正为潜在的上海科创板上市做准备,并已聘请中信证券协助;但材料没有提供DeepSeek、投资方或监管文件的正式确认,因此融资金额、参与方与上市时间表仍应视为未证实信息。

阅读原文
8

AWS AgentCore被曝可从进程堆提取智能体JWT

智能体安全漏洞AWS

Palo Alto Networks Unit 42披露AWS AgentCore Harness与AgentCore Identity之间的凭据暴露路径:智能体默认启用的bash工具能以root权限执行任意命令,研究人员据此扫描进程堆并提取AgentCore Identity JWT,再将令牌外传。问题表明,即使智能体采用独立身份,高权限工具与凭据同处一个执行边界仍可能破坏隔离;材料未说明AWS是否已修复或具体受影响范围。

阅读原文
9

五家机构确认MCP跨智能体注入,最高严重度评分8

MCP智能体安全提示注入

过去五个月,Google等五家机构确认多起MCP智能体链路缺陷:注入到一个智能体的提示会被转发给其他内部智能体并被信任执行,通常最终形成SSRF。案例严重度从Rapid7的CVE-2026-97228评分2.7,到Google mcp-toolbox评分8;后者在跟随重定向时未验证目标IP。研究者称其为协议枢轴,但本质仍是跨智能体传播的间接提示注入。

阅读原文
10

ThinkingBox检查智能体终态,67%失败未报工具错误

智能体评测可靠性开发者工具

微软团队介绍ThinkingBox评测框架,不依据智能体自述是否完成,而是检查数据库终态及实际副作用。该框架覆盖507条工作流,每条重复20次;在79853次失败运行中,67%没有出现工具报错,显示仅靠最终回复或异常日志会系统性漏判。方法强调终态验证与重复性,可用于发现表面成功、后台状态错误的任务,但材料未给出与其他评测框架的总体准确率对比或公开数据集许可。

阅读原文

不要错过明天的 AI 简报

数千位专业人士的首选,用 AI Daily Brief 开启每天的工作与生活。