返回往期
2026年8月29日星期六
10 点要闻3 分钟阅读

今日要闻

1

腾讯发布Hy4预览版,770B参数支持百万上下文

大模型开源模型MoE

腾讯混元团队发布新一代MoE旗舰模型Hy4 preview,总参数770B、每个Token激活49B,采用78层骨干,其中77层为MoE层,每层包含256个路由专家和1个共享专家。模型支持100万Token上下文,面向软件工程、办公分析、游戏开发与科学研究场景;官方GitHub已公开项目与架构说明,并称其相较Hy3在推理及视觉语言任务上有所提升,开发者可查看具体设计与使用信息。

阅读原文
2

OpenAI推出Appshots,让模型读取当前应用界面

OpenAI开发工具多模态

OpenAI Developers推出Appshots,为ChatGPT Work与Codex提供用户当前应用界面的视觉及文本上下文,使模型能够理解屏幕上正在查看的内容并据此执行操作。该能力旨在减少用户手动复制界面信息的步骤,可用于分析聊天线程、识别应用状态和辅助调试等任务,并把静态截图理解扩展到实际应用工作流。官方材料尚未披露开放范围、调用方式、价格及具体上线节奏。

阅读原文
3

OpenAI发布Rosalind Workbench,整合生物科研分析

科学智能生物技术OpenAI

OpenAI发布Rosalind Workbench,面向蛋白质结构与基因组数据分析,将AI模型、可视化工具和测序处理流程整合到同一工作台。平台试图连接原始科研数据、模型分析与结果解释,减少研究人员在多套生物信息学工具之间切换的成本,并使用面向生物数据的专用模型支持蛋白折叠、序列比对等任务。现有官方材料未说明价格、用户开放范围、数据来源要求及正式上线时间。

阅读原文
4

xAI为Grok Bot接入Stripe,支持代用户网购

AI代理支付xAI

Grok Bot新增在线购买能力,用户可通过Stripe关联支付卡,把商品选择与结账流程委托给机器人完成。公开演示显示,该代理能够浏览在线市场、选取商品并发起支付,使其能力从信息检索和网页操作进一步延伸到真实交易。支付卡绑定与交易记录由Stripe处理,但现有材料未交代单笔额度、退款机制、支持商户、地区范围,以及误购或商品选择错误时的责任与人工确认规则。

阅读原文
5

Replit推出Growth Skills,打通开发与获客流程

AI代理开发平台增长工具

Replit推出Growth Skills,通过与分析、营销及销售平台合作,把产品开发后的获客、活动发布、支付和用户行为追踪接入Replit Agent。该方案试图让开发者在同一工作流内完成从构建产品到进入市场的流程,并借助PostHog等合作方查看客户从发现、触达到付费及留存的完整旅程。相关代理还可辅助寻找潜在客户和优化营销实验,但官方材料暂未披露合作方完整名单、价格及开放范围。

阅读原文
6

Gemini接入Waymo,提供独立车内语音助手

自动驾驶语音助手Gemini

Google将Gemini接入Waymo车辆,为乘客提供免手操作的车内语音助手,可用于获取信息及控制座舱相关功能。官方特别说明,Gemini与负责车辆行驶的Waymo Driver完全独立,因此语音助手不参与自动驾驶决策,避免将乘客交互系统与核心驾驶控制混为一体。此次整合把通用语音模型带入无人驾驶出行场景,但材料尚未说明覆盖城市、支持车型、具体座舱控制项目及全面开放时间。

阅读原文
7

LangChain接入MCP,1.4.0a2版本可试用

开源框架MCPAI代理

LangChain宣布在开源框架中加入MCP支持,并以FastMCP作为服务器与客户端开发的基础组件,改善模型、工具及运行环境之间的互操作体验。开发者现可在实验版本langchain==1.4.0a2中测试早期实现,在既有LangChain应用中尝试构建或连接MCP组件。此次更新仍处于预览阶段,主要用于收集反馈与排查兼容问题,官方尚未给出稳定版本发布时间及完整迁移指南。

阅读原文
8

Cohere发布Parse,文档解析每千页1.5美元

文档智能企业AICohere

Cohere发布企业级文档智能工具Parse,可把包含文本、表格及其他多模态内容的复杂文件转换为结构化数据,供检索、分析或后续AI工作流使用。产品支持九种主要语言,定价为每处理1000页1.5美元,为大规模合同、报告和档案数字化提供了明确的按页成本。现有材料没有给出支持的完整文件格式、单文件大小限制、数据驻留方案及准确率指标,也未提供独立官方链接。

9

开源补丁公开约10分钟即遭漏洞探测

网络安全开源软件AI代理

OCaml项目维护者报告,补丁在公开仓库分享后约10分钟,其网站便开始收到针对百分号编码路径遍历的自动化探测,显示漏洞监控机器人正持续观察公开代码变更。相关测试还表明,现代AI代理可依据模糊的漏洞提示快速构造可用攻击方法,使补丁公开与恶意利用之间的窗口显著缩短。该事件意味着传统开源项目的披露、延迟发布和补丁协调流程面临压力,但材料未确认实际入侵或数据泄露。

阅读原文
10

DeepMind开放DiffusionGemma,生成速度超千Token每秒

扩散模型推理加速开源模型

Google DeepMind推出开放模型DiffusionGemma,以并行去噪方式一次细化256个Token区块,区别于传统大模型逐Token自回归生成。材料称其基于Gemma 4 26B架构,在单张H100上生成速度超过每秒1000个Token,最高可比同级Gemma模型快4倍,同时支持256K上下文和140多种语言。模型采用Apache 2.0许可证,可用于商业与本地实验,但相关性能数据来自二手技术文章。

阅读原文

不要错过明天的 AI 简报

数千位专业人士的首选,用 AI Daily Brief 开启每天的工作与生活。