专题报告产品/公司近 14 天 · Asia/Shanghai

Global AI Model Releases, Official Previews & Lab Products

xAI发布Grok 4.7,OpenAI与阿里密集推出垂直SKU

13,657
14 天内扫描的条目 · 昨日 788
920.7%
通过研判、值得提醒 · 99.3% 噪音被过滤
47
新开进展卡 · 50 条并入已有进展作为佐证
8
本期产生有效进展的信源 · 首位 36氪

本期要点

AI 依据已归并的进展撰写,每条可回溯到原始来源
  1. xAI发布Grok 4.7,参数提升至2.1T,API定价$2/$6,已同步上线Cursor及云平台。
  2. OpenAI密集落地法律、金融、临床等垂直SKU,并下调Luna价格约80%,强化商业化矩阵。
  3. 阿里Qwen发布Qwen3.8-Omni-Flash全模态模型及Qwen Intelligence手机Agent方案。
  4. Meta Muse确认GA并登顶美区App Store,Anthropic推进Claude产品合并及金融销售垂直Beta。

接下来盯什么

  • 关注OpenAI及Anthropic垂直SKU从Beta向GA转化的速度及企业客户渗透率。
  • 监测Grok 4.7与Qwen新模型在第三方编程工具及云平台上的实际调用量与反馈。
  • 观察Meta Muse及阿里Qwen Intelligence在移动端生态的后续版本更新与功能扩展。

14 天脉动

每日扫描量与通过研判的条目
29
11
7
0
0
0
21
1
4
12
0
0
0
7
09/0909/1009/1109/1209/1309/1409/1509/1609/1709/1809/1909/2009/2109/22
当日扫描总量(底色)通过研判的条目(独立刻度,柱顶为数量)

本期主线

4 条主线 · 点击进展跳转到时间线

垂直行业SKU落地6

OpenAI、Anthropic、Kimi聚焦法律、金融、医疗等场景,推出专用产品或整合第三方数据源。

平台整合与科研突破2

Anthropic合并Claude产品线,OpenAI公布内部模型攻克千禧年数学难题的执行细节。

进展时间线

19 条 · 按发生时间倒序
9月22日星期二 · 3
重要 终端应用与商业化 18:43 · 快科技 1 条证据

阿里巴巴发布通义千问智能体:AI手机智能体解决方案将搭载于荣耀Magic9

阿里巴巴在2026云栖大会上正式发布通义千问智能体(Qwen Intelligence):这是一套基于通义千问模型系列的模块化全栈AI手机智能体解决方案,提供三个针对手机优化的智能体(移动规划、移动使用、移动创作)以及四个开放评估基准。荣耀Magic9(9月28日发布)已确认为首款搭载通义千问智能体的设备,荣耀机器人手机也获得支持。阿里巴巴将其定位为面向终端厂商的非硬件、开放合作产品。

重要 终端应用与商业化 13:41 · 财新网 - 评论/数据通 3 条证据

Meta Muse 正式全面开放:13 天内登顶美国 App Store 榜首(下载量 250 万,美国日活 64.2 万);AI 智能体重估推动股价上涨 11%

Meta 的人工智能代理“Muse”(9 月 8 日发布,支持 iOS 和 Android,覆盖美国及加拿大)已确认为 Meta 自有的通用 AI 客户端产品。Piper Sandler(经 CNBC 报道)证实了该产品在应用商店的巨大用户量和评分,从而引发投资者对 Meta AI 资本支出的重新评估;Meta 股价当日上涨 10%,9 月以来累计上涨 28%。发布后的量化数据(来自 Sensor Tower 和 Apptopia)显示:前 5 天下载量达 73 万;第 13 天累计下载量达 250 万(其中 iOS 约 150 万,Android 约 110 万);美国移动日活跃用户数为 64.2 万,而 ChatGPT 同期为 23.1 万。Muse 位居美国 iOS 免费榜第一名,超越 ChatGPT、Claude 和 Grok。Meta 将 Muse 定位为“面向所有人的全球首个个人 AI 助手”:这是一款能够自主执行网络任务(如研究、填写表格、在线购物、餐厅预订、宠物护理)的智能代理产品,并集成了电子邮件、日历、Spotify、Instagram 和 OpenTable;它存储用户偏好,并通过显式授权来限制敏感操作(隐私、支付)。在报道发布的周一,股价重新评级后上涨 11%。

前沿模型与API迭代 08:32 · 财新网 - 科技频道 3 条证据

xAI 正式发布 Grok 4.7(~2.1T 参数),API 定价 $2/$6 每百万词元,Cursor / Grok Build / 云平台同步上线

9 月 22 日 xAI 发布新一代基础模型 Grok 4.7。官方称参数量约 2.1 万亿(较 4.6 的 1.5 万亿提升约 40%),支持文本与图像输入,500K 上下文窗口,提供 low / medium / high / xhigh 四档推理强度。API 定价:输入 $2/M、输出 $6/M;另设高速版(输出速度翻倍、价格翻倍)。模型已通过 Cursor、Grok Build 及第三方编程工具、模型路由服务、云平台提供,Grok API 同步开放。CursorBench 4.0 中面向长时间编程任务,价格与性能处于同类前列。官方另称安全防护体系为现有最高水平,LatchBio 生物安全基准 62.4%。

参数量 ~2.1TAPI输入价格 $2/MAPI输出价格 $6/M
9月18日星期五 · 4
前沿模型与API迭代 12:41 · 36氪 3 条证据

智谱正式发布GLM-5.3-FlashX(最高200 tokens/s):前代'Ox Alpha'匿名上线后需求激增,基于10万张国产芯片推理算力推出

智谱(Zhipu)于9月18日正式推出基础模型GLM-5.3-FlashX,最高生成速度达200 tokens/s。前代版本GLM-5.3-Flash此前以'Ox Alpha'匿名推出,被开发者戏称为'牛来'模型;在需求快速增长后,智谱在10万张国产芯片提供的推理算力基础上,加大对Infra侧的投入与推理优化,推出FlashX新版本。

最高生成速度 200 tokens/s算力基础 10万张国产芯片
重要 垂直行业SKU落地 04:15 · OpenAI 4 条证据

OpenAI 发布 Astra for Law:基于 GPT-6 Astra 的法律垂直 SKU,整合 CourtListener 判例库与 73 插件,受邀内测中

OpenAI 正式发布 Astra for Law,面向律所及法律科技公司的垂直产品 SKU(lab-owned vertical SKU),基于 GPT-6 Astra 提供专属工具、设置与上下文。数据隐私为核心功能:零数据留存,客户案件资料不用于模型训练。平台内置专属法律检索索引,覆盖超 2.3 亿网页资源,并接入 CourtListener 案例库,可检索美国判例、成文法规与法院规则(覆盖 99.9% 已公开判例)。核心能力包括检索同类案件、区分判决核心观点与附带评述(dicta)、挖掘不利判例、起草诉状、合同风险识别及梳理案件辩论逻辑。法律基准测试中答题正确率 54%(对比普通 GPT-6 Astra 为 38.7%),相关判例检索量提升 24%,关键段落定位最多提升 54%。插件生态:26 个合作伙伴构建插件 + 47 个社区插件(共 73 个),用户可在 ChatGPT 内直接调用。产品命名与 GPT-6 Astra 推理能力绑定,随 OpenAI 后续模型更新自动升级。目前采用受邀内测模式,仅限选定律所先行试用,后续将开放 API。

Astra for Law: Frontier intelligence built for your practice. A new offering powered by GPT-6 Astra with tools, settings, and context to support the expertise and judgment of lawyers and legal technology firms.— OpenAI · @OpenAI 于 X · 2026年9月18日 04:15
前沿模型与API迭代 11:16 · Alibaba_Qwen 1 条证据

阿里巴巴 Qwen 官方发布 Qwen3.8-Omni-Flash:首个全模态智能体基础模型

阿里巴巴 Qwen 官方渠道正式发布 Qwen3.8-Omni-Flash,称其为该实验室首个以智能体能力为核心的全模态基础模型,原生集成音视频理解、推理与工具调用功能,可在单一模型内完成内容理解、任务规划、工具执行与结果交付。

🚀 Meet Qwen3.8-Omni-Flash, Qwen's first omni-modal model built around agentic capabilities! Native audio-video understanding, reasoning, and tool use come together in one model: understand the content, plan the task, execute with tools, and deliver the result. Highlights: 🥳 -— Alibaba_Qwen · @Alibaba_Qwen 于 X · 2026年9月18日 11:16
垂直行业SKU落地 08:15 · 财新网 - 科技频道 2 条证据

Kimi 发布金融行业解决方案(垂直 SKU 正式 GA)

Moonshot Kimi 9 月 17 日正式发布金融行业解决方案,整合 10 余个权威数据源、9 项金融技能及 5 项合规安全措施,提供数据建模与报告交付能力;已有数十家金融机构(头部券商、商业银行、风险投资基金、投研数据机构)基于 Kimi 模型 / Kimi 企业版 / Kimi Work 开展业务创新或共建金融方案。

9月17日星期四 · 2
终端应用与商业化 07:40 · Greg Brockman 1 条证据

OpenAI ChatGPT Ads 正式上线,Shopify 成首个电商合作方

OpenAI 旗下的 ChatGPT Ads 广告产品正式上线,Shopify 成为其首个电商合作伙伴。商家可以直接在 Shopify 后台安装并管理面向 ChatGPT 用户的广告活动,自主设定预算,产品目录由 OpenAI 直接获取。该功能是 OpenAI 自有的商业化广告产品,属于垂直 SKU 级别的产品正式全面上线(GA)。

重要 平台整合与科研突破 00:20 · claudeai 2 条证据

Anthropic 官方宣布 Claude Cowork 与 chat 合并为统一 Claude,数周内推送至 Pro/Max 用户

Anthropic 官方渠道确认 Claude Cowork 与 chat 将合并为单一 Claude 产品:用户可快速提问或交付报告,Claude 在用户关闭笔记本后继续处理,遇不清晰处主动追问,最终决定权归用户。该合并体验将在数周内向 Pro 与 Max 订阅者推送。

Claude Cowork and chat are merging into one Claude. Ask a quick question or hand over a report, and Claude takes it from there, even after you close your laptop. If something's unclear, Claude asks—you keep the final say. Rolling out to Pro and Max over the next few weeks.— claudeai · @claudeai 于 X · 2026年9月17日 00:20
9月15日星期二 · 2
重要 垂直行业SKU落地 23:02 · claudeai 2 条证据

Anthropic 开放“Salesforce in Claude”垂直产品 Beta 版(含 37 项预建销售技能)

Anthropic 正式推出“Salesforce in Claude”Beta 版,这款垂直领域销售产品可将 Salesforce 的客户、商机及管道数据直接集成至 Claude 对话中。该产品内置 37 项预建销售技能,支持通话准备、交易审查、管道仪表盘生成及预测发送等功能,用户无需离开对话界面即可完成任务。

Salesforce in Claude is now available in beta. It brings your accounts, opportunities, and pipeline into Claude, with 37 pre-built sales skills. Prep a call, review a deal, create a pipeline dashboard, or send your forecast without leaving the conversation.— claudeai · @claudeai 于 X · 2026年9月15日 23:02
重要 垂直行业SKU落地 07:12 · 36氪 1 条证据

Anthropic推出面向财务顾问的Claude,一款集成BlackRock和Vanguard金融工具的垂直领域标准化产品

Anthropic发布了面向财务顾问的Claude,这是一款由实验室拥有并专门针对垂直领域的标准化产品,它将Claude与BlackRock和Vanguard运营的金融分析及风险管理工具相结合。Anthropic和BlackRock的高管表示,该系统加速了财务顾问在研究、行政及投资组合监控等任务中的工作流程,这标志着Anthropic进军金融行业最重大的举措之一。

9月11日星期五 · 3
垂直行业SKU落地 01:17 · CNBC 5 条证据

OpenAI正式发布ChatGPT for Financial Services(垂直领域SKU GA,Morgan Stanley/Evercore为设计伙伴)

OpenAI官方渠道(Greg Brockman博客)宣布ChatGPT for Financial Services现已上线:面向投资银行家与股票研究员的定制化ChatGPT Work体验,内置Daloopa、PitchBook、LSEG News等金融数据源,搭载GPT-6 Astra推理能力,支持投研、财务建模及定制客户材料;服务将随OpenAI后续模型更新自动升级。Morgan Stanley与Evercore作为设计伙伴参与了产品打造。OpenAI表示该工具旨在吸引大型金融机构、持续扩大企业客户占比。

OpenAI targets work of Wall Street junior bankers with new ChatGPT for Financial Services— CNBC · @CNBC 于 X · 2026年9月11日 01:17
重要 垂直行业SKU落地 05:12 · Greg Brockman 1 条证据

OpenAI上线ChatGPT for Clinicians(GPT-6 Astra Pro),面向美国认证临床医生

OpenAI官方渠道宣布垂直产品ChatGPT for Clinicians上线:经身份验证的美国临床医生即日起可免费使用GPT-6 Astra Pro,官方提供注册入口。

9月9日星期三 · 4
前沿模型与API迭代 08:00 · 36氪 22 条证据

DeepSeek正式发布V4.1-Flash基础模型,取代V4-Pro并下调价格

9月10日,DeepSeek正式发布DeepSeek-V4.1-Flash,为其全新模型结构系列中最小尺寸型号,552B参数MoE架构,具备原生多模态视觉理解能力,输入激活8B/输出激活16B,成本低于同尺寸模型。官方称该模型取代V4-Pro并下调价格,多项基准测试超越旗舰模型V4-Pro。

重要 平台整合与科研突破 01:23 · OpenAI 19 条证据

OpenAI公布内部模型攻克Navier-Stokes千禧年难题的执行细节:88小时探索+Lean形式化核验,模型强于GPT-6 Astra

OpenAI于9月8日官宣使用强于GPT-6 Astra的内部模型、协同约1万个AI智能体攻克纳维-斯托克斯方程千禧年难题后,9月9日补充执行细节:88小时内完成核心证明思路探索,随后17小时通过Lean形式化证明系统完成严谨核验;项目累计消耗约1300亿token(总项目近3000亿),成本数百万美元,配套公开165页论文与形式化代码。OpenAI重申代理未预先接触研究者工作、未利用特定用户数据,并致谢Levent Alpöge与Tristan Buckmaster;Greg Brockman与Sam Altman此前已公开确认此为AI与数学里程碑及“首次成功成就”。克雷数学研究所尚未正式认定该证明成立,部分顶尖数学家对证明逻辑、成果归属及前期研究版权提出质疑。此外,已发布的GPT-6 Astra此前曾一次性攻克5道Erdős数学难题(含解离集猜想与Erdős-Sós猜想)。该内部模型仍未披露正式名称、版本及API定价。

前沿模型与API迭代 07:51 · 36氪 2 条证据

DeepSeek flash系列官方API定价调整(含降幅明细)

DeepSeek flash系列API定价于2026年9月10日12:00起调整:空闲时段输入缓存命中0.02元/M token(降幅60%)、未命中1元/M token(降幅33%)、输出4元/M token(降幅11%);高峰时段(周一至周五9:00-12:00、14:00-18:00)为空闲时段2倍,缓存命中0.04元、未命中2元、输出8元。

9月3日星期四 · 1
终端应用与商业化 04:57 · Zephyr (@zephyr_z9) 16 条证据

Meta 正式发布 Muse Spark 1.3,Muse Code 登陆原生 Windows,Muse 个人智能体上线 iPhone / Mac 客户端

Meta 通过 Meta Model API 和 Muse Code 正式发布 Muse Spark 1.3,其基准测试表现接近 GPT-5.6 Sol;发布时的 max reasoning 配置仍处于安全测试阶段,尚未向开发者广泛开放。Meta 同步推出了由 Muse Spark 1.3 驱动的个人智能体 Muse,该智能体能够自主处理任务,交互形式类似 Grok Bot。最新进展显示,Muse Code 已登陆原生 Windows 版本,无需依赖 WSL,支持 PowerShell 交互并默认在沙箱中运行;Muse 个人智能体也已上线原生 iPhone 和 Mac 应用,Mac 用户可直接下载安装。

谁在提供有效信号

按通过研判的条目数排序
36氪17
快科技13
财新网 - 最新报道9
财新网 - 科技频道8
Greg Brockman7
OpenAI6
Sam Altman4
CNBC3

这份报告在盯什么

监控的关注范围与研判准则(只读)

关注

具名实验室的基础大模型正式发版或新正式版本具名基础模型的官方 API/平台内测、预览或灰度(含限时 preview endpoint)官方开源权重官方价目表或 API 单价变动实验室自家产品上架/GA(通用客户端或行业版 SKU)官方预告:具名模型 + 可核验动作(开放申请/预览名日期/价目草案)

排除

第三方托管 / Copilot / 电商货架 / 其他平台上架可用性限时促销、夜间免费、数据共享折扣、订阅档降价纯榜单与评测登顶诉讼、财报、宕机、安全事故无具名模型或无可核验动作的空预告/传闻非基础大模型的领域模型(如纯气象模型)

研判准则

Wake only if a named lab (1) launches a foundation model or a new official version, (2) opens an official API/platform beta, preview, or gray release for a named foundation model (including time-limited preview endpoints), (3) releases official open weights, (4) changes the official list price or API unit price, or (5) ships or GAs the lab own product (general client/app/desktop or vertical SKU tied to that lab, e.g. Claude for Financial Advisors, DeepSeek desktop). Official teasers wake only when an official channel names a model and a verifiable action (open signup, preview name/date, or dra