← 返回首页
ℹ️ 采集任务自 09-24 后中断,本期覆盖 09-25 ~ 10-08 窗口;漏跑期间的追溯发现模型统一记入本报告,卡片标注的是原始发布日期。
🔒 闭源模型 (11)
📅 2026-10-07
Anthropic 迄今最快、最便宜、最强的小模型,面向高并发与成本敏感任务,如摘要、压缩、数据库查询、分类、实时客服与浏览器操作。是首个支持可调 effort 档位(Low→Max)的 Haiku 级模型,平均运行成本比 Haiku 4.5 低约 75%;OSWorld 2.1 得分 72.4%,Humanity's Last Exam 45.9%(无工具)/57.4%(有工具)。
text+image→text
小模型/高并发
可调 effort
→ Anthropic Blog
📅 2026-10-06
Google 新一代高能效图像生成与对话式编辑模型,在图像生成质量与指令跟随上较上一代提升,支持多轮对话式图像编辑,已通过 Gemini API 与 Google Cloud 提供。
text→image
图像生成/编辑
→ Google DeepMind
📅 2026-10-06
Mistral 迄今最大最强的原生多模态模型(内部代号 le Chonk),1T 总参数 / 52B 激活的稀疏 MoE 架构,在自有欧洲数据中心用 3800 张 NVIDIA Grace Blackwell 从零训练,训练数据覆盖 160+ 语言。主打网络安全(Artificial Analysis Cyber Index 全球前五)、Agentic 编码与知识工作。先以公开预览版上线 Mistral Studio,权重承诺月底开源。
text+image→text
1T总参/52B激活
📋 计划开源
→ Mistral News
📅 2026-10-02
通义千问统一的文生图与图像编辑模型,视觉生成组件仅 70 亿参数(32 层单流 DiT),采用轻量级架构配合混合粒度注意力与前缀 KV 缓存复用。支持原生透明(RGBA)输出、最多 10 张参考图的多图编辑与局部遮罩/标注编辑,并提升排版、人像光影与细节表现。
text+image→image
70亿参数
图生图/透明通道
→ 阿里云百炼
📅 2026-09-30
Google 新一代前沿模型,面向真实世界编码、企业知识工作与网络防御。输出上限提升至业界领先的 100 万 token(此前 64K),可自主发现、验证并修补漏洞;DeepSWE v1.1 达 77.9%、LVBench 91.7%、CWE-bench v1 68%。首批仅向 Fairwind 计划的可信网络防御方开放,随后逐步面向付费 API 客户与 Google AI Ultra 订阅者。
text+image+video→text
1M输出上限
前沿模型/网络安全
→ Google Blog
📅 2026-09-29
GPT-6 Sol 的升级版,智能水平接近旗舰 GPT-6 Astra,成本约为其五分之一。主打智能体编码、电脑操作与专业工作,DeepSWE v1.1 与 Astra 持平,在复杂 PDF 问答、多步业务流程(AutomationBench)与科学工作流上表现突出。API 定价 $2/百万输入 token、$10/百万输出 token,缓存输入享 95% 折扣。
text+image+file→text
编程/Agent
$2/$10 每百万token
→ OpenAI Blog
📅 2026-09-28
Claude 5.5 系列的第二款模型,定位 Agent 与编程场景,保持 1M 上下文。能力大幅超前代,是首个自带安全分类器的 Sonnet 模型;发布后即登上 Artificial Analysis 智能指数第 2 名。
text+image→text
1M上下文
Agent/编程
→ Anthropic Blog
📅 2026-09-23
智谱 GLM-5.3 的高速增强版本,支持 1M 上下文,输出吞吐较 GLM-5.3 提升约 1.5–2 倍,面向高吞吐编码与 Agent 场景。
text+image+file→text
1M上下文
高吞吐
→ OpenRouter
📅 2026-09-23
通义千问 Qwen3.8-Max 系列的新版本,支持 1M 上下文与 131K 输出,可输入文本、图像与视频,主打编码与协作(Cowork)能力。
text+image+video→text
1M上下文 / 131K输出
编码/协作
→ OpenRouter
📅 2026-09-23
Google 迄今表现力最强的语音生成模型之一,面向深度创作与角色设计。可用自然语言提示生成原创音色,并对每一行台词控制表演提示、节奏、方言切换与回应语气;支持 100+ 语言与方言、2000+ 预置音色,30 秒样本即可复刻音色(需本人同意验证)。
text→speech
语音合成/音色设计
100+语言
→ Google Blog
📅 2026-09-23
Gemini 3.8 系列的轻量高性价比文本转语音模型,面向大规模配音、音频内容与语音 Agent,可控制语气、节奏与表达细节,并支持长文本低说话人漂移生成。所有生成音频均带 SynthID 水印与 C2PA 凭证。
text→speech
轻量/高性价比
SynthID水印
→ Google Blog
🔓 开源模型 (2)
📅 2026-09-29
北京智源研究院(BAAI)推出的 27B 长程 Agent 模型,基于 Qwen3.8-27B 的稠密多模态架构。通过在可验证任务上的多轮「提出—度量—反思—修正」自改进训练,将自我提升能力迁移到深度研究场景,无需新增搜索轨迹。Apache-2.0 开源。
text+image→text
27B参数
Apache-2.0
→ HuggingFace
📅 2026-09-26
上海人工智能实验室推出的多模态结构化决策模型系列(0.8B/2B/4B),单次前向即可对一组带 schema 的问题输出答案分布与置信度,适用于工单路由、内容审核、Agent 路由与结果校验等高频业务判断场景。Apache-2.0 开源。
text+image→结构化决策
0.8B/2B/4B
Apache-2.0
→ HuggingFace
📡 数据源状态
- ✅ OpenRouter API — 正常(发现 7 个)
- ✅ HuggingFace API(26厂商)— 正常(发现 2 个)
- ✅ 阿里云百炼新模型发布页 — 正常(发现 1 个)
- ✅ 千问AI平台模型发布记录 — 正常(发现 1 个)
- ✅ DeepSeek API Changelog — 正常(无新发布)
- ✅ OpenAI Blog / Release Notes — 正常(发现 1 个)
- ✅ Anthropic News — 正常(发现 2 个)
- ✅ Google AI Blog / DeepMind — 正常(发现 4 个)
- ✅ Meta AI Blog — 正常(无新发布)
- ✅ Mistral AI News — 正常(发现 1 个)
- ✅ MiniMax News — 正常(无新发布)
- ✅ 智谱 Z.ai — 正常(发现 1 个)
- ✅ 字节 Seed / Kimi / 阶跃星辰 / 腾讯 / 快手 — 正常(无新发布)
- ✅ Artificial Analysis — 正常(确认 5 个)
- ✅ 搜索引擎补充 — 正常(确认 9 个)