← 返回首页

🎯 模型发布追踪

2026年10月8日 · 早间报告

新模型 13 🔓 开源 2 🔒 闭源 11 数据源 15
ℹ️ 采集任务自 09-24 后中断,本期覆盖 09-25 ~ 10-08 窗口;漏跑期间的追溯发现模型统一记入本报告,卡片标注的是原始发布日期。

🔒 闭源模型 (11)

Claude Haiku 5.5 Anthropic
📅 2026-10-07
Anthropic 迄今最快、最便宜、最强的小模型,面向高并发与成本敏感任务,如摘要、压缩、数据库查询、分类、实时客服与浏览器操作。是首个支持可调 effort 档位(Low→Max)的 Haiku 级模型,平均运行成本比 Haiku 4.5 低约 75%;OSWorld 2.1 得分 72.4%,Humanity's Last Exam 45.9%(无工具)/57.4%(有工具)。
text+image→text 小模型/高并发 可调 effort
→ Anthropic Blog
Gemini Nano Banana 2.1 Google
📅 2026-10-06
Google 新一代高能效图像生成与对话式编辑模型,在图像生成质量与指令跟随上较上一代提升,支持多轮对话式图像编辑,已通过 Gemini API 与 Google Cloud 提供。
text→image 图像生成/编辑
→ Google DeepMind
Mistral Large 4 Mistral
📅 2026-10-06
Mistral 迄今最大最强的原生多模态模型(内部代号 le Chonk),1T 总参数 / 52B 激活的稀疏 MoE 架构,在自有欧洲数据中心用 3800 张 NVIDIA Grace Blackwell 从零训练,训练数据覆盖 160+ 语言。主打网络安全(Artificial Analysis Cyber Index 全球前五)、Agentic 编码与知识工作。先以公开预览版上线 Mistral Studio,权重承诺月底开源。
text+image→text 1T总参/52B激活 📋 计划开源
→ Mistral News
Qwen Image 2.1 Pro 阿里
📅 2026-10-02
通义千问统一的文生图与图像编辑模型,视觉生成组件仅 70 亿参数(32 层单流 DiT),采用轻量级架构配合混合粒度注意力与前缀 KV 缓存复用。支持原生透明(RGBA)输出、最多 10 张参考图的多图编辑与局部遮罩/标注编辑,并提升排版、人像光影与细节表现。
text+image→image 70亿参数 图生图/透明通道
→ 阿里云百炼
Gemini 4 Argon Google
📅 2026-09-30
Google 新一代前沿模型,面向真实世界编码、企业知识工作与网络防御。输出上限提升至业界领先的 100 万 token(此前 64K),可自主发现、验证并修补漏洞;DeepSWE v1.1 达 77.9%、LVBench 91.7%、CWE-bench v1 68%。首批仅向 Fairwind 计划的可信网络防御方开放,随后逐步面向付费 API 客户与 Google AI Ultra 订阅者。
text+image+video→text 1M输出上限 前沿模型/网络安全
→ Google Blog
GPT-6.1 Sol OpenAI
📅 2026-09-29
GPT-6 Sol 的升级版,智能水平接近旗舰 GPT-6 Astra,成本约为其五分之一。主打智能体编码、电脑操作与专业工作,DeepSWE v1.1 与 Astra 持平,在复杂 PDF 问答、多步业务流程(AutomationBench)与科学工作流上表现突出。API 定价 $2/百万输入 token、$10/百万输出 token,缓存输入享 95% 折扣。
text+image+file→text 编程/Agent $2/$10 每百万token
→ OpenAI Blog
Claude Sonnet 5.5 Anthropic
📅 2026-09-28
Claude 5.5 系列的第二款模型,定位 Agent 与编程场景,保持 1M 上下文。能力大幅超前代,是首个自带安全分类器的 Sonnet 模型;发布后即登上 Artificial Analysis 智能指数第 2 名。
text+image→text 1M上下文 Agent/编程
→ Anthropic Blog
GLM 5.3 Prime 智谱
📅 2026-09-23
智谱 GLM-5.3 的高速增强版本,支持 1M 上下文,输出吞吐较 GLM-5.3 提升约 1.5–2 倍,面向高吞吐编码与 Agent 场景。
text+image+file→text 1M上下文 高吞吐
→ OpenRouter
Qwen 3.8 Max Prime 阿里
📅 2026-09-23
通义千问 Qwen3.8-Max 系列的新版本,支持 1M 上下文与 131K 输出,可输入文本、图像与视频,主打编码与协作(Cowork)能力。
text+image+video→text 1M上下文 / 131K输出 编码/协作
→ OpenRouter
Gemini 3.8 Flash TTS Google
📅 2026-09-23
Google 迄今表现力最强的语音生成模型之一,面向深度创作与角色设计。可用自然语言提示生成原创音色,并对每一行台词控制表演提示、节奏、方言切换与回应语气;支持 100+ 语言与方言、2000+ 预置音色,30 秒样本即可复刻音色(需本人同意验证)。
text→speech 语音合成/音色设计 100+语言
→ Google Blog
Gemini 3.8 Flash-Lite TTS Google
📅 2026-09-23
Gemini 3.8 系列的轻量高性价比文本转语音模型,面向大规模配音、音频内容与语音 Agent,可控制语气、节奏与表达细节,并支持长文本低说话人漂移生成。所有生成音频均带 SynthID 水印与 C2PA 凭证。
text→speech 轻量/高性价比 SynthID水印
→ Google Blog

🔓 开源模型 (2)

BAAI AREX-2 智源
📅 2026-09-29
北京智源研究院(BAAI)推出的 27B 长程 Agent 模型,基于 Qwen3.8-27B 的稠密多模态架构。通过在可验证任务上的多轮「提出—度量—反思—修正」自改进训练,将自我提升能力迁移到深度研究场景,无需新增搜索轨迹。Apache-2.0 开源。
text+image→text 27B参数 Apache-2.0
→ HuggingFace
Intern-Decision 上海AI实验室
📅 2026-09-26
上海人工智能实验室推出的多模态结构化决策模型系列(0.8B/2B/4B),单次前向即可对一组带 schema 的问题输出答案分布与置信度,适用于工单路由、内容审核、Agent 路由与结果校验等高频业务判断场景。Apache-2.0 开源。
text+image→结构化决策 0.8B/2B/4B Apache-2.0
→ HuggingFace

📡 数据源状态