← 返回首页

🎯 模型发布追踪

2026年8月17日 · 早间报告

新模型 8 🔓 开源 3 🔒 闭源 5 数据源 13 采集时间 21:25

🔒 闭源模型 (5)

DeepSeek V4 Pro (0813) DeepSeek
📅 2026-08-13 追溯发现
DeepSeek V4 Pro 正式版(GA),总参1.6T、激活49B,原生支持百万级超长上下文。Agent能力大幅增强,HLE 60.0(带工具)、TerminalBench 2.1 87.9、DeepSWE 62.7,支持低/高/最高三档推理努力控制,原生兼容OpenAI Responses API并适配Codex一键配置。
text→text 1M上下文 Agent增强 Codex适配
→ DeepSeek 官方
Gemini 3.7 Flash Google
📅 2026-08-13 追溯发现
Google最智能的工作马模型,在速度和智能之间取得最佳平衡。支持100万Token上下文窗口,多模态理解(文本+图像+视频+音频),Agent场景深度优化,代码生成和复杂推理能力显著提升。
text+image+video+audio→text 1M上下文 工作马模型 Agent优化
→ Google Blog
Grok 4.6 xAI
📅 2026-08-12 追溯发现
xAI最新编码与Agent模型,在Grok 4.5基础上专注长时运行Agent和更复杂的编码任务优化。首日即上线Cursor和Grok Build,支持OpenRouter、Vercel、Cloudflare等平台,知识截止日期2026年2月。
text→text 编码优化 Agent增强
→ xAI Official
Seed 2.1 Turbo 字节跳动
📅 2026-08-12 追溯发现
字节跳动Seed 2.1 Turbo多模态模型,专为编码和长时Agent工作流优化。厂商宣称较Claude Opus 4.6成本降低80%,支持多模态输入。
多模态 编码Agent 低成本
→ OpenRouter
Seed 2.0 Code 字节跳动
📅 2026-08-12 追溯发现
字节跳动Seed团队专为Agent编码场景优化的模型,在代码生成、工具调用和长链路编程任务上表现强劲,闭源API方式提供。
text→text 编码Agent
→ OpenRouter

🔓 开源模型 (3)

Qwen3.8 27B 阿里
📅 2026-08-14 追溯发现
通义千问Qwen3.8系列开源Dense模型,27B参数,支持视觉理解(image-text-to-text),Apache 2.0开源许可。在本地部署场景表现出色,支持长上下文,适合开发者和本地推理使用。
text+image→text Apache 2.0 本地部署 27B参数
→ HuggingFace
Qwen3.8 2.4T A95B 阿里
📅 2026-08-12 追溯发现
通义千问最新旗舰系列开源版本,稀疏MoE架构,总参数2.4万亿、每步激活约950亿,支持100万Token上下文。核心基准:GPQA Diamond 92.6、PaperBench 93.0、OSWorld 86.1,CodeArena全球第4。
text+image→text 1M上下文 2.4T参数 MoE架构
→ HuggingFace
NVIDIA Nemotron 3.5 Lightning NVIDIA
📅 2026-08-11 追溯发现
NVIDIA Nemotron 3系列扩展型号,30B参数MoE架构,专为长时运行Agent工作流的高效专用模型。输出速度最高4倍,Agent任务完成速度提升30%。支持本地部署(RTX PC/DGX Spark/Jetson),可使用NeMo后训练定制,开源权重。
text→text NVIDIA Open Agent专用 30B MoE
→ HuggingFace  ·  → NVIDIA Blog

📡 数据源状态