← 返回首页
🔒 闭源模型 (1)
📅 2026-09-08(官方发布日,追溯发现)
最强扩散语言模型 (dLLM),较 Mercury 2 智能提升 40%,在 NVIDIA GPU 上以 1,107 tokens/sec 运行。260K 上下文窗口,支持可调推理、并行工具调用和结构化 JSON 输出。API-only 闭源,通过 Inception API、Baseten 和 OpenRouter 提供服务。
text→text
260K上下文
扩散LLM
1,107 tokens/sec
API-only
→ Inception Labs 官方博客
🔓 开源模型 (2)
📅 2026-09-10
DeepSeek 新架构 Causal Encoder-Decoder (CED) 的首个模型,552B 总参数 / 8B 激活参数的 MoE 架构。20层因果编码器 + 20层解码器,全局 KV 缓存仅 890 bytes/token(约为 V4-Flash 的 1/4)。原生多模态视觉理解,1M 上下文长度。GPQA Diamond 90.9,Codeforces Rating 3471。MIT 许可证开源权重。替代 V4-Flash 和 V4-Flash-Vision-Exp。
text+image→text
1M上下文
552B MoE
CED架构
MIT
→ HuggingFace
📅 2026-09-08(追溯发现)
Cohere 的多语言基座模型,3.35B 参数,支持 46+ 种语言,覆盖五大世界地区。32K 上下文窗口,基于 Cohere2 架构。CC-BY-NC-4.0 许可证。Tiny Aya 系列的基座版本,另有 En-Thinker 等衍生模型。
text→text
32K上下文
46+语言
多语言
CC-BY-NC-4.0
→ HuggingFace
📡 数据源状态
- ✅ OpenRouter API — 发现2个新模型:DeepSeek V4.1 Flash、Inception Mercury 2.5
- ✅ HuggingFace API (21厂商) — 发现2个新模型:DeepSeek V4.1 Flash、CohereLabs Tiny Aya Base 32K
- ✅ OpenAI 官方博客 — 正常(无新模型,GPT-6 Astra 已于09-08报告)
- ✅ Anthropic 官方博客 — 正常(无新模型)
- ✅ Google 官方博客 — 正常(无新模型)
- ✅ Meta AI 官方博客 — 正常(无新模型)
- ✅ DeepSeek API Changelog — 确认 DeepSeek V4.1 Flash 于 09-10 发布
- ✅ 阿里云百炼新模型页 — 正常(9月无新模型)
- ✅ 搜索引擎补充 — 确认3个新模型发布信息
- ✅ Mistral/Cohere/NVIDIA/xAI/ByteDance/Tencent/MiniMax/其他 — CohereLabs 发现 Tiny Aya Base 32K;其他厂商无新模型