← 返回首页

🎯 模型发布追踪

2026年8月7日 · 早间报告

新模型 5 🔓 开源 1 🔒 闭源 4 数据源 11 采集时间 01:00

🔒 闭源模型 (4)

Meta Muse Spark 1.2 Meta
📅 2026-08-05
Meta Muse Spark 最新版本,与 Muse Code 编程 Agent 同步发布。针对 Agent 编码场景深度优化,支持1M token上下文窗口、多文件重构和长调试会话,与 Agent 训练循环协同训练。Muse Code 提供并行子Agent工作树隔离、可重放事件日志和内置技能系统。
text→text 1M上下文 编程Agent 多Agent协作
→ Meta Developer Blog
SeedRealtime 字节跳动
📅 2026-08-05
字节跳动发布的原生音视频全双工大模型,端到端统一音频、视频和文本建模,支持实时交互、主动感知和自然对话节奏。已大规模部署,较级联模型减少一半对话节奏问题,显著降低中断、延迟和误触发。
audio+video→audio+text 全双工 实时交互 主动感知
→ ByteDance Seed
Grok Voice Think Fast 2.0 xAI
📅 2026-07-29
xAI 最智能的语音模型,支持语音到语音(Speech-to-Speech)实时交互。grok-voice-latest 从8月5日起路由到该模型。
speech→speech 实时语音 全双工
→ xAI
Wan3.0 Video(万相3.0) 阿里
📅 2026-08-06
阿里万相3.0全能参考视频生成模型(All-in-One),统一支持文生视频、图生视频和参考生视频,最长可生成30秒视频。已在阿里云百炼上线,计划后续开源权重。
text/video→video 30秒长视频 📋 计划开源
→ 阿里云百炼

🔓 开源模型 (1)

Mistral Shieldstral Mistral
📅 2026-08-04
Mistral 发布的 3B 开源多模态安全分类器,Apache 2.0 许可证。将内容审核框架为策略自适应问答任务,支持文本和图像安全评估,推理时接受自然语言策略,无需重新训练即可适配新场景。性能匹敌7倍大小的模型,单卡16GB GPU即可运行。
text+image→safety 3B参数 策略自适应 Apache 2.0
→ HuggingFace

📡 数据源状态