← 返回首页

🎯 模型发布追踪

2026年9月9日 · 凌晨报告

新模型 3 🔒 闭源 3 数据源 10 采集时间 01:00

🔒 闭源模型 (3)

Meta Muse Voice Transcribe Meta
📅 2026-09-01(官方发布日,追溯发现)
Meta Superintelligence Labs 首个实时音频感知模型,在单一自回归模型中同时完成流式语音识别(ASR)、说话人分离(支持20+说话人)与端点检测。音频以80ms块(12.5Hz)输入,每个块用单个软token表示。支持70+语言(25种在发布时已验证),流式WER 3.1%,最终延迟0.16秒,平均说话人分离错误率17.5%。定价$3.00/千分钟($0.18/小时)。API-only,未开源权重。
audio→text 流式ASR 说话人分离 端点检测 70+语言 API-only
→ Meta AI Research 官方博客
Google WeatherNext 3 Google
📅 2026-09-03(官方发布日,追溯发现)
Google DeepMind 与 Google Research 联合开发的最先进全球天气AI模型,已集成到 Search、Gemini、Maps、Google Maps Platform 和 Cloud 中。支持实时卫星数据摄取、每小时刷新、5公里级表面变量预测,并预测可再生能源条件(如100米风速和太阳辐射水平)。首个直接在AI天气模型中实现每小时更新和实时卫星数据融合的模型。
weather forecasting 5km分辨率 每小时刷新 实时卫星数据 可再生能源预测
→ Google 官方博客
Google Lyria 3.5 Google
📅 2026-09-03(官方发布日,追溯发现)
Google 最强音乐生成模型,提供更富表现力的人声和更丰富的编曲,支持更高保真度输出。用户可选择或描述流派、人声/器乐风格、短/长曲目长度。已通过 Gemini 应用、Google AI Studio、Google Flow Music 和 Google Vids 提供服务。在 Gemini API 中以公开预览版上线。
text→music 音乐生成 人声合成 Gemini集成 公开预览版
→ Google 官方博客

📡 数据源状态