Instella-MoE是什么Instella-MoE 是 AMD 开源的混合专家语言模型系列,总参数量 16B、激活参数量 2.8B,采用 27 层解码器架构。模型基于 AMD Instinct M
Lyria 3.5是什么Lyria 3.5是 Google DeepMind 在 Google Flow Music 中推出的新一代音乐生成模型,实现音乐性、歌词质量、人声表现力与创作控制四项核心升级
AngelSpec是什么AngelSpec 是腾讯混元团队开源的端到端推测解码训练框架,基于 TorchSpec 构建,支持 MTP 自回归与 DFly 块并行共 6 种草稿架构。推理与训练解耦,推理
JiuwenSwarm是什么JiuwenSwarm是华为2012实验室、华为云、终端小艺等团队联合构建的开源AI Agent平台,也是首个面向鸿蒙PC的开源AI统一工作台。平台采用多智能体协同架构,支
MiniMax H3是什么MiniMax H3 是稀宇科技推出的通用全模态生成模型,打破传统任务与模态边界,支持对文本、图像、视频、音频的统一理解与原生生成。模型能输出原生双声道音视频,最高支持15秒
Qwen-Audio-3.0-ASR-Flash是什么Qwen-Audio-3.0-ASR-Flash 是阿里千问团队推出的语音识别大模型,现已通过阿里云百炼平台开放调用,提供 Flash、Filet
Kimi K3是什么Kimi K3 是月之暗面推出的 2.8 万亿参数开源大模型,基于 KDA 混合线性注意力机制与注意力残差技术构建,原生支持视觉理解,拥有 100 万 token 上下文窗口。Ki
StaffDeck是什么StaffDeck 是面壁智能联合东北大学-面壁智能数据智能联合实验室、清华大学 THUNLP 实验室、OpenBMB 与 AI9Stars 开源的数字员工全流程构建与管理平台
LoHoSearch是什么LoHoSearch 是美团 LongCat 团队推出的下一代搜索智能体评测基准,基于覆盖 762 万维基百科实体、2.65 亿条关系边的知识图谱自动生成题目,替代传统人工出
Qwen-Audio-3.0-TTS是什么Qwen-Audio-3.0-TTS 是阿里通义千问推出的语音合成大模型,包含面向实时交互的 Flash 版与面向高质量生成的 Plus 版。模型在 Arti
MoWorld是什么MoWorld 是魔芯科技推出的全球首个高帧率交互式世界模型,基于纯国产华为昇腾 NPU 全栈优化,实现最高 50 FPS 实时推理,成本较 GPU 降低 70%。模型支持精确相机
GPT-Live是什么GPT-Live 是 OpenAI 推出的新一代语音模型,采用全双工架构实现同时听说,每秒多次决策开口、倾听、插话或调用工具。模型将实时交互与深度任务解耦,复杂问题委托后台 GP