跳到正文
北京时间

通义千问 Qwen

阿里通义千问 Qwen 系列的开源发布与迭代:从旗舰模型到端侧小模型的全谱系动态。

最新精选

第 101–106 条 · 共 106 条
4月16日周四
  1. 公众号:通义实验室(千问)62

    Qwen3.6-35B-A3B 开源!

    通义千问开源 Qwen3.6-35B-A3B,一款总参数 350 亿、推理仅激活 30 亿参数的稀疏 MoE 模型。其在 SWE-bench、Terminal-Bench 等编程基准上显著超越前代,并超越 270 亿参数的稠密模型;原生多模态,在 RefCOCO 上得分 92.0。

    推荐理由:千问又推轻量 MoE 模型,35B 总参激活仅 3B,小团队能跑,但正文就一句宣传语,缺技术细节,先观望。

3月30日周一
3月19日周四
  1. Qwen:Blog Retrieval(API)

    Qwen3.5-Max-Preview 现已上线 Arena

    Qwen3.5-Max-Preview 已登陆 LMSYS Chatbot Arena。Qwen Studio 提供聊天机器人、图像与视频理解、图像生成、文档处理、网页搜索、工具调用及 artifacts 等全栈功能。

    推荐理由:阿里 Qwen3.5-Max 预览版上线 Arena,支持多模态理解与工具调用

12月15日周一
  1. 通义 QwenAudio:原创语音项目60

    通义实验室开源 Fun-ASR 系列语音识别模型,含方言与 31 语言版本

    通义实验室发布 Fun-ASR 端到端语音识别模型系列并开源。Fun-ASR-Nano-2512 参数量 800M,基于数千万小时语音训练,支持中英日三语、7 种汉语方言和 26 种地方口音;Fun-ASR-MLT-Nano-2512 同为 800M,基于数十万小时训练,支持 31 种语言。

    推荐理由:原文给出两个识别模型的训练规模、语言覆盖和开源基准对比,还附部署与推理路径,读者可据此评估在中文和方言场景的可用性。

7月3日周三
  1. 通义 QwenAudio:原创语音项目62

    FunAudioLLM 发布 Fun-CosyVoice 3.0 开源语音合成模型

    通义 FunAudioLLM 团队开源基于 LLM 的 TTS 系统 Fun-CosyVoice 3.0,官方称在内容一致性、说话人相似度和韵律自然度上超越前代 CosyVoice 2.0,面向零样本多语言语音合成。

    推荐理由:官方发布开源 TTS 新版本,附评测表、安装与部署方式,适合关注多语言语音合成落地的开发者参考。

  2. 通义 QwenAudio:原创语音项目61

    SenseVoice 开源语音理解模型仓库:支持 ASR、情感识别与音频事件检测

    SenseVoice 是一个语音理解基础模型,支持 ASR、语种识别、语音情感识别和音频事件检测。发布的 SenseVoiceSmall 检查点支持普通话、粤语、英语、日语和韩语,并输出情感与事件标签;采用非自回归端到端架构,同参数量级下推理速度比 Whisper-Small 快 5 倍以上、比 Whisper-Large 快 15 倍以上。

    推荐理由:官方仓库文档同时给出基准对比、部署路径和微调方案,读者可以据此评估 SenseVoice 在中英文语音识别场景的可用性。