hzwer

开源语音大模型 Step-Audio 2 mini

  •  
  •   hzwer · Sep 1, 2025 · 1829 views
    This topic created in 275 days ago, the information mentioned may be changed or developed.

    大家好,我们上了一个开源端到端语音大模型 Step-Audio 2 mini ,该模型在多个国际基准测试集上取得最佳成绩。

    它将语音理解、音频推理与生成统一建模,在音频理解、语音识别、跨语种翻译、情感与副语言解析、语音对话等任务中表现突出,并率先支持语音原生的 Tool Calling 能力,可实现联网搜索等操作。

    GitHub: https://github.com/stepfun-ai/Step-Audio2

    Hugging Face: https://huggingface.co/stepfun-ai/Step-Audio-2-mini

    4 replies    2025-09-05 16:50:06 +08:00
    bigtear
        1
    bigtear  
       Sep 1, 2025
    开放权重就是好模型,顶🆙
    byc4i
        2
    byc4i  
       Sep 1, 2025
    能贴一下微信吗?微信群超 200 了不能扫码
    closedevice
        3
    closedevice  
       Sep 5, 2025
    赞,晚点就研究下,有相关论文么?
    hzwer
        4
    hzwer  
    OP
       Sep 5, 2025
    @closedevice 嗯,主页有 arxiv
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Solana   ·   1281 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 34ms · UTC 17:28 · PVG 01:28 · LAX 10:28 · JFK 13:28
    ♥ Do have faith in what you're doing.