linvscode
V2EX  ›  问与答

ds 视觉模型来了

  •  
  •   linvscode · 7h 50m ago · 735 views

    https://mp.weixin.qq.com/s/UGMfvPMwBIB4oFYZZejekA

    在纯文本能力( Agent 、推理、世界知识等)方面,DeepSeek-V4-Flash-Vision-Exp 与 DeepSeek-V4-Flash 正式版持平

    在需要视觉理解的 Agent Benchmark 上,DeepSeek-V4-Flash-Vision-Exp 相比 DeepSeek-V4-Flash 实现了大幅跃升,多模态 Agent 能力已接近 Opus-4.8 。

    在 API 服务中,图片会转换成 token 后按 token 计费,一张图片最多占 384 tokens ,计费价格与 V4-Flash 模型一致。

    6 replies    2026-08-21 21:51:25 +08:00
    volvo007
        1
    volvo007  
       6h 49m ago via iPhone
    啊?!等大佬们评测了
    PrinceofInj
        2
    PrinceofInj  
       6h 28m ago via Android
    那是不是可以把输入的文字截图发给他会省一些 Token 🐶
    mqnu00
        3
    mqnu00  
       5h 43m ago
    @PrinceofInj 天才!
    wangxiaoer
        4
    wangxiaoer  
       5h 40m ago
    @PrinceofInj #2 真特么天才啊
    passive
        5
    passive  
       5h 24m ago via Android
    @PrinceofInj #2

    还是发二维码吧🐶
    linvscode
        6
    linvscode  
    OP
       3h 35m ago
    @PrinceofInj 天才!
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Solana   ·   1329 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 36ms · UTC 17:27 · PVG 01:27 · LAX 10:27 · JFK 13:27
    ♥ Do have faith in what you're doing.