资讯

刚刚,DeepSeek新模型内测!网友实测:快得飞起!

华尔街见闻·2026/9/8 09:18:01🔗 原文

📋总体概括

9月8日,DeepSeek宣布V4.1 Flash中间版本开启内测,采用全新模型结构,原生支持多模态,官方称能力更强、速度更快、成本更低。开发者无需更改base_url,只需将模型名设为deepseek-v4.1-flash-expires-on-0910即可调用,计费与V4 Flash相同,每账号限流20并发,内测版本将于9月10日自动过期下线。社交平台已有开发者实测,最高输出速度达507 tokens/s,反映其在推理速度上的显著提升,此次内测被视作V4.1正式版发布前的重要信号。

关键信息

  • 9月8日DeepSeek开启V4.1 Flash中间版本内测,采用新模型结构并原生支持多模态
  • 调用方式为改模型名即可,每账号限流20并发,内测版9月10日自动过期下线
  • 计费与V4 Flash相同:空闲时段缓存命中输入0.05元/百万tokens,输出4.5元
  • 开发者实测最高输出速度达507 tokens/s,速度提升明显

🔥犀利点评

短窗口限流内测、自动过期,这套打法 DeepSeek 玩得很熟练——用极低门槛换真实负载测稳定性,同时提前给市场打预防针。507 tokens/s 的实测速度如果稳定,对推理成本敏感的应用层是实打实的利好。但「能力更强」目前只有官方口径,多模态究竟到什么水平、和头部对手差几个身位,还得等正式版跑分说话,别急着封神。

本文由本站自动聚合,以下为原始来源:前往 华尔街见闻 阅读全文