资讯
刚刚,DeepSeek新模型内测!网友实测:快得飞起!
📋总体概括
9月8日,DeepSeek宣布V4.1 Flash中间版本开启内测,采用全新模型结构,原生支持多模态,官方称能力更强、速度更快、成本更低。开发者无需更改base_url,只需将模型名设为deepseek-v4.1-flash-expires-on-0910即可调用,计费与V4 Flash相同,每账号限流20并发,内测版本将于9月10日自动过期下线。社交平台已有开发者实测,最高输出速度达507 tokens/s,反映其在推理速度上的显著提升,此次内测被视作V4.1正式版发布前的重要信号。
⚡关键信息
- ▸9月8日DeepSeek开启V4.1 Flash中间版本内测,采用新模型结构并原生支持多模态
- ▸调用方式为改模型名即可,每账号限流20并发,内测版9月10日自动过期下线
- ▸计费与V4 Flash相同:空闲时段缓存命中输入0.05元/百万tokens,输出4.5元
- ▸开发者实测最高输出速度达507 tokens/s,速度提升明显
🔥犀利点评
短窗口限流内测、自动过期,这套打法 DeepSeek 玩得很熟练——用极低门槛换真实负载测稳定性,同时提前给市场打预防针。507 tokens/s 的实测速度如果稳定,对推理成本敏感的应用层是实打实的利好。但「能力更强」目前只有官方口径,多模态究竟到什么水平、和头部对手差几个身位,还得等正式版跑分说话,别急着封神。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 华尔街见闻 阅读全文 →