灰度测试悄然开启
想象你打开DeepSeek的对话窗口,输入一道复杂的推理题,AI没有直接给出答案,而是开始用"I'm thinking..."这样的第一人称口吻来展开完整的思考过程。这个看似不起眼的措辞变化,恰恰是判断你是否拿到了V4满血版灰度测试资格的关键信号,消息一出便在开发者圈子中引发了广泛的关注和积极的尝试。
DeepSeek V4的灰度测试已经面向部分受邀用户悄然展开,最有趣的鉴别方式藏在思维链的细节里。拥有测试权限的版本会使用"I'm"或"I'll"作为推理起点,普通版本则倾向于用"Let me"句式来展开思考。这个微妙的差异成了开发者们互相验证资格的一个有趣指标,不少人专门设计推理题目来试探自己的模型是否中选。
双版本战略与性能表现
正式版将推出两个差异化版本:DeepSeek V4 Flash和DeepSeek V4 Pro。Flash版主打轻量高效,适合日常高频调用和成本敏感的使用场景;Pro版则追求极致性能,面向专业级应用和企业级部署需求。两者在架构设计和推理策略上各有侧重,覆盖了不同层次的使用体验,满足从个人开发者到大型企业的多样化需求。
首轮内部测试成绩相当亮眼,V4整体表现已逼近Opus 4.8的水平,编码能力直追GPT-5.6 Sol,Agent能力相比前代更是有了质的飞跃。不过在部分复杂推理任务上,V4的迭代轮数比Fable 5略多一些。绝对性能层面,V4可能稍逊于Kimi K3,但它的定价策略堪称激进,试图用巨大的价格优势在竞争激烈的市场中找到自己的位置。
峰谷计费与极致性价比
本次发布最引人注目的创新是峰谷计费机制的引入,这在AI大模型行业中尚属首次。Pro版百万token输出,平时价格仅为0.87美元,高峰时段翻倍至1.74美元。Flash版更是低至0.28美元的平时价,高峰时段也只有0.56美元。如果命中缓存,价格还能进一步大幅下降,对高频调用的开发者来说极具吸引力。
对比来看,Fable 5的百万token输出定价高达50美元,V4的价格仅为它的几十分之一。在保持接近旗舰模型性能的前提下,V4无疑是当前市场上综合性价比最优的选择之一。峰谷计费机制让用户可以根据自己的使用时段来灵活调配成本,从长远来看,这种创新的定价模式很可能引领AI行业收费方式的下一次重大变革。
*来源:36氪*