大事儿太多,重要性分不出先后啦~
DeepSeek-V4预览版正式上线,百万上下文开源普惠
4月24日,DeepSeek全新系列模型DeepSeek-V4预览版正式上线并同步开源。该系列突破性地支持100万字超长上下文,在Agent协同能力、世界知识和推理性能上均达到国内与开源领域的领先水平。API服务已同步更新,通过修改model_name为deepseek-v4-pro或deepseek-v4-flash即可调用。
DeepSeek-V4首次优先适配华为昇腾,国产AI"去英伟达化"里程碑落地
4月24日,DeepSeek-V4预览版发布当日,华为昇腾宣布与DeepSeek完成深度芯模协同适配,实现昇腾超节点全系列产品对V4-Pro与V4-Flash双版本的支持。其中,昇腾950通过融合kernel与多流并行技术,单卡算力达海外顶级芯片H20的2.87倍,推理速度较前代提升35倍,Flash版推理时延低至10毫秒。
值得注意的是,与历次版本优先适配英伟达不同,DeepSeek-V4此次将华为昇腾、寒武纪思元等国产芯片列为第一梯队进行深度优化。这也是全球首个完全不依赖英伟达硬件栈的前沿大模型发布,标志着中国AI产业在推进"去CUDA化"进程中迈出关键一步。机构预测,2026年将为国产超节点放量元年。
DeepSeek首次对外融资,估值瞄准百亿美元
一直拒绝外部资本的DeepSeek被曝正在寻求首轮外部融资。4月17日,据The Information援引多位知情人士消息,DeepSeek计划募集至少3亿美元,目标估值超过100亿美元。此举标志着DeepSeek从"实验室项目"向"商业公司"的转型。值得注意的是,部分报道称估值已从初始的100亿美元攀升至200亿美元以上,具体数字尚存不确定性。
GPT-Image-2发布:首个具备"思考"推理能力的图像模型
OpenAI于4月21日发布GPT-Image-2,成为全球首个具备"思考"推理能力的图像生成模型。在大模型竞技场(AI Arena)评测榜单中,GPT-Image-2在文生图任务中登顶第一。
Claude Opus 4.7编程能力显著提升
Anthropic于4月16日发布Claude Opus 4.7,主打高端软件开发能力。相比前代 Opus 4.6,该版本在高难度软件工程任务上提升显著,高分辨率图像处理能力提升至此前3倍,上下文窗口维持100万token,API定价保持不变。据官方介绍,其在真实漏洞修复等编程基准测试中表现领先。
智谱GLM-5.1跻身开源代码能力第一梯队
智谱AI于4月8日发布GLM-5.1,成为首个在复杂工程任务中超越Claude Opus 4.6的国产开源模型。SWE-Bench Pro得分达58.4%,超越Claude Opus 4.6,一度在全球开源模型中排名第一(但4月17号发布的Claude Opus 4.7又反超回来了,AI界进步太快了,担心工程师们的心脏)。该模型支持单次任务持续自主工作超过8小时,在完成长程任务方面提升尤为显著。
Kimi K2.6发布:从"单兵作战"转向"AI操作系统"
月之暗面于4月20日发布并开源Kimi K2.6,核心定位从"单兵作战"转向"AI操作系统"。在多项权威基准测试中表现亮眼,代码模型多项能力持平或超越GPT-5.4、Claude Opus 4.6等国际顶尖闭源模型。目前已上线Kimi官网、应用、API及Kimi Code编程助手。