“强大”与“靠谱”之间的抉择
Anthropic于4月16日发布Claude Opus 4.7(详见今日首条推送),编程基准测试SWE-bench Pro得分从53.4%跃升至64.3%, 编程能力单代暴涨11%, 超越GPT-5.4和Gemini 3.1 Pro。更值得关注的是它的“靠谱”特质:遇到用户错误方案敢于反驳,遇到缺失信息直接报错而非编造答案。Anthropic表示,更强的Mythos Preview仍在内测中,Opus 4.7并非其最强模型。
“问答式”向“对话式”的关键跨越
字节跳动于4月发布Seeduplex全双工语音大模型,实现行业首个规模化落地的“边听边说”能力。该技术标志着语音AI从“问答式”向“对话式”的关键跨越,可实现真正的实时语音交互,让AI对话更像人与人的交流。
本文内容由AI提供辅助,由人类(饭罢)逐一编写并核实,不然AI会骗我~
