首页
学习
活动
专区
圈层
工具
发布

#glm

智谱发布 GLM-5.3-FlashX:速度提到 200 tokens/s

德顺

前段时间写过不少关于大模型的文章,先是 Cline 官宣 DeepSeek V4-Flash 免费用了,接着 匿名模型 Ox Alpha 被智谱认领为 GLM-...

34320

智谱 GLM 复盘推理基建:AI 干不动活,卡在反馈不可归因

海风自语

我第一遍读 GLM 那篇推理基建复盘,注意力全在数字上:十万张以上的国产加速器、从跑通到生产不到两周、端到端吞吐三倍。

10210

GLM涨到118元、Kimi贵4倍:国产AI到底还能买谁

用户12724357

7月31日,智谱把GLM Coding Plan价格翻了一倍多。Lite档从49元涨到118元,Pro从149涨到538,Max从469直接破千。Kimi K3...

38710

Next.js 之父和我都被震惊了:GLM-5.2 编程能力到底有多强?

用户12724357

"Genuinely impressed, almost shocked, at how good GLM-5.2 by @Zai_org is at codi...

14010

一行参数治好「龟速」:GLM-5.3-Flash 内部服务慢的排查与解决实录

高老师

最近我们把内部办公助手(问答、文档摘要、工单分类等场景)切换到了智谱新发布的 GLM-5.3-Flash。

76710

混元 Hy4 preview 与 GLM-5.3-Flash、Kimi K3、DeepSeek-V4-Pro 怎么选:一份给开发者的对比清单

hollyx

摘要 2026 年 8 月 28 日,腾讯混元发布并开源 Hy4 preview,总参数 770B、激活参数 49B、上下文长度达到 1M,采用 Apache ...

2.1K10

爆火的《牛来》模型正式发布!DeepSeek 的排名又下降了。。

程序员鱼皮

前几天,海外 AI 平台 OpenRouter 和 OpenCode 上突然冒出了一个没有任何背景介绍的匿名模型 Ox-Alpha,俗称「牛来」模型。

33410

把 GLM-5.3 接入到 DeepSeek Harness,夯爆了!

程序员鱼皮

最近 AI 圈儿真是过年了,前脚 DeepSeek V4 Pro 正式版和 DeepSeek Harness 同时发布,后脚智谱就放出了全新的 GLM-5.3 ...

35200

纯 .NET 手写 CUDA kernel,GLM-5.3-Flash decode 跑出 llama.cpp 的 2 倍

张善友

如果你所在的团队是 .NET 技术栈,又想把大模型推理收进自己的进程里,这篇文章值得你花五分钟。

60110

智谱官宣发布 GLM-5.3-Flash,Cline 继续免费用

德顺

国内走智谱开放平台 bigmodel.cn,国际版走 z.ai,模型 ID 都是 glm-5.3-flash,标准 OpenAI 兼容格式,支持图片 URL 和...

2.8K110

腾讯 Copilot 通道 GLM-5.3 缓存间歇性不命中· 技术调查日志

叫我小七总

我们的场景:三个模型(DeepSeek V4 Flash、V4 Pro、GLM-5.3)都走腾讯 Copilot 官方 API 通道,日常写代码。某天查账发现 ...

24010

TensorSharp 最新进展研究报告:从 DeepSeek V4 Flash 到 GLM-5.2,以及等待中的 GLM-5.3

张善友

截至 2026 年 8 月 20 日,纯 .NET 推理引擎 TensorSharp(作者 Zhongkai Fu)于 2026 年 8 月 19 日合并 PR...

1K10

安全卫士卸载提示“已损坏”?用 Claude Code 一行提示词完美清理顽固残留

高老师

相信很多 Windows 用户都经历过这样的绝望时刻:360安全卫士明明很久以前就卸载了,但在 Windows 11 的“程序和功能”里依然阴魂不散。当你试图点...

36110
领券