谷歌跌跌不休: 发布 3.6 flash, 3.5 lite, 就是不发 3.5 pro, 你怎么看?
先说我的判断, 谷歌一定会做自己的模型, 原因之前分析过, 《德说-第523期, 谷歌还要不要拼命做Gemini? 阿里云还要不要死磕Qwen?》
核心原因有几个:
其实谷歌和其他云厂商一样, 它们必须要有自己的大模型, 但自己大模型都不需要遥遥领先, 就像跑马拉松一样, 在第一梯队的末流不掉队就可以, 因为
1、模型利润比卖算力利润高
2、有自己的模型, 才有机会做用户黏性更高的流量入口: Agent
3、自家芯片外销背书、外采芯片议价权
使用自己设计的 TPU 训练自己的模型、跑模型推理, 并且模型在第一梯队、有足够的使用规模, 你在卖自己的TPU时才能给TPU背书, 有议价权.
另一方面是采购英伟达的议价权, 有TPU留个后手.
4、资本开支规划可控
如果没有自己的模型, 但是又希望绑定大量模型厂商客户, 资本开支根本不可控, 因为这类头部客户一个没伺候好的话, 要么就是导致大量算力闲置、要么就是算力建设赶不上客户的需求.
有自己的模型, 当头部客户跑路时, 自己的模型就盯上兜底, 也能知道各种级别的模型到底需要投入多少算力用来训练, 根据用户的规模判断多少算力需求用来推理.
另外, 谷歌没有这么不堪, 除了 claude、codex , 我几乎没有用过其他 coding agent, 现在则以 claude + 第三方模型为主.
但, 其实谷歌也有 coding Agent: Antigravity, 其实蛮好用的, 不知道为什么没有火起来, 我怀疑和它的名字有关, 确实太复杂了, 还好安装后命令名是 agy.
在 antigravity 中试用了一下 3.6 flash, 除了速度快, 另一个意外的是, 居然还能白嫖 Claude opus 4.6 (上上代旗舰)
安装
curl -fsSL https://antigravity.google/cli/install.sh | bash
使用
agy
第一次启动时要用谷歌账号进行认证, 会打开默认浏览器, 然后你需要使用谷歌账号认证, 生成一串 KEY 输入到 agy 客户端里, 输入后会将认证信息保留到本地.
如果你未来想切换账号, 进入 agy 后 /logout 登出后即可重新登陆其他账号.
再来说说白嫖的事.
模型的 quota 是按分组来的, reset 周期有点长(claude 4.6 用几下就没了, 7 天重置), 整个账号的 quota 用完了就切换账号.
白嫖是麻烦点, 但只要思想不滑坡, 办法总比困难多.
/model
Switch Model
> Gemini 3.6 Flash (current)
Gemini 3.5 Flash
Gemini 3.1 Pro
Claude Sonnet 4.6 (Thinking)
Claude Opus 4.6 (Thinking)
GPT-OSS 120B (Medium)
Effort ◂ ●━━━━━━━━━━━━━━●━━━━━━━━━━━━━━◉ ▸
low medium high
Deepest reasoning for complex problems — slower but strongest
/usage
└ Models & Quota
Account: xxx@gmail.com
GEMINI MODELS
Models within this group: Gemini Flash, Gemini Pro
Weekly Limit
[████████████████████████░░░░░░░░░░░░░░░░░░░░░░░░░░] 48.35%
48% remaining · Refreshes in 166h 0m
CLAUDE AND GPT MODELS
Models within this group: Claude Opus, Claude Sonnet, GPT-OSS
Weekly Limit
[░░░░░░░░░░░░░░░░░░░░░░░░░░░░░░░░░░░░░░░░░░░░░░░░░░] 0.00%
Refreshes in 166h 6m
│Within each group, models share a weekly limit. Quota is consumed
│proportionally to the cost of the tokens. Thus, limits will last longer with
│shorter tasks or using more cost-effective models. Your weekly limit is tied
│directly to your individual tier.
说说 agy 的体感, 其实和用 claude 差不多, 设计理念、概念也非常类似, 用过 claude 后使用 agy 没有任何门槛.
再说说 Gemini 3.6 Flash 模型的体感, 我只能说很棒.
我测的是基于原始文档创建视频播客的任务流, 对比了 minimax m3.
minimax m3 速度和 Google 3.6 flash 没法比, m3 就像拖拉机, 3.6 flash 就像法拉利.
还得是谷歌, 自研的 TPU 效率高, 不仅自己 gemini 用, 还能腾出来卖给 anthropic claude 用. (当然了, 效率和硬件性能、参数量、硬件负载都有关系, 但软硬都是自己的, 大概率效率是更高的.)
这让我非常看好阿里的 Qwen + 真武 自研模型+自研TPU组合的潜力, 股票继续持有. 打工缘尽于此, 那咱就当个股东吧!
你怎么看?