# 最近模型更新体验分享: Grok 4.5、Claude Fable、GPT-5.6 初体验

7 月 10 日
 bigbigegg123

最近模型更新体验分享:Grok 4.5 、Claude Fable 、GPT-5.6 初体验

这几天更新的模型比较多,我来分享一下自己实际使用后的体验,也欢迎大家一起讨论关于 Ai WorkFlow 的设计开发

使用背景

我的主要使用场景:

以下内容全部基于个人实际工作流体验,不是跑分测试。


总结

先说结论:

这次体验之后,我自己的工作流也发生了一些变化。

之前:

现在:


1. Claude 旗舰模型

模型

Fable 5 High

渠道

使用体验

价格大概是 Opus 的 2 ~ 3 倍。

但是实际使用下来,我没有感觉到它相比满血版本的 Opus 4.6 有非常明显的提升。

它确实会聪明一些,推理能力也有所增强。

但是最近这段时间,Opus 本身的实际表现下降比较明显,所以 Fable 带来的提升,有一部分可能来自对比基准下降。

如果和几个月之前状态最好的满血 Opus 4.6 比较,我没有感觉到特别明显的代际差距。


最大的问题:安全限制影响工作流

目前最大的问题,是 Cyber 相关限制出现频率非常高。

例如:

这些正常运维场景,也可能触发安全阻断。

模型会判断这些行为可能涉及网络攻击,然后停止继续执行。

这对于实际开发和运维场景影响比较大。

个人感觉 Claude 目前在安全策略方面收得比较紧,导致一些正常用户场景体验下降。


2. Grok 4.5

模型

Grok 4.5 (High)

渠道

Super Grok 套餐


使用体验

这个模型真的让我感觉非常惊艳。

整体体验非常接近高阶模型的满血状态。

它给我的感觉:

在复杂任务规划方面表现很好。

例如:

我测试让它分析 TikTok APP 的逆向方向,包括登录协议相关内容。

它给出的:

整体方向判断非常准确。


Grok 最大优势:生产力导向

相比部分模型,Grok 给我的感觉更加偏向:

先帮助用户把事情推进起来。

而不是:

先判断这个事情是否存在风险,然后停止执行。

对于开发、研究、排查问题,这种差异非常重要。


3. GPT-5.6 Sol

模型

GPT-5.6 Sol Medium

渠道

Pro 20 套餐


使用体验

之前 GPT-5.5 给我的体验其实很好。但是最近一段时间,5.5 的实际表现下降比较明显,一些任务中可以明显感觉到能力下降。(由于 GPT-5.6 凌晨才用上。只是初步体验,还没有进行大量深入测试。)

和之前状态比较好的 GPT-5.5 相比:

目前没有感受到特别明显的提升。

不过有一点比较明显:

GPT-5.6 现在也出现了更多 Cyber 相关限制。

在一些正常开发、安全研究、系统分析场景中,会影响连续工作流。


综合评价

这次模型更新里面,我个人感觉:

Grok 4.5

目前提升最明显。

已经正式加入我的工作流:


另外推荐一个 Grok 使用方式

Grok 做搜索和信息整理,非常强。

尤其是结合 MCP:

Grok MCP:

实际体验下来:

它收集 X ( Twitter )上的真实用户反馈、讨论趋势,非常好用。

相比传统 Web Search 好很多


以上只是个人实际使用体验,不代表跑分成绩。

欢迎大家分享自己的测试结果。

4923 次点击
所在节点    🤖Vibe Coding
34 条回复
win8en
7 月 10 日
grok 有类似 Codex 和 antigravity 之类的产品么?
bigbigegg123
7 月 10 日
@win8en 有啊,他自己的 grok 客户端,cli 的。 还有就是,antigravity 和 Codex 不一样吧,一个是模型 agent , 一个是图形化开发类似 cursor
MoLin2012
7 月 10 日
GPT-5.6 Sol Medium 不太行吧,至少换 high 或 xhigh 试试?
diudiuu
7 月 10 日
@win8en 直接用 cursor ,他俩现在同一个老板了。
gap
7 月 10 日
你这样一说我有点想把 chatgpt 订阅换成 grok 了,当然主力还是 claude
dododook
7 月 10 日
grok 有 IDE 么...
sunny352787
7 月 10 日
哥们儿你应该是被中转站坑了,用的并不是 Fable5 。就我的体验来说,Fable5 断崖领先 Opus4.8 、GPT5.5 等模型
Blackricky
7 月 10 日
疑难杂症还是得 Fable 5 ,grok4.5 跑很多轮都解决不了
calvinHxx
7 月 10 日
GPT-5.6 Sol Medium 肯定不明显啊 起码 xhigh 最好 ultra
CodeY99
7 月 10 日
@bigbigegg123 哥,你这个光订阅费一个月都得快 500 刀了。
另外确认一下,xai 官网写的好像 30$ 不支持 grok build cli 必须要用 heavy ,是真的吗?
https://x.ai/pricing
xidaduo
7 月 10 日
Grok 4.5 很强,智商不怎么输,但是很快。用完 Grok 4.5 的速度再回到 Claude 和 Codex 已经不习惯了
w3625930
7 月 10 日
@CodeY99 支持的 supergrok 已经用 2 个月的 cli 了
bigbigegg123
7 月 10 日
@CodeY99 没,我用的 super 就可以。super 买折扣号,可便宜了。 几十块钱一个 super 账号
thrinity
7 月 10 日
我使用 cursor ,体验了 grok 4.5 fast,同样的问题 grok4.5 跑很多轮都解决不了,但是 4.6 max 能解决,感受上还是存在差距。好的一面是比 composer 要稳定,composer 执行长任务经常出现思考一半就开始糊弄,grok 4.5 这方面还是会老老实实去做完。
bigbigegg123
7 月 10 日
@sunny352787 没,我自己也有 max , 我两种都用了。我自己¥用的这种中转站没降智,还行的。用了好久的。
win8en
7 月 10 日
@bigbigegg123 antigravity 现在三个版本,一个 antigravity cli ,一个 antigravity IDE ,一个 antigravity app ,类似 Codex ,😅
win8en
7 月 10 日
@diudiuu 明白,我试试
bigbigegg123
7 月 10 日
@win8en 这个第一次知道,哈哈哈哈哈哈,可以可以。
bigbigegg123
7 月 10 日
@xidaduo 是的,codex 如果遇到思考的问题, 走了 high 或者 xhigh , 一点点事情都是半个小时起步。
xing7673
7 月 10 日
可以,成功吸引我了今晚就买个 supergrok 或者 x premium 试试看

这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。

https://v2ex.ih06.com/t/1226389

V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。

V2EX is a community of developers, designers and creative people.

© 2021 V2EX