TwKit

GPT、Claude与Gemini模型能力及订阅体验比较

AI科技 · 17 篇公开推文 · 15 位作者 · 曝光 378078 · 评论 784 · 点赞 1825 · 书签 497

多条推文比较不同AI模型的推理、编程、生图及速度体验,也讨论订阅限制、模型降智和路由问题;另有GPT-6与Gemini新版本的发布传闻。

创作角度

  • 比较GPT-6、Claude Opus和Gemini等模型的能力与速度体验
  • 讨论订阅降智、路由和额度重置对实际使用的影响
  • 分析不同模型在编程、推理和生图任务上的适用场景
  • 追踪OpenAI新模型传闻与竞品发布节奏

相关公开推文

@Zhibin992

OpenAI 即将发布 GPT-6 Bel。 Bel 是一个猛兽般的模型,将碾压 Fable 5.5 Codex 将再次迎来 Astra 那样的时刻,所有人都会觉得 OpenAI 回来了。 一两周后,Anthropic 将推出 Sonnet 或 Opus 6。 然后我们将回到当前的循环:Claude 碾压所有人。

曝光 47882 · 评论 65 · 点赞 271 · 书签 49

查看原帖
@RealYDT

OpenAI 憋着要端出来的 GPT-6 Bel,剧本其实早就被行业看客猜得一清二楚了。 按现在的放风节奏,Bel 一出场大概率会拿着精心挑选的跑分把 Fable 5.5 按在地上,Codex 再顺势配合演一出类似当年 Astra 的惊艳演示,时间线上立刻又会铺天盖地刷屏“OpenAI 王者归来”。 结果顶多撑不过两周,隔壁 Anthropic 就会面无表情地把 Sonnet 6 或者 Opus 6 往线上一推,反手把全场重新干破防。 这种过山车式的戏码之所以能无限循环,是因为两家的生存机制完全长在两个极端。 OpenAI 现在背着沉重的估值包袱和退订焦虑,极度依赖高频的脉冲式发布来给市场打强心针。每当算力挤兑和企业客户流失的舆论压不住了,他们就必须从实验室里抢跑出一个定制的极限快照,用高度控评的 Demo 在社交媒体上制造一场视觉狂欢,把“我还领先”的叙事强行续费半个月。 而 Anthropic 根本不陪你玩这种公关特技。人家算力储备扎在物理电网和工业级机房里,每次都冷眼看着你在聚光灯下把营销弹药打光,然后再用不可动摇的吞吐稳定性、低延迟和纯粹的工程交付,把战线重新推回自己的统治区。 大模型的竞速早就从早期的学术秀场,演变成了重工业流水线的产能消耗战。 当一家公司需要不断靠发布会上的短暂高光来证明自己还没掉队,这场拉锯战的终局其实就已经没有悬念了。

曝光 46056 · 评论 44 · 点赞 114 · 书签 25

查看原帖
@dingyi

GPT sol 6.1 现在不仅慢,还特别智障,前端审美也不行。你一天 reset 一万次又有什么意义呢???

曝光 44853 · 评论 93 · 点赞 255 · 书签 10

查看原帖
@xluchuan

最新 Gemini 4 Argon 测试成绩出炉 彻底碾压 Claude Opus 5.5 和 GPT 6 Astra 这简直是降维打击!

曝光 38955 · 评论 60 · 点赞 202 · 书签 8

查看原帖
@YxzRainy

ChatGPT 订阅终于到期了😱 没有 AI 订阅的我如同离开了水的🐟😱 十月份,我的钱包该投向谁?? Claude(赌狗) ChatGPT(老牛拉破车) Grok/Cursor(没用过) Gemini(北美豆包)

曝光 31862 · 评论 103 · 点赞 68 · 书签 7

查看原帖
@Ion_Mio_

我的朋友是 Codex 重度用户,Astra刚出时每天都和我夸它有多强,后来自己的号降智到几乎没法用,只能去用“不降智中转站”,最后Opus 5.5出来,彻底跑路 中转站降智不会停手,他们有手段研究“不降智”,真实用户想用原始能力的模型,甚至智能去用中转站,最后再被推向竞品 问题已经不是额度,是信任。

曝光 31312 · 评论 45 · 点赞 203 · 书签 10

查看原帖
@aiZttt__

手机爆内存了,只能留一个。 ChatGPT vs Claude 留哪个?

曝光 25014 · 评论 59 · 点赞 21 · 书签 3

查看原帖
@aiZttt__

同一组提示词 GPT 6 Astra vs Opus 5.5 荒漠白骨 → 猛虎 → 悬崖一跃 → 鹰掠海面 → 水下鲨鱼。 五个场景,逐帧对比 👇

曝光 21693 · 评论 20 · 点赞 19 · 书签 10

查看原帖
@fly3nn

我想了一天没想明白 为什么ai的思考过程都是英文? claude、gpt、gemini是英文我能理解 但deepseek也是英文思考,我就不理解了。。。 难道是因为我用的是workbuddy国际端的ds?

曝光 20135 · 评论 44 · 点赞 31 · 书签 3

查看原帖
@yiren_ai

亲测,现在订阅 ChatGPT 500 刀会员,有两大福利: 1. GPT 6.1 sol 配合 ultrafast 模式,是真的快,几十秒完成功能开发你敢想,完全是实时聊天的速度。后面估计订阅的人多了后,速度也会降下来。 而且 6.1 sol 相比 Astra 消耗也少非常非常多。 2. 最近 ChatGPT 重置次数多,很多人额度来不及用完,配合 ultrafast 模式,羊毛薅满。

曝光 20131 · 评论 44 · 点赞 48 · 书签 11

查看原帖
@MinLiBuilds

😲 这TM是PPT?闭上眼睛感受一下。 当年有这个效果,我上台讲PPT就嘎嘎乱杀了啊。 我们来测试PPT里的Opus5.5做鹈鹕骑车。 效果真好啊~ 这种视频动画,后面就随便做了。 可以研究一下能不能写代码。

曝光 18703 · 评论 28 · 点赞 18 · 书签 14

查看原帖
@ThirteenYizuka

GPT-6 Astra 确实是个很聪明的模型,但我觉得它的聪明主要体现在推理和逻辑思考能力上。简单来说,就是特别适合做数学题。 这种能力放到编程上也很明显。你让它实现一个复杂功能,它往往能把逻辑理得很清楚,最后也确实能做出来,很少犯低级错误。 但我一直觉得它在软件工程方面差点意思。 比如相邻代码都抽了常量,它偏偏写死;有的地方应该抽个方法,它直接把逻辑内嵌进去;有的地方明明不需要额外封装,它又多加一层。架构设计上偶尔也有类似的问题。 代码基本都能跑,逻辑也没什么问题,但实现方式不一定合理,尤其是放到一个长期维护的项目里。 最近尝试在 Codex 里加了两个 Skill: Code Complete:负责具体编码规范 A Philosophy of Software Design:负责抽象和架构设计 通过 AGENTS.md 让它在动手写代码之前就参考这些原则。 感觉 Astra 并不是没有能力写出优雅的代码,而是它有时候根本没意识到自己应该关注这些东西。给它补上这方面的指导,可能比单纯提高模型的推理能力更有用。 https://github.com/ciembor/agent-rules-books

曝光 13695 · 评论 19 · 点赞 118 · 书签 136

查看原帖
@DeepBlueX0

GPT对话模式和工作模式文生图,差别也太大了吧? 对话模式:尺度可更大,但容易继承前图,人物动作、机位、构图和场景反复固化。 工作模式:尺度更保守,但随机抽卡更稳定,人物动作、场景和构图几乎重复。 👇具体看结果吧,具体哪个模式不用我说了吧? 🔵 GPT image 2.5 Prompt: 韩系轻熟辣妹 × 蕾丝叠穿 × 轻运动休闲 × iPhone 失败照片 9:16 竖版,成年东亚女性,韩系网红气质,冷白肤色。 风格 DNA: 韩系轻熟辣妹风,融合蕾丝叠穿、轻运动休闲与少量芭蕾风元素。整体精致、松弛、自然,兼具女性化魅力与日常穿搭感。 穿搭方向: 以柔和色彩、细腻蕾丝、柔软针织、轻薄面料与自然层次为视觉基础。款式、色彩、面料与配饰随机组合。 场景与摄影: 随机场景,随机试验镜头,随机非正常构图 n=4:连续独立生成4张,每次生成1张完整图,单张输出,严禁拼图、多宫格或分屏。

曝光 13003 · 评论 9 · 点赞 219 · 书签 161

查看原帖
@xingbugengming

Codex又又又重置了!! 为什么现在都在吹 Claude 踩 Codex 啊?Codex根本不差的,如果嫌 Codex 差找找自己原因 你现在看到的所有游戏内容全部是由 Codex Astra +Unreal 5.8 制作,包括玩法设计、游戏素材(找的现成美术素材包) 放在十年前 SEGA 的制作水平跟这也差不多了吧?

曝光 11491 · 评论 40 · 点赞 44 · 书签 28

查看原帖
@YxzRainy

突发!😱 谷歌在一项基准测试中实现绝对统治! Gemini 4 Argon 断层第一! 其他几家加起来都不够谷歌打的😱

曝光 11258 · 评论 56 · 点赞 79 · 书签 7

查看原帖
@goan999999

逆天!Gemini 越狱成功了 ⚠️这是美惠三女神艺术,别幻想 生图还是Gemini,别的都靠边站,提示词放下边

曝光 10467 · 评论 18 · 点赞 27 · 书签 10

查看原帖
@yifanxu_ephai

一早起来看到群里炸锅了。一位老师遇到gpt模型降智,升级至$500 plan,依旧智能路由到Luna。群友建议静置 48h👽👽👽,简直清了个活爹。 OpenAI过去一个月真的恶心到了我。 Astra发布三天之后,没一天智力正常。 6.0版本也是又贵又烂。 6.1 sol,发布三天后也降智了,除了便宜,一无是处。

曝光 9249 · 评论 37 · 点赞 88 · 书签 5

查看原帖
TwKit
正在载入