中级农民
- 积分
- 151
- 大米
- 颗
- 鳄梨
- 个
- 水井
- 尺
- 蓝莓
- 颗
- 萝卜
- 根
- 小米
- 粒
- 学分
- 个
- 注册时间
- 2026-4-19
- 最后登录
- 1970-1-1
|
注册一亩三分地论坛,查看更多干货!
您需要 登录 才可以下载或查看附件。没有帐号?注册账号 
x
https://www.wsj.com/tech/ai/openais-second-quarter-sales-show-tepid-growth-compared-with-anthropic-5cb42998
第二季度Anthropic和Open AI都给投资人亮了财报。Anthropic 11.6 Billion,Open AI 6.7 Billion。Anthropic的ARR达到了65 Billion, Open AI是40 Billion。只论大模型收入,Anthropic比全球所有其他大模型收入加起来还要多, 大概率打破Space X的IPO记录。而Open AI的营收也比除了Anthropic之外所有其他AI模型公司加起来还多。这绝不是单凭跑分和价格就能追上的。这就是我说的品牌和生态环境价值。
https://www.techradar.com/pro/anthropic-becomes-the-apple-of-ai-as-it-grabs-most-revenue-despite-being-the-most-expensive
我其实在公司里是强烈推荐GPT/Codex的,毕竟如果能有效降低AI开销,将来裁员也会少一些。家里也是希望大家多用Gemini,毕竟是Family Plan。但事实就是,Claude作为AI模型一哥已经深入人心。无论是同事还是道侣,孩子,他们的共识就是想赢,就得用Claude。全家桶组合Code,Cowork,Design,Science真的太强,加上Claude为Finance,Legal这些高薪职业打造的Plugin,又有Nicholas Lin这样的大神带领专业团队在这些领域落地开花。Github上无穷无尽的的Claude Agents/Skills。AI领域的苹果,当之无愧。他的价钱虽然高,但跟高薪人力比仍旧是大白菜。而且降到Medium/Low以后,性价比和跑分仍旧优秀。无敌的文笔,设计,品味,架构能力,没有真正意义上的替代品。什么大模型没门槛,随便换的,只能说完全不了解Claude Code Harness/Agent/Skill的三重保险,还有他们做出来东西的高大上。
自从Deepseek大涨价以后,Codex/GPT Plus直接成了性价比之王。5.6 Luna完美取代Deepseek 4 Flash的地位, 还有Sol这个顶级模型,要上限有上限,要性价比有性价比,再配合送最多Token的月计划,考虑到Claude在中国疯狂封号,这是GPT最大的突破口。不过个人账户营收真的太低,所以只能刷人头,对整体营收是杯水车薪。老实说Codex已经非常优秀,但是文笔,设计,品味,架构能力都不如Claude,后端能力再强,也很难得到高端企业用户的青睐。
谷歌在清理了德米,姐夫两个醉心科研,不好好做产品的老学究以后,3.7 Flash回暖了一波,进入了第二梯队。配合50%的降价,无敌的速度,最强的多媒体支持(可以直接看视频生Transcript/Subtitle),Antigravity里修改前端界面,做Code Review,哪怕开发些小功能都是非常好用的。看好Gemini 4 Pro重返第一梯队。他家的AI计划送的真的太多了。Family Plan, 5TB Google Drive, Youtube Premium Lite, Health/Home Premium, 还能生无限图和上百个AI视频。ChatGPT长远来说很难和他竞争用户数量。企业AI他有TPU,有Anthropic 15%的股份,可以说立于不败之地。
Grok和Muse Spark这两个模型最大问题,是他们的品牌和历史。Grok是以无限制写黄文,生擦边图为主要卖点。个人虽然可以随便上Cursor,Grok 4.6也非常优秀,大型企业真的不可能考虑他们为主体的。小札的Muse Spark 1.2个人版降到了10美分/20美分,历史第一低的价格,跑分也很亮眼,但仍旧无人问津,毕竟后面的数据是社媒体为主,写文章是不错,编程什么的,Muse Code还太嫩。用他们为什么不用Codex月计划呢?
国内我比较关注的Linux.Do, V2EX论坛,感觉Codex统治了四大开源。Deepseek 4 Pro的跑分不尽人意,加上大涨价,已经完全无法和Codex抗衡。Kimi K3, GLM, 和Qwen各有亮点,但无论性价比还是质量都无法打破5.6 Sol和5.6 Luna这个无敌组合。Z.AI GLM的股票从5.2巅峰到现在,已经跌了58%。GLM 5.3作为753B的模型,跑分能和Kimi K3 2.4T的模型一样,后期训练做的很不错。Kimi K3前端的品味非常强,但速度慢,价格高。还是这话,为什么不用Codex月计划呢?期待字节的Trillion级别的大模型, 最有希望跟美国御三家分庭抗礼的中国AI公司。他们在豆包,Seedance上积累的经验,也是国产AI真正进入了产品/生态环境境界的AI公司。
倒是国产本地模型是真的让我惊艳了一把。Minimax H3在我的5080上,五分钟一个720p的视频,质量仅次于Seedance 2, 但完全无视人物版权,限制级内容随便搞。没有本地显卡的,也建议用Runpod/Modal体验一下。 Seedance 2.5一个视频的价格,就够Runpod上租5090一个小时了。Qwen的27B的模型跑分居然和Deepseek 4 Flash完全一样,也是本地开源的里程碑。当然普通显卡跑不了这些模型的满血版。
https://artificialanalysis.ai/ 是目前最主流的跑分和价格榜,所有各大媒体都会引用。
跑分:https://artificialanalysis.ai/models?models=gpt-5-6-sol%2Cdeepseek-v4-pro%2Cdeepseek-v4-flash%2Cglm-5-3%2Cglm-5-2%2Ckimi-k3%2Cgemini-3-7-flash%2Cqwen3-8-max%2Cqwen3-8-27b%2Cclaude-sonnet-5%2Cgrok-4-6%2Cmuse-spark-1-2%2Cgpt-5-6-terra%2Cgpt-5-6-luna%2Cclaude-opus-5%2Cclaude-fable-5#intelligence-tabs
速度:https://artificialanalysis.ai/models?models=gpt-5-6-sol%2Cdeepseek-v4-pro%2Cdeepseek-v4-flash%2Cglm-5-3%2Cglm-5-2%2Ckimi-k3%2Cgemini-3-7-flash%2Cqwen3-8-max%2Cqwen3-8-27b%2Cclaude-sonnet-5%2Cgrok-4-6%2Cmuse-spark-1-2%2Cgpt-5-6-terra%2Cgpt-5-6-luna%2Cclaude-opus-5%2Cclaude-fable-5#speed-tabs
价格: https://artificialanalysis.ai/models?models=gpt-5-6-sol%2Cdeepseek-v4-pro%2Cdeepseek-v4-flash%2Cglm-5-3%2Cglm-5-2%2Ckimi-k3%2Cgemini-3-7-flash%2Cqwen3-8-max%2Cqwen3-8-27b%2Cclaude-sonnet-5%2Cgrok-4-6%2Cmuse-spark-1-2%2Cgpt-5-6-terra%2Cgpt-5-6-luna%2Cclaude-opus-5%2Cclaude-fable-5#cost-tabs |
上一篇: 独生子A8.5家境还要工作吗下一篇: 你认为美股和加密哪个未来行情更好?
|