2026上半年的AI之争

2026年上半年,AI行业更新节奏之快前所未有。由于严格意义上来讲,我是从今年1月份才开始关注AI“局势”的,所以完整经历了这一个过程。整个上半年,AI几乎是以周为单位快速演化,与此同时,模型能力、资本估值、地缘政治三条线同时开打。趁着最近休息间隙,我写一篇短文复盘一下。也是好久没发公众号了,不能死了(

OpenAI:迭代最密集的一家

3月,OpenAI发布GPT-5.4系列;4月末推出GPT-5.5;7月又带来分为旗舰、均衡、轻量三档的GPT-5.6系列。我在四月,尤其是月抛大盛兴时几乎已经变成了codex的坚定捍卫者和GPT的无脑拥护者。Tibo是一位非常优秀的产品经理,他懂得如何留住用户和打压对手,最近用codex确实用爽了。GPT的网页版的降智情况没有非常严重,目前来看GPT系列模型仍然是综合能力和性价比最强的,没有之一。

Google:混战中的稳健派

我从前是哈基米的用户,从三月开始慢慢转向GPT。主要是因为自3pro横空出世之后,Google一直没有大的更新,3.1Pro更像是小修小补,而3.5flash的综合能力也没有超越3.1ro,3.5Pro不断延迟,遥遥无期。Google这半年动作太克制。Gemini系列没有制造太多话题性事件。而其网页版的降智更是使得我这个老用户直接流失,不知多少人的白月光是25年下半年的Gemini 2.5Pro。

Anthropic:监管风波与煞笔态度

反华决定命运,to C的态度决定上限。我是非常痛恨这家煞笔公司,我之前还给他充过钱但是依旧屎。与此同时,如果放眼宏观,Anthropic完成650亿美元H轮融资,投后估值冲到9650亿美元,反超OpenAI。与此同时,美国政府以国家安全为由,要求Anthropic限制外国公民访问其最新模型Fable 5和Mythos 5,公司随即暂停了两款模型的海外服务。但是不得不说,Fable和Opus的强大有目共睹。

DeepSeek:搅动定价体系

4月24日,DeepSeek没有预热、没有发布会,直接开源了V4系列——1.6万亿参数、百万级原生上下文。其价格更是低到离谱,这一点是我最近大规模用V4 Flash才真正感觉到的。不得不说你梁文峰叔叔还是真神。其实我个人最关心的还是形如ds的AI,主要在于我用得起。期待接下来的V4正式版拳打脚踢闭源模型。

Kimi:大招来喽

我其实基本没怎么关注kimi,但是昨天原子弹爆炸了!7月16日,月之暗面正式发布Kimi K3——2.8万亿参数,原生支持视觉理解,拥有百万Token上下文窗口,重点强化了长程编程和复杂推理能力。benchmark全面超越GPT5.5,大多数场景超越Opus,前端遥遥领先,堪称全球top3模型。由于还未体验,主要是月之暗面狗屎的定价策略,如果以后有时间有钱体验了争取我再发一篇。

xAI,质谱,mimo等:百家争鸣

grok我一直当成一个大号豆包在用,对于没开会员的不是很友好,而且我最近发现幻觉严重。4.5的话也要去追代码能力了,我不知道马斯克在干啥,没搞懂。阿里还真没咋了解了,又闭源了,也没看懂;mimo高强度用了,送我了几十亿token,没用完,但是整体感觉略逊ds,但是plan似乎非常便宜。质谱基本也没用,主要是plan抢不到,5.2的Agent能力很强,但是依旧是烧钱包,我要考虑购入他的股票抄底了。还有字节,他们似乎在多模态发力比较猛,由于我对这方面不感兴趣,谈不上非常关注了,但是请允许我嘲讽一下豆包付费。

整个上半年捋下来,GPT胜在综合体验和生态成熟度,DeepSeek和Kimi是在用真金白银的价格和参数把国产模型的地位往上顶,智谱赶上了政策的顺风车,Google活生生把自己攒了大半年的老用户作没了,Anthropic技术是真强但那股煞笔劲儿也是真足。如何满足C端的“技术人员”,也就是大学生、个人开发者群体,我觉得这是竞争的重中之重。