Китайските езикови модели за първи път изпревариха американските по реално потребление.

Обобщение

  • Китайските AI модели вече са 20 от топ 50 в света, ръст от 400% спрямо 2025 г.
  • През юни китайските модели обработиха 98 трлн. токена срещу 53 трлн. за американските.
  • DeepSeek V4 Flash е близо 35 пъти по-евтин от GPT-5.5.
  • Lindy и клиенти на Vercel вече местят реален трафик към китайски модели.

Според данни на анализаторската платформа Apollo, цитирани и от The Kobeissi Letter, 20 от 50-те най-използвани AI модела в света идват от Китай, докато американските са намалели от 33 на 28 за година. Освен това, през юни китайските модели в топ 20 са обработили 98 трлн. токена при месечен ръст от 113%, докато американските са стигнали 53 трлн. при ръст от 43%. Токенът е основната разчетна единица в индустрията, с която моделите измерват обработения текст и на която се базира цялото ценообразуване, така че тези числа отразяват реални пари и реален корпоративен трафик, а не лабораторни класации.

Защо американски компании прехвърлят трафика си към DeepSeek и GLM

На OpenRouter, платформата, през която минава голяма част от реалния корпоративен AI трафик, делът на китайските модели е скочил от 30% на 46%, докато американският е паднал от 70% на 54%.

AI стартъпът Lindy спря да използва Claude на Anthropic и прехвърли 100% от трафика си към DeepSeek. Изпълнителният директор Фло Кривело заяви, че решението ще спести на компанията милиони долари само за няколко месеца. При Vercel ефектът е още по-рязък: след юнското пускане на GLM 5.2 на китайската Z.ai, дневният обем токени през платформата им е скочил 27 пъти за първата седмица, а плащащите клиенти са се увеличили 80 пъти, посочва Харприйт Арора от компанията.

Американските AI компании вдигат цените на най-новите си модели точно когато клиентите им обработват все по-големи обеми заявки, а разликата от няколко цента на милион токена се превръща в милиони долари при мащаб. Има и още нещо, което премахва основната пречка пред използването на китайски софтуер: при тези модели пълният код и параметрите, на които се основава AI системата, са публично достъпни за сваляне. Компаниите ги инсталират на собствени сървъри, а не изпращат заявки към чужд облак, така че никакви корпоративни данни не напускат инфраструктурата им. На практика се купува самата технология, не абонамент за услуга, а това елиминира риска, който обикновено спира западните фирми от работа с китайски доставчици.

Модели в топ 50
Китай20 (+400% от 2025 г.)САЩ28 (от 33)
Токени през юни
Китай98 трлн. (+113% MoM)САЩ53 трлн. (+43% MoM)
Ръст на преднината в токените
85% повече от САЩспрямо 24% през май
Дял в OpenRouter трафика
Китай30% → 46%САЩ70% → 54%

Как санкциите върху чиповете доведоха до по-евтини модели

Американските експортни ограничения върху висок клас графични процесори имаха за цел да ограничат достъпа на Китай до най-мощния AI хардуер, но на практика подтикнаха точно обратния ефект в най-търговската част на пазара. Лишени от най-мощните чипове, китайските инженери изградиха стратегията си около т.нар. Mixture-of-Experts архитектура. При нея моделът се състои от множество специализирани подмрежи, наречени експерти, но при всяка отделна заявка се активира само малка част от тях. Вместо цялата система да работи на пълни обороти за всеки въпрос, се включват единствено компонентите, нужни за конкретната задача, а това намалява необходимата изчислителна мощност и енергия за обработка на всяка заявка.

Тази архитектурна разлика обяснява защо цените на китайските модели не изостават с няколко процента от американските, а са толкова надолу: DeepSeek V4 Flash струва $0,14 за милион токена, GPT-5.5 около $5 за същия обем.

Бърз масов клас
DeepSeek V4 Flash
$0,14 / 1 млн. токена
OpenAI GPT-5.5
≈ $5,00 / 1 млн. токена
Около 35 пъти по-евтино
Флагмански клас
DeepSeek V3.2 / MiniMax M2.5
$0,38 – $1,10 / 1 млн. токена
US флагмански еквиваленти
$15,00 – $75,00 / 1 млн. токена
Разлика от 15 до 70 пъти

Хауърд Ю от бизнес училището IMD посочва и енергийния фактор, който според него ще определи следващия етап от надпреварата: победителите ще притежават силиция, договорите за електроенергия и водата за охлаждане, в този ред, а Китай е изградил стратегията си точно около ресурса, който контролира. Пекин вече е поел ангажимент за над $70 млрд. инвестиции в центрове за данни по последните си планове.

САЩ и Китай градят два отделни AI свята

Съединените щати запазват предимство в най-високия клас системи, но го пазят умишлено затворено: достъпът до модели като GPT-5.6 Sol е сведен до проверена група от около 20 организации, за да се защитят стратегически способности. Консултантската компания Boston Consulting Group описва развитието като изграждане на две отделни и все по-несъвместими технологични екосистеми: САЩ разчитат на капитала си и на изследванията в най-високия клас, докато Китай печели с по-ниски разходи и масово внедряване на своите модели по света. Според анализа компаниите постепенно ще бъдат принудени да работят само с едната от двете екосистеми, а не и с двете едновременно.

Политическият натиск върху американските потребители на китайски модели вече е факт. Законодатели във Вашингтон започнаха проверки срещу Airbnb и Anysphere, компанията зад редактора Cursor, заради използването на отворени китайски модели като Qwen, а силно регулираните западни сектори остават предпазливи по съображения за сигурност на данните. Пекин от своя страна обмисля да ограничи задграничния достъп до водещите си модели с отворени кодове, за да защити местната интелектуална собственост, а китайските регулатори наскоро наредиха спиране на потребителски създадени AI агенти в платформи на ByteDance и Alibaba заради проблеми със съответствието.

Anthropic и OpenAI се готвят за листвания на борсата при оценки, близки до $1 трилион, изчисления, които предполагат способност да задържат високи цени за корпоративните си клиенти. Случаят с Lindy и наблюденията на Vercel показват точно обратното: когато има достъпна алтернатива за конкретна задача, компаниите бързо преминават към нея, а не остават лоялни на един доставчик заради марката му. Самият Кривело заяви, че би превключил Lindy обратно към Claude, ако Anthropic намали цените си достатъчно. С други думи, лоялността към американските модели не е изчезнала, а е поставена под условие, което дузина други компании вероятно споделят мълчаливо. Въпросът пред Anthropic и OpenAI е дали могат да си позволят да отговорят на това условие, Въпросът пред Anthropic и OpenAI е дали могат да си позволят такова намаление на цените, без да застрашат приходите, на които се основават трилионните им оценки преди борсовия дебют.


Информацията, публикувана в TradeNews, има единствено информационен характер и не представлява финансов, инвестиционен, правен или какъвто и да е друг професионален съвет. Пазарите на акции, криптовалути, форекс и дигитални активи са силно волатилни и миналото представяне не е гаранция за бъдещи резултати. Читателите следва самостоятелно да правят собствено проучване и, при необходимост, да се консултират с лицензирани финансови или други професионални консултанти. TradeNews не носи отговорност за каквито и да е загуби или щети, произтичащи от използването на публикуваната информация.