GLM 5.2 and the coming AI margin collapse
Экономика искусственного интеллекта меняется: обучение модели — это разовый, дорогой капитальный расход, а реальная прибыль генерируется при инференсе, где есть реальные переменные затраты. Рынок переоценил DeepSeek R1, считая, что дешёвое обучение в $6 м делает крупные вложения в инфраструктуру излишними, что привело к резкому падению акций Nvidia. На деле же компании вроде Anthropic и OpenAI берут за токен инференса $25, при этом их валовая маржа достигает 90 % по сравнению с стоимостью вычислительных ресурсов. Такая модель позволяет амортизировать крупные затраты на обучение через огромный объём запросов, превращая их в устойчивую прибыль.
Недавно я тестировал GLM 5.2 от Z.ai — первый открытый конкурент, сравнимый по качеству с Opus и GPT‑5.5. Он почти неотличим по результатам, но работает медленнее, не поддерживает зрение и имеет слабую веб‑поисковую функцию, что критично для агентных сценариев. При этом платформа предоставляет совместимые OpenAI и Anthropic‑API, позволяя мгновенно заменить модель в Claude Code или Codex, меняя лишь базовый URL и ключ. Переключение стоит почти ничего, в отличие от привязки к проприетарным сервисам, и открывает путь к дешевым, открытым альтернативам, что может подорвать экономику закрытых лидеров.