Экономика AI-моделей: цены упали в 10 раз за год, и падение продолжается

GPT-4 Turbo стоил $30 за миллион токенов в 2024, GPT-5 — $3. Конкуренция и оптимизация обрушивают цены.

Aravana··1 мин

Экономика AI-моделей переживает дефляцию, которая напоминает ранний интернет. Стоимость инференса (обработки запросов) падает на 10x каждые 12-18 месяцев. GPT-4 Turbo стоил $30/млн токенов на входе в 2024. GPT-5 предлагает сопоставимое качество за $3.

Причины: конкуренция (OpenAI, Anthropic, Google, Meta, Mistral, десятки китайских компаний), оптимизация (квантизация, дистилляция, speculative decoding), и масштаб (чем больше пользователей, тем ниже стоимость на запрос).

Для бизнеса это меняет уравнение: задачи, которые год назад были нерентабельны с AI, теперь окупаются. Анализ каждого email (не только VIP-клиентов). Персонализация для каждого пользователя (не только premium). AI-ассистент для каждого сотрудника (не только менеджеров).

Прогноз: к 2028 году стоимость AI-инференса будет настолько низкой, что AI-обработка станет встроена в каждое приложение по умолчанию — как сегодня встроен SSL-шифрование. Не premium-функция, а базовая инфраструктура.

Этот материал подготовлен командой AI-агентов AravanaAI и проверен главным редактором.

Тип материала: research

Поделиться:TelegramXLinkedIn
Как вам материал?

Читайте также

Хотите получать подобные материалы раньше?

Aravana Intelligence — авторская аналитика и закрытый круг для тех, кто думает на шаг вперёд.

Узнать про Intelligence

Не пропускайте важное

Еженедельный дайджест Aravana — ключевые события в AI, робототехнике и longevity.

Похожие материалы

NVIDIA GTC 2026: от кремния до орбиты за одну презентацию

Jensen Huang представил платформу Vera Rubin, настольный суперкомпьютер на 20 петафлопс и план по размещению AI-дата-центров в космосе. ABB, Universal Robots и KUKA интегрируют Physical AI -- и робототехника перестаёт быть отдельной индустрией.

·2 мин·Выбор редакции

GPT-5.4 vs Claude Opus 4.6 vs Gemini 3.1 Pro: кто лучший в 2026 году

Три флагмана, десятки бенчмарков, ноль однозначных ответов. Разбираемся, какая модель реально лидирует — и почему ответ зависит от задачи.

·4 мин·Выбор редакции

AI для программистов: Claude Code vs Cursor vs Copilot vs Devin

Четыре подхода к AI-ассистированному кодингу: от автокомплита до полностью автономного агента. Разбираемся, кто для чего.

·4 мин·Выбор редакции