Операция выполнена!
Закрыть
Хабы: Блог компании МТС, Искусственный интеллект, Управление проектами, Бизнес-модели, Управление продуктом

Долгое время разработчики жили в парадигме «закон Мура все исправит, а применительно для ИИ сделает вычисления вообще бесплатными». Серьезный сдвиг в ИТ-индустрии, произошедший на рубеже 2025–2026 годов показал нечто иное. Благодаря прошлому опыту разработчики ПО привыкли к тому, что масштабировать цифровой продукт относительно легко: вы пишете код один раз, а затраты на каждого нового пользователя падают почти до незначительных затрат. В мире генеративного ИИ все уперлось в физическую и экономическую стоимость каждого отдельного токена, а их расход по ряду причин оказался очень далек от оптимального.

В эпоху генеративных моделей токен превратился в универсальную меру вычислений, точный аналог «киловатт-часа» для энергетика или «кубометра газа» для промышленника. Это фундаментальная расчетная единица, которая связала стоимость видеокарт, гигаватты электричества, многомиллионные инвестиции и строчки текста, которые получают пользователи.

И она отличается от того, к чему мы привыкли. Если в классической SaaS-модели стоимость обслуживания каждого последующего пользователя уменьшается, то в мире LLM стоимость запроса почти не меняется, а с большими объемами начинает расти.

Чтобы понять, как устроена эта «банковская система» цифровой эпохи, почему одни «буквы» стоят дороже других и что оптимальнее — корпоративный сервер или подписка на облачный сервис или серверная стойка, нам придется спуститься на уровень базовой логики работы ИИ и разобрать анатомию ее работы применительно к затратам. 

Читать далее
Читайте также
НОВОСТИ

ПИШИТЕ

Техническая поддержка проекта ВсеТут

info@vsetut.pro