Тренд «tokenmaxxing» в сфере искусственного интеллекта (ИИ), то есть максимальное использование токенов, достиг своего предела. Компании заметили, что применение ИИ для всего приводит к росту затрат, но производительность при этом не увеличивается пропорционально. Об этом говорится в новом отчете Винсента Гусдорфа, руководителя отдела анализа ИИ в Moody's Ratings, сообщает сайт infohub.kz.
Явление, получившее название tokenmaxxing, представляет собой стремление получить как можно больше сгенерированной ИИ работы от таких продуктов, как ChatGPT от OpenAI и Claude от Anthropic. Этот тренд вызвал ажиотаж в технологической сфере весной, но летом началась обратная реакция.
По словам Гусдорфа, сделать что-то ненужное с помощью ИИ легко. Он отметил: «Когда начали приходить счета, люди поняли, что эти новые инструменты очень дороги и их нужно использовать с умом».
Несколько месяцев назад руководители Кремниевой долины пропагандировали высокое потребление токенов как признак высокопроизводительных сотрудников. Генеральный директор OpenAI Сэм Альтман в мае интересовался, что можно увидеть от стартапов tokenmaxxing. Генеральный директор Nvidia Дженсен Хуан заявил: «Если ваш инженер за 500 000 долларов не сжигает токены на 250 000 долларов, что-то не так». Материнская компания Facebook, Meta, поощряла использование токенов во внутренних соревнованиях.
Генеральный директор Microsoft Сатья Наделла признал, что tokenmaxxing может вызывать зависимость, и предупредил, что клиенты платят за ИИ дважды: сначала за токены, а затем, передавая собственные данные.
Генеральный директор Palantir Алекс Карп пошел дальше, заявив, что «что-то в корне не так». Он передал, что американские компании возмущены необходимостью платить большие деньги за токены, которые не создают ценности.
Управляющий консультант Bain & Company Джуэ Ван сообщил, что расходы на токены в компаниях удваиваются каждые два месяца. Например, при увеличении с 200 долларов на одного разработчика до 20 000 разработчиков это превращается в огромную сумму, которую руководство не планировало.
Поэтому компании начали искать инструменты маршрутизации моделей ИИ: простые запросы направляются более дешевым моделям, а сложные задачи — более мощным. Джуэ Ван отметил, что нет необходимости использовать мощную модель, такую как Claude Opus 4.6, для написания писем.
При этом открытые модели китайских стартапов (Kimi от Moonshot и GLM от Zhipu) предлагают дешевую альтернативу. Они близки по возможностям к лучшим американским моделям, но стоят в несколько раз дешевле. Главный технический директор Mozilla Раффи Крикорян заявил: «Это может несколько продвинуть tokenmaxxing, но в целом индустрия понимает, что это глупость».
Крикорян сравнил этот тренд с тем, как раньше компании-разработчики ПО использовали количество строк кода как показатель производительности. «Я думаю, tokenmaxxing развивается по той же схеме, и через год мы будем смеяться над ним», — заключил он.


