Что это значит
Что произошло: рынок привык считать экономию на LLM по цене токена, хотя для агентной системы это только одна строка в смете. Если модель хуже планирует, путается в промежуточных шагах и чаще вызывает инструменты, дешёвый запуск быстро обрастает дополнительными итерациями, проверками и исправлениями. Цена одного запроса падает, а стоимость выполненной задачи может вырасти.
Для контент-завода это особенно критично. В цепочке, где агент разбирает исходник, выделяет тезисы, пишет варианты, проверяет факты и раскладывает материалы по площадкам, ошибка на раннем этапе размножается дальше. Ты получаешь не просто лишние токены, а ручную перепроверку, сбитый график публикаций и нестабильное качество всей линии. Дешёвая модель хороша там, где задача короткая и легко проверяется. Но управляющий агент, который принимает решения и передаёт работу между этапами, требует другой планки надёжности.
Что делать уже сейчас: считай не цену миллиона токенов, а стоимость готового результата - вместе с числом шагов, вызовов инструментов, временем и долей ручных исправлений. Раздели систему на уровни: сильную модель оставь для планирования, сложной редакторской работы и контроля, а дешёвую отдай на классификацию, форматирование и рутинную переупаковку. И обязательно заведи тестовый набор из своих реальных задач: так ты увидишь, где экономия помогает конвейеру, а где ломает его.





