(Не)видимая цена интеллекта: почему экономия на LLM убивает ваши агентные системыРазработчики агентных систем оказались в странной ситуации. Модели становятся дешевле, но задачи решают хуже. Провайдеры соревнуются в снижении цены за токен, а команды радостно переходят на облегчённые версии, экономя на вычислениях. Экономия очевидна — до первого столкновения с реальной задачей. Только потом выясняется, что агент на дешёвой модели делает в три раза больше вызовов инструментов, чем на дорогой. Он теряет способность планировать, начинает галлюцинировать и ходить по кругу, переспрашивать и исправлять ошибки новыми ошибками. Счёт за токены незаметно растёт, время выполнения задачи увеличивается, а многие начинают нервничать. Это история, уже не только про жадность разработчиков как таковую, а про то, как — и главное, почему так — устроен рынок ИИ, и почему ваша следующая экономия на модели может оказаться самой дорогой скрытой инвестицией в жизни проекта.https://habr.com/ru/companies/bothub/...
Related
Agent Engineering using Claude by Venkatesh Tadinada is free with a Leanpub Reader membership! Or you can buy it for $29...
Agent Engineering using Claude by Venkatesh Tadinada is free with a Leanpub Reader membership! Or you can buy it for $29.95! https://leanpub.com/agent_engineering_using_claude #age...
🤖 Working on a accessible creative production suite featuring a voice-first multi-agent assistant. All core tools are co...
🤖 Working on a accessible creative production suite featuring a voice-first multi-agent assistant. All core tools are completely free for hands-on use, while AI-powered automated g...
Rozhovor s CoreWeave supportem po tom, co jsem hledal kde nastavit spend limit na inference:Jak se da nastavit mesicni s...
Rozhovor s CoreWeave supportem po tom, co jsem hledal kde nastavit spend limit na inference:Jak se da nastavit mesicni spend limit?Spend limit na cely ucet je nastaveny na $700k. P...