



Исследователь сжёг все свои токены и разработал ИИ-конвейер, изучая способы экономии на ИИ-моделях
Разработчик Бартош Котрыс (Bartosz Kotrys) из компании Quesma рассказал, как полностью исчерпал лимит подписки Claude Max, пытаясь исследовать способы сокращения расходов на использование больших языковых моделей — на это у него ушло всего полчаса.
По словам специалиста, стандартный режим Deep Research оказался настолько ресурсоёмким, что лимит закончился ещё до завершения работы. Котрыс приводит пример одного из запусков Deep Research. Система создала 111 агентов, поставила в очередь 123 утверждения для проверки и выполнила более сотни поисковых запросов. До исчерпания лимита удалось подтвердить лишь 25 утверждений, после чего процесс остановился, так и не сформировав итоговый отчёт. По словам автора, проблема заключалась не столько в стоимости моделей, сколько в том, что разные агенты постоянно дублировали работу друг друга и многократно расходовали ресурсы.
После этого разработчик собрал собственную систему, объединив уже оплаченные подписки на Claude, Codex и Antigravity. Ключевым элементом стал плагин claude-mem, который создаёт общую память для всех агентов. Благодаря этому результаты поиска, промежуточные выводы и найденные источники сохраняются и становятся доступны другим моделям, которым больше не приходится повторно выполнять те же операции.
По словам автора, такая схема позволила примерно в десять раз увеличить продолжительность непрерывной работы системы без дополнительных расходов. Если раньше лимита подписки Claude Max хватало примерно на 30 минут исследования, то после распределения задач между Claude, Codex и Antigravity конвейер смог работать несколько часов. При этом, если одна из сторонних подписок достигает своего лимита, система автоматически возвращается к использованию моделей Claude, не прерывая
Читать на habr.com