По непонятным причинам я не могу писать в iGaming-чате, поэтому отвечу тут….
По непонятным причинам я не могу писать в iGaming-чате, поэтому отвечу тут. Может, кому-то ещё пригодится.
Коллеги подняли хороший вопрос про работу с Claude. На больших задачах контекст постепенно забивается, модель начинает хуже держать общую картину, поэтому человек вручную дробит задачу на маленькие куски и старается не давать Claude лишнего.
На самом деле это, похоже, и есть правильный подход, только я бы не делал его руками.
Большую задачу можно сначала разбить на независимые подзадачи и каждую отправлять в отдельный чистый контекст. Один агент ищет информацию, другой анализирует, третий пишет, четвёртый проверяет. В основной контекст возвращаются не все их рассуждения и промежуточный мусор, а только структурированный результат, который действительно нужен дальше.
Следующий уровень этой схемы: разные задачи вообще необязательно отдавать одной модели. Простую рутину отправлять дешёвой и быстрой, исследования более сильной, код отдельной модели. Тут уже можно подключать тот же OpenRouter для маршрутизации.
Если не хочется собирать такую архитектуру самостоятельно, можно посмотреть в сторону готовых агентных решений. Например, Hermes Agent уже умеет делегировать задачи отдельным субагентам с изолированными контекстами.
Получается довольно простое правило: не пытаться сделать один бесконечный умный чат. Дробить задачу, изолировать контекст и возвращать наверх только результат.
Чем сложнее задача, тем важнее становится уже не размер контекстного окна, а то, насколько грамотно ты им распоряжаешься.
Вставить свои 5 копеек: