>Так задачу все равно батчем можно скормить, даже через файл, если у тебя там 100500 пунктов.
ну если каждую задачу можно выполнить изолированно, то да, почему нет. но часто это не так. и если это изолированные окружения, то само составление списка задач и тем более контроль результатов уже целесообразно делегировать модели, потому что проверить результат(включая качество и устойчивость этого результата) в общем-то сопоставимо с самим процессом решения по трудозатратам. PM-ов и QA придумали в общем-то не от хорошей жизни и бюджета они жрут не меньше и архитектура организации процессов в компании - это в общем-то тоже самое, та же задача: распараллелить необъятное и проконтролировать чужими руками ещё более необъятные результаты, нести сопутствующие риски и всё это жутко абстрактно, настолько абстрактно, что возникают сомнения в общей целесообразности всего этого процесса. типа: а зачем мне это всё? вот эта вот "галера дома". можно у меня хотя бы дома её не будет? обычно мне нужна работа над одной задачей и то - степень надобности очень умеренная, а бесплатных галер вокруг плавает тьма, запрыгивай в любую и в любой роли и, кстати, не факт, что кожаный мешок будет дороже какого-нибудь клода. с ним пол часика побазаришь на любую тему - десять баксов в кармане как не бывало. может быть он и лучше психотерапевта, но психотерапевт во-первых дешевле, во вторых - с его спросить можно, у него репутация есть. а с этого чугунного болвана всегда взятки гладки, во всём буду виноват только я и только перед самим собой
так что здорово, конечно, что у меня дома есть думающие камни, а так же думающие камни побольше через апи, но думающие камни это просто думающие камни. тыкать их палочкой в духе "исправляй мою жизнь" можно, но результат будет таким же произвольным, как если бы я начал исправлять свою жизнь сам или просто подождал, пока исправление жизни произойдёт самопроизвольно. тоже ведь, бывает. никогда не знаешь, где найдёшь где потеряешь. но есть класс задач, в духе "прочитай за меня книгу" где в этом всём есть смысл. мне даже вот не настолько важно, что бы оно фигачило за меня код, сколько важно, что бы оно имело панораму и перспективу репозиторя, а так же контекст задачи и могло интегрально выдать мне, что оно об этом думает и указать на тупой баг. хотя, разгрузка меня от синтаксической работы - это тоже приятный момент, но есть у него и обратная сторона в духе того, что надо потом разбираться в специфических архитектурных решениях, возникших вследствие специфического для модели понимания задачи, а так специфического видения среды, в которой происходит весь этот процесс. модель слушает меня и делает как я сказал, но всегда имеет биас в сторону того "как это обычно бывает". и если мне нужны метрики и аналитика для какой-то своей специфической цели, модель в своих решениях всё равно будет неизбежно дрейфить в сторону типичных сценариев популярных коммерческих применений. посвятить модель в свою мифологию это всегда сожрать пол контекста, а то может быть и lora-адаптер имеет резон - этого я пока не пробовал