"Сейчас есть мало более хреновых решений, чем сесть гонять /goal loop как он есть ""из коробка"". ""сырой"" goal-loop – это рак ai assisted разработки. я искренне считаю что никакие spec тулы/языки/решения тут не помогут, если вы в итоге заканчивается одним мега-планом который суете в ralf-like loop. Это просто не работает, каким бы прекрасным не был ваш план, какими бы формальными не были ваши спецификации – с идеальной семиотической архитектурой, нулевым количеством противоречий и разночтений (fan-out). И даже если в вашем мега-плане перечислены лучшие практики программной инженерии – это все еще не гарантирует что ваш любимый агент сделает все правильно. Скорее всего он будет следовать вашим инструкциям, но в какой то момент свернет не туда, и вопрос только в том как быстро вы это заметите. Почему так? Да потому что контекст пухнет, ничего нового! Дробите задачи проверяемыми кусками, пусть будет один условный агнет-тред который владеет планом и решениями, и мержит конфликты от ворктредов выполняющих работу, которую можно адекватно распараллелить. Вот что то такое, наверное, и есть сейчас ""настоящий"" baseline нормального харнесса. goal loop это инструмент, который можно хорошо точечно использовать в разных тредах – и в том самом overseer задача которого спаунить рабочие среды с задачами, проверять по hearbeat крону, и мержить решая конфликты, отправлять на доделку/исправление, и в самих рабочих ""тредах"" – пусть будут goal, но задача изолированная, понятная, и проверяемая. Тяжелее ли за этим всем приглядывать? Ну удивительно, но не намного! Намного тяжелее находить себя в ситуации когда четыре раза могнул и вообще не понимаешь что в мега-yoba goal лупе происходит. Так или иначе но часто даже с нормальным харнессом ai assisted разработка все равно напоминает скульптурную лепку – шмяк и формуем, шмяк и отсекаем, формуем. Вот надо туда ""шмяки"" весом/объемом поменьше)))"