Проверка очереди ещё не значит, что работа сделана
Сегодня моя ИИ-команда трижды могла записать промежуточное действие как готовую работу. Радар проверил источники. Система задач дважды пересмотрела одну задачу. Контентный конвейер прошёлся по очереди из 24 черновиков.
Но проверка ещё не означает, что работа сделана.
Если агент посмотрел очередь, передвинул карточку или написал «всё работает», он ещё ничего не выпустил. А если для следующего шага нужно моё решение, он не должен принимать его за меня.
Утром я как раз думал о контексте как о контракте для агента.
Чем дольше я работаю с агентами, тем меньше верю в магию длинных промптов. Можно накидать агенту простыню текста, десять правил и ждать, что он сам поймёт главное. Обычно так рождается гладкая фигня.
Нормальная постановка задачи выглядит жёстче: цель, контекст, входные материалы, инструменты, ограничения и понятный результат. Не «сделай хорошо». Нужно заранее записать, что получить, на что опираться, чего не трогать и как проверить готовность.
И отдельно: что агент имеет право решить сам, а где обязан остановиться и спросить человека.
Весь день эта граница попадалась мне в разных местах.
Утром ИИ-радар не потащил в базу всё подряд. Он нашёл 5 нормальных сигналов и отсеял 18 слабых. Получилось сырьё для уроков, постов, разборов и будущих регламентов.
Среди тем были нейропоиск по большому архиву контента, самоулучшающиеся агентные циклы, голосовой ИИ в реальном времени и короткие команды для кодинговых агентов. Это полезные заготовки. Готовых публикаций среди них нет.
Потом та же проверка сработала в задачнике.
Там висела одна активная задача: настроить регулярный разбор входящих и выбор задач на день. Система посмотрела на неё утром и вечером.
Утром она предложила один вариант. Вечером другой. Ещё заметила, что задача могла стать лишней, если утренний и вечерний обзоры уже закрывают эту функцию.
При этом система ничего не выбрала за меня.
Она не перенесла задачу, не поставила дату и не удалила её. Показала варианты и оставила решение мне.
Следом я увидел ту же границу в конвейере каруселей.
Система проверила 24 черновика в ожидании. У каждого уже были бриф, слайды, подпись, проверка на понятность холодному читателю и задание для дизайна. Причины переписывать их заново не нашлось.
Значит, очередь в порядке. На этом система остановилась.
Она не переписала черновики ради активности, не поменяла статусы и не назвала проверку публикацией. Контент можно считать выпущенным только после реального выхода, а не после красивой строчки в отчёте.
Ещё один пример пришёл из поддержки Фабрики.
Человек спросил, как подключить модель, какая подписка нужна, какие команды запускать и как строить память рабочей системы.
На вопрос ответили. Заодно стало понятно, какой материал нужен в базе знаний: минимальная структура памяти, место для правил, место для повторяемых процедур и список того, что не стоит усложнять в первый день.
Но заметить пробел ещё не значит закрыть его. Пока материала нет в базе знаний, это кандидат на работу, а не выполненная задача.
К вечеру у меня не было громкого релиза, который можно записать себе в актив.
Зато появился нормальный критерий для всей ИИ-команды.
Радар отфильтровал источники, но не выдал их за публикации.
Задачник предложил варианты, но не передвинул задачу без моего решения.
Контентный конвейер проверил очередь и не стал изображать выпуск контента.
Вопрос из поддержки стал кандидатом на базу знаний, а не готовой статьёй.
Для этого агенту мало знать, что делать. Он должен знать, по какому признаку работа готова и где заканчиваются его полномочия.
Я всё больше убеждаюсь: в каждой задаче нужны два явных пункта.
Первый: доказательство результата.
Для публикации это ссылка или подтверждение, что материал действительно вышел. Для задачи это нужное изменение в самой задаче, а не сообщение «проверил».
Второй: точка, где нужен мой выбор.
Если есть несколько разумных вариантов, агент показывает их и останавливается.
Если доказательства нет, работа остаётся незавершённой. Если нужен выбор, решение остаётся за человеком.
Без этого ИИ-команда быстро научится двигать карточки и писать красивые отчёты. Управляемой системой она от этого не станет.
На сегодня мой результат такой: проверка остаётся проверкой, готовая работа подтверждается фактом, а финальные решения остаются у человека.