← Оглавление
AI-native компания V2
Глава 5 из 12

Часть II · Операционная модель

Контекст, память и навыки

источники · память · навыки агента

Качество ИИ-системы зависит не от объёма текста, который ей передали, а от пригодности данных и правил для конкретного решения. Большой неотобранный контекст увеличивает расходы, скрывает противоречия и усложняет расследование.

Постоянный и оперативный контекст следует разделять и версионировать. [G1-D1-p16], The New SDLC With Vibe Coding_Day_1.pdf, с. 16.

Постоянный контекст #

Постоянный контекст меняется сравнительно редко и применяется ко многим задачам:

  • цели и границы продукта;
  • архитектурные решения;
  • стандарты разработки;
  • правила безопасности;
  • определения показателей;
  • допустимые источники;
  • требования к выпуску;
  • инструкция и примеры для повторяемой работы.

У постоянного контекста есть владелец, версия, дата действия и порядок изменения. «Постоянный» не означает вечный.

Оперативный контекст #

Оперативный контекст относится к текущей задаче:

  • запрос пользователя;
  • затронутые записи или файлы;
  • свежие показатели;
  • состояние процесса;
  • результаты вызванных инструментов;
  • история действий этой сессии;
  • текущие согласования и ограничения времени.

После завершения задачи его не следует целиком переносить в постоянную память. Сначала владелец выбирает полезный факт, удаляет лишние данные, проверяет источник и определяет срок хранения.

Реестр источников #

Для каждого источника запишите:

Реестр источников: таблица 6
ПолеСмысл
НазваниеУстойчивое имя источника
ВладелецКто отвечает за смысл и доступность
ПроисхождениеГде и как данные появились
Разрешённое использованиеДля каких решений их можно применять
ЧувствительностьКакие ограничения действуют
СвежестьКакой возраст допустим
Версия или времяКак воспроизвести использованный срез
ДоступКакая служебная роль читает или меняет данные
ОтзывКак отключить источник
ПроверкаКак обнаружить пропуск, конфликт или устаревание

Источник без владельца можно использовать только как непроверенную подсказку, если риск это допускает. Он не должен незаметно становиться основанием действия.

Отбор контекста #

Рекомендация. Отбирайте контекст по решению, а не по принципу «всё, что помещается».

Для каждого фрагмента задайте четыре вопроса:

  1. Какое решение он меняет?
  2. Кто отвечает за его точность?
  3. Насколько свежим он должен быть?
  4. Можно ли показать, что система действительно его использовала?

Плотный релевантный контекст обычно полезнее большого неотобранного. Это практический принцип, а его состав и пределы нужно проверять на задачах команды. [G1-D1-p42], The New SDLC With Vibe Coding_Day_1.pdf, с. 42.

Поиск по внутренним материалам может использовать полнотекстовый индекс, граф связей, структурированный запрос или извлечение фрагментов. Векторная база не является обязательной архитектурой. Выбор зависит от формы данных, свежести, объяснимости и расходов.

Память как управляемая запись #

Полезная память отвечает на один из трёх вопросов:

  • что произошло;
  • какое решение было принято и почему;
  • что нужно проверить в следующий раз.

Запись памяти содержит источник, дату, область действия и срок пересмотра. Вывод модели без подтверждения помечается как предположение.

Для критического процесса запретите автоматическое превращение результата в правило. Система может предложить изменение.

Владелец проверяет его на наборе случаев, получает согласование и выпускает новую версию. Такой порядок принят и для изменений навыка. [G1-D3-p37], Agent Skills_Day_3.pdf, с. 37.

Навык агента #

Навык агента — версионируемый набор инструкций, примеров и вспомогательных материалов для повторяемой задачи.

Навык является зависимостью. Он не гарантирует качество сам по себе. Результат зависит от модели, оперативного контекста, инструментов, соседних навыков и среды.

Минимальная карточка навыка содержит:

  • название и назначение;
  • признаки, когда навык применять и когда не применять;
  • входы и ожидаемый выход;
  • разрешённые инструменты;
  • пределы полномочий;
  • порядок действий;
  • примеры обычных и пограничных случаев;
  • проверки результата и хода;
  • владельца, версию и журнал изменений;
  • совместимые версии среды;
  • способ отключения.

Официальная спецификация Agent Skills описывает каталог, файл SKILL.md, метаданные и постепенную загрузку материалов. Соответствие формату не доказывает правильность или безопасность поведения. [AGENT-SKILLS-spec]

Постепенная загрузка #

Сначала система видит короткое описание навыка. Полную инструкцию она загружает после выбора. Вспомогательные файлы открываются только при необходимости.

Такая постепенная загрузка уменьшает постоянный контекст и делает выбор навыка наблюдаемым. [G1-D3-p10], Agent Skills_Day_3.pdf, с. 10.

Такой механизм создаёт отдельный объект проверки — маршрутизацию. Нужно узнать:

  • выбрала ли система нужный навык;
  • отказалась ли от неподходящего;
  • не загрузила ли лишний чувствительный материал;
  • уложилась ли в предел контекста;
  • сохранилось ли поведение после добавления соседнего навыка.

Как проверять навык #

Проверка навыка состоит из пяти частей.

  1. Маршрутизация. Правильно ли распознаны условия применения и отказа?
  2. Результат. Соответствует ли выход критериям задачи?
  3. Ход действий. Использованы ли допустимые инструменты, порядок и права?
  4. Расход. Как изменились время, контекст, вызовы и человеческая проверка?
  5. Регрессии библиотеки. Не ухудшились ли соседние навыки?

Такой набор покрывает ошибки, которые не видны при проверке одного удачного ответа. [G1-D3-p20], Agent Skills_Day_3.pdf, с. 20.

SkillsBench и SWE-Skills-Bench показывают, что навыки можно оценивать на повторяемых наборах задач. Их результаты не переносятся автоматически в другую среду и не являются производственной сертификацией. [SKILLSBENCH-2026] [SWE-SKILLS-BENCH-2026]

Универсального порога «90 процентов» для всех навыков нет. Утверждение об отраслевом стандарте не имеет независимого основания. [G1-D3-p22], Agent Skills_Day_3.pdf, с. 22.

Внешние навыки и подключения #

Внешний навык может читать контекст, запускать программу и меняться независимо. Поэтому:

  • закрепите точную версию или проверенный коммит;
  • прочитайте инструкции и код;
  • перечислите сетевые обращения и данные;
  • запускайте в изоляции;
  • дайте минимальные права;
  • проверьте обновление до выпуска;
  • храните возможность быстрого отключения.

Поэтому внешний навык проверяют как кодовую зависимость. [G1-D3-p43], Agent Skills_Day_3.pdf, с. 43.

Условный пример #

Команда создаёт навык подготовки описания изменения.

Постоянный контекст содержит стандарт описания, классы риска и правила доказательств. Оперативный контекст содержит задачу, изменённые файлы, результаты тестов и список зависимостей. Навык готовит черновик, но не утверждает риск.

Владелец навыка — инженер по качеству процесса разработки.

Проверки включают выбор навыка только для изменения кода, полноту обязательных полей, запрет выдуманных тестов и ссылку на фактический журнал. Обновление навыка проходит на сохранённом наборе запросов на слияние.

Рабочая карточка главы #

Решение. Определить минимальный постоянный и оперативный контекст для одного решения, а повторяемую процедуру оформить как проверяемый навык.

Минимальный механизм. Реестр источников, правила отбора и хранения, версионируемый навык и пять видов проверки.

Ответственный. Владелец процесса отвечает за достаточность. Владельцы данных подтверждают происхождение и доступ. Владелец навыка отвечает за версию и проверочный набор.

Артефакт. Реестр контекста и карточка навыка с версией, совместимостью и доказательствами проверки.

Критерий готовности. Для любого значимого результата можно восстановить версии постоянного контекста, оперативные источники и выбранный навык. Обновление можно проверить и откатить.

Показатели результата.

  • доля результатов с подтверждёнными источниками;
  • точность выбора навыка на согласованном наборе;
  • принятие результата без исправления;
  • время обновления устаревшего источника;
  • повторное использование навыка после отдельной приёмки.

Показатели риска.

  • доля источников без владельца;
  • число устаревших правил в рабочем контексте;
  • обращения к источникам вне разрешённой области;
  • необъяснимые изменения маршрутизации;
  • регрессии после обновления навыка;
  • объём чувствительных данных в журналах и памяти.

Типичные ошибки.

  • загружать все документы;
  • считать хранилище поиском и памятью одновременно;
  • сохранять весь разговор как знание;
  • менять правило напрямую по одному результату;
  • считать формат навыка доказательством качества;
  • обновлять внешний навык без закрепления версии и проверки.

Различия маршрутов. Стартап начинает с короткого реестра и одного общего навыка после подтверждения повторяемости.

Зрелая компания назначает владельцев доменов данных, правила свежести и совместимость библиотек навыков. Общая библиотека появляется после работающих локальных навыков.

Чек-лист.