Files
micro-scout/README.md
T

3.5 KiB

micro-scout

Исследовательский проект быстрого локального скаута контекста для программного кода.

Скаут должен находить полезные исходные фрагменты, учитывать связи между символами и передавать контекст большой модели через небольшой агентский harness — цикл управления моделью и инструментами.

Статус

Подготовлены исследование и план экспериментов. Реализация, обученные веса и собственные результаты измерений пока отсутствуют.

Документация

  • Исследование и план разработки: существующие решения, Graphify, архитектура, данные, обучение, оценка пользы, ресурсы и восьминедельный план.
  • Дата исследования: 16 сентября 2026 года.
  • В текущей смете исключена оплата вызовов модели-учителя и основной модели; учитываются обучение своей модели и инфраструктура.

Предлагаемая архитектура

Репозиторий и текущие изменения
    → граф символов и поисковые индексы
    → поиск кандидатов
    → маленькая модель отбора и выбора действий
    → исходные фрагменты с проверенными адресами
    → большая модель и проверка решения

Факты о репозитории хранятся во внешнем обновляемом индексе. Модель обучается выбирать полезный контекст и действия поиска на новых проектах.

Первые эксперименты

  1. Собрать минимальный harness с поиском, чтением символов и обходом графа.
  2. Сравнить обычный поиск, графовый поиск и готовый ранжировщик на одинаковых задачах.
  3. Измерить успешность решения, полную задержку, объём контекста и свежесть ссылок.
  4. Проверить пользу собственного encoder и затем уменьшить его размер.
  5. При подтверждённом эффекте обучать выбор действий и бюджета поиска.

Критерий полезности

Сокращение времени решения при сохранении успешности на незнакомых репозиториях. Проверяются весь агентский цикл, дополнительные чтения и обновление индекса, а не только скорость отдельного вызова модели.

Целевые размеры моделей, задержки и бюджеты в исследовании являются гипотезами для проверки, а не опубликованными результатами micro-scout.