3.5 KiB
micro-scout
Исследовательский проект быстрого локального скаута контекста для программного кода.
Скаут должен находить полезные исходные фрагменты, учитывать связи между символами и передавать контекст большой модели через небольшой агентский harness — цикл управления моделью и инструментами.
Статус
Подготовлены исследование и план экспериментов. Реализация, обученные веса и собственные результаты измерений пока отсутствуют.
Документация
- Исследование и план разработки: существующие решения, Graphify, архитектура, данные, обучение, оценка пользы, ресурсы и восьминедельный план.
- Дата исследования: 16 сентября 2026 года.
- В текущей смете исключена оплата вызовов модели-учителя и основной модели; учитываются обучение своей модели и инфраструктура.
Предлагаемая архитектура
Репозиторий и текущие изменения
→ граф символов и поисковые индексы
→ поиск кандидатов
→ маленькая модель отбора и выбора действий
→ исходные фрагменты с проверенными адресами
→ большая модель и проверка решения
Факты о репозитории хранятся во внешнем обновляемом индексе. Модель обучается выбирать полезный контекст и действия поиска на новых проектах.
Первые эксперименты
- Собрать минимальный harness с поиском, чтением символов и обходом графа.
- Сравнить обычный поиск, графовый поиск и готовый ранжировщик на одинаковых задачах.
- Измерить успешность решения, полную задержку, объём контекста и свежесть ссылок.
- Проверить пользу собственного encoder и затем уменьшить его размер.
- При подтверждённом эффекте обучать выбор действий и бюджета поиска.
Критерий полезности
Сокращение времени решения при сохранении успешности на незнакомых репозиториях. Проверяются весь агентский цикл, дополнительные чтения и обновление индекса, а не только скорость отдельного вызова модели.
Целевые размеры моделей, задержки и бюджеты в исследовании являются гипотезами для проверки, а не опубликованными результатами micro-scout.