43 lines
3.5 KiB
Markdown
43 lines
3.5 KiB
Markdown
# micro-scout
|
|
|
|
Исследовательский проект быстрого локального скаута контекста для программного кода.
|
|
|
|
Скаут должен находить полезные исходные фрагменты, учитывать связи между символами и передавать контекст большой модели через небольшой агентский harness — цикл управления моделью и инструментами.
|
|
|
|
## Статус
|
|
|
|
Подготовлены исследование и план экспериментов. Реализация, обученные веса и собственные результаты измерений пока отсутствуют.
|
|
|
|
## Документация
|
|
|
|
- [Исследование и план разработки](docs/RESEARCH_RU.md): существующие решения, Graphify, архитектура, данные, обучение, оценка пользы, ресурсы и восьминедельный план.
|
|
- Дата исследования: 16 сентября 2026 года.
|
|
- В текущей смете исключена оплата вызовов модели-учителя и основной модели; учитываются обучение своей модели и инфраструктура.
|
|
|
|
## Предлагаемая архитектура
|
|
|
|
```text
|
|
Репозиторий и текущие изменения
|
|
→ граф символов и поисковые индексы
|
|
→ поиск кандидатов
|
|
→ маленькая модель отбора и выбора действий
|
|
→ исходные фрагменты с проверенными адресами
|
|
→ большая модель и проверка решения
|
|
```
|
|
|
|
Факты о репозитории хранятся во внешнем обновляемом индексе. Модель обучается выбирать полезный контекст и действия поиска на новых проектах.
|
|
|
|
## Первые эксперименты
|
|
|
|
1. Собрать минимальный harness с поиском, чтением символов и обходом графа.
|
|
2. Сравнить обычный поиск, графовый поиск и готовый ранжировщик на одинаковых задачах.
|
|
3. Измерить успешность решения, полную задержку, объём контекста и свежесть ссылок.
|
|
4. Проверить пользу собственного encoder и затем уменьшить его размер.
|
|
5. При подтверждённом эффекте обучать выбор действий и бюджета поиска.
|
|
|
|
## Критерий полезности
|
|
|
|
Сокращение времени решения при сохранении успешности на незнакомых репозиториях. Проверяются весь агентский цикл, дополнительные чтения и обновление индекса, а не только скорость отдельного вызова модели.
|
|
|
|
Целевые размеры моделей, задержки и бюджеты в исследовании являются гипотезами для проверки, а не опубликованными результатами micro-scout.
|