24 lines
2.3 KiB
Markdown
24 lines
2.3 KiB
Markdown
|
||
# CodeBase
|
||
|
||
Прототип базы знаний по коду проектов. На вход получает полный адрес .cproj файла, парсит код для составления графа с векторным представлением каждого метода. Способен ответить на вопрос по проекту, ища векторное совпадение по косинусному сходству и по взаимосвязям в графе
|
||
|
||
|
||
|
||
Patch Notes:
|
||
|
||
* v1: реализовано MVP, работаем только с шарпом, храним все в оперативе. В качестве LLM - qwen2.5-coder:7
|
||
* v2:
|
||
* Переезд на графовую базу данных Neo4j с автоматической инициализацией.
|
||
* С помощью Microsoft.CodeAnalysis.MSBuild парсит все зависимости, исключая попадание системных вызовов в дерево вызовов кода.
|
||
* Изменен промт: теперь анализируем не просто чанки, а дерево зависимостей
|
||
* Вся инфраструктура теперь в докере: база, питоновский скрипт для векторизации, llm
|
||
* НУЖЕН РЕФАКТОРИНГ
|
||
* НУЖЕН ПЕРЕСМОТР СКАЧИВАНИЯ LLM Внутри Ollama - долго
|
||
* Нужна проверка бага: парсинг сохраняется не сразу
|
||
* v2.1.1:
|
||
* Реализована попытка в мультипарсинг: шарп, с горем пополам питон, должен еще го и ts
|
||
* почищены лишние файлы, новая репа для работы с бд, отдельно вынесена иинициализация
|
||
* теперь ручка парсера принимает на вход путь к проекту, название и язык в виде enum
|
||
* расширение списка языков проиходит через enum и настройку appsetting посредством добавления строки вида язык:команда докера для сборки файла index через Scip
|
||
* установлен protobuf для работы с Scip |