Files
CodeAnalizer/README.md

18 lines
1.5 KiB
Markdown
Raw Permalink Blame History

This file contains ambiguous Unicode characters
This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.
# CodeBase
Прототип базы знаний по коду проектов. На вход получает полный адрес .cproj файла, парсит код для составления графа с векторным представлением каждого метода. Способен ответить на вопрос по проекту, ища векторное совпадение по косинусному сходству и по взаимосвязям в графе
Patch Notes:
* v1: реализовано MVP, работаем только с шарпом, храним все в оперативе. В качестве LLM - qwen2.5-coder:7
* v2:
* Переезд на графовую базу данных Neo4j с автоматической инициализацией.
* С помощью Microsoft.CodeAnalysis.MSBuild парсит все зависимости, исключая попадание системных вызовов в дерево вызовов кода.
* Изменен промт: теперь анализируем не просто чанки, а дерево зависимостей
* Вся инфраструктура теперь в докере: база, питоновский скрипт для векторизации, llm
* НУЖЕН РЕФАКТОРИНГ
* НУЖЕН ПЕРЕСМОТР СКАЧИВАНИЯ LLM Внутри Ollama - долго
* Нужна проверка бага: парсинг сохраняется не сразу