Как я сделал локальный RAG-сервис для SRE: ищем по документации, ранбукам и коду через OllamaНедавно делал учебный проект про автоматизацию документирования инцидентов. Поначалу планы были грандиозными: инциденты, таймлайны, интеграции с мониторингами, чатами, постмортемы, подсказки дежурным инженерам. Но довольно быстро стало понятно, что с временными и ресурсными ограничениями лучше не пытаться написать маленький PagerDuty. Поэтому я сузил задачу до более реалистичного ядра: локального RAG-сервиса, который ищет по документации, ранбукам и коду, а затем передаёт найденный контекст в LLM. Так появился llmortem — FastAPI-сервис, который можно подключить к OpenWebUI как OpenAI-compatible backend. В статье расскажу, как устроена архитектура, почему я начал с BM25, зачем индексировать docstring’и и какие ограничения у такого подхода.https://habr.com/ru/articles/1043928/#RAG #LLM #FastAPI #Python #Ollama #OpenWebUI #BM25 #SRE #ранбуки #OpenAIcompatible_API
Related
The amount of #AI trash on #Loops is starting to feel really annoying.If I had a Loops server I'd categorically ban all ...
The amount of #AI trash on #Loops is starting to feel really annoying.If I had a Loops server I'd categorically ban all forms of generated video, images, speech, and music.Only hum...
This coming Monday marks the 127th anniversary of Jorge Luis #Borges, so next week we'll revisit our recent episode expl...
This coming Monday marks the 127th anniversary of Jorge Luis #Borges, so next week we'll revisit our recent episode exploring the philosophical worlds of this mind-bending novelist...
📰 Google Gives Publishers a 'Preferred Sources' Button to Fight AI-Driven Traffic LossesGoogle is giving publishers a ne...
📰 Google Gives Publishers a 'Preferred Sources' Button to Fight AI-Driven Traffic LossesGoogle is giving publishers a new way to fight declining referral traffic from AI-powered se...