#vector_store — Public Fediverse posts
Live and recent posts from across the Fediverse tagged #vector_store, aggregated by home.social.
-
Где заканчивается вызов LLM и начинается backend система: локальный RAG на FastAPI и Ollama
Хотел разобраться где заканчивается простой вызов локальной LLM и начинается backend система. Сначала всё выглядело просто: frontend отправляет вопрос, FastAPI принимает POST /ask, backend вызывает локальную модель через Ollama и возвращает ответ. Но стало понятно: для помощника по документации этого мало. Модель отвечает, но непонятно на какие документы она опирается, какие фрагменты попали в prompt, сколько времени занял каждый этап и что делать, если индекс устарел. В статье показываю не "как вообще устроен RAG", а путь от простого вызова локальной LLM к небольшому backend/RAG-проекту с API контрактом, request_id, логированием, sources, timings, rebuild index, negative tests и честными ограничениями. От LLM вызова к RAG системе
https://habr.com/ru/articles/1048252/
#rag #llm #fastapi #ollama #python #backend #embeddings #vector_store #request_id #локальная_llm
-
Делаем AI-официанта с помощью OpenAI Assistants API и Vector Store в Telegram
Что, если в качестве контекста нам необходимо, чтобы модель знала не только историю переписки с конкретным пользователем, но ещё и какую-то общую информацию про бизнес или продукт? Все эти проблемы призваны решить такие продукты OpenAI, как Assistants API и Vector Store . Vector Store — это векторное хранилище, в которое можно загрузить файлы с вашей документацией или базой знаний, они автоматически будут трансформированы в векторный формат, и при каждом запросе из хранилища будет выбираться только информация, актуальная для этого конкретного запроса, тем самым помогая модели точнее отвечать на вопросы и экономить токены.
https://habr.com/ru/articles/822249/
#openai #openai_api #assistants_api #vector_store #proxyapi #телеграмбот #yandexcloud