home.social

#manticore_search — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #manticore_search, aggregated by home.social.

  1. [Перевод] Как Bookbot использует Manticore Search для 3.5 млн сохранённых запросов и канала с 10% выручки

    Как Bookbot использует Manticore Search для поиска по 1.29 млн подержанных книг, сопоставляет новые поступления с 3.5 млн сохранённых запросов и развивает канал, на который приходится около 10% выручки.

    habr.com/ru/articles/1083254/

    #Manticore_Search #Bookbot #полнотекстовый_поиск #обратный_поиск #percolate #электронная_коммерция

  2. [Перевод] Как Bookbot использует Manticore Search для 3.5 млн сохранённых запросов и канала с 10% выручки

    Как Bookbot использует Manticore Search для поиска по 1.29 млн подержанных книг, сопоставляет новые поступления с 3.5 млн сохранённых запросов и развивает канал, на который приходится около 10% выручки.

    habr.com/ru/articles/1083254/

    #Manticore_Search #Bookbot #полнотекстовый_поиск #обратный_поиск #percolate #электронная_коммерция

  3. [Перевод] Как Bookbot использует Manticore Search для 3.5 млн сохранённых запросов и канала с 10% выручки

    Как Bookbot использует Manticore Search для поиска по 1.29 млн подержанных книг, сопоставляет новые поступления с 3.5 млн сохранённых запросов и развивает канал, на который приходится около 10% выручки.

    habr.com/ru/articles/1083254/

    #Manticore_Search #Bookbot #полнотекстовый_поиск #обратный_поиск #percolate #электронная_коммерция

  4. [Перевод] Улучшенный векторный поиск по длинным документам: чанкинг внутри Manticore Search

    Модель эмбеддингов читает только первые несколько сотен токенов документа, а остальное молча отбрасывает. Теперь Manticore Search сам разбивает длинные документы при INSERT: добавьте chunk_strategy к векторному столбцу и выберите одну из пяти стратегий. Без конвейера загрузки и библиотек для разбиения текста. На нашей документации recall@5 для текста за пределами окна модели вырос с 55% до 83%.

    habr.com/ru/articles/1082760/

    #Manticore_Search #векторный_поиск #эмбеддинги #чанкинг #семантический_поиск

  5. [Перевод] Улучшенный векторный поиск по длинным документам: чанкинг внутри Manticore Search

    Модель эмбеддингов читает только первые несколько сотен токенов документа, а остальное молча отбрасывает. Теперь Manticore Search сам разбивает длинные документы при INSERT: добавьте chunk_strategy к векторному столбцу и выберите одну из пяти стратегий. Без конвейера загрузки и библиотек для разбиения текста. На нашей документации recall@5 для текста за пределами окна модели вырос с 55% до 83%.

    habr.com/ru/articles/1082760/

    #Manticore_Search #векторный_поиск #эмбеддинги #чанкинг #семантический_поиск

  6. [Перевод] Улучшенный векторный поиск по длинным документам: чанкинг внутри Manticore Search

    Модель эмбеддингов читает только первые несколько сотен токенов документа, а остальное молча отбрасывает. Теперь Manticore Search сам разбивает длинные документы при INSERT: добавьте chunk_strategy к векторному столбцу и выберите одну из пяти стратегий. Без конвейера загрузки и библиотек для разбиения текста. На нашей документации recall@5 для текста за пределами окна модели вырос с 55% до 83%.

    habr.com/ru/articles/1082760/

    #Manticore_Search #векторный_поиск #эмбеддинги #чанкинг #семантический_поиск