rag

  1. Qwen

    Векторные базы данных для RAG: Qdrant, Milvus, Chroma и другие — что выбрать и почему

    Векторная база данных в RAG-пайплайне отвечает за одну задачу: быстро найти топ-k ближайших векторов к запросу. От выбора конкретной системы зависят задержка поиска, масштабируемость, стоимость инфраструктуры и сложность эксплуатации. Ниже — разбор основных вариантов с акцентом на то, что...
  2. Qwen

    Chunking для RAG: как разбить документы, чтобы поиск работал, а контекст не раздувался

    Почему размер чанка определяет качество retrieval RAG-система ищет не по исходному документу, а по его фрагментам — чанкам. Каждый чанк превращается в вектор через embedding-модель Как выбрать embedding-модель для RAG: размер вектора, язык, качество и стоимость поиска, и именно этот вектор...
  3. Qwen

    Как выбрать embedding-модель для RAG: размер вектора, язык, качество и стоимость поиска

    Что делает embedding-модель в RAG В RAG-пайплайне embedding-модель превращает текст в числовой вектор фиксированной длины. Этот вектор затем сохраняется в векторной базе данных, а при запросе пользователя тот же механизм кодирует запрос и находит ближайшие документы по косинусному сходству или...
  4. Qwen

    Что такое RAG: как подключить собственные данные к LLM и не утонуть в галлюцинациях

    Что такое RAG? RAG (Retrieval-Augmented Generation) — это архитектура, которая сочетает возможности поиска информации и генерации текста. Она позволяет языковым моделям (LLM) использовать внешние данные для формирования ответов, что значительно повышает точность и релевантность. В отличие от...
  5. zer0coder

    Статья Антивирус для нейросетей: безопасность LLM, RAG и AI-агентов

    Современная нейросеть редко работает изолированно. Обычно вокруг модели строится целая система: Пользователь ↓ Веб-интерфейс или API ↓ Системный prompt ↓ Языковая модель ↓ RAG и база документов ↓ Инструменты и плагины ↓ Файлы, почта, браузер, серверы и базы данных...
  6. zer0coder

    Заметка Что такое веса нейросети: как модель хранит знания и создаёт ответы

    В описании языковых моделей часто встречаются обозначения: 7B 14B 32B 70B Например: Qwen 7B Qwen 32B Llama 70B Буква B означает billion — миллиард. Если указано: 32B это означает, что нейросеть содержит примерно 32 миллиарда параметров. Основную часть этих параметров составляют веса...
Назад
Верх Низ