Назад к статьям

Руководство по RAG

•Команда GPTIK
Руководство по RAG

Руководство по работе с RAG в GPTIK

Retrieval-Augmented Generation (RAG) — это технология, которая позволяет языковым моделям отвечать на вопросы на основе ваших собственных документов.

Как это работает?

RAG состоит из нескольких этапов:

  1. Индексирование — ваши документы разбиваются на фрагменты и преобразуются в векторные представления
  2. Поиск — при запросе находятся наиболее релевантные фрагменты
  3. Генерация — языковая модель использует найденные фрагменты для формирования ответа

Поддерживаемые форматы

GPTIK поддерживает следующие форматы документов:

  • PDF — отчёты, презентации, книги
  • TXT — текстовые файлы
  • DOCX — Microsoft Word документы
  • MD — Markdown файлы

Создание RAG пространства

Шаг 1: Создайте Space

curl -X POST https://api.gptik.ru/v1/rag/spaces \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "name": "Мои документы",
    "description": "Корпоративная база знаний"
  }'

Шаг 2: Загрузите документы

curl -X POST https://api.gptik.ru/v1/rag/documents \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -F "file=@document.pdf" \
  -F "space_id=YOUR_SPACE_ID"

Шаг 3: Выполните поиск

curl -X POST https://api.gptik.ru/v1/rag/search \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "query": "Какие услуги вы предоставляете?",
    "space_id": "YOUR_SPACE_ID",
    "limit": 5
  }'

Best Practices

1. Структурируйте документы

Для лучших результатов:

  • Используйте заголовки и подзаголовки
  • Разбивайте текст на логические блоки
  • Избегайте слишком больших документов (>10MB)

2. Оптимизируйте запросы

  • Формулируйте конкретные вопросы
  • Используйте ключевые слова из ваших документов
  • Экспериментируйте с параметром limit

3. Мониторинг качества

Проверяйте:

  • Релевантность найденных фрагментов
  • Точность ответов модели
  • Время отклика

Примеры использования

Корпоративная база знаний

Загрузите внутренние документы компании и позвольте сотрудникам быстро находить нужную информацию.

Техническая поддержка

Создайте базу знаний из документации продукта для автоматических ответов на вопросы клиентов.

Исследования

Анализируйте большие объёмы научных статей и получайте инсайты с помощью AI.

Заключение

RAG — это мощный инструмент для работы с вашими данными. Попробуйте прямо сейчас и убедитесь в его эффективности!


Вопросы? Напишите нам на support@gptik.ru

Как выбрать AI модель для вашего проекта

Как выбрать AI модель для вашего проекта

10 декабря 2024 г. • Команда GPTIK

Полное руководство по выбору оптимальной нейросети для разных задач и бюджетов

Три новые модели: GLM-5.3-Flash, Qwen3.8 Flash и DeepSeek V4 Flash Vision

Три новые модели: GLM-5.3-Flash, Qwen3.8 Flash и DeepSeek V4 Flash Vision

28 августа 2026 г. • Команда GPTIK

Добавили в каталог три мультимодальные модели с контекстом около миллиона токенов. Разбираем, чем они отличаются, где сильны и почему самая дорогая из них не самая умная.

Две новые модели в GPTIK: Qwen3.8 27B и GLM-5.3

Две новые модели в GPTIK: Qwen3.8 27B и GLM-5.3

19 августа 2026 г. • Команда GPTIK

Добавили в каталог Qwen3.8 27B, компактную модель, которая видит изображения и видео, и GLM-5.3 с контекстом в миллион токенов для работы с кодом. Рассказываем, что умеют, сколько стоят и кому пригодятся.

Семь новых моделей в GPTIK: Grok 4.6, Gemini 3.7 Flash, гигант Qwen3.8 и дешёвое распознавание речи

Семь новых моделей в GPTIK: Grok 4.6, Gemini 3.7 Flash, гигант Qwen3.8 и дешёвое распознавание речи

14 августа 2026 г. • Команда GPTIK

Обновили каталог: флагман Grok 4.6 со ступенчатым тарифом, быстрая Gemini 3.7 Flash, открытый гигант Qwen3.8 на 2,4 триллиона параметров, DeepSeek V4 Pro 0813 по старой цене и посекундная транскрибация Qwen3 ASR. Разбираем, что умеет каждая и кому пригодится.

Снизили цены: Gemini 3.6 Flash подешевела вдвое

Снизили цены: Gemini 3.6 Flash подешевела вдвое

14 августа 2026 г. • Команда GPTIK

Скидки в каталоге GPTIK: Gemini 3.6 Flash и её batch-вариант теперь стоят вдвое дешевле, Qwen3 VL 30B подешевела на 13% и вдобавок получила вдвое больший лимит ответа.

Новые модели в GPTIK: Grok 4.6, Qwen3.8 и дешёвая расшифровка аудио

Новые модели в GPTIK: Grok 4.6, Qwen3.8 и дешёвая расшифровка аудио

13 августа 2026 г. • Команда GPTIK

Добавили в каталог пять моделей: флагман SpaceXAI для долгих агентных прогонов, открытый Qwen3.8 на 2,4 триллиона параметров, вышедший из preview DeepSeek V4 Pro и две модели распознавания речи, которые дешевле Whisper в 13 и 30 раз.