ChromaDB 2026: обзор встроенной векторной базы для RAG и памяти агентов
ChromaDB — векторная база, которая стартует в три строки кода и не требует сервера: сначала она стала стандартом RAG-прототипов, теперь умеет и распределённое облако. Разбираем, где встроенный режим заканчивается, сколько стоит Chroma Cloud и когда пора уходить на Qdrant.
Векторные БДRAGOpen source2026
Категория Векторная база для RAGЯзык ядра RustЛицензия Apache-2.0Релиз 1.5.9 · 05.05.2026Обновлено 05.10.2026
ChromaDB — открытая инфраструктура данных для AI: векторная база, которая одинаково умеет работать встроенно внутри Python-процесса и как клиент-серверный сервис. Именно из-за встроенного режима её берут в RAG-прототипы и в память агентов: коллекция поднимается без Docker, без отдельного хоста и без карты зарубежного облака. Вопрос обзора — где эта простота заканчивается и что делать дальше.
8,2
Оценка Qantcore
из 10 по методологии
29,4 тыс.
Звёзды GitHub
снято 05.10.2026
1.5.9
Последний релиз
05.05.2026
usage-based
Цена Cloud
по официальному прайсу
01Кратко: что это и для кого
Chroma хранит документы, их метаданные и эмбеддинги, умеет искать по плотным (dense) и разреженным (sparse) векторам, делает полнотекстовый и regex-поиск без эмбеддингов вообще и поддерживает мультимодальность — рядом с текстом можно индексировать изображения и другие типы данных. Официальная документация перечисляет это как встроенные возможности, а не как надстройки, которые надо докупать.
Ядро переписано на Rust и распространяется под Apache-2.0: версии 1.x дали распределённую архитектуру, схему коллекций, условные транзакции и форкинг коллекций. Клиенты есть для Python, TypeScript/JavaScript и Rust; режимы работы — «embedded» (внутри процесса) и «client-server» (отдельный сервис). Логика простая: прототип — встроенно, продакшен — сервер или Chroma Cloud.
Python-пакетchromadb 1.5.9 (PyPI, требует Python 3.9+)
Ключевые фичивстроенный и клиент-серверный режимы, dense + sparse + гибридный поиск, полнотекстовый и regex-поиск, фильтры по метаданным, мультимодальность, форкинг коллекций
ОблакоChroma Cloud: serverless, оплата по факту использования
Как проверялись данные
Мы не запускали собственный бенчмарк. Возможности — из официальной документации docs.trychroma.com, цены — из раздела Pricing той же документации (снято 05.10.2026), звёзды, форки и даты релизов — из GitHub API, версии пакета — из PyPI. Цены вендор может изменить: сверяйтесь по ссылке в источниках.
02Как устроена: от строки кода до сервера
Встроенный режим — это не «игрушечная» версия: это тот же движок, который в клиент-серверном режиме обслуживает приложение по сети. Разница в том, где живут данные и кто отвечает за их сохранность. Ниже — слои системы и точка, на которой обычно принимается решение о переходе на сервер.
Слои ChromaDB
Отдельно стоит отметить Sync: Chroma умеет синхронизировать данные из S3, GitHub-репозиториев и веб-страниц. Это снимает типовую ручную работу RAG-пайплайна — «скачать, распарсить, порезать на чанки, посчитать эмбеддинги, залить» — и переносит её в конфигурацию источника. По документации тарифицируется это отдельно: за гигабайт обработанных данных и за страницу извлечённого документа или скачанной веб-страницы.
Редакционные оценки ChromaDB по осям (из 10)
Баллы редакционные. Единственные внешние числа — звёзды, форки, версии и тарифы из первоисточников.
03Возможности: что реально закрывает
Chroma показывает себя там, где RAG нужен быстро и без инфраструктуры. Ниже — карта возможностей и то, где они упираются в ограничения.
Возможность
Что даёт
Ограничение
Встроенный режим
Коллекция в три строки кода, без сервера и Docker
Данные привязаны к процессу: для нескольких сервисов нужен серверный режим
Dense + sparse + гибрид
Смысловой поиск и точные термины в одном запросе
Настройку sparse-индекса нужно делать осознанно, а не «по умолчанию»
Полнотекстовый и regex-поиск
Поиск без эмбеддингов — по точным строкам
Полнотекстовые фильтры тарифицируются как дополнительные запросы
Фильтры по метаданным
Отсечение по условиям прямо в запросе
Часть продвинутых условий — только в Search API и облаке
Мультимодальность
Изображения и другие модальности рядом с текстом
Качество зависит от выбранной embedding-функции
Форкинг коллекций
Копия коллекции для экспериментов без дублирования данных
Доступно на Chroma Cloud и тарифицируется за запрос
Sync из S3, GitHub и веба
Загрузка источников без ручного парсинга
Тарифицируется отдельно — по данным и страницам
Составлено по официальной документации docs.trychroma.com (05.10.2026). Тарифные детали — в разделе 04.
Практическое правило
Держите прототип на встроенном режиме, но не тащите его в прод по инерции. Признаки, что пора на сервер: данные нужны двум и более сервисам, требуется бэкап по расписанию или коллекция перестала помещаться в память процесса.
04Сколько стоит: OSS и Chroma Cloud
Открытая версия бесплатна — и это главный аргумент Chroma для команд из России: встроенный режим не требует ни карты, ни зарубежного облака. Chroma Cloud — serverless-сервис: платите по факту использования, без выделенного кластера и фиксированной ставки за инстанс. Прайс опубликован в документации и устроен нестандартно — отдельно за запись, чтение, хранение и синхронизацию.
Цены Chroma Cloud из официального раздела Pricing документации docs.trychroma.com (05.10.2026). Считайте свой профиль по калькулятору вендора: при больших объёмах чтения сумма зависит от длины полей, а не только от числа векторов.
Отдельно тарифицируются Sync-источники: $0,01 за страницу извлечённого документа и за скачанную веб-страницу. Тарифы вендор меняет — сверяйтесь по ссылке в источниках.
Звёзды GitHub у открытых векторных базтыс. звёзд, снято 05.10.2026
Источник: GitHub API, поле stargazers_count. ChromaDB — вторая по популярности открытая векторная база из этой выборки, но для выбора движка важнее тесты на своих данных.
Звёзды и форки у встроенных и серверных баз
GitHub API, 05.10.2026. pgvector — расширение PostgreSQL: он не конкурент Chroma напрямую, но часто выигрывает там, где база уже есть.
05ChromaDB, Qdrant и LanceDB: что выбрать
Все три базы открыты под Apache-2.0 и написаны на Rust, но живут в разных местах: Chroma — рядом с приложением, Qdrant — отдельным сервером, LanceDB — вообще без сервиса, поверх файлового формата. Ошибка — выбирать по звёздам; выбирать нужно по тому, где будет храниться индекс и кто будет его обслуживать.
Критерий
ChromaDB
Qdrant
LanceDB
Старт
встроенно, 3 строки кода
нужен сервис (или Edge)
встроенно, без сервиса
Прод-нагрузка
сервер или Cloud
сервер изначально
зависит от сценария
Гибридный поиск
dense + sparse + FTS
dense + sparse
частично
Мультимодальность
да
да
нет
Форкинг коллекций
да (Cloud)
нет
нет
Тариф облака
usage-based
free tier, затем usage-based
уточняйте на официальном сайте
Релиз на 05.10.2026
1.5.9 (05.05.2026)
v1.19.1 (04.09.2026)
по данным репозитория
Сводка по официальной документации проектов и GitHub API. Номера релизов быстро устаревают — проверяйте в репозиториях.
06Плюсы, минусы и кому подходит
Плюс: самый быстрый старт среди векторных баз — коллекция без сервера и без карты.
Плюс: полнотекстовый и regex-поиск без эмбеддингов закрывает задачи поиска по точным строкам.
Плюс: открытая лицензия и работа в РФ-контуре без зарубежных платежей.
Плюс: Sync из S3, GitHub и веба убирает ручной парсинг источников.
Минус: встроенный режим — не прод: данные привязаны к процессу.
Минус: тарификация Cloud устроена сложнее инстанс-часов: счёт зависит от объёмов чтения и длины запросов.
Минус: для очень больших коллекций серверные движки вроде Qdrant остаются предсказуемее.
Вердикт Qantcore
8,2/ 10
ChromaDB — лучший вход в RAG: стартует без инфраструктуры и одинаково понятна в прототипе и в клиент-серверном режиме. Оценка 8,2 — редакционная; внешние данные (звёзды, релизы, тарифы) взяты из GitHub API, PyPI и официальной документации за 05.10.2026.
07Быстрый старт и переход на сервер
Встроенный старт — три строки. Дальше полезно сразу отделить интерфейс доступа от реализации, чтобы переход на серверный режим был заменой адреса, а не переписыванием кода.
Встроенный клиент и серверный клиент — это разные конструкторы. Заранее вынесите создание клиента в отдельную функцию: тогда перенос на сервер сведётся к смене одной строки, а не к правке всего пайплайна.
Это векторная база, которая ставится как обычная Python-библиотека: вы создаёте коллекцию и сразу складываете туда документы с метаданными и эмбеддингами. Сервер и зарубежный платёж для базового сценария не нужны.
ChromaDB бесплатна?
Открытая версия под Apache-2.0 бесплатна, включая клиент-серверный режим на своём хостинге. Платной является Chroma Cloud: там оплата по факту использования — запись, чтение, хранение и синхронизация считаются отдельно по опубликованному прайсу.
Чем ChromaDB отличается от Qdrant?
Режимом работы. Chroma стартует встроенно внутри процесса и легко переходит в клиент-серверный режим; Qdrant — изначально серверная база с фильтрами и квантованием под большие объёмы. Прототип — Chroma; крупная прод-нагрузка — чаще Qdrant.
Подходит ли ChromaDB для продакшена?
Да, но не во встроенном режиме: для продакшена нужен клиент-серверный вариант или Chroma Cloud, иначе данные окажутся привязаны к процессу и не переживут его перезапуск штатно. Второе условие — посчитать профиль расходов облака на своих объёмах чтения.
Как искать по точным словам, а не по смыслу?
В Chroma есть полнотекстовый и regex-поиск по документам, без эмбеддингов. При этом учитывайте тарификацию: в облаке полнотекстовый предикат считается дополнительными запросами, и счёт растёт от длины строки поиска.