ОБЗОР · ВЕКТОРНЫЕ БАЗЫ

ChromaDB 2026: обзор встроенной векторной базы для RAG и памяти агентов

ChromaDB — векторная база, которая стартует в три строки кода и не требует сервера: сначала она стала стандартом RAG-прототипов, теперь умеет и распределённое облако. Разбираем, где встроенный режим заканчивается, сколько стоит Chroma Cloud и когда пора уходить на Qdrant.

Векторные БДRAGOpen source2026
Категория Векторная база для RAGЯзык ядра RustЛицензия Apache-2.0Релиз 1.5.9 · 05.05.2026Обновлено 05.10.2026

ChromaDB — открытая инфраструктура данных для AI: векторная база, которая одинаково умеет работать встроенно внутри Python-процесса и как клиент-серверный сервис. Именно из-за встроенного режима её берут в RAG-прототипы и в память агентов: коллекция поднимается без Docker, без отдельного хоста и без карты зарубежного облака. Вопрос обзора — где эта простота заканчивается и что делать дальше.

8,2
Оценка Qantcore
из 10 по методологии
29,4 тыс.
Звёзды GitHub
снято 05.10.2026
1.5.9
Последний релиз
05.05.2026
usage-based
Цена Cloud
по официальному прайсу

01Кратко: что это и для кого

Chroma хранит документы, их метаданные и эмбеддинги, умеет искать по плотным (dense) и разреженным (sparse) векторам, делает полнотекстовый и regex-поиск без эмбеддингов вообще и поддерживает мультимодальность — рядом с текстом можно индексировать изображения и другие типы данных. Официальная документация перечисляет это как встроенные возможности, а не как надстройки, которые надо докупать.

Ядро переписано на Rust и распространяется под Apache-2.0: версии 1.x дали распределённую архитектуру, схему коллекций, условные транзакции и форкинг коллекций. Клиенты есть для Python, TypeScript/JavaScript и Rust; режимы работы — «embedded» (внутри процесса) и «client-server» (отдельный сервис). Логика простая: прототип — встроенно, продакшен — сервер или Chroma Cloud.

Карточка ChromaDB
РазработчикChroma (trychroma.com)
Язык ядраRust
ЛицензияApache-2.0
Репозиторийgithub.com/chroma-core/chroma — 29 439 звёзд, 2 547 форков (05.10.2026)
Стабильный релиз1.5.9 от 05.05.2026
Python-пакетchromadb 1.5.9 (PyPI, требует Python 3.9+)
Ключевые фичивстроенный и клиент-серверный режимы, dense + sparse + гибридный поиск, полнотекстовый и regex-поиск, фильтры по метаданным, мультимодальность, форкинг коллекций
ОблакоChroma Cloud: serverless, оплата по факту использования
Как проверялись данные
Мы не запускали собственный бенчмарк. Возможности — из официальной документации docs.trychroma.com, цены — из раздела Pricing той же документации (снято 05.10.2026), звёзды, форки и даты релизов — из GitHub API, версии пакета — из PyPI. Цены вендор может изменить: сверяйтесь по ссылке в источниках.

02Как устроена: от строки кода до сервера

Встроенный режим — это не «игрушечная» версия: это тот же движок, который в клиент-серверном режиме обслуживает приложение по сети. Разница в том, где живут данные и кто отвечает за их сохранность. Ниже — слои системы и точка, на которой обычно принимается решение о переходе на сервер.

Слои ChromaDB
КлиентPython, JS или Rust: создаёт или подключается к коллекцииприложениеКоллекцияДокументы, метаданные, эмбеддинги, схема и настройки индексаданныеИндексы и поискDense-векторы, sparse-векторы, полнотекстовый и regex-поиск, гибрид с RRFиндексыХранилищеЛокальные файлы во встроенном режиме; серверный процесс или Chroma Cloud в продакшене

Отдельно стоит отметить Sync: Chroma умеет синхронизировать данные из S3, GitHub-репозиториев и веб-страниц. Это снимает типовую ручную работу RAG-пайплайна — «скачать, распарсить, порезать на чанки, посчитать эмбеддинги, залить» — и переносит её в конфигурацию источника. По документации тарифицируется это отдельно: за гигабайт обработанных данных и за страницу извлечённого документа или скачанной веб-страницы.

Редакционные оценки ChromaDB по осям (из 10)
Простота старта9,4RAG-прототип из коробки9Гибридный и полнотекстовый поиск8,4Экосистема и интеграции8,6Готовность к большому продакшену7
Баллы редакционные. Единственные внешние числа — звёзды, форки, версии и тарифы из первоисточников.

03Возможности: что реально закрывает

Chroma показывает себя там, где RAG нужен быстро и без инфраструктуры. Ниже — карта возможностей и то, где они упираются в ограничения.

ВозможностьЧто даётОграничение
Встроенный режимКоллекция в три строки кода, без сервера и DockerДанные привязаны к процессу: для нескольких сервисов нужен серверный режим
Dense + sparse + гибридСмысловой поиск и точные термины в одном запросеНастройку sparse-индекса нужно делать осознанно, а не «по умолчанию»
Полнотекстовый и regex-поискПоиск без эмбеддингов — по точным строкамПолнотекстовые фильтры тарифицируются как дополнительные запросы
Фильтры по метаданнымОтсечение по условиям прямо в запросеЧасть продвинутых условий — только в Search API и облаке
МультимодальностьИзображения и другие модальности рядом с текстомКачество зависит от выбранной embedding-функции
Форкинг коллекцийКопия коллекции для экспериментов без дублирования данныхДоступно на Chroma Cloud и тарифицируется за запрос
Sync из S3, GitHub и вебаЗагрузка источников без ручного парсингаТарифицируется отдельно — по данным и страницам
Составлено по официальной документации docs.trychroma.com (05.10.2026). Тарифные детали — в разделе 04.
Практическое правило
Держите прототип на встроенном режиме, но не тащите его в прод по инерции. Признаки, что пора на сервер: данные нужны двум и более сервисам, требуется бэкап по расписанию или коллекция перестала помещаться в память процесса.

04Сколько стоит: OSS и Chroma Cloud

Открытая версия бесплатна — и это главный аргумент Chroma для команд из России: встроенный режим не требует ни карты, ни зарубежного облака. Chroma Cloud — serverless-сервис: платите по факту использования, без выделенного кластера и фиксированной ставки за инстанс. Прайс опубликован в документации и устроен нестандартно — отдельно за запись, чтение, хранение и синхронизацию.

оптимально
Open source (встроенно)
бесплатнолицензия Apache-2.0
  • Коллекция внутри процесса
  • Dense, sparse и гибридный поиск
  • Ни карты, ни сервера
  • Свои бэкапы файлов данных
Open source (server)
бесплатносвой хостинг
  • Клиент-серверный режим
  • Общая коллекция для нескольких сервисов
  • Эксплуатация на вашей стороне
Chroma Cloud
$2,50 / логический GiB записиusage-based, serverless
  • $0,0075 за TiB просканированного
  • $0,09 за GiB возвращённых данных
  • $0,33 за GiB·месяц хранения
  • $0,03 за форк коллекции
  • Sync: $0,04 за GiB обработанных данных
Цены Chroma Cloud из официального раздела Pricing документации docs.trychroma.com (05.10.2026). Считайте свой профиль по калькулятору вендора: при больших объёмах чтения сумма зависит от длины полей, а не только от числа векторов.
Отдельно тарифицируются Sync-источники: $0,01 за страницу извлечённого документа и за скачанную веб-страницу. Тарифы вендор меняет — сверяйтесь по ссылке в источниках.
Звёзды GitHub у открытых векторных базтыс. звёзд, снято 05.10.2026
0 тыс.20 тыс.40 тыс.Qdrant34,9 тыс.ChromaDB29,4 тыс.pgvector23,2 тыс.Weaviate16,9 тыс.LanceDB11,6 тыс.
Источник: GitHub API, поле stargazers_count. ChromaDB — вторая по популярности открытая векторная база из этой выборки, но для выбора движка важнее тесты на своих данных.
Звёзды и форки у встроенных и серверных баз
010203040ChromaDBQdrantLanceDBpgvector29,434,911,623,22,52,71,11,3Звёзды, тыс.Форки, тыс.
GitHub API, 05.10.2026. pgvector — расширение PostgreSQL: он не конкурент Chroma напрямую, но часто выигрывает там, где база уже есть.

05ChromaDB, Qdrant и LanceDB: что выбрать

Все три базы открыты под Apache-2.0 и написаны на Rust, но живут в разных местах: Chroma — рядом с приложением, Qdrant — отдельным сервером, LanceDB — вообще без сервиса, поверх файлового формата. Ошибка — выбирать по звёздам; выбирать нужно по тому, где будет храниться индекс и кто будет его обслуживать.

КритерийChromaDBQdrantLanceDB
Стартвстроенно, 3 строки коданужен сервис (или Edge)встроенно, без сервиса
Прод-нагрузкасервер или Cloudсервер изначальнозависит от сценария
Гибридный поискdense + sparse + FTSdense + sparseчастично
Мультимодальностьдаданет
Форкинг коллекцийда (Cloud)нетнет
Тариф облакаusage-basedfree tier, затем usage-basedуточняйте на официальном сайте
Релиз на 05.10.20261.5.9 (05.05.2026)v1.19.1 (04.09.2026)по данным репозитория
Сводка по официальной документации проектов и GitHub API. Номера релизов быстро устаревают — проверяйте в репозиториях.

06Плюсы, минусы и кому подходит

  • Плюс: самый быстрый старт среди векторных баз — коллекция без сервера и без карты.
  • Плюс: полнотекстовый и regex-поиск без эмбеддингов закрывает задачи поиска по точным строкам.
  • Плюс: открытая лицензия и работа в РФ-контуре без зарубежных платежей.
  • Плюс: Sync из S3, GitHub и веба убирает ручной парсинг источников.
  • Минус: встроенный режим — не прод: данные привязаны к процессу.
  • Минус: тарификация Cloud устроена сложнее инстанс-часов: счёт зависит от объёмов чтения и длины запросов.
  • Минус: для очень больших коллекций серверные движки вроде Qdrant остаются предсказуемее.
Вердикт Qantcore
8,2/ 10
ChromaDB — лучший вход в RAG: стартует без инфраструктуры и одинаково понятна в прототипе и в клиент-серверном режиме. Оценка 8,2 — редакционная; внешние данные (звёзды, релизы, тарифы) взяты из GitHub API, PyPI и официальной документации за 05.10.2026.

07Быстрый старт и переход на сервер

Встроенный старт — три строки. Дальше полезно сразу отделить интерфейс доступа от реализации, чтобы переход на серверный режим был заменой адреса, а не переписыванием кода.

pythonpython
import chromadb

client = chromadb.Client()
collection = client.get_or_create_collection(name="docs")
terminalbash
pip install chromadb==1.5.9
Не путайте режимы
Встроенный клиент и серверный клиент — это разные конструкторы. Заранее вынесите создание клиента в отдельную функцию: тогда перенос на сервер сведётся к смене одной строки, а не к правке всего пайплайна.

Частые вопросы

ChromaDB что это простыми словами?
Это векторная база, которая ставится как обычная Python-библиотека: вы создаёте коллекцию и сразу складываете туда документы с метаданными и эмбеддингами. Сервер и зарубежный платёж для базового сценария не нужны.
ChromaDB бесплатна?
Открытая версия под Apache-2.0 бесплатна, включая клиент-серверный режим на своём хостинге. Платной является Chroma Cloud: там оплата по факту использования — запись, чтение, хранение и синхронизация считаются отдельно по опубликованному прайсу.
Чем ChromaDB отличается от Qdrant?
Режимом работы. Chroma стартует встроенно внутри процесса и легко переходит в клиент-серверный режим; Qdrant — изначально серверная база с фильтрами и квантованием под большие объёмы. Прототип — Chroma; крупная прод-нагрузка — чаще Qdrant.
Подходит ли ChromaDB для продакшена?
Да, но не во встроенном режиме: для продакшена нужен клиент-серверный вариант или Chroma Cloud, иначе данные окажутся привязаны к процессу и не переживут его перезапуск штатно. Второе условие — посчитать профиль расходов облака на своих объёмах чтения.
Как искать по точным словам, а не по смыслу?
В Chroma есть полнотекстовый и regex-поиск по документам, без эмбеддингов. При этом учитывайте тарификацию: в облаке полнотекстовый предикат считается дополнительными запросами, и счёт растёт от длины строки поиска.

Источники и официальные ссылки

  • Документация Chromadocs.trychroma.com/docs/overview/introduction
    Возможности движка: хранение, эмбеддинги, поиск, мультимодальность.
  • Chroma Cloud: начало работыdocs.trychroma.com/cloud/getting-started
    Архитектура managed-сервиса и регионы.
  • Chroma Cloud: тарифыdocs.trychroma.com/cloud/pricing
    Единственный корректный источник цен за запись, чтение, хранение и Sync.
  • Репозиторий на GitHubgithub.com/chroma-core/chroma
    Звёзды, форки, релизы — данные для графиков (05.10.2026).
  • Пакет на PyPIpypi.org/project/chromadb/
    Версия пакета и требования к версии Python.
Собираете RAG или память агента?
В каталоге Qantcore — обзоры векторных баз, фреймворков и агентов по единой методике с проверяемыми цифрами.