qdrant-tenant-scaling

qdrant

Actualizado 6 days ago

158

Diseñodesign

Acerca de

Esta habilidad proporciona orientación sobre escalado de Qdrant para escenarios multi-tenant, desaconsejando los enfoques de colección por inquilino. Recomienda particionado basado en payload en colecciones compartidas y cubre shards dedicados para aislamiento de rendimiento. Úsela al abordar escalado de inquilinos, estrategias de aislamiento o problemas de rendimiento en cargas de trabajo multi-tenant en crecimiento.

Instalación rápida

Claude Code

Recomendado

Principal

npx skills add qdrant/skills -a claude-code

Comando PluginAlternativo

/plugin add https://github.com/qdrant/skills

Git CloneAlternativo

git clone https://github.com/qdrant/skills.git ~/.claude/skills/qdrant-tenant-scaling

Copia y pega este comando en Claude Code para instalar esta habilidad

Documentación

What to Do When Scaling Multi-Tenant Qdrant

Do not create one collection per tenant. Does not scale past a few hundred and wastes resources. One company hit the 1000 collection limit after a year of collection-per-repo and had to migrate to payload partitioning. Use a shared collection with a tenant key.

Understand multitenancy patterns Multitenancy

Here is a short summary of the patterns:

Number of Tenants is around 10k

Use the default multitenancy strategy via payload filtering.

Read about Partition by payload and Calibrate performance for best practices on indexing and query performance.

Number of Tenants is around 100k and more

At this scale, the cluster may consist of several peers. To localize tenant data and improve performance, use custom sharding to assign tenants to specific shards based on tenant ID hash. This will localize tenant requests to specific nodes instead of broadcasting them to all nodes, improving performance and reducing load on each node.

If tenants are unevenly sized

If some tenants are much larger than others, use tiered multitenancy to promote large tenants to dedicated shards while keeping small tenants on shared shards. This optimizes resource allocation and performance for tenants of varying sizes.

Need Strict Tenant Isolation

Use when: legal/compliance requirements demand per-tenant encryption or strict isolation beyond what payload filtering provides.

Multiple collections may be necessary for per-tenant encryption keys
Limit collection count and use payload filtering within each collection
This is the exception, not the default. Only use when compliance requires it.

What NOT to Do

Do not create one collection per tenant without compliance justification (does not scale past hundreds)
Do not skip is_tenant=true on the tenant index (kills sequential read performance)
Do not build global HNSW for multi-tenant collections (wasteful, use payload_m instead)

Repositorio GitHub

qdrant/skills

Ruta: skills/qdrant-scaling/scaling-data-volume/tenant-scaling

agent-skillsai-agentsclaude-codecodexcursorembeddings

Habilidades relacionadas

executing-plans

Diseño

Utilice la habilidad executing-plans cuando tenga un plan de implementación completo para ejecutar en lotes controlados con puntos de revisión. Esta habilidad carga y revisa críticamente el plan, luego ejecuta tareas en pequeños lotes (por defecto 3 tareas) mientras reporta el progreso entre cada lote para la revisión del arquitecto. Esto asegura una implementación sistemática con puntos de control de calidad integrados.

Ver habilidad

requesting-code-review

Diseño

Esta habilidad despacha un subagente revisor de código para analizar los cambios en el código frente a los requisitos antes de proceder. Debe usarse después de completar tareas, implementar funciones principales o antes de fusionar con la rama principal. La revisión ayuda a detectar problemas de forma temprana al comparar la implementación actual con el plan original.

Ver habilidad

connect-mcp-server

Diseño

Esta habilidad proporciona una guía integral para que los desarrolladores conecten servidores MCP a Claude Code mediante transportes HTTP, stdio o SSE. Cubre la instalación, configuración, autenticación y seguridad para integrar servicios externos como GitHub, Notion y APIs personalizadas. Úsala al configurar integraciones MCP, al configurar herramientas externas o al trabajar con el Protocolo de Contexto del Modelo de Claude.

Ver habilidad

web-cli-teleport

Diseño

Esta habilidad ayuda a los desarrolladores a elegir entre las interfaces web y CLI de Claude Code mediante el análisis de tareas, y luego permite la teletransportación fluida de sesiones entre estos entornos. Optimiza el flujo de trabajo gestionando el estado y el contexto de la sesión al cambiar entre web, CLI o móvil. Úsala para proyectos complejos que requieren diferentes herramientas en varias etapas.

Ver habilidad