Catálogo de modelos
Los modelos disponibles en tu infraestructura y su almacenamiento. Los recursos en vivo (VRAM) se gestionan en Modelos.
Almacenamiento usado
231 GB
11% de 2048 GB · NVMe RAID (2 TB)
Modelos descargados
9
1817 GB libres
Activos (no borrables)
4
En uso por modelos de la organización
Actualización disponible
3
Ver abajo
| Modelo | Proveedor | Tipo | Params | Tamaño | VRAM est. | Estado |
|---|---|---|---|---|---|---|
Llama 3.1 8B Instruct | Meta | Instrucción | 8B | 16.1 GB | 18 GB | Activo |
Qwen 2.5 7B Instruct | Qwen | Instrucción | 7B | 14.7 GB | 16 GB | Descargado |
Mistral 7B Instruct v0.3 | Mistral AI | Instrucción | 7B | 14.5 GB | 15 GB | Descargado |
Llama 3.1 70B Instruct | Meta | Instrucción | 70B | 140.0 GB | 160 GB | Descargando 67% |
Pixtral 12B | Mistral AI | Visión | 12B | 24.5 GB | 28 GB | Activo |
Qwen 2 VL 7B | Qwen | Visión | 7B | 15.8 GB | 18 GB | Descargado |
Nougat Base (OCR) | Meta | OCR | 0.35B | 1.4 GB | 4 GB | Activo |
BGE M3 (Embeddings) | NVIDIA | Embeddings | 0.57B | 2.3 GB | 3 GB | Activo |
BGE Large EN v1.5 | NVIDIA | Embeddings | 0.34B | 1.3 GB | 2 GB | Descargado |
meta-llama/Llama-3.2-3B-Instruct | Meta | Instrucción | 3B | 6.2 GB | 8 GB | |
meta-llama/Llama-3.3-70B-Instruct | Meta | Instrucción | 70B | 142.0 GB | 160 GB | |
Qwen/Qwen2.5-14B-Instruct | Qwen | Instrucción | 14B | 28.4 GB | 32 GB | |
Qwen/Qwen2.5-32B-Instruct | Qwen | Instrucción | 32B | 65.0 GB | 72 GB | |
Qwen/Qwen2.5-Coder-32B-Instruct | Qwen | Instrucción | 32B | 65.0 GB | 72 GB | |
google/gemma-2-9b-it | Instrucción | 9B | 18.2 GB | 22 GB | ||
google/gemma-2-27b-it | Instrucción | 27B | 54.5 GB | 62 GB | ||
google/gemma-3-12b-it | Visión | 12B | 24.6 GB | 28 GB | ||
google/paligemma-3b-mix-448 | Visión | 3B | 6.1 GB | 8 GB | ||
nvidia/NV-Embed-v2 | NVIDIA | Embeddings | 7.85B | 31.4 GB | 36 GB | |
nvidia/Llama-3.1-Nemotron-70B-Instruct | NVIDIA | Instrucción | 70B | 140.0 GB | 160 GB | |
nvidia/Nemotron-Mini-4B-Instruct | NVIDIA | Instrucción | 4B | 8.1 GB | 10 GB |
21 modelos en el catálogo · 9 ya en tu infra
Actualizaciones disponibles
· 3- Qwen 2.5 7B Instruct
Qwen2.5-7B-Instruct-1M— Soporta 1M tokens de contexto - Mistral 7B Instruct v0.3
Mistral-7B-Instruct-v0.4— Mejor seguimiento de instrucciones - BGE Large EN v1.5
bge-large-en-v1.5 (rev 2026-04)— Recalibrado, mejor MTEB