Models TibiOS can run
Modelos que TibiOS puede ejecutar
From a compact model on a single device to a frontier model across a coordinated cluster.
Desde un modelo compacto en un solo dispositivo hasta un modelo de frontera sobre un clúster coordinado.
TibiOS doesn't run just one AI model — it orchestrates whichever model fits the job and the hardware available, from a single edge device to a network of coordinated nodes. The table below is a sample of what's in the catalog today: the size of each model, how much memory it needs, what it's particularly good at, and roughly how capable and how fast it is.
TibiOS no ejecuta un único modelo de IA: orquesta el modelo que mejor encaja según la tarea y el hardware disponible, desde un solo dispositivo edge hasta una red de nodos coordinados. La tabla de abajo es una muestra de lo que hay hoy en el catálogo: el tamaño de cada modelo, cuánta memoria necesita, en qué destaca y, de forma aproximada, cuánta capacidad tiene y qué tan rápido responde.
A quick guide to what each column means:
Guía rápida de lo que significa cada columna:
- Size (parameters): how many parameters the model has — very roughly, its "weight." A bigger model can hold more nuance, at the cost of needing more memory and time.
- Tamaño (parámetros): cuántos parámetros tiene el modelo — a grandes rasgos, su "peso." Un modelo más grande puede captar más matices, a cambio de necesitar más memoria y más tiempo.
- Memory needed: the approximate minimum memory to run the model in its most efficient compressed form.
- Memoria necesaria: la memoria mínima aproximada para ejecutar el modelo en su versión comprimida más eficiente.
- Good at: the kind of task that specific model tends to do best — everyday conversation, step-by-step reasoning, writing code, or understanding images.
- Destaca en: el tipo de tarea en la que ese modelo concreto suele rendir mejor: conversación cotidiana, razonamiento paso a paso, escribir código o entender imágenes.
- Capability level: a relative read of how capable the model is compared to the rest of the catalog — not a single universal score, since that depends heavily on the task.
- Nivel de capacidad: una lectura relativa de cuán capaz es el modelo frente al resto del catálogo — no una puntuación única y universal, porque eso depende mucho de la tarea.
- Approximate speed: how quickly it tends to respond. Smaller models are typically near-instant on a single device; larger ones need more time, or more hardware working together.
- Velocidad aproximada: qué tan rápido suele responder. Los modelos pequeños suelen ser casi instantáneos en un solo dispositivo; los más grandes necesitan más tiempo, o más hardware trabajando en conjunto.
| Model | Modelo | Size | Tamaño | Memory needed | Memoria necesaria | Good at | Destaca en | Capability | Capacidad | Speed | Velocidad |
|---|---|---|---|---|---|---|---|---|---|---|---|
| Phi-4-mini-reasoning | ~3.8B params | ~3 GB | Step-by-step reasoning in a very compact model | Razonamiento paso a paso en un modelo muy compacto | Solid (reasoning)Sólida (razonamiento) | FastRápida | |||||
| Gemma 3 4B | ~4.3B params | ~3 GB | Everyday conversation + understanding images | Conversación cotidiana + entender imágenes | Solid (multimodal)Sólida (multimodal) | FastRápida | |||||
| DeepSeek Coder 6.7B Instruct | ~6.7B params | ~5 GB | Code generation and completion, sized for a single edge device | Generación y autocompletado de código, pensado para un solo dispositivo edge | Solid (code)Sólida (código) | Fast–MediumRápida–Media | |||||
| DeepSeek-R1-Distill-Qwen 7B | ~7.6B params | ~5 GB | Reasoning, math and logic — sized for a single edge device | Razonamiento, matemáticas y lógica — pensado para un solo dispositivo edge | Advanced (reasoning)Avanzada (razonamiento) | Fast–MediumRápida–Media | |||||
| Mistral 7B Instruct | ~7.25B params | ~5 GB | Everyday conversation, resource-efficient | Conversación cotidiana, eficiente en recursos | SolidSólida | Fast–MediumRápida–Media | |||||
| Qwen3 8B | ~8.2B params | ~5 GB | Everyday conversation, good quality/speed balance | Conversación cotidiana, buen equilibrio calidad/velocidad | SolidSólida | Fast–MediumRápida–Media | |||||
| Llama 3.1 8B Instruct | ~8B params | ~5 GB | Everyday conversation, very long context (131K tokens) | Conversación cotidiana, contexto muy largo (131K tokens) | SolidSólida | Fast–MediumRápida–Media | |||||
| DeepSeek-R1-Distill-Qwen 14B | ~14.8B params | ~9 GB | Advanced reasoning, more precise than the 7B version | Razonamiento avanzado, más preciso que la versión de 7B | Advanced (reasoning)Avanzada (razonamiento) | MediumMedia | |||||
| Qwen3 Coder 30B-A3B | ~30.5B params | ~19 GB | Writing and reviewing code, very long context (262K tokens) | Escribir y revisar código, contexto muy largo (262K tokens) | Advanced (code)Avanzada (código) | MediumMedia | |||||
| DeepSeek Coder 33B Instruct | ~33.3B params | ~20 GB | Code generation and completion, larger and more capable than the 6.7B version | Generación y autocompletado de código, más grande y capaz que la versión de 6.7B | Advanced (code)Avanzada (código) | MediumMedia | |||||
| Llama 3.3 70B Instruct | ~70.6B params | ~43 GB | High-quality conversation, complex tasks | Conversación de alta calidad, tareas complejas | AdvancedAvanzada | Slower — needs a larger GPU or several nodesMás lenta — necesita una GPU grande o varios nodos | |||||
| GLM-4.5 | ~355B params | ~213 GB | High-quality conversation and complex tasks, very long context (131K tokens) | Conversación de alta calidad y tareas complejas, contexto muy largo (131K tokens) | FrontierFrontera | Slower per response — runs across a coordinated clusterMás lenta por respuesta — corre sobre un clúster coordinado | |||||
| DeepSeek-V3 | ~671B params | ~403 GB | Frontier-level capability for the most demanding tasks | Capacidad de frontera para las tareas más exigentes | FrontierFrontera | Slower per response — runs across a coordinated clusterMás lenta por respuesta — corre sobre un clúster coordinado | |||||
| Kimi K2-Instruct | ~1T params (MoE) | ~600 GB | Long-context, frontier-scale conversation | Conversación de frontera con contexto muy largo | FrontierFrontera | Slower per response — runs across a coordinated clusterMás lenta por respuesta — corre sobre un clúster coordinado | |||||
| Kimi K3 | ~2.8T params (MoE) | Not yet benchmarked — research stage | Aún sin medir — en fase de investigación | Distributing giant models across many small, low-power devices instead of one big machine | Repartir modelos gigantes entre muchos dispositivos pequeños y de bajo consumo en lugar de una sola máquina grande | Research previewVista previa de investigación | Not yet measuredAún sin medir | ||||
| TibiOS Sauron | TBD | Not yet benchmarked — in research | Aún sin medir — en fase de investigación | Our own model, purpose-built for TibiOS's distributed architecture | Modelo propio de TibiOS, diseñado para su arquitectura distribuida | In researchEn investigación | Not yet measuredAún sin medir |
Sizes and memory figures come from TibiOS's own model catalog. Capability and speed are relative, orientation guides, not a benchmark score — actual speed depends on the hardware running each model.
Los tamaños y la memoria vienen del catálogo de modelos propio de TibiOS. Capacidad y velocidad son guías relativas de orientación, no una puntuación de benchmark — la velocidad real depende del hardware que ejecute cada modelo.