This article is also available in English.
Read in EN →
NaN Builders: La Tarifa Plana de Inferencia Open Source con Zero Logs, RGPD y Modelos SOTA que Revoluciona el Desarrollo de IA (Análisis 2026)
Infraestructura IA
14 min ETA

NaN Builders: La Tarifa Plana de Inferencia Open Source con Zero Logs, RGPD y Modelos SOTA que Revoluciona el Desarrollo de IA (Análisis 2026)

IA4PYMES Logo

IA4PYMES

Research Team

Cualquiera que haya desarrollado agentes autónomos, pipelines RAG o aplicaciones de IA en producción conoce la misma frustración: el contador de tokens. Con las recientes subidas de precios y tarifas dinámicas en horario laboral de proveedores cloud, calcular el coste real de una arquitectura de software se ha vuelto una pesadilla para desarrolladores y PYMEs.

Por otro lado, montar un cluster local propio con GPUs dedicadas de última generación exige una inversión de miles de euros en hardware y mantenimiento.

Aquí es donde entra NaN Builders: una plataforma de inferencia de modelos abiertos bajo tarifa plana mensual, con cero logs, servidores en la Unión Europea (cumplimiento RGPD total) y una comunidad privada de creadores de IA de primer nivel.

En este análisis detallado explicamos qué ofrece su cluster, cómo funciona su API compatible con OpenAI, el stack completo (LLMs, Embeddings, Rerankers, TTS y STT) y por qué se ha convertido en la herramienta imprescindible para nuestro día a día.

🎁 Descuento Exclusivo para Lectores: Si te suscribes a NaN Builders a través de nuestro enlace de invitación a NaN Builders, obtienes 5 € de descuento directo en tu primer mes.


1. ¿Qué es NaN Builders y por qué rompe el modelo tradicional de APIs?

NaN Builders es una iniciativa creada por Cristian Córdova (@barckcode, founder de Helmcode) y Borja Pérez (@borjaperfra). Nace de una necesidad compartida por quienes construyen producto real: poder quemar tokens sin miedo a la factura final.

En lugar de cobrar por cada millón de tokens consumidos, NaN Builders opera un cluster compartido de GPUs dedicadas de alto rendimiento donde los miembros abonan una cuota fija mensual.

Arquitectura Completa del Cluster de Inferencia NaN Builders

Las 4 garantías fundamentales de la plataforma:

  1. Tarifa Plana Fija: Sabes exactamente lo que pagas a principio de mes (70 €/mes en el tier estándar nan_member, IVA incluido). No hay costes imprevistos ni recargos por hora pico.
  2. Zero Logs & Privacidad RGPD: La inferencia se procesa íntegramente en servidores ubicados dentro de la Unión Europea. No se almacenan prompts, respuestas ni fragmentos de código (0 bytes registrados). Tus datos no entrenan ningún modelo.
  3. API 100% Compatible con OpenAI: Basta con cambiar el baseURL y añadir tu API key personal para conectar cualquier framework: LangChain, LlamaIndex, Claude Code, Cursor, OpenCode o tus propios scripts.
  4. Votación Trimestral de Modelos: La comunidad vota en Discord qué nuevos modelos del ecosistema open-source se incorporan al cluster según avanza la tecnología.

2. El Stack Completo: Mucho más que un simple LLM

La mayoría de servicios de inferencia solo ofrecen generación de texto. Para crear un sistema de IA empresarial completo (como automatización de facturas con VeriFactu o agentes conectados mediante Executor.sh), necesitas múltiples capas que normalmente disparan la factura.

NaN Builders incluye todo el stack en una sola suscripción:

A) Modelos de Lenguaje (LLMs) y Razonamiento

  • DeepSeek V4-Flash: Arquitectura MoE de 284B-21B parámetros, contexto masivo de 1M de tokens, soporte nativo de llamadas a herramientas (tool calling) y razonamiento analítico (500M tokens/mes incluidos).
  • MiMo v2.5 (Xiaomi): Modelo MoE omnimodal de 310B-15B con procesamiento de visión y audio, 1M de contexto (1.000M tokens/mes incluidos).
  • Google Gemma 4: 26B-A4B MoE, 256k contexto, razonamiento y visión (sin contador / ilimitado).
  • Alibaba Qwen 3.6: 35B-A3B MoE, 256k contexto (sin contador / ilimitado). Excelente complemento a las ejecuciones en GGUF local con Unsloth y Qwen 3.8-35B MoE.

B) Motor RAG: Embeddings y Reranking Sin Límites

  • Qwen3-Embedding (8B, 4096 dimensiones): Rendimiento sobresaliente en el benchmark MMTEB (70.58) y soporte para más de 100 idiomas (sin contador).
  • Qwen3-Reranker (8B, BF16 cross-lingual): Reordenación semántica de fragmentos documentales para garantizar que el LLM solo reciba el contexto más relevante (sin contador).

C) Voz e Interacción: TTS y STT de Ultra-Baja Latencia

  • Kokoro (TTS): Síntesis de voz neural con 82M parámetros, 67 voces naturales (incluyendo las reconocidas ef_dora y em_alex) y latencia inferior a 1 segundo (sin contador).
  • Whisper Large-v3 (STT): Transcripción de audio optimizada en CTranslate2 con solo un 3.2% de tasa de error (WER) en español y detección automática de idioma (sin contador).

3. Comparativa Económica: ¿Cuánto ahorra una PYME o Builder?

Analicemos un caso de uso real de una empresa o maker con 3 agentes en producción procesando soporte al cliente, análisis de documentos y generación de audios explicativos:

Concepto MensualProveedores Cloud Tradicionales (Pay-per-Token)Suscripción NaN Builders (nan_member)
150M Tokens LLM (DeepSeek / Qwen)~180 € - 350 € (con tarifas pico)Incluido
50.000 Consultas Embeddings + Rerank~45 €0 € (Ilimitado)
60 Horas de Transcripción Whisper~22 €0 € (Ilimitado)
200.000 Caracteres Text-to-Speech (TTS)~30 €0 € (Ilimitado)
Gobernanza / Servidores en UERequiere acuerdos Enterprise caros100% Incluido por diseño
TOTAL MENSUAL277 € - 447 € / mes70 € / mes (IVA incl.)

El ahorro mensual supera el 75%, pero la mayor ventaja no es solo el dinero: es la tranquilidad operativa. No tienes que monitorizar si un bucle agéntico con DeepSeek Harness ha consumido más llamadas de las previstas.


4. La Comunidad de Discord: El Verdadero Activo Oculto

Tener acceso a GPUs es potente, pero el valor diferencial de NaN Builders reside en su comunidad privada de Discord.

No es un canal de soporte técnico genérico: es un punto de encuentro diario donde ingenieros senior, fundadores de startups, investigadores y builders independientes comparten:

  • Arquitecturas reales de agentes en producción con MCP y frameworks modernos.
  • Hacks de optimización de prompts, context window y serialización de datos.
  • Demostraciones en directo (builds), sesiones de preguntas y respuestas (AMAs) y hackathons periódicos.
  • Votación directa sobre qué hardware y qué modelos se despliegan en el siguiente trimestre.

Estar en ese entorno acelera cualquier desarrollo meses respecto a trabajar en solitario.


5. Cómo Integrar NaN Builders en tu Código en 3 Líneas

Dado que la API es totalmente compatible con la especificación de OpenAI, integrarla en Node.js, Python o cualquier herramienta existente requiere apenas segundos:

Ejemplo en TypeScript / Node.js

import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://api.nan.builders/v1",
  apiKey: process.env.NAN_BUILDERS_API_KEY,
});

async function runInference() {
  const response = await client.chat.completions.create({
    model: "deepseek-v4-flash",
    messages: [
      { role: "system", content: "Eres un analista financiero experto para PYMEs." },
      { role: "user", content: "Calcula el punto de equilibrio para una inversión de 12.000€ con margen del 35%." }
    ],
  });

  console.log(response.choices[0].message.content);
}

runInference();

Ejemplo de Embeddings para RAG

async function createEmbedding(text: string) {
  const embedding = await client.embeddings.create({
    model: "qwen3-embedding",
    input: text,
  });
  return embedding.data[0].embedding;
}

6. Planes Disponibles y Descuento Exclusivo

NaN Builders ofrece tres modalidades según tus necesidades:

  1. nan_community (14,99 €/mes): Acceso completo a Discord, canales privados, charlas en directo, workshops y cola reservada de inferencia.
  2. nan_member (70 €/mes - IVA incluido): El plan de referencia. Inferencia completa con modelos ilimitados, 500M tokens en DeepSeek V4-Flash, 1.0B en MiMo v2.5, embeddings, reranker, Whisper y Kokoro sin contador, API key personal y Discord.
  3. nan_member · GLM 5.2 premium (200 €/mes): 3.000M de tokens por ciclo de facturación para el modelo de razonamiento de frontera GLM 5.2.

👉 Únete a NaN Builders con 5€ de Descuento en tu Primer Mes → Plazas limitadas según capacidad de cómputo del cluster. Al registrarte con este enlace de invitación obtendrás 5 € de descuento directo al activar tu membresía.


7. Preguntas Frecuentes

¿Mis datos se utilizan para entrenar modelos?

No. NaN Builders aplica una política estricta de cero logs. Las peticiones se procesan en memoria volátil en servidores de la Unión Europea y se destruyen inmediatamente tras la respuesta.

¿Puedo utilizar mi API key en herramientas como Cursor, Claude Code o LibreChat?

Sí. Al ser 100% compatible con el protocolo OpenAI, solo necesitas configurar la URL base (https://api.nan.builders/v1) y tu clave personal.

¿Por qué existe lista de espera (waitlist)?

Porque el cluster garantiza velocidad y latencia real a sus miembros. Solo se abren nuevas plazas cuando se añade más capacidad de cómputo en GPUs.

initiating_deployment...

Pasa de la teoría a la ejecución

El conocimiento sin implementación técnica es solo entretenimiento. Agenda tu consultoría de 60 minutos: te devolvemos el 100% del importe si en los primeros 15 minutos vemos que la IA no es viable para tu caso, y si decides contratar el proyecto con nosotros, te descontamos el coste total de la sesión del presupuesto final.

Reservar Consultoría