Nemotron Nano 30B · NVIDIA
Nemotron Nano 30B de NVIDIA con arquitectura MoE (3B activos). Diseñado para inferencia rápida con calidad de modelos mucho más grandes.
Sobre Nemotron Nano 30B
Nemotron Nano 30B de NVIDIA con arquitectura MoE (3B activos). Diseñado para inferencia rápida con calidad de modelos mucho más grandes.
Para qué sobresale: MoE eficiente · Velocidad NVIDIA-optimizada · Razonamiento.
Cómo usar Nemotron Nano 30B
-
1
Escribe o sube
Escribe lo que quieres en el cuadro de arriba — o sube el archivo si la herramienta lo pide.
-
2
Genera
Click en el botón principal. Esperar 2-30 segundos según el modelo y el tamaño del input.
-
3
Descarga o comparte
Descarga el resultado o comparte el link directo. Sin marca de agua, listo para usar.
Preguntas frecuentes
¿Cuánto cuesta usar Nemotron Nano 30B?
Nemotron Nano 30B es un modelo Pro: cuesta 10 tokens por uso (~$0.05 de costo real para nosotros). Necesitas un plan Pro ($9/mes → 15.000 tokens) o un pack one-shot. Si ya tienes tokens en la cuenta gratis, también puedes gastarlos directamente.
¿Cuántos usos de Nemotron Nano 30B entran en el plan Pro?
Pro ($9/mes) te da 15.000 tokens recurrentes. A 10 tokens por uso de Nemotron Nano 30B, eso son ~1.500 usos completos por ciclo. Si te quedas corto, los packs one-shot (5.000 / 25.000 / 80.000 tokens) suman al saldo sin caducar antes de un año.
¿Qué hace especial a Nemotron Nano 30B?
NVIDIA afina sus modelos para inferencia rápida en su propio hardware optimizado — bueno en preguntas técnicas y razonamiento. Sus puntos fuertes concretos son: moe eficiente, velocidad nvidia-optimizada y razonamiento.
¿Qué tan rápido responde Nemotron Nano 30B?
Nemotron Nano 30B es uno de los modelos rápidos del catálogo: respuestas típicas en 2-5 segundos. El tiempo real depende también de la longitud del prompt y de la carga del datacenter — modelos con contexto enorme tardan más cuando metes textos muy largos.
¿Cómo uso Nemotron Nano 30B en ia.gratis?
Puedes usar Nemotron Nano 30B desde /chat/ seleccionando Nemotron Nano 30B en el picker, o vía la API REST con `model=nemotron-nano` en el cuerpo del POST. Resumen rápido: nVIDIA, optimizado para velocidad. El identificador interno del modelo es `nemotron-nano` — útil cuando integres por API.