Skip to main content
A continuación encontrarás respuestas a las preguntas más comunes sobre Fastino. Si no ves lo que buscas, ponte en contacto con el equipo en support@fastino.ai. Para consultar el estado del servicio en tiempo real y los informes de incidencias, visita pioneerai.statuspage.io.
Fastino está diseñado para que el fine-tuning de modelos de lenguaje pequeños (SLMs) sea lo más sencillo posible. Todo el proceso consta de cuatro pasos:
  1. Crea un dataset: sube tus propios datos o genera ejemplos sintéticos con la herramienta de datos sintéticos integrada en Fastino. Consulta Datos sintéticos.
  2. Inicia un trabajo de entrenamiento: elige un modelo base, apúntalo a tu dataset y envíalo. Todos los hiperparámetros tienen valores predeterminados razonables, así que no necesitas ajustar nada para empezar. Consulta Entrenamiento.
  3. Espera a que termine: tu trabajo pasa por pending → running → complete. Los datasets pequeños suelen terminar en pocos minutos.
  4. Ejecuta la inferencia: usa el ID de tu trabajo como identificador del modelo. Los modelos encoder aceptan un texto y un esquema; los modelos decoder son compatibles con OpenAI. Consulta Inferencia.
Para ver un recorrido completo, consulta la guía de fine-tuning de NER o la guía de fine-tuning de LLM.
No. El almacenamiento es gratuito para todos los datasets en todos los planes. No se te cobrará por los datasets que crees o subas a Fastino.
Describe tu dominio y las etiquetas para las que quieres entrenar, y Fastino genera ejemplos etiquetados realistas a escala. Esto te permite crear un dataset de entrenamiento inicial sin ninguna anotación manual, algo útil cuando empiezas desde cero o necesitas ampliar la cobertura de casos límite.
Fastino admite Nemotron 3.5 Lightning, DeepSeek V4 Flash, GLM 5.2, Claude Opus/Sonnet/Haiku 5 y las familias GPT-5.5 y GPT-5.6 a través de una única API unificada.
Cambia el nombre del modelo por otro decoder compatible, como deepseek-ai/DeepSeek-V4-Flash, zai-org/GLM-5.2, claude-sonnet-5 o gpt-5.6-terra. Para ver el catálogo completo actualizado, llama a GET /v1/base-models. Consulta Inferencia para ver todos los detalles.
Sí, de forma predeterminada Fastino puede usar tus datos para mejorar los modelos. Sin embargo, puedes desactivarlo en los planes Pro y Custom. Los planes Custom también te permiten ejecutar el fine-tuning de forma privada dentro de tu propia VPC, para que tus datos nunca salgan de tu infraestructura.Contacta con el equipo para obtener más información sobre las opciones del plan Custom.
Los equipos (Teams) en Fastino se usan para la facturación compartida: cada miembro sigue teniendo su propio espacio de trabajo privado. Compartir modelos entre compañeros no está integrado directamente en Teams.Si necesitas compartir modelos con tu equipo, ponte en contacto y el equipo te guiará sobre el mejor enfoque para tu caso de uso.
Los modelos encoder (como GLiNER) se entrenan para comprender y extraer información estructurada del texto; son ideales para tareas de NER, clasificación y extracción de JSON. Son rápidos, eficientes y se ejecutan en CPU, lo que los hace baratos de servir a escala. Los modelos decoder (como Nemotron 3.5 Lightning) son generativos: producen texto, lo que los hace adecuados para tareas de resumen, preguntas y respuestas, chat y seguimiento de instrucciones.Fastino admite ambos. Si tu tarea tiene una estructura de salida definida (extraer estos tipos de entidad, clasificar en estas categorías), usa un encoder. Si tu tarea requiere generar texto libre, usa un decoder. En caso de duda, empieza con un encoder: se entrenan más rápido, cuestan menos y son más fáciles de evaluar.
Fastino ejecuta evaluaciones automáticamente después del entrenamiento e informa del F1, la precisión y el recall sobre tu conjunto de validación reservado.Si tu puntuación es más baja de lo esperado, ejecuta una evaluación manual con un dataset separado para obtener una señal más limpia. También puedes inspeccionar las predicciones por ejemplo para identificar dónde falla el modelo y luego usar esas carencias para generar datos sintéticos específicos. Consulta Evaluaciones y Datos sintéticos.
GLiNER es una arquitectura de modelo encoder de código abierto diseñada específicamente para el reconocimiento de entidades nombradas y la extracción estructurada. A diferencia de los modelos decoder, que generan texto token a token, GLiNER clasifica directamente spans de texto, lo que lo hace considerablemente más rápido y preciso para tareas de extracción.Usa GLiNER cuando necesites extraer tipos de entidad específicos (personas, organizaciones, productos, fechas), clasificar texto en categorías predefinidas o ejecutar inferencia de gran volumen en la que la latencia y el coste sean importantes. El pipeline de fine-tuning de Fastino está construido en torno a GLiNER. Puedes pasar de una descripción del dominio a un modelo de extracción listo para producción en minutos, sin necesidad de GPU por tu parte.
Como parte de la política de control de exportaciones de EE. UU. sobre IA en curso, incluidas las directivas emitidas en junio de 2026, cada proveedor de modelos ha actualizado sus políticas de disponibilidad para cumplirla.
Los usuarios ubicados en países sujetos a sanciones y restricciones de exportación de EE. UU. (incluidos China, Rusia, Irán, Corea del Norte, Cuba, Siria y Bielorrusia) no pueden acceder a los modelos en Fastino.
Para consultar la lista completa y actualizada de países admitidos, consulta directamente a cada proveedor: OpenAI, Anthropic, Google Gemini y Meta Llama 4.
Estas políticas evolucionan constantemente. Si crees que tu acceso se ha restringido por error, ponte en contacto con nuestro equipo de soporte.