Inferencia alojada

Inferencia LLM sin operar tus propias GPU

La pasarela gestiona autenticación, acceso y medición. Tu aplicación sigue siendo responsable de validar entradas, salidas y acciones.

Métodos de recarga previstos: Alipay y USDT. El cobro todavía no está habilitado.

Lo que gestiona el servicio

  • Autenticación
  • Acceso a modelos configurados
  • Medición
  • Límites
  • Metadatos públicos

Lo que gestiona tu aplicación

  • Validación
  • Autorización
  • Reintentos
  • Minimización de datos
  • Experiencia de error

Preguntas frecuentes

¿Puedo usar el SDK de OpenAI?

Sí, para el subconjunto verificado de Chat Completions. Actualiza la URL base, la clave API y el nombre del modelo; los parámetros no admitidos devuelven un error explícito.

¿Todos los modelos ofrecen streaming y llamadas a herramientas?

Las capacidades (como llamadas a funciones o streaming) varían según cada modelo. Puedes consultar las especificaciones en tiempo real en nuestro catálogo activo.

Recursos relacionados