Descripción
Cómputo General es un proveedor de inferencia enfocado en la velocidad. Despliega modelos de IA en infraestructura ASIC diseñada específicamente en lugar de GPUs, y los expone a través de una API compatible con OpenAI para que los equipos puedan cambiar simplemente modificando su URL base y clave API sin necesidad de reescribir código. Publicita un tiempo hasta el primer token de menos de un milisegundo, alto rendimiento y hasta 1,000 tokens por segundo, con comparativas de rendimiento que contrastan el mismo modelo ejecutado en Cómputo General contra una línea base de GPU.
La plataforma ofrece tres formas de ejecución: una API de autoservicio con inferencia basada en uso, capacidad dedicada para equipos que necesitan capacidad garantizada y soporte de producción, y servicio de modelos propios que ejecuta pesos privados en la infraestructura de Cómputo General. Todas comparten la misma superficie compatible con OpenAI, incluyendo llamadas a herramientas, modo JSON, modelos listos para razonamiento y semántica de streaming, por lo que los orquestadores existentes continúan funcionando. El tráfico de producción se ejecuta en una región de EE. UU. hoy en día, con regiones dedicadas disponibles para implementaciones empresariales.
Cómputo General se posiciona como un proveedor impulsado por la demanda y con activos pesados que compra, despliega y opera silicio especializado (como SambaNova y Etched Sohu) para que los clientes puedan ejecutar en chips que no instalarían ellos mismos, vendiendo el resultado como inferencia. Las nuevas cuentas comienzan con crédito gratuito, y los planes de pago por uso heredan una fiabilidad de mejor esfuerzo, mientras que los niveles empresariales añaden SLA contractuales, rutas de escalación y capacidad dedicada.
Características principales de Cómputo General
API de inferencia compatible con OpenAI con migración de URL base
Infraestructura ASIC diseñada específicamente para inferencia de alta velocidad
Bajo tiempo hasta el primer token y alto rendimiento
Llamadas a herramientas, modo JSON, modelos de razonamiento y streaming
API de autoservicio, implementaciones dedicadas y servicio de modelos propios
Crédito gratuito para nuevas cuentas
Niveles empresariales con SLA contractuales y capacidad dedicada
¿Cómo usar Cómputo General?
Obtén una clave: Regístrate y recibe una clave API con crédito gratuito.
Cambia tu URL base: Apunta tu SDK compatible con OpenAI existente a Cómputo General.
Ejecuta inferencia: Envía solicitudes y utiliza llamadas a herramientas, modo JSON y streaming como de costumbre.
Escala: Pasa a capacidad dedicada o trae tu propio modelo cuando necesites capacidad garantizada.
Casos de uso de Cómputo General
- Agentes de codificación
- Voz en tiempo real e IA interactiva
- Inferencia de alto rendimiento
- Servicio de modelos privados







