C

AI Tool

CoreWeave

Inferencia GPU en la nube con endpoints compatibles con OpenAI y API de gestión

CoreWeave documenta en docs.coreweave.com/products/inference productos Serverless, Dedicated (BYOW en GPUs H100/B200/A100) y CKS con endpoints compatibles con OpenAI. La API de inferencia en api.coreweave.com (v1alpha1) gestiona gateways, despliegues y capacity claims vía REST/gRPC/Connect con tokens Bearer (roles Inference Viewer/Admin).

Categoría Herramientas para desarrolladores
Precio Usage-based GPU inference; see CoreWeave billing docs for Dedicated and Serverless pricing
Plataformas Web / API / Terraform
gpuinferenceneocloud

Casos de uso

  • Servir pesos propios en GPU dedicada
  • Gestionar despliegues vía REST
  • Reservar capacidad GPU
  • Evaluar neoclouds
  • Reutilizar SDK OpenAI

Funciones principales

  • Endpoints OpenAI-compatibles
  • API DeploymentService/GatewayService
  • Dedicated BYOW con autoscaling
  • Proveedor Terraform
  • Gateways IAM con routing por model

Relacionados

Relacionados

3 Entradas indexadas