Enterprise
Vidgo Enterprise já está disponível.
APIs de imagem, vídeo, LLM e 3D de alto volume — um saldo de créditos, capacidade GPU reservada e uma equipa enterprise dedicada.
- Meta de disponibilidade
- 99,9%
- Modalidades em uma API
- 4
- Saldo de créditos
- 1
A stack de geração que a sua equipa já conhece.
falWaveSpeed
Replicate
Por que a Vidgo
Feito para equipes que publicam mídia generativa em produção.
Uma API para cada modalidade
Imagem, vídeo, LLM e 3D atrás de uma chave, um SDK e uma conta de cobrança.
Um só saldo de créditos
Gaste uma vez e direcione o uso entre modelos sem contas de provedor separadas.
Jobs com falha não são cobrados
Uma geração com falha não é descontada do seu saldo.
Assíncrono por padrão
Envie, consulte ou use webhooks — feito para jobs longos.
SLA enterprise
Meta de disponibilidade de até 99,9% com roteamento prioritário.
Suporte dedicado
Um canal direto para arquitetura, migração e lançamento.
API de modelos
Uma camada de API de produção para equipas que enviam média generativa à escala.
Mais concorrência, faturação previsível por créditos e termos comerciais à volta do seu mix — imagem, vídeo, LLM e 3D numa só conta.
Preços à medida
Termos por volume alinhados ao mix de modelos e ao perfil de tráfego.
Acompanhe gasto, utilização e desempenho da IA num só sítio.
Gasto estimado
$36.4k
−7.2%
Tarefas bem-sucedidas
8.6m
+16.1%
Fila mediana
640ms
−21.4%
Mix de modelos · 30 dias Vídeo · 52% Imagem · 31% LLM · 17%
Mais concorrência
Envie mais tarefas ao mesmo tempo nos picos de tráfego.
Processamento prioritário
Coloque cargas enterprise à frente do tráfego público.
Fila mais curta
Reduza a espera quando houver capacidade disponível.
Encaminhamento resiliente
Mantenha os jobs a avançar quando uma família de modelos satura.
Capacidade dedicada
Reserve throughput para lançamentos e volume sustentado.
SLA de disponibilidade
Meta de disponibilidade da API enterprise até 99,9%.
A capacidade GPU segue a procura.
Jobs ativos
86
+24 hoje
Utilização GPU
78%
estável
GPUs quentes
12
prontas
Inferência em GPU. Throughput reservado. Sem ops de cluster.
GPU
Capacidade GPU reservada. Sem cluster para gerir.
Os jobs enterprise correm em inferência GPU que operamos por si — throughput dedicado e um pool quente, sem provisionar uma frota. Continua a chamar a API de modelos; nós seguramos as GPU.
Sem frota GPU para operar
Inferência de produção sem instâncias, drivers ou autoscalers.
Capacidade GPU reservada
Reserve throughput para lançamentos e volume sustentado.
Pool quente
GPUs prontas para evitar arranques a frio.
Elástico quando precisa
Ultrapasse a reserva em picos — sempre na mesma API.
A mesma API de modelos
A capacidade GPU fica atrás do endpoint que já usa. Sem nova integração.
Faturação por uso
Pague jobs bem-sucedidos, com condições enterprise por volume.
Logs e métricas
Acompanhe gasto, taxa de sucesso e fila num só sítio.
Falhas não são cobradas
Uma geração falhada não é descontada do saldo.
Fale com a nossa equipa enterprise.
Partilhe o mix de modelos, o volume esperado e o calendário. Respondemos com uma arquitetura e um plano de preços em 1–2 dias úteis.
Resposta habitual: 1–2 dias úteis.