Capacité réservée
À partir de $0.99
par GPU-hour en mode sans serveur
- •Réservez un nombre de GPU pour une durée définie.
- •Dépassez votre capacité réservée lorsque vous en avez besoin.
Créer avec Runware
Quatre couches conçues pour fonctionner ensemble. L’orchestration et les Sonic Pods modulaires forment le Sonic Inference Engine®.
Explorer la plateforme
Requêtes d’inférence traitées pour les images, les vidéos, l’audio, le langage et la 3D.
Modèles accessibles grâce à une approche unifiée des charges de travail d’IA.
Développeurs qui créent des expériences propulsées par l’IA avec Runware.
Personnes touchées par les applications fonctionnant sur cette infrastructure.
Des coûts de génération inférieurs aux tarifs publics du marché pour certains modèles.
Disponibilité déclarée de la plateforme sur la période la plus récente de 90 jours.
Des modèles et des modalités réunis au même endroit, avec un parcours cohérent de l’expérimentation à l’intégration.
curl -X POST https://api.runware.ai/v1 \ -H "Authorization: Bearer YOUR_API_KEY" \ -d '[ { "taskType": "imageInference", "model": "runware:400@1", "positivePrompt": "machinery, green-to-yellow gradient", "width": 1024, "height": 1024 } ]'
● Sans serveur · Accès anticipé
Apportez vos conteneurs et les poids de vos modèles sur l’infrastructure GPU modulaire derrière l’API Runware. Adaptez les ressources à la demande au lieu d’en provisionner pour chaque période creuse.
Apportez votre conteneur et les poids de votre modèle. Déployez sans gérer l’infrastructure sous-jacente.
$1.99/hour pour RTX PRO 6000, contre des tarifs publics généralement compris entre $3.00–$4.00 ailleurs. L’infrastructure modulaire est conçue pour réduire le coût du calcul.
Découvrez le calcul GPU sans serveur.Commencez avec une capacité de calcul flexible. Une fois vos besoins de base définis, envisagez une capacité réservée ou du matériel dédié pour les charges de travail dont la demande est plus stable.
Capacité réservée
par GPU-hour en mode sans serveur
Bare metal
configurations personnalisées sur Sonic Pods
Un matériel conçu sur mesure, un moteur d’inférence dédié et des modèles familiers peuvent changer l’économie de la génération.
Chiffres indicatifs pour le modèle et le volume sélectionnés ; les conditions réelles dépendent du fournisseur et de la charge de travail.
Différence mensuelle indicative
$29.1Kdans l’exemple ci-dessusComparaisons des modèles sélectionnés
Connectez vos outils et intégrez l’accès aux modèles au flux de travail que vous utilisez déjà. Commencez avec une clé API et un environnement de développement familier.
✓ connecté · OAuth 2.1
✓ outils · run · list_models · model_schema
>
Connectez un client MCP et travaillez depuis une interface familière.
Appelez des modèles depuis votre terminal.
Donnez aux agents de programmation des instructions pour utiliser Runware.
« Des tarifs avantageux et une API flexible. Nos utilisateurs veulent essayer tous les modèles, hyperparamètres, LoRA et options. D’autres fournisseurs les répartissent entre différents points de terminaison. Runware les réunit tous. »
Une inférence au plus près des utilisateurs, sans provisionner de GPU pour chaque nouvelle idée.
Les questions que se posent les développeurs avant leur premier appel. Explorez la plateforme pour en savoir plus sur votre propre charge de travail.
Utilisez une structure d’API cohérente pour les tâches d’image, de vidéo, d’audio, de langage et de 3D prises en charge, au lieu d’intégrer chaque modalité à partir de zéro.
Il réunit un logiciel d’orchestration et une infrastructure modulaire conçus spécialement pour l’inférence.
L’objectif est d’exécuter les mêmes modèles sur une infrastructure plus efficace, en réduisant les coûts de calcul plutôt qu’en modifiant le modèle que vous avez choisi.
Le calcul dédié est une option lorsqu’une charge de travail nécessite sa propre capacité et une configuration matérielle spécifique.
Runware indique que les données d’entrée et de sortie des clients ne sont pas utilisées pour entraîner les modèles. Consultez les conditions applicables au traitement des données pour votre cas d’usage.