Replicate MCP Server : lancer des modèles depuis Claude, Claude Code et Cursor
Ajoutez le serveur MCP officiel de Replicate à Claude Desktop, Claude Code et Cursor, puis recherchez des modèles et lancez des prédictions d’image, de vidéo et de texte sans quitter votre chat ou votre éditeur. Avec les commandes exactes, la configuration JSON, la sécurité du token, les coûts et une alternative sans configuration sur PicassoIA.
Vous pouvez désormais demander à Claude de trouver un modèle d’image sur Replicate, de le lancer avec votre prompt et de vous renvoyer le fichier fini sans quitter le chat. C’est tout l’intérêt du serveur MCP Replicate. Il branche l’API HTTP de Replicate sur tout client qui parle le Model Context Protocol, si bien que Claude Desktop, Claude Code et Cursor peuvent parcourir des milliers de modèles et créer des prédictions pour vous.
La mise en place prend environ cinq minutes. Ce qui ralentit les gens, ce sont les petits détails : quelle URL coller, quel transport choisir, où placer le token et ce qui apparaît ensuite sur la facture. Vous trouverez ci-dessous les commandes exactes pour chaque client, une liste de contrôle de sécurité pour le token, un aperçu du mode code expérimental et une solution sans configuration pour ceux qui veulent seulement des images et des vidéos finies.
Ce que fait le serveur MCP Replicate
Replicate héberge un vaste catalogue de modèles d’image, de vidéo, audio et texte derrière une seule API. Le serveur MCP officiel encapsule cette API sous forme d’outils, afin qu’un assistant puisse l’appeler directement au lieu de vous obliger à jongler avec des commandes curl et des onglets de navigateur. D’après la documentation de Replicate, il prend en charge toutes les opérations de l’API HTTP de Replicate : recherche, liste et inspection des modèles, puis création et récupération des prédictions.
Comment un prompt devient une prédiction
Imaginons que vous tapiez : faites une photo 16:9 d’un phare à l’aube. Le client transmet votre message au grand modèle de langage, le modèle décide qu’il a besoin d’un outil d’image et appelle le serveur. Le serveur relaie la requête à Replicate, qui exécute le modèle choisi sur ses GPU et renvoie une URL de sortie. La séquence ressemble en général à ceci :
L’assistant recherche un modèle adapté à la tâche.
Il lit les options de saisie de ce modèle, comme le champ prompt et le format.
Il crée une prédiction avec votre prompt et vos réglages.
Il récupère le résultat et vous affiche le lien de la sortie.
💡 Astuce : si vous connaissez déjà le modèle souhaité, nommez-le dans le prompt. Cela évite l’étape de recherche et rend les résultats reproductibles d’une session à l’autre.
La même boucle fonctionne pour les modèles vidéo et audio. Demandez un clip de cinq secondes : l’assistant choisit un modèle vidéo, renseigne le champ de durée et interroge le service jusqu’à la fin de l’exécution. Les vidéos prennent plus de temps que les images, comptez donc une minute ou plus au lieu de quelques secondes.
Les outils disponibles
La page MCP de Replicate nomme trois outils, et la documentation liste les opérations sous-jacentes :
Outil ou opération
Ce qu’il fait
search_models
Trouve des modèles selon la tâche ou la description
create_predictions
Lance une exécution avec les entrées que vous fournissez
list_hardware
Affiche le matériel disponible pour exécuter les modèles
models.list, models.get
Liste les modèles et renvoie les métadonnées d’un modèle
predictions.get
Récupère le statut et la sortie d’une exécution
Le matériel compte, car il détermine à la fois la vitesse et le prix. Il vaut donc la peine d’essayer list_hardware avant un gros lot.
Configuration hébergée ou locale
Vous pouvez exécuter le serveur de deux façons, et ce choix détermine le fonctionnement de l’authentification.
Serveur hébergé
Serveur local
Adresse ou commande
https://mcp.replicate.com
npx -y replicate-mcp
Connexion
Flux d’approbation dans le navigateur
Variable d’environnement REPLICATE_API_TOKEN
Fonctionne où
Côté Replicate
Sur votre machine, nécessite Node
Avis de la documentation
Recommandé pour la plupart des utilisateurs
Alternative avec configuration manuelle du token
Choisissez le serveur hébergé, sauf si vous avez une raison de faire tourner un processus sur votre propre machine. Il supprime complètement le fichier de token de votre configuration, et c’est la voie que tous les exemples des sections suivantes utilisent en premier.
⚠️ Attention : les anciens tutoriels vous demandent d’installer mcp-replicate. Il s’agissait d’une expérimentation communautaire, et son README indique qu’elle n’est plus activement développée. Le serveur officiel l’a remplacée, alors évitez l’ancien paquet.
Serveur hébergé sur mcp.replicate.com
Le serveur hébergé est celui que Replicate recommande. Les clients se connectent à l’endpoint SSE, https://mcp.replicate.com/sse, puis vous terminez par une étape d’approbation sur le web où vous collez un token API Replicate. Créez-en un sur replicate.com/account/api-tokens avant de commencer et gardez-le dans votre presse-papiers.
Serveur local avec npx
L’option locale fait tourner le même serveur comme un processus sur votre machine. Définissez REPLICATE_API_TOKEN, lancez-le avec npx -y replicate-mcp et arrêtez-le avec Ctrl+C. La plupart des clients le démarrent pour vous à partir d’un fichier de configuration comme celui-ci :
VS Code avec GitHub Copilot lit .vscode/mcp.json et utilise un objet servers de premier niveau au lieu de mcpServers, donc copiez le bloc et renommez ce seul champ. Si le serveur n’apparaît jamais, vérifiez que Node est installé et que npx fonctionne depuis un terminal classique.
Le connecter à Claude Desktop
Claude Desktop est la voie la plus rapide, car le serveur hébergé ne nécessite aucun fichier de configuration.
Ajouter le connecteur personnalisé
Ouvrez Paramètres et allez dans Connecteurs.
Cliquez sur Ajouter un connecteur personnalisé.
Saisissez l’URL du serveur : https://mcp.replicate.com/sse.
Cliquez sur Connecter et collez votre token API Replicate.
Cliquez sur Se connecter et approuver.
Redémarrez Claude Desktop. Les outils apparaissent sous l’icône en forme de curseurs, sous la zone de saisie du chat.
Vous préférez le serveur local ? Placez le JSON de la section précédente dans claude_desktop_config.json et redémarrez l’application.
Premier prompt à essayer
Commencez par quelque chose qui déclenche la boucle complète de recherche, d’inspection et d’exécution :
Recherche sur Replicate un modèle texte vers image photoréaliste et rapide, montre-moi ses options de saisie, puis génère une photo 16:9 d’un phare à l’aube.
Les variantes rapides de FLUX, comme FLUX Schnell, sont des candidats typiques pour une demande de ce type, même si la recherche décide de ce qui arrive en premier. Si la réponse arrive sous forme de lien plutôt que d’image intégrée, c’est normal : le serveur renvoie l’URL de sortie, et le client décide de la manière de l’afficher.
Une fois cela fonctionnel, soyez précis. Indiquez le format, l’objectif, la direction de la lumière et le nombre de variantes souhaitées. Les prompts vagues gaspillent des exécutions, et chaque exécution est facturée.
Le connecter à Claude Code
Claude Code se configure avec une seule commande, et la connexion reste active d’un projet à l’autre.
Installation en une commande
Installez la CLI si vous ne l’avez pas encore, puis ajoutez le serveur :
npm install -g @anthropic-ai/claude-code
claude mcp add replicate https://mcp.replicate.com/sse --transport sse --scope user
L’option --scope user enregistre le serveur dans votre configuration utilisateur, donc chaque projet que vous ouvrez y a accès.
S’authentifier avec /mcp
Lancez claude, tapez /mcp, choisissez l’entrée Replicate, et une fenêtre de navigateur s’ouvre pour le même flux d’approbation que celui de Claude Desktop. Une fois que le serveur s’affiche comme connecté, demandez une exécution en langage naturel.
Comme Claude Code travaille dans votre dépôt, il peut faire plus que d’afficher un lien. Essayez ceci : générez trois options d’image principale pour la page d’accueil, puis téléchargez chaque résultat dans public/images. L’étape de téléchargement compte plus qu’il n’y paraît, et la section sur les coûts ci-dessous explique pourquoi.
Si les outils n’apparaissent pas, relancez /mcp et vérifiez la ligne de statut pour le serveur. Un serveur affiché comme déconnecté a généralement besoin d’une nouvelle authentification, et non d’une réinstallation.
Le connecter à Cursor
Cursor lit les serveurs MCP depuis un fichier JSON, donc cette configuration tient en quelques lignes.
Modifier le fichier mcp.json
Ouvrez Paramètres de Cursor, allez dans Outils et intégrations et cliquez sur Nouveau serveur MCP. Cursor ouvre ~/.cursor/mcp.json, où vous ajoutez le serveur hébergé via le pont mcp-remote :
Pour un seul dépôt, créez plutôt .cursor/mcp.json dans le projet, et utilisez le JSON du serveur local vu plus haut avec votre token dans env. Enregistrez le fichier et le serveur doit apparaître dans le même panneau de réglages, avec ses outils.
À partir de là, l’agent de Cursor peut générer des visuels provisoires, des photos de produits ou des icônes pendant qu’il modifie le composant qui en a besoin. C’est là le vrai intérêt : l’asset et la modification du code arrivent dans une seule conversation.
Autres clients compatibles
Le même serveur fonctionne au-delà de ces trois clients :
Claude.ai dans le navigateur
Codex CLI
Google Gemini CLI
Windsurf
Chorus
VS Code avec GitHub Copilot, en utilisant .vscode/mcp.json
Le principe ne change jamais : pointez le client vers l’URL hébergée ou lancez replicate-mcp en local, puis authentifiez-vous une seule fois.
Tokens, coûts et mode code
Trois éléments déterminent si cette configuration reste agréable à utiliser : la gestion du token, le coût de chaque exécution et la mesure dans laquelle vous poussez l’automatisation.
Protéger votre token
Créez le token sur replicate.com/account/api-tokens et traitez-le comme un mot de passe.
Privilégiez le flux hébergé quand c’est possible. Le token passe par l’écran d’approbation au lieu de rester dans un fichier de votre dépôt.
Avec le serveur local, conservez le token dans une variable d’environnement, ou gardez le fichier de configuration hors du contrôle de version. Ajoutez .cursor/mcp.json ou .vscode/mcp.json à .gitignore dès qu’ils contiennent un token.
Renouvelez le token immédiatement s’il apparaît dans un commit, une capture d’écran ou une conversation partagée.
Ce que vous payez
Le serveur MCP est une porte d’entrée vers la même API, donc chaque prédiction est facturée sur votre compte Replicate comme n’importe quel appel d’API. Le prix dépend du modèle et du matériel sur lequel il tourne, ce qui explique pourquoi list_hardware et un coup d’œil rapide aux pages des modèles aident avant un gros lot.
Une habitude simple permet de garder une facture prévisible. Faites un premier jet avec un modèle rapide et peu coûteux, comme FLUX Schnell, générez quatre options, choisissez la meilleure composition, puis relancez uniquement ce prompt sur un modèle de meilleure qualité. Indiquez cette règle à l’assistant une fois au début d’une session, et il la suivra pour toutes les demandes suivantes.
Élément
Ce qui se passe
Une prédiction que vous lancez
Facturée sur votre compte Replicate
Fichiers de sortie de l’API
Supprimés au bout d’une heure par défaut
Fichiers d’entrée de l’API et journaux
Supprimés au bout d’une heure par défaut
Prédictions faites sur le site web
Conservées indéfiniment
💡 Astuce : les URL de sortie des prédictions de l’API disparaissent au bout d’environ une heure. Demandez à l’assistant de télécharger ou d’importer chaque résultat immédiatement, surtout lors d’une longue session.
Mode code dans un bac à sable
Replicate propose aussi un mode code expérimental. Au lieu d’appeler un outil à la fois, le modèle écrit du TypeScript et l’exécute dans un bac à sable Deno. Cela convient aux tâches qui enchaînent plusieurs prédictions, comme générer six variantes et garder les deux meilleures. Deno doit être installé. Ajoutez-le à Claude Code avec :
claude mcp add "replicate-code-mode" --scope user --transport stdio -- npx -y replicate-mcp@alpha --tools=code
Le libellé @alpha indique ce à quoi vous attendre. Considérez-le comme un terrain d’essai, gardez le serveur classique installé à côté, et vérifiez sa sortie avant de vous y fier pour un travail en production.
Une alternative sans configuration sur PicassoIA
Si vous voulez seulement l’image ou le clip final, sans une après-midi de configuration, PicassoIA propose des centaines de modèles sur des pages consultables, sans token à coller. Associez-le à un grand modèle de langage (LLM) comme Claude Sonnet 5 pour rédiger des prompts, puis générez dans le navigateur.
Utiliser PicassoIA Image
PicassoIA Image est le modèle texte vers image de la plateforme, et c’est un endroit rapide pour tester un prompt avant d’automatiser quoi que ce soit.
Rédigez un prompt avec un sujet, un décor, une direction de lumière et un objectif, par exemple a lighthouse at dawn, low-angle, soft golden light from the left, 35mm lens, film grain.
Choisissez le format dont vous avez besoin, par exemple 16:9 pour les en-têtes de blog.
Générez, examinez le résultat et ajustez un détail à la fois.
Envoyez le meilleur résultat dans PicassoIA Image Editor Pro pour des modifications comme le remplacement d’un objet ou la correction d’un détail.
Animez-le avec PicassoIA Video, qui accepte un texte ou une image, ou essayez Seedance 2.5 Lite pour des clips allant jusqu’à 10 secondes.
💡 Astuce : modifiez une seule variable par exécution. Lorsque le résultat s’améliore, vous savez quelle modification en est la cause.
API et MCP de PicassoIA
PicassoIA expose aussi une API REST de type Replicate, donc le schéma créer, interroger et récupérer que vous venez de configurer vous sera familier :
URL de base : https://api.picassoia.com/v1, authentifiée avec un token Bearer de votre compte
Créer une exécution : POST /v1/models/{owner}/{name}/predictions
Vérifier une exécution : GET /v1/predictions/{id}
Annuler une exécution : POST /v1/predictions/{id}/cancel
Quatre modèles sont disponibles via l’API et la connexion MCP : PicassoIA Image, PicassoIA Image Editor Pro, PicassoIA Video et Seedance 2.5 Lite. Chaque compte dispose de 5 prédictions simultanées, partagées entre les tokens et les connexions MCP, et les prompts peuvent atteindre 4 000 caractères. L’accès à l’API et au MCP dépend de votre forfait : consultez la page des tarifs avant de bâtir dessus, et lisez la documentation sur picassoia.com/en/api.
Serveur MCP Replicate
API et MCP PicassoIA
Catalogue
Des milliers de modèles
Quatre modèles
Connexion
Token API Replicate
Token Bearer de votre compte PicassoIA
Facturation
Sur votre compte Replicate
Sur votre forfait PicassoIA
Idéal pour
Un large choix de modèles et des expérimentations
Un ensemble rapide et fixe pour images et vidéos
Créez votre première image dès aujourd’hui
Choisissez la voie qui correspond à votre quotidien. Si vous travaillez dans un terminal ou un éditeur, connectez le serveur MCP Replicate avec la commande de votre client et lancez le prompt du phare. Si vous voulez un résultat dans les soixante secondes, ouvrez Picasso IA et testez le même prompt là-bas. Faites les deux, comparez les résultats et gardez celle qui convient à votre flux de travail, ou utilisez chacune pour ce qu’elle fait le mieux.
Trois prompts à essayer sur PicassoIA Image, chacun assez court pour être collé :
A fishing boat at sunrise, low-angle, wet wood texture, 35mm lens, soft mist, film grain
Une étagère d’atelier de céramique dans la lumière matinale d’une fenêtre, objectif 85 mm, faible profondeur de champ
Un cycliste traversant un pont de pierre au crépuscule, vue aérienne, lumière chaude, léger flou de bougé
Parcourez tous les modèles, des générateurs d’images et de vidéos aux modèles de langage, sur picassoia.com/en/all-models, et commencez dès aujourd’hui à créer vos propres images sur Picasso IA.