Replicate MCP Server : lancer des modèles depuis Claude, Claude Code et Cursor

Ajoutez le serveur MCP officiel de Replicate à Claude Desktop, Claude Code et Cursor, puis recherchez des modèles et lancez des prédictions d’image, de vidéo et de texte sans quitter votre chat ou votre éditeur. Avec les commandes exactes, la configuration JSON, la sécurité du token, les coûts et une alternative sans configuration sur PicassoIA.

Replicate MCP Server : lancer des modèles depuis Claude, Claude Code et Cursor
Cristian Da Conceicao
Fondateur de Picasso IA

Vous pouvez désormais demander à Claude de trouver un modèle d’image sur Replicate, de le lancer avec votre prompt et de vous renvoyer le fichier fini sans quitter le chat. C’est tout l’intérêt du serveur MCP Replicate. Il branche l’API HTTP de Replicate sur tout client qui parle le Model Context Protocol, si bien que Claude Desktop, Claude Code et Cursor peuvent parcourir des milliers de modèles et créer des prédictions pour vous.

La mise en place prend environ cinq minutes. Ce qui ralentit les gens, ce sont les petits détails : quelle URL coller, quel transport choisir, où placer le token et ce qui apparaît ensuite sur la facture. Vous trouverez ci-dessous les commandes exactes pour chaque client, une liste de contrôle de sécurité pour le token, un aperçu du mode code expérimental et une solution sans configuration pour ceux qui veulent seulement des images et des vidéos finies.

Ce que fait le serveur MCP Replicate

Replicate héberge un vaste catalogue de modèles d’image, de vidéo, audio et texte derrière une seule API. Le serveur MCP officiel encapsule cette API sous forme d’outils, afin qu’un assistant puisse l’appeler directement au lieu de vous obliger à jongler avec des commandes curl et des onglets de navigateur. D’après la documentation de Replicate, il prend en charge toutes les opérations de l’API HTTP de Replicate : recherche, liste et inspection des modèles, puis création et récupération des prédictions.

Vue en plongée d’un bureau en chêne bien rangé avec un ordinateur portable, un carnet et une tasse d’expresso

Comment un prompt devient une prédiction

Imaginons que vous tapiez : faites une photo 16:9 d’un phare à l’aube. Le client transmet votre message au grand modèle de langage, le modèle décide qu’il a besoin d’un outil d’image et appelle le serveur. Le serveur relaie la requête à Replicate, qui exécute le modèle choisi sur ses GPU et renvoie une URL de sortie. La séquence ressemble en général à ceci :

  1. L’assistant recherche un modèle adapté à la tâche.
  2. Il lit les options de saisie de ce modèle, comme le champ prompt et le format.
  3. Il crée une prédiction avec votre prompt et vos réglages.
  4. Il récupère le résultat et vous affiche le lien de la sortie.

💡 Astuce : si vous connaissez déjà le modèle souhaité, nommez-le dans le prompt. Cela évite l’étape de recherche et rend les résultats reproductibles d’une session à l’autre.

La même boucle fonctionne pour les modèles vidéo et audio. Demandez un clip de cinq secondes : l’assistant choisit un modèle vidéo, renseigne le champ de durée et interroge le service jusqu’à la fin de l’exécution. Les vidéos prennent plus de temps que les images, comptez donc une minute ou plus au lieu de quelques secondes.

Les outils disponibles

La page MCP de Replicate nomme trois outils, et la documentation liste les opérations sous-jacentes :

Outil ou opérationCe qu’il fait
search_modelsTrouve des modèles selon la tâche ou la description
create_predictionsLance une exécution avec les entrées que vous fournissez
list_hardwareAffiche le matériel disponible pour exécuter les modèles
models.list, models.getListe les modèles et renvoie les métadonnées d’un modèle
predictions.getRécupère le statut et la sortie d’une exécution

Le matériel compte, car il détermine à la fois la vitesse et le prix. Il vaut donc la peine d’essayer list_hardware avant un gros lot.

Gros plan d’une carte graphique posée sur un établi propre, à côté d’un tournevis

Configuration hébergée ou locale

Vous pouvez exécuter le serveur de deux façons, et ce choix détermine le fonctionnement de l’authentification.

Serveur hébergéServeur local
Adresse ou commandehttps://mcp.replicate.comnpx -y replicate-mcp
ConnexionFlux d’approbation dans le navigateurVariable d’environnement REPLICATE_API_TOKEN
Fonctionne oùCôté ReplicateSur votre machine, nécessite Node
Avis de la documentationRecommandé pour la plupart des utilisateursAlternative avec configuration manuelle du token

Choisissez le serveur hébergé, sauf si vous avez une raison de faire tourner un processus sur votre propre machine. Il supprime complètement le fichier de token de votre configuration, et c’est la voie que tous les exemples des sections suivantes utilisent en premier.

⚠️ Attention : les anciens tutoriels vous demandent d’installer mcp-replicate. Il s’agissait d’une expérimentation communautaire, et son README indique qu’elle n’est plus activement développée. Le serveur officiel l’a remplacée, alors évitez l’ancien paquet.

Serveur hébergé sur mcp.replicate.com

Le serveur hébergé est celui que Replicate recommande. Les clients se connectent à l’endpoint SSE, https://mcp.replicate.com/sse, puis vous terminez par une étape d’approbation sur le web où vous collez un token API Replicate. Créez-en un sur replicate.com/account/api-tokens avant de commencer et gardez-le dans votre presse-papiers.

Serveur local avec npx

L’option locale fait tourner le même serveur comme un processus sur votre machine. Définissez REPLICATE_API_TOKEN, lancez-le avec npx -y replicate-mcp et arrêtez-le avec Ctrl+C. La plupart des clients le démarrent pour vous à partir d’un fichier de configuration comme celui-ci :

{
  "mcpServers": {
    "replicate": {
      "command": "npx",
      "args": ["-y", "replicate-mcp"],
      "env": {
        "REPLICATE_API_TOKEN": "your-token-here"
      }
    }
  }
}

VS Code avec GitHub Copilot lit .vscode/mcp.json et utilise un objet servers de premier niveau au lieu de mcpServers, donc copiez le bloc et renommez ce seul champ. Si le serveur n’apparaît jamais, vérifiez que Node est installé et que npx fonctionne depuis un terminal classique.

Le connecter à Claude Desktop

Claude Desktop est la voie la plus rapide, car le serveur hébergé ne nécessite aucun fichier de configuration.

Femme tapant un message sur un ordinateur portable dans un café ensoleillé, à côté d’un latte

Ajouter le connecteur personnalisé

  1. Ouvrez Paramètres et allez dans Connecteurs.
  2. Cliquez sur Ajouter un connecteur personnalisé.
  3. Saisissez l’URL du serveur : https://mcp.replicate.com/sse.
  4. Cliquez sur Connecter et collez votre token API Replicate.
  5. Cliquez sur Se connecter et approuver.
  6. Redémarrez Claude Desktop. Les outils apparaissent sous l’icône en forme de curseurs, sous la zone de saisie du chat.

Vous préférez le serveur local ? Placez le JSON de la section précédente dans claude_desktop_config.json et redémarrez l’application.

Premier prompt à essayer

Commencez par quelque chose qui déclenche la boucle complète de recherche, d’inspection et d’exécution :

Recherche sur Replicate un modèle texte vers image photoréaliste et rapide, montre-moi ses options de saisie, puis génère une photo 16:9 d’un phare à l’aube.

Les variantes rapides de FLUX, comme FLUX Schnell, sont des candidats typiques pour une demande de ce type, même si la recherche décide de ce qui arrive en premier. Si la réponse arrive sous forme de lien plutôt que d’image intégrée, c’est normal : le serveur renvoie l’URL de sortie, et le client décide de la manière de l’afficher.

Une fois cela fonctionnel, soyez précis. Indiquez le format, l’objectif, la direction de la lumière et le nombre de variantes souhaitées. Les prompts vagues gaspillent des exécutions, et chaque exécution est facturée.

Le connecter à Claude Code

Claude Code se configure avec une seule commande, et la connexion reste active d’un projet à l’autre.

Vue en contre-plongée d’un poste de développeur avec une fenêtre de terminal sombre et une lampe de bureau chaleureuse

Installation en une commande

Installez la CLI si vous ne l’avez pas encore, puis ajoutez le serveur :

npm install -g @anthropic-ai/claude-code
claude mcp add replicate https://mcp.replicate.com/sse --transport sse --scope user

L’option --scope user enregistre le serveur dans votre configuration utilisateur, donc chaque projet que vous ouvrez y a accès.

S’authentifier avec /mcp

Lancez claude, tapez /mcp, choisissez l’entrée Replicate, et une fenêtre de navigateur s’ouvre pour le même flux d’approbation que celui de Claude Desktop. Une fois que le serveur s’affiche comme connecté, demandez une exécution en langage naturel.

Comme Claude Code travaille dans votre dépôt, il peut faire plus que d’afficher un lien. Essayez ceci : générez trois options d’image principale pour la page d’accueil, puis téléchargez chaque résultat dans public/images. L’étape de téléchargement compte plus qu’il n’y paraît, et la section sur les coûts ci-dessous explique pourquoi.

Si les outils n’apparaissent pas, relancez /mcp et vérifiez la ligne de statut pour le serveur. Un serveur affiché comme déconnecté a généralement besoin d’une nouvelle authentification, et non d’une réinstallation.

Le connecter à Cursor

Cursor lit les serveurs MCP depuis un fichier JSON, donc cette configuration tient en quelques lignes.

Deux développeurs en train de collaborer sur un bureau réglable en hauteur, dans un atelier aux murs de briques

Modifier le fichier mcp.json

Ouvrez Paramètres de Cursor, allez dans Outils et intégrations et cliquez sur Nouveau serveur MCP. Cursor ouvre ~/.cursor/mcp.json, où vous ajoutez le serveur hébergé via le pont mcp-remote :

{
  "mcpServers": {
    "replicate": {
      "command": "npx",
      "args": ["-y", "mcp-remote@latest", "https://mcp.replicate.com/sse"]
    }
  }
}

Pour un seul dépôt, créez plutôt .cursor/mcp.json dans le projet, et utilisez le JSON du serveur local vu plus haut avec votre token dans env. Enregistrez le fichier et le serveur doit apparaître dans le même panneau de réglages, avec ses outils.

À partir de là, l’agent de Cursor peut générer des visuels provisoires, des photos de produits ou des icônes pendant qu’il modifie le composant qui en a besoin. C’est là le vrai intérêt : l’asset et la modification du code arrivent dans une seule conversation.

Autres clients compatibles

Le même serveur fonctionne au-delà de ces trois clients :

  • Claude.ai dans le navigateur
  • Codex CLI
  • Google Gemini CLI
  • Windsurf
  • Chorus
  • VS Code avec GitHub Copilot, en utilisant .vscode/mcp.json

Le principe ne change jamais : pointez le client vers l’URL hébergée ou lancez replicate-mcp en local, puis authentifiez-vous une seule fois.

Tokens, coûts et mode code

Trois éléments déterminent si cette configuration reste agréable à utiliser : la gestion du token, le coût de chaque exécution et la mesure dans laquelle vous poussez l’automatisation.

Cadenas en laiton posé sur un carnet en cuir noir, à côté d’un ordinateur portable fin

Protéger votre token

  • Créez le token sur replicate.com/account/api-tokens et traitez-le comme un mot de passe.
  • Privilégiez le flux hébergé quand c’est possible. Le token passe par l’écran d’approbation au lieu de rester dans un fichier de votre dépôt.
  • Avec le serveur local, conservez le token dans une variable d’environnement, ou gardez le fichier de configuration hors du contrôle de version. Ajoutez .cursor/mcp.json ou .vscode/mcp.json à .gitignore dès qu’ils contiennent un token.
  • Renouvelez le token immédiatement s’il apparaît dans un commit, une capture d’écran ou une conversation partagée.

Ce que vous payez

Le serveur MCP est une porte d’entrée vers la même API, donc chaque prédiction est facturée sur votre compte Replicate comme n’importe quel appel d’API. Le prix dépend du modèle et du matériel sur lequel il tourne, ce qui explique pourquoi list_hardware et un coup d’œil rapide aux pages des modèles aident avant un gros lot.

Une habitude simple permet de garder une facture prévisible. Faites un premier jet avec un modèle rapide et peu coûteux, comme FLUX Schnell, générez quatre options, choisissez la meilleure composition, puis relancez uniquement ce prompt sur un modèle de meilleure qualité. Indiquez cette règle à l’assistant une fois au début d’une session, et il la suivra pour toutes les demandes suivantes.

Vue en plongée d’un carnet de budget, d’une calculatrice et de pièces de monnaie à côté d’un ordinateur portable

ÉlémentCe qui se passe
Une prédiction que vous lancezFacturée sur votre compte Replicate
Fichiers de sortie de l’APISupprimés au bout d’une heure par défaut
Fichiers d’entrée de l’API et journauxSupprimés au bout d’une heure par défaut
Prédictions faites sur le site webConservées indéfiniment

💡 Astuce : les URL de sortie des prédictions de l’API disparaissent au bout d’environ une heure. Demandez à l’assistant de télécharger ou d’importer chaque résultat immédiatement, surtout lors d’une longue session.

Mode code dans un bac à sable

Replicate propose aussi un mode code expérimental. Au lieu d’appeler un outil à la fois, le modèle écrit du TypeScript et l’exécute dans un bac à sable Deno. Cela convient aux tâches qui enchaînent plusieurs prédictions, comme générer six variantes et garder les deux meilleures. Deno doit être installé. Ajoutez-le à Claude Code avec :

claude mcp add "replicate-code-mode" --scope user --transport stdio -- npx -y replicate-mcp@alpha --tools=code

Développeur devant un tableau blanc couvert de schémas de flux dessinés à la main, avec des cases et des flèches

Le libellé @alpha indique ce à quoi vous attendre. Considérez-le comme un terrain d’essai, gardez le serveur classique installé à côté, et vérifiez sa sortie avant de vous y fier pour un travail en production.

Une alternative sans configuration sur PicassoIA

Si vous voulez seulement l’image ou le clip final, sans une après-midi de configuration, PicassoIA propose des centaines de modèles sur des pages consultables, sans token à coller. Associez-le à un grand modèle de langage (LLM) comme Claude Sonnet 5 pour rédiger des prompts, puis générez dans le navigateur.

Photographe triant des tests d’impression sur une longue table devant un mur de tirages

Utiliser PicassoIA Image

PicassoIA Image est le modèle texte vers image de la plateforme, et c’est un endroit rapide pour tester un prompt avant d’automatiser quoi que ce soit.

  1. Ouvrez la page du modèle PicassoIA Image.
  2. Rédigez un prompt avec un sujet, un décor, une direction de lumière et un objectif, par exemple a lighthouse at dawn, low-angle, soft golden light from the left, 35mm lens, film grain.
  3. Choisissez le format dont vous avez besoin, par exemple 16:9 pour les en-têtes de blog.
  4. Générez, examinez le résultat et ajustez un détail à la fois.
  5. Envoyez le meilleur résultat dans PicassoIA Image Editor Pro pour des modifications comme le remplacement d’un objet ou la correction d’un détail.
  6. Animez-le avec PicassoIA Video, qui accepte un texte ou une image, ou essayez Seedance 2.5 Lite pour des clips allant jusqu’à 10 secondes.

💡 Astuce : modifiez une seule variable par exécution. Lorsque le résultat s’améliore, vous savez quelle modification en est la cause.

API et MCP de PicassoIA

PicassoIA expose aussi une API REST de type Replicate, donc le schéma créer, interroger et récupérer que vous venez de configurer vous sera familier :

  • URL de base : https://api.picassoia.com/v1, authentifiée avec un token Bearer de votre compte
  • Créer une exécution : POST /v1/models/{owner}/{name}/predictions
  • Vérifier une exécution : GET /v1/predictions/{id}
  • Annuler une exécution : POST /v1/predictions/{id}/cancel

Quatre modèles sont disponibles via l’API et la connexion MCP : PicassoIA Image, PicassoIA Image Editor Pro, PicassoIA Video et Seedance 2.5 Lite. Chaque compte dispose de 5 prédictions simultanées, partagées entre les tokens et les connexions MCP, et les prompts peuvent atteindre 4 000 caractères. L’accès à l’API et au MCP dépend de votre forfait : consultez la page des tarifs avant de bâtir dessus, et lisez la documentation sur picassoia.com/en/api.

Serveur MCP ReplicateAPI et MCP PicassoIA
CatalogueDes milliers de modèlesQuatre modèles
ConnexionToken API ReplicateToken Bearer de votre compte PicassoIA
FacturationSur votre compte ReplicateSur votre forfait PicassoIA
Idéal pourUn large choix de modèles et des expérimentationsUn ensemble rapide et fixe pour images et vidéos

Créez votre première image dès aujourd’hui

Choisissez la voie qui correspond à votre quotidien. Si vous travaillez dans un terminal ou un éditeur, connectez le serveur MCP Replicate avec la commande de votre client et lancez le prompt du phare. Si vous voulez un résultat dans les soixante secondes, ouvrez Picasso IA et testez le même prompt là-bas. Faites les deux, comparez les résultats et gardez celle qui convient à votre flux de travail, ou utilisez chacune pour ce qu’elle fait le mieux.

Trois prompts à essayer sur PicassoIA Image, chacun assez court pour être collé :

  • A fishing boat at sunrise, low-angle, wet wood texture, 35mm lens, soft mist, film grain
  • Une étagère d’atelier de céramique dans la lumière matinale d’une fenêtre, objectif 85 mm, faible profondeur de champ
  • Un cycliste traversant un pont de pierre au crépuscule, vue aérienne, lumière chaude, léger flou de bougé

Parcourez tous les modèles, des générateurs d’images et de vidéos aux modèles de langage, sur picassoia.com/en/all-models, et commencez dès aujourd’hui à créer vos propres images sur Picasso IA.

Partager cet article

Choisissez votre langue