Servidor MCP de Replicate: ejecuta modelos desde Claude, Claude Code y Cursor

Añade el servidor MCP oficial de Replicate a Claude Desktop, Claude Code y Cursor, y busca modelos y ejecuta predicciones de imagen, video y texto sin salir de tu chat o editor. Incluye comandos exactos, configuración JSON, seguridad del token, costos y una alternativa sin configuración en PicassoIA.

Servidor MCP de Replicate: ejecuta modelos desde Claude, Claude Code y Cursor
Cristian Da Conceicao
Fundador de Picasso IA

Ahora puedes pedirle a Claude que busque un modelo de imagen en Replicate, lo ejecute con tu prompt y te devuelva el archivo terminado sin salir del chat. Para eso sirve el servidor MCP de Replicate. Conecta la API HTTP de Replicate con cualquier cliente que hable el Model Context Protocol, de modo que Claude Desktop, Claude Code y Cursor pueden buscar entre miles de modelos y crear predicciones en tu nombre.

La configuración lleva unos cinco minutos. Lo que frena a la gente son los detalles: qué URL pegar, qué transporte elegir, dónde va el token y qué aparece después en la factura. A continuación encontrarás los comandos exactos para cada cliente, una lista de comprobación de seguridad del token, una mirada al modo código experimental y una ruta sin configuración para quien solo quiere imágenes y videos terminados.

Qué hace el servidor MCP de Replicate

Replicate aloja un amplio catálogo de modelos de imagen, video, audio y texto detrás de una sola API. El servidor MCP oficial envuelve esa API como herramientas, de modo que un asistente puede llamarla directamente en lugar de que tú te encargues de comandos curl y pestañas del navegador. Según la documentación de Replicate, admite todas las operaciones de la API HTTP de Replicate: buscar, listar e inspeccionar modelos, y luego crear y consultar predicciones.

Vista cenital de un escritorio de roble ordenado con un equipo portátil, una libreta y una taza de espresso

Cómo un prompt se convierte en una predicción

Supongamos que escribes: haz una foto de un faro al amanecer en formato 16:9. El cliente envía tu mensaje al modelo de lenguaje, el modelo decide que necesita una herramienta de imagen y llama al servidor. El servidor transmite la solicitud a Replicate, que ejecuta el modelo elegido en sus GPU y devuelve una URL de salida. La secuencia suele ser así:

  1. El asistente busca un modelo que encaje con la tarea.
  2. Lee las opciones de entrada de ese modelo, como el campo de prompt y la relación de aspecto.
  3. Crea una predicción con tu prompt y tus ajustes.
  4. Recupera el resultado y te muestra el enlace de salida.

💡 Consejo: Si ya sabes qué modelo quieres, nómbralo en el prompt. Así te saltas el paso de búsqueda y los resultados se repiten de una sesión a otra.

El mismo ciclo funciona para modelos de video y audio. Pide un clip de cinco segundos y el asistente elige un modelo de video, completa el campo de duración y consulta el estado hasta que la ejecución termina. Los videos tardan más que las imágenes, así que espera un minuto o más en lugar de unos pocos segundos.

Las herramientas que obtienes

La página MCP de Replicate nombra tres herramientas, y la documentación enumera las operaciones subyacentes:

Herramienta u operaciónQué hace
search_modelsBusca modelos por tarea o descripción
create_predictionsInicia una ejecución con los datos que indiques
list_hardwareMuestra el hardware disponible para ejecutar modelos
models.list, models.getLista modelos y devuelve los metadatos de un modelo
predictions.getConsulta el estado y el resultado de una ejecución

El hardware importa porque determina tanto la velocidad como el precio, así que vale la pena probar list_hardware antes de un lote grande.

Primer plano de una tarjeta gráfica sobre una mesa de trabajo limpia con un destornillador cerca

Configuración alojada o local

Puedes ejecutar el servidor de dos formas, y la elección determina cómo funciona la autenticación.

Servidor alojadoServidor local
Dirección o comandohttps://mcp.replicate.comnpx -y replicate-mcp
Inicio de sesiónFlujo de aprobación en el navegadorVariable de entorno REPLICATE_API_TOKEN
Dónde se ejecutaEn el lado de ReplicateEn tu equipo, necesita Node
Veredicto de la documentaciónRecomendado para la mayoría de usuariosAlternativa con configuración manual del token

Elige el servidor alojado a menos que tengas una razón para ejecutar un proceso en tu propio equipo. Elimina por completo el archivo de token de tu configuración, y es la ruta que usan primero todos los ejemplos de las siguientes secciones.

⚠️ Atención: Los tutoriales antiguos te indican que instales mcp-replicate. Era un experimento de la comunidad, y su README dice que ya no está en desarrollo activo. El servidor oficial lo ha reemplazado, así que omite el paquete antiguo.

Servidor alojado en mcp.replicate.com

El servidor alojado es el que recomienda Replicate. Los clientes se conectan al endpoint SSE, https://mcp.replicate.com/sse, y terminas con un paso de aprobación en la web donde pegas un token de API de Replicate. Crea uno en replicate.com/account/api-tokens antes de empezar y tenlo listo en el portapapeles.

Servidor local con npx

La opción local ejecuta el mismo servidor como un proceso en tu equipo. Define REPLICATE_API_TOKEN, inícialo con npx -y replicate-mcp y deténlo con Ctrl+C. La mayoría de los clientes lo lanzan por ti desde un archivo de configuración como este:

{
  "mcpServers": {
    "replicate": {
      "command": "npx",
      "args": ["-y", "replicate-mcp"],
      "env": {
        "REPLICATE_API_TOKEN": "your-token-here"
      }
    }
  }
}

VS Code con GitHub Copilot lee .vscode/mcp.json y usa un objeto servers de nivel superior en lugar de mcpServers, así que copia el bloque y renombra ese único campo. Si el servidor nunca aparece, comprueba que Node está instalado y que npx funciona desde una terminal normal.

Conectarlo a Claude Desktop

Claude Desktop es la vía más rápida, porque el servidor alojado no necesita ningún archivo de configuración.

Mujer escribiendo un mensaje en un equipo portátil en una cafetería iluminada por el sol junto a un café con leche

Añadir el conector personalizado

  1. Abre Settings (Configuración) y ve a Connectors (Conectores).
  2. Haz clic en Add Custom Connector (Añadir conector personalizado).
  3. Introduce la URL del servidor: https://mcp.replicate.com/sse.
  4. Haz clic en Connect (Conectar) y pega tu token de API de Replicate.
  5. Haz clic en Log in and Approve (Iniciar sesión y aprobar).
  6. Reinicia Claude Desktop. Las herramientas aparecen debajo del icono de controles, bajo el campo del chat.

¿Prefieres el servidor local? Pon el JSON de la sección anterior en claude_desktop_config.json y reinicia la aplicación.

Primer prompt para probar

Empieza con algo que fuerce el ciclo completo de búsqueda, inspección y ejecución:

Busca en Replicate un modelo de texto a imagen fotorrealista y rápido, muéstrame sus opciones de entrada y luego genera una foto de un faro al amanecer en formato 16:9.

Las variantes rápidas de FLUX, como FLUX Schnell, son candidatas típicas para una petición así, aunque la búsqueda decide qué aparece primero. Si la respuesta llega como enlace en lugar de como imagen insertada, es normal: el servidor devuelve la URL de salida y el cliente decide cómo mostrarla.

Una vez que funcione, sé específico. Indica la relación de aspecto, el objetivo, la dirección de la luz y el número de variaciones que quieres. Los prompts vagos desperdician ejecuciones, y cada ejecución se cobra.

Conectarlo a Claude Code

Claude Code necesita un solo comando, y mantiene la conexión entre proyectos.

Vista desde abajo de una estación de trabajo de programación con una ventana de terminal oscura y una lámpara de escritorio cálida

Instalación con un solo comando

Instala la CLI si aún no la tienes y, después, añade el servidor:

npm install -g @anthropic-ai/claude-code
claude mcp add replicate https://mcp.replicate.com/sse --transport sse --scope user

La marca --scope user guarda el servidor en la configuración de tu usuario, de modo que todo proyecto que abras tendrá acceso a él.

Autenticarse con /mcp

Lanza claude, escribe /mcp, elige la entrada de Replicate y se abrirá una ventana del navegador con el mismo flujo de aprobación que usa Claude Desktop. Cuando indique que está conectado, pide una ejecución en lenguaje natural.

Como Claude Code trabaja dentro de tu repositorio, puede hacer más que mostrar un enlace. Prueba esto: Genera tres opciones de imagen principal para la página de inicio y descarga cada resultado en public/images. El paso de descarga importa más de lo que parece, y la sección de costos más abajo explica por qué.

Si las herramientas no aparecen, ejecuta /mcp de nuevo y revisa la línea de estado del servidor. Un servidor que aparece como desconectado normalmente necesita una autenticación nueva, no una reinstalación.

Conectarlo a Cursor

Cursor lee los servidores MCP desde un archivo JSON, así que esta configuración es unas pocas líneas.

Dos desarrolladores colaborando en un escritorio de pie en un estudio con paredes de ladrillo

Editar el archivo mcp.json

Abre Cursor Settings (Configuración de Cursor), ve a Tools & Integrations (Herramientas e integraciones) y haz clic en New MCP Server (Nuevo servidor MCP). Cursor abre ~/.cursor/mcp.json, donde añades el servidor alojado mediante el puente mcp-remote:

{
  "mcpServers": {
    "replicate": {
      "command": "npx",
      "args": ["-y", "mcp-remote@latest", "https://mcp.replicate.com/sse"]
    }
  }
}

Para un solo repositorio, crea .cursor/mcp.json en el proyecto, y usa el JSON del servidor local de antes con tu token en env. Guarda el archivo y el servidor debería aparecer en el mismo panel de configuración, junto con sus herramientas.

A partir de ahí, el agente de Cursor puede generar arte provisional, fotos de producto o iconos mientras edita el componente que los necesita. Ese es el verdadero beneficio: el recurso y el cambio en el código se producen en una misma conversación.

Otros clientes compatibles

El mismo servidor funciona más allá de estos tres:

  • Claude.ai en el navegador
  • Codex CLI
  • Google Gemini CLI
  • Windsurf
  • Chorus
  • VS Code con GitHub Copilot, usando .vscode/mcp.json

El patrón no cambia nunca: apunta el cliente a la URL alojada o lanza replicate-mcp de forma local, y luego autentícate una vez.

Tokens, costos y modo código

Tres cosas determinan si esta configuración sigue siendo cómoda: cómo gestionas el token, cuánto cuesta cada ejecución y hasta dónde llevas la automatización.

Candado de latón sobre una libreta de cuero negro junto a un equipo portátil delgado

Protege tu token

  • Crea el token en replicate.com/account/api-tokens y trátalo como una contraseña.
  • Prefiere el flujo alojado cuando puedas. El token pasa por la pantalla de aprobación en lugar de quedarse en un archivo de tu repositorio.
  • Con el servidor local, guarda el token en una variable de entorno o mantén el archivo de configuración fuera del control de versiones. Añade .cursor/mcp.json o .vscode/mcp.json a .gitignore siempre que contengan un token.
  • Rota el token de inmediato si aparece en un commit, en una captura de pantalla o en un chat compartido.

Qué pagas

El servidor MCP es una puerta de entrada a la misma API, así que cada predicción se factura en tu cuenta de Replicate como cualquier otra llamada a la API. El precio depende del modelo y del hardware en el que se ejecuta, por eso list_hardware y una mirada rápida a las páginas de los modelos ayudan antes de un lote grande.

Un hábito sencillo mantiene la factura previsible. Haz borradores con un modelo rápido y barato como FLUX Schnell, genera cuatro opciones, elige la mejor composición y vuelve a ejecutar solo ese prompt en un modelo de mayor calidad. Indícale esta regla al asistente una vez al inicio de una sesión y la seguirá en cada petición posterior.

Vista cenital de una libreta económica, una calculadora y monedas junto a un equipo portátil

ElementoQué ocurre
Una predicción que ejecutasSe factura en tu cuenta de Replicate
Archivos de salida de la APISe eliminan después de una hora por defecto
Archivos de entrada de la API y registrosSe eliminan después de una hora por defecto
Predicciones hechas en la webSe conservan indefinidamente

💡 Consejo: Las URL de salida de las predicciones de la API desaparecen después de una hora aproximadamente. Pide al asistente que descargue o suba cada resultado enseguida, sobre todo en una sesión larga.

Modo código en un sandbox

Replicate también incluye un modo código experimental. En lugar de llamar a una herramienta cada vez, el modelo escribe TypeScript y lo ejecuta dentro de un sandbox de Deno. Eso encaja con trabajos que encadenan varias predicciones, como generar seis variaciones y quedarse con las dos mejores. Necesita tener Deno instalado. Añádelo a Claude Code con:

claude mcp add "replicate-code-mode" --scope user --transport stdio -- npx -y replicate-mcp@alpha --tools=code

Desarrollador frente a una pizarra llena de cuadros de diagrama de flujo dibujados a mano y flechas

La etiqueta @alpha te indica qué esperar. Trátalo como un terreno de pruebas, mantén instalado junto a él el servidor habitual y revisa su resultado antes de confiar en él para trabajo de producción.

Una alternativa sin configuración en PicassoIA

Si solo quieres la imagen o el clip terminados y no una tarde de configuración, PicassoIA tiene cientos de modelos en páginas que puedes explorar, sin tokens que pegar. Combínalo con un modelo de lenguaje (LLM) como Claude Sonnet 5 para redactar prompts y luego genera en el navegador.

Fotógrafo ordenando pruebas impresas sobre una mesa larga frente a una pared llena de copias

Cómo usar PicassoIA Image

PicassoIA Image es el modelo de texto a imagen propio de la plataforma, y es un buen lugar para probar un prompt antes de automatizar nada.

  1. Abre la página del modelo PicassoIA Image.
  2. Escribe un prompt con un sujeto, un escenario, una dirección de luz y un objetivo, por ejemplo un faro al amanecer, desde un ángulo bajo, luz dorada suave desde la izquierda, objetivo de 35 mm, grano de película.
  3. Elige la relación de aspecto que necesitas, como 16:9 para cabeceras de blog.
  4. Genera, revisa el resultado y ajusta un detalle cada vez.
  5. Envía el ganador a PicassoIA Image Editor Pro para hacer ediciones como reemplazar un objeto o corregir un detalle.
  6. Anímalo con PicassoIA Video, que acepta texto o imagen, o prueba Seedance 2.5 Lite para clips de hasta 10 segundos.

💡 Consejo: Cambia una variable por ejecución. Cuando el resultado mejore, sabrás qué ajuste lo causó.

API y MCP de PicassoIA

PicassoIA también expone una API REST de estilo Replicate, así que el patrón de crear, consultar y obtener que acabas de configurar te resultará familiar:

  • URL base: https://api.picassoia.com/v1, autenticada con un token Bearer de tu cuenta
  • Crear una ejecución: POST /v1/models/{owner}/{name}/predictions
  • Consultar una ejecución: GET /v1/predictions/{id}
  • Cancelar una ejecución: POST /v1/predictions/{id}/cancel

Cuatro modelos están disponibles a través de la API y de la conexión MCP: PicassoIA Image, PicassoIA Image Editor Pro, PicassoIA Video y Seedance 2.5 Lite. Cada cuenta tiene 5 predicciones simultáneas, compartidas entre tokens y conexiones MCP, y los prompts pueden tener hasta 4000 caracteres. El acceso a la API y a MCP depende de tu plan, así que consulta la página de precios antes de construir sobre ello, y lee la documentación en picassoia.com/en/api.

Servidor MCP de ReplicateAPI y MCP de PicassoIA
CatálogoMiles de modelosCuatro modelos
Inicio de sesiónToken de API de ReplicateToken Bearer de tu cuenta de PicassoIA
FacturaciónTu cuenta de ReplicateTu plan de PicassoIA
Mejor opción paraAmplia elección de modelos y experimentosUn conjunto rápido y fijo para imágenes y video

Crea tu primera imagen hoy

Elige la ruta que encaje con tu día. Si trabajas en una terminal o en un editor, conecta el servidor MCP de Replicate con el comando de tu cliente y ejecuta el prompt del faro. Si quieres un resultado en los próximos sesenta segundos, abre Picasso IA y prueba allí el mismo prompt. Haz ambas cosas, compara los resultados y quédate con lo que encaje en tu flujo de trabajo, o usa cada una para lo que mejor hace.

Tres prompts para probar en PicassoIA Image, cada uno lo bastante corto para pegarlo:

  • Un barco de pesca al amanecer, ángulo bajo, textura de madera mojada, objetivo de 35 mm, neblina suave, grano de película
  • Un estante de estudio de cerámica con luz de ventana por la mañana, objetivo de 85 mm, profundidad de campo reducida
  • Un ciclista cruzando un puente de piedra al atardecer, vista aérea, luz cálida, un desenfoque de movimiento sutil

Explora todos los modelos, desde generadores de imagen y video hasta modelos de lenguaje, en picassoia.com/en/all-models, y empieza hoy mismo a crear tus propias imágenes en Picasso IA.

Compartir este artículo

Elige tu idioma