Servidor MCP de Replicate: ejecuta modelos desde Claude, Claude Code y Cursor
Añade el servidor MCP oficial de Replicate a Claude Desktop, Claude Code y Cursor, y busca modelos y ejecuta predicciones de imagen, video y texto sin salir de tu chat o editor. Incluye comandos exactos, configuración JSON, seguridad del token, costos y una alternativa sin configuración en PicassoIA.
Ahora puedes pedirle a Claude que busque un modelo de imagen en Replicate, lo ejecute con tu prompt y te devuelva el archivo terminado sin salir del chat. Para eso sirve el servidor MCP de Replicate. Conecta la API HTTP de Replicate con cualquier cliente que hable el Model Context Protocol, de modo que Claude Desktop, Claude Code y Cursor pueden buscar entre miles de modelos y crear predicciones en tu nombre.
La configuración lleva unos cinco minutos. Lo que frena a la gente son los detalles: qué URL pegar, qué transporte elegir, dónde va el token y qué aparece después en la factura. A continuación encontrarás los comandos exactos para cada cliente, una lista de comprobación de seguridad del token, una mirada al modo código experimental y una ruta sin configuración para quien solo quiere imágenes y videos terminados.
Qué hace el servidor MCP de Replicate
Replicate aloja un amplio catálogo de modelos de imagen, video, audio y texto detrás de una sola API. El servidor MCP oficial envuelve esa API como herramientas, de modo que un asistente puede llamarla directamente en lugar de que tú te encargues de comandos curl y pestañas del navegador. Según la documentación de Replicate, admite todas las operaciones de la API HTTP de Replicate: buscar, listar e inspeccionar modelos, y luego crear y consultar predicciones.
Cómo un prompt se convierte en una predicción
Supongamos que escribes: haz una foto de un faro al amanecer en formato 16:9. El cliente envía tu mensaje al modelo de lenguaje, el modelo decide que necesita una herramienta de imagen y llama al servidor. El servidor transmite la solicitud a Replicate, que ejecuta el modelo elegido en sus GPU y devuelve una URL de salida. La secuencia suele ser así:
El asistente busca un modelo que encaje con la tarea.
Lee las opciones de entrada de ese modelo, como el campo de prompt y la relación de aspecto.
Crea una predicción con tu prompt y tus ajustes.
Recupera el resultado y te muestra el enlace de salida.
💡 Consejo: Si ya sabes qué modelo quieres, nómbralo en el prompt. Así te saltas el paso de búsqueda y los resultados se repiten de una sesión a otra.
El mismo ciclo funciona para modelos de video y audio. Pide un clip de cinco segundos y el asistente elige un modelo de video, completa el campo de duración y consulta el estado hasta que la ejecución termina. Los videos tardan más que las imágenes, así que espera un minuto o más en lugar de unos pocos segundos.
Las herramientas que obtienes
La página MCP de Replicate nombra tres herramientas, y la documentación enumera las operaciones subyacentes:
Herramienta u operación
Qué hace
search_models
Busca modelos por tarea o descripción
create_predictions
Inicia una ejecución con los datos que indiques
list_hardware
Muestra el hardware disponible para ejecutar modelos
models.list, models.get
Lista modelos y devuelve los metadatos de un modelo
predictions.get
Consulta el estado y el resultado de una ejecución
El hardware importa porque determina tanto la velocidad como el precio, así que vale la pena probar list_hardware antes de un lote grande.
Configuración alojada o local
Puedes ejecutar el servidor de dos formas, y la elección determina cómo funciona la autenticación.
Servidor alojado
Servidor local
Dirección o comando
https://mcp.replicate.com
npx -y replicate-mcp
Inicio de sesión
Flujo de aprobación en el navegador
Variable de entorno REPLICATE_API_TOKEN
Dónde se ejecuta
En el lado de Replicate
En tu equipo, necesita Node
Veredicto de la documentación
Recomendado para la mayoría de usuarios
Alternativa con configuración manual del token
Elige el servidor alojado a menos que tengas una razón para ejecutar un proceso en tu propio equipo. Elimina por completo el archivo de token de tu configuración, y es la ruta que usan primero todos los ejemplos de las siguientes secciones.
⚠️ Atención: Los tutoriales antiguos te indican que instales mcp-replicate. Era un experimento de la comunidad, y su README dice que ya no está en desarrollo activo. El servidor oficial lo ha reemplazado, así que omite el paquete antiguo.
Servidor alojado en mcp.replicate.com
El servidor alojado es el que recomienda Replicate. Los clientes se conectan al endpoint SSE, https://mcp.replicate.com/sse, y terminas con un paso de aprobación en la web donde pegas un token de API de Replicate. Crea uno en replicate.com/account/api-tokens antes de empezar y tenlo listo en el portapapeles.
Servidor local con npx
La opción local ejecuta el mismo servidor como un proceso en tu equipo. Define REPLICATE_API_TOKEN, inícialo con npx -y replicate-mcp y deténlo con Ctrl+C. La mayoría de los clientes lo lanzan por ti desde un archivo de configuración como este:
VS Code con GitHub Copilot lee .vscode/mcp.json y usa un objeto servers de nivel superior en lugar de mcpServers, así que copia el bloque y renombra ese único campo. Si el servidor nunca aparece, comprueba que Node está instalado y que npx funciona desde una terminal normal.
Conectarlo a Claude Desktop
Claude Desktop es la vía más rápida, porque el servidor alojado no necesita ningún archivo de configuración.
Añadir el conector personalizado
Abre Settings (Configuración) y ve a Connectors (Conectores).
Haz clic en Add Custom Connector (Añadir conector personalizado).
Introduce la URL del servidor: https://mcp.replicate.com/sse.
Haz clic en Connect (Conectar) y pega tu token de API de Replicate.
Haz clic en Log in and Approve (Iniciar sesión y aprobar).
Reinicia Claude Desktop. Las herramientas aparecen debajo del icono de controles, bajo el campo del chat.
¿Prefieres el servidor local? Pon el JSON de la sección anterior en claude_desktop_config.json y reinicia la aplicación.
Primer prompt para probar
Empieza con algo que fuerce el ciclo completo de búsqueda, inspección y ejecución:
Busca en Replicate un modelo de texto a imagen fotorrealista y rápido, muéstrame sus opciones de entrada y luego genera una foto de un faro al amanecer en formato 16:9.
Las variantes rápidas de FLUX, como FLUX Schnell, son candidatas típicas para una petición así, aunque la búsqueda decide qué aparece primero. Si la respuesta llega como enlace en lugar de como imagen insertada, es normal: el servidor devuelve la URL de salida y el cliente decide cómo mostrarla.
Una vez que funcione, sé específico. Indica la relación de aspecto, el objetivo, la dirección de la luz y el número de variaciones que quieres. Los prompts vagos desperdician ejecuciones, y cada ejecución se cobra.
Conectarlo a Claude Code
Claude Code necesita un solo comando, y mantiene la conexión entre proyectos.
Instalación con un solo comando
Instala la CLI si aún no la tienes y, después, añade el servidor:
npm install -g @anthropic-ai/claude-code
claude mcp add replicate https://mcp.replicate.com/sse --transport sse --scope user
La marca --scope user guarda el servidor en la configuración de tu usuario, de modo que todo proyecto que abras tendrá acceso a él.
Autenticarse con /mcp
Lanza claude, escribe /mcp, elige la entrada de Replicate y se abrirá una ventana del navegador con el mismo flujo de aprobación que usa Claude Desktop. Cuando indique que está conectado, pide una ejecución en lenguaje natural.
Como Claude Code trabaja dentro de tu repositorio, puede hacer más que mostrar un enlace. Prueba esto: Genera tres opciones de imagen principal para la página de inicio y descarga cada resultado en public/images. El paso de descarga importa más de lo que parece, y la sección de costos más abajo explica por qué.
Si las herramientas no aparecen, ejecuta /mcp de nuevo y revisa la línea de estado del servidor. Un servidor que aparece como desconectado normalmente necesita una autenticación nueva, no una reinstalación.
Conectarlo a Cursor
Cursor lee los servidores MCP desde un archivo JSON, así que esta configuración es unas pocas líneas.
Editar el archivo mcp.json
Abre Cursor Settings (Configuración de Cursor), ve a Tools & Integrations (Herramientas e integraciones) y haz clic en New MCP Server (Nuevo servidor MCP). Cursor abre ~/.cursor/mcp.json, donde añades el servidor alojado mediante el puente mcp-remote:
Para un solo repositorio, crea .cursor/mcp.json en el proyecto, y usa el JSON del servidor local de antes con tu token en env. Guarda el archivo y el servidor debería aparecer en el mismo panel de configuración, junto con sus herramientas.
A partir de ahí, el agente de Cursor puede generar arte provisional, fotos de producto o iconos mientras edita el componente que los necesita. Ese es el verdadero beneficio: el recurso y el cambio en el código se producen en una misma conversación.
Otros clientes compatibles
El mismo servidor funciona más allá de estos tres:
Claude.ai en el navegador
Codex CLI
Google Gemini CLI
Windsurf
Chorus
VS Code con GitHub Copilot, usando .vscode/mcp.json
El patrón no cambia nunca: apunta el cliente a la URL alojada o lanza replicate-mcp de forma local, y luego autentícate una vez.
Tokens, costos y modo código
Tres cosas determinan si esta configuración sigue siendo cómoda: cómo gestionas el token, cuánto cuesta cada ejecución y hasta dónde llevas la automatización.
Protege tu token
Crea el token en replicate.com/account/api-tokens y trátalo como una contraseña.
Prefiere el flujo alojado cuando puedas. El token pasa por la pantalla de aprobación en lugar de quedarse en un archivo de tu repositorio.
Con el servidor local, guarda el token en una variable de entorno o mantén el archivo de configuración fuera del control de versiones. Añade .cursor/mcp.json o .vscode/mcp.json a .gitignore siempre que contengan un token.
Rota el token de inmediato si aparece en un commit, en una captura de pantalla o en un chat compartido.
Qué pagas
El servidor MCP es una puerta de entrada a la misma API, así que cada predicción se factura en tu cuenta de Replicate como cualquier otra llamada a la API. El precio depende del modelo y del hardware en el que se ejecuta, por eso list_hardware y una mirada rápida a las páginas de los modelos ayudan antes de un lote grande.
Un hábito sencillo mantiene la factura previsible. Haz borradores con un modelo rápido y barato como FLUX Schnell, genera cuatro opciones, elige la mejor composición y vuelve a ejecutar solo ese prompt en un modelo de mayor calidad. Indícale esta regla al asistente una vez al inicio de una sesión y la seguirá en cada petición posterior.
Elemento
Qué ocurre
Una predicción que ejecutas
Se factura en tu cuenta de Replicate
Archivos de salida de la API
Se eliminan después de una hora por defecto
Archivos de entrada de la API y registros
Se eliminan después de una hora por defecto
Predicciones hechas en la web
Se conservan indefinidamente
💡 Consejo: Las URL de salida de las predicciones de la API desaparecen después de una hora aproximadamente. Pide al asistente que descargue o suba cada resultado enseguida, sobre todo en una sesión larga.
Modo código en un sandbox
Replicate también incluye un modo código experimental. En lugar de llamar a una herramienta cada vez, el modelo escribe TypeScript y lo ejecuta dentro de un sandbox de Deno. Eso encaja con trabajos que encadenan varias predicciones, como generar seis variaciones y quedarse con las dos mejores. Necesita tener Deno instalado. Añádelo a Claude Code con:
claude mcp add "replicate-code-mode" --scope user --transport stdio -- npx -y replicate-mcp@alpha --tools=code
La etiqueta @alpha te indica qué esperar. Trátalo como un terreno de pruebas, mantén instalado junto a él el servidor habitual y revisa su resultado antes de confiar en él para trabajo de producción.
Una alternativa sin configuración en PicassoIA
Si solo quieres la imagen o el clip terminados y no una tarde de configuración, PicassoIA tiene cientos de modelos en páginas que puedes explorar, sin tokens que pegar. Combínalo con un modelo de lenguaje (LLM) como Claude Sonnet 5 para redactar prompts y luego genera en el navegador.
Cómo usar PicassoIA Image
PicassoIA Image es el modelo de texto a imagen propio de la plataforma, y es un buen lugar para probar un prompt antes de automatizar nada.
Escribe un prompt con un sujeto, un escenario, una dirección de luz y un objetivo, por ejemplo un faro al amanecer, desde un ángulo bajo, luz dorada suave desde la izquierda, objetivo de 35 mm, grano de película.
Elige la relación de aspecto que necesitas, como 16:9 para cabeceras de blog.
Genera, revisa el resultado y ajusta un detalle cada vez.
Envía el ganador a PicassoIA Image Editor Pro para hacer ediciones como reemplazar un objeto o corregir un detalle.
💡 Consejo: Cambia una variable por ejecución. Cuando el resultado mejore, sabrás qué ajuste lo causó.
API y MCP de PicassoIA
PicassoIA también expone una API REST de estilo Replicate, así que el patrón de crear, consultar y obtener que acabas de configurar te resultará familiar:
URL base: https://api.picassoia.com/v1, autenticada con un token Bearer de tu cuenta
Crear una ejecución: POST /v1/models/{owner}/{name}/predictions
Consultar una ejecución: GET /v1/predictions/{id}
Cancelar una ejecución: POST /v1/predictions/{id}/cancel
Cuatro modelos están disponibles a través de la API y de la conexión MCP: PicassoIA Image, PicassoIA Image Editor Pro, PicassoIA Video y Seedance 2.5 Lite. Cada cuenta tiene 5 predicciones simultáneas, compartidas entre tokens y conexiones MCP, y los prompts pueden tener hasta 4000 caracteres. El acceso a la API y a MCP depende de tu plan, así que consulta la página de precios antes de construir sobre ello, y lee la documentación en picassoia.com/en/api.
Servidor MCP de Replicate
API y MCP de PicassoIA
Catálogo
Miles de modelos
Cuatro modelos
Inicio de sesión
Token de API de Replicate
Token Bearer de tu cuenta de PicassoIA
Facturación
Tu cuenta de Replicate
Tu plan de PicassoIA
Mejor opción para
Amplia elección de modelos y experimentos
Un conjunto rápido y fijo para imágenes y video
Crea tu primera imagen hoy
Elige la ruta que encaje con tu día. Si trabajas en una terminal o en un editor, conecta el servidor MCP de Replicate con el comando de tu cliente y ejecuta el prompt del faro. Si quieres un resultado en los próximos sesenta segundos, abre Picasso IA y prueba allí el mismo prompt. Haz ambas cosas, compara los resultados y quédate con lo que encaje en tu flujo de trabajo, o usa cada una para lo que mejor hace.
Tres prompts para probar en PicassoIA Image, cada uno lo bastante corto para pegarlo:
Un barco de pesca al amanecer, ángulo bajo, textura de madera mojada, objetivo de 35 mm, neblina suave, grano de película
Un estante de estudio de cerámica con luz de ventana por la mañana, objetivo de 85 mm, profundidad de campo reducida
Un ciclista cruzando un puente de piedra al atardecer, vista aérea, luz cálida, un desenfoque de movimiento sutil
Explora todos los modelos, desde generadores de imagen y video hasta modelos de lenguaje, en picassoia.com/en/all-models, y empieza hoy mismo a crear tus propias imágenes en Picasso IA.