Reseña de Picasso IA: funciones de imagen, video, API y MCP
Picasso IA reúne generación de imágenes, generación de video, modelos de lenguaje, una API para desarrolladores y un conector MCP bajo un solo inicio de sesión. Esta reseña analiza qué hace bien cada parte, dónde están sus límites, qué incluye cada plan y quién estaría mejor con otra opción.
La mayoría de las plataformas de IA te obligan a elegir un camino. Las imágenes viven en una herramienta, el video en otra, una ventana de chat en algún otro sitio, y la API para desarrolladores queda detrás de una página de facturación distinta. Esta reseña de Picasso IA analiza una plataforma que intenta reunir todo bajo un solo inicio de sesión y que, además, añade una API para desarrolladores y un conector MCP. Es una promesa grande, así que la he revisado pieza por pieza.
Una advertencia antes de los detalles: las cifras de abajo proceden de las propias páginas de modelos de la plataforma, de su documentación de API y de su página de precios. No son benchmarks de laboratorio, y cada tiempo de render es una cifra que aparece en las páginas de galería. Cuando esas páginas no coinciden entre sí, lo digo en lugar de quedarme con la versión más favorable.
Veredicto rápido
Picasso IA encaja bien si generas muchas imágenes y clips cortos y estás cansado de contar créditos. Encaja peor si necesitas una dirección pública de servidor MCP, más de cuatro modelos a través de la API o una respuesta clara sobre qué plan incluye el acceso a la API.
Esta es la versión corta, área por área:
Área
Qué ofrece
Valoración breve
Imágenes
Un modelo nativo ilimitado, un editor nativo y decenas de modelos externos
Sólido
Video
Clips nativos de 5 segundos, más clips de Seedance Lite de hasta 10 segundos, ambos con audio
Sólido para clips cortos
Modelos de chat
Más de 70 modelos de lenguaje en una sola colección
Un extra útil
API
4 modelos, 5 trabajos a la vez, códigos de error documentados
Estrecha pero limpia
MCP
Un conector que expone los mismos 4 modelos
Útil, pero poco detallado en la configuración
Precios
Planes ilimitados más créditos para modelos premium
Lee dos veces las condiciones de cada plan
💡 Consejo: Si solo tienes diez minutos, haz dos pruebas: un prompt en el modelo de imagen y un clip de imagen a video. Esas dos pruebas te dirán buena parte de lo que supondrá el uso diario.
Generación y edición de imágenes
En imágenes, la plataforma parece más completa. Hay un modelo propio, un editor propio y una amplia oferta de modelos externos, todos en la misma cuenta.
El modelo de imagen propio
Picasso IA Image es el modelo nativo de texto a imagen. Su página enumera siete relaciones de aspecto (1:1, 16:9, 9:16, 4:3, 3:4, 3:2 y 2:3), una semilla que puedes fijar para obtener resultados repetibles, salida en JPG, PNG o WebP, y hasta dos imágenes por llamada. La característica principal es la ausencia de contador: la página describe la generación como ilimitada, sin tope por imagen ni cuota diaria.
Las cifras de velocidad también son atrevidas. La galería de ejemplos enumera tiempos de generación entre 0,63 y 0,67 segundos. Considéralo como el escenario más favorable con prompts cortos, porque son los tiempos de la propia plataforma y no míos.
Editor Pro para ediciones
Picasso IA Image Editor Pro edita fotos a partir de una instrucción de texto. Acepta hasta tres imágenes de referencia, y las señalas dentro del prompt como "imagen 1", "imagen 2" e "imagen 3". Eso importa en trabajos como colocar a una persona de una foto dentro de la escena de otra.
La galería muestra cambios de vestuario, un frasco de perfume sobre mármol negro, un coche recoloreado de rojo a azul y una calle de día convertida en vista nocturna. La relación de aspecto predeterminada es match_input_image, así que el encuadre se mantiene a menos que pidas otra cosa. Los tiempos indicados van de unos 0,9 a 2,5 segundos.
💡 Consejo: Nombra lo que debe seguir igual. Una frase como "mantén el fondo y la escena originales sin cambios" aparece en los prompts de la galería, y evita que las ediciones se descontrolen.
Modelos de imagen de terceros
Los modelos externos se sitúan junto a los nativos. La tabla recoge cuatro que vale la pena probar con tus propios prompts. La última columna refleja la reputación, no un benchmark que yo haya ejecutado.
La página de precios marca algunos modelos externos como gratuitos o ilimitados en ciertos planes, y el resto consume créditos. Confirma lo que cuesta cada modelo en tu plan antes de poner en cola un lote grande.
Escribe el prompt en lenguaje sencillo: sujeto, escenario, dirección de la luz y objetivo. Lo concreto supera a lo breve.
Elige una relación de aspecto. La predeterminada es 1:1, así que cámbiala a 16:9 para encabezados de blog o a 9:16 para historias.
Opcional: fija una semilla, elige JPG, PNG o WebP y sube la calidad de salida desde el valor predeterminado de 80 si el tamaño del archivo no te preocupa.
Pon el número de salidas en 2 cuando quieras dos versiones para comparar.
Con el video, la idea de "una sola cuenta" se pone más a prueba, porque los clips son lentos y caros de renderizar. Dos modelos nativos hacen la mayor parte del trabajo, y una larga lista de modelos externos cubre el resto.
Clips nativos con audio
Picasso IA Video convierte un prompt de texto o una imagen inicial en un clip fijo de 5 segundos a 24 fotogramas por segundo (fps). El audio se genera sincronizado por defecto, y un interruptor save_audio te da un clip silencioso en su lugar. La resolución es 480p o 720p, con 720p como predeterminada. Los tiempos de render de la galería para este modelo se sitúan entre unos 31 y 78 segundos.
Seedance 2.5 Lite amplía el formato. Renderiza clips de 5 o 10 segundos, también a 480p y 720p, y añade un último fotograma opcional para que un clip pase animado de una imagen a otra. Sus ejemplos de 10 segundos muestran tiempos de render cercanos a los 104 segundos.
Aquí hay un problema de redacción. La página de Seedance Lite vincula el uso ilimitado a los miembros de Wonder, mientras que la página de precios habla de los niveles Pro+, Elite e Infinite y enumera límites de resolución distintos para el mismo modelo. No pude conciliar ambas, así que confirma qué nivel se aplica a tu cuenta antes de planear un lote.
El audio merece una pausa. Los clips silenciosos necesitan un paso de sonido aparte, y que los pasos, el viento o el ambiente de una habitación lleguen junto con el video elimina un paso completo en el trabajo de formato corto. Tómalo como un primer borrador del sonido, no como una mezcla final.
Modelos de video premium
La colección de texto a video reúne bastante más de 100 entradas. Los nombres por los que más pregunta la gente son Veo 3.1, Kling v3 Video, Sora 2, Wan 3 y Seedance 2.5, cuya página anuncia clips de hasta 30 segundos.
Algo que conviene saber sobre ese recuento: la colección mezcla generadores con utilidades. Robust Video Matting elimina fondos de video y Deoldify Video colorea material antiguo. Ambas son útiles, pero no son generadores de texto a video, así que no leas el número de entradas como un recuento de generadores.
Modelos de chat y efectos
Una plataforma creativa depende por completo de lo que ocurre alrededor de los generadores. Hay dos extras que merecen atención: los modelos de lenguaje y la biblioteca de efectos.
El uso práctico es un flujo de prompts. Pides a un modelo de chat que redacte diez prompts de imagen para una campaña, eliges los mejores tres y los pegas en el modelo de imagen. Esos modelos de chat también puedes encontrarlos en otros sitios, así que el valor aquí es la comodidad y una sola cuenta, no la exclusividad.
La biblioteca de efectos
La página de precios enumera una biblioteca de efectos que crece según el plan: 250+ en Pro+, 400+ en Elite y 647+ en Infinite. La misma página incluye entre las funciones del plan la sincronización labial, la eliminación de fondo, la superresolución, la voz a texto, el texto a voz y la música con IA.
Una salvedad: cuando pedí al catálogo de modelos la categoría de efectos, no devolvió ninguna entrada, así que no pude comprobar efectos individuales. Toma esas cifras como datos de marketing hasta que explores la biblioteca tú mismo.
Acceso a API y MCP
Las funciones para desarrolladores son la parte más nueva de la plataforma y son la razón de que exista esta reseña. También aquí importan más los detalles, así que esta sección se mantiene cerca de la documentación.
Cómo funciona la API
La API está en https://api.picassoia.com/v1 y se autentica con un token Bearer que empieza por pia_sk_. Los trabajos son asíncronos y siguen el patrón al estilo Replicate: creas una predicción, consultas su estado y luego lees la salida.
Endpoint
Función
POST /v1/models/{owner}/{name}/predictions
Crear una predicción
GET /v1/predictions/{id}
Consultar el estado de una predicción
POST /v1/predictions/{id}/cancel
Cancelar una predicción
GET /v1/predictions
Listar tus predicciones
Cuatro modelos están disponibles a través de la API:
El cuerpo de la solicitud envuelve tus ajustes en un objeto input. Los estados son starting, processing, succeeded, failed y canceled, y output se mantiene en null hasta que el trabajo termina con éxito. Este bucle de Python está adaptado del patrón de la documentación:
import os, time, requests
API = "https://api.picassoia.com/v1"
HEADERS = {"Authorization": f"Bearer {os.environ['PICASSOIA_TOKEN']}"}
def run(model, payload):
r = requests.post(f"{API}/models/{model}/predictions",
json={"input": payload}, headers=HEADERS)
pred = r.json()
if not r.ok:
raise RuntimeError(f"{pred['code']}: {pred['detail']}")
while pred["status"] not in ("succeeded", "failed", "canceled"):
time.sleep((pred.get("eta") or {}).get("next_poll_in_seconds", 2))
pred = requests.get(pred["urls"]["get"], headers=HEADERS).json()
if pred["status"] != "succeeded":
raise RuntimeError(pred["error"] or pred["status"])
return pred["output"]
urls = run("picassoia/picassoia-image",
{"prompt": "a lighthouse at sunset, oil painting", "aspect_ratio": "16:9"})
La respuesta incluye una pista eta.next_poll_in_seconds, así que no tienes que adivinar un intervalo de consulta.
Los límites con los que te topas
5 predicciones a la vez. Una cuenta puede tener hasta 5 predicciones en cola o en ejecución, compartidas entre sus tokens de API y sus conexiones MCP.
4000 caracteres por prompt, un cuerpo de solicitud de 10 MB y un tiempo límite de 3 horas por predicción.
Solo cuatro modelos. Si tu producto necesita Flux, Veo o Sora detrás de un único endpoint, esta API no es eso.
El conector MCP permite que un asistente compatible con MCP maneje los mismos cuatro modelos sin que escribas código HTTP. La lista de herramientas es corta y fácil de leer:
generate_image y edit_image para los dos modelos de imagen
generate_video_picassoia y generate_video_seedance para los dos modelos de video
get_generation para consultar un trabajo, list_generations para ver los anteriores y cancel_generation para detener uno
list_models para ver qué puede usar tu cuenta y get_account para revisar tu plan y tus límites de paralelismo
Cada llamada de generación devuelve de inmediato un ID de predicción, con un tiempo estimado y una espera sugerida antes de la primera consulta. Después, el asistente consulta get_generation hasta que el trabajo indique succeeded o failed. Un fallo es definitivo, así que reintentar significa una nueva generación.
💡 Consejo: MCP y la API comparten las mismas 5 ranuras. Un script y un asistente que funcionen al mismo tiempo competirán por ellas, y el que se quede sin ranura recibirá un error concurrency_limit.
Las conexiones se crean desde la página de MCP dentro de tu cuenta, que requiere iniciar sesión. No encontré una dirección pública de servidor en el sitio, así que no puedo decirte qué pegar en una configuración de cliente. La página de tu cuenta es la fuente de referencia.
Planes y costo real
Los precios son la parte de esta reseña en la que me detendría y leería dos veces. La plataforma mezcla generación ilimitada, un saldo mensual de créditos y ranuras paralelas, y los tres planes difieren en todo ello.
Qué incluye cada plan
Esto es lo que mostraba la página de precios cuando lo revisé. Los precios llevan un descuento anual que cambia, así que los omití y conservé la estructura.
El patrón es sencillo. Pro+ te da acceso a las herramientas de imagen ilimitadas, Elite añade video ilimitado con menor resolución y una segunda ranura paralela, e Infinite abre los modelos premium y cuatro ranuras.
El desajuste de la API con los planes
Aquí está la contradicción que señalé antes. La documentación de la API dice: "Las predicciones de API son actualmente gratuitas. No usan créditos." Acto seguido, la misma documentación dice que crear predicciones requiere un plan Infinite, y el error plan_required existe justamente para ese caso. Sin embargo, la página de precios incluye el acceso a API y las conexiones MCP también en Pro+ y Elite.
La lectura más probable es que los planes inferiores puedan leer y gestionar predicciones existentes, pero no crear nuevas. Eso es una suposición, no una regla confirmada. Antes de construir nada, envía una predicción de prueba pequeña. Un 403 con plan_required significa que tu plan es demasiado bajo, y te cuesta un minuto en lugar de un sprint.
Puntos fuertes y débiles
Lo que funciona
Herramientas nativas ilimitadas. El modelo de imagen y el editor no tienen un tope declarado por imagen, y los tiempos de la galería son cortos.
Los clips cortos llegan con sonido. Ambos modelos nativos de video generan audio sincronizado, y Seedance Lite añade clips de 10 segundos y control del último fotograma.
Una cuenta para muchos trabajos. Imágenes, video y más de 70 modelos de chat comparten un inicio de sesión y un saldo.
Una forma de API limpia. El flujo de crear, consultar y leer es fácil de automatizar, los errores tienen nombre y las pistas de consulta vienen integradas.
MCP usa el mismo conjunto. No hay un segundo sistema que aprender, solo los mismos cuatro modelos tras una nueva puerta.
Lo que necesita mejorar
La API es estrecha. Cuatro modelos y 5 trabajos simultáneos descartan muchos usos de producción.
La redacción de los planes es irregular. Wonder, Pro+, Elite e Infinite aparecen en páginas distintas, y los límites de resolución de Seedance Lite difieren entre ellas.
La configuración de MCP está oculta tras un inicio de sesión. No hay una dirección pública de servidor que revisar primero.
Los efectos no se pueden verificar desde el catálogo. Los recuentos están en la página de precios, pero el catálogo no muestra ninguno.
Las cifras de velocidad son autoinformadas. Toma cada tiempo como el escenario más favorable hasta que hagas tus propias pruebas.
¿Quién debería descartarlo? Los equipos que necesitan una sola API para muchos modelos externos, quienes quieran salida en 1080p desde los modelos de video nativos y quienes necesiten términos del plan por escrito antes de pagar. Todos los demás obtienen mucha generación por su dinero.
Crea tu primera imagen hoy
La forma más rápida de juzgar una plataforma es pasar cinco minutos dentro de ella. Abre Picasso IA Image, pega un prompt que describa una escena real de tu trabajo, cambia la relación de aspecto a 16:9 y genera dos versiones. Elige la mejor, envíala a Picasso IA Image Editor Pro con una pequeña corrección y luego convierte el resultado en un clip de 5 segundos con Picasso IA Video.
Si esos tres pasos te resultan rápidos, sabrás en menos de una hora si los niveles ilimitados encajan con tu carga de trabajo. Para ver qué más hay antes de pagar por algo, explora el catálogo en picassoia.com/en/all-models y prueba unos cuantos modelos uno al lado del otro con el mismo prompt. Escribe el prompt, pulsa generar y crea tu primera imagen hoy.