Avis Picasso AI : fonctions image, vidéo, API et MCP
Picasso IA réunit la génération d’images, la génération de vidéos, les modèles de langage, une API pour développeurs et un connecteur MCP sous un seul identifiant. Cet avis examine ce que fait bien chaque partie, où se situent les limites, ce que comprend chaque forfait et qui serait mieux servi ailleurs.
La plupart des plateformes d’IA vous obligent à vous cantonner à un seul outil. Les images vivent dans un outil, la vidéo dans un autre, une fenêtre de discussion ailleurs, et l’API pour développeurs se trouve derrière une autre page de facturation. Cet avis sur Picasso AI examine une plateforme qui tente de réunir tout cela sous un seul identifiant, puis y ajoute une API pour développeurs et un connecteur MCP. C’est une grande promesse, alors je l’ai vérifiée point par point.
Un avertissement avant les détails : les chiffres ci-dessous proviennent des pages de modèles de la plateforme, de sa documentation API et de sa page tarifaire. Ce ne sont pas des benchmarks de laboratoire, et chaque durée de rendu est un chiffre affiché sur les pages de la galerie. Lorsque ces pages se contredisent, je le signale au lieu de retenir la version la plus flatteuse.
Le verdict rapide
Picasso AI convient très bien si vous générez beaucoup d’images et de courts clips et si vous en avez assez de compter vos crédits. Il convient moins si vous avez besoin d’une adresse publique de serveur MCP, de plus de quatre modèles via l’API, ou d’une réponse claire sur le forfait qui inclut l’accès à l’API.
Voici la version courte, domaine par domaine :
Domaine
Ce qu’il propose
Verdict rapide
Images
Un modèle natif illimité, un éditeur natif et des dizaines de modèles externes
Solide
Vidéo
Clips natifs de 5 secondes, plus des clips Seedance Lite jusqu’à 10 secondes, avec son dans les deux cas
Solide pour les clips courts
Modèles de discussion
Plus de 70 modèles de langage dans une seule collection
Formules illimitées plus crédits pour les modèles premium
Relisez bien les conditions du forfait
💡 Astuce : Si vous n’avez que dix minutes, faites deux tests : un prompt dans le modèle d’image et un clip image vers vidéo. Ces deux essais vous diront déjà l’essentiel de ce que sera l’usage quotidien.
Génération et retouche d’images
Les images sont le domaine où la plateforme paraît la plus aboutie. On y trouve un modèle natif, un éditeur natif et une longue liste de modèles externes, le tout sur le même compte.
Le modèle d’image maison
Picasso IA Image est le modèle natif de texte vers image. Sa page liste sept formats (1:1, 16:9, 9:16, 4:3, 3:4, 3:2 et 2:3), une seed que vous pouvez verrouiller pour obtenir des résultats reproductibles, une sortie en JPG, PNG ou WebP, et jusqu’à deux images par appel. Le point fort est l’absence de compteur : la page décrit la génération comme illimitée, sans plafond par image ni quota quotidien.
Les promesses de vitesse sont également audacieuses. La galerie d’exemples indique des durées de génération comprises entre 0,63 et 0,67 seconde. Considérez cela comme un cas optimal, sur des prompts courts, car ce sont les chiffres de la plateforme elle-même et non les miens.
Editor Pro pour les retouches
Picasso IA Image Editor Pro modifie des photos à partir d’une instruction textuelle. Il accepte jusqu’à trois images de référence, auxquelles vous faites référence dans le prompt par « image 1 », « image 2 » et « image 3 ». Cela compte pour des tâches comme placer une personne d’une photo dans la scène d’une autre.
La galerie présente des changements de tenue, un flacon de parfum posé sur du marbre noir, une voiture recolorée du rouge au bleu et une rue de jour transformée en vue de nuit. Le format par défaut est match_input_image, ce qui préserve votre cadrage sauf si vous demandez autre chose. Les durées annoncées vont d’environ 0,9 à 2,5 secondes.
💡 Astuce : Précisez ce qui doit rester identique. Une phrase comme « conserver l’arrière-plan et la scène d’origine sans modification » apparaît dans les prompts de la galerie, et elle empêche les retouches de dériver.
Modèles d’image tiers
Des modèles externes sont proposés à côté des modèles natifs. Le tableau en présente quatre qui méritent d’être testés sur vos propres prompts. La dernière colonne reflète la réputation, pas un benchmark que j’ai réalisé.
La page tarifaire indique que certains modèles externes sont gratuits ou illimités sur certaines formules, tandis que les autres puisent dans les crédits. Vérifiez le coût d’un modèle sur votre forfait avant de lancer un gros lot.
Rédigez le prompt en langage courant : sujet, décor, direction de la lumière et objectif. La précision vaut mieux que la brièveté.
Choisissez un format. Le format par défaut est 1:1 ; passez en 16:9 pour les en-têtes de blog ou en 9:16 pour les stories.
Facultatif : définissez une seed, choisissez JPG, PNG ou WebP, et augmentez la qualité de sortie au-delà de la valeur par défaut de 80 si la taille du fichier ne vous pose pas problème.
Réglez le nombre de sorties sur 2 lorsque vous voulez comparer deux versions.
La vidéo est le test le plus rude pour l’idée d’un compte unique, car les clips sont lents et coûteux à générer. Deux modèles natifs couvrent l’essentiel, et une longue liste de modèles externes complète le reste.
Clips natifs avec son
Picasso IA Video transforme un prompt textuel ou une image de départ en un clip fixe de 5 secondes à une fréquence d’images de 24 fps. Le son est généré en synchronisation par défaut, et un interrupteur save_audio vous donne un clip muet à la place. La résolution est de 480p ou 720p, avec 720p par défaut. Les durées de rendu relevées dans la galerie se situent entre environ 31 et 78 secondes.
Seedance 2.5 Lite élargit le format. Il génère des clips de 5 ou 10 secondes, toujours en 480p et 720p, et ajoute une dernière image facultative afin qu’un clip puisse passer d’une image à une autre. Ses exemples de 10 secondes affichent des durées de rendu proches de 104 secondes.
Il y a ici un problème de formulation. La page Seedance Lite lie l’usage illimité aux membres Wonder, tandis que la page tarifaire parle de formules Pro+, Elite et Infinite et indique des limites de résolution différentes pour le même modèle. Je n’ai pas pu concilier les deux : vérifiez quelle formule s’applique à votre compte avant de planifier un lot.
Le son mérite une pause. Les clips muets exigent une passe sonore séparée, et le fait que des bruits de pas, de vent ou une ambiance de pièce arrivent avec la vidéo supprime une étape entière pour les contenus courts. Considérez-le comme un premier jet du son, pas comme un mixage final.
Modèles vidéo premium
La collection de texte vers vidéo compte nettement plus de 100 entrées. Les noms que l’on demande le plus souvent sont Veo 3.1, Kling v3 Video, Sora 2, Wan 3 et Seedance 2.5, dont la page annonce des clips jusqu’à 30 secondes.
Un point à garder en tête sur ce décompte : la collection mélange des générateurs et des utilitaires. Robust Video Matting supprime les arrière-plans de vidéos et Deoldify Video colorise les vieilles séquences. Ces outils sont utiles, mais ce ne sont pas des générateurs texte vers vidéo ; ne lisez donc pas le nombre d’entrées comme un nombre de générateurs.
Modèles de discussion et effets
Une plateforme créative dépend entièrement de ce qui entoure les générateurs. Deux extras méritent un coup d’œil : les modèles de langage et la bibliothèque d’effets.
L’usage concret est un pipeline de prompts. Demandez à un modèle de discussion de rédiger dix prompts d’image pour une campagne, retenez les trois meilleurs, puis collez-les dans le modèle d’image. Vous pouvez obtenir ces modèles de discussion ailleurs : la valeur ici tient donc à la commodité et à un compte unique, pas à l’exclusivité.
La bibliothèque d’effets
La page tarifaire présente une bibliothèque d’effets qui s’étoffe avec la formule : 250+ sur Pro+, 400+ sur Elite et 647+ sur Infinite. La même page cite parmi les fonctions incluses la synchronisation labiale, la suppression d’arrière-plan, la super-résolution, la reconnaissance vocale, la synthèse vocale et la musique IA.
Une réserve : quand j’ai demandé au catalogue de modèles la catégorie des effets, il n’a renvoyé aucune entrée, je n’ai donc pas pu vérifier les effets un par un. Considérez ces chiffres comme des chiffres marketing tant que vous n’aurez pas parcouru la bibliothèque vous-même.
Accès à l’API et au MCP
Les fonctions pour développeurs sont la partie la plus récente de la plateforme, et la raison d’être de cet avis. Ce sont aussi celles où les détails comptent le plus ; cette section reste donc au plus près de la documentation.
Fonctionnement de l’API
L’API se trouve à https://api.picassoia.com/v1 et s’authentifie avec un token Bearer qui commence par pia_sk_. Les tâches sont asynchrones et suivent le schéma de Replicate : créer une prédiction, interroger son statut, puis lire le résultat.
Un corps de requête enveloppe vos réglages dans un objet input. Les statuts sont starting, processing, succeeded, failed et canceled, et output reste null jusqu’à ce que la tâche réussisse. Cette boucle Python est adaptée du modèle présent dans la documentation :
import os, time, requests
API = "https://api.picassoia.com/v1"
HEADERS = {"Authorization": f"Bearer {os.environ['PICASSOIA_TOKEN']}"}
def run(model, payload):
r = requests.post(f"{API}/models/{model}/predictions",
json={"input": payload}, headers=HEADERS)
pred = r.json()
if not r.ok:
raise RuntimeError(f"{pred['code']}: {pred['detail']}")
while pred["status"] not in ("succeeded", "failed", "canceled"):
time.sleep((pred.get("eta") or {}).get("next_poll_in_seconds", 2))
pred = requests.get(pred["urls"]["get"], headers=HEADERS).json()
if pred["status"] != "succeeded":
raise RuntimeError(pred["error"] or pred["status"])
return pred["output"]
urls = run("picassoia/picassoia-image",
{"prompt": "a lighthouse at sunset, oil painting", "aspect_ratio": "16:9"})
La réponse contient une indication eta.next_poll_in_seconds, vous n’avez donc pas à deviner un intervalle d’interrogation.
Les limites que vous allez rencontrer
5 prédictions simultanées. Un compte peut avoir jusqu’à 5 prédictions en file d’attente ou en cours, partagées entre ses tokens d’API et ses connexions MCP.
4 000 caractères par prompt, un corps de requête de 10 Mo et un délai d’expiration de 3 heures par prédiction.
Quatre modèles seulement. Si votre produit a besoin de Flux, Veo ou Sora derrière un seul point de terminaison, cette API n’est pas faite pour cela.
Le connecteur MCP permet à un assistant compatible MCP de piloter les mêmes quatre modèles sans que vous écriviez de code HTTP. La liste des outils est courte et lisible :
generate_image et edit_image pour les deux modèles d’image
generate_video_picassoia et generate_video_seedance pour les deux modèles vidéo
get_generation pour interroger une tâche, list_generations pour voir les précédentes et cancel_generation pour en arrêter une
list_models pour voir ce que votre compte peut utiliser et get_account pour vérifier votre forfait et vos limites de simultanéité
Chaque appel de génération renvoie immédiatement un identifiant de prédiction, avec une durée estimée et un délai d’attente conseillé avant la première interrogation. L’assistant vérifie ensuite get_generation jusqu’à ce que la tâche indique succeeded ou failed. Un échec est définitif : une nouvelle tentative implique donc une nouvelle génération.
💡 Astuce : MCP et l’API partagent les mêmes 5 emplacements. Un script et un assistant qui tournent en même temps se disputeront ces emplacements, et celui qui perd recevra une erreur concurrency_limit.
Les connexions se créent depuis la page MCP de votre compte, qui exige une connexion. Je n’ai pas trouvé d’adresse publique de serveur sur le site, je ne peux donc pas vous dire quoi coller dans la configuration d’un client. Votre page de compte fait foi.
Forfaits et coût réel
Les tarifs sont la partie de cet avis où je ralentirais pour relire deux fois. La plateforme combine génération illimitée, solde mensuel de crédits et emplacements parallèles, et les trois forfaits diffèrent sur chacun de ces points.
Ce que comprend chaque forfait
Voici ce que la page tarifaire affichait lors de ma vérification. Les prix intègrent une remise annuelle qui change, je les ai donc omis et j’ai conservé la structure.
La logique est simple. Pro+ vous donne les outils d’image illimités, Elite ajoute la vidéo illimitée en résolution inférieure et un deuxième emplacement parallèle, et Infinite ouvre les modèles premium ainsi que quatre emplacements.
Le décalage sur l’API
Voici la contradiction que j’ai signalée plus tôt. La documentation de l’API indique : « Les prédictions API sont actuellement gratuites. Elles n’utilisent aucun crédit. » Les mêmes documents précisent ensuite que la création de prédictions exige un forfait Infinite, et l’erreur plan_required existe précisément pour ce cas. Pourtant, la page tarifaire indique l’accès API et les connexions MCP sur Pro+ et Elite également.
La lecture la plus probable est que les forfaits inférieurs peuvent lire et gérer les prédictions existantes, mais ne peuvent pas en créer de nouvelles. C’est une supposition, pas une règle confirmée. Avant de construire quoi que ce soit, envoyez une petite prédiction de test. Un 403 avec plan_required signifie que votre forfait est trop bas : cela vous coûte une minute au lieu d’un sprint.
Points forts et faiblesses
Ce qui fonctionne
Outils natifs illimités. Le modèle d’image et l’éditeur n’ont pas de plafond par image annoncé, et les durées de la galerie sont courtes.
Les clips courts arrivent avec le son. Les deux modèles vidéo natifs génèrent un audio synchronisé, et Seedance Lite ajoute des clips de 10 secondes et le contrôle de la dernière image.
Un compte pour de nombreux travaux. Images, vidéo et plus de 70 modèles de discussion partagent un même identifiant et un même solde.
Une API bien structurée. Le flux créer, interroger puis lire est facile à scripter, les erreurs ont des noms et les indications d’interrogation sont intégrées.
Le MCP utilise le même pool. Il n’y a pas de second système à prendre en main, seulement les mêmes quatre modèles derrière une nouvelle porte.
Ce qui doit être amélioré
L’API est restreinte. Quatre modèles et 5 tâches simultanées écartent de nombreux usages en production.
La formulation des forfaits est incohérente. Wonder, Pro+, Elite et Infinite apparaissent sur différentes pages, et les limites de résolution de Seedance Lite diffèrent entre elles.
La configuration MCP est cachée derrière une connexion. Il n’y a pas d’adresse publique de serveur à examiner au préalable.
Les effets ne peuvent pas être vérifiés depuis le catalogue. Les chiffres figurent sur la page tarifaire, mais le catalogue n’en liste aucun.
Les chiffres de vitesse sont auto-déclarés. Considérez chaque durée comme un cas optimal tant que vous n’avez pas fait vos propres mesures.
À qui cela ne convient-il pas ? Aux équipes qui ont besoin d’une seule API pour de nombreux modèles externes, à quiconque veut une sortie en 1080p depuis les modèles vidéo natifs, et aux acheteurs qui ont besoin de conditions écrites avant de payer. Les autres en obtiennent beaucoup pour leur argent.
Créez votre première image dès aujourd’hui
La façon la plus rapide de juger une plateforme est d’y passer cinq minutes. Ouvrez Picasso IA Image, collez un prompt qui décrit une scène réelle de votre travail, passez le format en 16:9 et générez deux versions. Choisissez la meilleure, envoyez-la dans Picasso IA Image Editor Pro avec une petite correction, puis transformez le résultat en clip de 5 secondes avec Picasso IA Video.
Si ces trois étapes vous paraissent rapides, vous saurez en une heure si les formules illimitées conviennent à votre charge de travail. Pour voir ce qui est disponible avant de payer quoi que ce soit, parcourez le catalogue sur picassoia.com/en/all-models et testez quelques modèles côte à côte avec le même prompt. Rédigez le prompt, lancez la génération et créez votre première image dès aujourd’hui.