Gemini 3.5 Flash ha despertado mucho interés desde que Google lo puso a disposición con un nivel de acceso gratuito. La promesa suena casi demasiado bien: un modelo rápido y multimodal, con una ventana de contexto amplia, disponible sin costo. Pero el plan gratuito tiene particularidades que importan mucho según lo que estés construyendo. Este artículo desglosa cada límite para que no tengas que adivinar.
Qué es Gemini 3.5 Flash realmente

Antes de entrar en los límites, conviene saber en qué se diferencia el modelo. Gemini 3.5 Flash pertenece a la familia "Flash" de Google, lo que significa que prioriza el rendimiento y la velocidad por encima del razonamiento más profundo posible. Es una contrapartida deliberada, no un defecto.
Velocidad frente a inteligencia
Los modelos Flash están optimizados para responder rápido. Donde un modelo "Pro" puede tardar varios segundos en resolver una lógica compleja, Flash da respuestas en una fracción de ese tiempo. La precisión se sostiene bien en la mayoría de tareas prácticas: resumen, extracción, traducción, clasificación y programación sencilla. Donde pierde terreno es en el razonamiento lógico de varios pasos que exige manejar muchas variables interdependientes a la vez.
En la mayoría de casos de uso reales, lo primero que notas es la diferencia de velocidad, no una brecha de calidad.
Dónde encaja en la familia

La familia actual de modelos de Google va desde Gemini 3.5 Flash, en el extremo más rápido y ligero, hasta Gemini 3.1 Pro y Gemini 3 Pro, en el extremo más capaz. Flash no es la opción más débil de la gama. Es el caballo de batalla práctico del día a día, que cubre la gran mayoría de lo que los desarrolladores necesitan de verdad. Piénsalo como el modelo al que recurres primero, antes de decidir si hace falta un cálculo más pesado.
💡 Si tu tarea implica leer documentos largos, Gemini 3.5 Flash maneja muy bien el contexto incluso en el plan gratuito. El límite de la ventana de contexto es lo bastante generoso para la mayoría de documentos e informes completos.
Las cifras del plan gratuito

Esto es lo que más quiere saber la mayoría de la gente. El acceso gratuito de Google a Gemini 3.5 Flash llega a través de Google AI Studio y de la API de Gemini. Esto es lo que obtienes:
Peticiones por minuto
El nivel gratuito limita a 15 peticiones por minuto (RPM). Es suficiente para proyectos personales, prototipos y flujos de trabajo ligeros. Si estás construyendo una aplicación en la que varios usuarios lanzan llamadas al mismo tiempo, llegarás a este techo muy pronto. Un equipo pequeño que ejecute procesos automatizados también lo alcanzará.
| Nivel | RPM | Peticiones por día |
|---|
| Free | 15 | 1.500 |
| Pago por uso | 2.000 | Ilimitadas |
| Enterprise | A medida | A medida |
Límites diarios de tokens
La cuota diaria es de 1.500 peticiones al día en el nivel gratuito. Suena a mucho hasta que ejecutas un proceso por lotes, ingieres documentos a gran escala o atiendes a más de un puñado de usuarios activos. Un solo usuario que mantenga una conversación intensa durante toda una jornada laboral puede consumir una parte sorprendente de esa cuota.
En cuanto al volumen total de tokens, el nivel gratuito permite alrededor de 1.000.000 de tokens por minuto. Es generoso para cargas de trabajo de un solo usuario, pero se agota rápido con presión de varios usuarios.
Tamaño de la ventana de contexto
Un aspecto en el que Gemini 3.5 Flash destaca de verdad es su ventana de contexto. Incluso en el plan gratuito tienes acceso a la ventana de contexto completa de 1 millón de tokens. En el nivel gratuito no está limitada artificialmente. Puedes pasar documentos largos, bases de código completas o historiales de conversación extensos sin toparte con ningún límite.
Es una ventaja importante frente a otros modelos en los que el contexto del nivel gratuito se recorta de forma deliberada. Aquí, lo que ves es lo que obtienes.
💡 La ventana de contexto de 1M hace que Gemini 3.5 Flash sea especialmente adecuado para el análisis de documentos y para flujos de generación aumentada por recuperación, en los que alimentas mucho material de origen antes de hacer preguntas.
Qué puedes hacer gratis

El plan gratuito no es solo una demo. Es un nivel funcional que sirve para muchas tareas reales. Estos son los casos en los que rinde bien.
Tareas de texto que funcionan
Gemini 3.5 Flash en el plan gratuito maneja de forma fiable lo siguiente:
- Resumen: Sube un PDF de 40 páginas y obtén un resumen limpio y preciso. La ventana de contexto amplia es una ventaja real aquí.
- Clasificación: Etiqueta texto en gran volumen dentro de tu cuota diaria. La clasificación por sentimiento, categoría e intención funciona sin problemas.
- Extracción: Obtén datos estructurados a partir de texto no estructurado, útil para procesar correos, formularios y contratos.
- Traducción: Buen rendimiento en los principales idiomas, a la altura de los servicios de traducción comerciales para la mayoría de tipos de contenido.
- Respuesta a preguntas: Tanto las preguntas abiertas como las basadas en documentos funcionan bien dentro de los límites de la ventana de contexto.
Visión y entrada de imágenes
Gemini 3.5 Flash es multimodal, lo que significa que puedes enviar imágenes junto con los prompts de texto. En el plan gratuito, la entrada de imágenes está totalmente incluida. Puedes enviar capturas de pantalla, fotos, diagramas o cualquier contenido visual y pedirle al modelo que describa, analice o razone a partir de lo que ve.
Esto resulta especialmente útil en flujos de procesamiento de documentos en los que tienes PDF escaneados o contenido basado en imágenes del que hay que extraer información. El nivel gratuito no restringe el acceso multimodal.
Generación de código

Para los desarrolladores, el rendimiento en programación es sólido. Gemini 3.5 Flash puede escribir funciones, depurar fragmentos de código, explicar lógica existente y sugerir refactorizaciones. Maneja Python, JavaScript, TypeScript, Go y Rust de forma fiable. La calidad de la salida en tareas comunes es competitiva con lo que obtendrías de GPT-4o o DeepSeek V3 en tareas comparables.
El inconveniente es el límite de RPM. Si ejecutas un asistente de programación con IA en el que los usuarios escriben con frecuencia, 15 peticiones por minuto se agotan rápido, incluso en un equipo pequeño.
Dónde el plan gratuito choca con sus límites

Las limitaciones no son solo cuestión de cifras. Algunas restricciones son estructurales y importan sin importar el volumen que manejes.
Sin SLA de producción
El nivel gratuito no tiene garantía de disponibilidad. Google indica de forma explícita que el uso gratuito no incluye un acuerdo de nivel de servicio (SLA). Si el servicio se cae o se degrada, no tienes ninguna vía de reclamación. Para proyectos personales y herramientas internas, normalmente es aceptable. Para cualquier cosa que atienda a clientes que pagan, es un riesgo real.
Los niveles de pago ofrecen SLA formales con compromisos de disponibilidad y vías de escalado de soporte. Si tu negocio depende de una disponibilidad fiable, eso importa mucho.
Términos de datos y privacidad
En el nivel gratuito, Google puede usar tus entradas para mejorar sus modelos. Así lo indican los términos de uso. Para contenido de propósito general, normalmente es aceptable, pero si procesas datos empresariales propietarios, información de clientes o cualquier cosa confidencial, debes prestar mucha atención.
Los niveles de pago por uso y empresariales ofrecen condiciones de tratamiento de datos distintas, incluidas opciones que impiden que tus datos se usen para entrenamiento. Los usuarios del nivel gratuito no tienen esa protección por defecto.
💡 Lee siempre las condiciones actuales de tratamiento de datos antes de pasar datos empresariales sensibles por cualquier nivel gratuito de API. Las condiciones cambian con el tiempo y los valores por defecto rara vez son conservadores.
Sorpresas con los límites de uso
Los límites de uso se aplican a nivel de clave de API, no de cuenta. Esto suena bien hasta que te das cuenta de que crea fallos muy concretos. Si usas una sola clave para varios usuarios o procesos, un pico de tráfico bloquea todo lo demás que comparte esa clave. El nivel gratuito no incluye margen para ráfagas ni suavizado.
Cuando alcanzas el límite de 15 RPM, las peticiones fallan de inmediato en lugar de ponerse en cola. Tu aplicación debe gestionar estos errores de forma explícita, con lógica de reintentos y retroceso exponencial.
Gratuito frente a pago, lado a lado

Poner las cifras reales en contexto facilita mucho la decisión.
La diferencia de precio
| Función | Gratuito | Pago por uso |
|---|
| Precio | $0 | ~$0,075 por 1M de tokens de entrada |
| RPM | 15 | 2.000 |
| Peticiones por día | 1.500 | Ilimitadas |
| SLA | Ninguno | Sí |
| Datos usados para entrenamiento | Posiblemente | No |
| Soporte | Solo comunidad | Soporte de pago |
El precio de los tokens de entrada en el nivel de pago es realmente bajo. Un millón de tokens cuesta menos de un dólar. Si llegas a los límites del nivel gratuito con regularidad, el salto al pago probablemente no sea caro, salvo que proceses volúmenes enormes.
Cuándo cambiar
Los puntos de inflexión que suelen llevar a la gente del gratuito al de pago son constantes:
- Varios usuarios simultáneos que usan la misma clave de API
- Flujos automatizados que ejecutan más de 15 llamadas por minuto
- Procesamiento de datos sensibles o propietarios en los que importan las garantías sobre el tratamiento de datos
- Cualquier producto para usuarios finales en el que el tiempo de inactividad sea inaceptable
Los proyectos personales, la experimentación y los flujos de aprendizaje casi nunca necesitan salir del nivel gratuito.
Cómo usar Gemini 3.5 Flash en PicassoIA
PicassoIA tiene Gemini 3.5 Flash disponible directamente en su colección de modelos de lenguaje grandes. Así puedes usar el modelo sin gestionar claves de API, sin encargarte de la autenticación ni de los límites de uso en bruto.
Paso 1: Accede al modelo
Ve a Gemini 3.5 Flash en PicassoIA. El modelo aparece en la categoría de modelos de lenguaje grandes, junto a otros modelos de texto rápidos como Gemini 3 Flash, Claude Sonnet 4.6 y DeepSeek R1.
Selecciona Gemini 3.5 Flash de la colección. Verás un área de entrada donde puedes escribir tu prompt directamente, sin configuración.
Paso 2: Configura tus entradas
La interfaz acepta prompts de texto y admite entradas multimodales. Puedes:
- Escribir un prompt para generar o analizar texto
- Pegar documentos largos o código para procesarlos
- Hacer preguntas de seguimiento en formato de conversación
La plataforma gestiona el contexto de la sesión de forma automática. No necesitas llevar a mano el historial de la conversación ni contar tokens.
Combinar LLM con generación de imágenes

Donde PicassoIA resulta especialmente útil es en combinar la generación de texto con la salida visual en la misma sesión. Puedes usar Gemini 3.5 Flash para escribir textos, descripciones de artículos o briefs creativos, y luego cambiar de inmediato a los modelos de generación de imágenes para producir visuales para ese contenido.
La plataforma tiene más de 91 modelos de texto a imagen disponibles. Este flujo de trabajo, en el que generas contenido estructurado con un LLM y luego produces imágenes a juego sin cambiar entre varias herramientas y cuentas, es de verdad más rápido que gestionarlos por separado.
Para comparar, otros LLM potentes disponibles en la misma plataforma incluyen GPT-4o, Claude 4 Sonnet, Gemini 2.5 Flash y Gemini 3.1 Pro. Cada uno tiene un equilibrio distinto entre velocidad y capacidad, así que puedes cambiar según la tarea sin salir de la plataforma.
Lo que puedes construir ahora mismo

El plan gratuito es de verdad útil para una amplia gama de tareas reales. Esto es lo que la gente está construyendo con él:
- Herramientas internas de documentos: Resume notas de reuniones, extrae tareas pendientes y clasifica tickets de soporte. El uso ligero por varios usuarios se mantiene cómodamente dentro de la cuota diaria.
- Asistentes de escritura: Redacta correos, reescribe textos y genera esquemas estructurados. Las tareas de bajo RPM funcionan sin problemas dentro de los límites gratuitos.
- Revisores de código: Pega una función y recibe comentarios. Las herramientas de programación para un solo usuario casi nunca alcanzan los límites de frecuencia en la práctica.
- Pipelines de extracción de datos: Pasa documentos estructurados por el modelo para extraer campos específicos. El procesamiento por lotes funciona bien mientras te mantengas por debajo de 1.500 peticiones diarias.
- Prototipos y MVP: Construye y prueba ideas de producto sin ningún costo de infraestructura. Pasa a un plan de pago cuando lleguen usuarios reales y el volumen lo justifique.
El plan gratuito no es un simple adelanto recortado. Es un nivel de trabajo con restricciones reales, pensado para cubrir exactamente este abanico de casos de uso. Lo que no cubre es el tráfico de producción a una escala considerable, ni los flujos de trabajo con requisitos estrictos de tratamiento de datos.
Si no estás seguro de que el nivel gratuito sea suficiente, haz la cuenta con tu volumen previsto de peticiones: 15 RPM multiplicadas por tus horas de uso activo te dan tu techo práctico. La mayoría de proyectos personales y productos en fase inicial caben cómodamente dentro de él.
Cuando estés listo para ir más allá, empieza usando Gemini 3.5 Flash en PicassoIA para tus tareas de texto y razonamiento. Combínalo con las herramientas de generación de imágenes de la plataforma para producir visuales en la misma sesión. Ambas cosas están en un solo lugar, sin configurar ninguna API. Elige una tarea real que hayas estado haciendo a mano y pásala por el modelo. La diferencia de velocidad y calidad suele hacerse evidente en los primeros minutos.