AltText Gen
Clic derecho en cualquier imagen → genera texto alternativo descriptivo. ML en el dispositivo, sin servidores, sin API keys.
Clic derecho en cualquier imagen → 'Generate Alt Text' — descripción instantánea
ML en el dispositivo (MobileNet v2, 13MB) vía LiteRT.js — 100% offline, sin API keys
Clasificación top-5 con puntuaciones de confianza
Generación de descripciones basada en plantillas a partir de las etiquetas
Copia al portapapeles o asigna directamente al atributo alt de la imagen
Resultado editable — refina el texto antes de aplicarlo
Estadísticas: total de imágenes descritas
100% gratis, sin premium, sin tracking, sin servidores
AltText Gen genera texto alternativo descriptivo para cualquier imagen — clic derecho, elige “Generate Alt Text” y obtén una descripción al instante. Funciona con MobileNet v2 en el dispositivo, sin servidores, sin API keys, sin datos saliendo de tu navegador.
Cómo funciona
- Clic derecho en una imagen → el menú contextual muestra “Generate Alt Text”
- La imagen se procesa — se redimensiona a 224×224, se normaliza al rango [-1, 1]
- Inferencia de MobileNet v2 — LiteRT.js ejecuta el modelo (WebGPU preferido, fallback a WASM)
- Top-5 predicciones — p. ej., “golden retriever (0.89), tennis ball (0.31), dog (0.28)”
- Se genera la descripción — basada en plantillas: “Un golden retriever” o “Imagen de un golden retriever con una pelota de tenis”
- Popup de resultado — texto editable, botones “Copy” y “Set as alt”
El modelo de ML
| Propiedad | Valor |
|---|---|
| Modelo | MobileNet v2 |
| Tamaño | 13.3 MB |
| Entrada | [1, 224, 224, 3] float32 |
| Salida | [1, 1000] float32 (clases de ImageNet) |
| Runtime | LiteRT.js (WebGPU/WASM) |
| Tiempo de inferencia | 100-500ms |
MobileNet v2 es un modelo preentrenado de clasificación de imágenes que reconoce 1000 categorías de ImageNet — animales, objetos, comida, monumentos, vehículos, escenas y más.
Generación de descripciones
El modelo produce probabilidades de clase, no lenguaje natural. AltText Gen usa generación de descripciones basada en plantillas:
| Predicciones | Descripción generada |
|---|---|
| golden retriever (0.89) | “Un golden retriever” |
| golden retriever (0.85), tennis ball (0.40) | “Un golden retriever con una pelota de tenis” |
| pizza (0.92) | “Una pizza” |
| laptop (0.78), desk (0.35) | “Un portátil sobre un escritorio” |
El resultado siempre es editable — puedes refinar el texto antes de copiarlo o aplicarlo como atributo alt de la imagen.
Privacidad
AltText Gen se ejecuta completamente en el dispositivo. El modelo de ML viene
incluido con la extensión (13MB). No se envía ninguna imagen, dato o telemetría
a ningún servidor. Los únicos permisos son storage (ajustes + estadísticas) y
contextMenus (menú de clic derecho).
Gratis para siempre
AltText Gen es 100% gratis. Todas las funciones están disponibles para todo el mundo. No hay tiers premium, ni API keys, ni límites de uso. Si te gusta, puedes invitarme a un café — pero sin ninguna presión.
¿Cómo valorarías AltText Gen?
Haz clic en una estrella para votar — sin registro.
Preguntas frecuentes
¿AltText Gen es realmente gratis?
Sí, 100% gratis. Todas las funciones están disponibles para todo el mundo. Sin tiers premium, sin API keys, sin límites de uso. Si te gusta, puedes invitarme a un café — pero sin ninguna presión.
¿AltText Gen envía mis imágenes a un servidor?
No. AltText Gen se ejecuta completamente en el dispositivo. El modelo de ML (MobileNet v2, 13MB) viene incluido con la extensión y la inferencia ocurre en tu navegador vía LiteRT.js (WebGPU/WASM). No se envía ninguna imagen, dato o telemetría a ningún servidor.
¿Cómo funciona la generación de texto alternativo?
AltText Gen usa MobileNet v2, un modelo preentrenado de clasificación de imágenes. Cuando haces clic derecho en una imagen, se redimensiona a 224x224 píxeles, se normaliza y se pasa por el modelo. Las top-5 predicciones de clase (p. ej., 'golden retriever', 'perro', 'mamífero') se combinan con generación de descripciones basada en plantillas para producir una frase descriptiva.
¿Es esto captioning real de imágenes o solo clasificación?
Es clasificación con generación de descripciones basada en plantillas — no es captioning neural real de imágenes (que requiere modelos mucho más grandes). MobileNet identifica lo que hay en la imagen (objetos, animales, escenas, comida) y las plantillas convierten esas etiquetas en texto descriptivo. El resultado es bueno para objetos y escenas comunes, pero no describirá composiciones complejas.
¿Con qué tipo de imágenes funciona mejor?
AltText Gen funciona mejor con fotos que tengan sujetos claros — animales, objetos, comida, monumentos, vehículos. Identifica 1000 categorías de ImageNet. El arte abstracto, capturas de pantalla o escenas con varios sujetos pueden dar resultados menos útiles.
¿AltText Gen ralentizará mi navegador?
No. El modelo solo se ejecuta cuando haces clic derecho en una imagen y eliges 'Generate Alt Text'. No se ejecuta al cargar la página ni en segundo plano. La inferencia tarda 100-500ms según tu hardware (WebGPU si está disponible, fallback a WASM).