Desarrollo
Sin valoraciones

AltText Gen

Clic derecho en cualquier imagen → genera texto alternativo descriptivo. ML en el dispositivo, sin servidores, sin API keys.

mlaccessibilityalt-textimage-captioningon-devicevision

Clic derecho en cualquier imagen → 'Generate Alt Text' — descripción instantánea

ML en el dispositivo (MobileNet v2, 13MB) vía LiteRT.js — 100% offline, sin API keys

Clasificación top-5 con puntuaciones de confianza

Generación de descripciones basada en plantillas a partir de las etiquetas

Copia al portapapeles o asigna directamente al atributo alt de la imagen

Resultado editable — refina el texto antes de aplicarlo

Estadísticas: total de imágenes descritas

100% gratis, sin premium, sin tracking, sin servidores

AltText Gen genera texto alternativo descriptivo para cualquier imagen — clic derecho, elige “Generate Alt Text” y obtén una descripción al instante. Funciona con MobileNet v2 en el dispositivo, sin servidores, sin API keys, sin datos saliendo de tu navegador.

Cómo funciona

  1. Clic derecho en una imagen → el menú contextual muestra “Generate Alt Text”
  2. La imagen se procesa — se redimensiona a 224×224, se normaliza al rango [-1, 1]
  3. Inferencia de MobileNet v2 — LiteRT.js ejecuta el modelo (WebGPU preferido, fallback a WASM)
  4. Top-5 predicciones — p. ej., “golden retriever (0.89), tennis ball (0.31), dog (0.28)”
  5. Se genera la descripción — basada en plantillas: “Un golden retriever” o “Imagen de un golden retriever con una pelota de tenis”
  6. Popup de resultado — texto editable, botones “Copy” y “Set as alt”

El modelo de ML

PropiedadValor
ModeloMobileNet v2
Tamaño13.3 MB
Entrada[1, 224, 224, 3] float32
Salida[1, 1000] float32 (clases de ImageNet)
RuntimeLiteRT.js (WebGPU/WASM)
Tiempo de inferencia100-500ms

MobileNet v2 es un modelo preentrenado de clasificación de imágenes que reconoce 1000 categorías de ImageNet — animales, objetos, comida, monumentos, vehículos, escenas y más.

Generación de descripciones

El modelo produce probabilidades de clase, no lenguaje natural. AltText Gen usa generación de descripciones basada en plantillas:

PrediccionesDescripción generada
golden retriever (0.89)“Un golden retriever”
golden retriever (0.85), tennis ball (0.40)“Un golden retriever con una pelota de tenis”
pizza (0.92)“Una pizza”
laptop (0.78), desk (0.35)“Un portátil sobre un escritorio”

El resultado siempre es editable — puedes refinar el texto antes de copiarlo o aplicarlo como atributo alt de la imagen.

Privacidad

AltText Gen se ejecuta completamente en el dispositivo. El modelo de ML viene incluido con la extensión (13MB). No se envía ninguna imagen, dato o telemetría a ningún servidor. Los únicos permisos son storage (ajustes + estadísticas) y contextMenus (menú de clic derecho).

Gratis para siempre

AltText Gen es 100% gratis. Todas las funciones están disponibles para todo el mundo. No hay tiers premium, ni API keys, ni límites de uso. Si te gusta, puedes invitarme a un café — pero sin ninguna presión.

¿Cómo valorarías AltText Gen?

Haz clic en una estrella para votar — sin registro.

Preguntas frecuentes

¿AltText Gen es realmente gratis?

Sí, 100% gratis. Todas las funciones están disponibles para todo el mundo. Sin tiers premium, sin API keys, sin límites de uso. Si te gusta, puedes invitarme a un café — pero sin ninguna presión.

¿AltText Gen envía mis imágenes a un servidor?

No. AltText Gen se ejecuta completamente en el dispositivo. El modelo de ML (MobileNet v2, 13MB) viene incluido con la extensión y la inferencia ocurre en tu navegador vía LiteRT.js (WebGPU/WASM). No se envía ninguna imagen, dato o telemetría a ningún servidor.

¿Cómo funciona la generación de texto alternativo?

AltText Gen usa MobileNet v2, un modelo preentrenado de clasificación de imágenes. Cuando haces clic derecho en una imagen, se redimensiona a 224x224 píxeles, se normaliza y se pasa por el modelo. Las top-5 predicciones de clase (p. ej., 'golden retriever', 'perro', 'mamífero') se combinan con generación de descripciones basada en plantillas para producir una frase descriptiva.

¿Es esto captioning real de imágenes o solo clasificación?

Es clasificación con generación de descripciones basada en plantillas — no es captioning neural real de imágenes (que requiere modelos mucho más grandes). MobileNet identifica lo que hay en la imagen (objetos, animales, escenas, comida) y las plantillas convierten esas etiquetas en texto descriptivo. El resultado es bueno para objetos y escenas comunes, pero no describirá composiciones complejas.

¿Con qué tipo de imágenes funciona mejor?

AltText Gen funciona mejor con fotos que tengan sujetos claros — animales, objetos, comida, monumentos, vehículos. Identifica 1000 categorías de ImageNet. El arte abstracto, capturas de pantalla o escenas con varios sujetos pueden dar resultados menos útiles.

¿AltText Gen ralentizará mi navegador?

No. El modelo solo se ejecuta cuando haces clic derecho en una imagen y eliges 'Generate Alt Text'. No se ejecuta al cargar la página ni en segundo plano. La inferencia tarda 100-500ms según tu hardware (WebGPU si está disponible, fallback a WASM).

Más extensiones para probar