Google crea un traductor para conversaciones en cualquier idioma y sin necesitar internet

Google presentó un traductor experimental capaz de procesar conversaciones en distintos idiomas completamente sin conexión a internet.

El proyecto de Google demuestra cómo un traductor basado en IA puede funcionar offline.

El proyecto de Google demuestra cómo un traductor basado en IA puede funcionar offline.

shutterstock

Google presentó Gemma Translator, un traductor experimental basado en inteligencia artificial que puede convertir conversaciones de voz en tiempo real sin depender de internet. El sistema procesa todo directamente en el dispositivo y permite mantener diálogos en otro idioma incluso en lugares sin cobertura o WiFi.

A diferencia de las herramientas tradicionales, este proyecto ejecuta localmente el reconocimiento de voz, la traducción y la generación de respuestas habladas. Gemma Translator no fue diseñado como un producto comercial, sino como una plataforma abierta que desarrolladores, estudiantes y aficionados pueden construir utilizando componentes accesibles y documentación publicada por la propia compañía.

Google lleva su traductor a un dispositivo compacto capaz de procesar conversaciones en otro idioma sin conexión.

Google lleva su traductor a un dispositivo compacto capaz de procesar conversaciones en otro idioma sin conexión.

Google y su nuevo traductor funcionan completamente offline

La principal particularidad de Gemma Translator es que no necesita comunicarse con servidores externos para traducir una conversación. Todo el proceso ocurre dentro del propio dispositivo.

Cuando una persona habla, un micrófono captura su voz y el sistema la transforma en texto. Después, la inteligencia artificial interpreta el contenido, lo convierte al idioma seleccionado y genera una respuesta mediante una voz sintética.

La traducción se realiza de principio a fin de manera local. Por eso, una vez instalados los modelos necesarios durante la configuración inicial, el dispositivo puede continuar funcionando sin conexión.

¿Dónde puede resultar especialmente útil una herramienta de este tipo? Para viajeros que llegan a zonas sin cobertura, trabajadores que desarrollan sus actividades en lugares aislados o personas preocupadas por la privacidad de sus conversaciones.

Además, al no enviar las conversaciones a servidores externos, el sistema reduce la exposición de información potencialmente sensible.

El traductor de Google, basado en Gemma Translator, procesa voz y texto en cada idioma directamente en el hardware.

El traductor de Google, basado en Gemma Translator, procesa voz y texto en cada idioma directamente en el hardware.

El traductor de Google utiliza una Raspberry Pi 5

El hardware elegido por Google para este experimento es una Raspberry Pi 5, un ordenador compacto de placa única utilizado habitualmente en proyectos educativos, tecnológicos y de automatización.

Sobre esta plataforma, la compañía incorporó diferentes componentes para crear un dispositivo portátil. El equipo cuenta con una pantalla táctil donde pueden visualizarse tanto el texto original como la traducción, además de un micrófono y un altavoz.

También incorpora un botón para iniciar la conversación y un control giratorio que permite seleccionar rápidamente otro idioma.

Todo el conjunto está protegido por una carcasa fabricada mediante impresión 3D. Su diseño recuerda a los antiguos dispositivos electrónicos utilizados específicamente para traducir conversaciones, aunque en este caso las capacidades están impulsadas por modelos de inteligencia artificial.

Gemma Translator permite experimentar con el traductor de Google y mantener conversaciones en otro idioma sin utilizar la nube.

Gemma Translator permite experimentar con el traductor de Google y mantener conversaciones en otro idioma sin utilizar la nube.

Gemma Translator lleva la inteligencia artificial directamente al dispositivo

El funcionamiento de Gemma Translator se apoya en Gemma 4 E2B, uno de los modelos abiertos desarrollados por Google para trabajar en equipos con recursos informáticos limitados.

El procesamiento se ejecuta mediante LiteRT-LM, una plataforma de la compañía diseñada para permitir que modelos de lenguaje funcionen directamente en dispositivos, sin necesidad de recurrir a la nube.

No solo la traducción se realiza de forma local. El reconocimiento de voz y la generación de la respuesta hablada también se procesan en el propio equipo.

Este planteamiento ofrece dos ventajas importantes. Por un lado, puede reducir la latencia al evitar el intercambio constante de información con servidores remotos. Por otro, permite que las conversaciones permanezcan en el dispositivo.

FUENTE: Información extraída de Infobae