Google actualiza Gemini para macOS con dictado por voz a nivel de sistema y percepción de pantalla
2026-07-31 09:37
Favoritos

es.wedoany.com Noticia: Google ha actualizado la aplicación Gemini para macOS, añadiendo funciones de dictado por voz a nivel de sistema y comandos de percepción de pantalla, lo que permite a los usuarios invocar al asistente de IA en distintas aplicaciones sin salir de su flujo de trabajo actual. Al mantener presionada la tecla Fn se activa el modo de voz, permitiendo a los usuarios dictar en casi cualquier campo de texto. Google afirma que, en comparación con las herramientas tradicionales de conversión de voz a texto, Gemini es capaz de eliminar automáticamente las muletillas, reconocer correcciones de voz y generar texto más claro. Esta función está disponible actualmente en inglés para usuarios globales de Gemini en macOS, con soporte para más idiomas en el futuro.

Esta actualización también introduce un modo opcional de razonamiento con percepción de pantalla, que amplía las capacidades de Gemini más allá del simple dictado. Si los usuarios activan esta función, pueden permitir que Gemini comprenda contenido seleccionado, archivos, imágenes y documentos en la pantalla del Mac. Los usuarios pueden ejecutar tareas como reescribir texto, resumir información o crear contenido directamente dentro de la aplicación que estén utilizando mediante comandos de voz. Esta función está diseñada para reducir las molestias de transferir información entre aplicaciones, ya que los usuarios no necesitan copiar texto al chatbot para modificarlo y luego pegar el resultado de vuelta; Gemini puede colocar directamente la salida donde el usuario la necesita.

Esta actualización indica que Google está impulsando a Gemini para pasar de ser un chatbot independiente a un asistente integrado en los flujos de trabajo informáticos diarios, acercándolo a la dirección de desarrollo de Apple Intelligence, donde las funciones de IA se integran cada vez más con la escritura, la productividad y las operaciones a nivel de sistema. El enfoque de Google se basa en atajos de teclado e interacción por voz, ofreciendo a los usuarios una forma unificada de invocar ayuda de IA durante el trabajo. Las nuevas funciones requieren permiso para acceder al contenido de la pantalla, lo que plantea consideraciones de privacidad para los usuarios que manejan información sensible, quienes deben verificar los resúmenes y reescrituras generados por IA antes de utilizarlos en comunicaciones comerciales o con clientes. Esta actualización continúa el esfuerzo de Google por convertir a Gemini en un asistente de productividad integrado en la experiencia de escritorio, en lugar de un chatbot independiente.

Este boletín es una compilación y reproducción de información de Internet global y socios estratégicos, y está destinado únicamente a proporcionar a los lectores la comunicación. Si hay infracción u otros problemas, por favor infórmenos a tiempo, este sitio será modificado o eliminado. Toda reproducción de este artículo sin autorización formal está estrictamente prohibida. Correo electrónico: news@wedoany.com