Apple ha presentado Audio Intelligence, un conjunto de funciones de IA basadas en el micrófono exclusivas para el Apple Watch Series 12 y el Apple Watch Ultra 4 [S1, S4]. Estas herramientas aprovechan el nuevo chip S11 y Apple Intelligence para ayudar a los usuarios a identificar sonidos ambientales, rastrear música y recuperar diálogos perdidos [S1, S2].
Debido a que estas funciones implican la escucha del entorno, son opcionales y están desactivadas por defecto [4]. Algunas capacidades se ejecutan enteramente en el reloj, mientras que otras requieren un iPhone 16 o posterior vinculado (excluyendo el iPhone 16e) para gestionar el procesamiento complejo [S2, S5].
Gestión de las herramientas de detección acústica
Dos de las funciones de Audio Intelligence se centran en la conciencia del entorno más que en la conversación. El Reconocimiento de sonidos identifica ruidos críticos como sirenas, alarmas, timbres y el llanto de bebés [S1, S5]. Funciona de manera independiente incluso cuando el iPhone vinculado está fuera de alcance, lo que lo convierte en una herramienta de accesibilidad fundamental para usuarios sordos o con dificultades auditivas [S1, S7].
Para activar el Reconocimiento de sonidos, ve a la app Ajustes del iPhone, pulsa en Accesibilidad, Reconocimiento de sonidos y nombres, y activa “Detectar usando Apple Watch” [S1, S4].
El Reconocimiento de música utiliza Shazam para identificar automáticamente las canciones que suenan de fondo [S1, S5]. En lugar de requerir un toque manual, el título de la canción y el nombre del artista aparecen automáticamente en el widget de la Pila inteligente [S1, S2]. Esto puede activarse en la app Ajustes del Apple Watch, en el apartado Pila inteligente, activando “Detección de música” [S1, S4].
Recuperación de voz con Live Rewind
Live Rewind actúa como un apoyo de memoria a corto plazo para discusiones activas [2]. Al pulsar dos veces la Digital Crown, el reloj transcribe y muestra los últimos 15 segundos de audio hablado como un fragmento de texto [S1, S3]. Está diseñado para esos momentos en los que el usuario pierde un detalle específico, como una lista de platos especiales en un restaurante [7].
Para proteger la privacidad de los demás, Live Rewind activa un timbre audible y un indicador de micrófono visible en la pantalla al activarse [S2, S6]. El fragmento de texto resultante es temporal; desaparece aproximadamente 30 segundos después de que la pantalla se atenúe, a menos que el usuario lo guarde manualmente en la app Siri o le pregunte a Siri sobre el contenido [S1, S4].
Los usuarios pueden activar esta función en la app Watch del iPhone navegando a Siri, luego a Live Rewind, y activando “Doble pulsación de Digital Crown” [S1, S3].
Organización de conversaciones con Siri Recap
Siri Recap proporciona resúmenes generales de las conversaciones a lo largo del día [S1, S5]. En lugar de una transcripción palabra por palabra, genera un título, un resumen general y puntos clave para ayudar a los usuarios a recordar la esencia de una reunión o discusión [S2, S7].
Al ser una herramienta ambiental, los usuarios pueden personalizar cuándo está activa [1]. A través de la app Watch del iPhone, puedes establecer un horario basado en la hora o la ubicación, como “solo en el trabajo” o “nunca por la noche” [S1, S3]. También puede activarse o desactivarse manualmente a través del Centro de control [S1, S6].
Existen limitaciones específicas en estos resúmenes para garantizar la privacidad y la brevedad. Siri Recap no atribuye el habla a interlocutores específicos y filtra deliberadamente datos sensibles, como información financiera e identificaciones gubernamentales [S2, S8]. Los resúmenes no guardados se eliminan automáticamente después de 7 días [S1, S4].
Comprendiendo la arquitectura de privacidad
Apple utiliza un compartimento aislado por hardware llamado Secure Exclave dentro del chip S11 para procesar el audio [S1, S4]. El audio bruto fluye hacia un búfer protegido donde es analizado y eliminado inmediatamente [S1, S6]. Esta arquitectura garantiza que el audio bruto nunca sea accesible para el sistema operativo, aplicaciones de terceros o Apple [S1, S4].
Para Siri Recap, el proceso implica tres capas de protección:
- Detección en el dispositivo: Un modelo de IA ligero detecta si se está produciendo un habla sin transcribirla [6].
- Private Cloud Compute (PCC): El texto condensado se envía a PCC para el formato final y la síntesis [S1, S2]. Los datos en PCC no son almacenados ni accesibles por Apple [1].
- Cifrado de extremo a extremo: Los fragmentos y resúmenes guardados se sincronizan entre dispositivos de confianza a través de iCloud utilizando cifrado de extremo a extremo [S1, S3].
Los usuarios pueden ver, editar o eliminar sus datos guardados dentro de la app Siri o exportar los resúmenes a otras aplicaciones como Notas y Diario [S1, S4].
Si estás buscando actualizar tu dispositivo vestible para obtener estas capacidades de IA, consulta la disponibilidad más reciente del Series 12 y el Ultra 4 en tu distribuidor local.
Fuentes
- About Audio Intelligence features on Apple Watch Series 12 and Apple …
- Apple Watch Audio Intelligence: Everything You Need to Know (2026)
- Apple Watch Audio Intelligence Explained: 2026 Guide
- Three All-New ‘Audio Intelligence’ Features Arrive With Apple Watch …
- Apple Introduces New Audio Intelligence Features for Apple Watch
- About Audio Intelligence features on Apple Watch Series 12 and Apple …
- Apple details how Apple Watch’s new Audio Intelligence features work in …
- Apple’s new Audio Intelligence turns the Watch into a … - TechSpot