Il nuovo Apple Watch Series 12 e l’Apple Watch Ultra 4 sono in grado di ascoltare l’ambiente circostante per tutto il giorno grazie alla funzione Audio Intelligence. Questa funzionalità, descritta nel supporto ufficiale Apple, riconosce suoni critici come allarmi o pianti di bambini, identifica brani musicali tramite Shazam integrato, permette di riprodurre gli ultimi 15 secondi di una conversazione in forma testuale (Live Rewind) e genera un riassunto delle conversazioni giornaliere (Siri Recap), operando senza necessità di attivazione manuale.

Apple ha progettato questa funzione attorno a un’architettura incentrata sulla privacy. Il nuovo chip S11 include una Secure Enclave, un compartimento isolato via hardware dove l’audio viene trascritto e immediatamente cancellato, sia sull’orologio che sull’iPhone associato. Al cloud privato di Apple arriva solo un testo condensato, privo dell’identificazione degli interlocutori, per la generazione del riassunto finale: né le applicazioni di terze parti, né il sistema operativo, né l’utente stesso, né Apple possono accedere all’audio originale e ogni funzione può essere disattivata singolarmente.
Apple watch series: perché è importante
Le quattro funzionalità di Audio Intelligence sono disponibili su Apple Watch Series 12 e Ultra 4, in vendita dal 18 settembre a partire da 459 e 909 euro. Ognuna rimane disattivata fino a quando l’utente non la abilita intenzionalmente tramite le impostazioni dell’iPhone o l’app Watch.
Sound Recognition identifica sirene, allarmi e campanelli, avvisando anche quando l’iPhone non è nelle vicinanze, risultando particolarmente utile per persone con difficoltà uditive. Music Recognition, basato su Shazam, funziona automaticamente mostrando titolo e artista nello Smart Stack senza richiedere l’apertura del widget. Per entrambe le funzioni, la Secure Enclave invia ai server solo un’impronta acustica, un dato compresso non ricostruibile nel suono originale.
Live Rewind si attiva con una doppia pressione della Digital Crown e recupera gli ultimi 15 secondi di parlato come testo visualizzabile sullo schermo; il frammento scompare automaticamente dopo circa 30 secondi dallo spegnimento dello schermo, a meno che non venga salvato nell’app Siri. L’attivazione è segnalata da un segnale acustico emesso dall’altoparlante, anche con volume silenziato, e da un’animazione a schermo intero con l’icona del microfono attivo. Questo rappresenta l’unico aspetto in cui Apple estende la privacy anche alle persone circostanti.
Siri Recap prende appunti ambientali durante tutta la giornata per generare un riassunto di alto livello, cancellato automaticamente dopo 7 giorni se non salvato dall’utente. Il testo inviato all’iPhone per la sintesi finale, su Private Cloud Compute, è progettato per essere inferiore alla metà della trascrizione originale, depurato da tono, riempitivi e ripetizioni. Il riassunto omette intenzionalmente l’attribuzione delle frasi a persone specifiche e esclude categorie sensibili come dati finanziari e documenti d’identità, secondo la documentazione tecnica pubblicata da Apple.
Cosa cambia e quali sono gli effetti
Live Rewind e Siri Recap rimangono in versione beta fino alla fine dell’anno, disponibili solo in inglese e richiedendo almeno un iPhone 16 con Apple Intelligence e la nuova Siri AI, anch’essa ancora in fase di test. L’utilizzo è precluso ai minori di 13 anni e, per i ragazzi tra i 13 e i 17 anni, richiede l’attivazione da parte di un genitore su Child Account. In Europa, il lancio di Siri AI in Italia è ostacolato dal Digital Markets Act, lo stesso vincolo normativo che ha già ritardato altre funzionalità di Apple Intelligence nell’Unione Europea.
Nel 2019, un’inchiesta aveva rivelato che migliaia di addetti ascoltavano e trascrivevano clip audio di Alexa, incluse conversazioni private captate accidentalmente, un rischio già segnalato dal Garante anche per i dispositivi indossabili aziendali che raccolgono dati biometrici sul lavoro. Apple ha implementato Audio Intelligence su un’architettura differente: elaborazione isolata nel silicio, testo condensato prima dell’invio al cloud e nessuna attribuzione dei parlanti.
Il chip S11 deve dimostrare la sua affidabilità attraverso l’architettura, passo dopo passo. Per gli acquisti aziendali, la priorità è capire dove finisce il testo dopo che il microfono si spegne, più della semplice promessa di sicurezza contenuta nel comunicato stampa.
Fonte e approfondimento su apple watch series: articolo originale.
* Contenuto realizzato con l'ausilio di sistemi di intelligenza artificiale.
Hardware Ready Ready to Bench?