L'intelligenza

Il viaggio di una frase.

Martedì mattina, in cucina, Marta dice una cosa. Ecco cosa le succede da quel momento fino a quando, la sera, ti serve. Quasi ogni passaggio è intelligenza artificiale: per questo tiRicordo è possibile adesso, e non dieci anni fa.

Martedì, 10:12

Il suono.

La tessera sente che qualcuno parla e comincia a registrare, tenendo anche i due secondi prima. Il resto del tempo resta in silenzio.

Sulla tessera · ESP32-S3 e processore audio XMOS

cucina · 2 voci · 0:41

Pochi secondi dopo

Le parole.

L'audio diventa testo, e ogni frase viene attribuita a chi l'ha detta, anche quando due voci si sovrappongono.

Trascrizione · ElevenLabs Scribe

Voce 1Stasera alle otto ceniamo da Giulia. Ricordati il dolce.

Voce 2Sì, passo in pasticceria.

Voce 1Quella sotto casa, che chiude alle sette.

Subito dopo

Le persone.

Ogni voce ha un'impronta. «Voce 1» è Marta: tiRicordo l'ha già sentita altre volte. I nomi nuovi li impara dalle conversazioni stesse.

Riconoscimento delle voci · impronte vocali

MartaStasera alle otto ceniamo da Giulia. Ricordati il dolce.

TuSì, passo in pasticceria.

MartaQuella sotto casa, che chiude alle sette.

Martedì notte

Il diario.

Ogni notte la giornata viene riletta e riassunta: chi c'era, cosa si è detto, cosa resta da fare. La televisione accesa nella stanza accanto non finisce nel diario.

Comprensione e riassunto · modelli linguistici

Martedì 7 ottobre

MattinaIn cucina con Marta.

Da fareStasera alle 20 cena da Giulia. Portare il dolce: pasticceria sotto casa, chiude alle 19.

PomeriggioTelefonata con il medico, prossima visita giovedì.

Martedì, 18:40

La domanda.

Non serve un comando. L'app capisce che «non mi ricordo cosa dovevo fare» è una richiesta di aiuto, e che «ricordati il pane» invece no.

Riconoscimento della richiesta · sull'iPhone

«Non mi ricordo cosa dovevo fare stasera…»

Richiesta di memoria

Un istante dopo

La risposta.

Il modello legge il diario e le conversazioni, collega i pezzi e risponde. Se non trova la risposta, lo dice: per chi è fragile, una risposta sbagliata è peggio del silenzio.

Ragionamento · Claude  ·  Voce · ElevenLabs

All'orecchioStasera alle otto siete a cena da Giulia. Marta ti ha chiesto di portare il dolce: la pasticceria sotto casa chiude alle sette.

Una risposta sbagliata è peggio del silenzio.
Chi dimentica fa domande vaghe, «cosa dovevo fare?», «come si chiamava?», e la risposta è sparsa in ore di parlato tra voci che si accavallano. Serve un modello che legga moltissimo, colleghi i pezzi e sappia dire «non lo so» invece di inventare. Per questo il ragionamento di tiRicordo è affidato a Claude.
Una voce gentile si tiene. Una voce fredda si spegne.
Scribe di ElevenLabs separa chi parla anche in una cucina piena di gente; la voce di ElevenLabs risponde all'orecchio con calma. Per una persona anziana è la differenza tra usarlo ogni giorno e lasciarlo nel cassetto.
0 ore di audio al giorno.
Tante ne ha registrate il sistema in una sola giornata di prova. Ogni ora va trascritta, attribuita, capita e tenuta pronta per una domanda che può arrivare tra un minuto o tra un mese.

Le domande aperte

Quello che stiamo studiando.

Cinque domande che il prototipo ci ha messo davanti. Vogliamo rispondere insieme a chi ci affianca.

Memoria di anni
Ragionare su mesi e anni di conversazioni senza perdere il dettaglio che serve.
Il tempo giusto
La risposta deve arrivare prima che il discorso vada avanti.
Mai inventare
Misurare le risposte sbagliate e portarle il più vicino possibile a zero.
Il consenso degli altri
Chi parla con te non ha scelto di essere ascoltato. È la domanda più seria che ci poniamo.
Cosa resta in locale
Quanto si può capire direttamente sulla tessera e sul telefono, senza mandare nulla altrove.