Innovazione

ChatGPT vs Smartphone: Un Test su 12 Funzioni Quotidiane

Un esperimento ha messo a confronto ChatGPT e le app di smartphone in 12 attività quotidiane, rivelando punti di forza e limiti dell'intelligenza artificiale.

In Breve

Quali funzioni ha superato ChatGPT?
ChatGPT ha superato i test su previsioni meteorologiche, calcoli matematici, suggerimenti di film e identificazione di piante.
Quali funzioni hanno avuto risultati parziali?
I giochi di parole, l'identificazione del cielo stellato, la pianificazione di percorsi e l'apprendimento di una lingua hanno avuto risultati parziali.
Quali funzioni hanno fallito?
ChatGPT ha fallito in funzioni come cronometro, sveglia, meditazione guidata e supporto al food delivery.

Un recente test ha messo alla prova ChatGPT su dodici attività quotidiane solitamente svolte tramite app su smartphone. I risultati sono stati misti: quattro successi, quattro passaggi parziali e quattro fallimenti. L’esperimento è stato condotto senza una profonda integrazione con il sistema operativo del telefono, limitando l’accesso dell’AI a email, app di messaggistica e wallet.

ChatGPT ha dimostrato buone performance in alcune aree. Le previsioni meteorologiche fornite si sono rivelate accurate, i calcoli matematici sono stati corretti, seppur con qualche ritardo, e le raccomandazioni cinematografiche si sono adattate bene ai gusti dell’utente. Inoltre, l’identificazione botanica delle piante attraverso fotografie ha avuto successo dopo verifiche incrociate.

Alcuni test hanno ottenuto risultati parziali. Ad esempio, i giochi di parole e l’identificazione delle costellazioni hanno mostrato potenzialità, ma non hanno eguagliato l’esperienza d’uso delle app dedicate. Nella pianificazione di percorsi, ChatGPT ha fornito opzioni utili, ma il dialogo ha richiesto chiarimenti e ha generato azioni indesiderate, come la creazione di promemoria. Anche l’apprendimento di una lingua ha mostrato risultati variabili, con conversazioni vocali che a volte risultavano naturali, ma soggette a pause e malfunzionamenti.

Al contrario, alcune funzioni utilitaristiche hanno fallito. ChatGPT non ha potuto misurare il tempo come un cronometro nativo; la sveglia non ha notificato l’utente nonostante fosse stata impostata. La guida vocale per la meditazione ha mostrato intonazioni e esitazioni disturbanti, mentre nella scelta di ristoranti, l’assistente ha suggerito locali chiusi o non disponibili, evidenziando il divario tra raccomandazioni informative e azioni pratiche.

Questo esperimento mette in luce che, con l’attuale implementazione come app separata e senza accesso profondo ai dati e ai servizi del dispositivo, l’AI si adatta meglio a sostituire app informazionali, mentre fatica a sostituire app che richiedono azioni rapide e integrate (come timer e navigazione). Emergono anche criticità comuni, come la generazione di risposte errate ma sicure e la mancanza di integrazione con banche dati specialistiche.

Un’ulteriore riflessione riguarda l’eventuale integrazione nativa dell’AI nel sistema operativo, che potrebbe migliorare i risultati, consentendo l’accesso a calendari, timer e impostazioni. Tuttavia, rimangono necessarie garanzie su accuratezza, fonti affidabili e la possibilità di uscire dall’interfaccia conversazionale quando l’utente richiede strumenti più diretti.

Autore

redazione

Leggi tutti gli articoli pubblicati da questo autore.

Tutti gli articoli
Iscriviti alla newsletter

Ricevi ogni giorno analisi, notizie e approfondimenti.