ChatGPT vs Smartphone: Un Test sulle Funzioni Quotidiane
In Breve
- Quali sono i punti di forza di ChatGPT nel test?
- ChatGPT ha superato i test su previsioni meteorologiche, calcoli matematici, suggerimenti di film e identificazione di piante.
- In quali aree ha ottenuto risultati parziali?
- Ha avuto risultati parziali in giochi di parole, identificazione del cielo stellato, pianificazione di percorsi e apprendimento di una lingua.
- Quali funzioni hanno fallito?
- Le funzioni di utility come cronometro, sveglia, meditazione guidata e supporto al food delivery hanno registrato fallimenti.
ChatGPT vs Smartphone: Un Test sulle Funzioni Quotidiane
Un recente test ha messo alla prova ChatGPT su 12 attività quotidiane che normalmente vengono svolte tramite app su smartphone. I risultati sono stati misti, con quattro successi, quattro risultati parziali e quattro fallimenti. L’esperimento è stato condotto senza un’integrazione profonda con il sistema operativo del telefono, limitando l’accesso dell’IA a email, app di messaggistica e wallet.
Punti di Forza di ChatGPT
ChatGPT ha dimostrato di essere efficace in alcune aree. Ha superato i test relativi a:
- Previsioni Meteorologiche: Le previsioni fornite si sono rivelate accurate.
- Calcoli Matematici: I calcoli sono stati corretti, anche se con qualche ritardo.
- Consigli Cinematografici: Le raccomandazioni sono state ben calibrate sui gusti dell’utente.
- Identificazione Botanica: L’IA ha identificato piante dalle foto in modo efficace, grazie a verifiche incrociate.
Risultati Parziali
Alcune funzioni hanno ottenuto risultati parziali, tra cui:
- Giochi di Parole: ChatGPT ha riprodotto la meccanica, ma non l’esperienza d’uso fluida delle app dedicate.
- Identificazione del Cielo Stellato: Ha riconosciuto costellazioni da singole foto, ma non ha offerto un’esplorazione AR continua.
- Pianificazione di Percorsi: Ha fornito opzioni utili, ma il dialogo ha richiesto chiarimenti e ha generato azioni indesiderate, come la creazione di promemoria.
- Apprendimento di una Lingua: La conversazione vocale è risultata naturale quando funzionante, ma ha mostrato pause e malfunzionamenti.
Fallimenti nelle Funzioni di Utility
Alcune funzioni tipiche di utility hanno registrato fallimenti, tra cui:
- Cronometro: ChatGPT non è riuscito a misurare il tempo trascorso come un cronometro nativo.
- Sveglia: La notifica non ha allertato l’utente nonostante la creazione di un avviso.
- Meditazione Guidata: La guida vocale ha mostrato intonazioni e esitazioni disturbanti.
- Supporto al Food Delivery: L’assistente ha suggerito ristoranti chiusi o non disponibili, evidenziando il divario tra raccomandazione informativa e azione concreta.
Conclusioni e Prospettive Future
L’esperimento ha messo in luce che, con l’attuale implementazione come app separata e senza accesso profondo ai dati e ai servizi del dispositivo, ChatGPT è più adatto a sostituire app informazionali. Tuttavia, fatica a sostituire app che necessitano di eseguire azioni rapide e integrate con il sistema operativo, come timer e navigazione turn-by-turn.
Inoltre, emergono criticità comuni, come la generazione di risposte errate ma sicure e la mancanza di integrazione con banche dati specialistiche. Un’eventuale integrazione nativa dell’IA nel sistema operativo potrebbe modificare i risultati, consentendo accesso a calendari, timer e impostazioni. Tuttavia, rimangono richieste garanzie maggiori su accuratezza e fonti affidabili.
