back to top

Apple vuole rendere gli LLM più piccoli

Alcuni ricercatori di Apple hanno pubblicato un articolo intitolato "LLM in a flash: Efficient Large Language Model Inference with Limited Memory" nel quale viene descritto un sistema con cui memorizzare i dati necessari al funzionamento di un modello generativo all’interno dell’unità SSD di un device. Ciò renderebbe più efficienti i Large Language Model di dimensioni contenute.

Tecnicamente l’idea è quella di utilizzare l’SSD per sostituire la memoria RAM come riferimento per l’archiviazione dei dati. Stando ai risultati dei benchmark effettuati questa soluzione dovrebbe garantire una velocità di elaborazione nettamente superiore rispetto a quelle che si potrebbero ottenere tramite il caricamento su CPU o GPU.

Pubblicitร 

In sostanza l’uso delle unità SSD porterebbe a velocità 4 o 5 volte superiori rispetto all’allocazione su CPU e addirittura a 20 o 25 volte superiori rispetto a quella su scheda grafica. In questo modo sarebbe più facile sviluppare LLM on-device e farli interagire con piattaforme come per esempio l’assistenze digitale intelligente Siri della stessa Apple.

Per ottenere questo risultato la Casa di Cupertino ha implementato un nuovo sistema di compressione che prende il nome di EELBERT. Grazie ad esso è possibile ridurre le dimensioni di un LLM senza perdita di dati fondamentali per il suo funzionamento e qualità degli output, il modello BERT di Google è stato reso ad esempio 15 volte più piccolo con una regressione minima.

Un’altra novità di Cupertino in tema di AI è il sistema STEER (Semantic Turn Extension-Expansion Recognition). Tale progetto è stato lanciato per il miglioramento di Siri fornendogli maggiori capacità di riconoscere il contesto di una richiesta, in questo modo l’assistente dovrebbe essere sia in grado di fornire risposte che di prevedere le domande successive.

Iscriviti a Google News Per restare sempre aggiornato seguici su Google News! Seguici
Pubblicitร 
Claudio Garau
Claudio Garau
Web developer, programmatore, Database Administrator, Linux Admin, docente e copywriter specializzato in contenuti sulle tecnologie orientate a Web, mobile, Cybersecurity e Digital Marketing per sviluppatori, PA e imprese.

Leggi anche...

Chrome su iOS e Android con accesso diretto all’AI Mode

Dopo il debutto su desktop avvenuto a marzo, Google...

L’AI Mode di Google prenota biglietti e appuntamenti con i centri benessere

Big G ha incluso delle nuove capacitร  agentiche in...

Studio Ghibli sfida OpenAI: non usate le nostre animazioni

Un gruppo di importanti editori giapponesi, tra cui lo...

Meta nega l’uso di contenuti per adulti nell’addestramento delle AI

Meta ha richiesto l'archiviazione della causa intentata da Strike...

Se ChatGPT sostituisce lo studio: i rischi dell’apprendimento superficiale

Un recente studio condotto da ricercatori della Wharton School...

Apple: il nuovo Siri sarร  basato su gemini di Google

Secondo quanto riportato da Bloomberg Apple avrebbe avviato una...
Pubblicitร