back to top

Apple vuole rendere gli LLM più piccoli

Alcuni ricercatori di Apple hanno pubblicato un articolo intitolato "LLM in a flash: Efficient Large Language Model Inference with Limited Memory" nel quale viene descritto un sistema con cui memorizzare i dati necessari al funzionamento di un modello generativo all’interno dell’unità SSD di un device. Ciò renderebbe più efficienti i Large Language Model di dimensioni contenute.

Tecnicamente l’idea è quella di utilizzare l’SSD per sostituire la memoria RAM come riferimento per l’archiviazione dei dati. Stando ai risultati dei benchmark effettuati questa soluzione dovrebbe garantire una velocità di elaborazione nettamente superiore rispetto a quelle che si potrebbero ottenere tramite il caricamento su CPU o GPU.

Pubblicitร 

In sostanza l’uso delle unità SSD porterebbe a velocità 4 o 5 volte superiori rispetto all’allocazione su CPU e addirittura a 20 o 25 volte superiori rispetto a quella su scheda grafica. In questo modo sarebbe più facile sviluppare LLM on-device e farli interagire con piattaforme come per esempio l’assistenze digitale intelligente Siri della stessa Apple.

Per ottenere questo risultato la Casa di Cupertino ha implementato un nuovo sistema di compressione che prende il nome di EELBERT. Grazie ad esso è possibile ridurre le dimensioni di un LLM senza perdita di dati fondamentali per il suo funzionamento e qualità degli output, il modello BERT di Google è stato reso ad esempio 15 volte più piccolo con una regressione minima.

Un’altra novità di Cupertino in tema di AI è il sistema STEER (Semantic Turn Extension-Expansion Recognition). Tale progetto è stato lanciato per il miglioramento di Siri fornendogli maggiori capacità di riconoscere il contesto di una richiesta, in questo modo l’assistente dovrebbe essere sia in grado di fornire risposte che di prevedere le domande successive.

Iscriviti a Google News Per restare sempre aggiornato seguici su Google News! Seguici
Pubblicitร 
Claudio Garau
Claudio Garau
Web developer, programmatore, Database Administrator, Linux Admin, docente e copywriter specializzato in contenuti sulle tecnologie orientate a Web, mobile, Cybersecurity e Digital Marketing per sviluppatori, PA e imprese.

Leggi anche...

Meno metaverso e piรน AI nel futuro di Meta

Meta ha programmato una revisione della propria strategia aziendale...

ChatGPT ha compiuto 3 anni

Il 30 novembre 2022 OpenAI presentava al pubblico un...

L’iPhone 17e sarร  come l’iPhone 17 ma piรน “semplice”

Apple si starebbe preparando a rinnovare la sua linea...

ChatGPT puรฒ fare tutto? Prova a chiedergli che ore sono..

Quando si interagisce con un'AI, come quella che permette...

DeepSeek svelerร  i segreti dell’universo

Il gruppo cinese DeepSeek, giร  noto per aver introdotto...

Il documento che diede vita ad Apple รจ all’asta. Vale 4 milioni di dollari

Un pezzo di storia della tecnologia sta per essere...
Pubblicitร