Qualcomm AI200 e AI250, gli acceleratori per l’AI con 768 GB

Qualcomm ha deciso di entrare nella grande lega dei data center contro giganti come NVIDIA, Intel, AMD o Google, tra gli altri, e questa volta lo fa con due acceleratori creato da zero per l’Intelligenza Artificiale: i nuovi AI200 e AI250. Con loro l’azienda cerca ridefinire le prestazioni su scala rackriducono drasticamente il consumo energetico e offrono una solida alternativa ai sistemi di inferenza dominati oggi dai principali attori. Cosa offrite di nuovo al mercato più fashion del pianeta?

Entrambi i chip promettono un salto di memoria, larghezza di banda ed efficienza, ma la cosa più interessante sta nella visione che sta dietro: una nuova architettura progettata per l’intelligenza artificiale generativa e l’inferenza massiccia. L’annuncio arriva in un momento di massima pressione per l’efficienza energetica e i costi operativi nei data center, quindi Qualcomm può operare lì con questi due acceleratori, presumibilmente, sotto
braccio?

Qualcomm AI200 e AI250, la scommessa dell’azienda per introdurre l’intelligenza artificiale dalla porta principale

Il passo di Qualcomm è quasi un salto nel vuoto, perché nonostante arrivino forti, è la pietra su cui formeranno la “loro chiesa”, e quindi, deve essere solido. Pertanto, la sua doppia scommessa arriva con questi acceleratori con caratteristiche sulla carta che lo sono dinamite pura.

Lui AI200ad esempio, è progettato per essere lanciato in 2026 e si rivolge a carichi di inferenza complessi, con supporto fino a Memoria LPDDR da 768 GB per scheda/acceleratore, cifra che moltiplica la capacità abituale in questo tipo di soluzioni. Qualcomm lo presenta come piattaforma “scala rack”il che significa che non stiamo parlando di un semplice chip, ma piuttosto di un insieme ottimizzato di processori, memoria e comunicazione interna che funzionano come una singola unità all’interno di ciascun rack. L’obiettivo è
Massimizza le prestazioni per watt e per dollaro investitouna metrica fondamentale nelle attuali implementazioni dell’intelligenza artificiale.

Da parte sua, il AI250previsto per
2027fa un ulteriore passo avanti introducendo un’architettura di memoria “calcolo quasi-memory”con cui Qualcomm garantisce il raggiungimento Più di dieci volte la larghezza di banda di memoria effettiva della generazione precedente. La chiave di questo approccio è spostare l’elaborazione più vicino alla memoria stessa per ridurre la latenza e il consumo associati allo spostamento dei dati.

Nelle attività di inferenza di modelli di grandi dimensioni, questa differenza può significare diversi ordini di grandezza in termini di efficienza e velocità. Sfortunatamente, non hanno mostrato i dati sulle prestazioni, tanto meno i dati comparativi, per poterteli offrire.

L’inferenza come obiettivo chiave, senza guardare ad AMD o NVIDIA e lottando contro Intel

Rack Qualcomm AI200 o AI250

Mentre NVIDIA rimane focalizzata sui sistemi di addestramento per modelli giganti, Qualcomm scommette sull’altro lato del processo: inferenzacioè l’uso quotidiano di quei modelli già addestrati. Questo mercato è enorme e in crescita, perché è il luogo in cui vengono effettivamente gestiti i servizi di intelligenza artificiale generativa, dai chatbot agli assistenti multimodali.
Riduci il costo energetico di ogni inferenza e aumenta la densità di memoria per rack Sono i due principali colli di bottiglia attuali e Qualcomm sembra determinata ad attaccarli.

Una delle Prime aziende ad adottare questa tecnologia sarà
UMANOun’azienda saudita dell’intelligenza artificiale che prevede di implementare circa 200 MW di infrastrutture basate su questi acceleratori a partire dal 2026. L’accordo, oltre a fungere da vetrina per Qualcomm, anticipa il crescente interesse da parte del Medio Oriente nel diventare un nodo chiave di calcolo dell’intelligenza artificiale globale, con hardware più efficiente e autonomo rispetto ai grandi fornitori occidentali.

Qualcomm insiste sul fatto che queste soluzioni offriranno un costo totale di proprietà molto più basso rispetto alle attuali GPU. Ciò include esigenze di raffreddamento ridotte, consumo energetico ridotto e migliore scalabilità in ambienti raffreddati a liquido o ad aria forzata. Nelle parole dell’azienda, La sfida non è solo quella di competere in termini di potenza pura, ma di “come eseguire l’intelligenza artificiale in modo sostenibile”.

Se mantengono ciò che hanno promesso, Qualcomm AI200 e AI250 potrebbero diventare l’inizio di una nuova fase dell’hardware AIdove memoria ed efficienza pesano quanto la pura potenza. Speriamo che l’azienda offra presto parametri di prestazione da confrontare, perché finora tutto promette che suona molto bene, sì.

8 comments

  1. Ma ragazzi, quei nuovi acceleratori Qualcomm per lAI sono proprio la marcia in più che stavamo aspettando! Scommettono duro e non guardano indietro. Forza Qualcomm, vogliamo vedere cosa sapete fare! 🚀🔥

  2. Ma ragazzi, che botta! Qualcomm si butta sullAI pesante con gli acceleratori AI200 e AI250. Che coraggio! Voi che ne pensate? Io sono curioso di vedere come si evolverà questa sfida! 🚀🤖

  3. Ragazzi, che dire di questi Qualcomm AI200 e AI250? Una mossa audace, ma sarà abbastanza per sfidare i giganti come AMD e NVIDIA? Chi vivrà, vedrà. Intanto, brindiamo a Qualcomm per lambizione! 🚀🥂

  4. Che botta di novità con i nuovi acceleratori AI di Qualcomm! Scommessa coraggiosa, ma non sottovaluterei AMD, NVIDIA e Intel. Sarà una lotta interessante! Che ne pensate?

  5. Wow, ma che botta di innovazione! Qualcomm si gioca il tutto per tutto con gli AI200 e AI250. Saranno davvero in grado di spodestare i colossi come AMD e NVIDIA? Intanto, brindiamo alle scommesse coraggiose! 🚀🥂

Lascia un commento

Il tuo indirizzo email non sarà pubblicato. I campi obbligatori sono contrassegnati *