Amazon annuncia Nova, ecco i nuovi modelli di AI per video e immagini

Disponibili attraverso la piattaforma Amazon Bedrock, puntano su quattro fattori: velocità, precisione, personalizzazione e versatilità multimodale.

Amazon ha annunciato il lancio di Amazon Nova, modelli di intelligenza artificiale di ultima generazione. Disponibili attraverso la piattaforma Amazon Bedrock, puntano su quattro fattori: velocità, precisione, personalizzazione e versatilità multimodale. In più, Amazon promette un costo basso.

In quella classe di modelli ci sono i seguenti prodotti. Amazon Nova Micro: un modello solo testuale ottimizzato per risposte rapide e a basso costo. Amazon Nova Lite: un modello multimodale conveniente e ad alta velocità. Amazon Nova Pro: un modello multimodale bilanciato tra velocità, accuratezza e costi. Amazon Nova Premier: il più avanzato, progettato per compiti complessi e per la formazione di modelli personalizzati (disponibile dal primo trimestre 2025). Amazon Nova Canvas e Amazon Nova Reel: modelli di generazione creativa per immagini e video.

L’idea, che si è vista anche con prodotti Google Gemini e OpenAI, è creare diversi livelli di IA, più complessi (più lenti e più costosi in termini di denaro e risorse computazionali) in rapporto alle esigenze dei clienti. Per cose semplici è meglio (più veloce, più economico) usare modelli leggeri.

Tutti questi modelli supportano un’ampia gamma di attività in 200 lingue e modalità multiple. Amazon Nova Micro, Amazon Nova Lite e Amazon Nova Pro costano almeno il 75% in meno rispetto ai modelli più performanti delle rispettive classi di intelligenza in Amazon Bedrock, a quanto annuncia l’azienda.

I modelli Nova sono accessibili tramite Amazon Bedrock, una piattaforma che permette alle aziende di sperimentare e adattare i modelli IA alle proprie necessità attraverso un’unica API. Su Bedrock Amazon ha già il chatbot di shopping Rufus e integrerà sempre più Alexa.

Con la funzionalità di fine-tuning, le aziende possono personalizzare i modelli utilizzando i propri dati, mentre la tecnica di distillazione consente di trasferire conoscenze da modelli più grandi a versioni più leggere e performanti.

Amazon cita come utilizzo, che già sta facendo per il proprio ecommerce, la possibilità grazie all’IA di creare campagne display e video per un maggior numero di prodotti del catalogo e la sperimentazione di nuove strategie di creatività basata su parole chiave. “In media, abbiamo visto che i marchi che utilizzano questi strumenti pubblicizzano un numero di prodotti cinque volte superiore e un numero doppio di immagini per prodotto pubblicizzato, spostando i budget su ciò che produce i risultati migliori”. Chiara la sfida al mercato pubblicitario di Meta e Google. Ma l’IA può anche migliorare le performance di vendita su ecommerce.

In questo esempio, Amazon Ads ha utilizzato Amazon Nova Reel per creare un video pubblicitario per un’immaginaria marca di pasta in scatola.

Altro esempio, la comprensione di video.

“Per mettere alla prova le capacità di comprensione video di Amazon Nova Pro, abbiamo chiesto al modello di esaminare e descrivere un breve filmato muto di una partita di calcio”.

La comprensione visiva può anche aiutare i clienti a generare ulteriore materiale creativo.

Ad esempio, Amazon Nova Pro può suggerire diverse didascalie per i social media per lo stesso video della partita di calcio.

Nel 2025 Amazon lancerà altri due modelli di Amazon Nova, tra cui un modello speech-to-speech e un modello nativo multimodale-to-multimodale o “any-to-any”. Il primo comprenderà lo streaming di input vocali in linguaggio naturale, interpretando le indicazioni verbali e non verbali (come il tono e la cadenza) e fornendo interazioni naturali simili a quelle umane, mentre il secondo sarà in grado di elaborare testo, immagini, audio e video, sia come input che come output.

Ciò semplificherà lo sviluppo di applicazioni in cui lo stesso modello può essere utilizzato per eseguire un’ampia varietà di compiti, come la traduzione di contenuti da una modalità all’altra, la modifica di contenuti e l’alimentazione di agenti AI in grado di comprendere e generare tutte le modalità.


Posted

in

, ,

by

Tags:

Comments

Leave a Reply

Your email address will not be published. Required fields are marked *