TGViewer
DeepWeb DeepWeb @deepwebita · 56.1K subscribers
Post #3559 20.2K
⁣🤖 Gemini di deepmind: modello multimodale superiore raggiunge competenze umane

Il team di ricerca di Google DeepMind ha presentato una nuova famiglia di modelli multimodali chiamata Gemini, che dimostra notevoli competenze nella comprensione di immagini, audio, video e testo.

Questi modelli, basati su decodificatori Transformer, includono versioni Ultra, Pro e Nano, ciascuna progettata per affrontare specifiche limitazioni computazionali e requisiti applicativi. Gemini è in grado di integrare testo con input audio e visivi diversificati, gestendo la risoluzione variabile per la comprensione dei video e catturando dettagli trascurati in precedenza.

La valutazione su benchmark mostra che il modello Gemini Ultra supera le prestazioni umane in diversi casi. Il team enfatizza un approccio etico e responsabile nell'implementazione di tali modelli.

#AIInsights - by @UAITales
More from @deepwebita
  1. Oct 11, 2026Post #4325
  2. Sep 24, 2026⁣🚨 UaniaOS: una falla trasforma il pannello web in una shell root Un ricercatore di Hacke…
  3. Sep 22, 2026⁣🔐 Revolut, il caso dei 680 clienti: non un attacco alla banca, ma una PEC istituzionale…
  4. Sep 10, 2026⁣🚨 SAP in emergenza: una RCE critica può spalancare le porte ai dati aziendali SAP ha cor…
  5. Sep 4, 2026⁣🤖 OpenAI Astra raggiunge il livello “Critico”: l’AI ora può scoprire e sfruttare zero-da…
  6. Sep 3, 2026⁣💌 ILOVEYOU: il “ti amo” che nel 2000 mise in ginocchio Internet Il 4 maggio 2000 milioni…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →