Ugrás a tartalomra
Vissza a hírekhez
Google DeepMind (X)2026. okt. 6. 18:04modell

Megjelent az eszközökön futtatható EmbeddingGemma 2 modell

A Google DeepMind bemutatta az első olyan nyílt forrású beágyazási modelljét, amely közvetlenül az eszközökön hangot, képet és videót is képes kezelni.

A videó az EmbeddingGemma 2 működését szemlélteti, bemutatva, hogyan kapcsolódnak össze a szövegek, kódok, képek, hangok és videók egyetlen közös térben.

Az EmbeddingGemma 2 a Google első olyan natívan multimodális megoldása, amelyet kifejezetten a felhasználók eszközein történő futtatásra terveztek. A nyílt hozzáférésű technológia közvetlenül a helyi hardvereken működik.

Az új modell túllép az egyszerű szöveges adatokon, és egyetlen közös térben egyesíti a programkódokat, a képeket, a hangokat, valamint a videókat. Ez a multimodális beágyazási képesség lehetővé teszi a különböző tartalomtípusok közötti gyors és hatékony keresést, illetve rendszerezést.

A Google DeepMind nyílt modellként tette közzé az újdonságot, így a fejlesztők szabadon beépíthetik azt a saját alkalmazásaikba és helyi munkafolyamataikba.

Az eredeti szöveg (Google DeepMind (X))
Meet EmbeddingGemma 2, our first natively multimodal open model for on-device embeddings. It expands beyond text to unify code, images, audio, and video in a shared space. 🧵