A Google legfejlettebb MI-jének használatához az EU-ban még mindig VPN kell, bár még azzal is olcsóbb, mint a GPt-4 a ChatGPT-ben.
Ahogy arról már tavaly beszámoltunk, a nagy rivális már december elején megérkezett a Bardba is, és a modell Gemini Pro nevű változata jelenleg is elérhető a Bard chatboton belül. Ezen kívül bárki, akinek Pixel 8 Pro telefonja van, és az USA-ban vagy Nagy-Britanniában él, szintén hozzáférhet a Geminihez és élvezheti a mesterséges intelligencia által javasolt szöveges üzenetek kényelmét a WhatsApp alkalmazásban.
Sőt mi több, ehhez Magyarországon is elegendő egy VPN előfizetés, amivel ledönthetjük a geoekonomikus-kerítéseket, és kipróbálhatjuk a Geminit.
A Google új generatív MI platformja, a Gemini három verzióban elérhető, ezek az Ultra, a Pro és a Nano. A a Google mesterséges intelligencia kutatólaboratóriumai, a DeepMind és a Google Research által kifejlesztett modellek „natívan multimodálisak”, szöveggel, hanggal, képekkel és videókkal egyszerre dolgoznak. A Gemini modelleket arra képezték ki, hogy alkalmazkodjanak a sokféle audio- és vizuális bemenettel, például természetes képekkel, diagramokkal, képernyőképekkel, PDF-ekkel és videókkal átszőtt szöveges bevitelhez, és szöveges és képi kimeneteket is készíthetnek.
Mihez kezdhet a cég a Geminivel?
A kibővített Gemini Pro-val a fejlesztők a Google Vertex AI vagy a Generative AI Studio segítségével létrehozhatják és felépíthetik a saját használati eseteiket. A vállalkozások sokféle értékes dologra használhatják a Google Geminit, például:
- MI chatbotok létrehozása
- Marketing prezentációk egyszerűsítése
- Könnyen lekérdezhető leltáradatbázisok létrehozása
- Ötletgyűjtés
- Kód íratása
- Információk keresése, beszerzése
A Google felhőalapú ügyfelei bizonyos korlátozásokkal, de ingyenesen hozzáférhetnek a Gemini Pro-hoz, és a Google azt is elmondta, hogy hosszú távon is versenyképes rendszert szeretnének, így bármi is kerül majd az árcédulára, olcsóbbnak kell majd lennie, mint a Google PaLM 2-je. A Gemini Pro ugyanakkor csak csak szöveges bevitelt képes elfogadni és szövegalapú eredményeket generál egy 32k-s kontextusablakon keresztül. Az olyan nagy teljesítményű modellek megérkezésére a vállalati szférába, mint az Ultra, egyelőre még várni kell. Idővel a Gemini Pro funkcióskálája is több funkcióval bővülhet, mint például a csevegés, ahogy gépi tanulása pontosabbá válik. A későbbiekben a Google természetesen integrálja majd ezt az MI-rendszert is a keresőmotorjába, a hirdetési termékeibe és egyéb szolgáltatásaiba.
Ahogy említettük, Gemini Ultrához egyelőre még nem minden halandó férhet hozzá, ez a verzió a legkomplexebb problémák megoldására is képes, és segítséget nyújthat például egy nehéz a fizika házi feladatban vagy éppen a tudományos dolgozatok azonosításában. A nyilvánosan is elérhető Gemini Pro gyengébb matematikai képességekkel rendelkezik, ám kiválóan érvel, a Gemini Nano pedig az a kisebb verzió, ami a telefonokon is képes futni, és olyan funkciókat kínál, mint a hanganyagok összefoglalóinak elkészítése a Pixel 8 Pro készülékekben.
A Google azt állítja, hogy a Gemini felülmúlja az OpenAI GPT-4 modelljét és dacára jelenlegi ingyenességének a Bard felületébe integrálva, később bizony majd az összes piacon – tehát nem csak a cégek számára – pénzbe kerül majd a használata. Az applikációfejlesztők már most feliratkozhatnak a Gemini Nano integrációra az Android-alkalmazásokban, a szélesebb körű integrációkat pedig idén év elejére tervezik.







