Přeskočit na obsah

Google Gemini

Z Infopedia
Google Gemini (dříve Bard)
Stav vývojeAktivní vývoj
VývojářGoogle
NázevGoogle Gemini (dříve Bard)
VerzeNeustále aktualizováno
FunkceGenerování textu, odpovídání na otázky, shrnování informací, psaní kreativních textů, kódování
První vydání21. března 2023 (jako Bard)
LogoGemini (Google).svg
Popisek logaLogo Google Gemini
Webgemini.google.com
ModelRodina modelů Gemini (Ultra, Pro, Nano)
Typ softwaruKonverzační umělá inteligence, velký jazykový model (LLM)
PlatformaWebový prohlížeč
Webgemini.google.com
Programovací jazyk(Interní, není veřejně specifikováno, pravděpodobně Python a další)
NázevGoogle Gemini (dříve Bard)
LogoGemini (Google).svg
První vydání21. března 2023 (jako Bard)
PlatformaWebový prohlížeč
LicencováníProprietární
VývojářGoogle

Google Gemini (dříve známý jako Bard) je rodina velkých jazykových modelů (LLM) a zároveň konverzační umělá inteligence vyvinutá společností Google. Je navržena tak, aby dokázala generovat lidsky znějící text, odpovídat na širokou škálu otázek, shrnovat informace, psát různé druhy kreativního obsahu a pomáhat s úkoly, jako je kódování.

Co je Gemini a jak funguje?

Gemini představuje snahu Googlu o pokročilý konverzační nástroj s umělou inteligencí, který konkuruje podobným systémům, jako je ChatGPT.

  • Velký jazykový model (LLM): Základem Gemini jsou rozsáhlé neuronové sítě, které byly trénovány na obrovském množství textových a jiných dat. Díky tomu si modely osvojily složité vzory jazyka, gramatiku, sémantiku a do určité míry i "chápání" světa.
  • Konverzační AI: Gemini je optimalizováno pro interakci s uživateli formou přirozeného jazyka. Můžete s ním chatovat, klást otázky, žádat o vysvětlení nebo o generování textu, a systém se snaží poskytovat relevantní a kontextově vhodné odpovědi.
  • Multimodalita: Současné verze Gemini jsou vyvíjeny jako multimodální, což znamená, že dokážou zpracovávat a generovat informace nejen z textu, ale také z obrázků, zvuku a videa. To rozšiřuje jejich schopnosti a umožňuje složitější interakce.
  • Integrace s Google službami: Gemini je navrženo tak, aby se v budoucnu integrovalo s dalšími službami Googlu, což mu umožní přistupovat k aktuálním informacím (např. přes Google Search) a dalším datům pro generování relevantnějších odpovědí.

Funkce a možnosti

Gemini má širokou škálu využití:

  • Generování textu: Psaní emailů, esejí, básní, scénářů, marketingových textů, shrnutí a dalších písemných materiálů.
  • Odpovídání na otázky: Poskytování informací na základě znalostí, které model získal z tréninkových dat, nebo z přístupu k aktuálním informacím (tzv. "extenze").
  • Shrnování informací: Zkrácení dlouhých textů do klíčových bodů.
  • Brainstorming a tvorba nápadů: Pomoc s generováním kreativních nápadů pro různé účely.
  • Kódování: Generování kódu v různých programovacích jazycích, vysvětlování kódu nebo jeho ladění.
  • Vzdělávání: Vysvětlování složitých konceptů, pomoc s učením.

Vývoj a budoucnost

Gemini je nástupcem modelu Bard a představuje novou generaci modelů umělé inteligence od Googlu. Google se zaměřuje na zvyšování schopností modelů v oblasti rozumění, uvažování, kódování a multimodality. Cílem je poskytnout ještě výkonnější a užitečnější nástroje, které budou schopny lépe chápat složité dotazy a poskytovat komplexní a přesné odpovědi.

🎬 Video

💬 Diskuze k článku