OMX Helsinki — S&P 500 — DAX — NASDAQ 100 — STOXX 600 — EUR/USD — EUR/SEK — BTC/USD — ETH/USD — Euribor 3M — Euribor 12M —
Miroslav Reiter - VITA Academy

Miroslav Reiter - VITA Academy

Technológie a umelá inteligencia 11,300 odberatelia

Online kurz AI Grafika a Dizajn – Ako na AI Obrázky a OCR Technológiu v ChatGPT a Gemini? 1. Časť

10.09.2026
Publikované: 10.09.2026 Kategória: Technológie a umelá inteligencia

Informácie o epizóde

Popis epizódy

🎓 Absolvujte celý online kurz AI Grafika, Dizajn a Multimédia na ➡ https://www.vita.sk/online-kurz-ai-grafika-dizajn-a-multimedia/ V tomto videu z online kurzu AI Grafika a Dizajn si vysvetlíme, ako pracujú ChatGPT, Google Gemini a Gemini Notebook s obrázkami a ako môžeme využívať OCR technológiu pri rozpoznávaní a spracovaní textu z obrazových podkladov. OCR (Optical Character Recognition – optické rozpoznávanie znakov) umožňuje získavať text z fotografií, skenov, dokumentov a ďalších obrazových zdrojov. Moderné multimodálne AI nástroje však dokážu ísť ďalej ako klasické OCR. Okrem samotného textu môžu analyzovať objekty, rozloženie dokumentu, grafy, diagramy, tabuľky a širší vizuálny kontext obrázka. Pozrieme sa na to, aké obrazové formáty môžeme používať v Gemini Notebook, ako pridávať obrázky ako zdroje a aké obmedzenia platia pri veľkosti nahrávaných súborov. Prakticky si ukážeme prácu s obrázkami vo webovej aj mobilnej verzii AI nástrojov. Vysvetlíme si rozdiel medzi klasickým OCR systémom a multimodálnym porozumením obrazu. Klasické OCR sa primárne sústreďuje na rozpoznanie znakov a textu. ChatGPT, Gemini a Gemini Notebook dokážu zároveň interpretovať celý vizuálny obsah, identifikovať objekty, analyzovať graf alebo diagram a vysvetľovať jeho význam v kontexte. Ukážeme si tiež, čo sa pri práci so zdrojmi spracúva a čo nie. Samostatne nahrané fotografie, obrázky, skenované dokumenty alebo PDF môžu obsahovať vizuálne informácie, ktoré AI analyzuje. Pri webových stránkach a YouTube videách však musíme počítať s odlišným spôsobom importu zdrojov. Pri YouTube zdrojoch v Gemini Notebook sa importuje textový prepis videa, nie jednotlivé obrazové snímky. Pri webových URL sa rovnako nemôžeme automaticky spoliehať na to, že sa importujú všetky obrázky, vložené videá alebo ďalší vnorený vizuálny obsah stránky. Na praktických príkladoch si ukážeme, čo dokáže Gemini Notebook z obrázka zistiť. Budeme pracovať s fotografiami predmetov, produktov a interiérov a sledovať, ako AI identifikuje objekty, text, značky, materiály, prostredie a ďalšie vizuálne vlastnosti. ⭐ Obsah nadupaného videa AI Grafika a Dizajn ⭐ ⌨ (0:00:00) AI Obrázky a OCR Technológia - čo budeme riešiť v 1. časti ⌨ (0:04:44) Pre koho je práca s AI obrázkami a OCR technológiou určená? ⌨ (0:09:28) Čo…

Otvoriť chat s AI asistentom. Chat sa načíta až potom, ako ho otvoríte.