Session
Seeing the World Like Humans: Spatial Reasoning in Computer Vision with Gemini
Dalam sesi ini, peserta akan diajak mengeksplorasi bagaimana model AI multimodal terbaru dari Google, Gemini 2.0, mampu memahami dunia visual seperti manusia melalui kemampuan spatial reasoning. Kita akan membahas bagaimana Gemini tidak hanya mengenali objek dalam gambar, tetapi juga memahami hubungan antar objek—seperti mana yang di atas, di bawah, berdekatan, atau saling bertumpuk. Sesi ini akan mencakup demo langsung dari Gemini Cookbook, termasuk analisis gambar 2D dan ruang 3D, serta penerapan model ini melalui Vertex AI di Google Cloud Platform. Cocok untuk pengembang, pelajar, maupun pegiat teknologi yang ingin membangun aplikasi computer vision cerdas dengan pemahaman spasial layaknya manusia.
Please note that Sessionize is not responsible for the accuracy or validity of the data provided by speakers. If you suspect this profile to be fake or spam, please let us know.
Jump to top