Explore como você pode usar o novo modelo Gemini Pro Vision com a API Gemini para lidar com dados de entrada multimodais, incluindo prompts de texto e imagem, para receber um resultado em texto. Nesta solução, você aprenderá como acessar a API Gemini com dados de imagem e texto, explorar uma variedade de exemplos de prompts que podem ser alcançados usando imagens com o Gemini Pro Vision e, finalmente, completar um codelab explorando como usar a API para um cenário de problema do mundo real envolvendo acessibilidade e desenvolvimento web básico.
Plataforma: Google Developers
Nível: beginner
Curso gratuito