Skip to content
This page has been auto-translated and may contain errors.View in English

Multimodalidade

O módulo trabalha com imagens em ambas as direções: gerando-as a partir de um prompt e pedindo a um modelo que as descreva. Seus dois projetos para download, um gerador de pôsteres de filmes e uma solicitação de visão, rodam no navegador contra os modelos atuais de imagem e visão da OpenAI. Ambos precisam da mesma mudança de chave Vite e atualização do SDK da OpenAI, e ambos fazem requisições pagas a partir do navegador, então o guia é cuidadoso sobre qual chave você usa.

Essas páginas acompanham o módulo Multimodalidade do AI Engineer Path do Scrimba. Elas não substituem as aulas; elas guardam os detalhes de configuração que mudam mais rápido do que um scrim gravado consegue acompanhar, para que possam ser corrigidos aqui em vez de ser re-gravados.

As páginas

Executando Multimodalidade localmente é para quando você tiver baixado o projeto de geração de imagens ou de visão do menu de aulas e quiser executá-lo em sua própria máquina. Cobre o que instalar primeiro, como preparar qualquer um dos projetos, substituir seu modelo descontinuado e executá-lo com uma chave OpenAI temporária, além dos erros mais comuns que os alunos enfrentam no caminho.

Mais páginas para este módulo serão adicionadas aqui conforme forem escritas.

Procurando um curso diferente?

Execute um projeto de curso de IA localmente lista todos os cursos e projetos que têm um guia de configuração.

Faça o AI Engineer Path no ScrimbaMultimodalidade é um módulo do AI Engineer Path do Scrimba, onde você gera e lê imagens aula após aula.