Suas próprias imagens
Um slide de imagem normalmente mostra uma imagem gerada para a aula. Ele pode mostrar uma sua no lugar: uma captura de tela, um gráfico, um diagrama, uma foto, um desenho.
Sua imagem não carrega a etiqueta Imagem gerada e não conta para as 12 imagens geradas que um explainer pode ter.
No Scrimba
Anexe a imagem ao seu prompt em scrimba.com/explain.
O Explain a mostra quando você pede, ou quando a imagem é o próprio assunto da aula: a interface, o gráfico, o desenho ou a foto que você está pedindo para ser explicada. Cada uma é mostrada no máximo uma vez, sozinha em seu slide, com a narração apontando para ela.
Imagens que ele lê em vez de mostrar
Uma captura de tela de código, uma mensagem de erro ou uma página de texto é material para ser lido, não um slide. A aula ensina a partir do que está nela: código volta como um slide de código, texto vira um cartão ou um layout.
Peça diretamente se quiser ver a captura de tela em si.
Definindo o estilo das imagens geradas
Uma imagem anexada também pode guiar o estilo das que o Explain gera. Anexe o desenho de um personagem, ou uma imagem no estilo que você quer, e peça para as cenas seguirem esse padrão. O explainer mostra sua imagem uma vez, no começo, e desenha o resto a partir dela.
De um agente de codificação
Um agente conectado por MCP, como o Claude Code, envia imagens enquanto escreve a aula: uma captura de tela ou diagrama do repositório, uma foto, ou uma imagem que ele gerou com suas próprias ferramentas.
Cada arquivo é enviado para https://scrimba.com/explain/uploads com o token do stream em um cabeçalho X-Stream-Token. A resposta traz um id de anexo, e o agente escreve um slide de imagem que referencia esse id em vez de um prompt. O contrato de autoria já define essa chamada, então não há nada para você configurar.
Do ChatGPT
Uma imagem em uma conversa do ChatGPT funciona da mesma forma, seja você quem a enviou ou o próprio ChatGPT quem a gerou. Peça por ela junto com o pedido do vídeo:
Imagens enviadas pelo aplicativo móvel do ChatGPT não podem ser buscadas, então o explainer é montado sem elas. Veja ChatGPT / Codex.
Limites
Envios de um agente ou do ChatGPT têm um teto por explainer:
| Limite | |
|---|---|
| Imagens por explainer | 12 |
| Tamanho do arquivo | 8 MB cada, 40 MB no total |
| Dimensões | 30 megapixels |
| Formatos | PNG, JPEG, WebP, GIF |
Uma imagem recusada não interrompe o explainer. O agente é informado do que deu errado e de quantas imagens ainda tem disponíveis, e monta o resto da aula sem aquela imagem.

