Skip to content
This page has been auto-translated and may contain errors.View in English

Multimodalidad

El módulo trabaja con imágenes en ambas direcciones: generándolas a partir de un prompt y pidiendo a un modelo que las describa. Sus dos proyectos descargables, un generador de pósters de películas y una solicitud de visión, se ejecutan en el navegador contra los modelos actuales de visión e imagen de OpenAI. Ambos necesitan el mismo cambio de clave Vite y actualización del SDK de OpenAI, y ambos hacen solicitudes pagadas desde el navegador, así que la guía es cuidadosa sobre qué clave usas.

Estas páginas acompañan al módulo de Multimodalidad de la ruta de AI Engineer de Scrimba. No reemplazan las lecciones; contienen los detalles de configuración que cambian más rápido de lo que un video grabado puede seguir, para que se corrijan aquí en lugar de re-grabar.

Las páginas

Ejecutar Multimodalidad localmente es para cuando has descargado el proyecto de generación de imágenes o visión del menú de lecciones y quieres que se ejecute en tu propia máquina. Cubre qué instalar primero, cómo preparar cualquiera de los proyectos, reemplazar su modelo obsoleto y ejecutarlo con una clave temporal de OpenAI, y los errores que la mayoría de estudiantes encuentran en el camino.

Se añadirán más páginas para este módulo aquí conforme se escriban.

¿Buscas un curso diferente?

Ejecutar un proyecto de curso de AI localmente lista todos los cursos y proyectos que tienen una guía de configuración.

Toma la ruta de AI Engineer en ScrimbaMultimodalidad es un módulo de la ruta de AI Engineer de Scrimba, donde generas y lees imágenes lección a lección.