Modelos de visão e linguagem

O modelo de visão e linguagem adiciona ao modelo AMALIA 9B capacidades de análise de imagem, como descrição de imagens, diálogo sobre conteúdo visual, reconhecimento de texto e processamento de documentos escritos.

Este modelo tem como alvo aplicações que necessitam de processamento de documentos e também aplicações com conteúdo visual rico.

O modelo visão e linguagem está disponível no HuggingFace do projeto AMALIA.