Modelos de visão e linguagem
O modelo de visão e linguagem adiciona ao modelo AMALIA 9B capacidades de análise de imagem, como descrição de imagens, diálogo sobre conteúdo visual, reconhecimento de texto e processamento de documentos escritos.
Este modelo tem como alvo aplicações que necessitam de processamento de documentos e também aplicações com conteúdo visual rico.
O modelo visão e linguagem está disponível no HuggingFace do projeto AMALIA.
— A equipa AMALIA
