GPT-4o junta texto, imagem e voz num único modelo
A OpenAI apresentou uma arquitetura multimodal concebida para responder com menor latência e compreender diferentes formatos sem depender de vários sistemas separados.
Modelo multimodal da OpenAI concebido para interações rápidas através de texto, imagem e áudio.
Uma leitura rápida das características publicadas pelo laboratório.
A OpenAI apresentou uma arquitetura multimodal concebida para responder com menor latência e compreender diferentes formatos sem depender de vários sistemas separados.
Use perguntas concretas para perceber para que serve um modelo e quais são os seus limites.
Lembre-se: As capacidades, preços e condições de acesso podem mudar. Confirme sempre na fonte oficial antes de escolher uma ferramenta.