
OpenAI lançou GPT-4, uma IA multimodal
OpenAI tem anunciou o lançamento de um modelo avançado de IA chamado GPT-4, que exibe capacidades excepcionais na compreensão de imagens e texto através de melhorias aprendizado de máquina. Esta inovação representa um marco significativo na jornada da empresa para aprimorar tecnologias de aprendizado profundo.
O GPT-4 pode ser acessado pelo OpenAI ChatGPT Além disso, assinantes estão sujeitos a um limite de uso, enquanto desenvolvedores podem entrar em uma lista de espera para acesso à API.
A estrutura de preços envolve uma taxa de US$ 0.03 para cada 1,000 tokens de “prompt” (equivalente a aproximadamente 750 palavras) e US$ 0.06 para cada 1,000 tokens de “completion” (novamente, cerca de 750 palavras). Os tokens são os blocos de construção do texto; por exemplo, a palavra “fantástico” seria dividida nos tokens “fan”, “tas” e “tic”. Os tokens de prompt consistem em segmentos de palavras inseridos no GPT-4, enquanto os tokens de conclusão se referem ao conteúdo gerado pelo modelo de IA.
Curiosamente, o GPT-4 tem estado discretamente operacional, conforme revelado por Confirmação da Microsoft que o Bing Chat, uma tecnologia de chatbot desenvolvida em conjunto com a OpenAI, é alimentada pelo GPT-4.
Primeiros usuários do GPT-4
Vários pioneiros já estão aproveitando o potencial do GPT-4. Stripe emprega o modelo de IA para analisar sites de negócios e fornecer resumos para equipes de suporte ao cliente. O Duolingo integrou o GPT-4 em um novo nível de assinatura de aprendizado de idiomas.
O Morgan Stanley está desenvolvendo um sistema baseado em GPT-4 para extrair informações de documentos corporativos para analistas financeiros. Além disso, a Khan Academy está utilizando GPT-4 para criar uma solução de tutoria automatizada.
O GPT-4 demonstrou desempenho notável em uma variedade de benchmarks profissionais e acadêmicos, alcançando resultados de “nível humano”. Por exemplo, em um exame simulado da OAB, o GPT-4 pontuou no 10% dos melhores candidatos, uma melhoria notável em relação à pontuação inferior de 3.5% do GPT-10.
Meio ano de desenvolvimento
A OpenAI passou seis meses ajustando o GPT-4 usando insights de um programa interno de testes adversariais e do ChatGPT. O resultado é um modelo que ostenta precisão, dirigibilidade e capacidade de operar dentro de restrições predefinidas inigualáveis.
Para treinar o GPT-4, a OpenAI colaborou com Microsoft para criar um “supercomputador” personalizado na nuvem Azure. O modelo foi treinado usando dados publicamente disponíveis e fontes de dados licenciadas, resultando em um modelo de linguagem versátil e completo.
O GTP-4 é capaz de entender imagens, assim como texto
Um dos aspectos mais intrigantes do GPT-4 é sua capacidade de compreender imagens além de texto. Por exemplo, ele pode reconhecer e interpretar imagens relativamente complexas, como identificar um adaptador Lightning Cable a partir de uma imagem de um iPhone conectado.
Embora o recurso de compreensão de imagem ainda não esteja disponível para todos os clientes OpenAI, ele está sendo testado com Seja meus olhos, um único parceiro. O recurso Virtual Volunteer do Be My Eyes, alimentado pelo GPT-4, pode responder perguntas sobre imagens que são enviadas a ele. Em uma postagem de blog, a empresa elaborou como esse recurso funciona:
“Se um usuário enviar uma foto do interior de sua geladeira, o Virtual Volunteer não só poderá identificar corretamente o que há nela, mas também extrapolar e analisar o que pode ser preparado com aqueles ingredientes. A ferramenta também pode então oferecer uma série de receitas para aqueles ingredientes e enviar um guia passo a passo sobre como fazê-los.”
O recurso “Ferramentas de direção”
O novo recurso “ferramentas de direção” permite que os desenvolvedores prescrevam instruções específicas para a IA definir o tom e os limites para suas interações. Esse recurso é possível por meio da introdução de uma nova capacidade de API chamada mensagens de “sistema”.
Mensagens do sistema são essencialmente instruções que fornecem um estilo e uma tarefa que a IA deve seguir. Elas são como diretrizes que ditam como a IA deve se comportar em uma determinada situação. O ChatGPT também receberá esse recurso no futuro.
Por exemplo, uma mensagem do sistema pode especificar que a IA deve agir como um tutor que sempre responde no estilo socrático. Nesse caso, a IA nunca daria a resposta diretamente ao aluno, mas sempre faria as perguntas certas para ajudá-lo a aprender a pensar por si mesmo.
RELACIONADO: 12 usos da IA na educação
Além disso, a IA sempre ajustaria suas perguntas com base no interesse e conhecimento do aluno, dividindo problemas complexos em partes mais simples até atingirem o nível certo.
Apesar da introdução de mensagens do sistema e outras atualizações, a OpenAI reconhece que o GPT-4 ainda tem falhas. A IA ainda pode cometer erros de raciocínio e até mesmo “alucinar” fatos. Por exemplo, o GPT-4 certa vez descreveu Elvis Presley como o “filho de um ator”, o que é incorreto.
Quais são as limitações do GPT-4
De acordo com a OpenAI, o GPT-4 sofre de falta de conhecimento sobre eventos recentes que ocorreram após setembro de 2021, que é quando seus dados são cortados. Além disso, o GPT-4 não aprende com a experiência, o que às vezes pode resultar em erros de raciocínio simples que não refletem seu amplo conhecimento em muitos domínios.
Além disso, o GPT-4 pode ser muito confiante quando se trata de aceitar declarações obviamente falsas de usuários e pode até falhar em tarefas difíceis, como introduzir vulnerabilidades de segurança no código que ele gera.
Palavras finais
Apesar dessas limitações, a OpenAI alega que o GPT-4 fez melhorias significativas em certas áreas. Por exemplo, o GPT-4 agora tem menos probabilidade de gerar instruções sobre como sintetizar produtos químicos perigosos. Em comparação com o GPT-3.5, o GPT-4 tem 82% menos probabilidade de responder a solicitações de conteúdo “não permitido”.
Além disso, o GPT-4 agora está mais em conformidade com as políticas da OpenAI quando se trata de fornecer informações confidenciais, como aconselhamento médico e tópicos de automutilação, aos quais ele responde com 29% mais frequência do que seu antecessor.














