OpenAI lançou GPT-4, uma IA multimodal
Blog

OpenAI lançou GPT-4, uma IA multimodal

OpenAI tem anunciou o lançamento de um modelo avançado de IA chamado GPT-4, que exibe capacidades excepcionais na compreensão de imagens e texto através de melhorias aprendizado de máquina. Esta inovação representa um marco significativo na jornada da empresa para aprimorar tecnologias de aprendizado profundo.

O GPT-4 pode ser acessado pelo OpenAI ChatGPT Além disso, assinantes estão sujeitos a um limite de uso, enquanto desenvolvedores podem entrar em uma lista de espera para acesso à API.

A estrutura de preços envolve uma taxa de US$ 0.03 para cada 1,000 tokens de “prompt” (equivalente a aproximadamente 750 palavras) e US$ 0.06 para cada 1,000 tokens de “completion” (novamente, cerca de 750 palavras). Os tokens são os blocos de construção do texto; por exemplo, a palavra “fantástico” seria dividida nos tokens “fan”, “tas” e “tic”. Os tokens de prompt consistem em segmentos de palavras inseridos no GPT-4, enquanto os tokens de conclusão se referem ao conteúdo gerado pelo modelo de IA.

Curiosamente, o GPT-4 tem estado discretamente operacional, conforme revelado por Confirmação da Microsoft que o Bing Chat, uma tecnologia de chatbot desenvolvida em conjunto com a OpenAI, é alimentada pelo GPT-4.

Primeiros usuários do GPT-4

Vários pioneiros já estão aproveitando o potencial do GPT-4. Stripe emprega o modelo de IA para analisar sites de negócios e fornecer resumos para equipes de suporte ao cliente. O Duolingo integrou o GPT-4 em um novo nível de assinatura de aprendizado de idiomas.

O Morgan Stanley está desenvolvendo um sistema baseado em GPT-4 para extrair informações de documentos corporativos para analistas financeiros. Além disso, a Khan Academy está utilizando GPT-4 para criar uma solução de tutoria automatizada.

O GPT-4 demonstrou desempenho notável em uma variedade de benchmarks profissionais e acadêmicos, alcançando resultados de “nível humano”. Por exemplo, em um exame simulado da OAB, o GPT-4 pontuou no 10% dos melhores candidatos, uma melhoria notável em relação à pontuação inferior de 3.5% do GPT-10.

Meio ano de desenvolvimento

A OpenAI passou seis meses ajustando o GPT-4 usando insights de um programa interno de testes adversariais e do ChatGPT. O resultado é um modelo que ostenta precisão, dirigibilidade e capacidade de operar dentro de restrições predefinidas inigualáveis.

Para treinar o GPT-4, a OpenAI colaborou com Microsoft para criar um “supercomputador” personalizado na nuvem Azure. O modelo foi treinado usando dados publicamente disponíveis e fontes de dados licenciadas, resultando em um modelo de linguagem versátil e completo.

O GTP-4 é capaz de entender imagens, assim como texto

Um dos aspectos mais intrigantes do GPT-4 é sua capacidade de compreender imagens além de texto. Por exemplo, ele pode reconhecer e interpretar imagens relativamente complexas, como identificar um adaptador Lightning Cable a partir de uma imagem de um iPhone conectado.

Embora o recurso de compreensão de imagem ainda não esteja disponível para todos os clientes OpenAI, ele está sendo testado com Seja meus olhos, um único parceiro. O recurso Virtual Volunteer do Be My Eyes, alimentado pelo GPT-4, pode responder perguntas sobre imagens que são enviadas a ele. Em uma postagem de blog, a empresa elaborou como esse recurso funciona:

“Se um usuário enviar uma foto do interior de sua geladeira, o Virtual Volunteer não só poderá identificar corretamente o que há nela, mas também extrapolar e analisar o que pode ser preparado com aqueles ingredientes. A ferramenta também pode então oferecer uma série de receitas para aqueles ingredientes e enviar um guia passo a passo sobre como fazê-los.”

O recurso “Ferramentas de direção”

O novo recurso “ferramentas de direção” permite que os desenvolvedores prescrevam instruções específicas para a IA definir o tom e os limites para suas interações. Esse recurso é possível por meio da introdução de uma nova capacidade de API chamada mensagens de “sistema”.

Mensagens do sistema são essencialmente instruções que fornecem um estilo e uma tarefa que a IA deve seguir. Elas são como diretrizes que ditam como a IA deve se comportar em uma determinada situação. O ChatGPT também receberá esse recurso no futuro.

Por exemplo, uma mensagem do sistema pode especificar que a IA deve agir como um tutor que sempre responde no estilo socrático. Nesse caso, a IA nunca daria a resposta diretamente ao aluno, mas sempre faria as perguntas certas para ajudá-lo a aprender a pensar por si mesmo.

RELACIONADO: 12 usos da IA ​​na educação

Além disso, a IA sempre ajustaria suas perguntas com base no interesse e conhecimento do aluno, dividindo problemas complexos em partes mais simples até atingirem o nível certo.

Apesar da introdução de mensagens do sistema e outras atualizações, a OpenAI reconhece que o GPT-4 ainda tem falhas. A IA ainda pode cometer erros de raciocínio e até mesmo “alucinar” fatos. Por exemplo, o GPT-4 certa vez descreveu Elvis Presley como o “filho de um ator”, o que é incorreto.

Quais são as limitações do GPT-4

De acordo com a OpenAI, o GPT-4 sofre de falta de conhecimento sobre eventos recentes que ocorreram após setembro de 2021, que é quando seus dados são cortados. Além disso, o GPT-4 não aprende com a experiência, o que às vezes pode resultar em erros de raciocínio simples que não refletem seu amplo conhecimento em muitos domínios.

Além disso, o GPT-4 pode ser muito confiante quando se trata de aceitar declarações obviamente falsas de usuários e pode até falhar em tarefas difíceis, como introduzir vulnerabilidades de segurança no código que ele gera.

Palavras finais

Apesar dessas limitações, a OpenAI alega que o GPT-4 fez melhorias significativas em certas áreas. Por exemplo, o GPT-4 agora tem menos probabilidade de gerar instruções sobre como sintetizar produtos químicos perigosos. Em comparação com o GPT-3.5, o GPT-4 tem 82% menos probabilidade de responder a solicitações de conteúdo “não permitido”.

 

Além disso, o GPT-4 agora está mais em conformidade com as políticas da OpenAI quando se trata de fornecer informações confidenciais, como aconselhamento médico e tópicos de automutilação, aos quais ele responde com 29% mais frequência do que seu antecessor.

 

Qual é a sua reação?

Animado
0
Boa
0
in Love
0
Not Sure
0
Boba
0
Emily Davis
Emily é uma engenheira de aprendizado de máquina. Ela se dedica a usar IA para causar um impacto positivo no mundo. Quando não está trabalhando, ela gosta de ler e experimentar novas receitas na cozinha.

Sugestões para você

Mais em:Blog