Inteligência Artificial

OpenAI investiga o funcionamento interno da GPT

Publicado por
Isabella Caminoto

A OpenAI acaba de publicar um novo artigo detalhando um método para realizar engenharia reversa dos conceitos aprendidos por modelos de IA e, assim, entender melhor o funcionamento interno do ChatGPT.

Conheça os detalhes

  • O artigo foi escrito por membros da equipe de “superalinhamento” recentemente dissolvida, incluindo Ilya Sutskever e Jan Leike.
  • O trabalho, intitulado “Dimensionamento e Avaliação de Autoencoders esparsos”, descreve uma técnica para identificar padrões que representam conceitos específicos dentro do GPT-4.
  • Ao utilizar um modelo adicional para sondar o modelo principal, os pesquisadores encontraram uma maneira de extrair milhões de padrões de atividade para exploração posterior.
  • A OpenAI liberou o código-fonte e uma ferramenta de visualização, permitindo que outros explorem como diferentes palavras e frases ativam conceitos dentro dos modelos.

Por que isso importa?

Assim como o recente “Golden Gate Claude” e a pesquisa correspondente da Anthropic, as empresas de IA ainda estão trabalhando para entender o que realmente está acontecendo dentro de seus modelos. Desvendar a “caixa preta” da IA seria um grande passo para melhorar a segurança, o ajuste e a capacidade de controle de modelos que avançam rapidamente.

Leia também:

Este post foi modificado pela última vez em %s = human-readable time difference 12:36

Isabella Caminoto

Advogada e mestranda em Direito Internacional, tenho a democracia e a liberdade como bandeiras irrenunciáveis. Sou apaixonada pelos animais e acredito que o bem-estar do nosso planeta deveria ser o destaque diário da pauta da nossa sociedade.

Posts recentes

Google se associa à Apptronik para desenvolver robôs humanoides

O Google DeepMind acaba de anunciar uma parceria estratégica com a Apptronik, uma empresa de…

20 de dezembro de 2024

Genesis: Um novo patamar para simulações físicas em IA

Uma equipe de pesquisadores de 20 laboratórios diferentes acaba de apresentar o Genesis, um motor…

20 de dezembro de 2024

Google lança seu próprio modelo de IA de “raciocínio”

O Google acabou de lançar o que está chamando de um novo modelo de inteligência…

19 de dezembro de 2024

GitHub Copilot agora é gratuito

A GitHub, de propriedade da Microsoft, acaba de anunciar um nível gratuito de seu Copilot…

19 de dezembro de 2024

ChatGPT ganha um novo número de telefone; veja

A OpenAI acaba de lançar uma nova maneira surpreendente de acessar o ChatGPT - através…

19 de dezembro de 2024

Google lança novo benchmark para testar a factualidade de LLMs

O Google DeepMind acaba de lançar o FACTS Grounding, um novo benchmark projetado para avaliar…

18 de dezembro de 2024