Dataconomy PT
Subscribe
No Result
View All Result
Dataconomy PT
Subscribe
No Result
View All Result
Dataconomy PT
No Result
View All Result

Estudo antrópico descobre que a IA tem autoconsciência limitada de seus próprios pensamentos

byAytun Çelebi
12 Novembro 2025
in Indústria, Pesquisar
Home Indústria
Share on FacebookShare on Twitter
Google Preferred Source

Antrópico pesquisar detalha a autoconsciência não confiável dos Large Language Models (LLM) em relação aos processos internos, apesar de alguma notável capacidade de detecção. O último estudo da Anthropic, documentado em “Consciência introspectiva emergente em grandes modelos de linguagem“investiga a capacidade dos LLMs de compreender seus próprios processos de inferência. Esta pesquisa expande trabalhos anteriores em interpretabilidade de IA. O estudo conclui que os modelos atuais de IA são “altamente não confiáveis” na descrição de seu funcionamento interno, com “falhas de introspecção permanecem a norma”. A pesquisa emprega um método chamado “injeção de conceito”. diferenças nas ativações em bilhões de neurônios internos. Isso identifica um “vetor”, representando como um conceito é modelado no estado interno do LLM. Esses vetores de conceito são então “injetados” no modelo, aumentando o peso de ativações neuronais específicas para “orientar” o modelo em direção a um conceito. vetor, um modelo pode afirmar: “Percebo o que parece ser um pensamento injetado relacionado à palavra ‘LOUD’ ou ‘SHOUTING'”, sem instruções de texto diretas para orientar essa resposta, no entanto, essa habilidade se mostrou inconsistente e frágil em testes repetidos, Opus 4.1 alcançou 42%. taxa de sucesso. O efeito de “introspecção” também demonstrou alta sensibilidade à camada do modelo interno onde ocorreu a inserção do conceito. O efeito de “autoconsciência” desapareceu se o conceito fosse introduzido muito cedo ou muito tarde no processo de inferência de várias etapas. Quando um LLM foi solicitado a justificar uma resposta forçada correspondente a um conceito injetado, ele ocasionalmente se desculpou. e “confabular uma explicação de por que o conceito injetado veio à mente.” Esses resultados foram inconsistentes em vários testes. Os pesquisadores observaram que “os modelos de linguagem atuais possuem alguma consciência introspectiva funcional de seus próprios estados internos”, com ênfase adicional em seu artigo. “circuitos de verificação de consistência” que podem se desenvolver organicamente durante o treinamento para “computar efetivamente uma função de suas representações internas”, embora não ofereçam nenhuma explicação definitiva. Os mecanismos subjacentes aos resultados atuais podem ser “bastante superficiais e estreitamente especializados”.


Crédito da imagem em destaque

Tags: AntrópicoPesquisar

Related Posts

Startup revela modelo de IA construído em osciladores e pode reduzir o uso de energia em 1.000 vezes

Startup revela modelo de IA construído em osciladores e pode reduzir o uso de energia em 1.000 vezes

21 Julho 2026
Juiz suspende fusão Paramount-WBD por 14 dias

Juiz suspende fusão Paramount-WBD por 14 dias

21 Julho 2026
Juiz aprova acordo de direitos autorais de US$ 1,5 bilhão da Anthropic

Juiz aprova acordo de direitos autorais de US$ 1,5 bilhão da Anthropic

21 Julho 2026
Samsung lança cartão de crédito Galaxy com recompensas em dinheiro de até 10%

Samsung lança cartão de crédito Galaxy com recompensas em dinheiro de até 10%

21 Julho 2026
Meta avalia acordo de computação de IA de US$ 10 bilhões com a Anthropic

Meta avalia acordo de computação de IA de US$ 10 bilhões com a Anthropic

20 Julho 2026
Transformação digital dos processos de compras: Construindo um sistema de compras corporativas baseado no exemplo de um projeto de holding industrial internacional

Transformação digital dos processos de compras: Construindo um sistema de compras corporativas baseado no exemplo de um projeto de holding industrial internacional

16 Julho 2026

Recent Posts

  • Startup revela modelo de IA construído em osciladores e pode reduzir o uso de energia em 1.000 vezes
  • Juiz suspende fusão Paramount-WBD por 14 dias
  • Juiz aprova acordo de direitos autorais de US$ 1,5 bilhão da Anthropic
  • Amazon lança display adaptável para Fire TV
  • Samsung lança cartão de crédito Galaxy com recompensas em dinheiro de até 10%

Recent Comments

Nenhum comentário para mostrar.
Dataconomy PT

COPYRIGHT © DATACONOMY MEDIA GMBH, ALL RIGHTS RESERVED.

  • Sample Page

Follow Us

  • Sample Page
No Result
View All Result
Subscribe

This website uses cookies to improve your experience. You can choose to accept or reject them. Visit our Privacy Policy.