-
Petro diz temer 'guerra civil' na Colômbia após suposta fraude eleitoral
-
Trump afirma que EUA e Irã negociam e alerta para 'última oportunidade'
-
Incêndio na França revela obuses da Segunda Guerra Mundial
-
Mau tempo em cuba dificulta reconexão elétrica após apagão
-
Conselho de Paz tranquiliza Israel após objeções a retirada de Gaza
-
Tarifas de Trump voltam à mira da Justiça nos EUA
-
Crise em Ceuta abre nova frente para premier da Espanha
-
Ex-presidente hondurenho indultado pelos EUA vai se defender em liberdade
-
MLS escolhe Larry Berg como comissário para suceder Don Garber
-
Vladimir Petkovic deixa cargo de técnico da Argélia
-
Vinte e cinco estados democratas processam governo Trump por 'tarifaço'
-
737 MAX 7 da Boeing obtém certificação após vários anos de atrasos
-
Trump diz que EUA e Irã estão negociando e alerta para 'última oportunidade'
-
Real Madrid acerta transferência do atacante Gonzalo García para o Fulham
-
Zelensky demite embaixadora ucraniana nos Estados Unidos
-
Fritz vence Jódar na final em Washington e conquista seu 11º título
-
Trump acusa petroleiras de ganhar 'dinheiro demais' graças à guerra com Irã
-
Eala vence Pegula na final em Washington e conquista seu 1º título WTA
-
Taxa de homicídios recuou no México em 2025
-
Cuba restaura eletricidade após apagão nacional, mas cortes persistem
-
Irmãs Williams recebem convites para disputar duplas do WTA 1000 de Cincinnati
-
Incêndio perto de Bordeaux revela projéteis da Segunda Guerra Mundial
-
Eala vence Pegule na final em Washington e conquista seu 1º título WTA
-
Casa Branca terá reunião sobre regulação da IA na terça-feira
-
Trump diz que Irã deve escolher entre 'acordo' ou 'rendição total'
-
Flick admite que Barça precisa de reforços no ataque
-
Chelsea contrata meia Jordan Henderson, do Brentford e da seleção inglesa
-
Atividade industrial cresce em ritmo acelerado em julho nos EUA
-
Seleção dos EUA renova com técnico Mauricio Pochettino até a Copa de 2030
-
Edin Dzeko renova com Schalke 04 por mais um ano
-
Cuba começa a restabelecer eletricidade após novo apagão nacional
-
Inglaterra e Gales tiveram julho mais seco desde que começaram os registros
-
Espanha defende sua soberania sobre Ceuta após crise migratória
-
Amazon ultrapassa pela primeira vez os US$ 3 trilhões em valor de mercado
-
Ex-primeira-dama Michelle Bolsonaro será candidata ao Senado
-
Condições de trabalho na América Latina melhoraram pouco em três décadas, diz BID
-
Chefe da UE pede resposta comum para 'reforçar fronteiras' após crise em Ceuta
-
'Ted Lasso' retorna aos gramados com equipe feminina
-
Ataque russo queima oito milhões de livros na Ucrânia, denuncia editora
-
Aung San Suu Kyi, Nobel da Paz presa em Mianmar, reúne-se com delegado da Cruz Vermelha
-
Como formar 'cirurgiões do futuro' no uso de robôs
-
Irã nega negociações com EUA após anúncio de Trump sobre novas conversações
-
BitMart、説明を迫られる:SNC SCANDIC COINの出金は8日経っても依然としてTXIDなし
-
설명 압박에 직면한 BitMart: 8일이 지나도 여전히 TXID가 없는 SNC SCANDIC COIN 출금
-
BitMart تحت ضغط لتقديم توضيحات: عمليات سحب عملة SNC SCANDIC COIN لا تزال بدون معرّف المعاملة (TXID) بعد مرور ثمانية أيام
-
BitMart змушений надати пояснення: виплати в SNC SCANDIC COIN через вісім днів досі без TXID
-
BitMart sob pressão para dar explicações: os levantamentos de SNC SCANDIC COIN continuam sem TXID após oito dias
-
Israel transmite aos Estados Unidos suas 'preocupações' sobre o plano para Gaza
-
BitMart 面臨解釋壓力:SNC SCANDIC COIN 提現八天後仍無 TXID
-
Candidato de Trump a procurador-geral anuncia acordo com senadores após impasse
IA aprende a mentir, manipular e ameaçar seus criadores
Os últimos modelos de inteligência artificial (IA) generativa não se conformam mais em cumprir ordens. Começam a mentir, manipular e ameaçar para alcançar seus objetivos, diante dos olhares preocupados dos pesquisadores.
Ameaçado em ser desconectado, Claude 4, recém-criado pela Anthropic, chantageou um engenheiro e ameaçou revelar uma relação extraconjugal.
Por sua vez, o o1, da OpenAI, tentou se baixar em servidores externos e quando flagrado, negou.
Não é preciso se aprofundar na literatura ou no cinema: a IA que emula o comportamento humano já é uma realidade.
Para Simon Goldstein, professor da Universidade de Hong Kong, a razão para estas reações é o surgimento recente dos chamados modelos de "raciocínio", capazes de trabalhar por etapas em vez de produzir uma resposta instantânea.
O o1, versão inicial deste tipo da OpenAI, lançada em dezembro, "foi o primeiro que se comportou desta maneira", explica Marius Hobbhahn, encarregado da Apollo Research, que põe à prova grandes programas de IA generativa (LLM).
Estes programas também tendem, às vezes, a simular um "alinhamento", ou seja, dão a impressão de que seguem as instruções de um programador, quando na verdade buscam outros objetivos.
Por enquanto, estes traços se manifestam quando os algoritmos são submetidos a cenários extremos por humanos, mas "a questão é se os modelos cada vez mais potentes tenderão a ser honestos ou não", afirma Michael Chen, do organismo de avaliação METR.
"Os usuários também pressionam os modelos o tempo todo", diz Hobbhahn. "O que estamos vendo é um fenômeno real. Não estamos inventando nada".
Muitos internautas falam nas redes sociais de "um modelo que mente para eles ou inventa coisas. E não se tratam de alucinações, mas de duplicidade estratégica", insiste o cofundador da Apollo Research.
Embora Anthropic e OpenAI recorram a empresas externas, como a Apollo, para estudar seus programas, "uma maior transparência e um acesso maior" da comunidade científica "permitiriam investigar melhor para compreender e prevenir a farsa", sugere Chen, do METR.
Outro obstáculo: a comunidade acadêmica e as organizações sem fins lucrativos "dispõem de infinitamente menos recursos informáticos que os atores da IA", o que torna "impossível" examinar grandes modelos, assinala Mantas Mazeika, do Centro para a Segurança da Inteligência Artificial (CAIS).
As regulamentações atuais não estão desenhadas para enfrentar estes novos problemas.
Na União Europeia, a legislação se centra principalmente em como os humanos usam os modelos de IA, não em prevenir que os modelos se comportem mal.
Nos Estados Unidos, o governo de Donald Trump não quer nem ouvir falar em regulamentação, e o Congresso americano poderia, inclusive, proibir em breve que os estados regulem a IA.
- A IA no banco dos réus? -
"Por enquanto há muito pouca conscientização", diz Simon Goldstein, que, no entanto, avalia que o tema passará ao primeiro plano nos próximos meses com a revolução dos agentes de IA, interfaces capazes de realizar sozinhas uma multiplicidade de tarefas.
Os engenheiros estão em uma corrida atrás da IA e suas aberrações, com resultado duvidoso, em um contexto de forte concorrência.
A Anthropic pretende ser mais virtuosa que suas concorrentes, "mas está tentando idealizar um novo modelo para superar a OpenAI", segundo Goldstein. O ritmo dá pouco tempo para comprovações e correções.
"Como estão as coisas, as capacidades [da IA] estão se desenvolvendo mais rápido que a compreensão e a segurança", admite Hobbhahn, "mas ainda estamos em condições de nos atualizarmos".
Alguns apontam na direção da interpretabilidade, ciência que consiste em decifrar, do lado de dentro, como funciona um modelo de IA generativa, embora muitos, como o diretor do Centro para a Segurança da IA (CAIS), Dan Hendrycks, se mostrem céticos.
As trapaças da IA "poderiam obstaculizar a adoção caso se multipliquem, o que supõe um forte incentivo para que as empresas [do setor] resolvam" este problema, afirma Mazeika.
Goldstein, por sua vez, menciona o recurso aos tribunais para enquadrar a IA, dirigindo-se às empresas caso se desviem do caminho. Mas ele vai além, ao propor que os agentes da IA sejam "legalmente responsabilizados" em caso "de acidente ou delito".
F.Cardoso--PC