quarta-feira, 12 de agosto de 2026 📬 Resumo no TelegramPortaisSobre🌓
Últimas
Premiê libanês denuncia ‘destruição sistemática’ de Israel no sul do país: ‘violação do direito internacional’ ‘Cater Force One’: Irã difunde vídeo satirizando fuga de Trump de avião presidencial Lula e Alcolumbre se reúnem para discutir prioridades do governo no Senado Democratas de Wisconsin escolhem moderado em vez de socialista para governo China e Rússia enviam homenagens aos 100 anos de Fidel Castro: ‘memória sagrada’ Governo interino da Venezuela anuncia retomada de serviços consulares com Israel; movimentos protestam Putin fala em ‘crescente presença’ da OTAN em regiões próximas à Rússia ONU mobiliza ajuda humanitária para Colômbia após terremoto; mais de 250 morreram Ondas de calor ainda são negligenciadas no Brasil e podem piorar com El Niño, diz pesquisadora Governo Milei elimina atendimento médico gratuito para estrangeiros Premiê libanês denuncia ‘destruição sistemática’ de Israel no sul do país: ‘violação do direito internacional’ ‘Cater Force One’: Irã difunde vídeo satirizando fuga de Trump de avião presidencial Lula e Alcolumbre se reúnem para discutir prioridades do governo no Senado Democratas de Wisconsin escolhem moderado em vez de socialista para governo China e Rússia enviam homenagens aos 100 anos de Fidel Castro: ‘memória sagrada’ Governo interino da Venezuela anuncia retomada de serviços consulares com Israel; movimentos protestam Putin fala em ‘crescente presença’ da OTAN em regiões próximas à Rússia ONU mobiliza ajuda humanitária para Colômbia após terremoto; mais de 250 morreram Ondas de calor ainda são negligenciadas no Brasil e podem piorar com El Niño, diz pesquisadora Governo Milei elimina atendimento médico gratuito para estrangeiros
Economia

Aprendizado por reforço: a técnica por trás dos maiores saltos de qualidade da IA

Exame ·
Aprendizado por reforço: a técnica por trás dos maiores saltos de qualidade da IA

Modelos de inteligência artificial costumavam ser treinados principalmente para reconhecer padrões e prever qual seria a próxima palavra em uma sequência.

Esse processo continua sendo importante, mas uma técnica chamada aprendizado por reforço ganhou relevância para desenvolver sistemas capazes de lidar com problemas mais complexos.

A lógica pode ser entendida sem recorrer à matemática. Em vez de apenas mostrar ao sistema exemplos de respostas prontas, o treinamento cria situações em que o modelo pode tentar diferentes caminhos e receber uma espécie de recompensa quando chega a um resultado considerado adequado.

Se você quer entender como a inteligência artificial está mudando o trabalho e quais conhecimentos podem fazer diferença na carreira, conheça o Pré-MBA em IA da Saint Paul e EXAME por R$ 37.

O aprendizado por reforço é uma técnica de inteligência artificial inspirada na ideia de aprender por tentativa e erro .

Imagine uma pessoa aprendendo a jogar xadrez. No início, ela pode fazer movimentos ruins. Depois de várias partidas, identifica quais decisões costumam levar à vitória e quais aumentam a chance de perder.

No treinamento de uma IA, o princípio é parecido. O sistema recebe uma tarefa, produz uma resposta e recebe uma avaliação.

Quando uma estratégia funciona, ela ganha uma recompensa. Quando não funciona, o resultado serve como sinal para ajustar o comportamento.

Ler a notícia completa no Exame ›

Resumo agregado pelo 5News a partir do feed público do veículo. A matéria completa, com todo o contexto, está em exame.com — o conteúdo pertence a Exame.

Mais de Exame

Ver tudo ›

Mais em Economia

Ver tudo ›