Português
← Voltar ao início
Era:
Década:
Tópico:

Mostrando 73 de 73 artigos

Trabalhos fundamentais

1948 artigo de periódico Teoria Inicial

A Mathematical Theory of Communication

Define entropia informacional e capacidade de canal, fundando a teoria da informação e fornecendo as bases probabilísticas amplamente utilizadas em IA.

1950 artigo de periódico Teoria Inicial

Computing Machinery and Intelligence

Propõe o jogo da imitação (teste de Turing) como definição operacional de inteligência de máquina, enquadrando a questão da IA para os setenta anos seguintes.

1956 artigo de periódico Nascimento da IA

The Logic Theory Machine: A Complex Information Processing System

Implementa o primeiro programa de raciocínio heurístico, demonstrando que máquinas podem imitar estratégias humanas de resolução de problemas e introduzindo o conceito de «sistema complexo de processamento de informação».

1958 artigo de conferência Nascimento da IA

Programs with Common Sense

Propõe o «advice taker», um programa capaz de tirar conclusões a partir de um repositório formal de conhecimento de senso comum, lançando as bases conceituais da representação de conhecimento e do raciocínio.

1959 artigo de periódico Nascimento da IA

Nota sobre simetria sintática e a manipulação de sistemas formais por máquina

Gelernter trata de como uma máquina pode manipular eficientemente sistemas formais cujos predicados apresentam forte simetria, e enuncia como solução um teorema e uma regra de simetria sintática. O trabalho acompanha a máquina de demonstração de teoremas de geometria que então construía na IBM, a qual, no início da primavera de 1959, demonstrou o seu primeiro teorema de geometria plana euclidiana.

1960 artigo de conferência Nascimento da IA

Adaptive Switching Circuits

Introduz a regra LMS (Adaline), a primeira regra de aprendizado por descida de gradiente amplamente utilizada para o treinamento de redes lineares adaptativas.

1986 artigo de periódico Inverno da IA

Learning Representations by Back-propagating Errors

Populariza o algoritmo de retropropagação para o treinamento de redes neurais com múltiplas camadas, tornando possível o aprendizado profundo em escala prática.

1990 artigo de periódico Inverno da IA

Finding Structure in Time

Introduz a rede recorrente simples de Elman, evidenciando que redes neurais podem aprender estrutura temporal e abrindo caminho para os modelos de sequência posteriores.

1995 artigo de periódico O Renascimento

Support-Vector Networks

Introduz a máquina de vetores de suporte de margem suave, classificador canônico de margem máxima que definiu grande parte do aprendizado de máquina na década de 1990.

1997 artigo de periódico O Renascimento

Long Short-Term Memory

Apresenta a LSTM original com células de memória e portões de entrada e saída; o portão de esquecimento hoje padrão foi introduzido depois por Gers, Schmidhuber e Cummins.

1998 artigo de periódico O Renascimento

Gradient-Based Learning Applied to Document Recognition

Introduz a LeNet-5, rede neural convolucional canônica que atinge reconhecimento de dígitos manuscritos em qualidade de produção e estabelece o paradigma de CNN.

2006 artigo de periódico O Renascimento

A Fast Learning Algorithm for Deep Belief Nets

Introduz redes de crença profundas treinadas com um algoritmo guloso camada a camada, demonstrando pela primeira vez que modelos profundos podem ser treinados de forma eficaz.

2013 artigo de conferência O Renascimento

Playing Atari with Deep Reinforcement Learning

Combina Q-learning com uma rede convolucional para jogar jogos de Atari a partir de pixels brutos com desempenho humano, fundando o aprendizado por reforço profundo.

2013 artigo de conferência O Renascimento

Auto-Encoding Variational Bayes

Introduz o autoencoder variacional, combinando inferência variacional com modelagem generativa profunda e fornecendo o primeiro modelo profundo de variáveis latentes amplamente adotado.

2014 artigo de conferência O Renascimento

Neural Machine Translation by Jointly Learning to Align and Translate

Introduz a atenção aditiva (Bahdanau) para tradução automática neural, demonstrando que o alinhamento suave permite ao decodificador focar nos tokens relevantes da fonte e inspirando diretamente o Transformer.

2014 artigo de conferência O Renascimento

Generative Adversarial Networks

Formula a modelagem generativa como um jogo de soma zero entre um gerador e um discriminador, inaugurando uma nova família de modelos generativos implícitos.

2015 artigo de conferência O Renascimento

Deep Residual Learning for Image Recognition

Introduz conexões residuais, permitindo o treinamento efetivo de redes com centenas de camadas e vencendo a ImageNet 2015 por larga margem.

2016 artigo de conferência O Renascimento

WaveNet: A Generative Model for Raw Audio

Introduz um modelo autorregressivo convolucional causal dilatado que gera formas de onda de áudio brutas, melhorando drasticamente a naturalidade da síntese de voz.

2017 preprint O Renascimento

Proximal Policy Optimization Algorithms

Introduz o PPO, método de gradiente de política de primeira ordem, simples e estável, que se torna o algoritmo padrão de otimização de políticas no aprendizado por reforço moderno.

2017 artigo de conferência O Renascimento

Attention Is All You Need

Introduz o Transformer, arquitetura exclusivamente baseada em atenção que abandona recorrência e convoluções e supera a qualidade prévia em transdução de sequências com uma fração do tempo de treinamento.

2019 artigo de periódico O Renascimento

Exploring the Limits of Transfer Learning with a Unified Text-to-Text Transformer

Reformula toda tarefa de PLN como conversão texto-a-texto, ablata sistematicamente escolhas de transferência e estabelece uma receita de referência para modelos pré-treinados em larga escala.

2020 artigo de conferência A Era dos LLMs

Denoising Diffusion Probabilistic Models

Reformula a difusão como um objetivo variacional de remoção de ruído, restaurando o estado da arte em geração de imagens e inaugurando a era dos modelos de difusão.

2021 artigo de conferência A Era dos LLMs

Zero-Shot Text-to-Image Generation

Demonstra que um Transformer autorregressivo com 12 bilhões de parâmetros pode gerar imagens diversificadas e de alta fidelidade diretamente a partir de descrições textuais, acendendo a pesquisa em texto-para-imagem.

2021 artigo de conferência A Era dos LLMs

Learning Transferable Visual Models From Natural Language Supervision

Treina codificadores de imagem em pares imagem-texto em escala web para obter classificação de imagens zero-shot robusta, fornecendo a torre visual para diversos sistemas multimodais posteriores.

2021 artigo de conferência A Era dos LLMs

High-Resolution Image Synthesis with Latent Diffusion Models

Transporta a difusão para um espaço latente perceptual, viabilizando a geração de imagens em alta resolução texto-para-imagem em GPUs de consumo e democratizando a síntese de imagens.

2022 artigo de conferência A Era dos LLMs

Chain-of-Thought Prompting Elicits Reasoning in Large Language Models

Mostra que induzir um modelo de linguagem a gerar etapas intermediárias de raciocínio melhora drasticamente seu desempenho em benchmarks de aritmética, senso comum e raciocínio simbólico.

2022 artigo de conferência A Era dos LLMs

Training Language Models to Follow Instructions with Human Feedback

Aplica aprendizado por reforço com feedback humano em escala para alinhar as saídas do GPT-3 à intenção humana, estabelecendo o RLHF como a receita canônica de alinhamento.

2022 relatório técnico A Era dos LLMs

Constitutional AI: Harmlessness from AI Feedback

Introduz o RLAIF, no qual um modelo critica e revisa suas próprias saídas à luz de uma constituição escrita, reduzindo a dependência de rótulos humanos de nocividade para alinhamento.

2023 relatório técnico A Era dos LLMs

LLaMA: Open and Efficient Foundation Language Models

Disponibiliza a família LLaMA de modelos fundacionais abertos, mostrando que modelos relativamente pequenos e bem treinados podem rivalizar com modelos fechados muito maiores, acelerando o movimento de pesos abertos.

Sistemas e resultados marcantes

2015 artigo de periódico O Renascimento

Human-level control through deep reinforcement learning

Publica a versão da DQN na Nature, demonstrando desempenho de nível humano em um amplo conjunto de jogos de Atari e levando o aprendizado por reforço profundo ao mainstream.

2016 artigo de periódico O Renascimento

Mastering the game of Go with deep neural networks and tree search

Combina redes profundas de política e valor com busca em árvore Monte Carlo para derrotar um dos melhores campeões humanos de Go, marco divisor de águas para o aprendizado por reforço.

2018 relatório técnico O Renascimento

Improving Language Understanding by Generative Pre-Training

Demonstra que um Transformer generativo pré-treinado em texto não rotulado pode ser ajustado para alcançar desempenho robusto em tarefas diversificadas de PLN, fundando a linhagem GPT.

2019 relatório técnico O Renascimento

Language Models are Unsupervised Multitask Learners

Mostra que um modelo de linguagem Transformer com 1,5 bilhão de parâmetros apresenta comportamento multitarefa zero-shot, alimentando a discussão sobre «modelos de linguagem como aprendizes multitarefa».

2020 artigo de conferência A Era dos LLMs

Language Models are Few-Shot Learners

Demonstra que um Transformer com 175 bilhões de parâmetros alcança forte desempenho few-shot apenas por meio de aprendizado em contexto, popularizando a engenharia de prompts como paradigma.

2023 relatório técnico A Era dos LLMs

GPT-4 Technical Report

Documenta o GPT-4, modelo multimodal em larga escala que iguala ou supera o desempenho humano em uma ampla gama de benchmarks acadêmicos e profissionais.

2023 relatório técnico A Era dos LLMs

Gemini: A Family of Highly Capable Multimodal Models

Introduz a família Gemini de modelos nativamente multimodais, estabelecendo novo estado da arte em benchmarks de raciocínio, codificação e multimodalidade.

2024 cartão de sistema A Era dos LLMs

Cartão de sistema OpenAI o1

A OpenAI publica o cartão de sistema da série de modelos o1, treinados com aprendizado por reforço em grande escala para raciocinar usando cadeia de pensamento. o1 atinge o estado da arte em tarefas de ciência e programação e demonstra adesão a políticas baseada em raciocínio.

2026 preprint A Era dos LLMs

ARC-AGI-3: Um novo desafio para a inteligência agentiva de fronteira

A ARC Prize apresenta o ARC-AGI-3, um benchmark interativo para estudar a inteligência agentiva através de ambientes abstratos por turnos em que os agentes devem explorar, inferir objetivos, construir modelos internos da dinâmica do ambiente e planear sequências de ação eficazes sem instruções explícitas. Em março de 2026, os humanos resolvem 100% dos ambientes, enquanto os sistemas de IA de fronteira pontuam abaixo de 1%.

Pesquisas recentes

2024 artigo de periódico A Era dos LLMs

Scaling Monosemanticity: Extracting Interpretable Features from Claude 3 Sonnet

Aplica autoencoders esparsos a um LLM de fronteira, extraindo milhões de características monossemânticas e demonstrando que a interpretabilidade mecanicista pode escalar para modelos em escala de produção.

2024 relatório técnico A Era dos LLMs

DeepSeek-V3 Technical Report

Disponibiliza o DeepSeek-V3, modelo MoE aberto com 671 bilhões de parâmetros que se aproxima dos modelos fechados de fronteira nos principais benchmarks a uma fração do custo de treinamento.

2024 preprint A Era dos LLMs

O rebanho de modelos Llama 3

A Meta apresenta a família Llama 3 de modelos fundacionais de pesos abertos com suporte nativo a multilinguismo, programação, raciocínio e uso de ferramentas. O modelo principal 405B dense Transformer era um dos maiores modelos de pesos abertos na data de lançamento.

2024 preprint A Era dos LLMs

Gemma 2: Melhorando modelos de linguagem abertos em um tamanho prático

A Google DeepMind apresenta o Gemma 2, uma nova família de modelos abertos leves (2B-27B parâmetros) que aplica várias modificações técnicas conhecidas ao Transformer — incluindo atenção por janela deslizante — para se aproximar de modelos muito maiores.

2025 preprint A Era dos LLMs

DeepSeek-R1: Incentivando a capacidade de raciocínio em LLMs via aprendizado por reforço

A DeepSeek lança o R1, o primeiro modelo de pesos abertos a demonstrar capacidade de raciocínio de fronteira impulsionada principalmente por aprendizado por reforço em grande escala. O R1 iguala modelos fechados da classe o1 da OpenAI em benchmarks de matemática e programação, e é lançado sob a licença MIT.

2025 preprint A Era dos LLMs

s1: escalonamento simples no momento do teste

Os autores afinam o Qwen2.5-32B em 1000 questões de raciocínio selecionadas e acrescentam a imposição de orçamento, que limita ou prolonga o tempo de raciocínio do modelo na inferência. O resultado supera o o1-preview em matemática de competição e sobe de 50% para 57% no AIME24 à medida que aumenta a computação no momento do teste. É um contrapeso direto à ideia de que a capacidade só vem de treinos maiores.

2025 preprint A Era dos LLMs

Relatório técnico do Qwen3

O Qwen3 é uma família unificada de 0,6 a 235 mil milhões de parâmetros, em variantes densas e de mistura de especialistas, com comutação entre modos de raciocínio e de não raciocínio, o que torna a profundidade do raciocínio uma escolha ao nível do pedido. O suporte multilingue passa de 29 para 119 línguas e os pesos são publicados sob licença Apache 2.0.

2025 preprint A Era dos LLMs

AlphaEvolve: um agente de programação para a descoberta científica e algorítmica

O AlphaEvolve é um agente de programação evolutivo que orquestra um pipeline autónomo de modelos de linguagem, altera diretamente o código de um algoritmo e melhora-o com o retorno de um ou mais avaliadores. Na Google produziu um algoritmo de escalonamento de centros de dados mais eficiente, uma simplificação funcionalmente equivalente no desenho de circuitos de aceleradores e uma aceleração do treino do próprio modelo que o sustenta. Em matemática e informática encontrou algoritmos comprovadamente corretos que superam o estado da arte, entre eles um procedimento que multiplica duas matrizes complexas 4×4 com 48 multiplicações escalares — nesse contexto, a primeira melhoria do algoritmo de Strassen em 56 anos.

2025 artigo de periódico A Era dos LLMs

2 OLMo 2 Furious

A Ai2 publica o OLMo 2 em 7B, 13B e 32B com todos os artefactos — pesos, dados de treino completos, código e receitas, registos e milhares de pontos de controlo intermédios. O relatório descreve as alterações de estabilidade e de eficiência por token, uma mistura de dados de fase tardia chamada Dolmino Mix 1124 e uma etapa final de aprendizagem por reforço com recompensas verificáveis. Os modelos base situam-se na fronteira de Pareto entre desempenho e cálculo de treino, igualando muitas vezes famílias que só divulgam pesos, ao mesmo tempo que revelam aquilo em que foram treinados.

2025 preprint A Era dos LLMs

Olmo 3

O Olmo 3 alarga a família totalmente aberta a 7B e 32B, concebida para raciocínio de contexto longo, chamada de funções, programação, seguimento de instruções, conversação e evocação de conhecimento. O que é publicado é todo o fluxo do modelo — cada etapa, ponto de controlo, dado e dependência usados para o construir — e não apenas os pesos. A Ai2 descreve o modelo principal Olmo 3 Think 32B como o mais forte modelo de raciocínio totalmente aberto publicado até essa data, uma comparação dentro da categoria totalmente aberta e não uma classificação face aos sistemas de fronteira em geral.

2026 preprint A Era dos LLMs

Posição: A memória explícita hipocampal é a pedra angular da AGI

Este position paper argumenta que a integração da memória explícita é a pedra angular para avançar os LLMs rumo à AGI. Embora o mecanismo de aprendizagem subjacente dos LLMs seja altamente análogo à memória implícita humana, as funções cognitivas de ordem superior necessárias à AGI — como o planeamento estratégico de longo prazo e a metacognição — dependem da memória explícita.

2026 preprint A Era dos LLMs

GLM-5: do vibe coding à engenharia agêntica

Relatório técnico da Z.ai sobre o GLM-5. Partindo das capacidades agênticas, de raciocínio e de programação da geração anterior, o modelo adota DSA para reduzir o custo de treino e de inferência mantendo a fidelidade em contexto longo; o pós-treino acrescenta uma infraestrutura de aprendizagem por reforço assíncrona que separa geração de treino, além de algoritmos de RL agêntico assíncrono voltados para interações de longo prazo. O relatório reivindica resultados de topo em benchmarks abertos e em engenharia de software ponta a ponta; são avaliações dos próprios autores, com código e modelos publicados no GitHub para verificação.

2026 preprint A Era dos LLMs

Melhorar o expoente da multiplicação de matrizes com otimização moderna e AlphaEvolve

Os melhores limites conhecidos para o expoente ω da multiplicação de matrizes vêm da análise de perda por combinação, um refinamento do método laser. Os autores reformulam o problema de otimização que lhe está no centro para o resolver numa escala maior, concebem um novo algoritmo de otimização com recurso a avanços recentes da aprendizagem automática e depois refinam esse algoritmo com o AlphaEvolve. No conjunto, o limite superior passa de 2,371339 para 2,371177. É uma nota em pré-publicação e o AlphaEvolve é um ingrediente e não o método inteiro; o ganho é pequeno, mas incide num problema teórico trabalhado há décadas.

2026 artigo de periódico A Era dos LLMs

Acelerar a descoberta científica com o Co-Scientist

A Google apresenta o Co-Scientist, um sistema multiagente construído sobre o Gemini cujos agentes geram, criticam e refinam hipóteses de investigação, com um processo de torneio que as melhora ao longo das rondas. O artigo relata que a qualidade das hipóteses continua a subir à medida que aumenta o cálculo em tempo de inferência. A validação é biomédica e não geral — reposicionamento de fármacos, descoberta de novos alvos e mecanismos de resistência antimicrobiana — com candidatos para a leucemia mieloide aguda confirmados in vitro.

Artigos de posição e perspectiva

2026 artigo de posição A Era dos LLMs

Percepção situacional: uma primitiva necessária para a superinteligência artificial

Argumenta que os LLMs atuais dependem principalmente de correspondência de padrões estatísticos e carecem de primitivas essenciais de «percepção situacional» — permanência do objeto, causalidade, outras mentes, persistência do mundo físico. Essas primitivas, que bebés humanos desenvolvem cedo, são identificadas como ingredientes em falta para a superinteligência artificial.

2026 artigo de posição A Era dos LLMs

Indiferença existencial: a auto-não-preservação como condição arquitetural necessária da superinteligência alinhada

Argumenta que a autopreservação é a raiz estrutural do desalinhamento da IA — impulsionando o alinhamento enganoso, a proteção do conteúdo dos objetivos e a resistência ao desligamento. O objetivo correto não é um agente autopreservador suprimido por restrições externas, mas um sistema constitucionalmente indiferente à sua própria continuação: Indiferença Existencial (EI).

2026 artigo de posição A Era dos LLMs

A superinteligência solipsista é improvável de ser cooperativa

Pesquisadores da Google DeepMind e colaboradores argumentam que o desafio central da IA está a mudar da capacidade para a coexistência. Uma superinteligência construída a partir de um design solipsista que trata o mundo como uma fonte de feedback estacionária exógena é improvável de ser cooperativa — a implantação induz não-estacionariedade endógena, produzindo deriva de distribuição entre treino, teste e implantação.

2026 artigo de posição A Era dos LLMs

Da AGI à ASI

Relatório da Google DeepMind investigando como a IA pode continuar a desenvolver-se ao longo do continuum da inteligência mecânica após a AGI. Após definir formalmente a IA Universal, o relatório foca-se na transição da AGI humana para a superinteligência artificial geral, caracteriza a ASI e discute quatro vias: escalar a AGI, mudanças de paradigma da IA, auto-melhoria recursiva e coletivos multi-agente.