O processo de usar um modelo de IA já treinado para gerar uma resposta a partir de uma entrada. É o que acontece toda vez que uma mensagem é enviada ao Claude ou a qualquer LLM — diferente do treinamento, que é a fase em que o modelo aprende a partir de grandes volumes de dados. A inferência consome poder computacional (GPUs) e tempo; otimizá-la é uma das principais frentes de pesquisa em IA aplicada.
Inteligência ArtificialIntermediário
Inferência
Inference
O processo de usar um modelo de IA já treinado para gerar uma resposta a partir de uma entrada — diferente do treinamento, que é quando o modelo aprende.
Veja também
- LLMRelacionado
Um modelo de inteligência artificial treinado em enormes quantidades de texto, capaz de gerar e entender linguagem natural.
- TokenRelacionado
A menor unidade de texto que um modelo de linguagem processa — pode ser uma palavra, parte de uma palavra ou um caractere de pontuação.
- Fine-tuningRelacionado
Processo de re-treinar um modelo de IA já existente com dados específicos, para especializá-lo em uma tarefa ou domínio.