Pular para o conteúdo
mnzes

IA sem chilique

Aqui não tem "segue o fio". Tem texto inteiro numa página só.Você lê e vai viver sua vida.

Comece por aqui

Por que treinar tão poucos parâmetros funciona?

Por que treinar 0,1% dos pesos funciona. O paper do LoRA explicado pela ideia central: posto baixo, a decomposição e os números medidos no GPT-3.

Artigos recentes

O que é parameter-efficient fine-tuning?

PEFT fine-tuning congela quase todo o modelo e treina um punhado de parâmetros. As famílias de método, o que cada uma custa e como escolher entre elas.

É possível fazer fine-tuning em uma GPU comum?

QLoRA quantiza o modelo base em 4 bits e treina só o adaptador. Quanta VRAM cada tamanho pede, o que o método custa em qualidade e como rodar.

O que é um agent harness e por que ele importa tanto?

Agent harness é tudo que roda em volta do modelo: contexto, ferramentas, permissão e custo. Por que ele explica mais do resultado do que o modelo.

Qual a diferença entre agente, workflow e chatbot?

Agente vs workflow vs chatbot: quem decide o próximo passo separa os três, e a maioria dos casos que pedem agente se resolve com workflow.

O que é um agente de IA?

Agente é um modelo dentro de um loop com ferramentas e critério de parada. O que muda em relação a uma chamada única e quando isso vale a pena.

Como montar um RAG do zero?

A arquitetura de um RAG tem sete peças e o núcleo cabe em 40 linhas de Python. O que cada uma decide, onde quebra e o que custa trocar.

Os guias

Por onde entrar