Formação completa para estudo individual

Lance sistemas com LLM com autonomia. Transforme a revisão em um harness de juízes.

Chamar um LLM é a parte comum. O desafio é transformar um gerador instável em um sistema que possa ser lançado com evidências. Esta linha de cursos ensina a codificar as verificações de qualidade, segurança e prontidão que uma pessoa não conseguiria executar manualmente em toda saída.

A tese: modelos de linguagem podem ser substituídos; o sistema de avaliação que você constrói ao redor deles é o ativo duradouro. Você define o padrão, e o harness o aplica a milhares de saídas, com uma cobertura de revisão e qualidade impossível de executar manualmente. O modelo muda; seus critérios permanecem.

Explore as opções Comece grátis — fundamentos
58lições HTML
57laboratórios executáveis
40+fontes citadas
8trilhas

Hero do curso em revisão final

O Harness Dirigido por Juízes · hero bilíngue do curso

Apresentador fictício gerado por IA

Um método, oito aplicações

Gerar → avaliar → aplicar o gate → repetir

Todas as trilhas aplicam a mesma estrutura a um domínio diferente. Aprenda o método no curso central e depois use-o para proteger uma aplicação, decidir se uma versão pode ser entregue, governar agentes de código ou desenvolver um conjunto de avaliação que melhora com novas falhas.

gerar avaliar (como código) gate (aprovar ou bloquear) repetir · promover · reter · reverter
Por que vai além de um artigo gratuito

Evidências, não impressões

Três elementos que raramente aparecem juntos em uma formação prática.

◆ pesquisa publicada

Baseado em pesquisa

Cada afirmação remete a pesquisa pública e publicada — OWASP para LLMs e aplicações agênticas, MITRE ATLAS, RAGAS, MT-Bench, DORA, NIST AI 600-1 e C2PA — sempre com atribuição, nunca como opinião sem base.

▶ executável

57 laboratórios determinísticos

As 58 aulas são acompanhadas por 57 laboratórios em Python que funcionam sem internet, usam apenas a biblioteca padrão e produzem a mesma saída em toda execução. Não são apenas slides: você executa o código e depois o adapta ao seu próprio sistema.

✓ honesto

O que existe e o que está planejado

Toda métrica é identificada como ilustrativa. Você aprende a medir o próprio sistema; nunca usamos afirmações como "nosso sistema atinge X%" sem evidência pública. A distinção entre o que já existe e o que ainda está planejado é explícita.

As oito trilhas

O método, aplicado ao seu domínio

Comece pelo curso central. Acrescente a trilha mais próxima do seu trabalho ou faça o programa completo.

BASE · o método

Harness Dirigido por Juízes

A base independente de domínio: descubra falhas, escreva juízes como código, valide-os com um conjunto rotulado compacto, aplique um gate, repita, calibre e integre à CI.

fundamentos grátis + 9 módulos · 8 laboratórios
EVAL · avaliação

Lançar Aplicações com LLM e Evidências

Registros de execução com OpenTelemetry, conjuntos de referência, tríade de RAG sem resposta esperada, nota de prontidão, fronteira de Pareto, gates reproduzíveis e ciclo de produção.

7 módulos · 7 laboratórios
AGENT · codificação agêntica

Harness de Codificação Agêntica

Claude Code em produção: AGENTS.md como contrato, subagentes especializados, robustez, determinismo, testes adversariais dos próprios agentes e revisão dirigida por juízes. O foco é governança, não uma lista de recursos.

7 módulos · 7 laboratórios
SEC · segurança

Segurança de Aplicações com LLM

OWASP para LLMs e aplicações com agentes, MITRE ATLAS, taxonomia de injeção de instruções, testes adversariais repetíveis, detecção como código integrada ao SIEM e evidências de conformidade.

6 módulos · 6 laboratórios
DOG · dogfooding

Dogfooding

Valide seu próprio produto: execute-o como avaliação, separe dimensões de qualidade, calibre os gates, mantenha um banco vivo de perguntas e integre o dogfooding à CI. Lance com evidências, não porque algo "parece bom".

7 módulos · 7 laboratórios
SIM · usuários sintéticos

Usuários Sintéticos e Personas

Simulação de NPC dirigida por objetivo, exploração em vários turnos e uma fronteira de validade explícita entre alcance e repetição: personas ampliam o espaço de teste, mas não substituem a calibração com usuários reais.

8 módulos · 8 laboratórios
DATA · a camada de dados

Flywheel de Dados

O conjunto de avaliação é o ativo, não o modelo: crie um banco inicial, amplie-o com falhas reais, estratifique a cobertura, remova duplicatas, calibre os rótulos com concordância κ, versione o banco e detecte regressões.

7 módulos · 7 laboratórios
COST · a camada de eficiência

Harness de Custo e Latência

Qualidade tem custo: gate de três eixos, percentis de latência em vez de médias, fronteira de Pareto entre custo e qualidade, encaminhamento de solicitações simples para modelos mais econômicos, cache semântico e orçamentos que bloqueiam regressões na integração contínua.

7 módulos · 7 laboratórios
Opções de lançamento · estudo individual

Escolha o escopo adequado ao seu trabalho.

Método central, combinação temática ou programa completo. Consulte o conteúdo de cada opção; os preços finais e links de compra serão exibidos somente após a aprovação do lançamento.

Método central
A base sobre a qual todas as trilhas são construídas.
No lançamento
Preço aguardando aprovação final
  • Fundamentos grátis + 9 módulos centrais
  • 8 laboratórios executáveis
  • O método completo gerar→avaliar→gate→repetir
  • Atualizações grátis
Método + uma trilha
O método central e uma trilha voltada ao seu domínio.
No lançamento
Preço aguardando aprovação final
  • Método central + uma trilha completa, ou a combinação Validação: dogfooding e usuários sintéticos
  • Todos os laboratórios e resumos de pesquisa da trilha; a combinação Programação inclui a integração com o AI Coding OS
  • Escolha entre segurança, avaliação, codificação agêntica, dogfooding, usuários sintéticos, dados ou custo
  • Fundamentos gratuitos incluídos · atualizações grátis

Novo aqui? A aula de fundamentos do Nível 0 é grátis; leia enquanto finalizamos os detalhes do lançamento.
Procura ferramentas prontas, e não a formação? Combine uma trilha com o AI Coding OS →, com 18 recursos prontos para instalar.

Antes de comprar

Respostas diretas

Isso vai além de uma página gratuita da OWASP ou de um artigo?
Sim. Materiais gratuitos costumam apresentar os riscos; aqui você constrói o harness que os detecta em escala. A formação combina testes adversariais repetíveis, detecção como código, gates dirigidos por juízes, laboratórios executáveis e fontes públicas. O diferencial é aplicar o método em código, não apenas consultar uma lista.
Os laboratórios são reais ou apenas exemplos simplificados?
São 57 laboratórios executáveis em Python, determinísticos, sem internet e baseados apenas na biblioteca padrão. Os números são deliberadamente ilustrativos: você aprende o padrão, conecta o ponto de extensão ao seu modelo e mede o próprio sistema.
Isso é atual para 2026?
O conteúdo acompanha a fronteira de 2026: OWASP LLM (2025) e Agentic (2026) Top 10, convenções atuais de GenAI no OpenTelemetry, achados de viés de juiz do MT-Bench, NIST AI 600-1, C2PA, SynthID e o cronograma do Artigo 50 do EU AI Act. O status das ferramentas, como o acordo anunciado pela OpenAI para adquirir a Promptfoo, é sinalizado com alternativas de código aberto.
Claude Code já não é ensinado grátis pela Anthropic?
Os cursos gratuitos apresentam recursos como subagentes, MCP, skills e hooks. A trilha Codificação Agêntica trata do que vem depois: governança, robustez, testes adversariais e gates de qualidade para usar o Claude Code em produção. Ela inclui laboratórios executáveis com juízes e um projeto inicial reutilizável; é uma formação voltada à produção, não uma lista de recursos.
A oferta é individual. Existe uma versão para equipes?
Hoje todas as opções são destinadas ao estudo individual e o preço considera esse formato. Uma modalidade para organizações, com acompanhamento de progresso e licenças por usuário, permanece apenas no planejamento e não faz parte da oferta atual.
Como eu recebo, e funciona offline?
Você recebe um arquivo .zip com um index.html de entrada. Abra-o no navegador, leia em qualquer dispositivo e execute os laboratórios em um computador. Não é preciso criar conta, e o conteúdo não depende de serviços externos. As atualizações ficam disponíveis na biblioteca da loja.