Avalie sistemas de IA antes que respondam ou ajam

Reconheça falhas importantes de IA. Decida se a evidência é suficiente para lançar.

Comece grátis — fundamentos Veja o que você vai aprender

Um produto de IA pode dar uma resposta bem escrita e ainda estar errado, inseguro, inconsistente ou sem apoio; um agente de IA pode tomar a ação errada. Aprenda a identificar a falha, escolher uma verificação relevante, ler resultados conflitantes e explicar por que um lançamento deve avançar ou parar.

Um único curso Lumina organiza um processo repetível de avaliação em oito trilhas: o Full Harness Dirigido por Juízes. A trilha principal não exige programação. CORE é a âncora: primeiro você pratica com casos e decisões de lançamento. As outras sete trilhas aplicam o mesmo método a sistemas e produtos que respondem, recuperam informações, geram conteúdo ou agem. Se quiser implementá-lo, laboratórios opcionais em Python mostram como um juiz — uma verificação com critério explícito — e um harness — o processo repetível que executa essas verificações — funcionam em código.

58lições HTML
57laboratórios executáveis
40+fontes citadas
8trilhas

Hero do curso em revisão final

O Harness Dirigido por Juízes · hero bilíngue do curso

Apresentador fictício gerado por IA

Um método, oito aplicações

Gerar → avaliar → aplicar o gate → repetir

O curso central ensina o método compartilhado. Cada trilha aplicada o usa em um sistema ou produto de IA diferente: que responde, recupera informações, gera conteúdo, toma ações ou apoia uma decisão. Comece pela âncora e depois escolha a aplicação mais próxima do seu trabalho.

gerar avaliar (como código) gate (aprovar ou bloquear) repetir · promover · reter · reverter
Por que vai além de um artigo gratuito

Evidências, não impressões

Três elementos que raramente aparecem juntos em uma formação prática.

◆ pesquisa publicada

Baseado em pesquisa

Cada afirmação remete a pesquisa pública e publicada — OWASP para LLMs e aplicações agênticas, MITRE ATLAS, RAGAS, MT-Bench, DORA, NIST AI 600-1 e C2PA — sempre com atribuição, nunca como opinião sem base.

▶ executável

57 laboratórios determinísticos

As 58 aulas são acompanhadas por 57 laboratórios em Python que funcionam sem internet, usam apenas a biblioteca padrão e produzem a mesma saída em toda execução. Não são apenas slides: você executa o código e depois o adapta ao seu próprio sistema.

✓ honesto

O que existe e o que está planejado

Toda métrica de laboratório — um resultado numérico de um exemplo sintético e ilustrativo — é identificada. Você aprende a medir o próprio sistema; nunca afirmamos que o nosso "atinge X%".

As oito trilhas

O método, aplicado ao seu domínio

Comece pela âncora do Harness e acrescente a trilha de aplicação mais próxima do seu trabalho, ou faça o Harness completo.

BASE · o método

Harness Dirigido por Juízes

A base independente de domínio: descubra falhas, escreva juízes como código, valide-os com um conjunto rotulado compacto, aplique um gate, repita, calibre e integre à CI.

fundamentos grátis + 9 módulos · 8 laboratórios
EVAL · avaliação

Lançar Aplicações com LLM e Evidências

Comece por registros de execução (OpenTelemetry): inspecione fontes recuperadas e respostas com a tríade de RAG, mantenha um conjunto de referência e use verificações reproduzíveis na integração contínua. A fronteira de Pareto torna visível a troca entre custo e qualidade, em vez de escondê-la em uma nota.

7 módulos · 7 laboratórios
AGENT · codificação agêntica

Harness de Codificação Agêntica

Claude Code em produção: AGENTS.md como contrato, subagentes especializados, robustez, determinismo, testes adversariais dos próprios agentes e revisão dirigida por juízes. O foco é governança, não uma lista de recursos.

7 módulos · 7 laboratórios
SEC · segurança

Segurança de Aplicações com LLM

Transforme riscos de injeção de instruções em testes adversariais repetíveis e depois em regras de detecção para um SIEM: o sistema que centraliza logs e emite alertas. OWASP e MITRE ATLAS fornecem o vocabulário público de riscos.

6 módulos · 6 laboratórios
DOG · dogfooding

Dogfooding

Valide seu próprio produto: execute-o como avaliação, separe dimensões de qualidade, calibre os gates, mantenha um banco vivo de perguntas e integre o dogfooding à CI. Lance com evidências, não porque algo "parece bom".

7 módulos · 7 laboratórios
SIM · usuários sintéticos

Usuários Sintéticos e Personas

Simulação de usuário sintético dirigida por objetivo (NPC é um usuário simulado com uma meta), exploração em vários turnos e uma fronteira de validade explícita entre alcance e repetição: personas ampliam o espaço de comportamentos, mas não substituem a calibração com usuários reais.

8 módulos · 8 laboratórios
DATA · a camada de dados

Ciclo de Dados (Data Flywheel)

Construa um banco de avaliação a partir de falhas reais: cubra casos importantes, remova duplicatas, versione o conjunto e mantenha regressões. A concordância κ verifica se pessoas revisoras independentes rotulam o mesmo caso de forma parecida.

7 módulos · 7 laboratórios
COST · a camada de eficiência

Harness de Custo e Latência

Torne visível a troca entre qualidade, custo e latência. Compare percentis de latência em vez de apenas médias, encaminhe solicitações simples de forma econômica e use uma fronteira de Pareto para mostrar quais opções entre custo e qualidade são de fato diferentes.

7 módulos · 7 laboratórios
Prévia pública autônoma

Comece por uma ação delimitada de agente

Este curso fica fora da oferta das oito trilhas do Harness. A prévia pública abre o mapa do curso e GOV.1; as inscrições e o checkout ainda não estão disponíveis.

GOV · prévia pública

Governando ações de agentes

Transforme uma ação de agente com ferramenta em uma decisão revisável: papel, recurso, escopo, confirmação, evidência e retorno explícito.

6 módulos · 6 laboratórios · GOV.1 aberto para leitura
Conhecer o curso
Ofertas em pré-lançamento · estudo individual

Conheça o escopo e o preço de cada oferta de curso.

Os preços abaixo descrevem três ofertas planejadas: o método âncora, o programa completo e um pacote futuro que une âncora e trilha. As ofertas são localizadas em reais no Brasil e dólares no exterior. As inscrições permanecem indisponíveis até que a jornada de pagamento e entrega na Hotmart passe pelo preflight.

Método central
A base sobre a qual todas as trilhas são construídas.
R$750
Lançamento: R$600
  • Fundamentos grátis + 9 módulos centrais
  • 8 laboratórios executáveis
  • O método completo gerar→avaliar→gate→repetir
  • 12 meses de atualizações do pacote
Após o lançamento inicial
Método + uma trilha
O método central e uma trilha voltada ao seu domínio.
R$1.500
Oferta planejada: R$1.200
  • Método central + uma trilha completa, ou a combinação Validação: dogfooding e usuários sintéticos
  • Todos os laboratórios e resumos de pesquisa da trilha; a combinação Programação inclui a integração com o AI Coding OS
  • Escolha entre segurança, avaliação, codificação agêntica, dogfooding, usuários sintéticos, dados ou custo
  • Fundamentos gratuitos incluídos · 12 meses de atualizações do pacote
Reembolso em até 15 diasSolicite o reembolso pela Hotmart em até 15 dias após a compra, conforme as regras exibidas no checkout.
Licença pessoal permanenteLicença pessoal permanente para a versão baixada, com atualizações do pacote por 12 meses após a compra.
Download e uso sem conexãoZIP bilíngue para download na biblioteca Hotmart após a confirmação do pagamento; aulas e laboratórios podem ser usados sem conexão.
Suporte à primeira execuçãoSuporte por e-mail para acesso, download e problemas reproduzíveis na primeira execução.

A duração de estudo ainda não é publicada como promessa. Só informaremos uma faixa depois de observar sessões com iniciantes, em vez de adivinhar pelo ritmo de quem escreveu.

Esta rota mostra a oferta brasileira em reais. O total exibido no checkout é o valor vinculante; tributos e custos do meio de pagamento podem alterar o total antes da confirmação. A aula de fundamentos do Nível 0 permanece grátis.
O pack AI Coding OS → é um kit complementar separado, com 18 skills prontas para instalar — não é um sexto curso nem uma nona trilha do Harness.

Sobre as ofertas

Respostas diretas

Isso vai além de uma página gratuita da OWASP ou de um artigo?
Sim. Materiais gratuitos costumam apresentar os riscos; aqui você constrói o harness que os detecta em escala. A formação combina testes adversariais repetíveis, detecção como código, gates dirigidos por juízes, laboratórios executáveis e fontes públicas. O diferencial é aplicar o método em código, não apenas consultar uma lista.
Os laboratórios são reais ou apenas exemplos simplificados?
São 57 laboratórios executáveis em Python, determinísticos, sem internet e baseados apenas na biblioteca padrão. Os números são deliberadamente ilustrativos: você aprende o padrão, conecta o ponto de extensão ao seu modelo e mede o próprio sistema.
Isso é atual para 2026?
O conteúdo acompanha a fronteira de 2026: OWASP LLM (2025) e Agentic (2026) Top 10, convenções atuais de GenAI no OpenTelemetry, achados de viés de juiz do MT-Bench, NIST AI 600-1, C2PA, SynthID e o cronograma do Artigo 50 do EU AI Act. O status das ferramentas, como o acordo anunciado pela OpenAI para adquirir a Promptfoo, é sinalizado com alternativas de código aberto.
Claude Code já não é ensinado grátis pela Anthropic?
Os cursos gratuitos apresentam recursos como subagentes, MCP, skills e hooks. A trilha Codificação Agêntica trata do que vem depois: governança, robustez, testes adversariais e gates de qualidade para usar o Claude Code em produção. Ela inclui laboratórios executáveis com juízes e um projeto inicial reutilizável; é uma formação voltada à produção, não uma lista de recursos.
A oferta é individual. Existe uma versão para equipes?
Hoje todas as opções são destinadas ao estudo individual e o preço considera esse formato. Uma modalidade para organizações, com acompanhamento de progresso e licenças por usuário, permanece apenas no planejamento e não faz parte da oferta atual.
Como eu recebo, e funciona offline?
Após a confirmação do pagamento, a biblioteca da Hotmart entrega um arquivo .zip com um index.html de entrada. Abra-o no navegador, leia em qualquer dispositivo e execute os laboratórios em um computador. O curso em si não se conecta a serviços externos; as atualizações do pacote permanecem disponíveis por 12 meses.
A compra inclui certificado ou suporte ao vivo?
Não. O lançamento é para estudo individual: não inclui certificado, crédito acadêmico, tutoria ao vivo, consultoria estatística nem consultoria de implementação. O suporte por e-mail cobre acesso, download e problemas reproduzíveis na primeira execução.
Quais formas de pagamento e parcelamento estão disponíveis?
A Hotmart pode oferecer Pix, boleto e cartão conforme a pessoa compradora e sua localização. As formas de pagamento, parcelas, tributos, conversão e o total final exibidos no checkout são vinculantes.