§ Fundamentos
AI Safety
Também conhecido como: segurança em IA · alinhamento
AI Safety é o campo da investigação focado em garantir que sistemas de IA, à medida que ganham capacidade, permanecem alinhados com objetivos humanos benéficos. Subáreas: alinhamento (alignment), interpretabilidade (perceber porquê o modelo decidiu X), robustez adversarial, jailbreaks, riscos catastróficos. Líderes: Anthropic, OpenAI, DeepMind, MIRI, ARC. Em 2026 é uma exigência regulatória do EU AI Act para sistemas de «alto risco».
Termos relacionados
Aprender AI Safety na prática
O Instituto Português de IA ensina este e outros temas em formações estruturadas com projetos. Começa pelo curso gratuito (48 aulas).