Seminário técnico de segurança da IA
As capacidades da IA avançam mais rápido do que a segurança. Seis semanas sobre como fechar essa lacuna: treinar modelos mais seguros, avaliá-los, olhar dentro deles e limitar o dano quando falham. Para quem tem base técnica.
De 12 de outubro a 22 de novembro de 2026. Vagas limitadas: inscreva-se até 9 de outubro.
Seis semanas
De 12 de outubro a 22 de novembro de 2026, uma sessão de duas horas por semana mais uma hora de material por conta própria
Misto: presencial e on-line
Sessões na Universidad de los Andes, com comida grátis, e sessões on-line
Grátis, com certificado
Materiais da BlueDot Impact; discussão em espanhol, leituras em inglês
As capacidades avançam mais rápido que a segurança
As capacidades da IA avançam mais rápido que a segurança, e o campo precisa de mais gente técnica trabalhando nisso. Os problemas continuam em aberto: ainda não sabemos medir com confiança o que um modelo pode e quer fazer, nem entender o que ele calcula por dentro, nem garantir que um sistema capaz não cause dano se algo falhar.
O Seminário técnico de segurança da IA é um percurso por esses problemas e pelos métodos com que hoje se tenta resolvê-los: RLHF, avaliações, interpretabilidade mecanicista e AI control. As leituras são as criadas pela BlueDot Impact; a AI Safety Colombia conduz esta turma por conta própria, com facilitadores da comunidade.
Prefere fazê-lo on-line e em inglês? Inscreva-se diretamente na BlueDot.
Para quem já entende como um modelo é treinado e quer trabalhar para torná-lo seguro
Basta entender o básico de como um LLM é treinado; se ainda não entende, o curso AI Foundations da BlueDot, de duas horas, dá essa base. O seminário foi pensado para:
Pesquisa em ML
Você faz pesquisa em machine learning e quer apontá-la para alinhamento, avaliações ou interpretabilidade.
Engenharia de software
Você constrói sistemas com modelos e quer passar a trabalhar na segurança dos modelos que usa.
Matemática e ciência da computação
Você tem a base formal e quer ver quais problemas do campo precisam dela.
Estudantes que já levam a sério
Você está pensando em fellowships como MATS, SPAR ou ARENA, ou numa pós-graduação, e quer chegar com critério.
Não é uma introdução à IA. Pressupõe que você já sabe como um modelo funciona e quer a segurança que vai por baixo.
Se prefere começar pelo panorama estratégico, veja o Seminário de futuro e riscos da IA.
Uma turma pequena que discute toda semana
Toda semana começa com uma hora de material leve (vídeos e podcasts) e segue com uma sessão de duas horas com a turma: leitura aprofundada e discussão. São cerca de três horas por semana, em um horário definido com os participantes selecionados. Todas as leituras e vídeos são em inglês, como a BlueDot os publica; a discussão é em espanhol. A modalidade é mista: há sessões presenciais na Universidad de los Andes e sessões on-line, e cabe junto com o trabalho ou a faculdade. Nas sessões presenciais tem comida grátis.
Os facilitadores são Helen Stefany Penagos (Mastercard) e Andrés Mosquera (Universidad de los Andes). A discussão é onde os pressupostos são postos à prova e onde as leituras se conectam com o trabalho feito em laboratórios e organizações de pesquisa, e a turma fica como uma comunidade de pares com quem seguir explorando o campo depois do seminário.
Seis semanas, do problema de fundo ao seu próximo passo
Toda semana: uma hora de material leve e uma sessão de duas horas, de leitura aprofundada e de discussão. As sessões se alternam: a primeira semana é presencial, a segunda on-line, e assim até o fim. O horário das sessões é definido de acordo com a disponibilidade dos participantes selecionados.
- Semana 1Presencial
O que é preciso para a IA dar certo
Por que os modelos atuais não são seguros por padrão e quais abordagens técnicas existem para mudar isso.
- Semana 2On-line
Treinar modelos mais seguros
Como funciona o RLHF, que outros métodos se usam para ajustar um modelo e em que casos não bastam.
- Semana 3Presencial
Avaliações
Como se mede o que um modelo é capaz de fazer e como se procura saber se ele está escondendo algo.
- Semana 4On-line
Interpretabilidade mecanicista
As técnicas para ver o que uma rede neural calcula por dentro e até onde chegam hoje.
- Semana 5Presencial
Minimizar o dano
Como se limita o que um modelo pode fazer mesmo que esteja desalinhado, com AI control e classificadores constitucionais.
- Semana 6On-line
Como começar a contribuir
Quais problemas em aberto combinam com o que você já sabe fazer e como dar o primeiro passo.
Um mapa técnico, critério e um próximo passo
Um mapa das abordagens técnicas da segurança e de qual problema cada uma ataca.
Critério para ler um paper do campo: o que uma avaliação mede, o que um resultado de interpretabilidade mostra e o que não mostra.
Clareza sobre onde suas habilidades se encaixam e qual é seu próximo passo: um hackathon, um fellowship ou um projeto próprio.
Uma turma de pessoas técnicas na Colômbia, e um certificado da AI Safety Colombia.
As inscrições foram encerradas
As inscrições desta turma foram encerradas na sexta-feira, 9 de outubro.
Perguntas frequentes
Quanta formação técnica eu preciso?
Você deve entender o básico de como os LLMs são treinados e ajustados, que o progresso da IA é movido por dados, algoritmos e computação, e que uma rede neural é otimizada com descida de gradiente. O curso AI Foundations da BlueDot, de duas horas e no seu ritmo, dá essa base.
Preciso fazer o Seminário de futuro e riscos da IA antes?
Não é obrigatório, mas ajuda: o Seminário de futuro e riscos da IA dá o contexto sobre o qual este seminário se constrói. Se você se inscrever neste e não for aceito, no formulário pode pedir para ser considerado para o Seminário de futuro e riscos da IA.
Há seleção ou entra todo mundo que se inscreve?
Há seleção: as vagas são limitadas. Lemos cada inscrição e escolhemos pelo que você escrever e pelo encaixe com o perfil que esta página descreve. Avisamos a todos, aprovados ou não, antes de a turma começar.
Em que horário são as sessões?
O horário é definido com os participantes selecionados: antes de começar perguntamos quais faixas funcionam para eles e fixamos a que melhor atende à turma.
Em que idioma é?
As discussões são em espanhol. Todas as leituras, vídeos e podcasts são em inglês, como a BlueDot Impact os publica, então é preciso ler inglês com conforto.
O que preciso para receber o certificado?
Participar das sessões de discussão: você pode faltar a uma, no máximo. É a mesma regra que a BlueDot Impact usa em suas turmas. O certificado é emitido pela AI Safety Colombia pela conclusão do seminário, baseado no currículo da BlueDot Impact.
Qual a relação com a BlueDot Impact?
A BlueDot Impact criou o programa e publica seus materiais. A AI Safety Colombia conduz esta turma por conta própria, com esses materiais e com facilitadores da comunidade.
