Três lições dos nossos projetos de IA
Ao longo de dois anos, acompanhámos dezenas de projetos de IA, desde a exploração inicial até um modelo que é executado todas as noites. Alguns…
Para evitar este cenário, é importante identificar quais das milhares de mutações podem realmente representar um grande perigo, para que o desenvolvimento de vacinas possa responder o mais rapidamente possível. A inteligência artificial (IA) pode ajudar. Investigadores do MIT desenvolveram uma nova forma de modelar ‘viral escapes’ com base em modelos originalmente criados para analisar a linguagem: os conhecidos modelos de Natural Language Processing (NLP).
A ideia de usar um modelo de NLP neste caso é a seguinte: os vírus sofrem mutações que respeitam as regras biológicas da estrutura das proteínas, mas que também lhes são o mais favoráveis possível. Por exemplo, o SARS-CoV-2 sofre mutações na proteína spike, visível na imagem abaixo. Atualmente, as pessoas que tiveram recentemente COVID-19 ou foram vacinadas têm anticorpos que se ligam à proteína spike. Por isso, as células do vírus SARS-CoV-2 deixam de conseguir estabelecer contacto com as células humanas, e uma pessoa fica infetada. O objetivo do vírus é, então, voltar a sofrer rapidamente mutações nas proteínas spike, para que os anticorpos deixem de se ligar a elas, mas os recetores das células humanas ainda o consigam fazer. O vírus procura, assim, sofrer mutações que lhe permitam escapar ao sistema imunitário humano (aos anticorpos), sem morrer nem perder a capacidade de se multiplicar. Da mesma forma, para um modelo de NLP, uma frase não só tem de ter o significado certo (semântica), como também tem de estar gramaticalmente correta (sintaxe). Usando estes dois princípios, os investigadores adaptaram de forma criativa modelos de NLP para detetar alterações no código genético dos vírus.
O exemplo abaixo ilustra como o modelo de NLP estima que mutações do vírus podem provocar viral escape. A primeira frase representa o vírus antes de sofrer uma mutação. A segunda frase (a contar da esquerda) mostra uma pequena mutação. O significado da frase quase não mudou e a frase está gramaticalmente correta. Com esta mutação, o novo vírus ainda se assemelha o suficiente ao original para que o sistema imunitário o reconheça e ataque. Não são necessários novos anticorpos. A terceira frase está gramaticalmente incorreta. Na linguagem do vírus, esta mutação seria considerada falhada. A última frase é onde reside o perigo. Está gramaticalmente correta e tem uma semântica adequada. Estas são as exceções que, segundo o modelo de NLP, podem provocar viral escape. Os investigadores chamam à procura destas exceções 'constrained semantic change search' (CSCS).
Naturalmente, o modelo NLP não foi treinado com frases, mas com os elementos constituintes de diferentes proteínas spike de coronavírus: as chamadas sequências de aminoácidos. O conjunto de treino continha pouco menos de 1000 sequências da proteína spike do SARS-CoV-2 e mais 3000 sequências de aminoácidos de proteínas spike de outros tipos de coronavírus. A imagem abaixo mostra o modelo NLP. Internamente, o modelo constrói uma representação semântica, também chamada “embedding”, para uma determinada sequência de aminoácidos. O resultado do modelo mostra até que ponto um aminoácido se enquadra na “gramática” da sequência. Na imagem, o aminoácido que melhor se enquadra gramaticalmente na sequência está assinalado com a letra maiúscula A.
Das 891 sequências diferentes de aminoácidos de proteínas spike de coronavírus que os investigadores analisaram com o modelo, uma provinha de uma estirpe que reinfetou uma pessoa recuperada da Covid-19 no ano anterior. Por isso, esta sequência recebeu rapidamente uma pontuação elevada segundo a CSCS. Em todo o conjunto, foram encontradas apenas outras três sequências que apresentavam simultaneamente uma maior alteração semântica e uma maior «gramaticalidade». Os investigadores também introduziram algumas das novas variantes no algoritmo e verificaram que tanto a estirpe sul-africana como a britânica obtiveram pontuações "bastante elevadas" quanto à probabilidade de evasão.
E agora? Se as novas mutações forem acompanhadas de perto e o algoritmo for utilizado para avaliar o perigo que representam, os investigadores poderão testar as estirpes suspeitas em laboratório o mais rapidamente possível e adaptar as vacinas em conformidade. O teste funciona da seguinte forma. As estirpes suspeitas são colocadas em contacto com anticorpos. Se os anticorpos não se ligarem às proteínas spike, os anticorpos atuais deixam de oferecer proteção. Ainda não se sabe quanto tempo os responsáveis pelo desenvolvimento das vacinas poderão efetivamente poupar com uma abordagem baseada em IA como esta. O que sabemos é que, numa pandemia desta dimensão, cada segundo conta.
Ao longo de dois anos, acompanhámos dezenas de projetos de IA, desde a exploração inicial até um modelo que é executado todas as noites. Alguns…
Muitas organizações já realizaram um projeto-piloto de IA. O modelo funciona, a demonstração é aplaudida e depois não acontece mais nada. Pela nossa…
A inteligência artificial está a evoluir rapidamente. Surgem novos modelos quase todas as semanas, e cada vez mais organizações experimentam a IA. Ao…
Quer ser a primeira pessoa a saber quando publicamos um novo artigo no blogue?
Obrigado pela sua inscrição!