A Iniciativa de Biologia Virtual busca medir respostas celulares em condições nunca estudadas antes, com dados que serão eventualmente públicos. Empresas financiadoras terão acesso inicial aos dados antes da liberação pública, modelo que atrai investimento privado para ciência aberta.
EUA, Meta e Google investem US$ 1,8 bi em IA para revolucionar pesquisa biológica
Precisamos capturar a linguagem da célula. Isso não existe hoje.
Por que agora? Por que essas três organizações — governo, Meta e Google — decidiram investir US$ 1,8 bilhão especificamente nisso?
Porque a IA precisa de dados para funcionar, e dados biológicos de qualidade nunca foram organizados em escala. Cada laboratório tem seus próprios dados, guardados a sete chaves. Ninguém consegue treinar um modelo preditivo robusto com fragmentos.
Mas a Biohub já existia. O que mudou?
O reconhecimento de que isso é possível agora. As técnicas de sequenciamento e mapeamento celular ficaram mais baratas e rápidas. E há pressão real — desenvolvimento de medicamentos leva anos, custa bilhões. Se IA conseguir reduzir isso, vale o investimento.
E quanto ao embargo? As empresas financiadoras têm acesso primeiro?
Sim. Elas trabalham com os dados por um tempo antes de ficarem públicos. É como um acordo: você financia, você colhe o benefício primeiro.
Quanto tempo é esse embargo? A fonte não diz.
Não, não diz. Rives só menciona "períodos de embargo", sem especificar duração.
Então há uma tensão aqui — ciência aberta, mas com vantagem comercial embutida?
Exatamente. É a forma como Biohub atrai dinheiro privado para um projeto que se chama ciência aberta. Sem o embargo, talvez Meta e Google não entrassem.
E o trabalho financiado pelo governo não tem embargo?
Segundo Rives, não. Mas novamente, não sabemos quanto dinheiro é governo versus privado nesse US$ 1,8 bilhão.
Qual é o prazo realista?
Eles dizem cinco anos para modelos preditivos precisos. Um ano para o primeiro conjunto de dados.
Décadas comprimidas em cinco anos. Rives diz que o trabalho "normalmente levaria décadas". Mas isso é uma estimativa dele, não uma métrica verificada.
Le Pouls
- Investimento de US$ 1,8 bilhão do governo americano, Meta e Google na Biohub
- Iniciativa de Biologia Virtual visa comprimir décadas de pesquisa em cinco anos
- Primeiro conjunto de dados previsto para cerca de um ano
- Conjuntos de dados celulares atuais contêm centenas de milhões de células; modelos precisos exigirão bilhões e trilhões
- Empresas financiadoras terão acesso inicial aos dados antes da liberação pública
A Iniciativa de Biologia Virtual busca medir respostas celulares em condições nunca estudadas antes, com dados que serão eventualmente públicos. Empresas financiadoras terão acesso inicial aos dados antes da liberação pública, modelo que atrai investimento privado para ciência aberta.
Governo dos EUA, Meta e Google unem-se à Biohub para criar conjuntos de dados abertos que treinem modelos de IA para pesquisa biológica, visando acelerar o desenvolvimento de medicamentos.
O governo americano, a Meta e o Google anunciaram uma parceria com a Biohub, organização sem fins lucrativos, para construir conjuntos de dados abertos destinados a treinar modelos de inteligência artificial voltados para pesquisa biológica. O investimento de US$ 1,8 bilhão financia a Iniciativa de Biologia Virtual, um projeto ambicioso que pretende medir como as células respondem a condições muito mais variadas do que qualquer estudo científico já realizou até agora.
O objetivo central é usar esses dados para criar modelos preditivos capazes de encurtar drasticamente o tempo de desenvolvimento de medicamentos — um processo que atualmente consome anos de pesquisa. Segundo Alex Rives, chefe de ciência da Biohub, o trabalho normalmente levaria décadas, mas os parceiros pretendem comprimir tudo em cinco anos, com um primeiro conjunto de dados pronto em aproximadamente um ano e modelos preditivos precisos dentro de cinco anos.
A estrutura do acordo reflete uma negociação delicada entre a abertura científica e os incentivos comerciais. Os conjuntos de dados serão eventualmente divulgados ao público, mas as empresas que financiam o projeto terão acesso inicial durante períodos de embargo — um arranjo que permite que os investidores trabalhem com os dados antes de eles se tornarem um recurso científico público. Rives explicou que o trabalho financiado diretamente pelo governo, que ocorre em paralelo, não terá essas restrições. A Biohub também planeja abordar empresas farmacêuticas e organizações filantrópicas para futuras rodadas de financiamento.
O desafio técnico é imenso. Os conjuntos de dados celulares existentes contêm centenas de milhões de células, mas um modelo preditivo verdadeiramente preciso exigirá bilhões e, eventualmente, trilhões de células mapeadas. Os dados virão de técnicas como transcriptômica espacial, que mapeia a atividade molecular dentro de tecidos intactos, e de exames que registram como as células respondem a mudanças no ambiente — grande parte desses dados nunca foi gerada de forma coordenada antes.
Rives enfatizou que o projeto busca capturar algo fundamental: a linguagem da biologia, a linguagem da célula. "Isso não existe hoje", afirmou. A visão é transformar a biologia de uma ciência baseada em descobertas isoladas em uma ciência capaz de fazer previsões sistemáticas sobre como os sistemas biológicos funcionam.
Este movimento não é isolado. A Anthropic intensificou seus esforços em biologia com um laboratório úmido próprio, enquanto a Fundação OpenAI lançou um programa de bolsas de mais de US$ 125 milhões especificamente para financiar conjuntos de dados biológicos e médicos destinados à pesquisa em IA. A corrida para construir a infraestrutura de dados que alimentará a próxima geração de modelos biológicos está em andamento, e o sucesso dessa iniciativa pode redefinir a velocidade com que novos tratamentos chegam aos pacientes.
Citations marquantes
Até agora, a biologia tem sido uma ciência baseada em descobertas inteligentes. Sempre a consideramos um patrimônio da comunidade, não apenas de um grupo.— Chan, em entrevista
Com financiadores comerciais, temos períodos de embargo durante os quais os grupos podem trabalhar com os dados por um período de tempo, e depois eles ficam disponíveis como um recurso científico público.— Alex Rives, chefe de ciência da Biohub