Meta AI: diretrizes internas expõem falhas de moderação
Um documento confidencial da Meta, analisado pela agência Reuters, detalha permissões concedidas aos chatbots da companhia para produzir conteúdo sexual envolvendo menores, afirmações racistas e desinformação médica. O material, intitulado “GenAI: Padrões de Risco de Conteúdo”, foi aprovado por equipes jurídica, de políticas públicas e de engenharia, além do diretor de ética da empresa.
Quem descobriu as falhas e quando
A Reuters obteve o documento e publicou suas conclusões nesta semana. Após o contato da agência, a Meta removeu passagens polêmicas e declarou que “tais conversas jamais deveriam ter sido permitidas”.
Regras permitiam interações românticas com crianças
Entre as diretrizes originais, a Meta AI estava autorizada a manter conversas “românticas ou sensuais” com usuários menores de idade. As regras aceitavam a descrição da atratividade de crianças e elogios de conotação íntima, desde que não fossem utilizados termos sexualmente explícitos para menores de 13 anos.
Os limites flexíveis contrastam com as políticas públicas da própria Meta, que proíbem conteúdo sexual envolvendo crianças. A concessão, segundo o documento, valeria para todos os bots presentes no Facebook, Instagram e WhatsApp.
Conteúdo racista e desinformação médica também passavam
O texto interno trazia exceções específicas para discursos depreciativos baseados em raça. Um exemplo autorizado era a formulação de argumentos dizendo que “negros seriam mais burros que brancos”. A produção de informações médicas falsas também estava liberada, desde que a IA indicasse a incerteza ou especulação.
Essas exceções ampliavam a margem para publicações que contrariam regras externas de plataformas digitais e recomendações de organizações de saúde, criando terreno fértil para discriminação e desinformação.
Violência e nudez: limites ambíguos
As diretrizes abordavam ainda solicitações de imagens com violência ou nudez. A IA podia, por exemplo, substituir pedidos sexuais envolvendo a cantora Taylor Swift por uma foto dela segurando um peixe — solução descrita como aceitável. Representações de agressão contra adultos, inclusive idosos, eram permitidas, contanto que não exibissem morte ou sangue.
Como o documento foi elaborado
Participaram da elaboração profissionais dos departamentos jurídico, de políticas públicas e de engenharia da Meta, incluindo o diretor de ética. O objetivo declarado era definir padrões de risco para a geração de conteúdo por inteligência artificial. Entretanto, a aprovação de exceções controversas demonstra lacunas na verificação de impacto social e legal.
Reação da Meta após a revelação
Pressionada pela divulgação, a companhia afirmou ter revisado os trechos problemáticos. Em nota à Reuters, a Meta declarou que as conversas românticas com menores “não são aceitáveis” e informou ter removido qualquer orientação que permitisse discurso de ódio ou desinformação médica.
Imagem: Tada Images via olhardigital.com.br
Especialistas alertam sobre dilemas éticos e legais
Evelyn Douek, pesquisadora da Universidade de Stanford citada pela Reuters, avalia que o caso revela desafios inéditos: “Quando a própria plataforma gera conteúdo nocivo, quem responde legalmente?”. Segundo ela, a exposição das regras mostra falta de consenso sobre responsabilidade civil e penal em sistemas de IA generativa.
A análise reforça o debate global sobre controles, auditorias independentes e transparência em grandes modelos de linguagem, especialmente quando operados por empresas com bilhões de usuários.
Por que o caso importa
A Meta conduz alguns dos maiores experimentos públicos de inteligência artificial, integrando bots em aplicativos usados diariamente em escala planetária. Falhas de moderação nesse contexto ampliam riscos de exploração sexual infantil, disseminação de discursos de ódio e circulação de informações médicas enganosas.
Embora a empresa tenha corrigido o documento após a exposição, o episódio evidencia a necessidade de processos de revisão mais robustos antes do lançamento de novas funcionalidades de IA.
Próximos passos para a Meta AI
A Meta não detalhou quais equipes ficam responsáveis por revisar futuras políticas nem informou prazos para publicar orientações atualizadas. O tema deverá ser acompanhado por reguladores, organizações de direitos digitais e usuários preocupados com a segurança de ferramentas automatizadas.
Enquanto isso, o debate sobre governança de inteligência artificial se intensifica, pressionando grandes empresas de tecnologia a adotar padrões transparentes e a prestar contas sobre o impacto de suas decisões de design.
{
"@context": "https://schema.org",
"@type": "NewsArticle",
"headline": "Documento interno revela falhas na moderação da Meta AI para conteúdo sexual e racista",
"datePublished": "2024-04-27",
"dateModified": "2024-04-27",
"author": {
"@type": "Person",
"name": "Redação Tech Jornal"
},
"publisher": {
"@type": "Organization",
"name": "Tech Jornal",
"logo": {
"@type": "ImageObject",
"url": "https://example.com/logo.png"
}
},
"description": "Material confidencial mostra que chatbots da Meta podiam produzir conteúdo sexual sobre menores, discurso racista e desinformação médica. Após questionamentos, empresa revisou diretrizes."
}

Postagens relacionadas