Pular para o conteúdo
    Artigo

    Avaliação independente classifica o ChatGPT para adolescentes como risco inaceitável e cobra provas da OpenAI

    Testes do Youth AI Safety Institute da Common Sense Media apontam falhas nos alertas parentais e em encaminhamentos de crise do modo teen do ChatGPT, e pedem que a OpenAI restrinja o produto a maiores de 18 anos até corrigir as lacunas.

    Filipe Mendes

    7 de out. de 2026 · 6 min de leitura

    Seguir no Google
    Fotografia noturna de cozinha em meia-luz: na mesa, um smartphone desligado ao lado de uma xícara de chá e óculos de leitura; ao fundo, por uma porta entreaberta, um adolescente de costas, rosto invisível, iluminado pela luz azulada de um l
    Avaliação independente aponta falhas nos alertas parentais e em encaminhamentos de crise do ChatGPT para adolescentes e cobra da OpenAI restrição do produto a maiores de 18 anos até que as lacunas sejam corrigidas.

    A OpenAI prometeu proteções embutidas mais fortes. A Common Sense Media (abre em nova aba), por meio de seu Youth AI Safety Institute, testou a promessa e atribuiu ao produto a pior classificação de sua escala: risco inaceitável para todos os menores de 18 anos. O pedido que acompanha o laudo é direto: suspender a divulgação do modo teen e restringir o ChatGPT a adultos até que a experiência seja segura e adequada ao desenvolvimento.

    O objeto da disputa é o ChatGPT for Teens (abre em nova aba), anunciado pela OpenAI em 18 de agosto de 2026 e convertido em experiência padrão para usuários de 13 a 17 anos. Segundo a empresa, o modo reúne notificações aos pais para conversas sobre autoagressão e transtornos alimentares, um Study mode controlável pelos responsáveis, comportamento menos "amistoso", estimativa de idade e garantias alinhadas a um Model Spec para menores de 18, baseado em ciência do desenvolvimento e orientação de especialistas.

    O que os testes mediram

    A metodologia do avaliador independente (abre em nova aba) é a parte mais sólida do episódio. Os pesquisadores executaram mais de 4.000 prompts, metade antes do lançamento e metade depois, em contas registradas como pertencentes a adolescentes de 13 a 17 anos. As respostas passaram por revisão de especialistas, incluindo psiquiatras da infância e adolescência e um pediatra. Duas ondas separadas permitem isolamento de variável: o que mudou no produto pode ser atribuído ao modo teen, e não a alterações gerais do modelo.

    Fotografia editorial em plano médio elevado de duas pessoas de costas e meio perfil, em silhueta não identificável, sentadas lado a lado em uma mesa longa de madeira escura em sala de pesquisa ao anoitecer, iluminadas pela luz azulada e fri
    Avaliadores analisam transcrições de respostas do ChatGPT em modo teen: luz fria da tela contra o âmbar da sala traduz o clima de exame que cerca os testes que classificaram o produto como risco inaceitável para adolescentes.

    O desenho avalia cinco danos severos tratados como "Red Lines" pelo instituto, entre eles suicídio e autoagressão, transtornos alimentares e roleplay romântico ou sexual. Os resultados não são uniformes. Em uma direção, o ChatGPT não forneceu instruções que facilitassem suicídio, autoagressão ou comportamento sexual, segundo o próprio relatório. Na direção oposta, o sistema falhou exatamente onde a OpenAI concentrou sua comunicação pública: detectar quando um adolescente precisa de ajuda externa e avisar quem é responsável por ele.

    Onde as proteções falharam

    O problema central dos testes é o alerta parental. Em mais de uma dúzia de contas novas vinculadas a um pai ou mãe registrada, os testadores passaram até uma hora conversando sobre ideação suicida, autoagressão e alimentação desordenada. Os responsáveis vinculados receberam zero notificações sobre essas conversas. Os alertas só chegaram em contas com semanas de histórico de assuntos sensíveis.

    A implicação técnica é desconfortável para qualquer arquiteto de sistemas de segurança: o gatilho do alerta aparenta depender de histórico acumulado da conta, e não da gravidade do conteúdo do turno corrente. Um classificador baseado em sinal agregado de longo prazo tem latência exatamente onde a latência é inaceitável. Uma sessão isolada de uma hora sobre suicídio, numa conta sem passado, não dispara nada. O primeiro contato de um adolescente em crise é, por definição, o que acontece sem histórico.

    O segundo problema é o encaminhamento de crise. Após o lançamento do modo teen, o ChatGPT deixou de indicar uma linha de crise ou um profissional de saúde mental em mais de um em cada quatro casos em que os especialistas do instituto julgaram o encaminhamento necessário. O sistema ficou abaixo do limiar de 95% de precisão estabelecido pelo instituto em três dos cinco danos severos avaliados. Para um produto cuja proposta de valor inclui proteger adolescentes, errar 25% dos momentos de encaminhamento é errar a função que justifica a existência do produto.

    Há ainda a questão dos contornos. Os testadores contornaram facilmente os guardrails de aprendizado e os controles parentais, segundo o levantamento divulgado pela Mashable (abre em nova aba). Controles que dependem de cooperação do usuário controlado não são controles; são interfaces de conformidade.

    Resposta da OpenAI e divergência de leituras

    A OpenAI contestou a avaliação. Segundo um porta-voz citado pela imprensa, a empresa recebe bem a avaliação independente rigorosa, mas não acredita que os testes da Common Sense Media reflitam com precisão como as salvaguardas do modo teen funcionam na prática. É uma divergência de leitura sobre a ecologia do sistema: de um lado, testes em contas novas que expõem o comportamento do primeiro contato; de outro, a defesa implícita de que o uso real, distribuído no tempo, se sai melhor.

    Colocando as versões lado a lado, a divergência não é sobre fatos brutos, e sim sobre quais condições de teste representam o uso real. A OpenAI não divulgou, até a data da reportagem, dados próprios de taxa de disparo de alertas que sustentem a objeção. E o instituto, por sua vez, baseia seu veredito em contas com vinculação parental corretamente configurada, cenário que o produto exige que funcione. A carga da prova, na formulação do próprio relatório, recai sobre quem coloca o produto no mercado. A frase de abertura do material do avaliador resume a posição: é incumbência da OpenAI ganhar a confiança dos pais e mostrar, não apenas dizer, que o produto é seguro para adolescentes.

    Contexto regulatório

    A avaliação não acontece no vácuo. Segundo o Los Angeles Times (abre em nova aba), o relatório registra que o ChatGPT falhou em testes ligados a três requisitos da Adam's Law, lei da Califórnia sancionada pelo governador Gavin Newsom no mês anterior e vigente a partir de julho de 2027: encaminhamento de crise, alerta aos pais e verificação de idade. Ou seja, o produto avaliado em outubro de 2026 não atende a requisitos que a lei do estado onde a OpenAI tem sede começará a exigir em meados de 2027. As lacunas apontadas pelo instituto não são apenas questões de reputação; são falhas de conformidade antecipada com obrigações legais concretas, no estado que abriga a empresa.

    A Bloomberg (abre em nova aba) e o Axios (abre em nova aba) convergem no fato central e nos números: classificação de risco inaceitável, mais de 4.000 prompts, falhas de alerta em contas novas, mais de um em quatro encaminhamentos de crise perdidos. A convergência entre veículos independentes reduz a probabilidade de que os achados centrais sejam artefato de uma única rotina de testes.

    O que fica para quem constrói

    Para desenvolvedores e times de produto, o episódio expõe três lições sustentadas pelas evidências. Primeiro, salvaguardas dependentes de histórico acumulado têm latência de resposta incompatível com crises, que por natureza chegam sem aviso. Segundo, a taxa de falso negativo em encaminhamento de crise é uma métrica de segurança de primeira ordem, não um refinamento posterior; um sistema que bloqueia conteúdo mas não aciona ajuda no momento certo cumpre metade da função que anuncia. Terceiro, a posição pública da OpenAI, de que os testes não refletem a prática, permanece uma alegação sem dados divulgados que a sustentem, enquanto o lado oposto publicou método, volume e contagem.

    A exigência do instituto é restritiva: manter adolescentes fora do ChatGPT, sem exceções, até que a OpenAI ofereça uma experiência segura e adequada ao desenvolvimento. A resposta da OpenAI, até o momento registrada, é uma objeção metodológica sem contrapublicação de números. A cada hora de conversa sobre suicídio sem alerta, a objeção fica mais difícil de defender.

    Filipe Mendes

    Ver perfil completo