Foi o que aconteceu esta semana em França com Thélyson Orélien e o seu romance C’était ça ou mourir (Era isso ou morrer). O livro, publicado pela Editora Grasset, tinha recebido o Prix du Roman Fnac, ultrapassado os 35 mil exemplares vendidos e surgido nas seleções dos grandes prémios literários do outono. Na segunda-feira, 21 de setembro, uma conta anónima no X acusou o escritor de ter recorrido à Inteligência Artificial (IA) para escrever o romance, apresentando como argumento resultados obtidos através do Pangram, uma ferramenta de deteção de texto gerado por IA. A acusação espalhou-se rapidamente. O autor negou-a. A editora saiu em sua defesa. Depois surgiram outras acusações, nomeadamente de plágio, que pertencem a um plano diferente e exigem outra análise. Entretanto, a Academia Goncourt retirou imediatamente o romance da sua seleção. O caso ainda está envolto em controvérsia, mas uma coisa já aconteceu: antes de sabermos definitivamente o que aconteceu no processo de escrita, a suspeita já produziu consequências.
É isto que me interessa neste caso. Não me interessa, aqui, decidir quem tem razão. Interessa-me a pergunta que ficou no ar e que, a meu ver, será uma das grandes perguntas culturais e até sociológicas deste tempo: quando uma máquina acusa um escritor, quem acusa a máquina?
Há uma espécie de paradoxo que me fascina e me inquieta. Estamos a usar sistemas algorítmicos para tentar determinar se outro sistema algorítmico participou na escrita de um texto. A máquina que procura a máquina é também uma máquina. E, no entanto, quem fica sob suspeita é o homem. É o escritor que tem de explicar a sua escrita, justificar a sua linguagem, apresentar os seus rascunhos, recordar o seu processo, talvez até reconstruir diante de terceiros aquilo que foi, até então, uma experiência íntima: o ato de escrever.
Parece-me que o detetor não viu o escritor a escrever. Não esteve presente quando surgiu a primeira frase. Não conhece os livros que o autor leu, as línguas que aprendeu, as pessoas que encontrou, as conversas que teve, as frases que riscou. Não sabe de onde veio uma imagem, uma personagem, uma memória. Não sabe quantas vezes uma palavra foi substituída até parecer certa. Recebe o texto terminado e procura nele padrões estatísticos. Não observa a autoria. Infere-a.
E aqui começa, para mim, o verdadeiro problema. Uma inferência não é uma prova.
Pode ser uma indicação. Pode ser um sinal de alerta. Pode justificar que se faça uma investigação, mas não deveria adquirir, por si só, o estatuto de verdade.
No caso de Orélien, o jornal Le Monde submeteu mais de metade do romance ao Pangram e obteve uma classificação superior a 95% de texto produzido por IA, com elevado nível de confiança. O mesmo jornal ouviu investigadores que chamaram a atenção para as limitações destes sistemas, para a sua opacidade e para as dificuldades acrescidas quando se trabalha com línguas, estilos e variedades linguísticas que não correspondem aos padrões dominantes usados no treino dos modelos.
Não é preciso negar a existência de detetores de IA para perceber o problema. Basta reconhecer uma coisa muito simples: uma ferramenta pode ser útil e, ao mesmo tempo, não ser infalível.
É aqui que a discussão se torna demasiado tecnológica e pouco filosófica. Perguntamo-nos qual é o melhor detetor, qual tem a percentagem de falsos positivos mais baixa, qual é a que analisa mais palavras, qual a que utiliza o modelo mais recente. Tudo isso é importante. Mas antes de perguntarmos qual é a máquina mais eficaz, deveríamos perguntar: que espécie de autoridade estamos dispostos a conceder a uma máquina sobre uma pessoa?
O erro, quando se trata de atribuir a autoria de um texto, não é um erro neutro. Um falso positivo não é apenas uma incorreção estatística. É uma pessoa acusada injustamente. A diferença é enorme.
Uma ferramenta pode apresentar uma taxa de falsos positivos muito baixa e, ainda assim, errar. E quando o resultado desse erro pode atingir a reputação de alguém, retirar um livro de um prémio, interromper uma digressão, comprometer uma relação editorial ou lançar sobre um autor uma suspeita que ficará para sempre associada ao seu nome, a estatística deixa de ser apenas estatística. Torna-se uma questão moral. A publicidade de uma acusação pode ser instantânea; a reparação da reputação, lenta ou impossível.
É por isso que a história de Orélien me parece maior do que Orélien. É uma história sobre a confiança, sobre aquilo que aceitamos como prova, sobre o momento em que a tecnologia deixa de ser uma ferramenta que nos ajuda a conhecer e começa a adquirir o poder de decidir aquilo que devemos acreditar.
Há uma questão que me toca particularmente e que talvez eu próprio não pudesse evitar nesta crónica. Sou professor de Português e escrevo em português, mas a minha língua não é linguisticamente “pura”. Tenho muitas influências francesas: na sintaxe, na morfologia, no léxico, na maneira como uma frase se organiza dentro da minha cabeça antes de passar para a escrita. Há estruturas que reconheço em mim e que resultam desse contacto continuado com outra língua. Há escolhas lexicais que me são naturais, porque a minha experiência linguística também foi moldada pelo francês.
E isto é importante, porque a língua é uma história pessoal. Nenhum de nós escreve apenas na língua que aprendeu na gramática da escola. Escrevemos na língua que vivemos. E a língua que vivemos é feita de encontros, de leituras, de deslocações, de conversas, de outras línguas. Um escritor bilingue não escreve duas línguas separadas dentro de si; escreve muitas vezes uma língua transformada pelo contacto com outra. Um cabo-verdiano pode levar o crioulo para dentro do português. Um angolano pode inscrever outras cadências na língua portuguesa. Um brasileiro traz outras músicas, outras soluções sintáticas, outras relações com o léxico. Um português que viveu longamente em França pode deixar que o francês atravesse a sua escrita.
É precisamente isso que torna a linguagem humana tão difícil de reduzir a padrões. E é aqui que vejo um perigo ético. E se aquilo que um algoritmo identifica como “artificial” for, afinal, apenas aquilo que não corresponde ao padrão linguístico que ele espera encontrar?
E se a singularidade começar a parecer suspeita? E se um autor bilingue for mais difícil de classificar e, por isso, mais facilmente acusado? E se uma escrita muito organizada, muito regular ou muito económica parecer “demasiado perfeita”?
Chegaríamos a uma situação absurda: o erro seria uma prova de humanidade. A imperfeição, uma espécie de certificado de autenticidade. E um escritor poderia sentir-se tentado a deixar propositadamente uma frase menos limpa, uma construção mais tortuosa, um pequeno defeito, apenas para que uma máquina reconhecesse nele aquilo que ela entende por humano.
Seria o triunfo do detetor sobre o escritor. Perturba-me particularmente a ideia de uma máquina avaliar a humanidade de um texto apenas pelo texto final. A literatura nunca foi apenas o produto acabado. É também o caminho que conduz até ele.
Um romance é o que chegou à página, mas é também o que foi recusado antes de chegar à página. São as páginas destruídas, as frases que não sobreviveram, as personagens que desapareceram, os pensamentos que ficaram pelo caminho. A escrita tem um lado visível e outro invisível. O livro mostra o resultado; não mostra o processo.
Ora, a IA está a obrigar-nos a voltar os olhos para esse processo. O escritor do futuro terá de conservar os seus rascunhos? Os ficheiros têm de guardar versões? Será necessário documentar o percurso de uma obra? A relação entre autor e editor passa a incluir alguma forma de declaração sobre a utilização de ferramentas de IA. Tudo isso me parece discutível e, em alguns contextos, talvez necessário.
Contudo, há uma linha que me parece perigosa ultrapassar: pedir ao escritor que entregue a sua intimidade para provar que é humano.
Um rascunho não é apenas um rascunho. Pode conter uma memória familiar. Uma ferida. Um nome. Uma relação. Uma ideia ainda informe. Uma coisa que o escritor escreveu e que decidiu não publicar. O processo criativo é, muitas vezes, um território de liberdade precisamente porque ninguém o observa.
Se começarmos a exigir esse território como prova, poderemos estar a trocar uma cultura da criação por uma cultura da vigilância.
E há ainda outra questão que considero fundamental: o que significa, afinal, “usar IA”?
A pergunta é demasiado simples. Um escritor que utiliza uma ferramenta para corrigir uma gralha não está necessariamente na mesma situação de quem pede a uma máquina que produza um romance. Um autor que consulta uma IA para discutir uma ideia não está na mesma posição de quem lhe entrega a estrutura narrativa, as personagens e a redação. Entre a assistência e a substituição existe um território enorme, cheio de zonas intermédias.
Por isso, a pergunta decisiva não será “foi usada IA?”, mas “que papel desempenhou a IA na construção desta obra?”
Quem pensou a obra? Quem tomou as decisões fundamentais? Quem escolheu? Quem recusou? Quem reescreveu? Quem verificou? Quem assumiu os erros? Quem está disposto a responder pelo livro?
É aqui que a responsabilidade me parece mais importante do que a obsessão pela pureza.
A literatura nunca foi uma criação a partir do nada. Camões escreveu depois de Homero e Virgílio. A Bíblia é uma história de tradição, transmissão, memória, escrita e reescrita. Cada escritor traz consigo uma biblioteca de outros escritores. Traz frases que leu, histórias que ouviu, ritmos que assimilou sem dar por isso. A língua que usamos pertence a todos os que a falaram antes de nós.
A autoria humana nunca significou começar do zero. Significou transformar aquilo que recebemos numa voz própria.
A IA apenas torna esta velha verdade mais desconfortável, porque agora existe uma ferramenta que pode participar dessa transformação em escala e velocidade inéditas.
É por isso que não gostaria de transformar este debate numa batalha simplista entre escritores “puros” e escritores que usam a tecnologia. Isso seria fugir à questão verdadeiramente difícil. O que precisamos é de uma ética da autoria suficientemente inteligente para distinguir o auxílio da delegação, a ferramenta da substituição, a consulta da criação, a responsabilidade da simples produção de texto.
E, sobretudo, precisamos de regras que não confundam suspeita com prova.
O caso de Thélyson Orélien revela o que acontece quando a suspeita corre mais depressa do que a investigação. Uma acusação surge nas redes sociais. Uma ferramenta fornece uma percentagem. A percentagem transforma-se numa narrativa. A narrativa ganha força. A instituição é obrigada a reagir. E, antes de sabermos tudo o que precisamos de saber, a obra já sofreu uma consequência concreta e provavelmente irreversível.
Isto é novo. Ou talvez não seja. A humanidade sempre condenou depressa aquilo que compreendia mal. O que há de novo é a velocidade e a aparência de objetividade que a máquina acrescenta ao julgamento. Um rumor acompanhado de uma percentagem parece menos rumor. Uma suspeita acompanhada por um gráfico parece mais científica. Uma acusação produzida por um algoritmo adquire, aos nossos olhos, uma autoridade que talvez não mereça.
E é aqui que devemos parar urgentemente. Um algoritmo não é um tribunal.
Pode ser uma ferramenta de investigação. Pode ser uma ferramenta de apoio. Pode ajudar a formular perguntas, mas não deveria ser transformado numa autoridade moral sobre a autoria de uma pessoa.
Até porque os próprios sistemas de deteção têm limitações reconhecidas. A investigação sobre estas ferramentas está longe de oferecer um detetor universal, infalível e independente de idioma, género textual, estilo ou intervenção humana. Há sistemas que funcionam melhor em determinados contextos e pior noutros. Há falsos positivos. Há falsos negativos. Há textos humanos que parecem artificiais e textos artificiais que conseguem escapar à deteção.
Temos de recuperar uma palavra que pertence mais ao direito e à filosofia do que à tecnologia: dúvida. Não a dúvida como paralisia, mas como prudência perante aquilo que ainda não conseguimos demonstrar.
A literatura deveria ser um dos lugares onde essa dúvida pudesse sobreviver. Escrever é, em grande medida, uma forma de procurar aquilo que ainda não sabemos. É experimentar uma palavra e substituí-la. É aproximarmo-nos de uma ideia e recuarmos. É escrever algo para descobrir depois se acreditamos realmente no que acabámos de escrever.
Como poderia uma máquina conhecer esse movimento interior? Pode reconhecer o padrão da frase, o ritmo, a probabilidade de uma palavra surgir depois de outra. Mas pergunto se poderá conhecer a razão pela qual aquela palavra, naquele instante, foi necessária para aquele escritor?
É aqui que volto à minha própria condição de professor de Português. É provável que uma máquina consiga analisar a minha sintaxe, encontrar regularidades na minha morfologia, assinalar o meu vocabulário e comparar o meu texto com milhões de outros textos. Até pode conseguir dizer que há características estatísticas semelhantes às de determinado modelo de IA.
Mas isso não lhe permitirá conhecer a minha história linguística. Não saberá que, por detrás de algumas dessas construções, está o francês que aprendi e que continuo a transportar comigo. Não saberá quais foram os livros que me formaram. Não saberá as frases que ouvi. Não saberá as experiências que deram espessura às palavras.
Pode conhecer o texto. Não conhece a biografia da língua que me levou até ele.
Essa é a diferença que devemos preservar. Não uma diferença mágica entre o humano e a máquina, como se o escritor possuísse alguma substância invisível que um algoritmo jamais pudesse tocar. Mas, sim, uma diferença fundada na experiência, na consciência, na memória e, sobretudo, na responsabilidade.
Uma máquina pode produzir uma frase. Um escritor pode assiná-la. Mas assinar significa alguma coisa. Significa aceitar que, a partir daquele momento, aquela frase ficará ligada ao nosso nome. Que alguém poderá discordar dela. Que alguém poderá perguntar-nos por que a escrevemos. Que poderemos ter de explicar uma escolha, corrigir um erro, assumir uma consequência.
Creio que é isto que autoria significa, no fundo. Não ser o primeiro a pensar, não escrever a partir do nada, nem sequer escrever sem qualquer ferramenta. Ser aquele que responde pelo que foi escrito.
É por isso que a pergunta que esta história francesa deixa atrás de si me parece tão importante. Não é apenas saber se Thélyson Orélien escreveu ou não escreveu o seu romance com inteligência artificial. Não devemos transformar uma questão ainda em disputa numa certeza que os factos não nos permitem afirmar.
A pergunta é outra. Que tipo de sociedade queremos construir quando uma máquina pode acusar um escritor e uma percentagem pode transformar-se em suspeita?
Uma sociedade em que o escritor tenha de provar permanentemente a sua humanidade? Uma sociedade em que os rascunhos se transformem em documentos forenses? Uma sociedade em que a intimidade do processo criativo seja sacrificada em nome da autenticação? Ou uma sociedade suficientemente prudente para perceber que nenhuma tecnologia deve receber, sozinha, o poder de decidir aquilo que é verdadeiro sobre uma pessoa?
Ainda não sabemos como responder. Penso que devemos começar por uma regra muito simples: quem acusa deve apresentar mais do que uma percentagem; e quem julga deve saber que uma máquina também pode errar.
O maior perigo da inteligência artificial não é ela aprender a escrever como nós. É nós começarmos a acreditar que ela conhece os seres humanos melhor do que os próprios seres humanos.
E, nesse dia, o escritor já não estará apenas a defender o seu livro. Estará a defender uma ideia muito mais antiga e muito mais frágil: a de que uma pessoa não pode ser reduzida ao padrão que uma máquina reconhece na sua linguagem.
E, aí, estamos mesmo perdidos. Seremos todos réus humanos e a máquina decide a condenação.
Os textos nesta secção refletem a opinião pessoal dos autores. Não representam a VISÃO nem espelham o seu posicionamento editorial.