Fazia tempo que o papai não respondia. A gente ficava ali, no corredor do hospital em Accra, com o médico repetindo os resultados em inglês puro, e a minha avó respondia em twi, com frases que começavam numa língua e terminavam na outra. Ela entendeu tudo, claro, mas quando precisou perguntar sobre o remédio, a pergunta saiu misturada: "Então o doctor sey we go keep giving am the same?" Foi aí que eu percebi que nenhuma inteligência artificial que me obrigasse a escolher uma língua antes de falar ia conseguir ajudar ela.
O problema de escolher antes de falar
Os assistentes de voz mais populares funcionam assim: você define o idioma no aplicativo, e ele só entende aquele idioma. Twi? Ok, só twi. Inglês? Só inglês. Mas ninguém em Gana conversa assim. A gente code-switcha naturalmente, mistura as duas línguas numa frase só, sem nem perceber.
Um app que força a escolha de uma única língua antes de você abrir a boca está pedindo que você abandone o jeito que você realmente fala. É como exigir que alguém preencha um formulário antes de contar uma história. A conversa vira um exercício de tradução mental, e não uma conversa.
A lição de um fracasso histórico
Em 1962, a NASA lançou a Mariner 1, a primeira sonda espacial americana com destino a Vênus. Pouco depois do lançamento, ela começou a desviar de rota e teve que ser destruída no ar. O custo? Cerca de US$ 18 milhões na época, um valor enorme.
O problema? Um erro de programação. Durante o cálculo da trajetória, uma fórmula manual foi transcrita de forma incorreta no código. Mas o erro da Mariner 1 não foi ter cometido a falha na transcrição, foi ter construído um sistema onde um único traço a menos fazia tudo desmoronar. Houve uma investigação que destacou justamente a fragilidade de depender de um passo perfeitamente executado.
Isso tem tudo a ver com o problema dos assistentes de voz. Quando você constrói um sistema que espera "ou twi, ou inglês", você cria um ponto de falha desnecessário. A conversa natural acaba sendo o "erro", quando deveria ser a norma. O sistema foi construído para o caso ideal e quebrou diante do caso real.
Falar a língua que as pessoas de verdade falam
A gente não pensa em "misturar línguas" quando conversa, só conversa. O código-switching não é um defeito, é a forma mais natural de comunicação em Gana. E a tecnologia tem que se adaptar a isso, não o contrário.
É por isso que o Nkomo foi construído com o twi fluido e o inglês ganês de verdade, no mesmo turno de conversa. Você fala "Me pɛ sɛ me check my schedule", e ele entende, porque essa é a língua que você realmente usa. Não precisa escolher, não precisa se explicar, é só falar.
O mesmo vale para a privacidade. Se você fala de um jeito natural, quer também saber o que acontece com essa conversa. O Nkomo mostra os erros quando eles acontecem, em vez de escondê-los, e deixa o controle do que vai para a nuvem com você, com opções claras de "nunca", "perguntar cada vez" ou "nesta sessão". Nada do que você quer manter no aparelho sai dele, e o histórico fica sob seu controle.
Voltar ao corredor do hospital
A NASA aprendeu com a Mariner 1 a não construir sistemas que quebram no ponto em que mais importam. No corredor do hospital, a minha avó não teve que escolher entre o twi e o inglês para ser entendida. A tecnologia deveria ser igual: presente na hora da dúvida, entendendo a língua que a gente fala de verdade.
Comentários
Ainda não há comentários.