Nkomo
A confident woman with braids smiling in a studio with a microphone and speaker in the background.

Photo by Moisés Souza Celestino on Pexels

Una conversación bilingüe no suele empezar eligiendo un idioma: empieza hablando. Si un asistente obliga a escoger entre twi e inglés antes de escuchar, convierte una costumbre natural en una decisión artificial.

En abril de 1970, la tripulación del Apollo 13 tenía un problema urgente dentro del módulo lunar Aquarius. Los filtros de dióxido de carbono disponibles en el módulo de mando eran cuadrados, mientras que el sistema que debía recibirlos usaba conexiones redondas. Los ingenieros de la NASA en Houston tuvieron que diseñar un adaptador con materiales que ya estaban a bordo y explicar a los astronautas cómo montarlo.

La misión había sido concebida como un conjunto de sistemas compatibles. En aquel momento, una diferencia de formato podía impedir que una pieza esencial cumpliera su función.

El problema empieza antes de la primera palabra

Pensemos en una nota de voz que Auntie ya está grabando. No abre una pantalla para decidir: “Ahora hablaré en twi”. Tampoco anuncia el momento exacto en que pasará al inglés.

Empieza con el saludo que le sale de forma natural. Explica una situación en inglés, introduce una condición en twi y vuelve al inglés para concretar qué necesita. Puede cambiar porque una palabra le resulta más precisa, porque está citando a otra persona o porque así habla con su familia.

La mezcla no es ruido alrededor del mensaje. Puede contener la parte más importante del mensaje.

Una selección previa de idioma presupone que toda la conversación cabrá en una sola casilla. Obliga a Auntie a adaptarse a la interfaz antes de que la interfaz haya intentado entenderla. Es el equivalente conversacional de tener la pieza correcta con la conexión equivocada.

El estudio LoDNA aporta otra razón para tomarse en serio esa adaptación. Al evaluar instrucciones de seguridad localizadas culturalmente en twi, hausa, amhárico y suajili, encontró que, en la mayoría de las combinaciones probadas de modelo e idioma, las indicaciones dañinas conservaron menos del 10 % de la señal de rechazo observada en inglés. Comprender una lengua a medias puede afectar tanto al significado como a la seguridad.

Una frase puede cambiar de sentido a mitad de camino

En una conversación real, el idioma no es una configuración fija. Es parte del contenido.

“Send it to Kofi, nanso…” puede comenzar como una instrucción sencilla y cambiar por completo después de la condición en twi. Si el sistema trata el cambio como una interrupción, una anomalía o el inicio de otra consulta, puede perder justo la parte que limita la acción.

Eso importa cuando se habla de un encargo, una transferencia, una cita o un asunto familiar. No hace falta que el asistente se equivoque en cada palabra. Basta con que pierda una condición, una negación o el nombre correcto. En este caso sobre una condición en twi, el riesgo aparece precisamente en ese pequeño fragmento que cambia la instrucción entera.

La misma lógica se aplica a la voz. Una persona puede sostener para hablar, hacer una pausa, interrumpir la respuesta y aclarar algo en el otro idioma. El sistema debe seguir el hilo de la conversación, no exigir que cada turno respete una frontera lingüística que la persona nunca trazó.

La privacidad también debe acompañar la conversación

Escuchar lenguaje natural implica escuchar contenido personal. Auntie puede pasar de preguntar por una receta a mencionar una deuda, un síntoma o un desacuerdo familiar sin detenerse a clasificar la sensibilidad de cada frase.

Por eso el control sobre la nube debe aparecer antes de enviar el contenido, con opciones comprensibles: nunca, preguntar cada vez o permitir durante esta sesión. La persona debe saber qué sale del dispositivo y tomar esa decisión de forma explícita.

Nkomo mantiene el historial en el dispositivo bajo control del usuario. Si se desactiva, se elimina de inmediato. También permite exportar los datos o borrar la cuenta con un toque. Cuando ocurre un error, se muestra; no se oculta como si la conversación hubiera seguido correctamente.

Estas decisiones reducen dos cargas distintas. La primera es lingüística: no tener que traducirse mentalmente para hablar con una máquina. La segunda es informativa: no tener que adivinar dónde quedó una conversación íntima.

Diseñar para la forma que ya tiene la conversación

La lección del Apollo 13 no consiste en comparar una charla cotidiana con una emergencia espacial. Consiste en reconocer el coste de imponer una conexión incorrecta entre una persona y el sistema que debe ayudarla.

Los ingenieros en Houston no podían cambiar los materiales disponibles dentro de Aquarius. Tuvieron que adaptar la interfaz para que las piezas funcionaran juntas. La NASA documenta aquel episodio como parte de la misión Apollo 13 y de la solución improvisada para controlar el dióxido de carbono.

Con el lenguaje ocurre algo parecido. Auntie ya sabe hablar. Su familia ya entiende cuándo pasa del twi al inglés y por qué una frase puede necesitar ambos. El trabajo del producto consiste en recibir esa conversación tal como empieza, conservar su sentido y explicar con claridad qué ocurre con los datos.

Antes de añadir otra pantalla de selección, conviene escuchar una nota de voz real de principio a fin. ¿Dónde cambia de idioma? ¿Qué palabra contiene la condición? ¿Qué perdería el sistema si obligara a escoger una sola lengua?

Auntie nunca vio una configuración de idioma porque no debería necesitarla para empezar a hablar.

Nkomo

A private, natural Twi and Ghanaian English voice-and-text companion — talk or type, in the mix of languages people actually speak, with clear control over what stays on the device versus what reaches the cloud.

Prueba Nkomo

Comentarios

Todavía no hay comentarios.