Un soir, une étudiante dans une classe de nuit russe répandit une pile de notes écrites à la main sur son bureau. Les mêmes phrases apparaissaient encore et encore: 'donnez-moi une pause — da lado' et 'l'avion a décollé — самолёт взлетел.' Elle m'a dit qu'elle n'avait pas appris ces pairs d'un livre de cours. Elle les avait tirés de tr-ex.me, un site Web qui a transformé une recherche d'une phrase anglaise en une longue colonne de traductions russes tirées des fichiers sous-titres et des livres traduits.
Une boîte de recherche pour la langue réelle, pas le dictionnaire
Le site n'était pas un dictionnaire dans le sens habituel. Il n'offrait pas une définition approuvée ou un guide de prononciation ordonné. Tapez "make up" dans la boîte de recherche et l'écran rempli de phrase après phrase: "Elle aime faire des histoires", "Ils ont fait des histoires après le combat", "Les femmes font la moitié de la classe." Chaque ligne portait un équivalent russe, de sorte qu'un apprenant pouvait voir que "make up" pourrait être prdumuvat pour inventer, mirться pour réconcilier ou составлять quand la phrase est sur les parties qui forment un tout.
tr-ex.me est arrivé à un moment où Google Translate a donné aux utilisateurs une sortie par requête, les dictionnaires généraux offrent une couverture russo-anglaise mince, et les outils de traduction payés se sentaient lourds pour un contrôle rapide des phrases. Une boîte de recherche gratuite sans connexion ressemblait à un raccourci.
D’où viennent les condamnations
tr-ex.me a l'air simple, mais la simplicité s'est assise sur un lourd backend de paires de phrases. La plupart du matériel provenait de fichiers de sous-titres circulant publiquement, qui sont utiles pour l'apprentissage des langues parce que les caractères parlent en bref, des éruptions naturelles. corpora parallèle, des collections de textes et leurs traductions alignées phrase par phrase, ont été utilisés par les chercheurs et les constructeurs d'outils depuis des décennies.OPUS corpus organisé par l'Université d'Helsinki, par exemple, regroupe des données de traduction ouvertes provenant de sous-titres de films, de documents gouvernementaux, de manuels logiciels et de textes religieux.
La Wayback Machine de l'Internet Archive a été conservéeSnapshot après snapshot de tr-ex.memontrant le même design année après année: une barre de recherche, une colonne d'exemples, et presque aucune explication éditoriale.
Photo by Brett Jordan on Unsplash
Pourquoi l'angle russo-anglais était important
Les dictionnaires anglo-russes de l'époque ont souvent porté avec des équivalents formels ou académiques. Une phrase comme "être à quelque chose" pourrait être absent du tout, ou il semblerait que "se occuper de quelque chose" quand la signification réelle était "zateвать что-to neхорошее." tr-ex.me a renvoyé ligne après ligne d'exemples idiomatiques et colloques de dialogue de thriller et de comédies familiales. Les traducteurs l'ont utilisé pour la même raison: ils avaient besoin de voir comment un personnage allait vraiment parler, pas comment un livre d'études a dit qu'ils devraient.
La volonté de l'ensemble de données d'inclure la profanité, le slang alcoolisé, le discours régional et les interjections semi-finis lui ont donné l'impression que les livres de phrases préparés ne l'ont pas fait.
Parce que le site a refusé de demander quoi que ce soit à ses visiteurs, il est devenu un paramètre par défaut pour les personnes qui étaient fatiguées de créer des comptes. Un étudiant pouvait ouvrir tr-ex.me pendant une pause commerciale, taper une phrase d'une chanson et trouver une douzaine de rendus russes avant que le spectacle ne reprenne. Les traducteurs indépendants l'ont gardé dans un onglet attaché à côté d'un contrôle d'orthographe. Les forums et les blogs linguistiques ont partagé le lien comme un truc silencieux plutôt qu'une ressource formelle.
Les fissures dans le corpus
Certains des défauts étaient linguistiques. L'anglais "fine" renvoyait des exemples signifiant "okay" et des exemples signifiant "une pénalité." Les apprenants russes qui ne connaissaient pas la différence pouvaient s'en aller avec une fausse équivalence. Une ligne d'un sous-titre pouvait être traduite idiomatiquement, ou elle pouvait être gâchée parce que le traducteur avait compressé une blague pour s'adapter à l'écran. Il n'y avait pas d'étiquette de sens, pas de note de registre, pas de moyen fiable de marquer une mauvaise correspondance. Le même corpus brut qui a rendu le site complet l'a également rendu incohérent, et les utilisateurs ont dû apporter leur propre
Sans un cadre de licence pour le matériel traduit, de tels projets pourraient disparaître soudainement ou faire face à la pression des titulaires de droits. tr-ex.me a un problème à long terme était un paradoxe: l'outil était facile à utiliser, mais de plus en plus difficile à faire confiance.
Lorsque les nouveaux outils sont pris en charge
À la fin des années 2010, les alternatives avaient changé.Contexte inverseIl a offert une ambiguïté des sens et un mode anglo-russe plus soigneusement structuré.profondeurlancé un traducteur qui traitait le langage idiomatique avec une précision que beaucoup d'utilisateurs n'avaient pas vu auparavant, et il a ajouté le soutien russe. les résultats contextuels de Google lui-même sont devenus plus faciles à lire. Un apprenant n'a plus à parcourir des centaines de fragments de sous-titres quand un outil polie pouvait montrer une poignée de bonnes options et expliquer le registre.
Certains des anciens appels ont également fonctionné contre le site. Les moteurs de recherche ont commencé à abaisser le classement des pages répétant les mêmes fragments de phrase non étiquetés, ce qui a rendu tr-ex plus difficile à trouver exactement comme les plus jeunes utilisateurs ont découvert l'apprentissage basé sur l'application. Lorsque le site a été chargé, il n'a offert aucun moyen de filtrer par variété, pas d'audio, pas de répétition espacée, et pas d'explication de l'origine d'une ligne.
Photo by Brett Jordan on Unsplash
Une leçon qui a dépassé le site
L'absence du site d'utilisation quotidienne est visible sur les forums où les anciens utilisateurs demandent ce qui l'a remplacé. tr-ex.me n'a pas évolué en une référence curée ou un corpus sous licence, et aucun successeur n'a adopté son nom et son modèle exacts. Ce qu'il a laissé derrière était une attente plus claire parmi les apprenants: le contexte compte, mais le contrôle de la qualité compte aussi. Un bon outil de traduction doit maintenant montrer la source, le registre, la raison d'un choix et les limites de l'exemple.
Cette étudiante de nuit a finalement déménagé vers des applications plus récentes, mais elle a gardé les phrases écrites à la main. Ce que tr-ex.me lui avait donné n'était pas une entrée de dictionnaire. C'était l'habitude de vérifier comment une phrase se comporte dans le sauvage.
