导读说明:原文发布于 2025-05-08。以下内容是依据原文重新组织、压缩并加入编辑性辨析的中文原创导读,不是逐句翻译,也不复制原图或原文长句。
十年成果来自持续迭代
内容翻译工具在 2015 年上线,文章称十年间已帮助各语言版本发布超过 240 万篇译文。它解决的并不只是“把文字翻成另一种语言”,而是把选题、段落转换、模板、参考文献和发布流程放进维基百科内部,并保留人工审阅。对资料较少的语言版本而言,这种工作流能降低双语编辑在外部文档、维基语法和引用格式之间反复切换的成本,让有限的志愿时间更多用于判断语境与核实内容。
技术路线从机器初稿走向完整工作流
文章梳理了几次关键改进:2016 年接入机器翻译以加快初稿;2018 年加强模板和引用转换;2021 年支持移动端、按章节协作,并加入识别机器翻译滥用的机制。后来,MinT 把机器翻译支持扩展到四万多个语言对,使 55 个语言版本首次获得相关支持;个性化建议提供 41 类主题筛选,社群还可用 Collections 整理待译清单,统一仪表板则缩小桌面端与移动端的功能差距。
数量增长如何触及知识缺口
原文称,内容翻译工具生成的条目约占伊博语和豪萨语维基百科全部内容的 80%,并帮助补充科学、文化、历史与社会等主题;若干南亚语言版本的 STEM 译文在三年内从不足 1.1 万篇增至 59,641 篇。疫情期间,相关协作又把 COVID-19 内容带到 130 多种语言。文章还表示,经人工认真编辑和复核的工具译文,比从零创建的条目更不易被删除。
不要把“翻得更多”直接等同于公平
这些数字说明工具已成为重要基础设施,但仍主要是文章选取的成果指标,不能单独证明翻译造成了长期活跃度、阅读覆盖或质量提升。机器初稿越容易产生,人工核查、来源适配、本地语境和社群政策能力越关键。可借鉴的方向,是把功能指标与删除率、复核积压、主题多样性、新人留存一起观察;否则,条目数上升也可能掩盖维护负担。真正的知识公平,是让本地社群能选择、修订并长期照管被引入的知识。
来源与许可:原作者:Uzoma Ozurumba;原文:A decade of consistent improvements to the Content Translation tool yields over two million Wikipedia articles。本文对原文进行了重新组织、压缩、中文改写并加入编辑性辨析;未复制原图或原文长句。本文采用 CC BY-SA 4.0 许可并以相同许可共享;原文及媒体如有另行注明,以其注明为准。