
比亚迪的“天神之眼”数据,翻译时该注意什么
昨晚在翻译一篇关于L2级辅助驾驶系统的论文,作者用了“trained on billions of kilometers of real-world driving data”。我习惯性地把“billions”译成“数十亿”,但突然想到,今天比亚迪官方说“天神之眼每天生成数据超2.1亿公里”,这个数字如果换算成“billion”,是0.21 billion。一个是“每天”,一个是“累加”,中文里“亿”和“billion”的语境差异,可能会让读者产生错觉。
先说结论:比亚迪的333万辆保有量和2.1亿公里/天的数据增量,在技术翻译和传播层面,需要更严格的术语界定。否则容易让人误以为“辅助驾驶能力”等同于“数据驱动能力”,或“数据规模”直接对应“算法成熟度”。
展开论证。
第一,关于“天神之眼”这个产品名称的翻译。原文是“天神之眼辅助驾驶”,英文如果直接译成“God's Eye”,在技术文档中会显得夸张。更合适的英文术语可能是“DiPilot - God's Eye”或“Divine Eye”,但更准确的做法是保留品牌名“DiPilot”,因为“天神之眼”本质上是比亚迪的辅助驾驶系统品牌,而非字面意义上的“神之眼”。在中文新闻中,这个名称有营销色彩,但作为技术翻译,必须区分“品牌名”和“技术描述”。例如,在论文中引用时,应写“BYD DiPilot (marketed as 'God's Eye')”。
第二,“每天生成数据超2.1亿公里”这个表述,原文的意思是“车辆每天行驶的总里程数”,但“生成数据”这个动宾搭配容易引起歧义。数据生成指的是传感器采集的原始数据流,还是指经过处理后可用于训练的里程数?更准确的中文表述应该是“每天累积行驶辅助驾驶里程超2.1亿公里”,或者“每天回收的辅助驾驶场景数据对应里程超2.1亿公里”。在翻译时,需要避免“数据”和“里程”混用,因为里程是物理量,数据是数字量,两者单位不同。
第三,这个数据与“保有量超333万辆”结合看,每辆车平均每天贡献约63公里的辅助驾驶里程。这个数字不低,但需要区分“辅助驾驶开启状态下的里程”和“车辆总行驶里程”。如果按L2级辅助驾驶标准,要求驾驶员注意力始终在线,那么这些数据是否能完全用于端到端模型训练,取决于是否记录了完整的驾驶员接管和系统脱手事件。否则,数据量只是好看,对算法迭代的边际效益递减。
配图:
第四,从翻译视角看,新闻报道中“性能均优于L2辅助驾驶新...”这个断句也有问题。原文应该是“性能均优于L2辅助驾驶新标准”或“优于L2级辅助驾驶要求”。但“L2辅助驾驶新”是明显的截断,在中文新闻中应补全。作为技术翻译,遇到这种需要结合上下文补全的省略,要格外小心,避免直接复制。
第五,数据规模的优势需要放在行业里对比。特斯拉FSD宣称有超过10亿英里的数据,约16亿公里,但那是累计数据。比亚迪333万辆车的保有量如果持续增长,日增2.1亿公里,年增约767亿公里,很快会超过特斯拉的累计数据量。但问题在于:特斯拉的FSD是纯视觉方案,数据采集标准统一;比亚迪的“天神之眼”覆盖不同配置(DiPilot 100/300/600等),传感器融合方案不同,数据格式和标注方式可能不统一。这种情况下,数据量越大,清洗成本越高,训练效率反而可能下降。
最后,直接收住,不总结。
原文链接:https://www.ithome.com/0/977/161.htm
物界前沿