← 返回 木质书桌上放着一本古旧词典,午后金色阳光洒落,浅景深效果

机器翻译 + 人工润色:能获排名的流程

一个客户在2023年初给我来电,真的慌了。他们付给一家机构(不是Seahawk,澄清一下)约14000英镑,把电商网站本地化为法语、德语和西班牙语。八个月后,这三个地区的自然搜索展现量为零。内容存在。谷歌已经索引了。没人点击,没人排名,没人能搞清楚为什么。

我打开了一个德语产品页面。读到第三句话,我就发现问题了。这些文案读起来像2011年谷歌翻译的截图。从技术上讲准确无误。但绝对不自然。没有德语使用者会这样写"Das Produkt ist sehr gut für Ihre Bedürfnisse geeignet."。除非他们是在逐字转录PowerPoint演讲稿的机器人。

这就是机器翻译的陷阱。我在Seahawk接触过的12000多个网站上都能看到这个问题。原始机器翻译输出排不了名,因为谷歌的质量信号不会被技术上正确的外语文本所迷惑。用户也不会。当用户在4秒内反弹,排名信号循环就会迅速崩溃。

这是真正有效的流程。

---

为什么原始机器翻译在搜索中失败(而且不是你想的原因)

大多数人认为机器翻译失败是因为语法错误。这个诊断是错的。

DeepL这样的现代工具确实令人印象深刻。DeepL的翻译,特别是对欧洲语言的翻译,通常在语法上很清晰。问题出在更微妙的地方:文化语境和搜索意图不匹配。

语言之间的搜索意图问题

当法语用户在谷歌中输入"chaussures de course femme pas cher"时,他们表达的是非常具体的意图。如果你把英语的"cheap women's running shoes"页面逐字翻译成法语,可能也会产生这个短语。没问题。但正文、标题、FAQ结构、你如何与读者交流的方式,所有这些都会带上英文内容穿上法文外套的节奏。

法语读者能察觉到。法语爬虫(即为fr语言环境渲染页面的谷歌爬虫)会衡量参与度。短会话、高跳出率、低滚动深度。这些信号会让你排名下降。

我在2023年中期对一个Seahawk时尚客户的法语网站进行了A/B测试。版本A是纯DeepL输出,已校对语法。版本B是同一个DeepL基础,由本地法语编辑处理25分钟/页。六周内,版本B的跳出率降低了34%。相同的URL、相同的反向链接、相同的技术设置。只有人工润色层改变了。

---

我实际使用的工具(按顺序)

我尝试过很多东西。这是Seahawk目前的机器翻译加人工工作的技术栈。

  1. 基础翻译用DeepL Pro。不是谷歌翻译。不是设置为"翻译这个"的ChatGPT。DeepL的神经网络模型在高质量双语语料库上训练,对大多数欧洲语言的输出明显更清晰。对于日语和韩语,我更倾向于使用我们内部开发的自定义GPT-4o提示,因为DeepL的亚洲语言质量参差不齐。
  2. Phrase(前身是Memsource)用于翻译记忆和术语表管理。如果客户有品牌术语、产品名称或必须不翻译的特定标语,Phrase会在每个页面、每个冲刺、每个编辑者中保持一致。没有TM工具,你会在一个页面上看到"Shopping Cart",在另一个页面上看到"Panier",在第三个页面上看到"Panier d'achat"。一致性对爬虫很重要。
  3. 一个本地人工编辑。这是不可协商的。我使用的编辑网络主要通过Workana和ProZ招募。不是做完整改稿的专业翻译人员,那太贵也太慢。我把他们用作编辑:每800字页面20-30分钟,只关注三点:自然表达、文化参考替换和CTA语言。
  4. Surfer SEO(或Clearscope,针对某些客户)用于目标语言的页面优化。你不能使用你的英文关键词数据并假设它能完整映射。我见过客户孜孜不倦地优化一个月搜索量40次的法语关键词,而实际的高搜索量短语是略微不同的东西。Surfer的内容编辑器支持法语、德语、西班牙语、葡萄牙语和其他几种语言。
  5. 按国家属性拆分的谷歌搜索控制台。在推出任何本地化页面之前设置这个。你需要从第一天开始获得每个地区的数据。

---

人工润色简报:我告诉编辑的内容

这正是大多数流程泄漏的地方。你不能只说"让它听起来自然",然后把DeepL文档发给自由职业者。我试过。结果不一致,浪费所有人的时间。

我的标准人性化指南涵盖四个方面:

  • 语言风格:这是正式还是非正式?德语中的"du"和"Sie"是商业决策,不是语法问题。搞错了会立即发出错误的品牌定位信号。
  • 习语替换:标记源文本中的任何英文习语,要求编辑用本地等效表达替换,而不是字面翻译。"Hit the ground running"在法语中不是习语。这会造成混淆。
  • 号召性用语重写:每个号召性用语都要重新创作,而不是翻译。"Buy Now"在德语中语法上变成"Jetzt kaufen",但本地编辑可能知道"Gleich bestellen"在他们的市场转化率更高。让他们决定。
  • 长度容错:某些语言会显著扩展。德语臭名昭著。250个单词的英文部分通常在德语中会变成310多个单词。在布局模板中考虑这一点,否则每台设备上都会出现破损的设计。

Seahawk在2022年有一个SaaS客户,他们的德语版定价页面完全破坏了卡片布局,因为没有人预算了文本扩展。我们在质量检查中发现了,但花了我们两天时间。现在它在我们发送的每份指南中。

---

用目标语言进行关键词研究:从头开始

我怎么强调都不过分。你的英文关键词研究只是起点,不是地图。

2020年,我做了一个针对意大利市场的旅游网站。客户有一个英文页面,优化过"budget hotels Rome",排名稳定。我们翻译成意大利语,优化"hotel economici Roma"(直译),三个月来一直在第18位徘徊。

然后一位意大利本地编辑指出意大利用户更常搜索"hotel a basso costo Roma"或甚至"hotel conveniente Roma"。我们交换了主要关键词并重写了元标签。八周内到达第6位。相同的域名权限、相同的反向链接、相同的页面结构。

Google Keyword Planner让你切换语言和位置设置。那是你的起点。然后与Ahrefs或Semrush交叉参考,筛选目标国家。看看你真实的本地竞争对手在排名什么,而不是你假设他们会瞄准的。

还有一件事:不同市场的搜索量阈值不同。法语关键词有800次月搜索可能值得追求。在英国,我可能会跳过它。市场规模背景很重要。

---

技术设置:hreflang、子文件夹和我一直看到的错误

内容管道只是一半。技术基础架构要么放大你的工作,要么悄悄抵消它。

hreflang标签

要么做对,要么别费事。Google的hreflang文档在这方面很清楚:每个本地化页面都需要双向hreflang实现。你的英文页面指向你的法文页面,你的法文页面指回你的英文页面和其他所有地区。漏掉链条中的一个链接,整个信号就会降级。

我通过Seahawk每年审计大约40-50个网站的hreflang实现。我会说其中60%至少有一个断裂或缺失的互惠标签。在每次部署后使用Screaming Frog的hreflang验证器。

子文件夹与子域

我的默认建议是子文件夹(/fr//de/)优于子域(fr.、de.)。域名权限合并值得,子文件夹在大多数CMS设置中更容易管理。子域在非常特定的情况下有意义,通常是国际版本需要单独的CMS或有明显不同的技术架构时。

规范标签

注意指向英文页面的自我参考规范标签。这是WordPress插件的问题。某些多语言插件(我看着你呢,较旧的WPML配置)曾经在翻译页面上将规范设置为原始英文URL。这个单一的错误配置会摧毁你的整个本地化工作。在发布当天检查每个地区的规范。

---

测量管道:我关注的数字

发布后,这是我追踪的内容以及我大约期望看到变化的时间:

  • 第1-4周:GSC中每个地区的索引编制率。如果Google在两周内没有索引你的本地化页面,你有抓取或站点地图问题。
  • 第4-10周:GSC中按国家/地区划分的展示次数。展示次数先于点击次数。如果展示次数在增长,说明内容正在进入考虑阶段。如果展示次数持平,则需要重新审视关键词或内容质量。
  • 第8-16周:目标关键词的平均排名变化。这是你能看到人工优化工作发挥作用的地方。即使hreflang配置再好,跳出用户快的页面也不会在这里上升。
  • 第4个月以后:按地区划分的自然搜索会话和网站参与度。跳出率、会话时长、每个会话的页面数。这些滞后指标确认了你的内容管道产出的是真正有用的内容,还是包装过的机器翻译垃圾。

老实说,一个执行完善的机器翻译加人工优化页面,配合干净的技术设置和合理的关键词策略,通常在中等竞争度的地区能在第10到20周看到显著的排名变化。在低竞争市场速度更快。在德国或法国这样本地发行商实力强的高竞争市场速度更慢。

---

这个流程的实际成本

我给你真实数字,因为含糊的范围没用。

对于标准的800字页面翻译成一种语言:

  • DeepL Pro:按当前API定价约0.04英镑/字。一个页面大约32英镑。
  • 人工编辑:Workana上一个优秀的B2级本地编辑对一个25分钟的页面收费在18-35英镑之间。我按25英镑计算。
  • Surfer SEO内容优化步骤(内部完成):按内部成本率计算30分钟。

所以本地化页面的硬成本约55-60英镑,不含你的时间。对比全人工翻译的120-180英镑/页面。你省下了50-60%,根据我的经验,质量上限接近到Google分不出区别,前提是人工优化做得当。

你仍应该使用完全人工翻译的情况:法律内容、医学内容、任何翻译错误会造成责任的内容。不要把服务条款页面丢给DeepL就算完事了。

---

FAQ

Google会惩罚机器翻译内容吗?

不会自动惩罚。Google的垃圾政策提到"以操纵搜索排名为主要目的"创建的自动生成内容违反政策。关键词是"主要目的"。真正服务用户并使用他们语言的机器翻译内容不是目标。低质量、未编辑的机器翻译垃圾才是。人工优化层是你的保护,它也恰好能产出更好的内容。两者都对。

我应该一次性启动多少种语言?

一种,最多两种。我见过人们试图同时启动七个地区并产出平庸内容。根据流量数据和现有需求信号选择最高机会市场,好好做,从中学习,然后扩展。Seahawk通常推荐分阶段推出:第一年每季度一个地区。

我可以用ChatGPT代替DeepL吗?

可以,但有限制条件。一个精心设计的GPT-4o提示词,带有人设、风格和语气指导,对许多语言对来说能产出与DeepL竞争的输出。对亚洲语言通常更好。代价是一致性:没有TM工具在上层,你会在跨会话中看到术语变化。欧洲语言用DeepL,它表现优秀。DeepL质量较弱的语言用GPT-4o,配合提示词中仔细维护的术语表。

本地化项目中最大的单一错误是什么?

把它当翻译项目而不是内容项目。翻译是关于准确性。内容是关于效果。从你的简报只问"他们翻译得对吗?"而不是"这个页面能带来流量和转化吗?"的那一刻起,项目就已经方向不对了。

---

这个流程不是魔法。它是一个序列:强大的机器翻译基础、重点人工编辑、本地关键词研究、干净的技术实现、耐心的测量。每一步都可以跳过。但你跳过的每一步都会在约三个月后出现在你的GSC数据中,到那时你已经花完预算了。

从一开始就做对。更便宜。

← 返回