2023年初頭、あるクライアントが本気の悲鳴を上げて電話をくれた。あるエージェンシー(Seahawkではない、念のため)にフランス語、ドイツ語、スペイン語へのローカライゼーションで約14,000ポンド払ったのだ。8ヶ月後、3つのロケールからのオーガニックインプレッションはゼロ。コンテンツは存在した。Googleはインデックスした。誰もクリックしない、誰もランクしない、誰も理由がわからない。
ドイツ語の製品ページを引き上げた。3文目で問題を見つけた。コピーは2011年のGoogle翻訳のスクリーンショットのように読めた。技術的には正確。完全に不自然。「Das Produkt ist sehr gut für Ihre Bedürfnisse geeignet.」なんて書くドイツ語話者はいない。ロボットがPowerPointの甲板を転写していない限りは。
それが機械翻訳の罠だ。そして私はそれを常に見ている。Seahawkで触れた12,000以上のサイト全体で。生のMT出力がランクしないのはGoogleの品質シグナルが技術的に正確な外国語テキストに騙されないからだ。ユーザーもそうだ。ユーザーが4秒でバウンスするとき、ランキングシグナルループは急速に崩壊する。
実際に機能するパイプラインはこれだ。
---
なぜ生のMTが検索で失敗するのか(そしてあなたが思っているのではない理由)
ほとんどの人はMTが文法エラーで失敗すると仮定する。それは誤った診断だ。
DeepLのような最新ツールは本当に素晴らしい。DeepLの翻訳、特にヨーロッパ言語では文法的にきれいなことが多い。問題はもっと微妙だ:文化的レジスタと検索意図のミスマッチ。
言語全体の検索意図の問題
フランス語ユーザーが「chaussures de course femme pas cher」をGoogleに入力するとき、彼らは非常に具体的な意図を示している。あなたの「cheap women's running shoes」ページの文字通りの英語からフランス語への翻訳はおそらくそのフレーズを生成するだろう。いい。だが本文、見出し、FAQ構造、読者への対応方法、すべてがフランス語の衣装を着た英語のコンテンツのリズムを持つだろう。
フランス語の読者は気づく。フランス語のクローラー(つまり、frロケールのページをレンダリングするGooglebot)はエンゲージメントを測定する。短いセッション、高いバウンス、低いスクロール深度。これらのシグナルはあなたを下げる。
2023年半ばに、Seahawkのファッションクライアントのフランス語サイトでA/Bテストを実行した。バージョンAは純粋なDeepL出力で、文法校正済み。バージョンBは同じDeepLベースで、ネイティブフランス語編集者によるページあたり25分の作業を通した。6週間以内にバージョンBはバウンス率が34%低かった。同じURL、同じバックリンク、同じ技術的セットアップ。人間化層だけが変わった。
---
実際に使うツール(順番に)
見てくれ、私は多くのことを試した。これがMT+人間作業のための現在のSeahawkスタックだ。
- ベース翻訳にはDeepL Pro。Google翻訳ではない。ChatGPTを「これを翻訳して」に設定するのではない。DeepLのニューラルモデルは高品質な二言語コーパスで訓練されており、ほとんどのヨーロッパ言語の出力は大幅にきれいだ。日本語と韓国語については、内部で構築したカスタムGPT-4oプロンプトに傾く。DeepLのアジア言語品質はむらがあるから。
- 翻訳メモリと用語集管理にはPhrase(旧Memsource)。クライアントがブランド用語、製品名、または翻訳してはいけない特定のタグラインを持っている場合、Phraseはすべてのページ、すべてのスプリント、すべての編集者で一貫性を保つ。TM工具なしでは、あるページでは「Shopping Cart」、別のページでは「Panier」、3番目のページでは「Panier d'achat」を得る。クローラーにとって一貫性は重要だ。
- ネイティブ人間編集者。これは譲れない。主にWorkanaとProZから調達したフリーランサーのネットワークを使う。新鮮なパスをする専門翻訳者ではない。それは高くて遅い。編集者として使う:ページあたり800単語あたり20~30分、3つのことだけに焦点を当てる:自然な言い回し、文化的参考の入れ替え、CTA言語。
- ターゲット言語でのページ上最適化にはSurfer SEO(一部のクライアントではClearscope)。英語のキーワードデータを使ってきれいにマッピングされると仮定することはできない。フランス語のキーワードに執着的に最適化してクライアントを見たことがある。月あたり40の検索を得るフレーズ。実際の大量検索フレーズは少し異なるもの。Surferのコンテンツエディターはフランス語、ドイツ語、スペイン語、ポルトガル語、その他いくつかで機能する。
- 国プロパティごとに分割されたGoogle Search Console。ローカライズされたページを1つも起動する前にこれを設定する。初日から場所ごとのデータが必要だ。
---
人間化ブリーフ:編集者に伝えることの内容
ここがほとんどのパイプラインが漏れる箇所です。「自然な響きにしてくれ」と言ってDeepLのドキュメントをフリーランサーに送るだけではいけません。私も試しましたが、結果がばらばらになり、みんなの時間を無駄にします。
私の標準的なヒューマナイゼーションブリーフは4つのことをカバーしています:
- レジスター:これは形式的か非形式的か?ドイツ語の「du」と「Sie」はグラマーの問題ではなく、ビジネス上の決定です。間違えると、すぐにブランドポジショニングが間違ったシグナルを発します。
- イディオムの入れ替え:ソース内の英語イディオムにフラグを立て、編集者に文字通り翻訳するのではなく、ネイティブに相当する表現に置き換えるよう指示します。「Hit the ground running」はフランス語ではイディオムではありません。混乱の元です。
- CTA の書き直し:すべての行動喚起は翻訳ではなく、新たに書き直します。ドイツ語での「Buy Now」は文法的には「Jetzt kaufen」になりますが、ネイティブ編集者は「Gleich bestellen」のほうが彼らの市場でより高い成約率をもたらすことを知っているかもしれません。編集者に決めさせましょう。
- 長さの許容範囲:言語によっては大幅に拡張されます。ドイツ語は特に有名です。英語の250語セクションは、しばしばドイツ語では310語以上になります。レイアウトテンプレートにこれを考慮しないと、すべてのデバイスでデザインが崩れます。
Seahawkは2022年にSaaSクライアントを担当していたのですが、価格設定ページのドイツ語版がテキスト拡張の予算がなかったため、カードレイアウトが完全に崩れてしまいました。QAで検出しましたが、2日間のコストがかかりました。現在、すべてのブリーフに含まれています。
---
ターゲット言語でのキーワード調査:最初からやり直す
これ以上に強調することはできません。英語のキーワード調査は出発点であり、地図ではありません。
2020年、イタリア市場をターゲットにする旅行サイトに取り組みました。クライアントは「budget hotels Rome」で堅調にランクされている英語ページを持っていました。イタリア語に翻訳し、文字通りの翻訳である「hotel economici Roma」で最適化しましたが、3ヶ月間は18位でほぼ動きませんでした。
その後、ネイティブのイタリア語編集者が、イタリアユーザーは「hotel a basso costo Roma」またはさらには「hotel conveniente Roma」をより一般的に検索していることを指摘しました。プライマリフレーズを入れ替え、メタを書き直しました。8週間以内に6位になりました。ドメインオーソリティ、バックリンク、ページ構造は同じでした。
Google Keyword Plannerを使うと、言語と地域の設定を切り替えることができます。これが出発点です。その後、AhrefsまたはSemrushをターゲット国にフィルタリングして相互参照します。あなたが想定するターゲットではなく、実際のローカルライバルがランキングしているものを確認します。
もう1つ:検索ボリュームの閾値は市場によって異なります。月間800回の検索量があるフランス語キーワードは対象にしているかもしれません。イギリスでは、おそらくスキップします。市場規模のコンテキストが重要です。
---
技術的なセットアップ:hreflang、サブフォルダ、繰り返し見ている間違い
コンテンツパイプラインはそれの半分に過ぎません。技術的な足場は、あなたの仕事を増幅するか、静かに打ち消すかのどちらかです。
hrefLangタグ
正しく設定するか、設定しないかです。Googleのhreflangドキュメントはこれについて明確です:ローカライズされたすべてのページは、双方向hreflang実装が必要です。英語ページはフランス語ページを指し、フランス語ページはあなたの英語ページと他のすべてのロケールを指し返します。チェーン内の1つのリンクを見落とすと、シグナル全体が低下します。
Seahawkを通じて、おそらく年間40~50サイトのhreflang実装を監査しています。60%以上に少なくとも1つの壊れているか欠落している相互タグがあると言えます。毎回のデプロイ後、Screaming FrogのhrefLangバリデータを使用してください。
サブフォルダ対サブドメイン
私のデフォルトの推奨事項は、サブドメイン(fr.、de.)よりもサブフォルダ(/fr/、/de/)です。ドメインオーソリティの統合の価値があり、サブフォルダはほとんどのCMS設定で管理しやすいです。サブドメインは非常に特定の状況、通常は国際バージョンが別のCMSを必要とするか、大幅に異なる技術アーキテクチャを持つ場合に意味があります。
正規タグ
英語ページを指す自己参照正規タグに注意してください。これはWordPressプラグインの問題です。一部のマルチリンガルプラグイン(古いWPML設定を見ています)は、翻訳されたページの正規タグを元の英語URLに設定するために使用されていました。この単一の誤設定があれば、ローカライゼーション全体が崩壊します。ローンチの日に、すべてのロケールの正規タグを確認してください。
---
パイプラインの測定:私が見ている数字
ローンチ後、ここで私が追跡し、おおよそいつ動きが見えるかを期待しています:
- 週1~4週目:GSCでのロケール別インデックス率。Googleがローカライズされたページを2週間以内にインデックスしていない場合、クロールまたはサイトマップに問題があります。
- 週4~10週目:GSCの国別インプレッション数。クリック前のインプレッション。インプレッション数が増加していれば、コンテンツが検討段階に入っています。インプレッション数が横ばいなら、キーワードまたはコンテンツ品質を再検討する必要があります。
- 週8~16週目:ターゲットフレーズの平均掲載順位の推移。ここで人間化作業の効果が現れると予想される場所です。ユーザーをすぐに離脱させるページは、hreflangの質がどれだけ高くても、ここでは上昇しません。
- 4ヶ月目以降:ロケール別のオーガニックセッション数とサイト内エンゲージメント。離脱率、セッション継続時間、セッションあたりのページ数。これらは、パイプラインが本当に有用なコンテンツを生み出したのか、それとも飾り付けられたMTのスラップなのかを確認する遅延指標です。
率直な答え:適切に実行されたMT+人間化ページは、クリーンな技術設定と合理的なキーワードターゲティングにより、中程度の競争力のあるロケールでは通常、週10~20の間に意味のあるランキング変動を示します。低競争市場ではより速く進みます。ドイツやフランスのような高競争市場ではより遅く進みます。ここではローカルパブリッシャーが強力です。
---
このパイプラインの実際のコスト
曖昧な範囲は役に立たないため、実際の数字をお示しします。
標準的な800語のページを1言語に翻訳する場合:
- DeepL Pro:現在のAPI価格で1語あたり約£0.04。ページあたり£32と考えてください。
- 人間の編集者:WorkanaのB2レベルの優れたネイティブ編集者は、25分間のパスで1ページあたり£18~35を請求します。私は£25を予算計上しています。
- Surfer SEO コンテンツ最適化パス(社内で実行):社内レートで30分。
したがって、ローカライズされたページの実コストは、あなたの時間を除いて約£55~60です。フル人間翻訳の£120~180と比較してください。50~60%を節約でき、私の経験では、人間化が適切に行われた場合、品質の上限は十分に近いため、Googleは違いを識別できません。
フル人間翻訳を使用すべき場所:法務コンテンツ、医療コンテンツ、誤訳がリスクを生じる場合。利用規約ページをDeepLで実行して完了と呼ばないでください。
---
FAQ
Googleは機械翻訳コンテンツにペナルティを与えますか?
自動的にはありません。Googleのスパムポリシーでは、「検索ランキングを操作する主要な目的」で作成された自動生成コンテンツが違反として言及されています。重要なフレーズは「主要な目的」です。ユーザーのために彼らの言語で本当に役立つMTコンテンツはターゲットではありません。低品質で編集されていないMTスパムです。人間化レイヤーがここでの保護になり、また、より良いコンテンツを生成することにもなります。両方とも真実です。
一度に何言語を立ち上げるべきですか?
1言語、最多でも2言語。7つのロケールを同時に立ち上げようとして、すべてのコンテンツを平凡にしている人を見てきました。トラフィックデータと既存の需要シグナルに基づいて、最も高い機会のある市場を選択し、適切に実行し、そこから学んでから拡張してください。Seahawkは通常、段階的なロールアウトを推奨しています:初年度の最初の1年間で1四半期あたり1つのロケール。
DeepLの代わりにChatGPTを使用できますか?
はい、注意点があります。ペルソナ、レジスター、トーン指示を含むよく設計されたGPT-4oプロンプトは、多くの言語ペアでDeepLと競合する出力を生成できます。アジア言語の方が優れていることが多いです。トレードオフは一貫性です。TMツールがその上にない場合、セッション全体でターミノロジーの変動が生じます。DeepLが優れているヨーロッパ言語にはDeepLを使用してください。DeepLの品質が弱い言語にはGPT-4oを使用し、プロンプトで慎重に維持されるグロッサリーを使用してください。
ローカライゼーションプロジェクトにおける最大の誤りは何ですか?
それをコンテンツプロジェクトではなく翻訳プロジェクトとして扱うこと。翻訳は正確性についてです。コンテンツはパフォーマンスについてです。ブリーフが「これは正しく翻訳されましたか?」ではなく「このページはトラフィックを得られ、訪問者を変換しますか?」と尋ねるようになった瞬間、プロジェクトはすでに間違った方向を向いています。
---
パイプラインは魔法ではありません。それはシーケンスです:強いMTベース、焦点を絞った人間編集、ネイティブキーワード調査、クリーンな技術実装、忍耐強い測定。各ステップはスキップ可能です。しかし、スキップするすべてのステップは、約3ヶ月後にGSCデータに表示され、その時点までに予算はすでに費やされています。
初回から正しく実行してください。その方が安価です。
