機械翻訳とSEO

機械翻訳はSEOにとって安全ですか?Googleのスケールコンテンツ乱用ポリシーは、ランキング操作を目的とした大量の未レビューMTを対象としていますが、翻訳自体は対象ではありません。ここでは、現在のポリシー、Redditの事例、MTPEワークフロー、そしてMTコンテンツが依然として必要とするhreflangレイヤーについて説明します。

初回公開:2026年7月2日 · 最終更新:2026年8月22日 · Advanced
言語

機械翻訳はSEOで禁止されていません。Googleのスケールコンテンツ乱用ポリシーが対象としているのは、ランキングを操作するために、未レビューで大量の機械翻訳ページを大規模に公開することです。トリガーとなるのは、大規模な低価値コンテンツであり、翻訳方法ではありません。Googleは2025年にこの点を明言し(AI翻訳コンテンツは「スパムとして厳密に定義されていない」)、robots.txtで自動翻訳ページをブロックするという以前のアドバイスを削除し、Redditの数千万のAI翻訳URLに対して措置を講じませんでした。大規模な標準ワークフローはMTPE(機械翻訳+人間によるポストエディット)です。なぜなら、すべてのページを100%人間が翻訳するのは通常現実的ではないからです。未レビューの生のMTダンプが実際のリスクです。そして、翻訳品質は仕事の半分に過ぎません。374 756のhreflang使用ドメインを調査したところ、67%以上に何らかのhreflangの問題があり、翻訳がどれだけ優れていても、MTコンテンツはしばしば対象オーディエンスを誤ってターゲットにしています。

TL;DR — 機械翻訳は禁止されていません。Googleのスケールコンテンツ悪用 ポリシーは、ランキングを操作するために大規模に公開される、未レビューの大量MTを対象としています。 トリガーは*“little value… to users,” (翻訳) 「ユーザーにとっての価値がほとんどない」ことであり、方法ではありません。Googleは2025年に AI翻訳コンテンツは”strictly defined… as spam,” (翻訳) 「厳密には…スパムとして定義されていない」と述べ、古い robots.txtブロックのアドバイスを削除し、Redditの数千万の AI翻訳URLに対して行動を起こしませんでした。スケールワークフローはMTPE(MT + 人間によるポストエディット)です。 なぜなら、すべてのページを100%人間が翻訳することは通常現実的ではないからです。2つの別々の 失敗モードがあります:翻訳の品質技術的なラッパー*です。私の 374 756のhreflang使用ドメインの調査では、67%以上が何らかのhreflang問題を抱えており、MTコンテンツは 翻訳が問題なくても、しばしばオーディエンスを誤ってターゲットにします。そして、もしあなたが まったく翻訳しない場合、Googleはあなたのページを自動翻訳して自社の translate.goog サブドメインに配置し、トラフィックを保持する可能性があります。

Evidence for this claim Google's scaled content abuse policy focuses on large amounts of low-value content created primarily to manipulate rankings and includes low-value automated translation as one possible technique. Scope: Google Search spam policy; machine translation is not categorically prohibited by this policy. Confidence: high · Verified: Google: Scaled content abuse Evidence for this claim Google recommends making a page's language obvious in visible content and warns that translating only boilerplate while leaving the main content unchanged can create a poor experience. Scope: Google Search guidance for multilingual page content. Confidence: high · Verified: Google: Make page language obvious

Googleは機械翻訳されたコンテンツをペナルティにしますか?

いいえ — 機械翻訳されたという理由だけでは違います。これは競合他社のコンテンツの中で最も時代遅れの主張であり、 そのほとんどはGoogleの2024年3月のポリシー改名と2025年の明確化の前に書かれたため、 今でも「Googleは自動翻訳コンテンツをペナルティにする」という包括的な主張を繰り返しています。

これが適用されるポリシーです。Googleのスパムポリシーは スケールコンテンツ悪用 (2024年3月に「自動生成コンテンツ」から改名されたセクション)を次のように定義しています:“Scaled content abuse is when many pages are generated for the primary purpose of manipulating search rankings and not helping users.” (翻訳) 「スケールコンテンツ悪用とは、検索ランキングを操作し、ユーザーを助けることを主な目的として多くのページが生成されることです。」 翻訳は一度だけ、 例の箇条書きに、スクレイピングや同義語化とグループ化されて登場します:“Scraping feeds, search results, or other content to generate many pages (including through automated transformations like synonymizing, translating, or other obfuscation techniques), where little value is provided to users.” (翻訳) 「フィード、検索結果、またはその他のコンテンツをスクレイピングして多くのページを生成すること(同義語化、翻訳、またはその他の難読化技術などの自動変換を含む)、ユーザーに提供される価値がほとんどない場合。」

それを正確に読んでください。そこには「翻訳コンテンツ」や「機械翻訳コンテンツ」が違反だと書かれていません。重要な言葉は**「多数のページを生成すること」「ユーザーに提供される価値がほとんどない場合」**です。そのパターンは、大量生成+低価値+ランキング操作の意図です。翻訳は、スクレイピングと同じ文脈で、そのパターンを犯す一つの方法として挙げられているだけで、禁止コンテンツのカテゴリとして挙げられているわけではありません。

Googleの2025年の声明 — 現在の最も明確な方針

最も引用に適した、最も新しい確認は2025年6月に得られました。Redditがサイト全体にAI翻訳を展開した後、Glenn Gabe氏がGoogleにそれが認められるかどうかを直接尋ね、Googleの広報担当者が次のように回答しました(Search Engine Landが報道):“While we don’t comment on the status of specific sites or pages, nor do we provide individualized support for any site, our policies do not strictly define content that has been translated by AI as spam. Our scaled content abuse policy mentions automated transformations, including translations, as part of the overall warning against creating large amounts of unoriginal content that provides little to no value to users.” (翻訳) 「当社は特定のサイトやページのステータスについてコメントせず、いかなるサイトに対しても個別のサポートを提供しませんが、当社のポリシーはAIによって翻訳されたコンテンツをスパムとして厳密に定義しているわけではありません。当社の大規模コンテンツ悪用ポリシーは、ユーザーにほとんどまたはまったく価値を提供しない大量の非オリジナルコンテンツを作成することに対する全体的な警告の一部として、翻訳を含む自動変換に言及しています。」

これは、Googleが平易な言葉で、まさに上記の区別を確認しているものです。AI/機械翻訳は*“strictly defined… as spam” (翻訳) 「スパムとして厳密に定義されている」*わけではありません。ポリシーの対象は、大規模で低価値な出力であり、翻訳方法そのものではありません。

2024年から2025年に変わったこと

現在のポリシーを文脈に位置づける具体的な動きが3つあります:

  • 2024年3月の名称変更。 「自動生成コンテンツ」は大規模コンテンツ悪用に変更され、コンテンツがどのように作成されたかではなく、規模における価値を中心に領域全体を再構成しました。旧「自動生成コンテンツ」のヘルプ文言(“text translated by an automated tool without human review or curation before publishing” (翻訳) 「公開前に人間によるレビューやキュレーションなしに自動ツールで翻訳されたテキスト」を例として文字通り挙げていた)は、この価値ベースの枠組みに組み込まれました。
  • 2025年のrobots.txtガイダンスの削除。 Googleは、サイト所有者に自動翻訳ページをブロックするためにrobots.txtを使用するよう指示していた長年のアドバイスを削除。変更ログでは*“This is a docs-only change, no change in behavior.” (翻訳) 「これはドキュメントのみの変更であり、動作の変更はありません。」*と特徴づけました。ポリシーが作成方法ではなくユーザー価値によってコンテンツを評価するようになると、「すべての機械翻訳ページをブロックする」という一律のルールは正しくなくなりました。特定の低品質な翻訳ページに対する正しいツールはページレベルのnoindexであり、サイト全体のrobots.txtブロックではありません。
  • 15年にわたる一貫性。 これは実際には新しいことではありません。Googleの関係者(2010年のMueller氏、2011年のCutts氏)は、「AI翻訳」という用語が使われるずっと前から、レビューされていない自動翻訳とレビューされた翻訳という同じ線引きをしていました。それは決して翻訳という技術の問題ではなく、常に規模におけるレビューされていない自動化の問題でした。

MT後の人間レビュー vs. 生の大量MT出力

これが実際の運用上重要な区別です。「SEOのための機械翻訳」と呼ばれるものには2種類あり、それらはポリシーの正反対の側に位置します:

  • 生の大量MT出力 — 数千ページがGoogle翻訳やDeepLで処理され、主に言語数を増やすために、人間によるレビューを一切行わずに公開されます。これが大規模コンテンツ悪用のリスクです。
  • MTPE(機械翻訳ポストエディット) — MTが最初のドラフトを作成し、人間の言語学者や流暢な編集者が公開前にレビューして修正します。軽度のMTPEは可読性と明らかなエラーを修正し、完全なMTPEは出力を人間による翻訳品質にまで引き上げます。

MTPEは、実際の規模において事実上の業界標準ワークフローです。それが何であるかを正確に理解しておく価値があります。それはリスク管理の実践であり、Googleの公式なコンプライアンス手順ではありません。Googleは翻訳ページに「レビュー済み」の免除やその他の正式な承認を与えるわけではありません。人間によるレビューは、スケールコンテンツ乱用ポリシーが実際に測定する価値基準の正しい側に出力を保つだけです。MTPEが支配的である理由は実用的です。すべてのページの100%人間翻訳は、数千または数百万のローカライズされたURLを十数の市場で維持している場合、通常は現実的でも手頃でもありません。生のMTは安価でリスクのある下限であり、完全な人間翻訳は高価で遅い上限です。MTPEは、エンタープライズ国際SEOが実際に存在する場所です。そして、それらすべてを正しく行うこと(流暢な出力、人間によるレビュー、技術的に有効なhreflang)は、それでもインデックス、ランキング、またはページの表示方法を保証するものではありません。それはスケールコンテンツ乱用のリスクを取り除くものであり、ランキング結果を購入するものではありません。(戦略的レイヤー、つまりいつ翻訳すべきか対完全にローカライズすべきかについては、翻訳対ローカライゼーションに関する姉妹記事で詳しく説明しています。)

翻訳ツールに何かを通す前に、もう一つ重要なこと: ページコンテンツをMT APIやLLMに送信することは、そのテキストがシステムから離れて第三者に渡ることを意味します。それに何が起こるか(保持、モデルトレーニングに使用されるかどうか、保存場所、他に誰がアクセスできるか)は、特定のプロバイダー、利用中のプラン、および管轄区域のデータ保護規則に完全に依存します。これは、個人データ、規制対象(健康/金融/法律)コンテンツ、またはNDAやライセンス制限下にあるものを含むページにとって、一般的なマーケティングコピーよりも重要です。これはSEOアドバイスではありません。実際のプランに関するプロバイダーの現在のデータ処理条件を確認し、機密性の高いものを送信する前に、会社のデータ保護/法務を担当する人に相談してください。この記事を含むいかなるSEO記事も、それを代わりに承認することはできません。

Redditのケース:方法ではなく価値によって適用されることの証明

Redditは現実世界のストレステストです。Glenn Gabeのレポート では、Redditが20以上の言語でAI翻訳を拡大し、数千万のAI翻訳URLを公開したと伝えています。Gabeは、例えばフランスで2,3M、スペインで2,4MのランキングURLを挙げています。これは、スケールコンテンツが可能な限り「スケール」に近いものです。Googleの対応は、Gabeの言葉を借りれば:“Well, nothing happened. Nothing at all.” (翻訳) 「何も起こりませんでした。まったく何も。」手動によるアクションも、アルゴリズムによる降格もありませんでした。

教訓は「生のMTを大規模に使うことは常に安全」ということではなく、Googleがポリシーを翻訳方法や量ではなく、基盤となるコンテンツが役立つかどうかに基づいて適用したということです。(フレーミングの帰属には注意してください:Redditがこのアプローチを「承認された」と特徴付けるのはRedditのフレーミングであり、Googleの引用ではありません。Googleが実際に言ったのは、上記の「スパムとして厳密に定義されていない」という声明です。)

MTコンテンツが依然として必要とする技術的レイヤー

ここが、ほとんどの報道が見逃している差別化ポイントです:翻訳品質と技術的実装は2つの別々の障害モードであり、両方を正しく行う必要があります。

専用のインデックス可能なURL — JSオーバーレイではない。 Google翻訳ウィジェットやクライアントサイドのJS翻訳オーバーレイは、検索エンジンにランキング対象となる実際の翻訳ページを提供しません。Google自身のローカライズ版ガイダンス をはじめとするマルチリージョナル文書は、言語ごとに個別のクロール可能なURLを前提としています。専用のインデックス可能なhreflangタグ付きURLなしのオンザフライ翻訳は、MT品質よりも明確な問題です。エンジンがインデックスするための翻訳されたもの自体が存在しないからです。

Hreflang — そしてそのほとんどが壊れている理由。 hreflang は、検索エンジンにどの言語・地域バージョンを誰に配信するかを伝えます。私の374 756ドメインのhreflang調査 (Brighton SEO 2023)では、hreflangを使用しているドメインの67%以上に少なくとも1つの問題がありました — x-defaultアノテーションの欠落、自己参照タグの欠落、リダイレクト先や壊れたページへの参照、相互の戻りタグの欠落、非正規URLへのポインタ、一貫性のない言語値などです。hreflangはSEOの最も複雑な側面の1つであり、相互のクラスターとしてのみ機能します。2つのページが互いに指し示していない場合、Googleはペア全体を無視します

これらを組み合わせると、実際的な意味合いは居心地の悪いものになります。翻訳ページの設定の大部分は、翻訳品質に関係なく、ターゲットオーディエンスを誤ってターゲットしています。hreflangが壊れた完全に人間が翻訳したページは、hreflangが完璧な生のMTダンプと同様にパフォーマンスが低下します。翻訳品質は必要ですが、十分ではありません。(仕組み — 3つの実装方法、相互性ルール、x-default、有効なコード — は、hreflangとx-defaultの詳細ガイドにあります。)

Googleのドキュメントからの1つの有用な明確化:翻訳されたページは自動的に重複コンテンツにはなりません。Googleは、“if the main content of the page remains untranslated” (翻訳) 「ページのメインコンテンツが未翻訳のままである場合」 — つまり、同じソース言語の本文が/de/ URLに置かれている場合にのみ、ページを重複として明示的に扱います。しかし、真に翻訳されたページは、どのように生成されたかにかかわらず、重複ではありません。

何よりも先に、最低限のゲート: 言語ごとに専用のインデックス可能なURL、JavaScriptなしで表示できる実際のメインコンテンツ、相互のhreflangクラスター(自己参照 + すべての代替 + x-default)、およびソース言語ページではなく自分自身を指す正規URL。これら4つのいずれかが欠けている場合、翻訳品質は無価値です — Googleが判断するためのインデックス可能なものがないからです。(完全なウォークスルーはDecision Treesレンズにあります。)

まったく翻訳しない場合に起こること

何も公開しないのではなく、少なくともレビュー済みのベースライン翻訳を公開するという2025年のライブなインセンティブがあります:Googleがあなたのコンテンツを自動翻訳して、自社のtranslate.googサブドメインに配置し、トラフィックを保持する可能性があります。 Ahrefsの分析 (私がレビュー)では、推定3億7700万の月間オーガニック訪問がGoogleの翻訳プロキシページを通じて流れており、インド、インドネシア、ブラジルが最も影響を受ける市場の一部です — このトラフィックは、元のパブリッシャー自身のローカライズされたページに流れていた可能性があります。

私の見解であり、私はそれを支持します:Googleは何年もhreflangシステムの改善について話してきましたが、クリエイターのローカライズを支援し続ける代わりに、事実上そのトラフィックの一部を自らのものとして主張することを決定しました。Googleはプロキシを、“there is no high-quality, local-language content available” (翻訳) 「高品質な現地語コンテンツが存在しない場合」 の場合のフォールバックとして位置づけています。Search Engine Landの報道 でも示されているこの位置づけは、通常の議論を逆転させます。実際のレビュー済みの翻訳ページがないことが、Googleがあなたのために翻訳してクリックを保持するように誘うのです。適切なhreflangを持つ、たとえ簡素でもMTPEでレビューされた母国語ページを公開することが、あなたのURLがインデックスされるようにする方法です。これは、レビュー済みMTに賛成する強力な商業的議論であり、翻訳に反対するものではありません。

Bingのアプローチ

Bing/Microsoftは、Googleのスパムポリシーのように機械翻訳に関する専用のポリシーを公開していません。Bingのウェブマスターガイドライン では、ランキングをコンテンツの品質と信頼性を中心に広く位置づけており、翻訳に特化した例外はありません。正直な見解としては、BingにはMT固有のルールはありませんが、一般的な薄い/低品質コンテンツのガイダンスは同じように適用されるでしょう。未レビューの一括MT出力は、Bing独自のポリシーではなく、薄いコンテンツのサブセットです。また、Bingはhreflangよりもcontent-languageシグナルに依存していることにも注意してください。これは技術的なラッパーで考慮する価値があります。

結論

機械翻訳は、正当で主流のSEOツールです。それを下書きとして使い、人間による品質管理(MTPE)を行い、各言語に専用のインデックス可能なURLを提供し、hreflangを正しく設定し、その出力がその市場にとって実際に役立つかどうかで判断してください。そうすれば、何かを不正に操作しているわけではありません。大規模な多言語サイトがすでに行っていることを行っているだけです。レビューを省略して、ランキングを追い求めるために生のMTを大規模に投入する場合、それこそがスケールコンテンツ乱用ポリシーが捕捉しようとしているパターンです。

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.