PR ハイジャックと同様に、私は、多くの場合、罪のないウェブマスターに大きな損害を与える可能性があるため、防止するのがより困難なブラックハット フレーミング手法について積極的に議論したくありませんでした。 2 日前の SEO のケースで、プロキシ ハイジャックについて触れました。プロキシ ハイジャックとは何かと尋ねられた方がいました。今日はそれを説明したいと思います。このようなことは諸刃の剣です。悪意のある人にとっては、他人に危害を加え、自分に利益をもたらすもう 1 つの手段となります。一方、すでに大きな被害を受けているウェブマスターにとっては、これを読むことで予防や回復に役立つかもしれません。 簡単に言えば、プロキシ ハイジャックとは、検索エンジンがプロキシ サーバーを介して閲覧された Web ページを含め、元の実際の Web ページを罰したり削除したりすることを意味します。 国内のウェブマスターはプロキシ サーバーに精通している必要があります。プロキシ サーバーを使用して他の Web サイトにアクセスする場合、ブラウザーに表示される URL は通常、次のようになります。 http://www.proxysite.com/proxy/www.proxysite.com このうち、proxysite.com はプロキシ サーバーのドメイン名であり、proxysite.com は実際にアクセスしたい Web サイトです。 この種の URL をブラウザで開くことには確かに問題はありませんが、検索エンジンがこの種の URL をクロールすると、元の Web サイトと完全に重複したコンテンツの Web ページが形成されます。重複コンテンツのページはほとんどの場合単に無視されますが、場合によっては検索エンジンが誤った判断を下し、元のバージョンをコピーとしてペナルティを課したり削除したりすることがあります。 一般的に、プロキシ経由でアクセスされる URL はインデックス化されません。しかし、誰かが悪意を持ってこのプロキシ URL にリンクすると、検索エンジンもそれにアクセスしてクロールします。 プロキシによるランキングの乗っ取りを防止または復元するにはどうすればよいでしょうか? 最も簡単な方法は、Web ページがプロキシによってハイジャックされていることがわかった場合は、プロキシ サーバーの IP アドレスを確認し、自分のサーバーでその IP アドレスをブロックして、クロールを禁止することです。 しかし、プロキシ サーバーの IP アドレスは変更される場合があり、プロキシ サーバーの数が多いとすべてをブロックすることが不可能になる場合があります。より複雑な方法は、サーバーがプログラムを使用して、訪問者が検索エンジン スパイダーであるかどうか、また実際の検索エンジン スパイダーであるかどうかを識別します。 場合によっては、プロキシ URL 経由でアクセスするときに検索エンジン スパイダーが使用するブラウザー タイプ (ユーザー エージェント) が、検索エンジン スパイダーのブラウザー タイプのままになることがあります。ただし、プロキシ サーバーの中には、元の IP アドレスとユーザー エージェントを隠すように設定されているものもあり、検索エンジン スパイダーであるかどうかを判断するのが非常に困難になります。 このとき、ウェブサイト プログラムは、訪問者が実際の検索エンジン スパイダーであるかどうかを積極的に検証する必要があります。プログラムがそれが本当に本物のスパイダーであることを確認すると、通常のページに戻ります。ユーザーがスパイダーではなく、通常のユーザー、または偽のスパイダーであることが検出された場合、返される Web ページに noindex タグと nofollow タグが追加されます。この方法では、プロキシ経由でアクセスした場合、これらの元の Web ページは検索エンジンによってクロールされません。 2月にGoogleのBlackboardとWebmaster Blogに掲載された、Googleスパイダーの検証方法に関するMatt Cutts氏の投稿(Matt Cutts氏の元の投稿は自身のブログではなく、Webmaster Blogの英語版に掲載されていた)は、面白半分に投稿されたのではなく、深い意味がある。これまでのところ、引用リンクとコメントがゼロであることから判断すると、ほとんどの人はこの投稿が何についてのものか全く分かっていない。 理論的には、検索エンジンはこの種のプロキシハイジャックを判断する方法を持っている必要があります。そうしないと、一部の人々が競合他社を陥れる簡単な方法になってしまいます。しかし、どんなアルゴリズムにも抜け穴は存在します。たとえアルゴリズムが 99% の正しい判断を下すことができたとしても、網をすり抜けた 1 つのエラーによって、無実の Web サイトが削除されてしまう可能性があります。 この記事は、より多くの人に知ってもらい、より効果的に予防できるようになることを願って書きました。誰もが、他人を陥れるためにこの方法を使うことを嫌うだろうと私は信じています。 私が記事を書くとき、それを理解できる人が少なければ少ないほど良いと考えることはめったにありません。これは一つです。 元のタイトル: プロキシハイジャックとは何ですか? キーワード: |
昨晩Weiboをチェックしていたところ、興味深い話題が2つ見つかったので、返信し、ネットユーザーのコ...
みなさんこんにちは、私はXiaosiです。フォーラムで何人かのSEO担当者とこの話題について話し合い...
マーケティング界のベテランとして、コカコーラは再び国境を越えたマーケティングを展開しました。今回のC...
APPの説明はAPPの現在のコンバージョンに大きな影響を与えており、 ASOは非常に重要です。今日は...
5G の高速性と低遅延性をエッジ コンピューティングの処理能力と組み合わせることで、IoT とモバイ...
chicagovps プロモーションがまたやって来ました。興味ありますか? !特価サーバー:ロサンゼ...
インターネットが拡大し続けるにつれ、特定の情報を検索すると、ますます多くの Web サイトが非常に類...
01大手ブランドの成功は多くの幻想を覆い隠す可能性があり、ブランド名についても同じことが言えます。大...
モルドバに登録されている pq.hsoting は、世界中の複数のデータセンターで VPS を提供し...
百度自社製品の重みは明らかです。多くのウェブマスターが百度製品に取り組もうと奮闘しています。百度知識...
2009年に設立されたHostlixは、仮想ホスティング、VPS、独立サーバーを主な事業とするロシア...
IT 業界の発展と変化に伴い、IT アプリケーションの基盤となるサポートも、メインフレーム、ミニコン...
電子商取引を行う者にとって、将来的にさらに大きく成長し、強くなりたいのであれば、百度入札広告は間違い...
オンラインの世界には、何百億ものウェブページが存在します。検索エンジンはそれらのほとんどを分類し、ラ...
Lanyou Digital Store のスクリーンショット (写真提供: Sina Techno...