PR ハイジャックと同様に、私は、多くの場合、罪のないウェブマスターに大きな損害を与える可能性があるため、防止するのがより困難なブラックハット フレーミング手法について積極的に議論したくありませんでした。 2 日前の SEO のケースで、プロキシ ハイジャックについて触れました。プロキシ ハイジャックとは何かと尋ねられた方がいました。今日はそれを説明したいと思います。このようなことは諸刃の剣です。悪意のある人にとっては、他人に危害を加え、自分に利益をもたらすもう 1 つの手段となります。一方、すでに大きな被害を受けているウェブマスターにとっては、これを読むことで予防や回復に役立つかもしれません。 簡単に言えば、プロキシ ハイジャックとは、検索エンジンがプロキシ サーバーを介して閲覧された Web ページを含め、元の実際の Web ページを罰したり削除したりすることを意味します。 国内のウェブマスターはプロキシ サーバーに精通している必要があります。プロキシ サーバーを使用して他の Web サイトにアクセスする場合、ブラウザーに表示される URL は通常、次のようになります。 http://www.proxysite.com/proxy/www.proxysite.com このうち、proxysite.com はプロキシ サーバーのドメイン名であり、proxysite.com は実際にアクセスしたい Web サイトです。 この種の URL をブラウザで開くことには確かに問題はありませんが、検索エンジンがこの種の URL をクロールすると、元の Web サイトと完全に重複したコンテンツの Web ページが形成されます。重複コンテンツのページはほとんどの場合単に無視されますが、場合によっては検索エンジンが誤った判断を下し、元のバージョンをコピーとしてペナルティを課したり削除したりすることがあります。 一般的に、プロキシ経由でアクセスされる URL はインデックス化されません。しかし、誰かが悪意を持ってこのプロキシ URL にリンクすると、検索エンジンもそれにアクセスしてクロールします。 プロキシによるランキングの乗っ取りを防止または復元するにはどうすればよいでしょうか? 最も簡単な方法は、Web ページがプロキシによってハイジャックされていることがわかった場合は、プロキシ サーバーの IP アドレスを確認し、自分のサーバーでその IP アドレスをブロックして、クロールを禁止することです。 しかし、プロキシ サーバーの IP アドレスは変更される場合があり、プロキシ サーバーの数が多いとすべてをブロックすることが不可能になる場合があります。より複雑な方法は、サーバーがプログラムを使用して、訪問者が検索エンジン スパイダーであるかどうか、また実際の検索エンジン スパイダーであるかどうかを識別します。 場合によっては、プロキシ URL 経由でアクセスするときに検索エンジン スパイダーが使用するブラウザー タイプ (ユーザー エージェント) が、検索エンジン スパイダーのブラウザー タイプのままになることがあります。ただし、プロキシ サーバーの中には、元の IP アドレスとユーザー エージェントを隠すように設定されているものもあり、検索エンジン スパイダーであるかどうかを判断するのが非常に困難になります。 このとき、ウェブサイト プログラムは、訪問者が実際の検索エンジン スパイダーであるかどうかを積極的に検証する必要があります。プログラムがそれが本当に本物のスパイダーであることを確認すると、通常のページに戻ります。ユーザーがスパイダーではなく、通常のユーザー、または偽のスパイダーであることが検出された場合、返される Web ページに noindex タグと nofollow タグが追加されます。この方法では、プロキシ経由でアクセスした場合、これらの元の Web ページは検索エンジンによってクロールされません。 2月にGoogleのBlackboardとWebmaster Blogに掲載された、Googleスパイダーの検証方法に関するMatt Cutts氏の投稿(Matt Cutts氏の元の投稿は自身のブログではなく、Webmaster Blogの英語版に掲載されていた)は、面白半分に投稿されたのではなく、深い意味がある。これまでのところ、引用リンクとコメントがゼロであることから判断すると、ほとんどの人はこの投稿が何についてのものか全く分かっていない。 理論的には、検索エンジンはこの種のプロキシハイジャックを判断する方法を持っている必要があります。そうしないと、一部の人々が競合他社を陥れる簡単な方法になってしまいます。しかし、どんなアルゴリズムにも抜け穴は存在します。たとえアルゴリズムが 99% の正しい判断を下すことができたとしても、網をすり抜けた 1 つのエラーによって、無実の Web サイトが削除されてしまう可能性があります。 この記事は、より多くの人に知ってもらい、より効果的に予防できるようになることを願って書きました。誰もが、他人を陥れるためにこの方法を使うことを嫌うだろうと私は信じています。 私が記事を書くとき、それを理解できる人が少なければ少ないほど良いと考えることはめったにありません。これは一つです。 元のタイトル: プロキシハイジャックとは何ですか? キーワード: |
Kubernetes は、最も人気のあるコンテナ オーケストレーションおよびデプロイメント プラット...
ソーシャル ネットワーキング サイトでの実名認証は、企業がソーシャル ネットワーク マーケティングを...
諺にあるように、軍隊が出発する前に、まず食糧と飼料を送らなければなりません。ウェブサイトを成功させた...
過去 10 年間で、接続されたデバイスの数とそれらが生成するデータの量は飛躍的に増加しました。一般的...
翻訳者 |崔浩企画 |徐潔成1. はじめに時間はお金や安全に等しいと認識したとき;データコンプライア...
2018年最もホットなプロジェクト:テレマーケティングロボットがあなたの参加を待っていますA5 St...
今日、ますます多くの企業がオンプレミスのデータセンターからクラウド コンピューティング環境に業務を移...
1. はじめに仮想番号は、インターネット技術に基づいた電話番号サービスです。電話番号をユーザーの携帯...
ルーマニアのホスティング プロバイダーである Hostsolutions は、大容量ハード ディスク...
新しい Web サイトを構築する初期段階では、多くの Web 管理者にとって最大の懸念は、Web サ...
ウェブサイトの成功は、検索エンジンのホームページにランクインしているキーワードの数ではなく、ホームペ...
「私は36Kr、Huxiu、Leifengをよく読んでいます。初期段階の投資家として、国内のテクノロ...
Hosthatch は、アジア太平洋データセンターにトランジットを追加し、浙江省のネットワーク パフ...
南都日報地図:宋小偉テンセントは10億元のセキュリティ基金を設立し、百度と手を組んで奇虎360に対抗...
本日のDianshi SEM ConferenceでのXingjianのスピーチの内容です。多くのS...