SonarStax 日本企業40万社の導入プロダクトを検出

よくある質問

掲載をやめてほしいのですが

掲載の停止・訂正から受け付けています。理由の説明は要りません。 → 掲載の停止・訂正

企業名や所在地はどこから来ていますか

商号・所在地・法人番号は国税庁 法人番号公表サイトの公表情報です(本サイトの内容を国税庁が保証するものではありません)。資本金・従業員数などの企業情報は経済産業省 gBizINFO(公共データ利用規約1.0)、過去の会社概要ページは Common Crawl、地図の形は国土数値情報(国土交通省)行政区域データです。プロダクトの利用は、各社がインターネット上に公開している設定(DNS レコード・Web ページ・タグマネージャ)から機械的に判定しています。非公開の情報やアクセス制限のかかった情報は使っていません。各社に問い合わせたり、アンケート・自己申告を集めたりはしていません。 → どうやって調べているか

載っている内容は、どのくらい正しいのですか

確かめているのは、会社とドメインの紐付けです。無作為に抽出して1件ずつ確かめたところ、95%以上で一致しました(確かめたのは抽出した分だけで、全件を保証するものではありません)。各プロダクトのシグナルについては、「シグナル」から実際に観測した値をご自身で確かめられます。事実と異なる記載は訂正します。 → 掲載の停止・訂正

「検出できなくなった」は解約という意味ですか

違います。設定を整理した、メールの仕組みを変えた、別の方式にした —— 使い続けていてもシグナルは消えます。だからこのサイトでは解約とは書かず、「いつ・どの方法で・検出できなくなったか」だけを記録しています。それでも「何かしらアクティビティがあった会社」は分かります。

うちが使っているサービスが載っていません

外から見えないサービスは検出できません。会計ソフトや人事システムのように、Web サイトにもメール設定にも痕跡が出ないものは、契約していても出てきません。カタログに登録していないプロダクトも出ません。出しているのは「見つかった」という事実だけで、網羅はしていません。

「いま検出できている」「何も検出されていない」の違いは

「いま検出できている」は、最新の観測でシグナルが1件以上出ているドメインです。「いまは何も検出されていない」は、観測はできたのに1件も出なかったドメインで、過去にだけ検出できたものもこちらに入ります。どちらも使っている・使っていないの証明ではありません。

同じサイトを複数の会社で使っている場合は

検出はドメイン単位です。グループ会社が1つのコーポレートサイトを共有していると、同じドメインに複数の法人が紐づき、同じ検出結果が全社に出ます。その会社が個別にそのプロダクトを契約しているとは限りません。共有しているドメインは、企業ページにそう書いています。

載っている内容が事実と違います

掲載の停止・訂正から受け付けています。やめたあとも設定が残っている(使っていないのに痕跡がある)ことはあり得ます。 → 掲載の停止・訂正

日付は導入日ですか

いいえ、こちらが最初に検出できた月です。観測を始める前のことは分かりません。10年前から使っているサービスでも、初観測は最近になります。

サイトに負荷はかかりますか

相手企業の Web サーバを取得するのは HTTP の確認だけで、robots.txt に従い、連絡先を名乗って1社あたり1〜2ページ、間隔を空けて取得します。DNS の確認は相手の Web サーバには当たりませんが、公開リゾルバのキャッシュに無い問い合わせは相手の権威 DNS へ回ります。タグマネージャの確認が当たるのはタグ配信のホストです。いずれも毎秒の件数に上限を置いています。 → データの情報源

robots.txt は見ていますか

見ています。Web ページを取る前に robots.txt を確かめ、拒否されていれば取りに行きません(転送先や www 付きもホストごとに見ます)。Crawl-delay があればその秒数を空けます。User-agent にはこのサイトの URL を入れて名乗っています。DNS とタグマネージャの確認は相手の Web サーバに当たらないため、対象外です。 → データの情報源

ロゴが表示されていますが、権利は