なぜDatadogやNew Relicがあっても、障害の原因が分からないのか

なぜDatadogやNew Relicがあっても、障害の原因が分からないのか

多くの企業は、すでに Zabbix、Datadog、New Relic、Dynatrace などの監視ツールを導入しています。
それでも、障害の第一報が顧客から届き、原因が分からないまま報告書を書くことがあります。
理由は、これらのツールが主に見ているのが「自社のシステム」であり、「顧客が利用しているインターネット」ではないからです。

監視ツールの種類と、主に見ている範囲
監視ツールの種類(例)主に見ている範囲
サーバ監視(Zabbix など)サーバのCPU、メモリ、ディスク、プロセス
APM・オブザーバビリティ(Datadog、New Relic、Dynatrace など)アプリケーションの処理、ログ、トレース、クラウドのメトリクス
SpeedData利用者が通るISP、モバイル回線、DNS、CDN、BGP経路

これらのツールにも合成監視の機能はありますが、計測拠点の多くはクラウドのデータセンターに置かれています。
クラウドから計測しても、ISPやモバイル回線など、利用者のいる回線で起きている問題は捉えられません。
SpeedData は既存の監視ツールを置き換えるものではありません。Datadog や New Relic と連携し、サーバの内側と外側の両方を見られるようにします。

他の監視ツールには見えていないもの

クラウド依存からの脱却

実ユーザが利用している回線

「AWS から AWS を監視する」矛盾を解決します。
多くの合成監視ツールはクラウド上で動いています。つまり、対象のクラウドの特定のリージョンに障害が起きれば、監視システム自体も影響を受けるリスクがあります。
SpeedData は、主要クラウドとは独立した「実ユーザーのいる場所(ISP/キャリア網)」に独自の物理計測センターを持っています。

本当の 5G 品質を可視化

モバイル計測

シミュレーションではなく、実機・実回線です。
「モバイル対応」を謳う他社ツールの多くは、データセンター内の PC 上で回線速度を人為的に制限(スロットリング)しただけのシミュレーションです。
私たちは、日本の MNO 4 社の SIM と実際のモデムを運用・管理しています。基地局の混雑やパケット詰まりなど、シミュレータでは絶対に見えない「現場のネットワークの真実」を捉えます。

「東京以外」の現実を知る

地方での計測

日本は東京だけではありません。
大規模アクセスサイトにおいて、CDN のキャッシュはエッジプレースメントで適切に効いていますか? 北海道や九州のユーザーには、遠いオリジンサーバから配信されていませんか?
首都圏と地方都市では、BGP ルーティングもレイテンシも全く異なります。国内 7 都市に物理拠点を持つ私たちだけが、地域特有の機会損失を正確に可視化します。

私たちだけが提供できる「独占的価値」

SpeedData は、他社が模倣できない物理インフラ・専門人材・運用体制の組み合わせで、独自の価値を実現しています。

物理計測インフラ (Asset)

Spelldata 物理インフラ

他社が模倣できない物理的な参入障壁。
国内 7 都市(札幌・仙台・新潟・東京・名古屋・大阪・福岡)に「物理的な計測センター」を自社で賃借・運用し、NTT/KDDI の光回線と docomo/au/SoftBank/楽天モバイルの 4 キャリア SIM を契約・維持管理しています。
AWS や Azure に障害が起きても、私たちの監視網は独立して稼働し続けます。NTT/KDDI 光回線と 4 キャリア SIM 全社を、国内 7 都市で同時に自社運用する計測ネットワークです。

専門家集団 (Expertise)

統計的品質管理に基づく、専門家集団の分析力。
Spelldata は、従業員に対し毎日午前 3 時間の学習・研究時間を設け、パフォーマンスエンジニアの育成に注力しています。統計的品質管理、実験計画法、RFC レベルの技術的正確性が、私たちの分析の基盤です。
Web パフォーマンス、DNS、メール認証、ネットワーク経路の全領域において、原因特定と改善提案まで行える専門家チームを国内に保有しています。

リアルタイム運用 (Service)

24/365 で異常を即検知、即通知。
計測間隔は 1 分単位で設定可能。閾値を超えた異常は Slack、PagerDuty、Webhook 経由で即座に通知します。
計測スクリプトの設計、データ分析、改善実装までを、専門家チームが支援します。お客様が「ツールを使いこなす」必要はありません。

SpeedData の機能一覧を見る