2 分で読了
0 views

ログ異常検知における少数トークンでの教師なし手法

(Unsupervised Log Anomaly Detection with Few Unique Tokens)

さらに深い洞察を得る

AI戦略の専門知識を身につけ、競争優位性を構築しませんか?

AIBR プレミアム
年間たったの9,800円で
“AIに詳しい人”として
一目置かれる存在に!

プレミア会員になって、山ほどあるAI論文の中から効率よく大事な情報を手に入れ、まわりと圧倒的な差をつけませんか?

詳細を見る
【実践型】
生成AI活用キャンプ
【文部科学省認可】
満足度100%の生成AI講座
3ヶ月後には、
あなたも生成AIマスター!

「学ぶ」だけではなく「使える」ように。
経営者からも圧倒的な人気を誇るBBT大学の講座では、3ヶ月間質問し放題!誰1人置いていかずに寄り添います。

詳細を見る

田中専務

拓海さん、最近うちの現場で「ログの異常検知を自動化しろ」と言われましてね。ログはいっぱいあるけど、同じ文言ばかりで困っていると部長が。こういうの、本当にAIで拾えるものなんですか?

AIメンター拓海

素晴らしい着眼点ですね!大丈夫、できますよ。今回の論文は「似た文面ばかりで学習データが少ない」場合でも、順序の乱れや文脈の外れを検出する手法を示しています。要点を3つで言うと、事前処理でノイズを減らす、ログを数値ベクトルに変える、そして順序をモデル化して確率で評価する、です。

田中専務

これって要するに、ログの中身だけじゃなくて「出た順番」を見ておけばおかしな挙動を見つけられる、ということですか?

AIメンター拓海

そうなんですよ。ログの文面が限られている環境では、単発の文言だけを評価しても見落としが出ます。順序のパターンを学ぶことで、普段の流れと違う箇所や珍しい組み合わせが確率的に低くなるため、そこをアラート化できるんです。

田中専務

投資対効果の観点では、学習に大量のラベル付けが要らない点が魅力に思えますが、本当に現場で使えるレベルの誤検知率になるんでしょうか。人手の確認は減りますか?

AIメンター拓海

良い質問ですね。結論から言うと、誤検知はゼロにはならないが、人手による全面監視よりは現実的だと言えるんです。理由は三つあります。まず、手作業のラベル付けコストが不要で即時導入できること。次に、モデルが順序を見ているため通常のノイズに鈍感な点。そして最後に、確率的スコアで閾値調整ができ、運用側のリスク許容に合わせやすい点です。

田中専務

導入はどの程度技術的に難しいですか。うちの現場担当はクラウドも苦手でして。オンプレで動かせますか?

AIメンター拓海

心配いりません。一緒に整備すればオンプレでも十分です。実装は概ね四工程で、前処理、埋め込み生成、順序モデル学習、スコアリングです。前処理は正規表現程度、埋め込みは既成のWord2Vec(Word2Vec)や類似手法で平均ベクトルを取るだけ、順序モデルはHidden Markov Model(HMM:隠れマルコフモデル)と呼ばれる確率モデルを用います。これらは比較的軽量で、現場のサーバでも動きますよ。

田中専務

なるほど。特に前処理で「ユニークすぎるトークン」をどう扱うかが鍵のようですね。監視する対象ノードごとに学習させるんですか、それとも汎用で使えるんですか。

AIメンター拓海

基本はノードごとに学習させるのが現実的です。ノードごとにログの表現や順序が違うため、各ソースを個別に扱うと精度が上がります。とはいえ、似たタイプのノード群をまとめて学習する工夫も可能ですし、運用コストとのバランスで決めれば良いですよ。

田中専務

わかりました。では最後に、要点を私の言葉でまとめますと、ログの中身だけでなく出現の順番を低コストで学ばせて、順序が外れた箇所を確率であぶり出す、ということですね。これなら現場でも使えそうです。

監修者

阪上雅昭(SAKAGAMI Masa-aki)
京都大学 人間・環境学研究科 名誉教授

論文研究シリーズ
前の記事
対話生成における知識内在化のための多階層適応コントラスト学習
(Multi-level Adaptive Contrastive Learning for Knowledge Internalization in Dialogue Generation)
次の記事
ID制約付きTransformer自己符号化器による教師なし異常音検知
(Transformer-based Autoencoder with ID Constraint for Unsupervised Anomalous Sound Detection)
関連記事
手話生成をデータ増強として用いることで手話翻訳を強化する方法
(Using Sign Language Production as Data Augmentation to enhance Sign Language Translation)
森林冠下体積の可視化を可能にする空撮イメージング技術
(DeepForest: Sensing Into Self-Occluding Volumes of Vegetation With Aerial Imaging)
言語モデルによる自己教師付き表現学習の新展開
(Self-Supervised Representation Learning with Language Models)
水中ロボットの「身ぶり」コミュニケーション
(Robot Communication Via Motion: Closing the Underwater Human-Robot Interaction Loop)
マンモグラム分類におけるConvNeXT-smallとEfficientNetV2-Sの比較
(Comparison of ConvNeXT-small and EfficientNetV2-S for Mammogram Classification)
Generative AI and Copyright: A Dynamic Perspective
(生成AIと著作権:動学的視点)
この記事をシェア

有益な情報を同僚や仲間と共有しませんか?

AI技術革新 - 人気記事
ブラックホールと量子機械学習の対応
(Black hole/quantum machine learning correspondence)
生成AI検索における敏感なユーザークエリの分類と分析
(Taxonomy and Analysis of Sensitive User Queries in Generative AI Search System)
DiReDi:AIoTアプリケーションのための蒸留と逆蒸留
(DiReDi: Distillation and Reverse Distillation for AIoT Applications)

PCも苦手だった私が

“AIに詳しい人“
として一目置かれる存在に!
  • AIBRプレミアム
  • 実践型生成AI活用キャンプ
あなたにオススメのカテゴリ
論文研究
さらに深い洞察を得る

AI戦略の専門知識を身につけ、競争優位性を構築しませんか?

AIBR プレミアム
年間たったの9,800円で
“AIに詳しい人”として一目置かれる存在に!

プレミア会員になって、山ほどあるAI論文の中から効率よく大事な情報を手に入れ、まわりと圧倒的な差をつけませんか?

詳細を見る
【実践型】
生成AI活用キャンプ
【文部科学省認可】
満足度100%の生成AI講座
3ヶ月後には、あなたも生成AIマスター!

「学ぶ」だけではなく「使える」ように。
経営者からも圧倒的な人気を誇るBBT大学の講座では、3ヶ月間質問し放題!誰1人置いていかずに寄り添います。

詳細を見る

AI Benchmark Researchをもっと見る

今すぐ購読し、続きを読んで、すべてのアーカイブにアクセスしましょう。

続きを読む