2 分で読了
2 views

CRISPR-Cas13dのオンターゲット・オフターゲット予測における機械学習アルゴリズム比較

(Comparative Analysis of Machine Learning Algorithms for Predicting On-Target and Off-Target Effects of CRISPR-Cas13d)

さらに深い洞察を得る

AI戦略の専門知識を身につけ、競争優位性を構築しませんか?

AIBR プレミアム
年間たったの9,800円で
“AIに詳しい人”として
一目置かれる存在に!

プレミア会員になって、山ほどあるAI論文の中から効率よく大事な情報を手に入れ、まわりと圧倒的な差をつけませんか?

詳細を見る
【実践型】
生成AI活用キャンプ
【文部科学省認可】
満足度100%の生成AI講座
3ヶ月後には、
あなたも生成AIマスター!

「学ぶ」だけではなく「使える」ように。
経営者からも圧倒的な人気を誇るBBT大学の講座では、3ヶ月間質問し放題!誰1人置いていかずに寄り添います。

詳細を見る

田中専務

拓海先生、最近部下からCRISPRだのCatBoostだの聞かされて困っておるのです。これを導入すると現場は本当に楽になるのですか。

AIメンター拓海

素晴らしい着眼点ですね!一緒に整理しましょう。結論から言うと、今回の論文は多数の機械学習アルゴリズムを比較して、どれがガイドRNAの性能予測に向くかを示していますよ。

田中専務

それは要するに当たり外れを減らして効率よく治療の候補を選ぶための道具、という認識でいいですかな。

AIメンター拓海

まさにその通りです。端的に言えば、良いモデルは正確に“当たり”(on-target)を選び、“外れ”(off-target)を避けられるのです。重要点を3つにまとめますね。まずデータの質、次に特徴量設計、最後にアルゴリズム選定です。

田中専務

データの質というのは、現場でいうと材料の仕入れや機械の校正に当たるのですかな。

AIメンター拓海

その比喩はいいですね。データの質は原料の良否です。具体的には検証済みのsgRNA(single guide RNA、sgRNA、一本鎖ガイドRNA)の実験結果が豊富であることが必要です。良い原料がないとどんな優秀なモデルでも精度は出せないんですよ。

田中専務

ちなみに、論文はどのアルゴリズムが良かったと報告しておるのですか。これって要するに、複数のモデルを組み合わせれば精度が上がるということ?

AIメンター拓海

良い質問です。論文ではCatBoostが感度(検出率)で最も優れていたと示していますが、単体で完璧というわけではありません。実務では複数モデルのスタッキング(stacking、モデルの組み合わせ)で性能向上が確認されていますから、結局は組み合わせ戦略が鍵になるのです。

田中専務

現場導入のコスト対効果が心配です。学習に大量データが要るのではないですかな。

AIメンター拓海

心配はもっともです。ポイントは既存の公開データを活用しつつ、自社データで微調整(ファインチューニング)するハイブリッド運用です。導入段階ではまず公開データでベースモデルを作り、少量の自社データで性能を合わせるのが現実的ですよ。

田中専務

なるほど。要するに、まずは公開データで試してから自社に合わせて調整すれば良い、ということですかな。よし、やってみます。

AIメンター拓海

大丈夫、一緒にやれば必ずできますよ。失敗は学習のチャンスですから。一歩ずつ進めましょう。

監修者

阪上雅昭(SAKAGAMI Masa-aki)
京都大学 人間・環境学研究科 名誉教授

論文研究シリーズ
前の記事
UGV植物フェノタイピングにおける適応的データ取得とNeREFに基づく放射校正による高品質3DMPC生成
(Generating high-quality 3DMPCs by adaptive data acquisition and NeREF-based radiometric calibration with UGV plant phenotyping system)
次の記事
ゲーテッド要約モジュールを備えた値反復ネットワーク
(Value Iteration Networks with Gated Summarization Module)
関連記事
胸部X線画像からのCOVID-19自動検出
(AUTOMATIC DETECTION OF COVID-19 FROM CHEST X-RAY IMAGES USING DEEP LEARNING MODEL)
時間的に不正確なラベルから時系列検出モデルを学習する
(Learning Time Series Detection Models from Temporally Imprecise Labels)
HybridoNet-Adapt:正確なリチウムイオン電池RUL予測のためのドメイン適応フレームワーク
(HybridoNet-Adapt: A Domain-Adapted Framework for Accurate Lithium-Ion Battery RUL Prediction)
CIの大規模運用最適化
(CI at Scale: Lean, Green, and Fast)
DAMEWARE: 天体データマイニングのためのウェブ・サイバーインフラ
(DAMEWARE: A web cyberinfrastructure for astrophysical data mining)
未来の種は歴史から芽吹く:将来の深層学習ライブラリの脆弱性を暴くファジング
(The Seeds of the FUTURE Sprout from History: Fuzzing for Unveiling Vulnerabilities in Prospective Deep-Learning Libraries)
この記事をシェア

有益な情報を同僚や仲間と共有しませんか?

AI技術革新 - 人気記事
ブラックホールと量子機械学習の対応
(Black hole/quantum machine learning correspondence)
生成AI検索における敏感なユーザークエリの分類と分析
(Taxonomy and Analysis of Sensitive User Queries in Generative AI Search System)
DiReDi:AIoTアプリケーションのための蒸留と逆蒸留
(DiReDi: Distillation and Reverse Distillation for AIoT Applications)

PCも苦手だった私が

“AIに詳しい人“
として一目置かれる存在に!
  • AIBRプレミアム
  • 実践型生成AI活用キャンプ
あなたにオススメのカテゴリ
論文研究
さらに深い洞察を得る

AI戦略の専門知識を身につけ、競争優位性を構築しませんか?

AIBR プレミアム
年間たったの9,800円で
“AIに詳しい人”として一目置かれる存在に!

プレミア会員になって、山ほどあるAI論文の中から効率よく大事な情報を手に入れ、まわりと圧倒的な差をつけませんか?

詳細を見る
【実践型】
生成AI活用キャンプ
【文部科学省認可】
満足度100%の生成AI講座
3ヶ月後には、あなたも生成AIマスター!

「学ぶ」だけではなく「使える」ように。
経営者からも圧倒的な人気を誇るBBT大学の講座では、3ヶ月間質問し放題!誰1人置いていかずに寄り添います。

詳細を見る

AI Benchmark Researchをもっと見る

今すぐ購読し、続きを読んで、すべてのアーカイブにアクセスしましょう。

続きを読む