2 分で読了
0 views

Systematic reviewの自動化――環境因子レビューの情報抽出を目指して

(Team EP at TAC 2018: Automating data extraction in systematic reviews of environmental agents)

さらに深い洞察を得る

AI戦略の専門知識を身につけ、競争優位性を構築しませんか?

AIBR プレミアム
年間たったの9,800円で
“AIに詳しい人”として
一目置かれる存在に!

プレミア会員になって、山ほどあるAI論文の中から効率よく大事な情報を手に入れ、まわりと圧倒的な差をつけませんか?

詳細を見る
【実践型】
生成AI活用キャンプ
【文部科学省認可】
満足度100%の生成AI講座
3ヶ月後には、
あなたも生成AIマスター!

「学ぶ」だけではなく「使える」ように。
経営者からも圧倒的な人気を誇るBBT大学の講座では、3ヶ月間質問し放題!誰1人置いていかずに寄り添います。

詳細を見る

田中専務

拓海先生、最近、うちの現場でも「レビュー作業をAIで早くできないか」という話が出てましてね。論文を自動で要約したり、必要なデータを抜いてくれるって本当でしょうか。

AIメンター拓海

素晴らしい着眼点ですね!大丈夫、一緒に見ていけばできますよ。今日は2018年のTAC(Text Analysis Conference)で発表されたTeam EPの手法を分かりやすく噛み砕いて説明しますよ。

田中専務

お願いします。うちの場合、過去の安全試験データから有害性の手がかりを拾う必要があるんですが、作業に時間がかかりすぎるんです。実務で使えるなら投資したい。

AIメンター拓海

まず結論ファーストで言うと、この論文は「論文中の材料と方法(Material and methods)から実験デザインに関する用語を自動で見つける」仕組みを提示しました。つまり、手作業で抜き出している『誰が何をしたか』の情報を自動化することが目標です。要点を三つに分けて説明しますよ。

田中専務

三つですか。まずは何が一番重要なんでしょうか。現場に入れるときのポイントが知りたいです。

AIメンター拓海

一つ目はモデルの設計です。彼らはBiLSTM-CRF(Bidirectional Long Short-Term Memory – Conditional Random Field/双方向LSTMと条件付き確率場)という「文の中で単語ごとに役割を当てる」モデルを使いました。二つ目は事前学習済み語彙(GloVeやELMo)を活用して言葉の意味を補強したことです。三つ目はデータが少ない中で大容量モデルを安定させるための正則化(regularization)手法を多用した点です。

田中専務

これって要するに、専門家が手で探していた重要な語句をAIに学習させて、同じ仕事を自動でやらせるということですか?

AIメンター拓海

その通りですよ!ただし完全自動化ではなく、候補を提示して人が確認するという半自動の運用が現実的です。要点は三つ、モデル設計、語彙補強、正則化です。運用は候補提示→人確認のワークフローを想定すると良いです。

田中専務

導入コストに見合うかが鍵ですが、精度はどれくらいだったんですか。現場で使うにはどの程度信用していいんでしょう。

AIメンター拓海

公式スコアはマイクロF1で60.9%でした。これは完全自動化に十分とは言えませんが、候補抽出の補助としては価値がある水準です。特に大量の文書をスクリーニングする初期段階で時間短縮効果が期待できますよ。

田中専務

なるほど。うちの現場に合わせるには学習データが必要ですよね。どれくらい用意すればいいですか。

AIメンター拓海

この研究は訓練データが100文書、トークン数で20万未満と少ない環境で試しています。ポイントは量だけでなくラベルの質です。最初は数十〜百件の良質な注釈付きデータを用意して、半自動で拡張する運用が現実的です。小さく始めて効果が出れば投資を拡大する流れをおすすめしますよ。

田中専務

現場と経営に説明するときの要点を三つにまとめてもらえますか。忙しい会議で手短に伝えたいので。

AIメンター拓海

もちろんです。要点は三つあります。第一、候補提示で現場のスクリーニング時間を短縮できること。第二、初期投資は小さく始めて段階的に拡大する運用が現実的なこと。第三、最終判断は必ず人が行う「人+AI」のワークフローが安全で効果的なことです。これだけ抑えれば会議で話が早いですよ。

田中専務

分かりました。では、結論を自分の言葉で言うと、まずは小さなデータで候補抽出をAIに任せ、最終的な確認は人が行うハイブリッド運用で、作業時間を短縮して投資効果を見ていく、ということですね。よし、これなら話ができそうです。

監修者

阪上雅昭(SAKAGAMI Masa-aki)
京都大学 人間・環境学研究科 名誉教授

論文研究シリーズ
前の記事
多源からの転移学習で概念ドリフトに迅速対応
(Multi-Source Transfer Learning for Non-Stationary Environments)
次の記事
スパース特徴とデータにおける埋め込みの次元性
(ON THE DIMENSIONALITY OF EMBEDDINGS FOR SPARSE FEATURES AND DATA)
関連記事
逆問題を解くための反発潜在スコア蒸留
(Repulsive Latent Score Distillation for Solving Inverse Problems)
コンテンツ・視点分離による頑健なクロスビュー位置特定
(Robust Cross-View Geo-Localization via Content-Viewpoint Disentanglement)
音声反スプーフィング検出の総説
(Audio Anti-Spoofing Detection: A Survey)
学習可能な変分量子回路の特殊ユニタリ・パラメータ化
(Special-Unitary Parameterization for Trainable Variational Quantum Circuits)
単一横スピン非対称性のメカニズム間の関係
(On the Relation Between Mechanisms for Single-Transverse-Spin Asymmetries)
教師なし潜在木構造誘導と深層インサイド・アウトサイド再帰オートエンコーダ
(Unsupervised Latent Tree Induction with Deep Inside-Outside Recursive Autoencoders)
この記事をシェア

有益な情報を同僚や仲間と共有しませんか?

AI技術革新 - 人気記事
ブラックホールと量子機械学習の対応
(Black hole/quantum machine learning correspondence)
生成AI検索における敏感なユーザークエリの分類と分析
(Taxonomy and Analysis of Sensitive User Queries in Generative AI Search System)
DiReDi:AIoTアプリケーションのための蒸留と逆蒸留
(DiReDi: Distillation and Reverse Distillation for AIoT Applications)

PCも苦手だった私が

“AIに詳しい人“
として一目置かれる存在に!
  • AIBRプレミアム
  • 実践型生成AI活用キャンプ
あなたにオススメのカテゴリ
論文研究
さらに深い洞察を得る

AI戦略の専門知識を身につけ、競争優位性を構築しませんか?

AIBR プレミアム
年間たったの9,800円で
“AIに詳しい人”として一目置かれる存在に!

プレミア会員になって、山ほどあるAI論文の中から効率よく大事な情報を手に入れ、まわりと圧倒的な差をつけませんか?

詳細を見る
【実践型】
生成AI活用キャンプ
【文部科学省認可】
満足度100%の生成AI講座
3ヶ月後には、あなたも生成AIマスター!

「学ぶ」だけではなく「使える」ように。
経営者からも圧倒的な人気を誇るBBT大学の講座では、3ヶ月間質問し放題!誰1人置いていかずに寄り添います。

詳細を見る

AI Benchmark Researchをもっと見る

今すぐ購読し、続きを読んで、すべてのアーカイブにアクセスしましょう。

続きを読む