Skip to content

🧫AIと未来

臨床データサイエンティスト · 臨床データ、治験データ、医療システムのデータを用いて、より安全な医療、研究、業務上の意思決定のための信頼できるエビデンスを生み出す。

このページを共有

データサイエンスはAIをめぐる物語の中で異例の位置にある。自動機械学習、自然言語からSQLへの変換、AI支援のグラフ作成といった、この職業を作り変えつつある多くのツール自体が、もともと臨床データサイエンティストや機械学習研究者によって作られ、今や自分たち自身の日々の仕事の一部に向けられている。

そのリスクは現実であり、かつ不均一だ。この仕事の定型的で仕様の明確な部分――データを取得し、標準的なモデルを実行し、初稿のグラフを作成すること――は、すでにAIツールがほぼ同等の速さでこなせる。生き残る部分は、コードを書くことよりも、どの問いを立てる価値があるのか、そしてその答えが信頼できるのかを判断することにある。

32 / 100
中程度

機械が代わり得る業務の割合

定型的なデータサイエンス業務――SQLクエリの作成、探索的なグラフ作成、AutoMLによる標準的なモデルの当てはめ、定型的なパイプラインコードの記述――のかなりの部分は、今日すでに自動化またはAI支援が可能であり、その割合は急速に増えている。自動化に耐えるのは、曖昧なビジネス上の問題を検証可能な問いへと組み立てること、結果が本物か統計的なアーティファクトかを判断すること、そしてモデルの現実世界での判断が間違っていた場合に責任を負うことだ。

肩書きではなく業務単位で算定。低いほど安全。

AIが奪えない仕事 →

機械が奪えないもの

正しい問いを組み立てる

84

曖昧なビジネス上または科学上の問題を具体的で検証可能な問いに変えるには、自動化されたツールが単独ではアクセスできない組織的・専門的な文脈が必要だ。

パターンが本物かどうかを判断する

80

本物の効果を、ノイズ、データリークによるアーティファクト、あるいは幸運な訓練・テスト分割と見分けることは、自動化されたパイプラインが自分自身の出力に対して最も苦手とする種類の懐疑的な判断そのものだ。

現実世界の意思決定への説明責任

88

融資を拒否し、患者にフラグを立て、製品の価格を誤って設定するモデルについて、誰かが説明責任を負わなければならない――それはその数値を生み出したツールに移せる責任ではない。

懐疑的な関係者を説得する

68

直感に反する、または歓迎されない発見を実際に行動に移してもらうには、正しい分析だけでなく、人々との信頼、信用、交渉が必要だ。

本当に新しい実験を設計する

74

新しい問いに対して適切な自然実験、対照群、因果推論の戦略を選ぶことは、過去の分析へのパターンマッチングよりも創造的な判断に近い。

すでに奪っているもの

定型的なSQLクエリとデータ取得

75

自然言語からSQLへの変換ツールは、かつては臨床データサイエンティストの直接的な関与を必要とした単純なデータ取得依頼の大部分を今や処理している。

探索的なグラフと要約の初稿

65

自動化された探索分析ツールは、生のデータセットから分布図、相関の要約、基本的なグラフを数秒で生成できる。

標準的なモデルの当てはめと調整

68

AutoMLプラットフォームは、明確に定義されラベル付けされた問題に対して、勾配ブースティングやロジスティック回帰といった従来型のモデルの選択、学習、調整をほぼ人手を介さずに行える。

定型的なパイプラインとETLコード

60

標準的なデータ変換やロードのスクリプトを組み立てることは、今ではゼロから書くよりもAIコーディングアシスタントで生成しレビューするほうが速いことが多い。

仕事の変わり方

モデルを作ることから、指示し検証することへ

この仕事のますます大きな部分が、すべてのクエリとモデルを手で書くことではなく、自動化されたパイプラインが何を試すべきかを指定し、その出力を検証することになっている。

総称的な肩書きが専門分野に分裂する

アナリティクスエンジニアリング、機械学習エンジニアリング、プロダクトアナリティクスがますます別々の職名になり、それぞれが十年前には単一の「臨床データサイエンティスト」がカバーすると期待されていた領域の一部を吸収している。

因果推論と実験がより重視されるようになる

既存データの中のパターン発見が自動化しやすくなるにつれ、信頼できる実験や因果分析を設計するというより難しいスキルが、以前よりも軽視されるどころかより重視されるようになっている。

「市民臨床データサイエンティスト」が基本的な分析を広げる

ノーコードとAutoMLのツールにより、専門家でない人も自分で基本的な分析を実行できるようになり、専任の臨床データサイエンティストは、こうしたツールが扱えないより難しく曖昧な問題へと押し出されている。

枝分かれする新しい仕事

アナリティクスエンジニア

ダッシュボードやモデルにデータを供給する、dbtのようなツールをしばしば使ったデータ変換パイプラインを構築・保守する、データエンジニアリングと分析の中間に位置する職種。

機械学習エンジニア

モデルを研究用ノートブックから取り出し、本番システムの中で監視されながら確実に大規模に動作させる。

データプロダクトマネージャー

データまたはAI駆動の機能のロードマップを担当し、ビジネス目標をデータチームが実際に構築すべきものへと翻訳する。

レスポンシブルAI/モデルリスクアナリスト

モデルとその背後にあるデータを、出荷が許可される前にバイアス、公平性、規制順守の観点から監査する。

展望

データを信頼できる意思決定へと変えられる人材への需要は、今後十年を通じて強いままである可能性が非常に高いが、入門レベルの仕事のあり方はすでに変わりつつある――純粋に定型的なクエリの記述や初稿のグラフ作成のためだけに存在する職務は減っていくだろう。

最も明確な長期的優位性は、本当に有用な問いを組み立て、AIが生成した結果が静かに間違っていることを見抜き、懐疑的な関係者を前に提言に責任を持てる臨床データサイエンティストにある――それは、フィッシャーの作物実験以来この分野が必要としてきたのと同じ判断力であり、今はますます自分自身で最初の草案を作るようになったワークフローに適用されている。

似ている職業

分野だけでなく、6つのスコアが近い職業です。

さらに探す

さらに探す

科学・研究のほかの職業

⚛️

物理学者

黒板一枚から3000人の共著者を抱える加速器論文まで、物質・エネルギー・空間・時間を支配する数学的法則を導き検証する仕事。

AI耐性 65
🧬

生物学者

生命そのものを研究する科学者。リンネが種を手作業で命名した時代から、CRISPRでゲノムを編集する今日まで、あらゆる着想を生きた生物で検証し続けてきた。

AI耐性 64
🧪

化学者

物質そのものを作り、測る科学者——バビロニアのタプティの蒸留器から今日のロボット実験室まで、スペクトルの意味を決めるのは常にこの人だ。

AI耐性 70
📊

データサイエンティスト

データからパターンを見つけ予測モデルを構築する職業――2008年生まれの肩書きだが、その土台には数値を数え、検証し、可視化してきた3世紀分の営みがある。

AI耐性 38
🔭

天文学者

バビロニアの粘土板から宇宙望遠鏡まで、宇宙を測り続ける科学者。今もデータの中のどの揺らぎが発見なのかを見極めている。

AI耐性 70
🧮

数学者

バビロニアの書記からフィールズ賞受賞者、AI支援証明まで――困難な問いを恒久的な確実性へと変え続けてきた職業、一つの定理ごとに。

AI耐性 70
🧿

量子エンジニア

コンピューティング、センシング、通信、材料研究のために量子状態を利用する装置を構築し、測定し、制御する。

AI耐性 78