본문으로 건너뛰기 섹션으로 건너뛰기

🧫전설의 인물들

임상 데이터 과학자 · 임상, 시험 및 건강 시스템 데이터를 사용하여 보다 안전한 치료, 연구 및 운영 결정을 위한 신뢰할 수 있는 증거를 생성합니다.

한눈에
지표 밀도

진한 칸일수록 이 직업에서 해당 지표가 높습니다.

최근 검토 출처·크레딧미디어 크레딧방법론

짧은 답

임상 데이터 과학자는 실제로 매일 무엇을 합니까?

'AI 모델 구축' 이미지와는 달리, 대부분의 날은 SQL 쿼리와 Python 코드를 작성하여 데이터를 가져오고 정리하고, 통계 테스트 또는 모델 교육을 실행하고, 결과를 비기술적 이해관계자가 조치를 취할 수 있는 차트나 메모로 변환하는 작업으로 나뉩니다. 실무자 설문조사에 따르면 지속적으로 데이터 정리 및 준비 작업이 전체 작업 시간의 대략 절반 이상에 소요됩니다.

임상 데이터 과학자가 되려면 박사 학위가 필요합니까?

아니요. 의학이나 법률과는 달리 자격증이나 단일 필수 학위가 없습니다. 통계, 컴퓨터 과학, 수학 또는 관련 양적 분야의 학사 또는 석사 학위가 가장 일반적인 경로이며 실제 프로젝트의 강력한 포트폴리오는 종종 정확한 자격보다 고용주에게 더 ​​중요합니다. 박사 학위는 연구 중심적이거나 응용 기계 학습 역할에 더 일반적입니다.

임상 데이터 과학은 단지 새로운 이름의 통계일 뿐인가?

그렇지 않습니다. Fisher의 실험 설계, Tukey의 탐색 분석 등 통계에 크게 의존하지만 기존 통계학과에서 거의 가르치지 않는 프로그래밍, 데이터베이스 엔지니어링 및 기계 학습을 추가합니다. William S. Cleveland는 2001년에 이 용어를 대체하기보다는 통계를 기반으로 하는 확장되고 컴퓨팅 집약적인 분야 버전을 설명하기 위해 특별히 제안했습니다.

임상 데이터 과학이 AI로 인해 위험에 처해 있나요?

일상적인 끝은 이미 노출되어 있습니다. AutoML 도구는 표준 모델을 맞추고 조정할 수 있으며 AI 보조자는 사람보다 빠르게 SQL 쿼리, 초안 탐색 차트 및 상용구 파이프라인 코드를 작성할 수 있습니다. 자동화되지 않은 것은 올바른 질문을 구성하고, 패턴이 의미있는지 가짜인지 판단하고, 결과에 따라 결정을 내리는 것입니다.

임상 데이터 과학자의 수입은 얼마입니까?

국가나 연공서열에 따라 매우 다양합니다. 미국 노동통계국(US Bureau of Labor Statistics)은 2023년 임상 데이터 과학자 직업의 평균 연봉을 약 108,000달러로 추정한 반면, 하급 분석가는 종종 70,000~95,000달러에 가깝게 시작하고 주요 기술 회사의 선임 또는 수석 임상 데이터 과학자는 총 자본 보상으로 200,000~400,000달러 이상을 벌 수 있습니다.

임상 데이터 과학자, 데이터 분석가, 기계 학습 엔지니어의 차이점은 무엇입니까?

데이터 분석가는 일반적으로 기존 데이터와 대시보드를 사용하여 정의된 비즈니스 질문에 답합니다. 임상 데이터 과학자는 종종 더 복잡한 데이터로부터 새로운 통계 모델과 예측 분석을 구축합니다. 기계 학습 엔지니어는 노트북에서 모델을 꺼내 프로덕션 환경에서 대규모로 안정적으로 실행합니다. 경계는 끊임없이 흐려지고 많은 사람들은 경력 전반에 걸쳐 세 가지 모두 사이를 이동합니다.

비교 랩 열기

이 페이지 공유

데이터 과학의 표준은 전염병 사망자 수를 손으로 세는 17세기 런던 상인부터 수십억 개의 익명 링크 클릭을 채굴하는 21세기 과학자까지 이어집니다. 이곳의 여덟 사람은 300년이 넘는 세월과 3개 대륙에 걸쳐 살고 있습니다.

그것들을 연결하는 것은 공유된 방법이라기보다는 공유된 본능입니다. 실제의 지저분한 기록을 자세히 살펴보고, 그것이 정밀 조사에서 살아남는지 확인한 후에만 패턴을 신뢰하십시오. 이 분야는 여전히 운영되고 있지만 제목이 10년이 된 동일한 분야입니다.

역대 최고의 시상대

🥈
플로렌스 나이팅게일
영국
2
🥇
로널드 피셔
영국
1
🥉
윌리엄 씰리 고셋
영국/아일랜드
3

“엄격한 실험에는 처음부터 제어 및 무작위화가 필요하며 나중에 논쟁이 필요하지 않습니다.”

로널드 피셔

정점에 오른 8인

1

로널드 피셔

영국 · 1890년~1962년

1920년대 Rothamsted Experimental Station에서 수십 년간의 작물 수확량 실험을 분석하면서 분산 분석, 무작위 실험 설계 및 최대 우도 추정 등 응용 통계의 현대적인 프레임워크를 대부분 구축한 영국의 통계학자이자 유전학자입니다.

일화

1920년대 후반 Rothamsted 애프터눈 티에서 동료 Muriel Bristol은 차를 마시기 전이나 후에 컵에 우유를 부었는지 알 수 있다고 주장했습니다. 피셔는 그녀를 기각하는 대신 실제로 주장을 테스트하기 위해 무작위 실험을 설계했습니다. 이는 나중에 귀무 가설과 무작위 실험 설계의 논리를 배치하기 위해 1935년 저서 '실험 설계'에서 사용한 시나리오였습니다.

“엄격한 실험에는 처음부터 제어 및 무작위화가 필요하며 나중에 논쟁이 필요하지 않습니다.”

'연구자를 위한 통계방법' 출판
1925년
Rothamsted 실험장에서의 수년
~14세
왕립학회 회원으로 선출됨
1929년
2

플로렌스 나이팅게일

영국 · 1820년~1910년

현대 간호의 창시자로 더 잘 알려진 나이팅게일은 또한 데이터 시각화를 사용하여 크림 전쟁에서 대부분의 군인이 전투 부상이 아닌 열악한 위생으로 인해 사망했다는 사실을 영국 정부에 설득하고 왕립 통계 학회 회원으로 선출된 최초의 여성이 된 선구적인 통계학자였습니다.

일화

1858년 나이팅게일은 1년을 월별 사망자 수로 쐐기 모양으로 나누고 원인별로 색상을 지정하는 원형 차트인 '콕스콤' 또는 극지방 다이어그램을 출판하여 전쟁이 아닌 예방 가능한 질병이 크리미아에서 영국군 사망자의 압도적인 다수를 초래했다는 사실을 전쟁성에 보여주었습니다. 시각화는 지속적인 군대 위생 개혁을 추진하는 데 도움이 되었습니다.

“잘 디자인된 차트는 테이블에 있는 동일한 숫자보다 더 빠르게 정부 정책을 변경할 수 있습니다.”

왕립통계학회 선임연구원
1858년(최초의 여성)
'건강에 영향을 미치는 사항에 관한 참고사항' 출판
1858년
왕립위생위원회 설립
1857년
3

윌리엄 씰리 고셋

영국/아일랜드 · 1876년~1937년

더블린의 기네스 양조장에서 화학자이자 통계학자로 일하면서 Gosset은 작은 보리 샘플의 품질을 판단하는 매우 실용적인 문제를 해결하기 위해 t-분포와 t-테스트를 개발했으며 기네스가 직원들이 자신의 이름으로 출판하는 것을 금지했기 때문에 'Student'라는 가명으로 출판했습니다.

일화

경쟁업체가 영업 비밀을 배우는 것에 대한 기네스의 우려로 인해 직원 간행물이 금지되었습니다. 따라서 Gosset의 랜드마크인 1908년 논문 'The Probable Error of a Mean'은 Biometrika에 'Student'라는 가명으로 게재되었습니다. 이 이름은 통계학자들 사이에서 그의 정체가 알려진 지 오랜 후에도 오늘날 수백만 건의 소표본 분석에 사용되는 t-테스트에 여전히 붙어 있습니다.

“하나의 좁고 실용적인 문제를 해결하기 위해 구축된 방법은 원래 목적보다 100년 이상 오래 지속될 수 있습니다.”

'평균의 오류 가능성' 출간
1908년, 바이오메트리카
기네스에서의 수년
~38세
출판물에 사용된 가명
'학생'
4

C. R. 라오

인도 / 미국 · 1920년~2023년

25세에 Cramér-Rao 경계와 Rao-Blackwell 정리(통계 추정 이론에서 가장 널리 사용되는 두 가지 결과)를 도출하고 나중에 미국 대학에서 오랫동안 경력을 쌓기 전에 인도의 인도 통계 연구소 설립을 도운 인도계 미국인 통계학자입니다.

일화

콜카타에 있는 인도 통계 연구소의 젊은 연구원으로 작성된 Rao의 1945년 논문은 편견 없는 추정자가 현재 Cramér-Rao 경계라고 불리는 미지의 양을 얼마나 정확하게 측정할 수 있는지에 대한 하한선을 입증했습니다. 이 결과는 이후 출판된 거의 모든 통계 교과서에 나타나며 그가 26세가 되기 전에 쓴 논문에 반영됩니다.

“경력 초기에 정확하게 입증된 단 하나의 결과는 해당 분야의 이후 수십 년보다 오래 지속될 수 있습니다.”

Cramér-Rao 제본 논문 출판
1945년
미국 국립 과학 메달
2002년
사망시 나이
102
5

존 투키

미국 · 1915년~2000년

고속 푸리에 변환(Fast Fourier Transform) 알고리즘을 공동 발명하고 상자 그림을 발명했으며 1962년 논문 '데이터 분석의 미래(The Future of Data Analysis)'에서 실제 데이터를 분석하는 것은 수학적 통계와는 별개의 과학 분야로 인식되어야 한다고 주장한 미국의 수학자이자 통계학자입니다.

일화

Tukey는 '데이터 분석의 미래'(1962)에서 데이터 분석이 수학의 작은 분야로서 '잘못 배웠으며' 그 후 15년 동안 그의 1977년 저서 '탐색적 데이터 분석'에 소개된 상자 그림과 줄기와 잎 그림을 포함한 실습 기술을 개발하는데 보냈으며 컴퓨터가 숫자를 터치하기 전에 연필과 종이를 사용하여 손으로 작업할 수 있도록 설계되었습니다.

“데이터로 구축된 모델을 신뢰하기 전에 간단한 손으로 그린 도구를 사용하여 직접 눈으로 데이터를 살펴보세요.”

'데이터 분석의 미래' 출간
1962년
탐색적 데이터 분석' 출간
1977년
고속 푸리에 변환 알고리즘
1965년 쿨리와 함께
6

윌리엄 S. 클리블랜드

미국 · b. 1943년

2001년 논문에서 확장된 통계 분야의 이름으로 '임상 데이터 과학'을 창안하고 LOESS 로컬 회귀 방법을 포함하여 널리 사용되는 데이터 시각화 및 평활화 기술을 별도로 발명한 Bell Labs 통계학자입니다.

일화

클리블랜드의 2001년 논문 '임상 데이터 과학: 통계 분야의 기술 영역 확장을 위한 실행 계획'에서는 대학이 통계학과와 별개로 전담 데이터 과학학과를 만들 것을 제안했습니다. 이는 따라잡는 데 10년 이상이 걸렸지만 2010년대 중반까지 전 세계 수백 개의 대학이 정확히 그렇게 했습니다.

“인쇄된 분야의 경계를 명명하고 공식적으로 제안하는 것은 몇 년 후 대학이 해당 분야를 중심으로 조직하는 방식을 형성할 수 있습니다.”

'임상 데이터 과학: 실행 계획' 출판
2001년
'데이터를 시각화하다' 출간
1993년
벨 연구소에서의 수년
~30세
7

DJ 파틸

미국 · b. 1973년

LinkedIn의 데이터 팀을 이끌었고 동료 Jeff Hammerbacher는 2008년경 독립적으로 '임상 데이터 과학자'라는 직위를 정했고, '21세기 가장 섹시한 직업'이라는 영향력 있는 2012 Harvard Business Review 기사를 공동 집필했으며, 이후 오바마 대통령 하에서 최초의 미국 최고 임상 데이터 과학자를 역임했습니다.

일화

Patil은 2008년경에 LinkedIn의 데이터 팀을 구성하는 동안 그와 그의 팀이 '데이터 분석가' 및 '비즈니스 분석가'와 같은 직위를 고려한 후 '임상 데이터 과학자'로 결정했다고 말했습니다. 부분적으로는 실제로 필요한 역할에 필요한 엔지니어링과 통계의 혼합을 더 잘 포착했기 때문이고, 부분적으로는 단순히 채용하기에 더 매력적인 직위였기 때문입니다.

“올바른 직위는 업무 자체만큼이나 전체 직업이 채용되는 방식을 결정합니다.”

'가장 섹시한 직업' HBR 기사 게재
2012년 10월, Davenport와 함께
미국 최고 임상 데이터 과학자 재임 기간
2015년~2017년
LinkedIn 데이터 팀이 합류했습니다.
2008년
8

힐러리 메이슨

미국 · b. 1978년

2009년에 bit.ly의 수석 과학자가 되었으며, 링크 단축 서비스의 대규모 클릭 스트림 데이터를 사용하여 온라인으로 퍼지는 내용을 연구하고 나중에 기계 학습 연구 스타트업인 Fast Forward Labs를 설립하여 직위를 공개적으로 보유한 최초의 사람 중 한 명이었습니다.

일화

bit.ly에서 Mason과 동료들은 정보가 실제로 인터넷 전체에 어떻게 확산되는지 연구하기 위해 수십억 개의 익명화된 단축 링크 클릭을 채굴했으며, 하루 중 어떤 링크가 가장 많이 클릭되는지와 같은 패턴에 대한 결과를 발표했습니다. 이를 통해 링크 단축 유틸리티를 공개적으로 논의된 최초의 대규모 임상 데이터 과학 연구 프로그램 중 하나로 전환했습니다.

“평범한 인프라 제품은 누군가가 보려고 생각한다면 이용 가능한 가장 풍부한 연구 데이터세트 중 하나로 두 배가 될 수 있습니다.”

bit.ly 수석 과학자 이후
2009년
Fast Forward Labs 설립
2014년
Cloudera가 Fast Forward Labs를 인수함
2017년

그래프는 이 목록 1위 기준 상대값입니다.

비교 실험실

이름을 켜고 끄면 — 모든 막대가 선택된 그룹의 1위를 기준으로 다시 계산된다.

5 / 8

논쟁

DJ Patil과 Jeff Hammerbacher가 직함을 실제로 '창안'했는지 여부는 논쟁의 여지가 있습니다. 둘 다 더 넓은 팀과 비공식적인 이전 업계 사용을 인정했으며 이 문구는 2008년 이전에 흩어져 있는 참고 자료에 나타납니다.

이 분야 자체의 이름을 정한 것에 대해 논란이 있습니다. 컴퓨터 과학자인 Peter Naur는 William S. Cleveland의 2001년 제안이 널리 인용되기 수십 년 전인 1974년부터 '임상 데이터 과학'이라는 용어를 컴퓨터 과학의 동의어로 사용했습니다.

비슷한 직업

같은 분야만이 아니라 여섯 점수 프로필이 가까운 직업입니다.

계속 탐색하기

계속 탐색하기

과학·연구 분야의 다른 직업

⚛️

물리학자

물질과 에너지, 공간과 시간을 지배하는 수학 법칙을 이끌어내고 검증한다. 혼자 칠판 앞에 선 연구자에서 3,000명이 공동 저자로 이름을 올리는 입자가속기 논문까지 그 모습은 다양하다.

AI 내성 65
🧬

생물학자

생명 그 자체를 연구하는 과학자. 린네가 손으로 종을 명명하던 시절부터 크리스퍼로 유전체를 편집하는 오늘날까지, 모든 아이디어를 살아있는 생물체에 비추어 검증한다.

AI 내성 64
🧪

화학자

물질 그 자체를 만들고 측정하는 과학자 — 바빌로니아 타푸티의 증류기에서 오늘날 로봇 실험실에 이르기까지, 스펙트럼이 의미하는 바를 결정하는 것은 여전히 사람이다.

AI 내성 70
📊

데이터 과학자

데이터에서 패턴을 찾고 예측 모델을 만드는 직업 — 2008년에 붙여진 이름이지만, 그 밑바탕에는 3세기에 걸친 증거 수집·검증·시각화의 역사가 있다.

AI 내성 38
🔭

천문학자

바빌로니아의 점토판에서 우주 망원경까지, 우주를 측정하는 과학자 — 데이터 속 어떤 깜빡임이 발견인지는 지금도 가려내는 중이다.

AI 내성 70
🧮

수학자

바빌로니아 서기관에서 필즈상 수상자와 AI 보조 증명까지: 어려운 질문을 영구적 확실성으로 바꾸는 직업, 정리 하나하나마다.

AI 내성 70
🧿

양자 엔지니어

컴퓨팅, 감지, 통신 및 재료 연구를 위해 양자 상태를 활용하는 장치를 구축, 측정 및 제어합니다.

AI 내성 78