SlideShare une entreprise Scribd logo
1  sur  44
山口健史
2019-01-21
裏切られる直感と、
確率と精度のはなし
今日の話題 1
 モンティ・ホール問題
 ウィルス感染検査装置の問題
 システムの評価尺度のはなし
モンティ・ホール問題
2
扉が3つ 3
A B C
テレビ番組の景品当てゲーム
東京フレンドパークのダーツ とか
アタック25の海外旅行チャレンジ とか
扉の向こうには…… 4
A B C
はずれが2つ
当たりが1つ
回答者が1つを選ぶ 5
A B C
Aにします
司会者が言う 6
A以外の2つのうち
1つを開けて
見せてあげましょう
A B C
司会者が扉を開け1つのはずれが判明する 7
A B C
選び直すことができると司会者は言う 8
A B C
あなたはもう1回
別の扉を選び直す
ことができますよ
問題 9
はたして
Aのままにするべきだろうか?
それとも
Cに選び直すべきだろうか?
10
警告
まったくよくない出題です
Wikipedia モンティ・ホール問題のページ
1990年9月9日発行、ニュース雑誌「Parade」
にてマリリン・ボス・サヴァントが連載する
コラム「マリリンにおまかせ」で、上記の読者
投稿による質問に ここはのちほど と回答した。
すると直後から、読者からの「彼女の解答は
間違っている」との約1万通の投書が殺到し、
本問題は大議論に発展した。
(略)
投書には、1000人近い博士号保持者からの
ものも含まれていた。
11
https://ja.wikipedia.org/wiki/モンティ・ホール問題 より引用
なぜそんなに炎上したのか……? 12
致命的な部分で出題があいまい
人間の直感を裏切る問題
だけでなく
という面も
問題のない問題
1. 回答者には3つの選択肢が与えられており、そのうちの
1つが当たり、2つが外れである
2. 司会者がいて当たりがどれかを事前に知っている
3. 回答者は選択肢から1つを選び司会者に伝える
4. 司会者は状況によって以下のどちらかの行動を取る
1. 回答者が外れを選択した場合、残った2つの選択肢のうち外れの方を
取り除く
2. 回答者が当たりを選択した場合、残った2つの選択肢のうち一方を
無作為に(つまりそれぞれ等しい確率で)取り除く
5. 回答者は最初に選んだ選択肢と、取り除かれずに残った
選択肢からもういちど選び直すことができる
6. 上記のルール・条件は事前に回答者に知らされている
13
答え 14
正解は『選択肢を変更する』である
なぜなら選択肢を変更した場合には
景品を当てる確率が2倍になるから
どう考えるとわかりやすいか? 15
このゲームを900人ぐらいがチャレンジする
Aを選択
300人ぐらい
Bを選択
300人ぐらい
Cを選択
300人ぐらい
どう考えるとわかりやすいか? 16
このゲームを900人ぐらいがチャレンジする
300人ぐらいがAを選択する
Aを選択
300人ぐらい
どう考えるとわかりやすいか? 17
このゲームを900人ぐらいがチャレンジする
300人ぐらいがAを選択する
Aが正解
100人ぐらい
Bが正解
100人ぐらい
Cが正解
100人ぐらい
どう考えるとわかりやすいか? 18
このゲームを900人ぐらいがチャレンジする
300人ぐらいがAを選択する
Bが正解 → Cが除外
100人ぐらい
Cが正解 → Bが除外
100人ぐらい
Aが正解で
Bが除外
50人ぐらい
Aが正解で
Cが除外
50人ぐらい
どう考えるとわかりやすいか? 19
このゲームを900人ぐらいがチャレンジする
300人ぐらいがAを選択する
Cが正解 → Bが除外
100人ぐらい
Aが正解で
Bが除外
50人ぐらい
150人ぐらいが、Aを選択してBを除外される状況を観測する
どう考えるとわかりやすいか?
 このゲームに900人がチャレンジすると
自分と同じ状況になる人が150人いて
 その中の50人は選択肢を変えない時に当たる
 その中の100人が選択肢を変える時に当たる
20
選択肢を変えると当たる人が2倍
問題のない問題 再掲
1. 回答者には3つの選択肢が与えられており、そのうちの
1つが当たり、2つが外れである
2. 司会者がいて当たりがどれかを事前に知っている
3. 回答者は選択肢から1つを選び司会者に伝える
4. 司会者は状況によって以下のどちらかの行動を取る
1. 回答者が外れを選択した場合、残った2つの選択肢のうち外れの方を
取り除く
2. 回答者が当たりを選択した場合、残った2つの選択肢のうち一方を
無作為に(つまりそれぞれ等しい確率で)取り除く
5. 回答者は最初に選んだ選択肢と、取り除かれずに残った
選択肢からもういちど選び直すことができる
6. 上記のルール・条件は事前に回答者に知らされている
21
ウィルス感染検査装置の問題
22
こんな問題
 あるウィルスに感染しているかどうかを検査できる
装置がある
 装置が判定した結果の正解率は99%
 1,000人に1人の割合で潜在的感染者がいる
 あなたがその検査装置を使ったところ陽性という
判定が出た
23
この条件で
本当にウィルスに感染している
確率はどれくらい?
答え 24
9%ぐらい
どう考えるとわかりやすいか? 25
この装置で10万人ぐらいを検査する
100人ぐらいが感染者
非感染者99,900人
感染者100人
比率は正しくない
どう考えるとわかりやすいか? 26
この装置で10万人ぐらいを検査する
100人ぐらいが感染者
感染者
かつ
結果が陽性
99人
非感染者99,900人
感染者100人
非感染者
かつ
結果が陽性
999人
比率は正しくない
どう考えるとわかりやすいか?
99人の感染者かつ結果が陽性
999人の非感染者かつ結果が陽性
27
=
99+999
99
=
1,098
99
≒0.09
9%
結果が陽性
真に感染
真に感染している確率=
ところで…… 28
おきづきだった
だろうか……?
実は…… 29
だということに……
99.9%
常に「感染していない」
と
答えていれば正解率が
正解率はあてにならない
 とはいえさすがに常に「感染していない」と答える
のではシステムとして評価できない
 しかし
 正解率は99.8%ある
 0.999×0.999+0.001×0.001≒0.998
30
マジョリティ
ベースライン
という名前が
ついている
非感染者の割合99.9%で
ランダムに感染していない
と答える
感染者の割合0.01%で
ランダムに感染している
と答える
ようなシステム
正解率はあてにならない
 例えば
 異常検知
 迷惑メール判定
 群衆の中での特定人物の識別
31
Aであるかを判定する問題で、Aである/ないの割合が
極端に違う時
正解率という指標は当てにならない
例えばこんなプレスリリース 32
判定において正解率約8割の
精度を確認しました
精度とは?
システムの評価尺度のはなし
33
正解率以外の尺度 34
適合率
(precision)
Aであると判定したもののうち
本当にAである割合
再現率
(recall)
本当にAであるもののうち
Aであると判定できた割合
※現実の問題では
真の再現率はわからない
ことの方が多い
適合率 35
感染者
かつ
結果が感染
99人
非感染者
かつ
結果が感染
999人
99
99 + 999
≒ 0.09
適合率
(precision)
Aであると判定したもののうち
本当にAである割合
再現率 36
感染者
かつ
結果が感染
99人
再現率
(recall)
本当にAであるもののうち
Aであると判定できた割合
99
100
= 0.99
感染者 100人
適合率と再現率はトレードオフ 37
Aらしい
Aらしくない システムが推定するAらしさ
Aです
Aじゃありません
しきい値
適合率
再現率
適合率
再現率
F値(F-measure)または F1値
適合率と再現率の調和平均という尺度
38
2 × 適合率 × 再現率
適合率 + 再現率
どちらかが極端に下がると値が下がる
いい案配にバランスが取れていると値が上がる
=
計算してみよう 39
マジョリティベースライン 正解率99%のシステム
正解率: 0.998 正解率: 0.99
適合率: 0.001
(precision)
適合率: 0.09
(precision)
再現率: 0.001
(recall)
再現率: 0.99
(recall)
F1値 : 0.0001 F1値 : 0.165
ROC曲線 40
Aらしい
Aらしくない
Aです
Aじゃありません
しきい値
Aでないものの中でAと判定された率
Aであるものの中で
Aと判定された率
0
100%
100%
弧が上にくると
よいシステム
例えばこんなプレスリリース 41
判定において正解率約8割の
精度を確認しました
F1値?
適合率?
正解率?
まとめ
42
まとめ
 条件付き確率の問題は容易に直感を裏切る
 Aである/ないに極端に差がある時は特に注意
正解率はよい指標にならない
 適合率と再現率という指標がある
どちらを重視するかはシステムのさじ加減
 F値というバランスのよさを測る指標がある
43

Contenu connexe

Dernier

Dernier (11)

新人研修 後半 2024/04/26の勉強会で発表されたものです。
新人研修 後半        2024/04/26の勉強会で発表されたものです。新人研修 後半        2024/04/26の勉強会で発表されたものです。
新人研修 後半 2024/04/26の勉強会で発表されたものです。
 
論文紹介:Selective Structured State-Spaces for Long-Form Video Understanding
論文紹介:Selective Structured State-Spaces for Long-Form Video Understanding論文紹介:Selective Structured State-Spaces for Long-Form Video Understanding
論文紹介:Selective Structured State-Spaces for Long-Form Video Understanding
 
Observabilityは従来型の監視と何が違うのか(キンドリルジャパン社内勉強会:2022年10月27日発表)
Observabilityは従来型の監視と何が違うのか(キンドリルジャパン社内勉強会:2022年10月27日発表)Observabilityは従来型の監視と何が違うのか(キンドリルジャパン社内勉強会:2022年10月27日発表)
Observabilityは従来型の監視と何が違うのか(キンドリルジャパン社内勉強会:2022年10月27日発表)
 
Amazon SES を勉強してみる その32024/04/26の勉強会で発表されたものです。
Amazon SES を勉強してみる その32024/04/26の勉強会で発表されたものです。Amazon SES を勉強してみる その32024/04/26の勉強会で発表されたものです。
Amazon SES を勉強してみる その32024/04/26の勉強会で発表されたものです。
 
論文紹介:Video-GroundingDINO: Towards Open-Vocabulary Spatio-Temporal Video Groun...
論文紹介:Video-GroundingDINO: Towards Open-Vocabulary Spatio-Temporal Video Groun...論文紹介:Video-GroundingDINO: Towards Open-Vocabulary Spatio-Temporal Video Groun...
論文紹介:Video-GroundingDINO: Towards Open-Vocabulary Spatio-Temporal Video Groun...
 
論文紹介: The Surprising Effectiveness of PPO in Cooperative Multi-Agent Games
論文紹介: The Surprising Effectiveness of PPO in Cooperative Multi-Agent Games論文紹介: The Surprising Effectiveness of PPO in Cooperative Multi-Agent Games
論文紹介: The Surprising Effectiveness of PPO in Cooperative Multi-Agent Games
 
LoRaWANスマート距離検出センサー DS20L カタログ LiDARデバイス
LoRaWANスマート距離検出センサー  DS20L  カタログ  LiDARデバイスLoRaWANスマート距離検出センサー  DS20L  カタログ  LiDARデバイス
LoRaWANスマート距離検出センサー DS20L カタログ LiDARデバイス
 
Amazon SES を勉強してみる その22024/04/26の勉強会で発表されたものです。
Amazon SES を勉強してみる その22024/04/26の勉強会で発表されたものです。Amazon SES を勉強してみる その22024/04/26の勉強会で発表されたものです。
Amazon SES を勉強してみる その22024/04/26の勉強会で発表されたものです。
 
NewSQLの可用性構成パターン(OCHaCafe Season 8 #4 発表資料)
NewSQLの可用性構成パターン(OCHaCafe Season 8 #4 発表資料)NewSQLの可用性構成パターン(OCHaCafe Season 8 #4 発表資料)
NewSQLの可用性構成パターン(OCHaCafe Season 8 #4 発表資料)
 
業務で生成AIを活用したい人のための生成AI入門講座(社外公開版:キンドリルジャパン社内勉強会:2024年4月発表)
業務で生成AIを活用したい人のための生成AI入門講座(社外公開版:キンドリルジャパン社内勉強会:2024年4月発表)業務で生成AIを活用したい人のための生成AI入門講座(社外公開版:キンドリルジャパン社内勉強会:2024年4月発表)
業務で生成AIを活用したい人のための生成AI入門講座(社外公開版:キンドリルジャパン社内勉強会:2024年4月発表)
 
LoRaWAN スマート距離検出デバイスDS20L日本語マニュアル
LoRaWAN スマート距離検出デバイスDS20L日本語マニュアルLoRaWAN スマート距離検出デバイスDS20L日本語マニュアル
LoRaWAN スマート距離検出デバイスDS20L日本語マニュアル
 

En vedette

How Race, Age and Gender Shape Attitudes Towards Mental Health
How Race, Age and Gender Shape Attitudes Towards Mental HealthHow Race, Age and Gender Shape Attitudes Towards Mental Health
How Race, Age and Gender Shape Attitudes Towards Mental Health
ThinkNow
 
Social Media Marketing Trends 2024 // The Global Indie Insights
Social Media Marketing Trends 2024 // The Global Indie InsightsSocial Media Marketing Trends 2024 // The Global Indie Insights
Social Media Marketing Trends 2024 // The Global Indie Insights
Kurio // The Social Media Age(ncy)
 

En vedette (20)

Everything You Need To Know About ChatGPT
Everything You Need To Know About ChatGPTEverything You Need To Know About ChatGPT
Everything You Need To Know About ChatGPT
 
Product Design Trends in 2024 | Teenage Engineerings
Product Design Trends in 2024 | Teenage EngineeringsProduct Design Trends in 2024 | Teenage Engineerings
Product Design Trends in 2024 | Teenage Engineerings
 
How Race, Age and Gender Shape Attitudes Towards Mental Health
How Race, Age and Gender Shape Attitudes Towards Mental HealthHow Race, Age and Gender Shape Attitudes Towards Mental Health
How Race, Age and Gender Shape Attitudes Towards Mental Health
 
AI Trends in Creative Operations 2024 by Artwork Flow.pdf
AI Trends in Creative Operations 2024 by Artwork Flow.pdfAI Trends in Creative Operations 2024 by Artwork Flow.pdf
AI Trends in Creative Operations 2024 by Artwork Flow.pdf
 
Skeleton Culture Code
Skeleton Culture CodeSkeleton Culture Code
Skeleton Culture Code
 
PEPSICO Presentation to CAGNY Conference Feb 2024
PEPSICO Presentation to CAGNY Conference Feb 2024PEPSICO Presentation to CAGNY Conference Feb 2024
PEPSICO Presentation to CAGNY Conference Feb 2024
 
Content Methodology: A Best Practices Report (Webinar)
Content Methodology: A Best Practices Report (Webinar)Content Methodology: A Best Practices Report (Webinar)
Content Methodology: A Best Practices Report (Webinar)
 
How to Prepare For a Successful Job Search for 2024
How to Prepare For a Successful Job Search for 2024How to Prepare For a Successful Job Search for 2024
How to Prepare For a Successful Job Search for 2024
 
Social Media Marketing Trends 2024 // The Global Indie Insights
Social Media Marketing Trends 2024 // The Global Indie InsightsSocial Media Marketing Trends 2024 // The Global Indie Insights
Social Media Marketing Trends 2024 // The Global Indie Insights
 
Trends In Paid Search: Navigating The Digital Landscape In 2024
Trends In Paid Search: Navigating The Digital Landscape In 2024Trends In Paid Search: Navigating The Digital Landscape In 2024
Trends In Paid Search: Navigating The Digital Landscape In 2024
 
5 Public speaking tips from TED - Visualized summary
5 Public speaking tips from TED - Visualized summary5 Public speaking tips from TED - Visualized summary
5 Public speaking tips from TED - Visualized summary
 
ChatGPT and the Future of Work - Clark Boyd
ChatGPT and the Future of Work - Clark Boyd ChatGPT and the Future of Work - Clark Boyd
ChatGPT and the Future of Work - Clark Boyd
 
Getting into the tech field. what next
Getting into the tech field. what next Getting into the tech field. what next
Getting into the tech field. what next
 
Google's Just Not That Into You: Understanding Core Updates & Search Intent
Google's Just Not That Into You: Understanding Core Updates & Search IntentGoogle's Just Not That Into You: Understanding Core Updates & Search Intent
Google's Just Not That Into You: Understanding Core Updates & Search Intent
 
How to have difficult conversations
How to have difficult conversations How to have difficult conversations
How to have difficult conversations
 
Introduction to Data Science
Introduction to Data ScienceIntroduction to Data Science
Introduction to Data Science
 
Time Management & Productivity - Best Practices
Time Management & Productivity -  Best PracticesTime Management & Productivity -  Best Practices
Time Management & Productivity - Best Practices
 
The six step guide to practical project management
The six step guide to practical project managementThe six step guide to practical project management
The six step guide to practical project management
 
Beginners Guide to TikTok for Search - Rachel Pearson - We are Tilt __ Bright...
Beginners Guide to TikTok for Search - Rachel Pearson - We are Tilt __ Bright...Beginners Guide to TikTok for Search - Rachel Pearson - We are Tilt __ Bright...
Beginners Guide to TikTok for Search - Rachel Pearson - We are Tilt __ Bright...
 
Unlocking the Power of ChatGPT and AI in Testing - A Real-World Look, present...
Unlocking the Power of ChatGPT and AI in Testing - A Real-World Look, present...Unlocking the Power of ChatGPT and AI in Testing - A Real-World Look, present...
Unlocking the Power of ChatGPT and AI in Testing - A Real-World Look, present...
 

裏切られる直感と、確率と精度のはなし

Notes de l'éditeur

  1. 東京フレンドパーク のダーツ とかパネルクイズ アタック25の海外旅行チャレンジ とかテレビ番組のゲーム
  2. もっと厳密にする時には、回答者が当たりを選択した時どちらを除外するかを無作為にするために、司会はゲームを始める前にコインか何かを振っておく、とします
  3. もっと厳密にする時には、回答者が当たりを選択した時どちらを除外するかを無作為にするために、司会はゲームを始める前にコインか何かを振っておく、とします
  4. 算術平均 幾何平均
  5. ROC曲線