SlideShare une entreprise Scribd logo
1  sur  47
Télécharger pour lire hors ligne
Masinõpe ja
                    bioinformaatika
                            Kaur Alasoo




Monday, November 30, 2009
Millest täna juttu
                                 tuleb?


                   • Mis on masinõpe?
                   • Juhendamata ja juhendatud õppimine
                   • Näited masinõppe rakendustest
                   • Masinõpe ja bioinformaatika




Monday, November 30, 2009
Masinõpe on mustrite
                         otsimine andmetest




                                      Autor: Federico Stevanin


Monday, November 30, 2009
Motiveeriv näide
                            Meil on eesti- ja ingliskeelsed laused:
                                          Kas ma Eestit unes nägin?"
                                           "Nägin lained laevu täis,"
                                           "nägin viljarikast randa,"
                                          "merehõlm ta ümber käis."

                                   "I walk the silent, Christmas-snowy path,"
                                "that goes across the homeland in its suffering."
                               "At each doorstep I would like to bend my knee:"
                                     "there is no house without mourning.”


                Kuidas ennustada, mis keeles on kirjutatud uus
                                   lause?

Monday, November 30, 2009
Millest täna juttu
                                 tuleb?


                   • Mis on masinõpe?
                   • Juhendamata ja juhendatud õppimine
                   • Näited masinõppe rakendustest
                   • Masinõpe ja bioinformaatika




Monday, November 30, 2009
Kuidas

                       Juhendamata õppimine




Monday, November 30, 2009
Kuidas

                       Juhendamata õppimine




                              klasterdamine

Monday, November 30, 2009
Kuidas

                       Juhendamata õppimine




Monday, November 30, 2009
Kuidas

                       Juhendamata õppimine




                            erindite otsimine (outlier detetection)

Monday, November 30, 2009
Kuidas

                            Juhendatud õppimine




Monday, November 30, 2009
Kuidas

                            Juhendatud õppimine




                                 klassifitseerimine

Monday, November 30, 2009
Kuidas

                            Juhendatud õppimine




                                 klassifitseerimine

Monday, November 30, 2009
Kuidas

                            Juhendatud õppimine




                                 klassifitseerimine

Monday, November 30, 2009
Kuidas

                            Juhendatud õppimine




                                 klassifitseerimine

Monday, November 30, 2009
Kuidas

                            Juhendatud õppimine




                                 klassifitseerimine

Monday, November 30, 2009
Mida tähendab aru saada?
                            Juhendatud õppimine




Monday, November 30, 2009
Mida tähendab aru saada?
                            Juhendatud õppimine




                                  regressioon
Monday, November 30, 2009
Oluline on piirata otsitavate
                                 Mida tähendab aru saada?
                             mustrite hulka




Monday, November 30, 2009
Oluline on piirata otsitavate
                                 Mida tähendab aru saada?
                             mustrite hulka




                                                   ?




Monday, November 30, 2009
Lineaarne regressioon
                       Oluline on piirata otsitavate
                                             mustrite hulka
                            0.6


                            0.4


                            0.2


                            0.0


                            −0.2


                            −0.4


                            −0.6


                            −0.8


                            −1.0


                            −1.2
                               −1.0   −0.8   −0.6   −0.4   −0.2   0.0   0.2   0.4   0.6   0.8




Monday, November 30, 2009
Õppimise kolm sammu



                   • Määrame huvipakkuvate mustrite hulga
                   • Määrame mustri headuse mõõdu
                   • Otsime parimat mustrit




Monday, November 30, 2009
Õppimise kolm sammu



                   • Määrame huvipakkuvate mustrite hulga
                   • Määrame mustri headuse mõõdu
                   • Otsime parimat mustrit

                              Selleks on vaja statistikat ja optimeerimist.



Monday, November 30, 2009
Oluline on kontrollida
                    mustrite olulisust




                               The Bible Code
Monday, November 30, 2009
Mõned ennustused

                                     BIBLE CODE:GEN:3:6
                                     JOE BIDEN - PRESIDENT - VICE
                                     OBAMA'S CHOICE - SELECTION


                                     BIBLE CODE 2: GEN:29:15
                                     BARAK OBAMA - ASSASSINATION
                                     GUNMAN - CONSPIRACY
              (29. sept - 30. okt)   TISHRI- HE WILL DIE
                                     PANIC - SUBSTITUTE - REPLACEMENT
                                                       http://www.satansrapture.com/obama.htm


Monday, November 30, 2009
Millest täna juttu
                                 tuleb?


                   • Mis on masinõpe?
                   • Juhendamata ja juhendatud õppimine
                   • Näited masinõppe rakendustest
                   • Masinõpe ja bioinformaatika




Monday, November 30, 2009
Motiveeriv näide
                            Meil on eesti- ja ingliskeelsed laused:
                                          Kas ma Eestit unes nägin?"
                                           "Nägin lained laevu täis,"
                                           "nägin viljarikast randa,"
                                          "merehõlm ta ümber käis."

                                   "I walk the silent, Christmas-snowy path,"
                                "that goes across the homeland in its suffering."
                               "At each doorstep I would like to bend my knee:"
                                     "there is no house without mourning.”


                Kuidas ennustada, mis keeles on kirjutatud uus
                                   lause?

Monday, November 30, 2009
Kuidas

                            Juhendatud õppimine




                                 klassifitseerimine

Monday, November 30, 2009
Sõnade häälduse
                               õppimine




Monday, November 30, 2009
Alzheimer’i tõve
                            kindlakstegemine
                                96% vs 85%




                                      PC beats doctor in scan tests (BBC.co.uk)



Monday, November 30, 2009
Automaatne
                            spämmifilter




Monday, November 30, 2009
Beautification engine




                                       Pilt: NYTimes


Monday, November 30, 2009
Beautification engine
                                                               Data-Driven Enhancement of Facial Attractiveness    •   38

                            Original Facial Data                                      Training Set




                                                                     Beautification
                                                                        engine
                     feature points     distances vector


                                                                                                Modified
                                                                                                distances
                                                                                                 vector

                                                                            distance
                                                                           embedding

                  input image         image warp     result image

                                              Figure 3: Our facialhttp://leyvand.com/research/beautification2008/
                                                                   beautification process.

Monday, November 30, 2009
Beautification engine




                            Enne     Pärast
Monday, November 30, 2009
Beautifcation engine




                              Enne        Pärast
Monday, November 30, 2009
Beautification engine




                            Enne     Pärast

Monday, November 30, 2009
Beautification engine




                            Enne     Pärast

Monday, November 30, 2009
Ülesanne



                   • Mille jaoks saaks juhendatud ja
                     juhendamata õppimist kasutada? Tooge
                     mõlema kohta vähemalt üks näide.




Monday, November 30, 2009
Millest täna juttu
                                 tuleb?


                   • Mis on masinõpe?
                   • Juhendamata ja juhendatud õppimine
                   • Näited masinõppe rakendustest
                   • Masinõpe ja bioinformaatika



Monday, November 30, 2009
Bioinformaatika




Monday, November 30, 2009
Bio + informaatika




Monday, November 30, 2009
Bioloogia                     informaatika
 probleemid                 +    rakendused




Monday, November 30, 2009
Bioloogia                           informaatika
probleemid                      +     rakendused
    • Kuidas saab ühest             • Kuidas andmetest
      rakust terve organism?          õppida?

    • Mis põhjustab vähki?          • Kuidas saada hakkama
                                      väga suurte andmetega?
    • Mis teeb inimesest
      inimese ja mitte hiire?       • Kuidas modelleerida,
                                      simuleerida ja
    • ...                             visualiseerida?



Monday, November 30, 2009
Kandidaatgeenide
                                otsimine
                                    5372 experiments
                                     6108




            405
        angiogenes



                   22283
                   genes




Monday, November 30, 2009
Bioloogiliste
                      võrgustike taastamine




Monday, November 30, 2009
!"#$%&'(&##)*&%+,-
                            Motiivide otsimine
      !"#$%#&'()*''#"&(+,&,&-




    02
Monday, November 30, 2009         4*56,&#(7#*"&,&-(88(9&'":;%5',:&   ./00/1223
Kokkuvõte

                   • Masinõpe on andmetest mustrite
                     otsimine.
                   • Masinõpe jaguneb juhendatud ja
                     juhendamata õppimiseks.
                   • Sellega saab väga lahedaid asju teha.
                   • Masinõpe bioinformaatikas aitab meil aru
                     saada sellest, kuidas inimene töötab.


Monday, November 30, 2009
Masinõppega seotud
                                  ained

                   • MTAT.03.183 Andmekaeve
                   • MTAT.03.227 Masinõpe
                   • MTMS.02.035 Tehisõpe
                   • http://courses.cs.ut.ee/datamining/
                   • Statistika ja tõenäosusteooria



Monday, November 30, 2009

Contenu connexe

En vedette

How Race, Age and Gender Shape Attitudes Towards Mental Health
How Race, Age and Gender Shape Attitudes Towards Mental HealthHow Race, Age and Gender Shape Attitudes Towards Mental Health
How Race, Age and Gender Shape Attitudes Towards Mental Health
ThinkNow
 
Social Media Marketing Trends 2024 // The Global Indie Insights
Social Media Marketing Trends 2024 // The Global Indie InsightsSocial Media Marketing Trends 2024 // The Global Indie Insights
Social Media Marketing Trends 2024 // The Global Indie Insights
Kurio // The Social Media Age(ncy)
 

En vedette (20)

Everything You Need To Know About ChatGPT
Everything You Need To Know About ChatGPTEverything You Need To Know About ChatGPT
Everything You Need To Know About ChatGPT
 
Product Design Trends in 2024 | Teenage Engineerings
Product Design Trends in 2024 | Teenage EngineeringsProduct Design Trends in 2024 | Teenage Engineerings
Product Design Trends in 2024 | Teenage Engineerings
 
How Race, Age and Gender Shape Attitudes Towards Mental Health
How Race, Age and Gender Shape Attitudes Towards Mental HealthHow Race, Age and Gender Shape Attitudes Towards Mental Health
How Race, Age and Gender Shape Attitudes Towards Mental Health
 
AI Trends in Creative Operations 2024 by Artwork Flow.pdf
AI Trends in Creative Operations 2024 by Artwork Flow.pdfAI Trends in Creative Operations 2024 by Artwork Flow.pdf
AI Trends in Creative Operations 2024 by Artwork Flow.pdf
 
Skeleton Culture Code
Skeleton Culture CodeSkeleton Culture Code
Skeleton Culture Code
 
PEPSICO Presentation to CAGNY Conference Feb 2024
PEPSICO Presentation to CAGNY Conference Feb 2024PEPSICO Presentation to CAGNY Conference Feb 2024
PEPSICO Presentation to CAGNY Conference Feb 2024
 
Content Methodology: A Best Practices Report (Webinar)
Content Methodology: A Best Practices Report (Webinar)Content Methodology: A Best Practices Report (Webinar)
Content Methodology: A Best Practices Report (Webinar)
 
How to Prepare For a Successful Job Search for 2024
How to Prepare For a Successful Job Search for 2024How to Prepare For a Successful Job Search for 2024
How to Prepare For a Successful Job Search for 2024
 
Social Media Marketing Trends 2024 // The Global Indie Insights
Social Media Marketing Trends 2024 // The Global Indie InsightsSocial Media Marketing Trends 2024 // The Global Indie Insights
Social Media Marketing Trends 2024 // The Global Indie Insights
 
Trends In Paid Search: Navigating The Digital Landscape In 2024
Trends In Paid Search: Navigating The Digital Landscape In 2024Trends In Paid Search: Navigating The Digital Landscape In 2024
Trends In Paid Search: Navigating The Digital Landscape In 2024
 
5 Public speaking tips from TED - Visualized summary
5 Public speaking tips from TED - Visualized summary5 Public speaking tips from TED - Visualized summary
5 Public speaking tips from TED - Visualized summary
 
ChatGPT and the Future of Work - Clark Boyd
ChatGPT and the Future of Work - Clark Boyd ChatGPT and the Future of Work - Clark Boyd
ChatGPT and the Future of Work - Clark Boyd
 
Getting into the tech field. what next
Getting into the tech field. what next Getting into the tech field. what next
Getting into the tech field. what next
 
Google's Just Not That Into You: Understanding Core Updates & Search Intent
Google's Just Not That Into You: Understanding Core Updates & Search IntentGoogle's Just Not That Into You: Understanding Core Updates & Search Intent
Google's Just Not That Into You: Understanding Core Updates & Search Intent
 
How to have difficult conversations
How to have difficult conversations How to have difficult conversations
How to have difficult conversations
 
Introduction to Data Science
Introduction to Data ScienceIntroduction to Data Science
Introduction to Data Science
 
Time Management & Productivity - Best Practices
Time Management & Productivity -  Best PracticesTime Management & Productivity -  Best Practices
Time Management & Productivity - Best Practices
 
The six step guide to practical project management
The six step guide to practical project managementThe six step guide to practical project management
The six step guide to practical project management
 
Beginners Guide to TikTok for Search - Rachel Pearson - We are Tilt __ Bright...
Beginners Guide to TikTok for Search - Rachel Pearson - We are Tilt __ Bright...Beginners Guide to TikTok for Search - Rachel Pearson - We are Tilt __ Bright...
Beginners Guide to TikTok for Search - Rachel Pearson - We are Tilt __ Bright...
 
Unlocking the Power of ChatGPT and AI in Testing - A Real-World Look, present...
Unlocking the Power of ChatGPT and AI in Testing - A Real-World Look, present...Unlocking the Power of ChatGPT and AI in Testing - A Real-World Look, present...
Unlocking the Power of ChatGPT and AI in Testing - A Real-World Look, present...
 

Masinõpe ja bioinformaatika

  • 1. Masinõpe ja bioinformaatika Kaur Alasoo Monday, November 30, 2009
  • 2. Millest täna juttu tuleb? • Mis on masinõpe? • Juhendamata ja juhendatud õppimine • Näited masinõppe rakendustest • Masinõpe ja bioinformaatika Monday, November 30, 2009
  • 3. Masinõpe on mustrite otsimine andmetest Autor: Federico Stevanin Monday, November 30, 2009
  • 4. Motiveeriv näide Meil on eesti- ja ingliskeelsed laused: Kas ma Eestit unes nägin?" "Nägin lained laevu täis," "nägin viljarikast randa," "merehõlm ta ümber käis." "I walk the silent, Christmas-snowy path," "that goes across the homeland in its suffering." "At each doorstep I would like to bend my knee:" "there is no house without mourning.” Kuidas ennustada, mis keeles on kirjutatud uus lause? Monday, November 30, 2009
  • 5. Millest täna juttu tuleb? • Mis on masinõpe? • Juhendamata ja juhendatud õppimine • Näited masinõppe rakendustest • Masinõpe ja bioinformaatika Monday, November 30, 2009
  • 6. Kuidas Juhendamata õppimine Monday, November 30, 2009
  • 7. Kuidas Juhendamata õppimine klasterdamine Monday, November 30, 2009
  • 8. Kuidas Juhendamata õppimine Monday, November 30, 2009
  • 9. Kuidas Juhendamata õppimine erindite otsimine (outlier detetection) Monday, November 30, 2009
  • 10. Kuidas Juhendatud õppimine Monday, November 30, 2009
  • 11. Kuidas Juhendatud õppimine klassifitseerimine Monday, November 30, 2009
  • 12. Kuidas Juhendatud õppimine klassifitseerimine Monday, November 30, 2009
  • 13. Kuidas Juhendatud õppimine klassifitseerimine Monday, November 30, 2009
  • 14. Kuidas Juhendatud õppimine klassifitseerimine Monday, November 30, 2009
  • 15. Kuidas Juhendatud õppimine klassifitseerimine Monday, November 30, 2009
  • 16. Mida tähendab aru saada? Juhendatud õppimine Monday, November 30, 2009
  • 17. Mida tähendab aru saada? Juhendatud õppimine regressioon Monday, November 30, 2009
  • 18. Oluline on piirata otsitavate Mida tähendab aru saada? mustrite hulka Monday, November 30, 2009
  • 19. Oluline on piirata otsitavate Mida tähendab aru saada? mustrite hulka ? Monday, November 30, 2009
  • 20. Lineaarne regressioon Oluline on piirata otsitavate mustrite hulka 0.6 0.4 0.2 0.0 −0.2 −0.4 −0.6 −0.8 −1.0 −1.2 −1.0 −0.8 −0.6 −0.4 −0.2 0.0 0.2 0.4 0.6 0.8 Monday, November 30, 2009
  • 21. Õppimise kolm sammu • Määrame huvipakkuvate mustrite hulga • Määrame mustri headuse mõõdu • Otsime parimat mustrit Monday, November 30, 2009
  • 22. Õppimise kolm sammu • Määrame huvipakkuvate mustrite hulga • Määrame mustri headuse mõõdu • Otsime parimat mustrit Selleks on vaja statistikat ja optimeerimist. Monday, November 30, 2009
  • 23. Oluline on kontrollida mustrite olulisust The Bible Code Monday, November 30, 2009
  • 24. Mõned ennustused BIBLE CODE:GEN:3:6 JOE BIDEN - PRESIDENT - VICE OBAMA'S CHOICE - SELECTION BIBLE CODE 2: GEN:29:15 BARAK OBAMA - ASSASSINATION GUNMAN - CONSPIRACY (29. sept - 30. okt) TISHRI- HE WILL DIE PANIC - SUBSTITUTE - REPLACEMENT http://www.satansrapture.com/obama.htm Monday, November 30, 2009
  • 25. Millest täna juttu tuleb? • Mis on masinõpe? • Juhendamata ja juhendatud õppimine • Näited masinõppe rakendustest • Masinõpe ja bioinformaatika Monday, November 30, 2009
  • 26. Motiveeriv näide Meil on eesti- ja ingliskeelsed laused: Kas ma Eestit unes nägin?" "Nägin lained laevu täis," "nägin viljarikast randa," "merehõlm ta ümber käis." "I walk the silent, Christmas-snowy path," "that goes across the homeland in its suffering." "At each doorstep I would like to bend my knee:" "there is no house without mourning.” Kuidas ennustada, mis keeles on kirjutatud uus lause? Monday, November 30, 2009
  • 27. Kuidas Juhendatud õppimine klassifitseerimine Monday, November 30, 2009
  • 28. Sõnade häälduse õppimine Monday, November 30, 2009
  • 29. Alzheimer’i tõve kindlakstegemine 96% vs 85% PC beats doctor in scan tests (BBC.co.uk) Monday, November 30, 2009
  • 30. Automaatne spämmifilter Monday, November 30, 2009
  • 31. Beautification engine Pilt: NYTimes Monday, November 30, 2009
  • 32. Beautification engine Data-Driven Enhancement of Facial Attractiveness • 38 Original Facial Data Training Set Beautification engine feature points distances vector Modified distances vector distance embedding input image image warp result image Figure 3: Our facialhttp://leyvand.com/research/beautification2008/ beautification process. Monday, November 30, 2009
  • 33. Beautification engine Enne Pärast Monday, November 30, 2009
  • 34. Beautifcation engine Enne Pärast Monday, November 30, 2009
  • 35. Beautification engine Enne Pärast Monday, November 30, 2009
  • 36. Beautification engine Enne Pärast Monday, November 30, 2009
  • 37. Ülesanne • Mille jaoks saaks juhendatud ja juhendamata õppimist kasutada? Tooge mõlema kohta vähemalt üks näide. Monday, November 30, 2009
  • 38. Millest täna juttu tuleb? • Mis on masinõpe? • Juhendamata ja juhendatud õppimine • Näited masinõppe rakendustest • Masinõpe ja bioinformaatika Monday, November 30, 2009
  • 40. Bio + informaatika Monday, November 30, 2009
  • 41. Bioloogia informaatika probleemid + rakendused Monday, November 30, 2009
  • 42. Bioloogia informaatika probleemid + rakendused • Kuidas saab ühest • Kuidas andmetest rakust terve organism? õppida? • Mis põhjustab vähki? • Kuidas saada hakkama väga suurte andmetega? • Mis teeb inimesest inimese ja mitte hiire? • Kuidas modelleerida, simuleerida ja • ... visualiseerida? Monday, November 30, 2009
  • 43. Kandidaatgeenide otsimine 5372 experiments 6108 405 angiogenes 22283 genes Monday, November 30, 2009
  • 44. Bioloogiliste võrgustike taastamine Monday, November 30, 2009
  • 45. !"#$%&'(&##)*&%+,- Motiivide otsimine !"#$%#&'()*''#"&(+,&,&- 02 Monday, November 30, 2009 4*56,&#(7#*"&,&-(88(9&'":;%5',:& ./00/1223
  • 46. Kokkuvõte • Masinõpe on andmetest mustrite otsimine. • Masinõpe jaguneb juhendatud ja juhendamata õppimiseks. • Sellega saab väga lahedaid asju teha. • Masinõpe bioinformaatikas aitab meil aru saada sellest, kuidas inimene töötab. Monday, November 30, 2009
  • 47. Masinõppega seotud ained • MTAT.03.183 Andmekaeve • MTAT.03.227 Masinõpe • MTMS.02.035 Tehisõpe • http://courses.cs.ut.ee/datamining/ • Statistika ja tõenäosusteooria Monday, November 30, 2009