<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
    <channel>
        <title>探索的データ分析 on Data Visualization Japan</title>
        <link>https://data-visualization.jp/tags/%E6%8E%A2%E7%B4%A2%E7%9A%84%E3%83%87%E3%83%BC%E3%82%BF%E5%88%86%E6%9E%90/</link>
        <description>Recent content in 探索的データ分析 on Data Visualization Japan</description>
        <generator>Hugo -- gohugo.io</generator>
        <language>ja-jp</language>
        <lastBuildDate>Mon, 28 Dec 2020 00:00:00 +0000</lastBuildDate><atom:link href="https://data-visualization.jp/tags/%E6%8E%A2%E7%B4%A2%E7%9A%84%E3%83%87%E3%83%BC%E3%82%BF%E5%88%86%E6%9E%90/index.xml" rel="self" type="application/rss+xml" /><item>
        <title>西田 勘一郎／データサイエンス革命の駆動力 ― データリテラシーとデータの可視化</title>
        <link>https://data-visualization.jp/data-literacy-viz/</link>
        <pubDate>Mon, 28 Dec 2020 00:00:00 +0000</pubDate>
        
        <guid>https://data-visualization.jp/data-literacy-viz/</guid>
        <description>&lt;p&gt;Data Visualization Japan Meetup 2020（2020年12月28・29日開催）における、西田 勘一郎さん（Exploratory, Inc. CEO）の講演です。科学哲学の視点からデータサイエンスを捉え直し、コロナ禍のデータを実際に可視化しながら、市民のデータリテラシーの重要性を論じます。&lt;/p&gt;
&lt;hr&gt;
&lt;div class=&#34;video-wrapper&#34;&gt;
    &lt;iframe loading=&#34;lazy&#34; 
            src=&#34;https://www.youtube.com/embed/0TnHnun8fCo&#34; 
            allowfullscreen 
            title=&#34;YouTube Video&#34;
    &gt;
    &lt;/iframe&gt;
&lt;/div&gt;

&lt;p&gt;皆さん、こんにちは。矢崎さんに招待していただきました。&lt;/p&gt;
&lt;p&gt;今日は「&lt;strong&gt;データサイエンス革命&lt;/strong&gt;」と私たちが呼んでいるものについて、その中心となるのは&lt;strong&gt;データリテラシー&lt;/strong&gt;と&lt;strong&gt;データの可視化&lt;/strong&gt;ではないかというお話をします。&lt;/p&gt;
&lt;p&gt;今年はコロナで、ほぼインパクトを受けない人が世界中にいなかったくらいの大きな出来事でした。いろいろ考えさせられる年だったと思います。その中で、&lt;strong&gt;データに関わる人間として、データの力に対する大きな失望と、同時に期待を感じるような1年&lt;/strong&gt;でした。&lt;/p&gt;
&lt;h2 id=&#34;自己紹介&#34;&gt;自己紹介
&lt;/h2&gt;&lt;p&gt;&lt;strong&gt;Exploratory&lt;/strong&gt; という会社で CEO をやっています。2016年の春にシリコンバレーで、&lt;strong&gt;データサイエンスを民主化するため&lt;/strong&gt;に立ち上げました。&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;Exploratory&lt;/strong&gt; というアプリケーションを作っていて、データサイエンスをもっと簡単に、誰もがアクセスできるようにしています。ただ&lt;strong&gt;ツールを作るだけではデータサイエンスの民主化はできない&lt;/strong&gt;ので、皆さんの知識やスキルを向上させるべく、&lt;strong&gt;データサイエンス・ブートキャンプ&lt;/strong&gt;などのトレーニングを通じて普及と教育も日々行っています。&lt;/p&gt;
&lt;p&gt;私たちのビジョンは「&lt;strong&gt;誰もがデータをもとに、より良い意思決定をしていける世の中になる&lt;/strong&gt;」こと。ミッションは「&lt;strong&gt;データサイエンスを民主化して、この言葉がなくなるくらい当たり前に使いこなせる時代にする&lt;/strong&gt;」ことです。&lt;/p&gt;
&lt;p&gt;Exploratory というツールは——データを取ってきて、加工して、可視化する。そして「アナリティクス」と呼んでいる機械学習や統計のアルゴリズムを取り入れて、&lt;strong&gt;可視化だけでは捉えきれないパターンやトレンドを発見する。&lt;strong&gt;さらにレポートやダッシュボード、スライドとして&lt;/strong&gt;より多くの人にコミュニケートしていく&lt;/strong&gt;。それを&lt;strong&gt;一つのシームレスな体験として提供できないか&lt;/strong&gt;、というツールです。&lt;/p&gt;
&lt;h2 id=&#34;データサイエンスとは何か&#34;&gt;データサイエンスとは何か
&lt;/h2&gt;&lt;p&gt;「データサイエンスとは何か」という話はよくあります。&lt;strong&gt;100人に聞いたら100通りの答えが返ってくる&lt;/strong&gt;ようなもので、私自身はその定義自体にあまり興味はありません。&lt;strong&gt;酒のつまみにはなる&lt;/strong&gt;と思いますが。&lt;/p&gt;
&lt;p&gt;言ってみれば、**社会的なゴールがあって、それを達成するためにデータをもとにより良い意思決定ができるようになるべきではないか。**私たちが考えるデータサイエンスは、&lt;strong&gt;いつも人間が中心にいて、人間がより良い意思決定をするためにデータを使えないか&lt;/strong&gt;ということです。&lt;/p&gt;
&lt;p&gt;そこで&lt;strong&gt;データを使うだけでなく、サイエンスの手法を使う。&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;「そもそもサイエンスの世界にはデータはいつもあるのだから、データサイエンスなんて言わずにサイエンスでいいじゃないか」という言い方もあると思います。ただ今**一般的に使われているデータサイエンスには、「ビジネスにサイエンスの手法を持ってくる」という文脈がある。**データをしっかり使って意思決定することでビジネスをよりよく回していく、という側面です。&lt;/p&gt;
&lt;p&gt;ここで強調したいのは——&lt;strong&gt;データサイエンスはアルゴリズムや AI といった特別なテクノロジーの話をしているというよりも、ゴールがあって、そこに行くための手段。データサイエンスそのものがゴールではない&lt;/strong&gt;ということです。&lt;/p&gt;
&lt;h2 id=&#34;サイエンスとは何か--カールポパー&#34;&gt;サイエンスとは何か ― カール・ポパー
&lt;/h2&gt;&lt;p&gt;では、そのサイエンスとは何なのか。ヒントとして、&lt;strong&gt;カール・ポパー&lt;/strong&gt;という哲学者の言っていたことが非常に参考になります。&lt;/p&gt;
&lt;blockquote&gt;
&lt;p&gt;&lt;strong&gt;すべての法則や理論は、もはや疑いないと思われるときでさえ、暫定的・推測的・仮説的でしかない。それは誤りや無知として摘発される可能性を、原理的に持っているのである。&lt;/strong&gt;&lt;/p&gt;&lt;/blockquote&gt;
&lt;p&gt;これがすごく重要だと思うんですね。&lt;/p&gt;
&lt;p&gt;アメリカでもこの1年、「&lt;strong&gt;サイエンスをもとに&lt;/strong&gt;」という言葉をみんな簡単に言っていましたが、&lt;strong&gt;誰もサイエンスの本当の意味を理解せずに、サイエンスを宗教として扱って「サイエンス＝正しいもの」という形にしてしまっていた。&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;そもそも&lt;strong&gt;私たちが思っていることは仮説でしかない。ここを忘れるべきではない。&lt;strong&gt;今持っている理論だと思っているものでさえ間違っている可能性があり、&lt;/strong&gt;「まだ棄却されていない仮説」を、私たちはたまたま持っているだけ&lt;/strong&gt;なのです。&lt;/p&gt;
&lt;h3 id=&#34;疑似サイエンス--フロイトの例&#34;&gt;疑似サイエンス ― フロイトの例
&lt;/h3&gt;&lt;p&gt;ポパーがよく使っていた例が&lt;strong&gt;フロイト&lt;/strong&gt;に代表される心理学です。&lt;strong&gt;何も証明することができないし、それを使って予測することもできない。&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;フロイトは「&lt;strong&gt;子どもの頃の経験は、大人になってからの行動や精神状態に大きく影響する&lt;/strong&gt;」と言います。私もニューヨークにいた頃、結婚してからもセラピストに会っていたことがありますが、だいたい**「子どもの頃どうだったか」という話になる。**&lt;/p&gt;
&lt;p&gt;いま人間関係で問題があるとすると、過去に遡って「この時の経験によって今の問題が作られているのではないか」という話になっていく。**「母親の愛情を十分受けていなかったから、今、自信がなくて人間関係もうまくいかない」**と。&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;でも、もし実は愛情をしっかり受けていたとしたら?&lt;/strong&gt; そのときは「&lt;strong&gt;逆に愛情を受けすぎていた。そのせいで母親がいないと自信がない人間になってしまった&lt;/strong&gt;」と言うことができてしまう。&lt;/p&gt;
&lt;p&gt;つまり——**過去に起きたことによって現在を予測しているように見えるが、それは予測ではなく「解釈」**ではないか。&lt;strong&gt;過去にあった都合のいいことを、現在を説明するために引っ張ってきて、うまく解釈をつけているだけ&lt;/strong&gt;ではないか。それが疑似サイエンスだ、とポパーは言うわけです。&lt;/p&gt;
&lt;h3 id=&#34;サイエンス--アインシュタインの例&#34;&gt;サイエンス ― アインシュタインの例
&lt;/h3&gt;&lt;p&gt;では、サイエンスとはどういうことか。&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;アインシュタインのような科学者がやっているのは、過去のデータから現在を解釈することではなく、過去のデータから将来を予測するための理論を作ること。&lt;strong&gt;そして&lt;/strong&gt;その理論によって将来を予測する。予測することで「間違っている」と証明されるリスクを引き受けている。&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;アインシュタインは1915年に一般相対性理論で、&lt;strong&gt;重力は局所的に観察される現象であること、光より速いものはないこと、太陽の光は地球に届くまで8分ほどかかること&lt;/strong&gt;を説明しました。&lt;/p&gt;
&lt;p&gt;それまで——ニュートンの時代の重力の考え方は「&lt;strong&gt;質量を持った物体間の引き合う力&lt;/strong&gt;」で、しかも&lt;strong&gt;無限大の速さ&lt;/strong&gt;で伝わるとされていた。ところがアインシュタインは&lt;strong&gt;時空（スペースタイム）&lt;/strong&gt; という概念を持ち込んで、&lt;strong&gt;その歪みこそが重力&lt;/strong&gt;であり、&lt;strong&gt;光より速いわけはない&lt;/strong&gt;と言ったわけです。&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;重力が時空の歪みであるなら、光の軌道も重力によって曲がる。&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;そして何年か後に&lt;strong&gt;日食&lt;/strong&gt;がありました。そのとき、&lt;strong&gt;本来であれば太陽の影になっているはずの星が、なぜか太陽の横にあるように見えた。&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;なぜか——**星から地球に届く光が、太陽の周りにできた時空の歪みによって曲がる。**すると地球から見ると、**あたかもその星が別の場所にあるように見える。**実際の場所は違うところだった、と。&lt;strong&gt;これがアインシュタインの理論で、後になって証明された&lt;/strong&gt;わけです。&lt;/p&gt;
&lt;p&gt;アインシュタインの理論についてはこういうニュースがたくさんありました。ブラックホールなどもそうです。&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;当たり前のことのように聞こえますが、こういう科学者は「予測することで、観測されたときに間違っていたと言われるリスクを負っている」。それこそがサイエンスだ&lt;/strong&gt;というのがポパーの主張です。&lt;/p&gt;
&lt;h3 id=&#34;まとめると&#34;&gt;まとめると
&lt;/h3&gt;&lt;ul&gt;
&lt;li&gt;&lt;strong&gt;今持っている理論は、間違っている可能性がある&lt;/strong&gt;&lt;/li&gt;
&lt;li&gt;&lt;strong&gt;間違いが証明されるまで、たまたま正しいと思っているだけ&lt;/strong&gt;&lt;/li&gt;
&lt;li&gt;&lt;strong&gt;仮説からいかに間違いを排除していくかがサイエンス&lt;/strong&gt;&lt;/li&gt;
&lt;li&gt;ということは、&lt;strong&gt;その仮説が正しいか間違っているかを判断できるような仮説にしておかなくてはいけない&lt;/strong&gt;&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;良い仮説の条件は——&lt;/p&gt;
&lt;ol&gt;
&lt;li&gt;&lt;strong&gt;計測できる&lt;/strong&gt;（データに関わる人には当たり前でしょう）&lt;/li&gt;
&lt;li&gt;&lt;strong&gt;検証できる&lt;/strong&gt;（正しいかどうかテストできる）&lt;/li&gt;
&lt;li&gt;&lt;strong&gt;反証できる&lt;/strong&gt;（&lt;strong&gt;間違っていると言える基準があるかどうか&lt;/strong&gt;）&lt;/li&gt;
&lt;/ol&gt;
&lt;p&gt;&lt;strong&gt;3つ目が最も重要です。&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;コロナでもそうですが、「マスクに効用がある／ない」「インフルエンザと比べて恐れる必要がある／ない」「都市封鎖をすべき／すべきでない」——&lt;strong&gt;そういうとき、「もし自分たちの仮説が間違っているとしたら、何をもって間違っていたとするのか」が明らかになっていないと、終わりのない議論になっていく。&lt;/strong&gt;&lt;/p&gt;
&lt;h3 id=&#34;サイエンスのプロセス&#34;&gt;サイエンスのプロセス
&lt;/h3&gt;&lt;p&gt;&lt;strong&gt;問題を定義する → 解決するための仮説を作る → 実験してデータを取る → データを分析する → 仮説が間違っているかどうかを判断する → 「今日までは間違っていると言われていない理論」を作る&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;その理論があれば将来を予測できるし、間違っているならそう判断されるべきです。&lt;/p&gt;
&lt;h2 id=&#34;良い質問と探索的データ分析&#34;&gt;良い質問と、探索的データ分析
&lt;/h2&gt;&lt;p&gt;では仮説をどう作るか。やはり&lt;strong&gt;質問&lt;/strong&gt;が重要になってきます。&lt;/p&gt;
&lt;blockquote&gt;
&lt;p&gt;&lt;strong&gt;正しい質問に対するおおよその答えの方が、間違った質問に対する正確な答えよりも、よっぽど良い。&lt;/strong&gt; ——ジョン・テューキー&lt;/p&gt;&lt;/blockquote&gt;
&lt;p&gt;テューキーは&lt;strong&gt;探索的データ分析（EDA）&lt;/strong&gt; を70年代ごろに提唱した人です。&lt;/p&gt;
&lt;p&gt;探索的データ分析とは、簡単にまとめると——&lt;strong&gt;予測、また将来をコントロールするために、データに対してたくさんの質問を投げかけて答えを探していく。それをもってより良い仮説を構築していくための分析。&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;**「データサイエンスとは、そもそも探索的データ分析だよね」と言う人もいます。**サイエンスがいかにより良い仮説を作り上げていくかということであれば、&lt;strong&gt;データを使ってより良い仮説を構築していくことこそがサイエンスの醍醐味&lt;/strong&gt;ではないか。&lt;/p&gt;
&lt;h2 id=&#34;可視化するだけでかなりのことが分かる&#34;&gt;可視化するだけで、かなりのことが分かる
&lt;/h2&gt;&lt;p&gt;ここが今回のテーマです。&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;データサイエンスというと、機械学習や AI、難しそうな統計を考えがちですが、データを使って可視化をするだけで、かなりのことが分かってくる&lt;/strong&gt;のではないか。&lt;/p&gt;
&lt;p&gt;今回のコロナでも、**データはたくさんありました。**日本政府も PCR 検査数、感染者数、死亡者数、入院患者数を出していたし、東京都や地方自治体も、世界中の組織や大学も。オックスフォードは各国の都市封鎖の強さを数値化して公表していました。&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;リアルタイムで、世界中の誰もが、無料で、許可を取ることもなくダウンロードして使えるようになっていた。&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;ところが——データはあったけれど、おかげで世界中の人・政府・組織がより良い意思決定をできていたのかというと、すごく疑問が残ります。&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;ビッグデータの世界でよく言われることですが、&lt;strong&gt;データはどんどん増えているのに、そこから得られる知識は増えていない。&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;なぜか。&lt;strong&gt;そもそもみんな、そのデータをダウンロードすらしていない。ダウンロードしていないので、可視化すらしていない。&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;**みんな難しく考えすぎているんです。実は可視化するだけでかなりのことが分かる。**メディアから垂れ流される情報だけでは分からない情報が見えてくる。&lt;strong&gt;専門的な知識を要することもなく、ただ単に現状を把握するだけでも、かなりのことが分かる&lt;/strong&gt;と思うんですね。&lt;/p&gt;
&lt;h3 id=&#34;例-検査数と陽性者数&#34;&gt;例① 検査数と陽性者数
&lt;/h3&gt;&lt;p&gt;これは厚生労働省からダウンロードしてきた &lt;strong&gt;PCR 検査数&lt;/strong&gt;です。3月ごろに最初の大きな波があって、夏、そして最近と波があり、今どんどん増えている。&lt;/p&gt;
&lt;p&gt;オレンジが検査数、青が陽性者数です。（&lt;strong&gt;可視化のカンファレンスで、凡例もタイトルもない酷い見せ方を一つしてしまっていて申し訳ないのですが。&lt;/strong&gt;）&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;検査数は上がっているけれど、陽性者数自体はあまり上がっていないように見える。&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;数の桁が圧倒的に違うので、&lt;strong&gt;スケールを変えて第2軸を使ってみる&lt;/strong&gt;と——**この2つは相関しているように見える。**同じ時に上がって、同じ時に下がる。&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;「最近すごく陽性者数が増えている、大変なことになっている」と考えることもできますが、「ただし検査数も増えている」という情報を文脈として捉えておくのは、すごく重要&lt;/strong&gt;だと思うんですね。&lt;/p&gt;
&lt;p&gt;さらに&lt;strong&gt;死亡者数&lt;/strong&gt;も重ねてみると、&lt;strong&gt;陽性者数は上がっているけれど、死亡者数は上がってはいるものの、ものすごく上がっているわけではない&lt;/strong&gt;ことが見えると思います。&lt;/p&gt;
&lt;h3 id=&#34;例-スウェーデンは本当に大変なことになっていたか&#34;&gt;例② スウェーデンは本当に「大変なこと」になっていたか
&lt;/h3&gt;&lt;p&gt;日本はいわゆる欧米で言うロックダウンをほぼしていません。一方、欧米は思い切ったロックダウンをしました。&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;このロックダウンが必要だったのかという話でよく出てくるのがスウェーデン&lt;/strong&gt;です。（『ファクトフルネス』を書いたハンス・ロスリングの出身国でもありますね。）&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;この国は基本的にロックダウンをしなかった国&lt;/strong&gt;で、「&lt;strong&gt;スウェーデンはロックダウンしなかったから大変なことになっている&lt;/strong&gt;」という話をメディアでよく目にします。特にアメリカにいると。&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;しかしデータにして、ただ時間軸で人口あたりの死亡者数を見るだけで、全然違う姿——というより、より現実にある姿が見えてきます。&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;このチャートで、**一番大きな青いのがスウェーデンなら「ロックダウンしないとある程度の被害は起きるのかな」と見えそうですが、これはベルギーなんです。**その次に多いのはスペインやイタリア。&lt;/p&gt;
&lt;p&gt;**では、スウェーデンはどれくらいか。この辺です。**別に少ないわけではないけれど、&lt;strong&gt;多いわけでもない。&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;こういう質問はすごく重要&lt;/strong&gt;だと思うんですね。「ロックダウンをしなかったから大変なことになっているのか」というとき、「&lt;strong&gt;他の国、施策をしていない国と比べて明らかな差があるのかないのか&lt;/strong&gt;」。見たところ、そんなに差がない。&lt;/p&gt;
&lt;p&gt;これだけで「ロックダウンは意味がなかった」という結論に持っていくわけではありません。&lt;strong&gt;それぞれの国の事情は違う&lt;/strong&gt;ので。&lt;strong&gt;ただ、こういうデータの見方は文脈を捉える上で重要&lt;/strong&gt;なのではないか。&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;これこそが私の言おうとしている可視化の力&lt;/strong&gt;です。この上にさらに統計の難しい話をしていきがちですが、&lt;strong&gt;「これ以上のことが本当に分かるのか」。可視化しただけでかなり十分な文脈が分かる。ですが、なぜかここまでもみんなやらない。これこそが今の問題&lt;/strong&gt;なんじゃないかと思っています。&lt;/p&gt;
&lt;h3 id=&#34;例-日本はどうなのか&#34;&gt;例③ 日本はどうなのか
&lt;/h3&gt;&lt;p&gt;「感染者数が大変だ」と言っているこの日本を見てみると——**赤いところです。**スウェーデンよりももちろん低いですが、**ここにあるどの国と比べても圧倒的に低い。**人口あたりの死者数で比べると。&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;私はアメリカにいますが、アメリカやイギリス、ヨーロッパの人たちが「コロナが大変だ」と言っているその大変さとは、全然違うはず&lt;/strong&gt;なんですね。&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;こういった文脈を、データにして可視化することによって捉えておくのはすごく重要&lt;/strong&gt;だと思います。&lt;/p&gt;
&lt;p&gt;**私が言いたいのは「日本は全然心配する必要ない」といった大げさなことではありません。**ただ、&lt;strong&gt;こうやって比べることで、どれくらいのインパクトがあるのか、どれくらいの影響が起きているのかを知ることが重要&lt;/strong&gt;だということです。&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;これから皆さんの毎日の行動が変わるかもしれない。ビジネスが、仕事が、学校が変わるかもしれない。そういうときに、これくらいの文脈は誰もが捉えておくべき&lt;/strong&gt;だと思うんですね。&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;そしてなぜかメディアは見せない情報なので、一人ひとりの市民がこういう情報を自分で掴んで、さらに発信していくことが求められている時代&lt;/strong&gt;なのではないかと思います。&lt;/p&gt;
&lt;h3 id=&#34;例-オックスフォードのロックダウン指数&#34;&gt;例④ オックスフォードのロックダウン指数
&lt;/h3&gt;&lt;p&gt;各国の都市封鎖、マスク、学校閉鎖、職場閉鎖、ソーシャルディスタンスといったものを重み付けして指数にしたものです。&lt;strong&gt;赤が日本。&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;これを見ると、&lt;strong&gt;日本は1年を通じてずっと比較的緩い。&lt;/strong&gt;「緩いから最近の感染者数が増えているんじゃないか」という考え方もできますが、&lt;strong&gt;逆に、日本よりずっと厳しい国がたくさんある。&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;こんなに厳しい国があるにもかかわらず、なぜこういう差が出ているのか。この質問はすごく重要な質問&lt;/strong&gt;だと思うんですね。私も今でも自分に、そしていろんな人に問い続けています。&lt;/p&gt;
&lt;p&gt;**「日本が欧米並みの都市封鎖をすることで、本当にそれが役に立つ」ということが、こういったデータから捉えきれるのだろうか。**それはどこかの理論なのかもしれないけれど、**それはフロイト的な理論ではないのか。**本当にデータからそういった傾向が掴めるのかどうか、&lt;strong&gt;見て比べていく必要がある&lt;/strong&gt;のではないかと思います。&lt;/p&gt;
&lt;h2 id=&#34;データサイエンス革命--宗教改革との相似&#34;&gt;データサイエンス革命 ― 宗教改革との相似
&lt;/h2&gt;&lt;p&gt;今回のコロナの経験から、私たちは何を学ぶべきなのか。&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;宗教改革&lt;/strong&gt;が16世紀に起こります。その前の15世紀に&lt;strong&gt;グーテンベルクが印刷機を発明&lt;/strong&gt;し、その後に宗教改革があり、さらにその後に科学革命がある——15・16・17世紀という流れがあります。&lt;/p&gt;
&lt;p&gt;もともと昔は、**教会がすべての情報を管理していました。**ほとんどの人は教会に行って、司祭の言う情報を得た。**なぜかというと、聖書がそこにしかなかったから。**聖書を作るのは大変で、みんな手書きで書いていたわけです。&lt;/p&gt;
&lt;p&gt;**それが印刷機の発明によって、聖書が一気に増えた。&lt;strong&gt;そうすると&lt;/strong&gt;教会が聖書を独占できなくなり、多くの人が聖書に直接アクセスできる時代になった。**ここでプロテスタントの改革が起きるわけです。&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;このときに一気にリテラシー（読み書き）が上がって、多くの人が実際に聖書を読める時代になっていく。&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;グラフの上の方——&lt;strong&gt;オランダ、イギリス、スウェーデンといったプロテスタントに流れた国&lt;/strong&gt;のリテラシーが**1600年ごろから一気に上がっている。**カトリックの国に比べて特徴的です。&lt;/p&gt;
&lt;h3 id=&#34;今同じことが起きている&#34;&gt;今、同じことが起きている
&lt;/h3&gt;&lt;p&gt;&lt;strong&gt;インターネット革命によってデータが一気に増えました。&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;**それまでデータは、科学者やメディアに独占されてきた。**それが今、データの数があまりに増えて、&lt;strong&gt;一般の市民が誰でも同じデータをダウンロードできる時代になった。&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;市民が直接データにアクセスして、そこから——真実と言うと大げさですが——現時点で起きている事実を掴み出すことができるようになった。一部の科学者、一部のメディアを通さずに。&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;これによってデータリテラシーがどんどん上がってくる時代になる&lt;/strong&gt;と思います。より多くの人がデータにアクセスして、&lt;strong&gt;データに質問を投げかけ、そこからいろんな議論をしていく時代になっていくべき&lt;/strong&gt;なんじゃないかと。&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;これが私たちが言っているデータサイエンス革命&lt;/strong&gt;です。&lt;/p&gt;
&lt;h2 id=&#34;分からないなら怖がるのではなく学ぶこと&#34;&gt;分からないなら、怖がるのではなく学ぶこと
&lt;/h2&gt;&lt;blockquote&gt;
&lt;p&gt;&lt;strong&gt;もし分からないのであれば、するべきことは怖がることではなく、学ぶことだ。&lt;/strong&gt; ——アイン・ランド&lt;/p&gt;&lt;/blockquote&gt;
&lt;p&gt;コロナのように恐れやパニックが起きるときこそ、&lt;strong&gt;それが何なのかをしっかり学ぶべき&lt;/strong&gt;だと思うんです。もちろんウイルスを学ぶこともありますが、&lt;strong&gt;現実に起きていることがどうなっているのかを学べるのが、実はデータ&lt;/strong&gt;だと思うんですね。&lt;/p&gt;
&lt;p&gt;**そこで効果的な手段がデータの可視化。**答えは見つからないかもしれないけれど、&lt;strong&gt;目の前にあるデータに問いかけていくことによって、パニックになるよりは、少なくとも心の平静は取れる。&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;これこそが、今の時代のデータリテラシーの重要性&lt;/strong&gt;です。&lt;/p&gt;
&lt;h2 id=&#34;最後に&#34;&gt;最後に
&lt;/h2&gt;&lt;p&gt;最後は告知っぽくなりますが、&lt;strong&gt;データサイエンス・ブートキャンプ&lt;/strong&gt;というトレーニングを提供しています。データの基礎、可視化の基礎、統計の基礎から始まってモデリングまで話しますが、**3日間を通して学んでほしいのは「どうやって仮説を作っていくか」、そして「どうやってその仮説を検証していくか」。**その手段としていろんな手法がある、ということです。&lt;/p&gt;
&lt;p&gt;今回のオーディエンスの方たちはデータの可視化を共通項にされていると思いますが、&lt;strong&gt;可視化ができるということは、すでにデータサイエンスのコックピットにいる&lt;/strong&gt;と思うんですね。&lt;/p&gt;
&lt;p&gt;**今わかっていると思っていることは仮説かもしれない。メディアやニュースから見たことも仮説かもしれない。**そこに対していろんな質問をして、&lt;strong&gt;いろんな角度から可視化することによって、データと対話していきましょう。&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;そしてデータリテラシーをもっと上げていくことで、より良い世の中が見えてくる。&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;いろんな意見を持った市民が多くなればなるほど、異なった意見でも健康的な議論をしていくことで、社会として、市民の集団として、より真実に迫っていくことができるんじゃないか。&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;これこそが、私が今年気づいたこと、再認識したことであり、&lt;strong&gt;今こそデータサイエンスとデータリテラシーがものすごく重要だ&lt;/strong&gt;と思っていることです。&lt;/p&gt;
&lt;p&gt;すごく駆け足になってしまいましたが、以上で終わりたいと思います。どうもご清聴ありがとうございました。&lt;/p&gt;</description>
        </item>
        
    </channel>
</rss>
