スモールデータとビッグデータの違いとは

更新日

投稿日

 

情報マネジメント

 ビッグデータの活用と声高に叫ばれています。無論、自動的にビッグデータが取れれば多いに越したことはありませんが、スモールデータでも十分に検証できます。

 私は顧客アンケート調査の設計から実査、分析までを頻繁に行っていますが、今回は最適な回収データ数について解説します。

 よく、データを何人取ったら有効でしょうか?と質問を受けます。データはたくさん取った方がいいなど、いろいろな意見が飛び交いますが。データ数50人よりデータ数100人。三桁のデータを扱うことを目標にしましょう。特に根拠はありませんが、調査データが 50人よりは 100人の方がよさそうです。

 100人と200人となると、多い方がいいですが、人数が多くなるとそのための工数や費用が掛かります。そこで、統計解析には誤差を推定することが可能です。この考え方から必要なデータ数を考えて見ましょう。

 統計学の中に少ないデータで全体を推定することができます。その時の前提としては

  • データが少ないと全体の誤差が大きい。
  • データが多いと全体の誤差は少ない。

 ではどの程度でしょうか。比率の誤差は簡便法で 1/ √nで推定できるのです。

 100人の比率の誤差は 最大 10%、400人の比率の誤差は最大 5%、1万人の比率の誤差は最大 1%になります。

 例としてアンケート調査等で回答の比率の結果:男性 50%と結果が出ました。

 その時、100人の場合は ± 10%、400人の場合は ± 5%、1万人の場合は ± 1%。

 100人ですと、± 10%も誤差があるので、問題が出てきます。400人ですと、± 5%の誤差なので、統計でよく使う95%の許容範囲に入ってきます。

 また、アンケート調査の段階評価や得点評価において平均値を使うことも多いでしょう。

 平均値の誤差は、簡便法で 2/ √nで推定できます。

 100人の場合、誤差は ± 0.2点、400人の場合、誤差は ± 0.1点、1万人の場合、誤差は ± 0.02点になります。

 400人ですと、平均値 3.5点の結果は全体では 3.4点 ~ 3.6点 にあることが推...

 

情報マネジメント

 ビッグデータの活用と声高に叫ばれています。無論、自動的にビッグデータが取れれば多いに越したことはありませんが、スモールデータでも十分に検証できます。

 私は顧客アンケート調査の設計から実査、分析までを頻繁に行っていますが、今回は最適な回収データ数について解説します。

 よく、データを何人取ったら有効でしょうか?と質問を受けます。データはたくさん取った方がいいなど、いろいろな意見が飛び交いますが。データ数50人よりデータ数100人。三桁のデータを扱うことを目標にしましょう。特に根拠はありませんが、調査データが 50人よりは 100人の方がよさそうです。

 100人と200人となると、多い方がいいですが、人数が多くなるとそのための工数や費用が掛かります。そこで、統計解析には誤差を推定することが可能です。この考え方から必要なデータ数を考えて見ましょう。

 統計学の中に少ないデータで全体を推定することができます。その時の前提としては

  • データが少ないと全体の誤差が大きい。
  • データが多いと全体の誤差は少ない。

 ではどの程度でしょうか。比率の誤差は簡便法で 1/ √nで推定できるのです。

 100人の比率の誤差は 最大 10%、400人の比率の誤差は最大 5%、1万人の比率の誤差は最大 1%になります。

 例としてアンケート調査等で回答の比率の結果:男性 50%と結果が出ました。

 その時、100人の場合は ± 10%、400人の場合は ± 5%、1万人の場合は ± 1%。

 100人ですと、± 10%も誤差があるので、問題が出てきます。400人ですと、± 5%の誤差なので、統計でよく使う95%の許容範囲に入ってきます。

 また、アンケート調査の段階評価や得点評価において平均値を使うことも多いでしょう。

 平均値の誤差は、簡便法で 2/ √nで推定できます。

 100人の場合、誤差は ± 0.2点、400人の場合、誤差は ± 0.1点、1万人の場合、誤差は ± 0.02点になります。

 400人ですと、平均値 3.5点の結果は全体では 3.4点 ~ 3.6点 にあることが推定できます。

 一方費用の観点で見ると、400人と1万人で人数は 25倍にも関わらず。精度は 5倍しか上がりません。となると、闇雲にデータをたくさん取ると、費用対精度で大きく差が開いてきます。これらの観点で、私はアンケート調査で最適回収データ数は 500人と伝えます。

 

   続きを読むには・・・


この記事の著者

石川 朋雄

日本のものづくりは品質向上に切磋琢磨し,高品質な商品を開発しました。高品質商品と顧客価値創造を融合する商品企画のシステム化を提案します。

日本のものづくりは品質向上に切磋琢磨し,高品質な商品を開発しました。高品質商品と顧客価値創造を融合する商品企画のシステム化を提案します。


「情報マネジメント一般」の他のキーワード解説記事

もっと見る
非構造化データにまで拡大! ビッグデータの活用で変わるものづくり

 近年、大量データを分析して、顧客や市場、あるいは自社の現状を定量的に把握し、そこから人間の勘だけでは分からない新たな知見を見出し、それをマーケティングや...

 近年、大量データを分析して、顧客や市場、あるいは自社の現状を定量的に把握し、そこから人間の勘だけでは分からない新たな知見を見出し、それをマーケティングや...


中小製造業のDXへの取り組み(その3)

【中小製造業のDXへの取り組み 連載へのリンク】 1、中小製造業の2つの事業パターン 2、受託製造サービス業へ脱皮する 3、経済産業省DX Se...

【中小製造業のDXへの取り組み 連載へのリンク】 1、中小製造業の2つの事業パターン 2、受託製造サービス業へ脱皮する 3、経済産業省DX Se...


自動車の制御系セキュリティ 制御システム(その11)

    【制御システム 連載目次】 1. セキュリティ脅威と歴史 2. サイバー攻撃事例、情報システムとの違い 3....

    【制御システム 連載目次】 1. セキュリティ脅威と歴史 2. サイバー攻撃事例、情報システムとの違い 3....


「情報マネジメント一般」の活用事例

もっと見る
現場情報の自動収集に道具だてを

 一日の作業指示の出し方で、次のどちらの組織の管理レベルの改善がより進むでしょうか?        ・A社 ➡「x製品を◯個」     ・B...

 一日の作業指示の出し方で、次のどちらの組織の管理レベルの改善がより進むでしょうか?        ・A社 ➡「x製品を◯個」     ・B...


Excelの帳票を見直そう

 オフィス業務においては、マイクロソフトOfficeがデファクトスタンダードになっています。とりわけ活用されているのはExcelでしょう。Excelを使う...

 オフィス業務においては、マイクロソフトOfficeがデファクトスタンダードになっています。とりわけ活用されているのはExcelでしょう。Excelを使う...


‐クレ-ム情報を開発に活用‐  製品・技術開発力強化策の事例(その13)

 前回の事例その12に続いて解説します。顧客から出されたクレ-ムは、技術開発や、関連製品の開発の可能性を潜在させている場合が多いようです。その視点からクレ...

 前回の事例その12に続いて解説します。顧客から出されたクレ-ムは、技術開発や、関連製品の開発の可能性を潜在させている場合が多いようです。その視点からクレ...