平均値の求め方完全ガイド|中央値との違いと外れ値の罠を徹底解説

目次
平均値の求め方完全ガイド|中央値との違いと外れ値の罠を徹底解説
平均値の求め方完全ガイド|中央値との違いと外れ値の罠を徹底解説
@ creator • Click to Play Video Inline
🎵 平均値の求め方完全ガイド|中央値との違いと外れ値の罠を徹底解説

学校のテストの平均点から職場の売上目標、さらには毎月の貯蓄額や給与水準まで、あらゆる情報判断の基準として使われる指標が「平均値」です。算数の授業で教わる「すべての数値を足して、その個数で割る」というシンプルな計算は、誰しも一度は触れた経験があるはずです。しかし、その手軽さゆえに、ビジネスの意思決定や市場調査の現場で実態を見誤るトラブルが頻発しています。

データに基づいた迅速な意思決定が求められる現在、単に計算式を丸暗記しているだけでは不十分です。足して割るだけの素朴な計算に潜む落とし穴を理解し、中央値や最頻値との使い分け、さらには実務で役立つExcel関数や度数分布表からの割り出し方を体系的に把握しておくことが不可欠です。本稿では、算数の基本からビジネスの応用、直感を裏切る数字の罠まで、現場の記者目線で徹底解説します。

📌 【この記事の重要ポイントまとめ】
  • 要点1:平均値の基本公式は「合計÷個数」だが、極端な「外れ値」が1つあるだけで実態と大きく乖離する致命的な盲点を持つ。
  • 要点2:貯蓄額や世帯所得など右に歪んだ分布では、真ん中の順位を示す「中央値」や最も頻出する「最頻値」の比較検証が欠かせない。
  • 要点3:ExcelのAVERAGE関数や加重平均、度数分布表の階級値を使った計算など、データの形式に応じた正しい算出手法の選定が必須となる。

【基本公式】小学生の算数から復習する平均値の求め方と電卓テクニック

平均値の基本的な考え方は、小学校5年生の算数で学習します。ばらつきのある複数の数値を「もしすべて均等にならしたら、1つあたりいくつになるか」を導き出す計算です。

数学や統計学において、最も一般的に使われるこの計算は「算術平均(相加平均)」と呼ばれます。基本公式は極めてシンプルです。

【平均値の公式まとめ】
平均値 = データの合計値 ÷ データの個数

たとえば、5回の小テストの点数が「70点、85点、60点、90点、75点」だった場合、次のように算出します。

1. 合計を求める:70 + 85 + 60 + 90 + 75 = 380点
2. 個数で割る:380 ÷ 5 = 76点

仮平均を使った手計算の短縮テクニック

数値が3桁以上になったりデータ数が多くなったりすると、全体の合計を求める暗算はミスを生みやすくなります。そこで役立つのが、あらかじめ大体の見当をつけて基準値を設定する「仮平均を使った計算方法」です。

先ほどのテスト(70, 85, 60, 90, 75)を例に、基準となる仮平均を「70点」と仮定してみます。

・各データから70点を引いた差分(偏差)を出す:0, +15, -10, +20, +5
・差分の合計を出す:0 + 15 - 10 + 20 + 5 = +30
・差分の平均を出す:30 ÷ 5 = +6
・仮平均に足す:70 + 6 = 76点

大きな桁数の加算を避け、小さな差分の処理だけで正確な数値を導き出せるため、簿記や経理の実務、筆記試験での検算に威力を発揮します。

電卓での平均の出し方とメモリー機能の活用

日常業務で一般的なデスク用電卓を使って平均を求める場合、単に順次足してから個数で割る以外に、メモリーキー([M+]、[M-]、[MR])を活用すると入力ミスを大幅に抑制できます。特に「1個120円のりんご5個と、1個150円の梨3個の平均単価」を求めるような場面では、電卓のメモリー計算が真価を発揮します。

1. [120] × [5] [M+] (600がメモリーに加算)
2. [150] × [3] [M+] (450がメモリーに加算)
3. [MR] (合計の1,050が表示される)
4. [÷] [8] [=] (結果:131.25円)

一度紙にメモを取る手間を省き、打ち間違いによる手戻りをゼロに抑える基本操作です。

当時のメディア報道・掲載写真
【検証資料 1】当時のメディア報道・掲載写真(出典:text.tomo.school)

足して割るだけは危険?「中央値との決定的な違い」と外れ値の罠

「平均値の求め方は足して割るだけ」と機械的に処理していると、重大な判断ミスを引き起こします。その最大の理由が、極端に大きい数値や小さい数値である外れ値が平均値に与える影響の大きさです。

分かりやすい例として、ある職場の5人の年収を比較してみます。

・社員A:350万円
・社員B:400万円
・社員C:420万円
・社員D:450万円
・役員E:3,000万円

この5人の年収の合計は4,620万円です。これを5で割ると、平均年収は924万円に跳ね上がります。しかし、現場の社員A〜Dの誰もが900万円には遠く及びません。役員Eという、1人だけの突出した外れ値によって、集団全体の代表値が大きく上方へ引っ張られてしまった典型例です。

ここで不可欠となるのが、平均値と中央値の違いを正しく認識することです。

中央値(メディアン)とは、データを小さい順(または大きい順)に並べたとき、ちょうど真ん中に位置する数値のことです。上記の5人を並べると「350万、400万、420万、450万、3000万」となり、中央値は420万円になります。社員の実感に即した生活水準を表しているのは、平均値(924万円)ではなく中央値(420万円)です。

公的統計でも同様の現象が起きています。厚生労働省が公表する「国民生活基礎調査」などの公的データにおいて、1世帯あたりの平均所得金額(約545万円前後)を下回る世帯が全世帯の6割以上を占めるのは、一部の高所得世帯が平均値を大きく引き上げているためです。

さらに、データ分析では最も出現頻度が高い値を指す「最頻値(モード)」も重要です。正規分布のように左右対称のきれいな釣鐘型のデータであれば「平均値 ≒ 中央値 ≒ 最頻値」と一致しますが、所得や貯蓄額のように右側に長い裾野を持つデータでは、必ず「平均値 > 中央値 > 最頻値」という不等式が成立します。この構造を知らないまま平均値だけを信用すると、マーケティングや価格設定で致命的な読み違えを招くことになります。

【徹底比較】データ分析で使い分ける代表値と各種平均の特徴

一口に平均といっても、扱う対象の性質によって計算アプローチは異なります。ビジネスの実務で多用される各種指標の違いを整理しました。

指標の種類算出の仕組み・計算特性主な適用例と現場基準編集部の見解・評価
算術平均
(相加平均)
全データの数値を加算し、データの総件数で均等に除算する最もポピュラーな算出法。テストの平均点、月別平均気温、工場の平均歩留まり率など。データが均等に分散している場合に最適。外れ値による歪みに最も弱いため確認が必要。
幾何平均
(相乗平均)
各データを掛け合わせ、データの個数乗根(n乗根)を算出する。割合の変化を捉える。投資信託の年間利回り、売上高の前年比成長率、複利計算など。比率や成長率の平均算出で算術平均を使うと過大評価になる。金融・経営分析では必須。
加重平均各データに「数量」や「重要度(ウェイト)」を掛け合わせ、ウェイトの合計で割る。仕入れの加重平均単価、履修単位数を考慮した大学のGPA評価など。取引規模のばらつきを反映できるため、仕入れや在庫管理の現場では相加平均より遥かに正確。
中央値
(メディアン)
数値を昇順に並べた際、ちょうど全体の50%地点に位置するデータ値を採用する。世帯所得、不動産取引価格、金融資産保有額の統計など。外れ値の影響を完全に遮断できるため、一般市民の実感に近い「世間の標準値」を把握可能。
最頻値
(モード)
母集団の中で、最も出現回数(頻度)が多い値を抽出する。度数分布で最多の階級。売れ筋のアパレルサイズ、アンケートの最多回答選択肢など。数値化しにくい定性データやカテゴリ分析にも適応可能。実務の在庫発注で重宝される。

相加平均と相乗平均の違いに注意すべき理由

投資や経営分析を行う上で、相加平均と相乗平均の混同は危険です。たとえば、ある株価が1年目に2倍(+100%)になり、2年目に半値(-50%)に下落したとします。

これを相加平均で計算すると「(+100% - 50%)÷ 2 = +25%」となり、毎年25%ずつ資産が増えているかのような錯覚に陥ります。しかし実際には、100万円の資金が200万円になり、翌年100万円に戻っただけであり、リターンはプラスマイナスゼロ(0%)です。変化率の平均を正確に捉えるには、掛け算の平方根をとる相乗平均(√(2.0 × 0.5)= 1.0、つまり年平均変動率0%)を用いなければなりません。

偏差値の求め方と平均値の密接な関係

学力テストなどで馴染み深い「偏差値」も、平均値を基点にして構築されています。偏差値は「自分の得点が、集団の平均値からどれくらい離れているか」を、データのばらつき度合い(標準偏差)を基準に数値化したものです。

【偏差値の計算式】
偏差値 = (個人の得点 - 平均点) ÷ 標準偏差 × 10 + 50

全体の平均点ちょうどを取った場合、分子がゼロになるため偏差値は必ず「50」になります。平均点が60点のテストで80点を取ったとしても、周りも高得点ばかりで標準偏差が大きい場合は偏差値の伸びが鈍くなり、逆に周りが解けず標準偏差が小さい難関テストなら偏差値は跳ね上がります。平均値は、相対的な立ち位置を客観評価するための絶対的なアンカー役を務めています。

活動歴および当時の関連ビジュアル記録
【検証資料 2】活動歴および当時の関連ビジュアル記録(出典:mathlandscape.com)

【実務検証】ExcelのAVERAGE関数を正しく使いこなす現場の知恵

ビジネスの集計業務において、最も多用されているのがエクセルの平均値関数です。手計算を瞬時に終わらせてくれる強力なツールですが、セルの扱い方を誤ると静かに間違った数字を出力し続けます。

AVERAGE関数の基本的な使い方

対象となるセル範囲を指定するだけで、自動的に合計とデータ数を算出して除算してくれます。

書式:=AVERAGE(範囲)
例:セルA1からA10までの平均を求める場合は「=AVERAGE(A1:A10)」と入力します。

実務の落とし穴:「空白セル」と「0」の致命的な違い

現場の事務担当者が最もやりがちなミスが、セルの空白と「0」の混同です。

・空白セル:AVERAGE関数は計算対象から除外(カウントしない)
・数値の「0」:AVERAGE関数はデータとして母数に含めて計算する

たとえば、営業担当4人の成約件数が「5件、3件、未入力(空白)、4件」の場合、AVERAGE関数は3人のデータとして処理し「(5+3+4)÷3 = 4件」を返します。
しかし、未入力部分に誤って「0」を入力すると、「(5+3+0+4)÷4 = 3件」となり、チーム全体のパフォーマンスが過小評価されてしまいます。データが存在しないのか、実績がゼロだったのかを厳密に区別して入力ルールを社内統一することが欠かせません。

また、条件付きで平均を求めたい場合は「AVERAGEIF関数(単一条件)」や「AVERAGEIFS関数(複数条件)」、フィルターで絞り込んだ行だけを集計したい場合は非表示行を除外できる「SUBTOTAL関数(集計方法番号に1または101を指定)」を使い分けるのが現場の鉄則です。

【発展編】度数分布表から平均値を導き出す実践ステップ

アンケート結果や顧客年齢層の分析など、個別の生データではなく「20代:15人、30代:28人…」といったグループごとの集計表しか手元にないケースがあります。この形式を統計学で「度数分布表」と呼びます。

度数分布表から平均値を導き出すには、「階級値(各区間の中央の値)」を使用します。

【度数分布表の平均値の求め方】
平均値 = 各階級の(階級値 × 度数)の合計 ÷ 度数の総数

具体例として、あるセミナー参加者40名の年齢分布から平均年齢を求めてみます。

1. 「20歳以上〜30歳未満(度数:10人)」→ 階級値は中央の25歳。小計:25 × 10 = 250
2. 「30歳以上〜40歳未満(度数:20人)」→ 階級値は中央の35歳。小計:35 × 20 = 700
3. 「40歳以上〜50歳未満(度数:10人)」→ 階級値は中央の45歳。小計:45 × 10 = 450

全体の合計値を求めると「250 + 700 + 450 = 1,400」となります。これを総人数の40人で除算します。
1,400 ÷ 40 = 35歳

個別の正確な年齢が分からなくても、区間の中央値を代表させることで、全体の近似的な平均値を高い精度で復元することが可能です。

公の場での発言・インタビュー報道記録
【検証資料 3】公の場での発言・インタビュー報道記録(出典:i.ytimg.com)

一般に知られていない盲点とネットの誤解|データ信仰が生むバイアス

ネット上の議論やビジネスの現場では、「平均=世の中の標準、普通のレベル」という強い思い込みが根深く存在します。しかし、この直感は往々にして認知の歪みを生み出します。

社会心理学や行動経済学には「平均以上効果(優越の錯覚)」という概念があります。多くのドライバーに「あなたの運転技術は平均より上か下か」と尋ねると、8割近い人が「平均より上」と回答してしまう心理バイアスです。平均値を「中央の標準」と無意識に同一視してしまうため、自分が平均以下に位置することを感情的に受け入れがたい性質が人間に備わっています。

さらに、ネット掲示板やSNSで頻繁に見られる「平均年収論争」や「婚活相手の平均条件」の議論は、典型的な外れ値の罠にハマっています。「普通の男性の年収=500万円以上」といった条件を課した結果、実際には20代〜30代の中央値が400万円前後に位置している実態を見失い、マッチングが成立しない構造的要因となっています。

【プロの結論】平均値を信用してよいデータ・疑うべきデータの判断基準

データに騙されず、物事の輪郭を正確に捉えるために、以下の判断基準を常に念頭に置いておく必要があります。

【平均値を信用して活用すべきケース】
・データが自然界の物理現象のように左右均等に散らばっている(身長、体重、ネジの寸法誤差など)
・学校の定期試験のように、点数の上限と下限があらかじめ固定されている集団データ
・外れ値が存在せず、全体の総量を単純に均等配分して計画を立てたいとき

【平均値を疑い、中央値や最頻値を優先すべきケース】
・上限に制限がない数値(年収、企業の売上高、個人資産、ウェブサイトのアクセス数)
・一部の超富裕層やモンスターヒット商品が全体を牽引している業界動向の分析
・ターゲット層の「最もリアルな日常の感覚」に寄り添った商品企画や価格付けを行うとき

【平均値の求め方】に関するよくある質問(FAQ)

Q1:データ数が偶数の場合、中央値はどうやって計算すればいいですか?
A1:データ数が偶数の場合、真ん中に位置する数値が2つ存在することになります。その際は、「中央に並ぶ2つの数値の平均値」を計算して中央値とします。たとえば「2, 4, 6, 8」という4つのデータの場合、真ん中の4と6を足して2で割った「5」が中央値になります。

Q2:加重平均はどのようなビジネスの場面で計算しますか?
A2:異なる価格で複数回にわたり原材料を仕入れた際の「仕入平均単価」の計算や、店舗ごとの「客単価の総合計」を算出する場面で必須となります。たとえば、100円のパンを10個、200円のパンを90個売った場合、単純平均は150円ですが、加重平均で計算すると「(100×10 + 200×90) ÷ 100 = 190円」となり、実際の売上構造に沿った正確な数値が得られます。

Q3:度数分布表から求めた平均値は、実際の生データから求めた平均値と完全に一致しますか?
A3:完全に一致することは稀で、わずかな誤差が生じます。度数分布表での計算は「その階級に属するデータはすべて中央値(階級値)である」と仮定して計算するためです。ただし、階級の幅を適切に設定していれば実務上の傾向分析には十分な精度を保てます。

まとめ:数字の罠を見抜きデータリテラシーを高めるために

平均値は、複雑で膨大なデータ群をたった1つの数字に要約して提示してくれる非常に利便性の高い道具です。しかし、その手軽さの裏には「極端な数値に全体が引っ張られる」という決定的な構造上の癖が存在します。

提示された数字を鵜呑みにせず、「外れ値が含まれていないか」「分布に歪みはないか」「中央値や最頻値とどれほど乖離しているか」を一歩立ち止まって検証する視点を持つこと。それこそが、データが氾濫する情報社会において、実態を見誤らないための最も確かなリテラシーです。状況に応じて相乗平均や加重平均、Excel関数を適切に選択し、数字の背後にあるリアリティを正しく読み解いていきましょう。 (出典: 平均 値 求め 方(Yahoo!ニュース))

平均 値 求め 方
平均 値 求め 方
平均 値 求め 方