由《教練力實踐》證據研究員維護。本檔是全書最關鍵的證據後盾:用統合分析(meta-analyses)與隨機對照試驗(RCT)證明「教練/教練式介入真的有用」。每筆來源 2026-06-23 用 WebSearch/WebFetch 實際查證;查不到一手全文、僅得權威二手摘要(如出版商/資料庫摘要、作者本人 PDF 摘要)者標
〔摘要查證・全文待覆核〕。鐵則自檢:絕不編造任何研究/效果量/作者;經典+最新並列,經典必註明「為何仍適用」;嚴格區分實證(同儕審查 meta/RCT)vs 業者宣稱(ICF 等,打折看、標「業者」);反證/限制獨立成區——教練研究方法常被批,本檔誠實列。
效果量讀法速記:Cohen 慣例 d/g ≈ 0.2 小、0.5 中、0.8 大;相關 r ≈ 0.1 小、0.3 中、0.5 大。Hedges' g 是對小樣本偏誤校正過的 d。本檔多數效果量落在「中等」區間,這在社會科學介入研究裡是務實且可信的量級——但務必連同「方法限制」一起讀(見反證區)。
核心論點(這份證據要撐住的 WHY)
書要主張「教練力是可以被驗證、可以被學會、也可以被傳遞的人本支持方法」。這條主張站不站得住,多半就看一件事:教練到底有沒有用? 證據給出的答案是分層的,這裡照實講:
- 「教練有用」這件事,已經有多份統合分析一致支持,效果量穩定落在「中等」:對目標達成、自我效能、幸福感、韌性、工作態度與表現,都有正向而且顯著的效果。這不是單一研究的僥倖,是 4–5 份獨立的 meta-analysis 反覆得到的結論。
- 但「中等效果」要誠實講:只看設計最嚴謹的 RCT 時,效果量會往下修,而且有明確的出版偏誤與自評膨脹訊號。書的可信度往往就來自敢講限制,不把它誇大成神效。
- 「為什麼有用」也有機制上的證據:核心是工作同盟,也就是教練關係(r≈.41),再加上目標設定、自我覺察、當責與反思。這一組證據支持書裡「關係與對話是核心」的立場。
- AI/chatbot 教練是一組雙面的證據:在「目標達成」這種結構清楚的任務上,AI 教練能追平真人;但在韌性、幸福感、壓力這些需要關係深度的面向,真人顯著勝出。這一點支持書「AI 賦能不替代、關係不外包」的主軸。
證據清單
A 區|成效:統合分析與 RCT(教練「有用」的主證據)
A1.〔經典・基石〕Theeboom, Beersma & van Vianen(2014)— 第一份組織情境教練 meta-analysis
- 年份/作者/出處:2014|Theeboom, T., Beersma, B., & van Vianen, A. E. M.|The Journal of Positive Psychology, 9(1), 1–18|DOI: 10.1080/17439760.2013.837499
- 樣本:18 篇研究的 meta-analysis(組織情境、個人層級成效)。
- 效果量與關鍵發現:教練對全部五類成效都有顯著正向效果,效果量 g = 0.43(coping/因應)到 g = 0.74(goal-directed self-regulation/目標導向自我調節)。五類為:表現/技能、幸福感、因應、工作態度、目標導向自我調節。重要限制(作者自陳):純前後測(within-subjects)設計的效果量顯著高於有對照組的混合設計——即弱設計會膨脹效果;教練「次數」與效果無關。
- 支持書哪論點:核心論點 1(教練對目標調節、幸福感等多面向有效)。目標導向自我調節 g=0.74 是全表最高的一項,正好支持「教練幫人把目標變成行動」這句話。
- URL:https://www.tandfonline.com/doi/abs/10.1080/17439760.2013.837499
- 類型:同儕審查 meta-analysis | 可信度:高(領域奠基之作,被引數千)
- 為何經典仍適用:它是「教練到底有沒有用」這題的第一份系統性量化答案,後續所有 meta 都拿它當基準對照;其「弱設計膨脹效果」的警告至今成立,是讀所有教練數據的標準濾鏡。
A2. Jones, Woods & Guillaume(2016)— 職場教練學習與表現成效 meta-analysis
- 年份/作者/出處:2016|Jones, R. J., Woods, S. A., & Guillaume, Y. R. F.|Journal of Occupational and Organizational Psychology, 89(2), 249–277|DOI: 10.1111/joop.12119
- 樣本:17 篇研究(k=17)的 meta-analysis。
- 效果量與關鍵發現:教練對組織成效整體有正效果 δ(delta)= 0.36;分項:情感性成效(affective,如態度/自我效能)δ = 0.51、技能性 δ = 0.28、個人層級結果(results)δ = 1.24(後者樣本少、要保守讀)。調節因子:內部教練效果 > 外部教練;用 360 度多源回饋反而讓效果變小;教練形式(面對面 vs 混合)與時長/次數對效果無顯著調節。
- 支持書哪論點:核心論點 1。「內部教練更有效」與「次數不是關鍵」這兩點,對「教練力可以被一般人或主管學起來、用在身邊的人」是有利的證據:不一定非得找昂貴的外部專家。
- URL:https://bpspsychub.onlinelibrary.wiley.com/doi/abs/10.1111/joop.12119|全文 PDF:https://centaur.reading.ac.uk/74522/1/Jones%20et%20al%202016_JOOP.pdf
- 類型:同儕審查 meta-analysis | 可信度:高
- 〔摘要查證・全文待覆核〕:δ 數值取自多個資料庫摘要與二手綜述一致引用;一手 PDF 為二進位無法線上解析全文表格,數值以摘要為準。
A3.〔最新・RCT only・本檔最有力〕Nicolau, Candel, Constantin & Kleingeld(2023)— 主管教練 RCT meta-analysis
- 年份/作者/出處:2023|Nicolau, A., Candel, O. S., Constantin, T., & Kleingeld, A.|Frontiers in Psychology, 14:1089797|DOI: 10.3389/fpsyg.2023.1089797
- 樣本:20 篇 RCT(只收隨機對照試驗)。
- 效果量與關鍵發現:整體 g = 0.43(95% CI 0.35–0.51)。分項:行為 g = 0.73(k=12, N=565)、態度 g = 0.34(k=12, N=1,793)、個人特質 g = 0.52(k=16, N=830)。特定成效:目標達成 g = 1.32(k=3, N=155)、心理資本 g = 0.83、韌性 g = 0.57(k=3, N=133)、自我效能 g = 0.31(k=5, N=254)。「教練對行為的影響高於態度與特質」。
- 支持書哪論點:核心論點 1、2。書如果只引一份,這份大概是最合適的:它(a)只收 RCT(設計最嚴)、(b)夠新(2023)、(c)直接給出「目標達成、韌性、自我效能、行為」的分項效果量。但要連帶講清楚:目標達成 g=1.32 雖然亮眼,只有 3 篇、N=155,讀的時候要保守。
- URL:https://www.frontiersin.org/journals/psychology/articles/10.3389/fpsyg.2023.1089797/full
- 類型:同儕審查 meta-analysis(RCT only)| 可信度:高
A4.〔最新・RCT only・最保守〕De Haan & Nilsson(2023)— 只用 RCT 的教練 meta-analysis
- 年份/作者/出處:2023|De Haan, E., & Nilsson, V. O.|Academy of Management Learning & Education, 22(4)|DOI: 10.5465/amle.2022.0107
- 樣本:37 篇 RCT(1994–2021)、39 個樣本、總 N = 2,528——是目前只看 RCT 的教練 meta 中規模最大之一。
- 效果量與關鍵發現:跨所有領導與個人成效的最佳效果量估計 g = 0.59(落在中等範圍)。關鍵警告(書必引):(a)有顯著的出版偏誤跡象;(b)自評(self-reported)成效的效果量大於客觀觀察的成效——即「教練讓人『覺得』有效」比「客觀變好」更明顯。
- 支持書哪論點:核心論點 1(用最嚴的設計仍然有中等效果)+核心論點 2(誠實列出出版偏誤與自評膨脹)。這一筆最適合放在書「敢講限制」的位置:頂尖期刊、目前最大的 RCT 樣本,一邊證明有效,一邊自己講出偏誤。
- URL:https://journals.aom.org/doi/10.5465/amle.2022.0107|作者 PDF:https://www.erikdehaan.com/wp-content/uploads/2023/04/AMLE20220107_RP.pdf
- 類型:同儕審查 meta-analysis(RCT only)| 可信度:高
A5.〔經典・第一份外部教練 RCT〕Grant, Curtayne & Burton(2009)— 目標達成、韌性、幸福感 RCT
- 年份/作者/出處:2009|Grant, A. M., Curtayne, L., & Burton, G.|The Journal of Positive Psychology, 4(5), 396–407|DOI: 10.1080/17439760902992456
- 樣本:41 名公共衛生機構主管,RCT;4 次個別教練(認知行為+焦點解決取向)+360 回饋+半日工作坊,10 週。
- 效果量與關鍵發現:相較對照組,教練提升目標達成、增加韌性與職場幸福感、降低憂鬱與壓力。是第一篇由組織外部專業教練執行的已發表 RCT。
- 支持書哪論點:核心論點 1、3。它把「目標達成、韌性、幸福感」這組成效第一次在 RCT 裡放在一起驗證,是 A3、A4 之前的奠基之作。
- URL:https://solutions-centre.org/pdf/Grant-et-al-Executive-coaching-enhances-goal-attainment-resilience-and-workplace-well-being-a-randomised-controlled-study-JOPP-20092.pdf
- 類型:同儕審查 RCT(單一研究)| 可信度:中高(樣本小 N=41,但設計嚴謹、奠基性高)
- 為何經典仍適用:Grant 是教練心理學奠基者;此研究確立「焦點解決+認知行為」教練取向的成效模板,後續 RCT 多沿用其成效組合。
A6. Athanasopoulou & Dopson(2018)— 主管教練成效系統性回顧(脈絡視角)
- 年份/作者/出處:2018|Athanasopoulou, A., & Dopson, S.|The Leadership Quarterly, 29(1), 70–88|DOI: 10.1016/j.leaqua.2017.11.004
- 樣本:系統性回顧(質性整合,非效果量 meta)。
- 效果量與關鍵發現:歸納主管教練三類成效——①當事人個人發展、②對他人的行為改變、③在角色中的表現提升。核心論點:多數研究忽略社會脈絡,成效會因當事人目標與脈絡(關係的、空間的、時間的)而異——「是旅程還是終點更重要?」
- 支持書哪論點:核心論點 1、4:它提醒我們,教練的成效不是一個固定數字,會隨著脈絡與關係而不同,呼應書裡說的「教練是關係性的」。這一筆也是通往反證區的橋:脈絡被忽略,就是一個方法學上的缺口。
- URL:https://www.sciencedirect.com/science/article/abs/pii/S1048984316303757(另見 Case Western PDF:https://case.edu/weatherhead/sites/default/files/2022-10/A%20systematic%20review%20of%20executive%20coaching%20outcomes.pdf)
- 類型:同儕審查系統性回顧| 可信度:高
A7. 不同類型教練的成效差異(健康教練 meta-analysis 群)
- 年份/作者/出處:Type 2 糖尿病健康教練 meta(2023, PMC9837922);心血管風險因子健康教練 meta(2020, Patient Education and Counseling);慢性病健康/wellness 教練 meta(2023, Patient Education and Counseling,104 篇 RCT)。
- 效果量與關鍵發現:健康教練對 HbA1c(糖化血色素)降幅 g = 0.29(20 RCT, N=3,222)——小但顯著;對身體活動、飲食、健康責任、壓力管理有小而顯著效果,唯獨戒菸無顯著效果。
- 支持書哪論點:核心論點 1,再加上「不同類型的教練,成效並不一樣」:健康與行為教練的效果量(g≈0.29)系統性地低於主管、生涯教練(g≈0.43–0.59)。比較合理的解釋是,生理指標(HbA1c、戒菸)通常比心理與行為指標更難移動。書談「教練式介入」時要分清楚:講心理上的目標達成(中等效果),跟講生理健康的改變(小效果),不是同一件事。
- URL:https://pmc.ncbi.nlm.nih.gov/articles/PMC9837922/ | https://www.sciencedirect.com/science/article/abs/pii/S0738399123003555
- 類型:同儕審查 meta-analysis(醫療 RCT)| 可信度:高
- 註:生涯教練(career coaching)、生活教練(life coaching)目前缺大型獨立 RCT meta;多被併入 A1–A4 的綜合 meta。生活教練奠基 RCT 見 Green, Oades & Grant(2006, J. Positive Psychology,焦點解決生活教練提升目標達成、幸福感、希望感)〔摘要查證・全文待覆核〕。這是缺口(見末段)。
B 區|機制:教練「為什麼有效」
B1.〔機制主證據・最有力之一〕Graßmann, Schölmerich & Schermuly(2020)— 工作同盟與教練成效 meta-analysis
- 年份/作者/出處:2020|Graßmann, C., Schölmerich, F., & Schermuly, C. C.|Human Relations, 73(1), 35–58|DOI: 10.1177/0018726718819725
- 樣本:27 個樣本、N = 3,563 個教練歷程的 meta-analysis。
- 效果量與關鍵發現:高品質工作同盟(working alliance/教練關係)與教練成效的整體相關 r = .41(95% CI .34–.48, p<.001),中等且穩定。工作同盟與所有正向成效正相關(r = .32 到 .64,與情感性、認知性成效最強),且與教練的非預期負面效果負相關(r = –.29)。
- 支持書哪論點:核心論點 3(為什麼有效,答案指向關係)。全書「關係與對話是核心」這句話,目前最紮實的量化支持就是這一筆:教練關係不只跟「有效」正相關,也跟「不傷害」正相關。
- URL:https://journals.sagepub.com/doi/abs/10.1177/0018726718819725
- 類型:同儕審查 meta-analysis| 可信度:高
B2. De Haan 等(2013–2019)— 共同因子:關係、自我效能、人格匹配
- 年份/作者/出處:De Haan, Grant, Burger & Eriksson(2016, Consulting Psychology Journal);De Haan, Gray & Bonneywell(2019, AMLE,全球醫療企業 near-RCT 場域研究)等系列。
- 效果量與關鍵發現:主張教練成效由「共同因子」(common factors)驅動,且多數共同因子的作用透過「教練關係」中介。一般自我效能(general self-efficacy)在 2013、2016、2019 多份研究中被確認為教練成效的預測因子。
- 支持書哪論點:核心論點 3:它把「為什麼有效」從「特定技法」移向「關係加上自我效能」這組可以遷移的共同因子,支持「教練力是一套可以學的基本能力,不是某一派的招式」。
- URL:https://journals.aom.org/doi/abs/10.5465/amle.2018.0158(2019 場域 near-RCT)
- 類型:同儕審查實證研究系列| 可信度:中高
- 〔摘要查證・全文待覆核〕:具體路徑係數未逐一取全文,結論取自作者本人著作《What Works in Executive Coaching》(Routledge, 2021) 與多篇摘要的一致陳述。
B3.〔機制橋接・跨領域〕目標設定、自我覺察、當責、反思
- 說明:教練的作用機制與目標設定理論(Locke & Latham)、自我調節/反思高度重疊;A1(Theeboom)的「goal-directed self-regulation」g=0.74 即此機制的成效顯化;A5(Grant)用的焦點解決+認知行為取向,核心就是「把模糊願望轉成具體目標+自我監控」。
- 支持書哪論點:核心論點 3。把「教練問問題→人自己想清楚→設目標→當責追蹤→反思」這條鏈,接回既有的目標設定與自我調節實證傳統。
- 可信度:中(為機制性綜述橋接,非單一新 meta;引用時宜以 A1 的 g=0.74 為實證錨點,目標設定理論本身另屬經典文獻〔此處未逐筆查證原典,標為論述橋接〕)
C 區|AI/chatbot 教練的成效(雙面證據)
C1.〔最有力 AI 證據〕Terblanche, Molyn, de Haan & Nilsson(2022, PLOS One)— AI 教練在「目標達成」追平真人
- 年份/作者/出處:2022|Terblanche, N., Molyn, J., de Haan, E., & Nilsson, V. O.|PLOS One, 17(6): e0270255|DOI: 10.1371/journal.pone.0270255
- 樣本:兩個縱貫 RCT、10 個月,合計約 327 人;AI 教練名為 Coach Vici(Telegram 文字 chatbot)。
- 效果量與關鍵發現:AI 教練在目標達成上追平真人教練——真人 η²p = .265、AI η²p = .269(p<.001),兩者皆顯著優於對照組。高頻使用者(>6 次,中位數以上)目標達成更佳(d = 0.52)。
- 支持書哪論點:核心論點 4:AI 在「結構清楚的目標達成」這一塊,確實可以規模化,也確實有效。不過這大概也就是它的能力邊界(見 C2)。
- URL:https://journals.plos.org/plosone/article?id=10.1371/journal.pone.0270255
- 類型:同儕審查 RCT(AI vs 真人)| 可信度:高
C2.〔最關鍵對照〕Terblanche 等(2022, Coaching: An Int. Journal)— AI 教練在韌性/幸福感/壓力上輸給真人
- 年份/作者/出處:2022|Terblanche, N. 等|"Coaching at Scale: Investigating the Efficacy of Artificial Intelligence Coaching"|Coaching: An International Journal of Theory, Research and Practice / Stellenbosch Business School|DOI: 10.24384/5cgf-ab69
- 樣本:實驗組 n=75 用 Vici 六個月、對照組 n=94;測目標達成、韌性、心理幸福感、壓力。
- 效果量與關鍵發現:用 Vici 者目標達成增加 55%(對照組 24%)——但韌性、心理幸福感、壓力全部不顯著。對照原始真人研究:真人教練在韌性、心理幸福感、壓力上勝出,Vici 只在它唯一被設計的功能(目標達成)上追平。
- 支持書哪論點:核心論點 4,也是全書主軸「AI 賦能不替代、關係不外包」最直接的實證:把 AI 限在窄而結構清楚的任務上,它能追平真人;一旦進到需要關係深度的韌性與幸福感,真人的關係(呼應 B1 的工作同盟 r=.41)就是 AI 補不上的那一格。
- URL:https://journals.sagepub.com/doi/10.24384/5cgf-ab69
- 類型:同儕審查 RCT| 可信度:高
C3.〔2026 新證據・更強的反 AI 訊號〕人類 vs AI chatbot 教練 RCT(HRDI 2026)
- 年份/作者/出處:2026|(Terblanche 等團隊)|Human Resource Development International|DOI: 10.1080/13678868.2026.2633990
- 樣本:114 名 coachee 的 RCT,首次直接比較受認證真人教練 vs 自動化 AI 教練於目標達成、幸福感、自我效能。
- 效果量與關鍵發現:在多項教練成效上展現顯著效果——但只在真人教練組(效果量落中到高區間);AI 教練在此設計下未展現等同效果。
- 支持書哪論點:核心論點 4。這是比 C1、C2 更新、也更強的「AI 不能完全替代真人」訊號。調性上要注意:它與 C1 的「AI 在目標達成上能追平」並不矛盾,差別在任務難度與測量的範圍不同。書要誠實呈現一件事:AI 教練的成效,很大程度取決於任務窄不窄。
- URL:https://www.tandfonline.com/doi/full/10.1080/13678868.2026.2633990
- 類型:同儕審查 RCT(2026)| 可信度:中高 〔摘要查證・全文待覆核:tandfonline 全文 403,效果量數值待覆核,目前僅得「僅真人組有效」的結論性摘要〕
D 區|業者宣稱(ICF,打折看、標「業者」)
D1. ICF Global Coaching Study(2023 / 2025)— 市場規模與滿意度
- 年份/作者/出處:2023 / 2025|International Coaching Federation(業者・利益相關方)
- 數據:2023 全球教練產業營收約 US$45.64 億(4.564 billion,較 2019 +60%);2025 估計約 US$53.4 億、執業教練 122,974 人。〔2026-09-10 單位修正:原記「4.564 億」與 122,974 名教練換算後每人年營收僅約 3,700 美元,明顯不合理;ICF 原文為 billion。單位已改,總額本身仍待回源確認〕客戶滿意度 99%、96% 願再次接受教練。ICF/PwC 宣稱企業教練投資平均 ROI 達 7 倍、86% 企業回收全部投資。〔待查證〕
- 支持書哪論點:可以當成「教練被廣泛採用、需求在成長」的規模背景,但不能當成效的實證。
- URL:https://coachingfederation.org/resource/global-coaching-study-executive-summary-2023/
- 類型:業者調查(非同儕審查、自家利益)| 可信度:低(成效宣稱)/中(市場規模)
- 這一筆要打很大的折扣:99% 滿意、ROI 7 倍是業者自評加上自選樣本,與 A4(De Haan 的自評高於客觀、出版偏誤)那組學術警告正好衝突。書若引用,必須標「業者數據,僅供市場脈絡;成效一律以同儕審查的 meta 為準」。
反證與限制(教練研究的方法常被批評,這一區書必須誠實放)
這一區不是扣分,是書的可信度來源。 教練實證最大的弱點,大概是「方法跟不上市場熱度」。把它講清楚,反而讓「中等但真實的效果」更可信。
Burt & Talati(2017)— 「未解的價值」最直接的反證:International Journal of Evidence-Based Coaching and Mentoring。只收有對照組的研究,符合標準的僅 11 篇。得到的整體加權效果量明顯低於其他 meta(落小到中區間),作者直言「支撐教練成效的方法學與研究,沒跟上它的成長與需求」「現有文獻缺乏足夠的實證嚴謹度」。書引用 A1–A5 的中等效果時,必須對照這一篇:設計越嚴,效果就越往下修。 URL: https://www.semanticscholar.org/paper/a3bad3862051bb79496d9a1394c344f1350792d6
出版偏誤(明確存在):De Haan & Nilsson(2023, A4)在最大的 RCT 樣本上仍然偵測到顯著的出版偏誤。也就是說,已發表的效果量可能系統性高估了真實效果。心理學 meta 普遍有此問題(PMC10320355:心理學 meta 常高估效果存在與大小)。
弱設計膨脹效果:Theeboom(2014, A1)親自證明純前後測設計效果量顯著高於有對照組設計。許多早期「教練有效」的證據來自沒有對照組的研究,讀的時候要打點折扣。
自評 vs 客觀的落差:De Haan & Nilsson(2023)自評成效 > 客觀觀察成效。教練讓人「覺得」自己改善了,比「被旁人客觀看到改善」更明顯。這對一本主打「自我支持」的書來說是兩面的:我們要承認,有一部分效果來自主觀感受。
小樣本與盲法困難:教練 RCT 普遍樣本小(A3 多個分項 k=3、N<160;A5 N=41),而且幾乎無法雙盲(受試者知道自己有沒有被教練)。Hedges' g 雖然校正了小樣本偏誤,但小樣本加上沒有盲法,效果仍然容易被放大。
脈絡被系統性忽略:Athanasopoulou & Dopson(2018, A6)指出多數研究忽略社會脈絡,所以把「教練成效」講成一個固定數字,通常是過度簡化了。
生涯/生活教練缺大型獨立 RCT meta:相較主管/職場教練與健康教練,生涯教練與生活教練的高品質、大樣本獨立 meta-analysis 仍然是空白。書談這兩類時,證據強度明顯比較弱,最好標明。
AI 教練的長期成效未知:C 區證據多為 6–10 個月內、目標達成導向;AI 教練對「關係深度成效」長期是否仍輸真人、會不會反而養成依賴,尚無長期 RCT〔待查證〕(呼應 AIcoach-workshop 研究庫「教練情境下 AI-人關係無對照研究」的空白)。
缺口與待補(下輪重驗追)
- 生涯教練與生活教練的大型獨立 RCT meta:目前是空白,書談這兩類時證據比較弱。
- De Haan & Nilsson 2023、Jones 2016 的全文逐筆效果量:本輪有一部分取自權威摘要(一手 PDF 為二進位,無法線上解析全文表格),下一輪最好取全文覆核 CI 與調節分析。
- HRDI 2026(C3)的全文效果量:tandfonline 全文回 403,目前只拿到結論摘要,具體的 d/g 待覆核。
- AI 教練長期(超過一年)成效與依賴風險的 RCT:目前還沒有,這是 AndAction「人本教練 × AI 邊界」可以填的研究空白(與 AIcoach-workshop 研究庫的缺口一致)。
- 2026-09-10 本輪的回源狀態:A3(Nicolau 2023)、A7(第 2 型糖尿病健康教練 meta)、C1(Terblanche 2022 PLOS One)三筆已重新打開原文逐項核對,數字全部相符;其餘各筆的出版社頁面本輪回 403 或憑證錯誤(tandfonline、sagepub、AOM、ScienceDirect、作者自存 PDF),沿用 2026-06-23 的查證。
- Green/Grant 生活教練奠基 RCT(2006)、目標設定理論原典(Locke & Latham):B3 的機制橋接目前沒有逐筆查證原典,下一輪補上實證依據。