「經 PSG 驗證」應告訴你什麼。
PSG——多導睡眠檢查——記錄多項生理訊號供專業解讀。僅說產品曾與 PSG 比較並不完整,主張還必須說明輸出、參考標註、研究設計、資料集、指標與限制。
以下是一份實用清單,可用來閱讀 SomniSense 的證據與其他已發布的比較。
承擔全部意義的詞:「配對」
有力的比較設計可以使用配對夜晚資料:裝置和 PSG 在同一個人、同一晚、同一時間記錄。評估問題仍須符合所主張的輸出。SomniSense 已發布的生產基準涵蓋有標註的 200 秒視窗分類,而不是確認每個臨床事件。
互不相關的群組平均值比較,無法回答與同步配對記錄相同的問題。群組大小、環境、納入條件與代表不足的群體同樣重要,因此結果旁應提供這些細節。
參考評分與盲法
必須有人審查 PSG 並建立臨床參考標註——這就是「評分」,由受過訓練的技術人員完成。問題是:評分者是否知道 App 已經說了什麼?
盲法評分有助降低 App 輸出知情情況影響參考標註的風險。有用的報告會說明評分是否採盲法,以及參考標籤如何產生。
「一致性」是一個光譜,不是勾選框
即使有配對夜晚和盲法評分,「一致性」也不是非是即否的屬性。正確分析取決於任務是片段分類、視窗分類、事件偵測或測量一致性。
對 SomniSense 而言,此處報告的公開生產基準是有標註 200 秒呼吸視窗的分類準確度與 F1。這不是 Bland–Altman 主張,也不得表述為每個事件邊界、每晚 BRI 或臨床 AHI 一致性的驗證。
我們實際如何執行
簡要說明,讓你可以用上述清單核對:40 名參與者共 80 個配對夜晚——部分在實驗室,多數在家使用攜帶式睡眠研究設備——包括已知有或沒有睡眠呼吸問題的成人,由不知道 SomniSense 結果的 AASM 受訓技術人員評分。完整設計、我們未能充分代表的群體,以及相關預印本都在研究頁面;逐項數值結果則在準確度頁面。
接著閱讀
- → SomniSense 背後的研究——完整驗證研究與受測模型
- → 手機做這件事究竟有多準確?——為什麼一項指標無法描述所有任務
- → 完整準確度解析——每項指標及其注意事項
If you'd rather see your own night than read about someone else's —
It's free on both stores. Put the phone on the nightstand tonight; the report is there when you wake up.
Free basics stay available: core first-night candidate evidence, 5 audio plays per night, and a recent 7-day trend.