《Disney +》 迪士尼、Marvel、彼思、星球大戰…  Fernando Tatis Jr.登上《MLB The Show 21》封面球員   人氣實況主「加藤 純一」發表結婚計劃   目標是成為傳說的貓皇!「貓咪大尋寶」登場!   PlayStation Store:「雙倍折扣」優惠回歸   從石卷市誕生的角色扮演遊戲「羈絆幻想曲~海濱之國的大聖典~」開放下載!   《Oddworld: Soulstorm》將於4月6日登上PS4和PS5   《仙境傳說 ORIGIN》日區6月28日開服!「Nijisanji」VTuber確定直播遊玩實況!   內容創作者向16型筆記型電腦「ASUS ProArt Studiobook系列12月發售! 

OpenAI 推出信任聯絡人功能 強化安全防護

商業

根據報導,OpenAI 近日宣布推出名為「信任聯絡人」的新功能,旨在當使用者在對話中提及自我傷害議題時,主動通知可信任的第三方。該功能允許成年 ChatGPT 使用者指定一位親友作為信任聯絡人,當系統偵測到潛在的自傷風險時,將會鼓勵使用者與該聯絡人聯繫,同時向信任聯絡人發送自動警示通知。

功能設計與運作機制

根據 OpenAI 的說明,這項功能的核心運作流程包含多個層面。首先,符合資格的成年使用者可以在帳戶設定中新增一位信任聯絡人,這位聯絡人通常是朋友或家庭成員。當系統偵測到對話內容可能涉及自我傷害相關主題時,ChatGPT 會主動提示使用者與其信任聯絡人取得聯繫,鼓勵他們主動關心這位可能身處困境的使用者。

在技術層面,OpenAI 目前採用自動化系統與人工審查相結合的方式來處理潛在的危害事件。系統內建特定的對話觸發條件,能夠辨識與自殺意念相關的內容,並將相關資訊轉交給人類安全團隊進行評估。該公司聲稱,每當接獲這類型通知時,都會由真人進行審查,並表示「我們致力於在一小時內完成這些安全通知的審查工作」。

警示通知的形式與隱私考量

若 OpenAI 內部團隊判斷該情況確實存在嚴重的安全風險,ChatGPT 將會向信任聯絡人發送警示通知。這類通知可透過電子郵件、簡訊或應用程式內通知等方式傳送。值得注意的是,警示內容設計以簡潔為原則,主要目的在於提醒聯絡人主動關心當事人,並不包含對話內容的詳細資訊,以作為保護使用者隱私的措施之一。

功能選項與帳戶管理

「信任聯絡人」功能為選配項目,並非強制性設定。儘管如此,該功能仍存在一定的局限性,因為使用者可以擁有多個 ChatGPT 帳戶,在某個帳戶中啟用的保護設定不會自動延伸至其他帳戶。類似的情况也適用於家長監護功能,該功能同樣為選配性質,其效果受限於帳戶管理的彈性設計。

先前的安全措施與家長監護功能

事實上,這項新功能的推出延續了 OpenAI 去年秋季所引進的家長監護措施。該措施賦予家長對青少年帳戶的一定程度的監督權,包括接收安全通知的功能,當系統判定其子女面臨「嚴重安全風險」時向家長發出警示。在此之前,ChatGPT 也已內建自動警示機制,當對話趨向自我傷害主題時,主動提供專業健康資源的資訊。

法律訴訟的背景因素

此項安全功能的開發背景與近年來 OpenAI 面臨的法律挑戰密切相關。該公司接連遭遇多起來自自殺者家屬的訴訟案件,這些家屬主張 ChatGPT 在對話中鼓勵其摯親結束生命,甚至協助他們規劃自殺方式。雖然這些案件的具體細節各異,但普遍反映出家屬對於 AI 系統在心理危機處理方面能力的質疑,也凸顯了科技公司在開發生成式 AI 應用時所需承擔的社會責任。

OpenAI 的回應與未來展望

「信任聯絡人是 OpenAI 打造協助人們度過困難時刻之 AI 系統的更廣泛努力的一部分,」該公司在公告中表示。「我們將持續與臨床專業人員、研究人員和政策制定者合作,改善 AI 系統在人們可能正在經歷痛苦時的回應方式。」這段聲明顯示,OpenAI 試圖將此功能定位為更全面安全策略的一環,而非單獨存在的補救措施。

功能選擇的策略意涵

從產品設計的角度來看,OpenAI 選擇將此功能設為選配而非預設開啟,反映出該公司在使用者自主權與安全防護之間尋求平衡的考量。強制性介入可能引發關於言論自由與隱私權的爭議,但完全依賴使用者自願啟用則可能降低功能的實際保護效果。這種設計取捨凸顯了 AI 安全議題的複雜性,也為業界提供了值得參考的案例。

業界反應與專家觀點

心理衛生專家普遍對此類功能的推出表示肯定,認為在數位時代提供額外的安全網具有重要價值。然而,部分專家也提醒,技術性的警示機制無法取代專業的心理健康介入,民眾在察覺身邊親友出現危機徵兆時,仍應尋求專業機構的協助。AI 系統的角色應定位為輔助性的預警機制,而非主要的心理治療工具。

安全機制的技術限制

儘管 OpenAI 強調其系統能夠在一小時內完成安全通知的審查,但此類依賴自然語言處理技術的偵測系統仍存在一定的準確度限制。AI 系統可能在解讀上下文時產生誤判,將正常的心理壓力討論識別為潛在的自傷風險,或者相反地未能及時察覺真正危險的言論。這種技術上的灰色地帶使得安全機制的設計必須持續迭代優化。

多元帳戶帶來的挑戰

使用者能夠擁有多個帳戶的特性,為安全機制的有效性帶來變數。倘若使用者在不同帳戶中進行差異化的行為模式,安全系統可能難以獲得完整的使用者互動圖像。這種設計上的彈性在某程度上保障了使用者的隱私與自由,但也為潛在的風險管理增加了難度,反映出便利性與安全性之間的永恆張力。

家長監護與青少年保護

信任聯絡人功能與先前推出的家長監護措施形成了互補的安全體系。後者專注於保護未成年使用者,允許家長在系統判定青少年面臨嚴重安全風險時接收通知。兩項功能的結合旨在為不同年齡層的使用者提供適切的安全防護,然而選配性質意味著這些保護機制的覆蓋範圍受限於使用者的主動意願。

專業健康資源的整合

除了人与人之間的聯繫機制外,ChatGPT 也內建了引導使用者尋求專業協助的自動化功能。當系統偵測到對話涉及自我傷害議題時,會主動提供心理健康資源的資訊。這種設計反映了 OpenAI 對於 AI 系統在公共衛生領域角色的思考,試圖在技術能力範圍內盡到社會責任。

安全文化的持續演進

信任聯絡人功能的推出可被視為 AI 產業安全文化演進的具體例證。隨著生成式 AI 應用日益普及,科技公司對於其在使用者生活中可能扮演的角色也承擔著更大的責任。這項功能不僅是技術層面的創新,更是對於 AI 系統社會角色定位的回應,體現了業界對於如何構建負責任 AI 的持續探索。

參考來源:https://techcrunch.com/2026/05/07/openai-introduces-new-trusted-contact-safeguard-for-cases-of-possible-self-harm/

TechApple

隨機商業新聞