祖父被弟弟的聲音騙了,孫女決定自己來解決這件事

有一天,一通電話打給了 Tarini Puri 的祖父。
電話那頭是他弟弟的聲音——熟悉的口音、講話的節奏、甚至那種老朋友之間才有的稱呼方式。祖父沒有懷疑,匯了錢。等到他們真的聯絡上弟弟,才發現那通電話根本不是他打的。
這不是科幻情節。根據 TechCrunch 在 2026 年 9 月的報導,這件事真實發生在 Tarini 家裡,而她的反應不是憤怒地在社群貼文,而是去創業。
這件事為什麼比你想的更難防
你可能會說:「那要求對方視訊不就好了?」
問題是,2026 年的 deepfake 技術已經不只能合成聲音,即時視訊換臉也做得到——而且需要的訓練資料愈來愈少。三到五分鐘的通話錄音,就足夠訓練出一個可以即時說話的聲音複製體。你祖父在抖音或 YouTube 上傳過影片嗎?參加過葬禮或婚禮的現場直播嗎?那些聲音樣本都是可以被收集的。
更麻煩的是,被鎖定的對象通常是年長者,不是因為他們笨,而是因為他們的「信任預設值」高——對認識幾十年的聲音,你不會先懷疑它。這反而是詐騙者精準利用的漏洞。
Tarini 做的那件事,比「建議大家小心」更有用
她沒有停在受害者的位置。她去研究聲紋驗證這個領域,然後開了一家公司,方向是幫家庭和個人建立一套聲音身分驗證的機制——白話講就是:當一通「可疑的」電話打來,系統可以比對對方聲紋是不是真人本人,而不只是聽起來像。
這個思路其實不算全新。金融業早就在用聲紋做客服認證(你打過某些銀行的客服,它會說「您的聲音即為您的密碼」)。但把這個技術下放到家庭層級、讓不懂科技的長輩也能用,才是真正的挑戰。
你可以把它想成兩階段的護城河:第一層是偵測(這個聲音是 AI 合成的嗎?),第二層是驗證(就算聲音是真人,他真的是你認識的那個人嗎?)。目前市場上大多數方案只做其中一層,Tarini 瞄準的是把兩層整合起來、並且讓操作門檻夠低。
詐騙產業的升級速度,比監管快得多
這裡有個讓我有點沮喪的現實:技術跑得太快。
2024 年全球 AI 語音詐騙造成的損失估計超過 250 億美元,而且這個數字還在加速。監管機構反應通常慢半拍,等到某個國家出台像樣的法規,攻擊者早就換了一套工具。
AI Agent 的普及讓情況更複雜——現在的 AI 不只能生成聲音,還能自動化整個對話流程,包含先蒐集目標資料、再選擇攻擊時機、然後發動行動。你面對的不再是一個騙子,而是一個可以同時對幾千個目標運行的自動化詐騙管線。
這也是為什麼 Tarini 這類創業者存在的意義很重要:她不是在等監管,她在做產品。
你能做什麼(現在,不是等之後)
說幾個真正可以落地的事情:
- 建立家庭暗語:跟你的長輩約定一個「真人確認詞」,對方如果說不出來,不管聲音多像都不匯錢。這個方法土,但有效。
- 警覺「緊急感」設計:幾乎所有的聲音詐騙都有一個共通點——製造時間壓力(「我現在在醫院」「你要馬上匯款」)。只要出現這種情境,先掛電話、用原本儲存的號碼回撥。
- 聲音樣本不要隨便公開:不是說要從網路消失,而是意識到你的聲音是可以被複製的生物特徵。
- 工具層面:目前有幾個瀏覽器外掛和手機應用程式可以即時偵測電話中的 AI 合成聲音特徵,值得搜尋安裝。
順帶一提,如果你在思考的是「怎麼讓公司內部的通話更安全」,AI 會議記錄工具的選擇其實也牽涉到誰能聽見對話、資料怎麼儲存,這個維度常常被忽略。
最後帶走一個想法
Tarini 的故事讓我想起一句話:「最好的安全產品,通常來自親身踩過雷的人。」
她祖父的遭遇是真實的損失,但它撞出了一個創業動機——這個動機比「市場機會分析」或「投資人簡報」更有韌性。你去查那些在 AI 安全領域做出成績的公司,背後很多都有一個具體的、讓創辦人睡不著覺的故事。
我不是在美化受害經歷。而是說:如果你身邊有長輩,今晚吃飯的時候值得花五分鐘聊這件事。不是要嚇他們,是讓他們知道「那個聲音聽起來很像,不代表它就是」。
AI 讓很多事變得更快更好。但它也讓一通電話變得比以前更難信任。
參考來源
分享這篇



