SonaFactEvidence from audio

從錄音到成稿之間的每一步

一個檔案,想推進到哪一步都行:值得信賴的逐字稿、帶出處的會議紀錄、帶評分的通話檢討、再譯成四種語言的字幕——或者就是一份乾淨的 DOCX。

上傳與處理逐字稿編輯器AI 文件通話分析字幕與詞彙表
上傳與處理

把檔案丟進來,看著它跑

一次一段錄音,最長十小時,音訊或影片都行。它會告訴你現在到哪一步、還剩多久——不會只給你一個什麼都不說的轉圈圖示。

語言會從一百種裡自動辨識,你也可以在已知時自行指定。
說話者人數:自動判斷,或者你知道時填準確的數字。
帳號詞彙表裡你的人名會當作提示傳給引擎。
出錯時用人話說明,而不是丟一串程式碼,並給出解決辦法。
MP3 · WAV · M4A · MP4 · MKV · OGG · FLAC · WMA每個檔案都有重試和紀錄
佇列3 個檔案
42:10product-review.mp4轉寫 · 64% · 還剩約 2 分鐘處理中
18:24interview-01.mp3區分說話者 · 88%處理中
07:55support-call.m4a中文(94%)· 2 位說話者已完成
old_tape.wma找不到音訊檔案——請指出檔案位置錯誤
各階段:解碼 → 說話者 → 語言 → 轉寫 → 詞語對齊 → 詞彙表 → 整理發言。
逐字稿編輯器

改一個詞,一次改掉所有地方的說話者名稱

播放時反白正在說的那一行,就地編輯文字,按一下就把一句話移給對的說話者。

點某一行就從那裡播放;點文字就能編輯。
把握較低的詞會畫底線,你一眼就知道該看哪裡。
在整份逐字稿裡尋找取代,詞語時間保持不變。
說話者面板顯示發言時間和占比;可以把一句移給別人,也可以合併兩個說話者。
尋找與取代跟隨播放合併說話者
product-review · 發言9 句發言 · 142 個詞
00:00Anna Whitfield早安,韋伯女士。謝謝您撥空。OK
00:10說話者 2不過關於時程,我有幾個問題。已修正
00:27說話者 2我們需要檢查 KSeF 中的發票。建議
00:44Anna Whitfield嗯。把握較低
最常需要修正的是「嗯」「好的」這類很短的應答。
AI 文件

會議紀錄、待辦、章節——都帶出處

從六種現成類型中產生文件。每一條都帶可點按的時間標記,逐字稿撐不住的內容在你看到之前就已被剔除。

會議紀錄、待辦清單、摘要、章節、業務與客服通話檢討。
查核行:「已刪除 2 條錄音無法佐證的內容。」
逐字稿一改,文件會把自己標記為已過期。
文件的語言與錄音的語言無關。
DOCX · PDF · Markdown · 複製用 Markdown 編輯重新產生
待辦清單會議紀錄 · 最新
01:01Anna Whitfield把移轉摘要寄給所有與會者今天
00:23James Carter確認慕尼黑資料交接的日期9 月 18 日
00:52尚未指派兩週後安排一次後續會議
🛡 已刪除 2 條錄音無法佐證的內容。
通話分析

為業務與客服通話準備的評分表

發言占比、語速、最長的一段獨白、插話次數和提問數量,再加上逐項評分表——每項都帶理由,以及它被滿足的那一刻。

現成的 BANT 和客服標準評分表——或者你自己的評分項目。
為每位說話者標註角色,AI 會給建議,你可以改。
異議連同已給出的回應,以及帶負責人的後續行動。
通話開頭、中段和結尾的語氣。
評分項目可編輯改了角色就重新產生
業務通話 · BANT得分 72%
04:12預算客戶給出了 2027 年預算的區間符合
07:48決策權提到了決策者,但未經確認部分符合
11:02需求現有流程中的兩個具體問題符合
時程沒有談到決策的時間不符合
角色有改動——請重新產生以更新分數。
字幕與詞彙表

逐句校對過的字幕

遵循易讀性規則的 SRT 和 WebVTT,每段錄音最多四種翻譯語言,以及能把人名和專業用語照你要求寫對的詞彙表。

每行最多 42 個字元,每秒最多 17 個字元。
每句都有狀態:OK、已修正、待檢查、已過期。
修改逐字稿後,只有改動過的句子會重新翻譯。
你自己的人名和專業用語詞彙表——可依語言分設,也可全部通用。
SRTWebVTT詞彙表在引擎開始聽之前就交給它
字幕 · 簡體中文14/16 · 待檢查 1
00:12安娜我们先从迁移状态开始。OK
00:19詹姆斯第一阶段将在十月完成。已修正
00:27詹姆斯我们需要检查 KSeF 中的发票。待檢查
00:41安娜我今天就发送摘要。已過期
18 條字幕 · 其中 4 條太快——匯出前請先修正。

它會說出自己沒把握的地方

任何自動轉寫都有弱點——一個說得很快的名字,一個被咳嗽蓋掉的詞。多數工具遞給你一面看起來乾淨的文字牆,然後把找問題的事留給你。SonaFact 會做標記。

在要緊處畫底線

引擎沒把握的詞下面有虛線。你只需讀這些詞,而不是整整一小時。

屬於這段錄音的數字

每份逐字稿都會寫明被標記的詞占多少比例——音質乾淨時通常只有百分之幾,吵雜的電話通話會更多。這是在你的檔案上量出來的,不是從宣傳手冊抄來的。

每種語言都一樣

一百種語言都走同一個引擎、同一套標記。坦米爾語的錄音和英文錄音一樣,會給出不確定詞語的比例。

拿你手上已有的錄音試試

免費方案就足以判斷準確度、說話者區分和編輯器好不好用。

免費開始