生成式圖像與影片模型
把同意內建在流程裡的視覺模型。
第二個研究支柱:生成式圖像與影片模型,用於可控合成、參考導向的創作、本地化、粵語語音、配音、唇形同步,以及取得同意的虛擬主持。
生成式圖像與影片模型
WB 視覺模型 / 預覽
WB 視覺模型 / 預覽
虛構人工智能主持 · 已開啟披露
視覺生成與安全流程
- 01 界定視覺意圖提示、參考與權利 就緒
- 02 核實資料權利圖像、身分與語音同意 未開放
- 03 生成圖像、影片、語音與本地化 未開放
- 04 真人覆核披露與品質關卡 未開放
- 05 發佈水印與來源紀錄 未開放
此為確定性的前端示範。瀏覽器不會進行任何生成,亦不會呼叫任何模型。
圖像合成影片生成照護教育員工培訓產品示範本地化與配音
此處所示的主持是人工智能生成的虛構人物。他不是真人、並非員工、並非臨床人員,亦不是持牌顧問,並且不會提供任何建議。
流程
九個步驟,未到第九步不會發佈。
01
界定視覺意圖
在開始製作之前,先記錄用途、受眾、負責人與所需輸出。
02
核實素材
查核提示、文稿、事實陳述與來源權利。
03
取得同意
只使用已具備現行、按用途發出的同意的參考圖像、肖像與語音。
04
記錄本次運行
模型版本、供應商、提示、參考、種子與參數,與輸出一起保存。
05
隔離生成
在一項設有時間、成本與內容上限的工作之內進行。
06
掃描輸出
在任何人看到之前,檢查身分、披露、安全與政策問題。
07
披露
加上清晰可見的人工智能披露,以及支援的來源資料或水印。
08
具名真人覆核
由具名覆核人在發佈前批准該檔案的確切雜湊值。
09
保留控制
發佈之後,撤回、刪除與事故應變機制仍然有效。
用途
視覺模型應用在哪裡。
- 圖像合成
- 影片生成
- 照護教育
- 員工培訓
- 產品示範
- 本地化與配音
評估
量度甚麼。
- 01 提示忠實度:輸出是否就是所要求的內容。
- 02 視覺品質,由真人判斷,而不是單靠分數。
- 03 身分相似度,而且只在獲授權的範圍之內。
- 04 粵語語音對齊,並以真實粵語素材查核。
- 05 披露的可見程度與來源紀錄的保留情況。
- 06 真人覆核完成率:具名覆核人實際簽核的比例,以及他們拒絕了甚麼。
角色與權利是兩個獨立問題
主持只能以已就特定用途取得同意的肖像來建立,而且同意可以在事後撤回。
每項已發佈的素材都會帶有清晰可見的人工智能披露。合成人物永遠不會被說成是真實的員工。
客戶無法出示權利的參考,一律不會用來生成。