OmniHuman 1.5
OmniHuman 1.5 目前的核心路徑會以一張人物、寵物或動漫主體圖片和一段音訊生成驅動影片。音訊長度由上傳簽章驗證,並直接決定建立任務前的預授權。
一句話瞭解
這個模型表現如何?
圖片可採用任意畫面比例,但仍須通過真實格式與簽章尺寸驗證;音訊必須使用支援的格式、不超過 10 MB,且短於 60 秒。選填提示詞會採用更嚴格的 300 個字元上限,不會使用互相衝突的較寬描述。
關鍵參數總覽
協助你快速評估此模型是否符合你的業務情境。
其他名稱
同一個模型在不同資料中可能有不同名稱,這裡統一整理,方便搜尋與比較。
使用者常見問題
從實際任務、輸入條件和結果要求出發,整理選擇模型時最需要確認的問題。
選擇指南
還在猶豫該用哪個模型嗎?先查看這幾個關鍵決策點。
來源素材為靜態人物或角色圖片,且需要由音訊驅動時可使用本模型。
若需要保留原影片動作與鏡頭,可比較 Video Lip Sync。
先使用建議的短音訊測試主體辨識與對嘴,再延伸至較長內容。
使用者常搜尋的比較
把常見候選放在同一任務下比較,協助你確認輸入方式、控制項和成本差異。
模型橫向比較表
還在猶豫該選哪一個嗎?這張表協助你快速看清目前模型與替代方案的核心差異。
實際使用體驗
結合公開資料、目前站內邊界和典型任務,說明模型適合與不適合的情況。
有限開放不等於完整輔助套件
依音訊秒數預授權可以驗證
功能詳解
圖片音訊驅動
雙解析度輸出
快速模式
適合做什麼
虛擬講解員
動漫角色對白
寵物擬人短片
提示詞技巧
保持主體清楚
音訊使用乾淨人聲
提示詞保持簡短
選擇它的理由
使用前須知
可調整參數
協助你快速評估此模型是否符合你的業務情境。
點數消耗
依已驗證音訊長度,以每秒 27 credits 計算建立任務前的預授權並無條件進位;音訊必須短於 60 秒,因此合法請求的預授權低於 1,620 點。任務完成後按實際消耗結算。
批次生成圖片或影片前,建議先用同一組素材,在目前模型與同類候選模型之間進行 AB 測試;確認效果後再批次執行,避免浪費點數。
常見問題
同類模型推薦
還沒決定該用哪個嗎?也可以比較這幾個同類候選模型。
Kling AI Avatar Standard
能力標籤: 前台要求恰好 1 張 JPEG 或 PNG 圖片及 1 段 MPEG、WAV、X-WAV、AAC、MP4 或 OGG 音訊。圖片最大 10 MB;音訊最大 100 MB、最長 5 分鐘。 依已驗簽的音訊長度按 8 點/秒計算並向上取整;長度缺失、無效或超過 5 分鐘時無法送出。
Infinitalk
Infinitalk 在 Kyeo 使用 1 張圖片、1 個不超過 15 秒的音訊檔案與必填提示詞,生成虛擬人物播報影片。可選 480p 或 720p,也能填寫 `seed`;費用依音訊秒數與解析度計算,不是固定的單次價格。
資訊來源
頁面內容結合模型資料、功能說明和 Kyeo AI 目前可用設定整理。
瞭解 OmniHuman 1.5 目前開放的一張圖片加一段音訊驅動影片、720P/1080P、音訊短於 60 秒、按秒計費及有限開放邊界。 依已驗證音訊長度,以每秒 27 credits 計算建立任務前的預授權並無條件進位;音訊必須短於 60 秒,因此合法請求的預授權低於 1,620 點。任務完成後按實際消耗結算。
用於核對本站目前接入版本的輸入模式、可見設定、素材限制與可用狀態;實際選項以頁面和工作台為準。