• 请不要在回答技术问题时复制粘贴 AI 生成的内容
Liu6
V2EX  ›  程序员

数字人开源模型推荐+魔改方案

  •  
  •   Liu6 · 22h 39m ago · 1258 views

    ps: 节点有问题,劳烦移动一下。我没找到数字人节点

    视频生视频模型
    1 、音频到视频 1 分钟视频生成时间 3-10 分钟左右
    2 、能跑着,走着说,角度最好能 90 度
    3 、可以批量生成
    4 、交付源代码.能最后封装到给 api 接口
    5 、能支持高清,720P 以上
    6 、除了改嘴型,背景文字和画面不改变
    7 、嘴巴颜色正常,不过红,牙齿清晰

    图生视频
    1 、图片生成视频时间 1 分钟视频生成时间 30 分钟以内
    2 、能跑着,走着说
    3 、可以批量生成
    5 、能支持高清,720P 以上
    6 、手部动作可以调节
    7 、嘴巴颜色正常,不过红,牙齿清晰

    目标: 对口型
    其实最主要的就是质量问题
    目前我也尝试了开源的模型,还是会出现口型会出现模糊,牙齿不清晰, 画面撕裂等 场景可以参考(原视频嘴巴不动, 跑, 跳等)

    求各位大佬分享开源模型+魔改方案
    实在不行购买也行,需要所有的源代码,我这边会封装成 API 。
    不需要考虑硬件问题
    球球啦~

    10 replies    2026-09-03 09:46:49 +08:00
    blueslmj
        1
    blueslmj  
       20h 46m ago
    我还以为是你推荐。。
    coefu
        2
    coefu  
       20h 28m ago
    不标价格不够诚意。
    Liu6
        3
    Liu6  
    OP
       20h 28m ago
    @blueslmj #1 我敲, 我也想推荐。
    Liu6
        4
    Liu6  
    OP
       20h 28m ago
    @coefu #2 价格你们报价啊。
    manhere
        5
    manhere  
       19h 48m ago
    开源的基本都是玩具
    hsuehly
        6
    hsuehly  
       19h 40m ago
    有这方案,我自己都成立公司了
    defunct9
        7
    defunct9  
       19h 7m ago
    我有,刚弄了一套
    isSamle
        8
    isSamle  
       17h 38m ago
    你提供硬件,我 SSH 隧道进去研究玩玩
    panxi
        9
    panxi  
       26 mins ago
    我自己魔改的 1080P 分辨率 1:0.5 的速度, 前提是第一次得创建缓存,后面推理命中缓存就飞起
    panxi
        10
    panxi  
       23 mins ago
    不过就是是单步 U-Net 生成, 最近正在替换成 多步潜空间扩散生成, 提升唇部质量
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   5767 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 53ms · UTC 02:10 · PVG 10:10 · LAX 19:10 · JFK 22:10
    ♥ Do have faith in what you're doing.