逆向六款开源RAG产品,提炼自研RAG五层架构与落地蓝图
2026/10/7 22:00:03
论文由清华大学 + 生数科技(Shengshu Technology)联合发布,提出Vidu S1——一款语音可控、无限时长、实时交互的数字人视频生成模型,解决现有离线视频生成模型无法实时交互、语音控制弱、长视频画面漂移、推理成本高四大行业痛点。
现有主流视频模型(Sora、Veo、Wan、Seedance)均为离线一次性生成:用户输入提示词后等待数分钟拿到完整视频,中途无法干预;而Vidu S1实现流式实时生成,用户可在视频生成全程用语音实时下发动作指令,数字人即时响应。