模型介绍
中文整理# Zing-0.5 模型卡片
模型用途
Zing-0.5是由Seedleap.ai团队(涌跃智能)开发的50亿参数因果世界模型,用于实时交互。该模型从当前状态持续预测视觉世界,文本提示和键盘动作可在生成过程中改变场景、运动和未来演变。
## 主要能力
支持文本初始化生成、单图像初始化、rollout期间提示更改以及连续W/A/S/D/I/J/K/L键盘控制。因果KV缓存和四步DMD采样技术使模型能够在单GPU上实现响应式长视野生成。
## 输入输出
- *输入**:文本提示、键盘动作、参考图像(用于Action TI2V)
- *输出**:每个JSONL行产生一个以sample id命名的结果文件。多帧rollout保存为H.264 MP4格式,帧率24 FPS。
运行要求
- *GPU内存配置**:
- 80 GB或以上:local attn size设为97,sink size设为9
- 少于80 GB:local attn size设为33,sink size设为5
默认97/9配置已在单张NVIDIA H100 80 GB显卡上验证通过。可通过设置--local-attn-size -1 --sink-size 0启用完整历史注意力机制。
基本用法
通过SGLang的WebSocket API进行实时服务时使用Zing-SGLang。也可使用Zing GitHub仓库中的独立推理代码。代码仓库包含现成的Action T2V和Action TI2V JSONL示例,包含所需参考图像。
限制
长时间rollout可能出现视觉漂移或物理不一致。动作响应性可能因场景内容和视角不同而有所变化。
许可证
Zing-0.5采用Apache License 2.0开源许可证。
优先采用原作者提供的中文模型卡片;仅有英文说明时由闲社AI翻译整理。重要参数、许可证和商用范围请以原文为准。
你将获得什么
完整仓库方式包含该固定版本中的权重、配置、分词器及说明文件;指定版本方式只下载所选文件或整组分片。多模态模型的投影文件、配置等依赖,请按作者说明配齐。
完整仓库可能包含多个权重格式,因此需要的磁盘空间可能大于单一格式的模型大小。下载文件不等于完成模型部署。
使用前须知
运行模型需要的设备、工具与依赖,以原作者说明为准。
是否允许商用、修改和分发,请查看模型许可证。
闲社提供资料与镜像下载方法,不代表已运行模型或完成安全审计。下载的代码应先检查,再执行。
资料或下载有问题?
登录后可提交反馈。
