超越Sora!阿里万相大模型正式开源,消费级显卡也能跑!
阿里云旗下视觉生成基座模型万相 2.1(Wan)重磅开源,支持文生视频和图生视频任务。14B 和 1.3B 参数规格的全部推理代码和权重开放,并在权威评测集 VBench 中表现优异。
阿里云旗下视觉生成基座模型万相 2.1(Wan)重磅开源,支持文生视频和图生视频任务。14B 和 1.3B 参数规格的全部推理代码和权重开放,并在权威评测集 VBench 中表现优异。
DeepSeek开源周内,阿里发布了Wan2.1模型。该模型支持文生视频和图生视频任务,并且采用了宽松的Apache2.0协议。万相2.1在VBench评测中表现出色,但在文本生成、物理细节理解和变形处理等方面仍存在不足。通过采用3D时空变分自动编码器(Wan-VAE),模型能在消费级显卡上运行并优化内存使用和生成速度。