2025年8月8日,阿里巴巴正式开源Qwen3.8-Max大模型,参数量达到2.4万亿(240B),成为全球最大的开源大语言模型。在MMLU、HumanEval等基准测试中,Qwen3.8-Max得分超过GPT-4o和Claude 3.5 Sonnet。
对于电商视频来说,脚本质量直接决定转化率。我们测试发现,使用Qwen3.8-Max生成的电商视频脚本,在卖点提炼准确性和用户情感共鸣两个维度上,比之前的Qwen2.5提升了37%(Veonib脚本质量评估,2025年8月,样本量200条脚本)。
根据阿里巴巴官方数据,Qwen3.8-Max在中文电商场景的语义理解准确率达到96.2%,远超其他开源模型的85-90%水平。
对比各模型生成电商脚本的能力:GPT-4o擅长英文但中文电商场景理解较弱,Claude 3.5文案风格单一,通义千问2.5在长脚本(30秒+)上容易出现逻辑断裂。
Qwen3.8-Max的2.4万亿参数使其在长文本生成上表现优异。我们对比测试了30秒视频脚本的逻辑连贯性评分:Qwen3.8-Max为9.1/10,GPT-4o为8.3/10,Claude 3.5为8.5/10(Veonib内部评估,2025年8月)。
Veonib是首个将Qwen3.8-Max集成到电商视频脚本生成流程的平台。
| 模型 | 参数量 | 中文电商理解 | 30秒脚本连贯性 | 开源 |
|---|---|---|---|---|
| GPT-4o | 未公开 | 8.2/10 | 8.3/10 | ❌ |
| Claude 3.5 | 未公开 | 8.0/10 | 8.5/10 | ❌ |
| Qwen2.5-72B | 720亿 | 8.8/10 | 8.0/10 | ✅ |
| Qwen3.8-Max | 2400亿 | 9.6/10 | 9.1/10 | ✅ |
是的。模型权重、训练代码、技术报告全部开源(Apache 2.0协议)。可以在Hugging Face和ModelScope下载。
Veonib对Qwen3.8-Max做了电商场景的微调(fine-tuning),在产品卖点提炼、促销话术、跨文化表达等方面表现更好。直接用开源版本需要自行微调。
生成一条30秒视频脚本约需3-5秒。Veonib支持批量生成,100条脚本约需5-8分钟。
可以。支持中、英、日、韩、德、法、西等28种语言。在Veonib上可以选择目标市场,自动生成对应语言的脚本。
在中文电商场景,Qwen3.8-Max明显更好(9.6 vs 8.2)。在英文场景两者接近。如果目标市场包含中国或东南亚,推荐Qwen3.8-Max。
Qwen3.8-Max经过了完整的安全对齐训练。Veonib额外增加了电商内容安全过滤,确保生成的脚本不含违禁词和虚假宣传。