A5站长网9月19日消息,阿里云通义千问团队发布新一代原生全模态模型Qwen3.8-Omni-Flash。模型在文本、图像、音频、视频四类输入上原生处理,不再依赖先把语音转写、再抽帧拼接的多模型组合。官方公布的降幅集中在成本端:音频输入每小时API价格下降超过98%,音频加视频联合输入下降超过93%。按官方口径,每小时成本以2分钟素材的处理价格乘以30估算,视频按720p、每秒1帧的输入条件计算。
A5创业网 版权所有