阿里通义千问开源 Qwen3.8-Flash:训练成本降至前代 1/9,支持 1M 上下文
阿里通义千问团队发布并开源 Qwen3.8-Flash 125B 参数 MoE 模型,训练成本降至前代的九分之一,原生支持 262K 上下文并可通过 YaRN 扩展至 1M,API 定价为每百万 Tokens 输入 1 元、输出 3 元。
SEARCH INTELLIGENCE
从资讯、AI应用到创新实践,让每一次搜索都能抵达更完整的数智脉络。
阿里通义千问团队发布并开源 Qwen3.8-Flash 125B 参数 MoE 模型,训练成本降至前代的九分之一,原生支持 262K 上下文并可通过 YaRN 扩展至 1M,API 定价为每百万 Tokens 输入 1 元、输出 3 元。
阿里巴巴通义千问(Qwen)系列开源AI模型在过去六个月内全球累计下载量突破30亿次,超越Meta和谷歌成为全球下载量第一的AI模型,其衍生模型数量也大幅领先竞争对手。
在浙江乌镇举行的2025年世界互联网大会领先科技奖颁奖典礼上,阿里云计算有限公司的'通义千问:开源开放的基础大模型'项目荣获工程研发组奖项。该项目已开源超300个模型,全球下载量突破6亿次,支持119种语言,服务超百万客户并实现多领域应用创新。
阿里云通义千问正式开放Qwen3-VL-30B-A3B-Instruct与Thinking模型源代码,同步推出FP8精度版本,该模型在多项视觉任务中性能达到国际先进水平。模型采用混合架构支持灵活部署,并升级图形界面操作、视觉编码等核心功能,扩展上下文窗口至1M。
阿里通义千问团队推出基于20B参数的Qwen-Image-Edit模型,通过双通道架构实现语义与外观双重控制,在公开基准测试中展现当前最优性能。尽管国内厂商加速布局多模态领域,但技术仍面临表征复杂度与空间推理能力等关键挑战。
阿里巴巴推出新一代通义千问 Qwen3 系列模型,通过混合推理架构与动态路由机制实现运算效率倍增,其 2350 亿参数模型在代码补全准确率提升 15%,现已通过 Apache 2.0 协议开源。该系列支持 119 种语言及 128K 上下文窗口,开源两小时内 GitHub 星标数激增 17000 次。
阿里巴巴即将发布通义千问 Qwen 第三代旗舰模型,引发行业对技术格局重构的关注。DeepSeek V3 版本凭借混合专家架构降低 27% 算力消耗,推动国内科技巨头加速技术迭代。
阿里云宣布在日本市场实施生成式 AI 战略升级,依托新建数据中心与本土合作伙伴共同开发行业定制模型。数智朋克讯,该计划重点突破制造业、服务业垂直领域 AI 应用,通过通义千问大模型技术底座实现自然语言处理与图像生成模块的精细化调参。
阿里巴巴集团开源通义千问 QwQ-32B 推理模型,凭借 320 亿参数规模追平行业标杆并实现 20 倍参数效率突破。该模型支持消费级显卡运行,企业 AI 推理成本降至传统方案 10%,适用于金融风控、医疗诊断等高需求领域。
阿里巴巴集团宣布未来三年将投入超 3800 亿元用于云与 AI 硬件基础设施建设,该金额超过去十年总和。在云业务 13% 增长及 AI 收入连续六季度三位数飙升的业绩支撑下,此次战略布局瞄准 AI 算力需求井喷与数字经济转型关键窗口期。