超2万亿参数规模模型又添新成员。继Kimi K3之后,当地时间8月3日,阿里巴巴发布新一代基座大模型Qwen3.8-Max。 该模型总参数量达2.4万亿,采用稀疏混合专家(MoE)架构,单次仅激活约950亿参数,兼顾旗舰级“脑容量”与极低推理延迟。模型支持最长100万Token上下文窗口,原生具备多模态视觉能力。官方宣称该模型在编程、办公、科学研究及长周期任务中的综合表现已进入全球大模型第一梯队...
网页链接超2万亿参数规模模型又添新成员。继Kimi K3之后,当地时间8月3日,阿里巴巴发布新一代基座大模型Qwen3.8-Max。 该模型总参数量达2.4万亿,采用稀疏混合专家(MoE)架构,单次仅激活约950亿参数,兼顾旗舰级“脑容量”与极低推理延迟。模型支持最长100万Token上下文窗口,原生具备多模态视觉能力。官方宣称该模型在编程、办公、科学研究及长周期任务中的综合表现已进入全球大模型第一梯队...
网页链接
精彩评论