博文

目前显示的是标签为“千问 3.0,模型”的博文

开源的真正野心:千问 3.0 不只是在聊天,它开始 "长出手脚"

图片
  先问一个有点怪的问题。 你问AI"今天星期几",它回答得很快。 你问它"这道竞赛数学题怎么解",它也回答得很快——然后错了。 在很长一段时间里,大模型就是这么个东西:不管问题多简单、多复杂,它都只用一种"力度"去思考。就像一个人被要求用同一副表情,既应付电梯里的寒暄,又完成一场博士答辩。 2025年4月29日凌晨,阿里把千问3.0(Qwen3)系列模型全部开源。它带来的最重要改变,不是参数变多了,而是—— AI第一次学会了"该想多久" 。 一年多过去,模型已经迭代了好几代。但回过头看,Qwen3 依然是很多人心里的那道分水岭。这篇文章想讲清楚三件事:它到底改了什么,为什么这些改动重要,以及它对普通人意味着什么。 一、一个脑子,两种转速 Qwen3 是阿里第一个"混合推理模型"。 翻译成人话:同一个模型里,装了两种思考方式。 思考模式 ,适合数学、代码、逻辑推理这类需要一步步来的活。它会先在内部写一长串"草稿",把问题拆开、试错、回头检查,然后才给你答案。官方给这个"草稿"设了上限,最长约 38K tokens——大致相当于它能在心里默写一篇上万字的推演。 非思考模式 ,适合日常对话、简单问答、批量处理。不写草稿,直接回答,快、省、便宜。 关键在于,这两种模式不是两个模型,而是 同一个模型的两种状态 ,而且能来回切换。开发者甚至可以在对话里用 /think 和 /no_think 这样的软开关,逐轮告诉它:"这个问题你认真想想",或者"这个别琢磨了,直接说"。 这件事为什么值得单独拿出来讲?因为它解决的是一个非常现实的成本问题。 在 Qwen3 之前,想要"会深度思考"的模型,你往往得单独部署一个推理模型;想要"回答快"的,再部署一个。两套东西,两份钱,中间还得自己写逻辑判断什么时候该用哪个。 Qwen3 把选择权交还给了使用者: 简单问题低算力秒回,复杂问题多步骤深想。 打个通俗的比方:以前的AI像一家永远在开全员大会的公司,问个厕所在哪也要立项、评审、汇报。Qwen3 之后,它学会了这件事走快速通道,那件事成立专项组。 二、2350亿参数,每次...