🔥【大模型系列42】关于Qwen 3.8 max和27B, 你想知道的一切

基本资料

官方文:https://qwen.ai/blog?id=qwen3.8

价格:输入$2/输出$6
参考kimi k3=$2.5/15,gpt-5.6-terra=$3/$15

参数:qwen-3.8-max=2.4t
qwen-3.8-27b

上下文: 标准128k,最大1m
最大输出:128k

Effort:最高xhigh,没有max
话说如果有qwen-3.8-max max也会怪怪的

评测

官方自评




ArtificiAlanalysis评分

来源:https://artificialanalysis.ai




Arena评分

来源:Arena Leaderboard | Compare & Benchmark the Best Frontier AI Models






LiveBench评分

来源:https://livebench.ai


Chat渠道

中国官网/App

来源:https://www.qianwen.com/

国际官网

来源:https://qwen.ai/

Arena Chat未上线

来源:Chat with Multiple Frontier AI Models


API渠道

官网API已上线

OpenRouter API已上线

来源:Qwen3.8 Max - API Pricing & Benchmarks | OpenRouter


Coding渠道

中国版:大模型服务平台百炼控制台
国际版:Token Plan (Team Edition) - AI model subscription plans and pricing - Alibaba Cloud Model Studio - Alibaba Cloud Documentation Center
1x=¥39=$6
4x=¥139=$18
16x=¥499=$68


最后发张梗图,祝佬友与qwen愉快地玩耍

39 Likes

我近期其他帖子

.🔥【大模型系列41】关于Opus 5, 你想知道的一切【楼底更新Arena前端反超k3】
.🔥【大模型系列40】关于Gemini 3.6 Flash 和 3.5 Flash-lite,你想知道的一切
.🔥【大模型系列39】关于Kimi K3,您想知道的一切【底楼更新Arean Agent评分】
.🔥【大模型系列38】关于Sonnet5,你想知道的一切【更新Arena Agent评分】
.🔥【大模型系列37】关于GPT-5.6,你想知道的一切【更新Arena Agent评分】
.🔥【大模型系列36.1】Fable5 vs Opus vs Sonnet5写作测试: 消耗速度是opus的5倍而不是API价格的2倍
.🔥【大模型系列36】关于Fable5/Mythos5,你想知道的一切【底楼更新封禁分析】


.【AI大战系列11】OpenAI这么讨人嫌么,R站认为OpenAI会率先实现AGI的票数,仅比中国模型概率高一点
.🔥【AI大战系列10】用非洲草原生态解释中美AI竞争(狮子王版)
.🔥【图像视频系列8】关于Gemini-omni-flash,你想知道的一切

L站qwen3.8相关帖子汇总(按从新到老排序)

.实测!Qwen3.8Max对比GPT5.6sol前端能力表现!
.qwen3.8max正式版画鹈鹕

qwen这是仰卧起坐吗,这次跑分居然能这么高…3.5plus当时体验半天就忍不了那诡异的说话风格给撇了

1 Like

不错,前两天 3.8 max preview的时候,因为没多少人关注,所以在官网随便试了试,居然意外的还可以

4 Likes

一般别人问我模型实力如何我会拿这个和GPT某一代的模型作对比,主要是Agent任务方面的。目前从基准测试来看Qwen3.8-Max应该有GPT-5.5级别了吧,和Kimi-K3类似水平。应该还达不到GPT-5.6 Sol的水平。各位佬觉得呢?

2 Likes

这次qwen3.8纸面数据不错,尤其是写作和编程比较均衡, 不像kimi和codex有点一边倒偏编程

说明只要国产模型解决算力问题, 参数上到2t, 技术上并没有太大差距

以前开源打不过前沿, 很重要原因是卡少, 训练参数上不去

以前开源一直都停留在几百b水平, 与opus的4t, fable的8t, gpt5.6sol的2-3t都有很大差距, 闭源不公布参数规模, 以上是业界估计参数

3 Likes

加一,之前在官网使用 qwen 3.8 max 拿 tikz 画图,效果相当不错,审美比 gpt 好多了

千问 3.8 好像还开源,不知道现在已经开了没有?

下周,max和27b模型同时开源

2 Likes

千问就还是好好点你的外卖吧,写个代码半天写不出来,就算写出来bug也超级多,写代码和豆包有的一拼。远不如glm、ds、kimi这些,所以就还是好好点外卖吧,千问点的外卖是最有性价比的,不接受反驳

5 Likes

百炼控制台试了一下,写作能力没榜单上说的这么强,而且倾向于短字数,千问系列一直有这个问题,写出来的内容太少,然后也没那么强

千问在 Arena上面的跑分独一档哇

ArtificiAlanalysis评分

来源:https://artificialanalysis.ai



1 Like

之前百炼用了2个月的pro订阅,3.5plus,我发现阿里的max模型一直没给coding plan里,然后就取消订阅了,而且那个服务台真的是极其反人类,我每次都找不到额度在哪显示

这个帖子内容质量非常高,仔细看完之后我收获了特别多的干货。

3 Likes

LiveBench评分

来源:https://livebench.ai

笑死 ArtificiAlanalysis评分又撤回了qwen-3.8-max 说是要更新权重重测

1 Like

DeepSWE评测

https://deepswe.datacurve.ai/

1 Like

个人娱乐测试,qwen38max 正式版的提升有一定幅度,但不大

1 Like

更新Qwen 3.8 27B

造反了, 敢和Opus4.6max比跑分
模型下载:Qwen/Qwen3.8-27B · Hugging Face