Qwen3.8-27B 的 Citation:bibtex 标题写的是另一个型号
一份 model card 里,绝大多数文字读者是拿来读的,只有一段是拿来原样复制的——文末的 Citation。它会被粘进论文的 .bib、粘进技术报告的参考文献、粘进内部评测记录,而且一旦粘进去,几乎没人会再回头逐字看一遍。
Qwen/Qwen3.8-27B 这个 Hugging Face 仓库的 model card 末尾就有这么一段。我们在 2026-08-16 采集快照 1d4bf0f 时逐行读了它,发现 bibtex 的 title 字段里写的型号名,和这个仓库本身的型号名不是同一个。
这篇文章只做一件事:把两处原文摆出来,标明位置,再给你一个自己动手核对的办法。至于为什么会这样、哪个说法「才是对的」,我们不推断,也不打算据此评价任何东西。
一、原文长什么样
README.md:569 是小节标题 ## Citation,这一节里的 bibtex 条目在 README.md:575-581:
@misc{qwen38,
title = {{Qwen3.8-Max}: A New Bar for Coding and Cowork},
url = {https://qwen.ai/blog?id=qwen3.8},
author = {{Qwen Team}},
month = {August},
year = {2026}
}
逐个字段看它的字面值:引用 key 是 qwen38;title 是 {Qwen3.8-Max}: A New Bar for Coding and Cowork;url 指向一个 qwen.ai 的博客地址,query 里的 id 是 qwen3.8;author 是 {Qwen Team};month 是 August;year 是 2026。
而这个仓库的型号名出现在两个地方:model card 的一级标题,README.md:7,写的是 # Qwen3.8-27B;以及 Hugging Face 上的仓库 ID 本身,Qwen/Qwen3.8-27B。
所以差异就是这一句话:README.md:576 的 title 写的是 Qwen3.8-Max,而 README.md:7 的一级标题与仓库 ID 写的是 Qwen3.8-27B。 两处并列,说完就停。
需要额外说明一句边界:url 那个链接我们没有访问过(本次整理全程不联网),因此它指向的页面标题是什么、内容讲的是哪个型号,我们一概不知,也不许在这里替它补。这里能确认的只有一件事——README 里写了这么一个链接。
二、怎么自己确认
不用装环境、不用下权重,把 model card 的 README.md 拿到本地,打印那几行就行。我们当时用的是这种最笨的办法(Python 按行读,避免不同 shell 的 grep 在中英混排和换行符上给你添乱):
import io
lines = io.open('README.md', encoding='utf-8').read().split('\n')
for i in range(568, 583):
print(i + 1, '|', lines[i])
需要提醒两点。第一,README.md 在我们这份快照里是 CRLF 换行,按 \n 切分后每行末尾会带一个 \r,肉眼看输出不影响判断,但你要做字符串精确比对时得先 strip()。第二,行号只对特定快照有效。我们对应的是 1d4bf0f,你拿到的快照如果 model card 有增删,行号会整体漂移,所以判断依据要落在「## Citation 小节里的 bibtex 条目」这个位置描述上,而不是死记 576 这个数字。
还有一个容易踩的坑:如果你打算用「行首是 #」这条规则去定位小节,会多出一堆假标题。我们按这个规则扫过一遍 README.md,输出里除了真正的 Markdown 标题,还混进了示例代码块里以 # 开头的 Python 注释行——README.md:277、README.md:286、README.md:405-417、README.md:430、README.md:479 这几处都是示例代码里的注释,不是小节。真正的标题一共十几个,## Citation(README.md:569)是其中最靠后的一个,所以从文件末尾往回翻反而更快找到。
另一个可以顺手核的坐标:整份 README.md 在我们这份快照里是 65,012 字节、583 行。如果你手上的文件大小和这个对不上,就说明你看的不是同一份内容,行号也别拿来对了。再记几个整体统计,方便你比对是不是同一份文件:我们数出来是 64,403 个字符、24 个代码围栏(也就是 12 个代码块)、2 处 <table>、15 处 http(s):// 链接,以及 0 个中日韩汉字——这是一份全英文文档,Citation 那段自然也没有中文版本可对照。
三、这不是孤例:名字对不上的地方还有几处
把视线从 Citation 拉开一点,这份仓库里「名字」这一层本来就有好几处字面值不一致。下面全部只做并列陈述,不解释、不排序、不推断哪个是主口径:
- 仓库叫 Qwen3.8-27B(
README.md:7),但config.json:7的model_type是qwen3_5,config.json:2-4的architectures是["Qwen3_5ForConditionalGeneration"],text_config.model_type是qwen3_5_text(config.json:94),vision_config.model_type也是qwen3_5(config.json:130)。model card 自己在README.md:20写的是Built on the architectural foundation of Qwen3.5。 tokenizer_config.json的tokenizer_class是Qwen2Tokenizer。preprocessor_config.json里同一个文件出现两个世代名:processor_class是Qwen3VLProcessor,image_processor_type是Qwen2VLImageProcessorFast;video_preprocessor_config.json的video_processor_type是Qwen3VLVideoProcessor。- 代际表述这一层也有一处可以并列:
README.md:18点名的前代是Qwen3.5 and Qwen3.6系列,而Qwen3.7-Plus这个名字在 README 正文里没有作为系列出现过,只作为两张 Benchmark 表的对照列名出现在README.md:72与README.md:192。
这些字面值我们都逐个读过、也逐个记了位置。它们各自意味着什么、运行时会不会有影响,我们没有依据判断——这是个权重与配置仓,仓库里不含建模代码,没有源码可以顺着往下读。
四、复制这段引用之前,你自己能落到实处的
先划清楚:下面这几条是通用的引用与记录做法,不是 model card 的内容。## Citation 这一节我们取证到的只有 README.md:575-581 这段 bibtex 条目本身,没有别的引用规范可援引。
- 把你实际用的东西写清楚。 你用的是仓库 ID
Qwen/Qwen3.8-27B,那就把这个 ID 连同你拉取的快照 sha(我们这次是1d4bf0f2ff6012fd82039f2fa52739d0dd7c60c0)和核对日期一起记进你的实验记录。这一步和 bibtex 里写什么无关,是你自己那份记录的完整性。 - 粘完 bibtex 之后回头看一眼
title。 这是这篇文章唯一想让你养成的动作。渲染出来的参考文献条目里如果出现了一个和你实验对象不同的型号名,审稿人或同事第一眼就会问,到那时再改成本更高。 - 不要自己动手把型号名改掉然后当成官方条目。 你改完它就不是 model card 给的那段文字了。要么原样引用并在正文里说清你用的是哪个仓库与哪个快照,要么按你所在期刊、会议或团队的引用规范另行处理——具体怎么处理,取决于那份规范,我们给不出通用答案。
- 许可与署名是另一回事,别混在一起看。 这个仓库的协议口径三方一致:Hugging Face API 元数据是
apache-2.0,model card frontmatterREADME.md:3是license: apache-2.0,仓库根目录的LICENSE是 Apache License 2.0 的标准文本,版权行在LICENSE:190写的是Copyright 2026 Alibaba Cloud。我们在整份LICENSE里检索过Qwen、Acceptable Use、restriction、Tongyi、Supplement,一处都没有命中。具体授权范围以官方协议原文为准。
五、什么情况说明你碰到的不是这回事
- 你手上的不是这个仓库。 本文的全部结论只对
Qwen/Qwen3.8-27B在快照1d4bf0f时的内容成立,别把这里的行号和字面值套到任何别的仓库上——其它仓库我们一个都没有取证过。 - 你用的是托管服务而不是这份权重。 model card 在
README.md:15-16中立地提到官方有一个名为 Qwen Cloud 的 API 服务,并写明 27B 的托管版本The service is coming soon——服务尚未提供。那条路径下的引用与文档口径不在本文范围内。 - 你的快照更新了。 model card 的内容会随上游更新变动,
README.md:569之后那几行随时可能变。发现和本文说的不一样,以你手上的仓库当前内容为准。 - 你关心的是模型效果。 那不是这篇能回答的。Citation 这段文字与模型的任何行为、任何评测数字都没有关系,别把两件事串起来看。
最后再重复一次这篇的边界:我们只是把 README.md:576 和 README.md:7 这两行摆在一起,指出它们写的型号名不同。到此为止。
延伸阅读
- 从头读起:Qwen3.8-27B 是什么:一个模型仓里有哪些文件、各自负责什么
- 本专题共 35 篇,完整分组目录见专题页
- Qwen3.8-27B 的许可实读:Apache-2.0 标准文本与那行版权
- Qwen3.8-27B 的上下文长度:256K、262144 还是 1M,四处口径
本文依据 Hugging Face 仓库 Qwen/Qwen3.8-27B 的 model card 与随仓配置文件
(config.json、generation_config.json、preprocessor_config.json、chat_template.jinja 等)整理,
核对日 2026-08-16,对应仓库快照 1d4bf0f。
本文内容为 model card 与配置文件口径,我们没有下载权重、没有部署、也没有推理过这个模型,
因此不涉及生成质量、推理速度与显存占用的任何描述;文中所有评测数字均为 model card 自述,我们没有复现。
模型仓库内容随上游更新而变动,请以官方最新说明为准。
许可条款请以官方 LICENSE 原文为准,本文不构成法律意见。