Altworld 开源 Hemmingway-1:27B 写作模型,把「像人写的」做成可测指标
Altworld 开源 Hemmingway-1,一个只做一件事的 27B 模型:替人写日常消息、邮件、难开口的请求。它基于 Qwen3.8-27B 微调,上下文 262144 token,Apache-2.0 可商用,Hugging Face 权重仓约 54.7GB;仓库创建时间 2026-09-20T12:10Z,配套 GitHub 代码仓同日 12:05Z 创建,两个时间戳相差 5 分钟互证。
它把「像人写的」拆成了三件可测的事,并在模型卡里主动声明这三个基准都是自建:CommunicationBench 用 80 条真实请求做盲测、每条答案与另一个模型的答案正反两序比对、裁判由第三方模型担任,官方称在该榜上超过 Fable 5.1、比 GPT-6 Astra 高 50 分;「人写度」比第二名领先 26 分;在「难开口的请求」这一类上,GPT-6 Astra 被判断为人写的比例是 9%,Hemmingway-1 是 72%。第三方基准方面,公开的 EQ-Bench 4 上它排第三,超过 GPT-5.5、Opus 4.7 与 4.8;自建的 StoryBench 与 Kimi K3 持平,比它的基座模型高 504 分。它输在敌意叙事与长篇故事转折这两类,作者也照写了。
真正值得记的是做法而不是分数:一个 27B 的窄任务微调去对标最大的闭源模型,并且把评测口径、盲测顺序、裁判独立性、自建基准的局限一次性写在模型卡里。官方同时坦白这是英文优先的模型,会「错得很自信」,不建议用于医疗、法律、财务决策。
核验记录
HF 模型卡 README 全文直读(27B / 基座 Qwen3.8-27B / 262144 / Apache-2.0 / 自建基准说明与全部数字均取自该页);日期用两处仓库时间戳互证:HF api Altworld/Hemmingway-1 createdAt 2026-09-20T12:10:31Z、GitHub api lukeckprobierts/Hemmingway-1 created_at 2026-09-20T12:05:48Z(R21 降级链第③④层)。官方站 hemmingway.io 直读无任何日期字段。**三个基准为作者自建、无第三方复现,正文已按此措辞**;仓库 24 小时内 76 likes、0 downloads,热度与质量不作互证。配图 HF social-thumbnail,curl 两次均 200 / PNG 1200×648。