TwKit

推文

@vintcessun · 2026-10-10 23:20

最反直觉的地方是,推理时不急着选定一个 token,反而可能更快找到答案 https://arxiv.org/abs/2610.09416 Flow Language Models 在去噪过程中保留连续表示,让多个候选的信息继续参与后续推理,最后才解码成 token。迷宫和数独实验中,少步数下准确率高于离散扩散基线;Maze15 达到 95% 准确率时,参数量还少 36.5%。但目前证据限于结构化任务,能否延伸到自然语言推理仍未知。

曝光 75 · 评论 1 · 点赞 1 · 书签 0

TwKit
正在载入