作者关注的是 Qwen3.5 小模型每月在 Hugging Face 上有 288 万次下载,但自己在实际使用较早的 Qwen3 0.6B 做深度研究工作流时,发现很难真正完成任务,因此想了解社区到底把这类小模型用在什么场景中。帖子中提到的主要问题包括:模型对概念的理解停留在较浅层,语义理解较弱,容易对主题或任务产生混淆;要求输出 JSON 时经常格式损坏,作者不得不额外加一层检查机制,耗费了大量时间;响应速度也偏慢,虽然这受多种因素影响且可能优化,但在多数情况下仍明显影响使用体验。作者没有否定下载量本身,而是围绕这些限制提出疑问:在能力、结构化输出和速度都存在明显短板时,社区为何仍大量下载并如何使用这些小模型。据Reddit报道。
来源:Reddit(r/MachineLearning)
原始发布时间:2026-05-12 01:19