试用 Muse Spark 1.3:小项目都不推荐

总体而言,我用它做了一个小型的 Web 应用,主题是团队组织。以 Codex 作为框架。结果却烂得一塌糊涂。这个模型在基准测试上表现夸张,但在需要自主执行的工作流中却力不从心,总是忘掉我交代的事情。

缓存机制也很差——请注意,那还只是单轮对话、单一上下文的情况。除了“健忘”之外,输出质量还算凑合,但需要大量人工干预,这让我很不满意;而且我们已经有 DeepSeek-Flash 和 GPT‑5.6‑Luna 这样更好的替代方案。

相比 DeepSeek,它的 token 利用率似乎相当高效,这或许也是它漏掉那么多信息的原因。看来该试试 GLM‑Flash 了。对了,我之所以发出来,是因为关于 Spark 的评测并不多,尤其是来自精打细算的 DeepSeek 用户群体;这也是我试用它的原因(不过还是操扎克伯格,我的 40 美分算是白扔了)。

添加评论
点赞收藏
点踩分享查看原文
评论
?
参与讨论