文字内容创作的形式 - No.20

本期封面来自在线作品集 cy92.org
玄光专栏 · No.20 · 2026-09-12 这是一份专注加速数字化生产力,覆盖知识管理、动态视觉设计、前端开发领域的电子专栏,发布频率目前为每月 2 期,每期精选一个主题展开思考。 如果你觉得周刊内容还不错,想获得更完善的阅读体验,更推荐使用浏览器来到官网 (https://cgartlab.com) 阅读。

最近发生

更新了我的网页版作品集

我始终认为设计师应该有一个自己设计的在线作品集,每次做自我介绍,谈生意,给别人发一个链接而不是几十页 PDF,在我看来没有比这更酷的方式了。

链接是 cy92.org,上面先放了比较早期的作品,功能稳定后再慢慢加新的进去。这套页面当然是用自己做的 Men Agent(一个 AI 编程助手团队)搭出来的,正好也检验了一下这个工具效果如何。欢迎来玩,也欢迎合作。

Argus 0.5.1 更新

Argus(我自己开发的一个专门检查网页设计质量的 AI 工具)也有自己的 公开主页 了,完全开源免费,用来帮我 24 小时不间断给网站找茬儿。

这版主要是稳定性和使用体验上的改进:

  • 免费模型清单现在直接从 OpenCode Zen(一个提供免费 AI 模型的平台)的公开接口拉取,不用再在电脑上装额外的命令行小工具,省事了不少;
  • 每次运行会自动挑选主力 AI 模型:之前用的还能用就继续用,不能用了就按评分自动换一个,不用再手动改配置;
  • 身份验证失败(比如密钥过期)时会立刻停下来,不再傻乎乎地把备用模型挨个试一遍,还会直接输出修复指引,让我看到后只要照做就行。

Men Agent 0.5.0 更新

Men Agent 这次把 Argus 的设计评审直接接进了 PR(代码提交合并流程):提交代码后自动检查一遍界面设计,按严重程度从 P0(最严重)到 P3 分级报告配色、间距、无障碍这类问题,相当于提交代码时自动有一位「设计顾问」在旁边把关。

AI 模型的配置也收拢成了全局统一管理(一个 men.jsonc 配置文件):想整体换一套预设,或者单独给某个 Agent 指定模型,都在这一个文件里搞定。新用户安装时会一步步引导完成模型配置,不用再翻文档猜。


深入聊聊:文字内容创作的形式

起因是豆包输入法最近终于放出来了电脑版。

最开始安利给爸妈用,他们几乎再也不需要用手打字了,准确率奇高。

我用着最畅快的场景就是给 AI 下命令,无论表达得多么糟糕,只要吐字清晰,它都能清晰理解你的意图,放开说就行了。

这让我隐约意识到,这种「用 AI 语音转文字」的过程转变,可能会永远改变我的文字创作方式。

回头看自己这些年的写作,无非三种形式:纸笔、键盘、语音。它们并不是一代替代一代的关系,是各管一段——分别适合记录什么、输出什么、在什么场景用,差别很大。

拿起笔更容易想清楚

纸笔写字时,身体参与得最多:笔尖和纸面的摩擦、笔划过的声音、手腕的动作、写下来的字迹本身。文字和身体动作是绑在一起的,这种感官多维度反馈永远不可替代。

代价是慢,但慢不一定亏——慢下来,人更容易进入专注当下的状态,脑子里的杂念会一点点飘散。同时,新的想法也更容易进来。

我自己的体会是,思路一团乱麻的时候,纸笔是最好用的「理线器」:列个清单、画个导图,如果实在乱得不行就想到什么写什么,不超过十分钟就进入状态了。

网上有个讨论「为什么用纸笔分析比纯用脑子想更有效」的问答,把道理讲得很透:脑子转得太快,信息一下子就发散跑偏了;写下来,等于把思考从脑子里「搬」到纸上,眼睛看着哪里,注意力就在哪里(🔗 为什么利用纸笔分析问题要比纯脑子分析要有效的多?)。

纸笔真正擅长的是孵化和整理想法,而不是输出成品。想法还没成型之前,让它在纸面上慢慢长——白纸就是个「暂存区」,想到什么先倒上去再说,比硬塞进键盘、敲成一段「像样的话」要自然得多。

键盘码字是成熟想法的主力输出

换成键盘之后,身体能感受到的反馈变少了:没有纸笔的触感,声音变成散落的敲击,动作也只剩下手指的起落。

但换来的是效率——打字比手写快得多,改起来更是方便,复制粘贴、随时重排,这些都是纸笔没法比的。

键盘码字适合已经有相对成熟想法的阶段,如果用笔写是在做选择题,键盘码字就像是在做填空题。

敲键盘要求你先想清楚再动手,思路模糊的时候,对着屏幕往往一个字都憋不出来;反过来,一旦进入创作状态,键盘就是最顺手的输出工具。

语音输入是收集想法的天花板

语音输入是三种形式里身体反馈最少的——你甚至看不到自己「写了什么」。但它输出速度无疑是最快的,没有之一。

手写和打字都要求先思考、再输出,想和写之间隔着一道闸门;说话则把这道闸门拆掉了,想到哪说到哪,思考的过程直接搬了一部分到输出里。

好处是快,坏处也是快:因为没经过「想清楚再落笔」,脑内反而更难留下沉淀,事后想找回来也麻烦。口述写出来的东西,为什么和键盘写的不一样?因为口述时思维和语言的「同步率」极高,想到哪说到哪,但口语的信息密度很低,说的时候觉得自己逻辑很清楚,过几个小时回头看反而看不懂自己说了什么,回看时「是在和脑子对齐暗号」。

所以我现在的用法很明确:语音只用来做两件事——纯粹的快速记录(买菜清单、临时灵感,谁还专门去打字),以及口述成文。后者是我最近最想推荐给你试试的方法。

口述 + AI 整理,才能把话变成文

用 AI 把口述整理成文,听起来美好,可是容易翻车。

其实这套做法网文圈早就有人在用了——有作者分享过自己的流程:先写 200 字左右的底稿定好章节走向,再口述整章「就像在说书」,半小时口述转出的文字,改完大约能到 6000-8000 字。跑下来的经验是,三个阶段各做对一件事:

口述阶段:彻底放弃审查。

别一边说一边想着「这句话要不要」,故意多说细节、说感受,甚至允许自己跑题。想想看,你聊天的时候,会一边说一边纠结这句该不该说吗?反正我不会。语音转文字本来就会损失一部分信息,说少了,损失完就什么都不剩了;说多了,反而能兜住。

整理阶段:严格合并,不创作。

让 AI 合并相近的内容,但不要大规模重写,更不能凭空补「虚构」的新内容。保留「我」的第一人称视角和具体细节,把口语还原成书面语就行;如果上下文合适,口语的节奏感也可以适当保留。引用到第三方真实案例时,务必逐条核实——AI 整理出来的内容,可信度需要你亲自把关。

定稿阶段:冷却后再读一遍。

最后做深度加工和全面润色,在发布之前留出几个小时的冷却期,再换回读者的视角从头读一遍。很多「写的时候觉得挺好」的地方,冷却之后一眼就能看出来。我学画画的时候老师教过,画不下去了,或者画完了,把画放远一点,或者干脆不理它去别处转转,过一段时间再来看,基本都会有新的发现。放在写作,我给自己定的原则是,尽量改成缺少一个字就会影响含义的状态,再发出去。

这套流程我自己跑了一阵,最大的感受是:它把「说」和「写」彻底拆开了——这正是写作方法论里的「写编分离」,写和编本来就是两件可以分开做的事,台湾开发者 xdite 在开源书 《打造超人大脑》 里把这套讲得很透。平时只习惯键盘写东西的人,多少都有点写作焦虑——盯着空白文档发呆。口述先把内容倒出来,AI 再帮你整理,至少,不用再面对一张白纸。

说到底,纸笔、键盘、语音,没有谁比谁高级。想法还没成型,用笔写;想法成熟了,用键盘;没想清楚,先开口说。重要的是记录和表达自己的思想、感受、观点,这是一笔非常值得积攒的财富。


推荐好物

Pi Coding Agent

🔗 https://pi.dev/

类似 OpenCode 的一款开源 Harness 开发底座,极致简洁高效(快,还节约 Token)。适合想自己搭一套固定工作流、但不想把工具链搞复杂的朋友。它本身不追求一上来什么都有,更像毛坯房,能够十分灵活地按照自己的意愿装修。

另外值得一提的是,@agegr/pi-web 和 @rainmanhhh/pi-web 作为 Pi 的第三方网页端,整体体验我用下来要比 OpenCode web 好得多。其中体验最舒服的是,它把藏在菜单中的模块用一个页面就搞定了,在这个页面里可以做到:

  • 批量设置模型详细参数、思考级别、插件和技能
  • 一个页面内搞定项目切换、会话管理、文件浏览和编辑
  • 自定义预设提示词,不用每次开新会话都重新贴一遍

MOSH

🔗 https://moshpro.app/

可以给图片、视频直接叠加 N 种动态效果的网站,支持输出视频和 GIF,用来制作动态头像和一些动图素材非常方便好用。


配饭视频

如何在AI时代写作,哈佛教授解析写作之道——史蒂芬・平克【中英字幕/中文配音】

这位大师讲写作,是从收集什么素材、怎么组织内容、怎么让别人听懂切入。和这期说的「口述 + AI 整理」很像:话先倒出来,再整理成文,最后决定哪些句子必须留下。

【影视飓风】Tim是如何写稿子的?如何构建视频的节奏感

Tim 讲视频内容创作者怎么写稿,如何让内容一段一段往前走。这个经验放到文章也成立:一般读者更多时候不必知道作者的思路,只需要顺着文字流动,而创作者是很有必要反过来思考的。


下期预告

下期聊聊 AI 没有明显提升效率的几个因素,看看你有没有遇到。GPT 都出到 6 了,为什么并没有变得更轻松?出到 16 会好点吗?


相关阅读:

本专栏首发于🔗cgartlab.com | 📮 来信/合作: hello@cgartlab.com
添加评论
点赞收藏
点踩分享查看原文
评论
?
参与讨论