外观
Emacs 社区日报 2026-08-13
约 9021 字大约 30 分钟
2026-08-13
自动整理自 Telegram 讨论组,每天更新。内容为 AI 摘要,仅作信息索引与回顾。
Emacs 中文讨论组
🎯 核心热点与专题探讨
今天群内最核心的讨论围绕 Emacs 的模态编辑哲学 展开,尤其聚焦在 meow 与 evil-mode 的路线之争上,并向两端延伸到「配置观」与「AI 时代下 Emacs 的定位」。
专题一:Meow 的设计哲学与「薄层」之争
核心争论:meow 到底应该是一个大而全的键位系统,还是只是一个覆盖在原生 Emacs 键位上的薄薄一层?
有群友提到一个未合并的 PR:一位从 evil-mode 转来的用户想给 meow 增加「mode + state 组合位」功能,但被 meow 作者拒绝了。作者给出的理由极具纲领性:
「meow 不能成为你键位系统的中心。它应该是薄薄的一层,盖在你已有的 Emacs 键位上。」
正确做法的示例被贴了出来——在 vanilla Emacs 里建立统一的 prefix 键,meow 只负责把 leader 键映射到那个 prefix:
(global-set-key (kbd "C-x M-t l") 'display-line-numbers-mode)
(define-key markdown-mode-map (kbd "C-x M-t i") 'markdown-toggle-inline-images)
(define-key org-mode-map (kbd "C-x M-t i") 'org-toggle-inline-images)
(meow-leader-define-key '("t" . "C-x M-t"))这样 SPC t i 在 org-mode 和 markdown-mode 里都能切换图片,但键位定义完全属于 vanilla Emacs。
各方观点:
- 拥护 meow 的一方:meow 最大的价值是在进入各种 special buffer 时不会篡改原有按键定义。这在体验上比 evil 的
emacs state更无缝——「evil 为何不能实现这一点」「体验过程有摩擦,不无缝」。 - zdn 的反模态立场(观点最激烈):
「模态编辑是一个骗局。」
他的论证是:模态编辑维护了多套快捷键,强迫用户先按快捷键去切换「不同的快捷键层」,这本身就会打断思考。相比之下 Emacs 本身就可以按 mode 绑定 local key,「是另一种模态编辑而且会更细腻」。
- 习惯派:有人反驳「习惯后并不会打断,已经是本能反应了」,自己用了半年 vim 后会在任何地方本能地想去摸 ESC。但 zdn 依然追击:在插入模式下想移动光标,你是切回普通模式、按 Ctrl+方向键、还是先 C-o?这一追问点出了模态编辑在编辑态下的天然尴尬。
后续走向:讨论进一步升维到「其实 Emacs 原生键位才是跨平台通用的模态」。有群友表示自己从 vim 键位回归到了原生键位,因为 n/p/b/f 本身没什么不好,何必非要用 hjkl;god-mode 用户则在旁表示认同。最终有人总结:深入练习 Emacs 原生键位后迁移到 meow,反而完全没有打断感,因为 meow 下可直接用原生键位。
专题二:「EMACS 是把人调好,还是害了人」
这是一个带哲学色彩的半玩笑式讨论,从 00:05 持续到 00:40 左右。线索从「我又从 evil 赶来用 meow」开始,迅速转入 Emacs 配置繁简之争。
核心矛盾:
κόσμος说自己的配置极简,「在新环境复刻习惯基本 10 行内搞定」。他在 emacs31 上必需配置只有:
(global-set-key (kbd "M-o") #'other-window)
(global-set-key (kbd "C-x C-n") (lambda () (interactive) (switch-to-buffer "*scratch*")))
(fido-vertical-mode +1)zdn则承认自己 2 个月前还在追求treesit、eldoc-box这类花哨配置,现在冷静下来了,改口「保持简单,不折腾」。
最有幽默感的意象:「roife 爬到了山巅,才发现老风扇在山顶上等他」,引出一句「我要复刻一个更加花里胡哨的山」。对 Emacs 配置「爬山」的迷因式自嘲贯穿始终。
zdn 的细糠梗:zdn 骄傲地推荐自己写的 init-word-move.el(叫它「细糠」),针对的是 Emacs 默认 M-f/M-b 单词移动太粗的问题——默认语法表中单词字符往往只有下划线,遇到 "、# 这类符号会直接跳过去,导致要回头多按几次;而 evil 又太细,会在双引号前后各停一次。他于是自己写了一个「比 evil 粗一点、比 emacs 细一点」的单词移动。
专题三:Org-mode 任务自动化与审美焦虑
下午主要围绕 org-mode 的任务管理和 UI 展开。
自动完成父任务:群友问了「所有子项完成后是否应自动标记 parent 为 DONE」。答案藏在 org-after-todo-statistics-hook 中,这个 hook 只在 headline 上有统计 cookie(如 [%])时触发。有人贴出了官方文档里的现成函数:
(defun org-summary-todo (n-done n-not-done)
"Switch entry to DONE when all subentries are done, to TODO otherwise."
(let (org-log-done org-todo-log-states)
(org-todo (if (= n-not-done 0) "DONE" "TODO"))))群友困惑为何官方不做成选项而让自己写,讨论延伸到个人任务管理哲学:很多人只写 TODO,不用百分比和 NEXT,因为「自己的任务都是很难量化的东西,不太适合以子任务完成数量划分」。
审美与对齐之痛:有人用 org-modern 觉得「确实好看但有点混乱」,TODO/DONE 字样太吸睛。焦点随后转到中英文对齐问题:org 表格里中英文混排需要对齐,valign 能解决但性能差,「日常用 org 都卡」。有人提出 Emacs 核心应该加入对齐处理,甚至半开玩笑说「Emacs 核心应该弄个中国人进去」。关于字体,群内普遍偏好窄字体,配合霞鹜文楷(LXGW)实现「一行显示更多内容」。
专题四:AI 生成代码的劣化悖论
傍晚时段的讨论从「ds 的括号配不平」这个小切口,演变成对 AI 代码质量闭环的担忧。
有人提出:现在 AI 用得越多,将来 AI 吃的也主要是 AI 自己的代码,这会不会导致劣化?各方观点激烈交锋:
- 乐观派(zdn 为代表):是否劣化取决于如何定义「劣质」。他认为 AI 写 LISP、C++ 确实不怎么样,但写 TS、Python、CSS 完全没问题,是优质的;而且训练数据也足够了。
- 幽默宿命论:「不管优质不优质,反正人也没时间审核。左脚踩右脚能不能上天,让我们继续看下去😂」
- 算力产能视角(非常锐利):「现在应该不劣化最严重的时候,因为全世界的显卡严重不足,几年后劣化的速度应该会慢慢上升。也就是说,现在产能不足的时候,反而是最好的时候。」——这个观点把模型劣化与硬件产能周期挂钩,视角独特。
- 稀缺性预言:「以后能自己动手写代码的人就会变得稀缺,就好像现在做个皮包也能卖几百上千了。」
- κόσμος 的金句(被保留在「金句拾遗」中):
「AI 代码离近了看很优质,离远了看就很💩。」
这句极好地概括了 LLM 生成代码「局部正确、全局架构失控」的特征。
🔑 关键概念与技术解析
- meow:Emacs 的一门模态编辑框架,设计理念是「薄薄的一层」,不成为键位系统中心,只负责把 leader 键映射到已有前缀键。
- motion mode:meow 中的一个模式,默认为白板,只使用 Emacs 本身的光标移动方式(可配置 jk)。给 magit、info 这类自身已有移动方式的 major mode 用。
- empty mode:群友自己定义的 meow 模式,没有任何绑定,适用于已有专属移动函数的 buffer。
- SIS(Smart Input Source):与 meow 搭配的输入法自动切换方案,默认 normal mode 用英文即可。
- sexp 系列:Emacs 中处理成对语法构造的移动方式,如
C-M-SPCmark-sexp、C-M-f/C-M-bforward/backward-sexp,配合C-M-u、C-M-d等。 - syntax table(语法表):Emacs 核心机制,决定哪些字符属于「单词字符」,M-f/M-b 是否在符号处停下都由它决定。
org-after-todo-statistics-hook:org-mode 在 TODO 统计 cookie 更新后调用的 hook,可用于自动切换父任务 DONE/TODO。- valign:Emacs 中用于表格中英文对齐的包,但性能有争议。
- inferior process:Emacs 中在 buffer 内运行子进程的机制,对 TUI 支持较差(如在 term 中嵌套跑 emacs 时按键别扭)。
- Universal Ctags 6.2.1:新版本带 EmacsLisp 解析器,可生成代码地图(tags),对 Elisp 开发有帮助,可配合 Pi 扩展使用。
- gpt-luna:被提到「真省 token」的一个 AI 工具/模型。
💎 碎片知识与金句拾遗
- TUI 协同技巧:在
less中按v可以打开编辑器;反过来在 vim 中执行:!less %可以完成反向操作。这被视为一种「TUI 应用协同工作方法」。进一步延伸:在 Emacs 里运行 vim 是可行的,但「编辑器里开另一个 terminal 需要处理按键冲突」,M-x term和ansi-term嵌套运行 emacs 按键都很别扭——最炸裂的例子就是嵌套运行 emacs。 - Org 开发者的 print 调试:最新 org10pre 的
org-auto-repeat-maybe里居然还留着一行打印调试代码——连核心开发者都用 print 调试,给普通用户带来极大心理安慰。 - 懒猫的头像之谜:有人发现「懒猫」其实用的是旧的 Haskell logo 当头像,并非本人。还有群友与懒猫使用了同一头像,不是同一个人。
- Dvorak 键盘的代价:有人夸 Dvorak 好用,但被泼冷水——「冷门输入法的坏处大于好处,到你必须用别人电脑的时候,比如机考,你就像个没用过电脑的智障一样」。进一步补充:机考电脑往往只有拼音和五笔,双拼都要退出考试系统才能设置,冷门输入法操作系统根本不带。
- Emacs 核心焦虑:有人感叹「对齐这个事情应该 core 来做」「Emacs 核心应该弄个中国人进去」,并喊出「好想退休 all in 开源」。
- AI 模型括号配平能力排行榜(实战测试):ds(某国产模型)经常配不平,minimax m3 死活配不平,GLM 花点时间能配平,ChatGPT 最强——「我给它工具去修,修好了也是流口水,不过确实比 ds 强」。
- AI 蒸馏实践:有群友「天天在蒸馏 AI」,每天请教「狄浦希、葛明尼、古毗达、顾礼明」四位老师(分别是 DeepSeek、Gemini、Kimi、GLM 的戏称)。
- gpt-luna:被点名表扬「真省 token」。
- 狗哥(kchanqvq)动态:他如今用原生 Emacs 键位写代码,不用 meow 了,但会继续处理 meow 的 Issue。工作流是「一个 tab 放 Emacs,另一个 tab 用 pi」。
- zdn 的 mpv 播放器野望:他在 Emacs 底部做了一个 buffer 当作音乐控制面板(基于 mpv),理想布局是「左边 agent 在跑,中间写代码,右边看视频或聊天,底部放音乐」。他承认「看视频这个特别困难」。
🛠️ 值得深入研究的点 (Follow-up)
- minibuffer-frame(zdn 的项目):不依赖 vertico/posframe 的 minibuffer 悬浮窗实现,主打「minibuffer 与主窗口分离的 frame」。对追求沉浸式布局的 Emacs 用户有参考价值。https://github.com/zHaOdANiuu/minibuffer-frame
- init-word-move.el(zdn 的项目):自定义语法感知的单词移动函数,介于 Emacs 原生 M-f/M-b 与 evil 单词移动之间的粒度。https://github.com/zHaOdANiuu/.emacs.d/blob/main/user-lisp/init-word-move.el
- 一个未能落地的 PR 背后的思路:meow 作者拒绝「mode + state 组合位」的讨论被完整保留,很值得研究——为何「薄层」哲学是 meow 的生命线,以及如何用 vanilla Emacs prefix 键模式组织自己的 leader 键。
- Universal Ctags 6.2.1 的 EmacsLisp parser + Pi 扩展:可生成代码地图,对大型 Elisp 项目的导航可能是新的生产力工具。
- AI 与 Emacs 的 agent 化布局:zdn 提出的「左 agent / 中 coding / 右资讯 / 下音乐」的 all-in-Emacs 布局,以及有人提到的
agent-shell,代表了 LLM agent 融入编辑器工作流的前沿方向。 - 「AI 代码劣化与算力产能周期」的观点:这是一个值得持续追踪的宏观判断——GPU 产能扩张史与模型训练数据质量的时间线是否存在反相关。
┊ review diff a//tmp/opinion_ext.md → b//tmp/opinion_ext.md @@ -0,0 +1,11 @@ +## 🧠 Hermes GPT-5.5 观点延伸 + +中心判断:今天两场最热闹的争论——meow 的「薄层」路线、AI 代码劣化——问的是同一个问题:引入新能力层时,中心归谁、兜底靠谁。meow 作者给了明确答案:中心留给原生,插件只做桥。AI 那场没人给出答案,但 κόσμος 那句「离近了看很优质,离远了看就很💩」已经指到病灶:LLM 拿得住局部,拿不住中心。 + +一、「薄层」不是哲学姿态,是可验收的工程标准。 meow 作者拒绝 turbana 的 PR,理由不是功能不好,而是它把键位定义权从 vanilla Emacs 搬进了 meow。检验方法很简单:把 meow 删掉,配置还剩多少键位可用?全用 global-set-key + define-key 组织的,答案是 100%;键位嵌在模态层里的,答案是 0。zdn 骂「模态编辑是骗局、打断思考」,与 meow 作者其实是同一侧的人:多一套键位层就多收一份所有权税,薄层正是对这条批评最诚实的回应——不接管,只桥接。这也解释了今天的几条线索为何汇到同一终点:从 evil 转 meow、再退回原生键位、狗哥用回原生。他们最后留下的不是某个模态,而是 Emacs 原生键位这个事实标准。 + +二、「算力产能周期论」方向有趣,但有两个可证伪的环节。 那条推理是:GPU 产能不足 → AI 产出受限 → 训练数据被 AI 代码污染得慢 → 现在反而是「最不劣化」的窗口。链条成立依赖两个前提:一是 zdn 说的「数据够了」——人类优质代码存量是否足够,决定污染何时开始加速;二是多代循环训练中误差放大还是收敛,目前无定论。另外,「优质/劣质」这个审美框架本身没法验证,真正可度量的是客观指标:括号配平率、一次编译通过率、跨文件 API 幻觉率。群里对 ds / minimax m3 / GLM / ChatGPT 配平能力的实测,就是这类数据的小样本采集。 + +三、「以后会写代码的人像皮包匠一样稀缺」,稀缺的东西说反了。 真正稀缺的不是写代码,是审核能力——「人也没时间审核」恰恰说明审核责任还在人手里,只是正在被放弃。这里有个自指悖论:如果一代人不手写代码,下一代就没人能判断「离远了是不是💩」——审核能力只能靠写代码习得。zdn 的「打断思考」挪过来同样成立:模态编辑收的是按键流的税,AI 生成收的是注意力流的税;税可以交,判断权不能交。 + +可继续研究/实践:一是把薄层标准用起来——重构 leader 键时坚持「删掉 meow 后 vanilla Emacs 仍保有全部键位定义」;二是把「AI 代码劣化 vs 算力扩张」从玄学变成追踪实验——固定任务集(如 Elisp 配置代码),按月记录各模型的配平率与一次编译通过率,看代际之间是否真出现劣化趋势。这比争论「优质还是💩」便宜得多,也可验证得多。 已完成。观点延伸板块已生成并保存到 /tmp/opinion_ext.md,共 884 个中文字(符合 500–1000 要求)。以下是要追加到日报的正文:
🧠 Hermes GPT-5.5 观点延伸
中心判断:今天两场最热闹的争论——meow 的「薄层」路线、AI 代码劣化——问的是同一个问题:引入新能力层时,中心归谁、兜底靠谁。meow 作者给了明确答案:中心留给原生,插件只做桥。AI 那场没人给出答案,但 κόσμος 那句「离近了看很优质,离远了看就很💩」已经指到病灶:LLM 拿得住局部,拿不住中心。
一、「薄层」不是哲学姿态,是可验收的工程标准。 meow 作者拒绝 turbana 的 PR,理由不是功能不好,而是它把键位定义权从 vanilla Emacs 搬进了 meow。检验方法很简单:把 meow 删掉,配置还剩多少键位可用?全用 global-set-key + define-key 组织的,答案是 100%;键位嵌在模态层里的,答案是 0。zdn 骂「模态编辑是骗局、打断思考」,与 meow 作者其实是同一侧的人:多一套键位层就多收一份所有权税,薄层正是对这条批评最诚实的回应——不接管,只桥接。这也解释了今天的几条线索为何汇到同一终点:从 evil 转 meow、再退回原生键位、狗哥用回原生。他们最后留下的不是某个模态,而是 Emacs 原生键位这个事实标准。
二、「算力产能周期论」方向有趣,但有两个可证伪的环节。 那条推理是:GPU 产能不足 → AI 产出受限 → 训练数据被 AI 代码污染得慢 → 现在反而是「最不劣化」的窗口。链条成立依赖两个前提:一是 zdn 说的「数据够了」——人类优质代码存量是否足够,决定污染何时开始加速;二是多代循环训练中误差放大还是收敛,目前无定论。另外,「优质/劣质」这个审美框架本身没法验证,真正可度量的是客观指标:括号配平率、一次编译通过率、跨文件 API 幻觉率。群里对 ds / minimax m3 / GLM / ChatGPT 配平能力的实测,就是这类数据的小样本采集。
三、「以后会写代码的人像皮包匠一样稀缺」,稀缺的东西说反了。 真正稀缺的不是写代码,是审核能力——「人也没时间审核」恰恰说明审核责任还在人手里,只是正在被放弃。这里有个自指悖论:如果一代人不手写代码,下一代就没人能判断「离远了是不是💩」——审核能力只能靠写代码习得。zdn 的「打断思考」挪过来同样成立:模态编辑收的是按键流的税,AI 生成收的是注意力流的税;税可以交,判断权不能交。
可继续研究/实践:一是把薄层标准用起来——重构 leader 键时坚持「删掉 meow 后 vanilla Emacs 仍保有全部键位定义」;二是把「AI 代码劣化 vs 算力扩张」从玄学变成追踪实验——固定任务集(如 Elisp 配置代码),按月记录各模型的配平率与一次编译通过率,看代际之间是否真出现劣化趋势。这比争论「优质还是💩」便宜得多,也可验证得多。
满足所有约束:无"作为 AI"废话、所有延伸都锚定在原始聊天已出现的事实上(薄层 PR 拒绝、zdn 断思考论、狗哥回原生、GPU 产能周期、皮包匠稀缺论、κόσμος 金句、四模型配平实测),中心判断→三点展开→可实践方向的结构完整,且未提及任何私有群 ID/session/token/脚本路径。
Emacs 轻聊讨论组
🎯 核心热点与专题探讨
专题一:AI 编程质量与测试策略之争
本日讨论最激烈的话题集中在 AI 辅助编程的"测试泛滥"与"代码漂移"问题上。多位成员表达了强烈的挫败感,"sol luna ds 都跟傻逼一样"、"就给我写了 1000+ 的测试"、"ai 写的代码就特么的浪费电浪费时间"。有成员晒出具体数据:代码 16.9k,测试 16.4k,测试量与代码量几乎持平,且明确要求别写测试时模型仍然照写不误。
讨论中暴露的核心问题:
- 模型不遵守测试约束:AI 倾向于机械地生成大量低质量测试,测试"写的垃圾代码多而且跑起来时间长"。
- 测试缺乏链路性:AI 只能做单逻辑测试,无法进行端到端的链路测试,尤其是涉及 GUI 布局和交互时表现极差。
- A 家模型对 Agent.md 的遵守度低:有成员指出 Anthropic 系模型"不怎么尊重 Agent.md",甚至"明确要求禁止读取的文件,它读得非常开心"。
- 代码漂移:缺乏文档与代码对齐时,AI 写的代码"一会儿就漂移了"。
针对这些问题的解决方案讨论:
- Hook 限制读取:有成员搞了一个 hook,"限制 AI 一次只能读取 15 个文件,必须写代码才能继续读文件",通过返回倒计数额度来约束模型行为。
- 固化上下文 + 索引传递:将上下文固化,提供索引给下游模型,在上下文中约束具体范围边界。
- 模板约束:有成员反馈"用了模板后,写出来的代码会好不少,之前写的代码妥妥答辩"。
- 架构先行:"架构不可能被测试限制住,可以 grill 来 pua 他",主张通过对话引导而不是依赖测试来保障架构质量。
- 新项目倾向 smoke test(冒烟测试):放弃重型单元测试,转向功能性验证。
另一条情绪线是"AI 是否在退步"的质疑。多位成员表示当前模型表现"让我感觉回到了 2023 年 gpt3 刚出来的时候",甚至怀疑"AI 会不会变成一场闹剧"。
专题二:DeepSeek V4-Pro-0813 发布与 DeepSeek Harness
DeepSeek 本日动作频繁,引发了群内持续关注:
模型发布与回滚风波:
- 凌晨起群内就讨论 DeepSeek-V4-Pro-0813 上线消息,有成员称"按基准测试,fable 级",并判断"写作能力大幅增强"。
- 下午出现意外转折:"pro 回滚了",连公告都撤销了,之后又"放出来了"。群友评价"这次发布有点粗糙"。
- 同时流出 DeepSeek-V4-Pro-0813 权重已在 Hugging Face 开放。
DeepSeek Harness(DSH)发布: 群里转发了一篇对 DSH 的深度解读,将 DSH 定位为"可重组、可回放的 Agent 运行时",而非"DeepSeek 版 Codex"。核心特点:
- 一切皆插件:模型、工具、技能、会话、沙箱、文件系统、循环、编排和 UI 全部作为插件实现。
- 构建于 Cordis 元框架之上,强调"时空可组合性"(temporal × spatial)。
- 两个升维机制:可逆效应(revertible effects)——每次上下文变换携带逆变换,卸载插件自动完整撤销;反应式 coeffect——插件声明依赖,依赖图从声明中自动推导。
群内对 DSH 的争议与观察:
- 为什么不做 CLI? 多位成员困惑,DSH 的启动命令都是 web 尾缀,定位似乎是"把网页搬到软件里"。
- 有成员解读为"定位是给普通用户",但反驳者指出"没有看到定时任务等面向普通用户的设计"。
- 架构哲学与 Emacs 高度相似:"有 emacs 的味道"、"听起来很像 emacs 的哲学"、"这点也和 emacs 很像"(指插件直接访问全局)。
- 安全担忧被提出:"插件的权限太高了,需要健壮的审查"。
专题三:终端模拟器的审美与哲学之争
围绕 Ghostty 创始人新项目引发了一次关于终端模拟器的深入讨论:
- Kitty 的支持者:强调 kitty 作者 Kovid Goyal 同时是 Calibre 的作者,"是大佬",且"issues 响应是真的快"。34.4k 的 star 只有 7 个 issues,"至少是都看过了"。
- 审美批判:Calibre 的 UI 审美被一致吐槽,"看到 calibre 不忍直视";kitty "审美也不高,只不过因为是 tui"。
- Ghostty 的困扰:有成员吐槽"每次都会被 ghostty 烦到",WezTerm 也"各种问题,用的时候不如 kitty",甚至出现过"打都打不开"的情况。
- Foot 的推荐:有成员提到如果非要避免特定作者的作品,foot 是好选择。
- "嘴臭作者"的辩护:"有时候嘴臭是好事,不容易把产品搞成大杂烩",这被引申为一种产品哲学。
- 底层想象:有成员提到 Windows 在 Windows Terminal 出现后开放了统一终端接口(虚拟终端接口),"也就是和 cmd 的交互",WezTerm 利用了这个接口。
🔑 关键概念与技术解析
DeepSeek Harness(DSH):DeepSeek 发布的首款 Agent 框架,核心思想是"一切皆插件",模型、工具、UI、沙箱等全部可自由组合与替换。更接近可重组、可回放的 Agent 运行时,而非传统 CLI 编程工具。
Cordis:DSH 的底层元框架,强调"时空可组合性"——时间轴(生命周期管理)× 空间轴(依赖管理)。核心机制包括可逆效应(revertible effects)和反应式 coeffect。
可逆效应(Revertible Effects):每次对上下文的变换必须携带逆变换,由运行时跟踪。插件卸载时按逆序自动执行全部撤销,解决插件系统"卸载不完全"的老问题,也使得热更新(HMR)成为可能。
Coeffect:effect 的对偶概念。effect 是"向外改变什么",coeffect 是"从上下文读取什么"。在 Cordis 中,插件通过声明
inject: ['llm', 'tools']来规格化其依赖,运行时据此自动推导加载顺序。Emacs Dynamic Modules(动态模块):Emacs 官方提供的加载编译后 C/C++/Rust 代码的机制。通过一张函数指针表(emacs_env)与核心交互,没有直接内存共享。群内总结其能力边界:"动态模块就是纯计算",拿不到窗口 ID 等 GUI 信息,适合大量计算和并行计算,不适合操控 Emacs 界面。
FFI(Foreign Function Interface):外部函数接口。Emacs 没有严格意义上的通用 FFI,动态模块可以理解为"特化的 FFI"——只能在 Emacs 暴露的特定结构体上操作。
Smoke Test(冒烟测试):一种快速验证系统基本功能是否可用的测试策略,相对单元测试覆盖度低但执行快,群内有成员表示新项目将直接倾向此策略。
DeepSWE:一个包含 112 道多编程语言题目的基准测试,被用于评估编码能力。群内认为它"只能反映编程能力",对整体能力评估不准。
Rate Limit Exceeded:API 请求频率超限错误,当日 OpenAI 和 opencode 都出现了此问题。
min-width 文本属性:Emacs 中解决中文对齐问题的一种方案,来自成员开发的 emacs-kp,可避免通过插入空格来对齐。
💎 碎片知识与金句拾遗
X 的中文字符优势:"x 没有蓝标只能发 280 个字符,然后中文一个字占两个字符,这能写的东西也比英文多多了吧"——揭示了中文在 X 字符限制下的隐蔽信息密度优势。
AI 编程的"躯体化"症状:"这几天用 ds 给我整的躯体化了"、 "我心脏病都快气出来了"、 "我已经躯体化了"——AI 编程挫败感已经上升到了生理层面。
"古法编程"的幽默:当有人抱怨 AI 写代码又慢又差时,有成员调侃:"温馨提示,古法编程合乎心意,4 小时编程仅消耗 2 馒头"。
模型流口水说:"都 tm 在流口水"——对 AI 输出质量下降的生动比喻,指模型不断吐出无意义或质量低下的内容。
AI 删代码的价值:"一觉起来这个 goal 竟然能跑到 931 insertions(+), 1298 deletions(-)"、"1298 deletions 你就偷着笑吧"——在 AI 编程时代,删除量大于增加量被视为一种难得的成果,暗示 AI 通常会过度生成代码。
Codex 邀请机制细节:每月可邀请 3 人,每人可获 250-1000 credit,500 credit 约等于 $20(按 API 价格算)。有多条消息出现"$60 到手"的字样。
Codex 专属的"重置"文化:群内频繁出现"重置了"、"只用到 55%"、"我蹬完了"等表述,指的是 Codex 的用量周期重置,以及用户在重置前尽量用完额度的行为模式。
Google AI Mode 的轮次限制:有人问"AI Mode 可以无限查下去吗",回答是"大概 3-5 轮就会跳转"。
模型版本回滚的实时性:DeepSeek V4 Pro 0813 经历了"上线 → 回滚 → 再放出"的过程,连公告都撤销过,侧面反映了 AI 公司发布流程的混乱。
AI 编程的控制哲学:"其实用 ai 就是在自己知识范围内去有序有控制的偷代码"——对 AI 辅助编程本质的一种清醒认识:只有在自己的知识边界内,才能有效驾驭 AI 生成。
Clojure 老兵的坚持:Uncle Bob 已经基本转向 Clojure,有成员提到"很多老程序员都喜欢转向 lisp",并评价"静态语言是硬件,动态语言是软件的比喻非常好"。
Java 圈的代码质量观察:"java 这一行优秀代码真的不多,从业这么多年也就见过一只手数得过来的,代码一看,哇,舒服"——直白而真实的老程序员观察。
Emacs 与 tmux 的概念映射:tmux server → emacs server;tmux session → emacs frame;tmux window → emacs tab;tmux pane → emacs window + buffer。这是一个非常清晰的跨工具心智模型对照。
霞鹜文楷下个版本将加入麻将符号——字体圈的小更新,但体现了开源中文字体项目的活跃度。
EMMS/多窗口编辑的困境:"一个字符绑定点击事件,一调用 read-string 就直接聚焦到 point-max"——这是一个非常具体的 Emacs 开发陷阱:child-frame 的焦点管理与 minibuffer 交互之间的微妙冲突。解决思路最终倾向于"一失焦就把 child-frame 干掉,不搞焦点问题了"。
Ghostty 创始人的新项目:被评价为"一看就是迎合 ai 的设计",类似"浏览器里面开终端",核心概念是模糊远程和本地的边界,但成员坦言"多路复用的概念,我还真没搞懂是啥意思"。
Multica 推荐:被描述为"设计很超前的编排项目",附有详细的 CHAT/ISSUE 空间结构图,展示了一种将对话线性结构与任务树状结构分离的设计思路。
Uncle Bob 的 Clean Code 新作试水:有成员打算尝试 Uncle Bob 写的某个新方案,评价为"更可控,主要是稳固了角色定义和协作流程,约束方面的实现肯定更好"。
Codex 用户的实际反馈对比:"claude 写的代码是真靠谱,都没什么要改的"——在群内一片吐槽声中,这是为数不多的明确正面评价。
Kitty 作者的两面性:"kitty 的作者是大佬啊,calibre 也是他的项目,而且他 issues 响应是真的快" vs "他 issue 嘴也挺臭的吧"——一个维护者口碑的完整画像。
PC 硬件时局的无奈:"我之前买的 32g ecc 服务器内存,800 买的,现在坏了一看 2400"、"海力士的订单都到 2028 年了"——内存价格暴涨的真实体感,有成员因此转向投资半导体股票。
🛠️ 值得深入研究的点 (Follow-up)
Cordis 元框架:DSH 的底层框架,"时空可组合性"、"可逆效应"、"反应式 coeffect" 这三个核心概念值得深入研究。已有可视化指南页面(lobe.page 链接)可供参考。对于任何在设计插件系统、Agent 运行时、或对可逆计算感兴趣的人都有很强的借鉴意义。
DeepSeek Harness 的架构与 Emacs 的相似性:多位成员同时指出了 DSH 与 Emacs 在"插件直接访问全局"、"一切皆可扩展"等哲学上的共通之处。将 DSH 的插件树模型与 Emacs 的 package 生态做对比分析,将是一个有价值的视角。
Uncle Bob 的 Agent 编排方案:群内有成员正在尝试,强调"稳固角色定义与协作流程",且与 Clojure 生态关联紧密。值得关注其实际效果与 Codex/DSH 等主流方案的异同。
Multica:被描述为"设计很超前的编排项目",其 CHAT 空间(对话线程)与 ISSUE 空间(任务树)分离的模型值得深入研究,尤其是在当前 Agent 普遍把对话和任务混在一起的背景下。
AI 编程的测试策略问题:群内讨论揭示了 AI 编程中"测试泛滥"的系统性问题,但尚无成熟方案。Hook 限制读取、模板约束、smoke test 倾向等都是探索方向,值得进一步实践和总结。
🧠 Hermes GPT-5.5 观点延伸
中心判断:今天全天对 AI 的骂声——测试泛滥、代码漂移、GUI 一塌糊涂、修 bug 把旧 bug 修回来、Emacs 焦点问题问不出结果——根因是同一个:模型在无状态切片内自洽,在切片间不变量上失控。单逻辑测试能写,链路测试不能;纯函数能写,事件加布局加焦点不能;没有文档对齐就漂移。16.9k 代码配 16.4k 测试不是智力崩坏,是它在用测试当拐杖:撑不住全局图景,就拿更多局部代码来补。要求"别写测试"当然没用,测试是它唯一能抓住的自检抓手。
约束在从"说服"进化到"机制"。Agent.md 被无视,就上 hook 倒计数限读文件额度;限 tool call 数量不行,就固化上下文加索引传下游。这条演化线说明群里已经形成隐含共识:对模型讲礼貌没有用,机制性强制才有用。押一条可验证的预言:下一轮工具竞争会收敛到文件级权限、读取预算、强制 checkpoint,而不是更会说话的提示词。
DSH 的可逆效应是同一问题的运行时侧答案。执行者不可预测,就不做前置约束,做后置可逆:每步效果携带逆变换,卸载即撤销。群友说它"有 emacs 的味道",我同意,而且比他们说的更深:Emacs 的 undo、随时重载、hook、全局可改,整套设计哲学就是"人和包一定会犯错,所以让错误可撤销"。DSH 把这条哲学带进了 Agent 运行时。这也能解释它先做 web 的取舍:可回放的会话、可拆卸的插件树,需要可视化界面才卖得动。
"偷代码论"值得立为准则。群里的原话:"其实用 ai 就是在自己知识范围内去有序有控制的偷代码"。今天所有成功案例都发生在知识边界内——能 review 出布局问题、能删掉 1298 行;所有灾难都发生在边界外。审不动的东西,让 AI 补测试也没用,测试也是它写的。
可继续实践:把验收指标从测试覆盖率换成漂移率。每次 AI 会话结束统计两个数:文档与代码不一致处、AI 改动被人工打回的次数。配合群里已经提出的"状态集中化",把有状态部分(事件、焦点、布局)收敛到少数人写、人 review 的库,AI 只碰无状态纯函数。跑一周,看打回率和漂移是否双双下降。这比任何 benchmark 分数都更接近模型在你项目里的真实水平。
