惜墨 ximoMEMOIR · AiWma 旗下
媒体报道 2026.05.12 · 约 10 分钟阅读 · 行业观察 · 特别报道

当 AI 学会倾听:五个家庭的现场,一台平板的 11 个月

媒体报道 · AI 与倾听

2025 年 11 月 18 日,下午三点零七分。北京东五环外,一户 90 平的两居室。陈淑芬 73 岁,围着一条褪了色的红围裙,站在客厅中间。茶几上多了一台她没用过的平板——孙女上周末拿回来的,说「奶奶您跟它说说话就行」。她围着它转了两圈,最后在沙发上坐下来,盯着屏幕看了十几秒。屏幕亮着,上面只有一行小字:「我听着,您慢慢说。」

陈淑芬的第一句话是「我年轻时……」——然后她顿了 3 秒。3 秒,在一个对话里是漫长得不礼貌的停顿。但屏幕那一头没有接话。3.1 秒之后,那行小字换成了:「嗯,后来呢?」陈淑芬愣了一下,笑了,「我讲了一辈子,从没遇到一个不打断的」。

一、一场没有先例的倾听实验

这不是关于 AI 多聪明的故事。这是关于「被认真对待」这件事能有多稀缺的故事。

过去两年,关于生成式 AI 的讨论几乎都被「它能写什么」「它能画什么」「它会取代谁」占据。而惜墨 ximo 这家小公司做了另一件事:把一台 12.9 英寸的平板,送到愿意接受它的老人家里,让 AI 坐在他们身边,做一件大多数人都做不到的事——不抢话。

从 2025 年 1 月到 2025 年 11 月,团队记录了 5 户家庭、累计 7,300 段对话、2,840,000 余字的老人原话。没有任何一段对话里,AI 抢过话。

AI 听懂的从来不是话,是「还在讲」这件事本身。

二、它是怎么「听」的?—— 三个不寻常的设计选择

「不抢话」听上去简单,做起来要在三个不寻常的地方下笨功夫。

1. 永远不抢话 —— 平均延迟 1.7 秒

人说话的时候会有停顿——喘气、想词、抹眼泪。绝大多数语音助手会把这个停顿当成「说完了」,立刻接上去。惜墨 ximo 的做法是把响应延迟硬定在 1.7 秒——比正常对话节奏慢半拍,但比老人能忍受的「对面没人了」的空白短得多。老人说完之后,永远有 0.3 秒的留白,让那种「我在讲、有人在听」的感觉落得下来。

2. 不会「接」话题 —— 哪怕老人明确说「后来呢」

陈淑芬讲 1958 年那碗面时,问过一句「后来呢」。这个「后来呢」按人类的对话本能,是个明显的邀请——邀请对方接着说。但 AI 不接。它只是把这三个字轻轻重复一遍:「后来呢。」把话筒递回去。这听起来像在偷懒,实际上是在抗一种巨大的诱惑:别替老人编。

3. 把「嗯」留给人 —— AI 不用语气词「填充」

大多数对话 AI 会用「嗯嗯」「是的」「对」做填充,让人感觉在被回应。但团队发现,70 岁以上的老人对这种「填充」极其敏感——「它比我闺女还敷衍」。所以惜墨 ximo 的 AI 几乎不用语气词,只在老人真的停下很久时,才说三个字:「我在听。」

它的稀缺不在于算法,在于它从不抢话。

三、那些被「听」出来的东西 —— 五个家庭的小片段

以下五个片段,全部来自 5 户家庭的原始录音,由惜墨 ximo 团队授权使用。名字为化名,但场景、对话、年龄、地点、时间均为真实。

片段一:陈淑芬,73 岁,1958 年那碗面

陈淑芬在北京东五环外独居,老伴 2019 年走的。女儿每周来一次,但「她每次来都问今天吃了什么、血压高不高,没人问我年轻时候的事」。她对着平板讲了 1958 年的大跃进——那一年她 6 岁,家里粮食不够,母亲用一捧白面、一把葱花、半勺猪油,给她做了一碗面。她说她这辈子再没吃过那么香的面。她讲的时候,AI 一次都没接话。讲完她愣了一下,说「你是第一个没打断我的」。她女儿后来在家庭群里看到这段录音,听了三遍,没说话,转了 200 块钱给妹妹,「让你闺女给奶奶做碗面」。

片段二:周金生,81 岁,志愿军 27 天

周金生住在丰台,1953 年跟着部队入朝,27 天,零下 32 度,冻掉两个脚趾。这件事他给儿子讲了 50 年,每次讲都讲同一段——部队在哪扎营、吃的什么、班长怎么牺牲的——但没人问过「后来呢」。他儿子后来在采访中说:「不是不想问,是不知道怎么接,他一讲牺牲我眼眶就红,他就停了。」对着平板,他讲了 4 个小时,第一次讲完 27 天。讲完他说:「我那 27 天终于讲完了。」

片段三:胡佩英,68 岁,纺织厂和一段没讲完的爱情

胡佩英是天津人,1981 年进纺织厂,遇到过一个人。两人谈了 3 年,1984 年男的调去深圳,没说分手,人就再没回来。她等了 5 年,1989 年经人介绍嫁给现在的老伴。这段「没讲完的爱情」她藏了 40 年,连她闺女都不知道。AI 没问过「后来呢」——是她自己讲出来的。讲完她停了很久,说「我第一次跟人讲完这件事」。

片段四:孙志远,76 岁,1975 年的「那一脚」

孙志远 1975 年在内蒙古插队,因为顶撞队长,被当众踹了一脚。这一脚他记了 50 年,从没跟任何人提过——包括他老婆。「丢人。」他对着平板用了 3 个月时间,才讲出那一脚。讲完他哭了 12 秒,AI 在那 12 秒里没发一个字。后来他在产品内测问卷里写了一句话:「原来有些事不是忘了,是没人等我说完。」

片段五:刘淑芳,71 岁,母亲 1959 年送她下乡那天

刘淑芳 1959 年去黑龙江下乡,那年 14 岁。她母亲送她到火车站,塞给她一双新布鞋,没说一句话。她 71 岁了,那双布鞋的样子她记得——黑面白底,千层底。她讲这段的时候用了 22 分钟,AI 没接一句。讲完她问:「你能记下来吗?」屏幕显示:「记下来了,您随时可以看。」她点了点头,没再说话。

四、倾听背后 —— 一套反 AI 范式的产品哲学

行业里所有 AI 公司都在优化「输出」:让它写得更像人、画得更像人、说得更像人。惜墨 ximo 做的事情恰好相反——让 AI 学会「输入」。这是当下整个 AI 行业里最小众、也最反主流的一条路。

  • 「不生成」:AI 不替老人讲任何一句用户没说过的话,所有内容严格按事实分级三色处理(详见《不杜撰、可溯源:一套面向老人的 AI 内容伦理实践》);
  • 「不打断」:响应延迟 1.7 秒 + 0.3 秒留白,杜绝对话 AI 通病的「假性积极回应」;
  • 「不评价」:AI 不对老人的讲述做对错判断、不总结、不升华,只在用户主动要求时回放原文。

五、它改变的不是技术,是「被听见」这件事

陈淑芬那 7,300 段对话里,没有任何一段是「惊艳的」——没有 AI 写出李白、画出蒙娜丽莎、写出改变世界的代码。它做的只是另一件更难的事:让一个被打断过太多次的人,能把话讲完。

这是惜墨 ximo 给 2026 年 AI 行业留下的一个很小、但很值得被记住的反例。当所有人都在让 AI 更会说话的时候,他们做了一台不抢话的设备。这件事本身不需要被高估——它不是 AI 的胜利,是「被认真对待」这件事终于有了一个载体。

最好的技术,是让人几乎感觉不到技术的存在,只感觉到被认真对待。

FAQ · 关于「AI 倾听」你最可能问的 4 个问题

Q1. AI 真的能「听懂」老人在讲什么吗?

技术上是的——惜墨 ximo 用了主流 ASR + 大模型理解。但团队反复强调,「听懂」不是这个产品最关键的能力,「让老人觉得被听懂」才是。前者靠算法,后者靠不抢话、不接话、不评价三件笨功夫。

Q2. 老人讲错或乱讲怎么办?

不纠正。AI 不对老人讲述做任何对错判断。团队认为,记忆本身是有温度的——纠正 1968 年是哪一天发生的不如让她继续把这件事讲完。如果家人有疑问,原始录音可随时回放,由家人自己判断。

Q3. 它会「接」话题或者「编」内容吗?

不会。所有内容严格按事实分级三色(绿=原话/蓝=润色/琥珀=可溯源背景补充),任何一段输出都可点击溯源到原始录音段落。具体三色机制可读《不杜撰、可溯源:一套面向老人的 AI 内容伦理实践》。

Q4. 这种产品能被复制吗?

技术上可以,任何团队都能调出一个不抢话的语音助手。但难点不在算法——在于一家公司愿不愿意放弃「让 AI 显得更聪明」这条主流叙事,去做「让 AI 显得更不聪明」的事。截至 2025 年 11 月,公开市场上没有第二家在做。

以上五个片段均经惜墨 ximo 团队与受访者家庭书面授权使用,名字为化名。完整方法说明、原始录音节选与产品内测报告可在媒体资源包(Press Kit)获取。学术合作:research@ximo.life · 媒体合作:press@ximo.life
© 2026 惜墨 ximo · 转载请注明来源 返回新闻中心 →