标签: LLM
无嘴模型:AI 的 OLTP 时刻

半夜三点,一条告警:复制延迟 187 秒,持续七分钟,生产集群,两个从库都活着。该不该把值班 DBA 叫醒? 这是一个 bit 的问题。 交给今天最聪明的大模型,它会先写三百字——复述指标、分析原因、权衡误报——最后吐一段 JSON:{"page": true}。两秒,几块钱。答案占一个字节,剩下几千个 token 是包装。 复杂事故值得这么想。但每一条工单、每一次路由、每一步工具调用都走这一套,就不对了。大量判断只要一个很短的答案,我们却给它套上了长篇生成的外壳。 9 月 15 日,一家叫 …
半夜三点,一条告警:复制延迟 187 秒,持续七分钟,生产集群,两个从库都活着。该不该把值班 DBA 叫醒? 这是一个 bit 的问题。 交给今天最聪明的大模型,它会先写三百字——复述指标、分析原因、权衡误报——最后吐一段 JSON:{"page": true}。两秒,几块钱。答案占一个字节,剩下几千个 token 是包装。 复杂事故值得这么想。但每一条工单、每一次路由、每一步工具调用都走这一套,就不对了。大量判断只要一个很短的答案,我们却给它套上了长篇生成的外壳。 9 月 15 日,一家叫 …