企业 AI 最危险的故障,不一定是模型给出了错误答案,而是系统做出了一个重要决定,却没人能在事后解释它是如何发生的。模型可能检索正确、推理合理、选择了正确动作,但外围系统仍会因为超时、重启、重复投递或状态记录丢失而产生错误结果。 这意味着,AI 可靠性不能只靠更强的模型解决。只要 AI 开始修改业务数据、调用外部 API、发送消息或触发审批,它就进入了...
参加大会 CFP(Call for Papers)评审之后,最容易留下的印象不是某个单独的演讲,而是整个选择过程有多像一次复杂的查询:输入是407份提案和228位演讲者,输出却必须满足主题覆盖、内容质量、公司代表性、性别平衡以及时间安排等多个约束。 这是一份基于公开信息和汇总统计的个人复盘。它不讨论具体提案、评分、委员会意见或私人交流,而是关注评审者如...
Jeff Dean 在 Google 工作了 27 年,最终宣布离开。这条消息之所以引发广泛关注,不只是因为一位知名科学家更换了公司,而是因为 Jeff Dean 几乎参与定义了现代互联网基础设施与大规模机器学习的发展路径。 Google 员工编号 20、MapReduce 作者之一、Bigtable 作者之一、TensorFlow 作者之一、Gemi...
当一次技术讨论同时出现 RabbitMQ、Valkey、Apache Geode/GemFire 和 Spring Cloud Data Flow,真正值得关注的并不是工具清单,而是数据在系统中如何流动:消息怎样解耦服务,热点数据放在哪里,分布式状态由谁维护,数据管道又如何部署和观察。由于现有摘要没有给出演讲中的具体结论,下面不把产品选择包装成原访谈观...