来源: cloud.google.com
32
餐厅电话一响,漏接可能意味着订单流失;医疗机构接到预约电话时,任何一个字段错误都可能影响后续服务。Voicify 的实践说明,企业级语音助手并不只是把大语言模型接到电话系统上,而是要同时解决交易准确性、流量尖峰、响应延迟以及安全合规问题。 Voicify 成立于 2018 年,最初希望为电话、聊天等渠道构建实用的语音驱动助手。疫情期间,团队将重点转向餐...
来源: istio.io
15
Istio 的镜像仓库迁移方案发生了重要变化:原计划作为长期统一入口的 将与 一样,在 2026 年末停止服务。Istio 镜像仍会发布到 ,项目也计划增加更多镜像站点。对集群管理员来说,真正要做的不是记住又一个仓库地址,而是尽快找出旧引用、修改安装配置,并为镜像拉取增加一层可控的缓存。 原本被设计成一个由 Cloudflare Worker 提供的 ...
来源: aws.amazon.com
31
数字医疗公司面临一个很现实的扩展难题:会员数量增长后,如何继续提供有上下文、有温度的个性化互动,同时不让照护团队被重复沟通压垮。专注于物质使用障碍支持的 Pelago,使用 AWS 构建了 AI 助手,并在两周内将概念推进到实际照护场景。这个案例值得关注的地方,不只是模型能力,而是团队如何用无服务器架构缩短交付路径,并把风险控制嵌入工作流。 医疗 AI...
来源: aws.amazon.com
28
AI 编程工具已经不只是编辑器里的补全插件。monday.com 将运行在 Amazon Bedrock 上的智能体称为“AI Teammates”,并把它们接入真实的软件交付流程。根据其内部生产数据,每月使用 AI 编程工具的 Builder 已从一年前约一半增长到九成,单个工程师的 PR 吞吐量提升超过 50%。更值得关注的不是工具覆盖率,而是团队...
来源: aws.amazon.com
34
CloudFormation 自定义资源可以补上原生资源类型的能力缺口,但它也会把 Lambda、外部 API、状态管理和失败重试带进部署链路。到了多区域场景,如果所有堆栈依赖同一个区域中的处理函数,一次区域故障就可能同时阻塞多个区域的发布。更稳妥的做法是让每个区域拥有独立的自定义资源提供者,并把幂等性、失败隔离和回滚语义设计进处理逻辑。 普通 Clo...
来源: cloud.google.com
29
数据平台上线只是开始。进入“Day 2”之后,补丁、升级、容量规划、依赖冲突和故障响应会持续消耗团队精力。Checkout.com 将自托管 Apache Airflow 迁移到 Google Cloud 的 Managed Service for Apache Airflow(Gen 3,Cloud Composer 3)后,把编排器维护转交给托管平...
来源: aws.amazon.com
34
西门子 2024 年报告估算,计划外停机每年给《财富》500 强企业造成约 1.4 万亿美元损失。工业现场真正棘手的地方,不只是设备发生故障,还包括网络不稳定、专家无法及时到场,以及运维人员难以快速定位问题。生成式 AI 可以把手册检索、告警解释和排障建议带到现场,但前提是应用不能把公网和云端模型当作唯一依赖。 离线优先不是简单地在边缘设备上运行一个模...
来源: aws.amazon.com
28
金融、保险、医疗和政务系统处理的敏感数据,往往不止姓名、地址和社会保障号码。保单号、会员 ID、病历号等行业标识同样可能指向具体个人,却未必能被通用规则准确识别。Amazon Macie 可以使用自定义数据标识符扩展检测范围,而 AWS Step Functions 适合把跨存储桶、批次和业务域的扫描编排成可追踪的工作流。 Macie 自定义数据标识符...
来源: cloud.google.com
39
科学计算正在同时遭遇三种规模压力:聚变等复杂系统难以完整模拟,新材料候选空间大到无法穷举,大型实验设施每天又会产生海量数据。Google 在 DOE Genesis Mission Summit 2026 上宣布投入价值 4000 万美元的 AI tokens 与云资源,试图把前沿模型从通用助手变成科研工作流中的搜索器、分析器和实验控制接口。 这项投入...
来源: infoq.com
34
一次账单计算系统的配置变更,让部分 AWS 客户连续超过 24 小时看到数十亿乃至数万亿美元的预估费用。更值得工程团队警惕的不是数字有多夸张,而是 AWS 内部告警已经发现异常,却既没有停止账单生成,也没有通知值班工程师。最终,客户升级反馈在 4.5 小时后才真正推动处置。 这起事件说明:监控检测到异常,只完成了可靠性工作的前半段。告警必须连接到明确的...