标签

AI

Shopify 用 AI 重写原生 App:从 React Native 回到 Swift 与 Kotlin意味着什么

来源: oschina.net 37
Shopify 正在把旗下移动应用从 React Native 迁移回 Swift 和 Kotlin。首个完成迁移的 Shop App 借助 AI,在 12 周内从概念验证推进到发布;更复杂的旗舰 Shopify App 也已进入迁移阶段。后者包含 300 多个屏幕,以及主屏幕和锁屏小组件、Apple Watch、Siri 捷径等平台能力,计划在年内发...

PostgreSQL 的 max_connections:别把连接上限当成吞吐量旋钮

来源: postgr.es 30
看起来像一个容量参数,很容易让人产生这样的直觉:把它从 100 调到 500,数据库就能同时处理五倍请求。实际情况恰恰不同。它更接近一份内存预算和一道熔断器,决定数据库最多接纳多少客户端连接,却不能增加 CPU 核心、存储 IOPS 或内存带宽。 真正需要回答的问题不是“能连多少”,而是“多少连接可以同时做有效工作,以及连接积压时应该在哪里排队”。 每...

NocoBase 一周更新解读:如何在 main、next 与 develop 之间选择

来源: oschina.net 38
NocoBase 本周的更新重点仍然围绕产品优化与缺陷修复展开。对正在评估或持续使用这款开源 AI 无代码平台的团队来说,真正需要关注的不只是“有哪些更新”,还包括应该跟踪哪个代码分支,以及如何在体验新功能和控制升级风险之间取得平衡。 NocoBase 当前维护 、 和 三个分支,它们对应不同的稳定性与参与方式: :目前最稳定的版本,适合生产环境和常规...

你的 AI Agent 可以自己关掉数据库的“熔断开关”

来源: postgr.es 34
给 AI Agent 配一个专用 PostgreSQL 角色时,很多团队会执行两条熟悉的加固命令:限制单条语句的执行时间,并让事务默认只读。 从管理员视角看,角色配置已经被限制:查询最多运行两秒,事务默认不能写入。但这份安全感有一个关键前提:客户端不能在连接建立时覆盖这些参数。 写入的是会话启动时的默认值,不是数据库层面的强制约束。连接创建后,会话本身...

用前缀感知路由降低 Amazon SageMaker 大模型推理延迟

来源: aws.amazon.com 42
在大模型在线推理中,首 token 延迟往往比完整响应耗时更影响用户体验。Amazon SageMaker Inference 新增的前缀感知路由,会把共享相同提示词前缀的请求发送到同一个实例,让该实例上的 KV cache 更容易保持温热。 根据摘要中的 Llama 3.1 70B 基准测试,这种路由策略将 P50 time-to-first-tok...

让 SageMaker HyperPod 的推理冷启动从分钟级降到秒级:模型缓存实践

来源: aws.amazon.com 32
在大模型推理集群里,真正拖慢扩容的往往不是容器启动,而是模型权重和容器镜像的下载。Amazon SageMaker HyperPod 现在支持面向推理的模型缓存:提前把模型权重与容器镜像放到集群节点的本地 NVMe 存储中,Pod 启动时直接从本地读取,而不是重新通过网络下载。 这会把原本可能需要几十分钟的冷启动,压缩到秒级范围内。对于弹性扩容、故障替...

让 Amazon Bedrock 知识库理解视频:用 Marengo 3.0 做多媒体语义搜索

来源: aws.amazon.com 35
过去,知识库检索通常围绕 PDF、网页和纯文本展开。现在,TwelveLabs Marengo Embed 3.0 已在 Amazon Bedrock Knowledge Bases 中正式可用,应用可以用自然语言搜索视频、图片和音频内容,而不必先为每种媒体单独搭建一套索引服务。 这项能力的价值不只是"给视频加个向量"。它把媒体内容纳入了知识库的检索链...

从 AKS 到混合云:用 Azure 构建可扩展的容器管理体系

来源: azure.microsoft.com 26
Microsoft 被评为 2026 年 Gartner® 容器管理魔力象限™领导者。这个消息的重点不只是一个市场评价,更在于企业如何把容器平台用于 AI、混合云和大规模应用交付:在 Azure 上运行 Kubernetes 工作负载,在本地或其他云环境中保持一致的治理能力,并为不需要直接管理 Kubernetes 的团队提供更简单的容器运行方式。 A...

Kubernetes 1.37:让高优先级 Pod 的原地扩容主动抢占资源

来源: kubernetes.io 21
Kubernetes 1.35 已将 Pod 原地调整资源能力推进到 GA:运行中的容器可以修改 CPU 和内存请求,而不必通过重建 Pod 才能生效。但这只解决了“如何调整”,没有完全解决“节点空间不足时怎么办”。 Kubernetes 1.37 引入 Alpha 特性 。当高优先级 Pod 的原地扩容因节点容量不足而进入 状态时,调度器可以抢占同一...