标签

AI

把 SageMaker 推理基准结果实时流进 MLflow

来源: aws.amazon.com 22
Amazon SageMaker AI 的优化推理推荐作业和基准测试作业现在可以和 MLflow 集成,把指标、参数和图表实时写入 serverless Amazon SageMaker MLflow App。对做模型上线的人来说,这个变化很实用:压测、实例规格对比、延迟和吞吐结果不再散落在作业日志、Notebook 和截图里,而是进入同一个实验追踪界...

PRX 的数据策略:先把事件、血缘和质量闸门立住

来源: huggingface.co 34
“PRX Part 4: Our Data Strategy”这个标题透露的信息很克制:这是一组系列文章里的第四篇,主题从产品或架构推进到了数据策略。摘要没有给出实现细节,所以本文不把具体方案包装成原文事实,而是围绕一个工程团队在 PRX 这类项目中可以如何落地数据策略来拆解:先定义数据契约,再建立可追踪的数据流,最后用质量检查挡住坏数据进入核心指标。...

Postgres 14-16 复制回放死锁:升级备库前先看这个坑

来源: postgr.es 26
PostgreSQL 14、15、16 的最新小版本 14.23、15.18、16.14 引入了一个回归问题:在特定 WAL 回放场景下,备库或 PITR 恢复实例可能卡在 相关的 LWLock 等待上。这个问题麻烦的地方不在于“所有人都会中招”,而在于它正好踩中了很多团队的常规补丁流程:先升级 standby,再升级 leader。 目前已知受影响范...

Netflix 如何把 Cassandra 宽分区读延迟从秒级压到毫秒级

来源: infoq.com 31
时间序列数据写进 Cassandra 很顺手,但一旦某个租户、设备或内容 ID 的数据量远超预期,原本看起来干净的分区键就会变成“宽分区”。Netflix 工程团队针对这类负载引入了动态分区拆分:用元数据识别过大的逻辑分区,把它拆成多个更小的子分区,并在读取时自动路由到这些子分区。结果是读延迟从秒级降到毫秒级,超时减少,集群稳定性也更好,同时对业务侧保...

面向受监管行业的 AI 安全与隐私工程:别等上线后再补课

来源: infoq.com 33
InfoQ 开放了一个为期五周的 AI Security & Privacy Engineering cohort,目标人群是受监管行业里的资深工程师和架构师。这个方向值得关注,不是因为“AI 安全”又多了一个课程名,而是因为生产级 AI 系统已经把安全、隐私、威胁建模、可观测性和治理揉成了同一个工程问题:模型调用、提示词、检索数据、用户输入、...

LeRobot v0.6.0 把机器人开发推向“想象、评估、改进”闭环

来源: huggingface.co 36
LeRobot v0.6.0 的发布标题是 “Imagine, Evaluate, Improve”。在缺少更多发布细节的前提下,最值得抓住的是这个方向:机器人学习不再只是“收集数据、训练模型、部署试试”,而是更强调一个可重复的工程闭环:先生成或设想任务与策略,再用指标评估,再把结果反馈到数据、模型和环境配置里。 “Imagine” 对机器人团队很关键...

AI 原生工作负载正在改写平台工程的边界

来源: cncf.io 44
Platform Engineering 1.0 已经证明了自己的价值:Golden Path 让部署更快,内部开发者平台降低了认知负担,自助式基础设施把开发者从工单队列里解放出来,标准流水线也让交付变得可复制。现在变化来了:AI 原生工作负载把平台从“帮应用上线”推向“帮模型、数据、推理和实验稳定运行”。 过去的平台工程主要围绕服务交付:创建仓库、申...

AI 公司真正烧钱的地方:每个员工背后的算力账单

来源: oschina.net 36
Tomasz Tunguz 在 Theory Ventures 的博客里用一组很直白的数字解释了 AI 行业的成本结构:Anthropic 约 5000 名员工,2026 年模型推理和训练支出约 100 亿美元。摊到每个员工身上,就是每人每年约 200 万美元的算力成本。 这个数字刺眼,不是因为“人贵”,而是因为 AI 公司的核心成本已经从传统软件公司...

腾讯混元 Hy3 开源:把推理、智能体和长上下文能力落到工程里

来源: oschina.net 43
腾讯混元 Hy3 从 4 月底的 preview 走到开源发布,重点变化不是简单“放出一个模型”,而是围绕后训练数据质量、多样性和 RL 算力规模继续加码。公告中提到,Hy3 在推理、智能体、长上下文等任务上有明显进步,并在软件开发、办公生产、金融建模等场景里接近更大尺寸旗舰模型的效果。对工程团队来说,这类开源模型的价值不只在榜单,而在于能不能被纳入自...

xbatis 1.10.6:少写持久层代码,但别放弃可维护性

来源: oschina.net 32
xbatis 1.10.6 正式发布,这次更新的重点很直接:继续把 ORM 的日常写法往“少写、好读、可维护”方向推。来源摘要里提到两个具体变化:新增 函数,以及 Map 结果支持强制包含 为 的字段。前者改善 SQL 表达能力,后者解决结果映射里“字段存在但值为空”容易被误判的问题。 很多团队现在会把“有 AI 帮忙写代码”当成减少 ORM 依赖的理...