标签

架构设计

AgentScope Java 1.1.0:Harness 工程框架落地,从本地提效到分布式 Agent 一套搞定

来源: my.oschina.net 76
AgentScope Java 1.1.0 把之前规划中的 Harness Framework 全部交付了。这意味着 Java 开发者不再需要自己拼凑 Agent 的基础设施——消息路由、服务发现、容错重试、分布式编排这些"脏活"都由 Harness 承担,你只需要关注 Agent 的业务逻辑。 从个人提效的 Coding Agent 到企业级的 SR...

Memcached 1.6.42:一次以安全为重心的硬核修补

来源: oschina.net 35
Memcached 作为生产环境中最常见的分布式缓存之一,常年暴露在高并发、多租户的网络边界上。1.6.42 版本几乎把所有修复精力都砸在了安全问题上——内存损坏、崩溃风险、认证侧信道,一个都没放过。如果你的服务还在跑老版本,这轮更新值得立刻安排。 本次更新覆盖了多个模块,核心修复集中在三类风险: 1. SASL 认证时序侧信道 SASL 密码数据库认...

MDP 主数据平台 1.2.0:一套代码,微服务与单体自由切换

来源: oschina.net 42
主数据平台的架构选择一直是团队早期最纠结的决策之一——上微服务怕运维成本爆炸,留单体怕后期拆分痛苦。MDP 1.2.0 给了一个务实的答案:同一套业务代码,不改逻辑,通过配置和构建方式决定最终跑成单体还是微服务。与此同时,这版把 Spring Boot、Dubbo、Nacos 等核心依赖全线拉到最新,底座安全性和兼容性同步刷新。 核心思路并不神秘:模块...

用 Amazon EKS 跑地质岩芯识别模型:ALS LITHOLENS 的工程实践

来源: aws.amazon.com 42
地质岩芯编录(core logging)是矿产勘探中最耗人力的环节之一——地质师需要逐段观察钻探取出的岩芯,记录岩性、结构、矿物含量,一条钻孔往往产生数百米样本,全靠肉眼和经验判断。ALS GeoAnalytics 的 LITHOLENS™ 把这件事交给机器学习:对岩芯高分辨率图像做自动识别与分类,大幅压缩编录时间,同时让结果更可复现。 但模型从实验室...

用异步帧生成流水线把 GPU 利用率从 82% 拉到 99.9%——视频推理加速实战

来源: aws.amazon.com 34
视频生成模型推理有一个老问题:VAE 解码器逐帧吐出画面,每帧都要从 GPU 搬到 CPU 做后处理(编码、封装),GPU 在等数据搬运完成的那段时间几乎是空转。Synthesia 与 AWS 合作在 EC2 G7e 实例上验证了一种叫 Asynchronous Frame Generation Pipeline 的方案,把 GPU 计算、设备到主机(...

PostgreSQL 为什么成了 AI 应用的默认数据库

来源: postgr.es 49
越来越多的 AI 产品在技术栈里选了 PostgreSQL——不是因为它重新包装成"AI 数据库",而是因为它本来就是团队最熟悉、最可靠的那层基础设施。Supabase 的普及加速了这一趋势:每次创建 Supabase 项目,底层就是一个 PostgreSQL 实例。主流 AI 框架对 PostgreSQL 和 pgvector 的直接支持,让向量检索...

Akka 2.10.18:十三年老牌 Actor 框架的又一次稳稳推进

来源: oschina.net 38
JVM 上做并发和分布式,Akka 几乎是绕不开的名字。从 2009 年第一个版本发布至今,这个受 Erlang 启发的 Scala 库已经持续维护了十三年。最近发布的 2.10.18 是一个典型的补丁版本——改动不大,但每一处都指向生产环境的稳定性。 2.10.18 的变更集中在两个方向: 依赖升级——Config 库从旧版本 bump 到 1.4....

古文字 OCR 终于有了统一考场:Chronicles-OCR 开源评测基准解析

来源: oschina.net 37
做现代汉字 OCR,随便拉一个开源模型就能跑出 95% 以上的准确率。但把同样的模型扔到甲骨文拓片上,识别率直接跌到不可用的程度——字形变异大、样本稀缺、标注门槛极高,古文字 OCR 长期处于"各家自建小数据集、互相无法对比"的碎片状态。Chronicles-OCR 的出现,第一次给这个领域搭了一个统一的考场。 Chronicles-OCR 最核心的卖...

用 AI Agent 把 Crash 分析从"人工排雷"变成"自动诊断"

来源: my.oschina.net 31
一线开发者对这套流程再熟悉不过:Crash 看板飘红 → 打开堆栈 → 看一眼觉得像内存问题 → 找对应模块负责人 → 对方说"我看看"→ 半天后回复"是第三方 SDK 的锅"→ 再拉 SDK 方排查 → 一轮下来半天没了。如果 Crash 量级大、版本多,专家基本被钉死在排查上,新功能迭代自然减速。 这篇文章讲的是:把这套依赖人的排查流程,交给一个结...