标签

工程效能

Dropbox Nova:让 AI 编程 Agent 在工程体系里真正跑起来

来源: infoq.com 67
当 AI 编程 Agent 从"个人工具"变成"团队基础设施",问题就不再是"能不能写代码",而是"怎么可靠地调度、观测和管控几十个 Agent 同时干活"。Dropbox 近期公开了内部平台 Nova——一个专门用来编排和运营 AI 编程 Agent 的系统,把 Agent 从实验玩具推进到了工程流水线的一环。 单个开发者用 Copilot 补全几行...

Dropbox Nova:让 AI 编码 Agent 在工程体系里真正跑起来

来源: infoq.com 87
Dropbox 公开了内部平台 Nova——专门用来编排和规模化运行 AI 编码 Agent 的基础设施。这不是又一个 IDE 插件或单点工具,而是一整套让 Agent 从"实验玩具"变成"工程流水线一环"的操作系统。 单个 AI 编码 Agent 在本地跑 demo 很简单:打开 Copilot、写一段 prompt、拿到补全结果。但当你想让 Age...

Easysearch × 鼎甲 DBackup:国产检索引擎的灾备全链路打通

来源: oschina.net 69
极限科技的分布式检索数据库 Easysearch V2.0 与鼎甲数据备份与恢复系统 DBackup V8.0 完成了双向兼容适配认证——功能、性能、稳定性三项联合测试全部通过。这件事的意义不只是"两家厂商互发了一张证书",而是国产检索存储与国产灾备之间那条长期断开的链路,终于被接上了。 检索引擎的数据备份一直是运维的痛点:数据量大、索引结构复杂、实时...

TypeORM 1.0 正式发布:近十年等待后的现代化重塑

来源: infoq.com 63
从 2016 年诞生到 2025 年终于推出 1.0,TypeORM 走了一条漫长的路。这个被无数 NestJS 项目默认绑定的 ORM,长期停留在 0.x 版本,维护节奏一度让人担忧。1.0 的到来不只是版本号的跃迁——它意味着平台要求的现代化、废弃 API 的清理、安全与迁移流程的加固,以及社区维护信心的重建。 TypeORM 早期采用"0.x 永...

Anthropic 公开宣称 AI 自我改进进入临界区间——内部代码自动化率突破 80%

来源: oschina.net 46
Anthropic 在官网发布了一篇关于"递归自我改进"的研究文章,这是他们首次系统性地向公众阐述 AI 自我编写、自我优化代码的趋势规模与速度。核心判断很直接:AI 能力的提升速度正在加快,而非趋缓。公开基准测试上的任务完成率在缩短时间窗口内持续攀升,而 Anthropic 内部数据更具冲击力——代码自动化率已经超过 80%。这意味着什么?不是"AI...

Kiwi TCMS 16.0:开源测试管理系统的大版本升级,有哪些值得关注的变动

来源: oschina.net 130
测试管理这件事,很多团队的做法是:自动化脚本跑完看一眼日志,手动测试靠 Excel 或 Wiki 记录,Bug 跟踪扔给 Jira。工具之间割裂,测试计划、执行记录和缺陷数据散落在不同系统里,回溯时全靠人肉拼凑。Kiwi TCMS 试图把这些环节收拢到一个系统中——手动测试用例管理、自动化测试结果汇总、Bug 跟踪器联动、权限控制和可视化报告,全部在一...

开源项目 CI/CD 安全:谁能在你的流水线里跑代码?

来源: cncf.io 123
过去一年,开源供应链几乎成了攻击者的游乐场。Axios 在 npm 上被劫持,正常版本里混进了远程访问木马;LiteLLM 的 PyPI 包同样遭篡改——这些都不是理论风险,而是已经发生的事。攻击路径往往指向同一个薄弱环节:CI/CD 流水线的执行权限。谁能触发 workflow?谁能往流水线里注入步骤?谁能拿到签名密钥?这些问题如果没想清楚,项目再火...

花 1500 美元让 LLM 黑自己的应用:一场真实漏洞挖掘实验

来源: oschina.net 61
安全研究员 Kasra 做了一件多数人只会想想的事——他掏出约 1500 美元,让多款主流大模型去攻击自己亲手写的应用,看它们能不能找到真正的安全漏洞。结果既让人意外,又让人清醒。 大多数 LLM 安全评测用的是人造题目:给模型一段有明显漏洞的代码,问它"这里有什么问题?"这就像把答案写在考卷旁边再问考生能不能看见。 Kasra 的做法完全不同。他构建...

Kimi Work 公测:把 Agent 落到本地,从写代码到做研究

来源: oschina.net 60
月之暗面把自家全员在用的本地 Coding Agent——Kimi Code——做成了更通用的底座,往上叠加金融、科研、办公等场景的 Skill,打包成 Kimi Work Beta 推向公测。这意味着"本地 Agent"不再只是程序员专属的工具,而是任何知识工作者装上客户端就能跑起来的生产力入口。 Kimi Code 是整个系统的内核。它每天服务几十...

Inspektor Gadget 首次安全审计:eBPF 可观测性工具的信任基石

来源: cncf.io 44
eBPF 正在重塑 Kubernetes 可观测性的底层逻辑——内核级钩子、零侵入采集、近乎无开销的运行时洞察。Inspektor Gadget 正是这一浪潮中的代表项目:它把数十种 eBPF 小工具打包成 Kubernetes 原生资源,一条命令就能追踪网络包、监控文件访问、抓取进程执行事件。但 eBPF 工具本身跑在内核态,权限极高,如果实现有漏洞...