标签

LLM

Hermes Desktop 公测:那个会"攒经验"的 AI Agent 终于上了桌面

来源: oschina.net 47
圈内人叫它"养马"——Hermes Agent,Nous Research 的开源智能体项目,靠跨会话记忆和自我进化这两板斧,在 Agent 场景里攒了不少口碑。6 月 3 日,它把最关键的一步补上了:桌面端应用 Hermes Desktop 正式公测,Windows、macOS、Linux 三平台全覆盖。 从"命令行里跑脚本"到"桌面图标双击启动",...

ChatGPT 新记忆系统:跨对话保持上下文的技术解读

来源: openai.com 41
过去和 ChatGPT 聊天,每次开新对话就像重新认识一个人——你得反复告诉它你偏好中文回复、你用的是 Python 3.11、你的项目在 Kubernetes 上跑。OpenAI 最近推出的 "Dreaming" 记忆系统,试图终结这种重复劳动。 新系统不是简单地把历史对话存下来再全文检索。它做的是偏好提取与压缩:从你的多次对话中识别出稳定倾向(编程...

花 1500 美元让 LLM 黑自己的应用:一场真实漏洞挖掘实验

来源: oschina.net 43
安全研究员 Kasra 做了一件多数人只会想想的事——他掏出约 1500 美元,让多款主流大模型去攻击自己亲手写的应用,看它们能不能找到真正的安全漏洞。结果既让人意外,又让人清醒。 大多数 LLM 安全评测用的是人造题目:给模型一段有明显漏洞的代码,问它"这里有什么问题?"这就像把答案写在考卷旁边再问考生能不能看见。 Kasra 的做法完全不同。他构建...

用 AI Agent 重塑软件交付:Endava 的实战路径

来源: openai.com 46
软件交付正在从"人写代码、人审代码、人部署"的模式,转向"Agent 生成、Agent 校验、人决策"的协作模式。Endava 这家全球软件工程公司正在把这条路径走通——他们用 ChatGPT Enterprise 和 Codex 作为核心引擎,把 AI Agent 嵌入需求分析、代码生成、测试、部署等环节,目标不是替换工程师,而是让每个环节都有 Ag...

让 LLM Agent 替你跑三个平台:告警排查自动化的落地思路

来源: my.oschina.net 36
凌晨两点,手机弹出一条告警——服务 A 的 P99 延迟飙升到 3 秒。你爬起来打开日志平台搜关键词,切到 APM 看监控曲线,再跳到链路追踪系统查 trace 详情。三套系统来回切换,眼睛在五个标签页之间跳了十几轮,最终定位到:上游服务 B 在 01:58 发生了一次 GC 停顿,导致下游调用超时。一分钟后流量恢复正常,告警自愈。 整个过程花了 25...

Claude 安全隔离架构拆解:从消费端到企业端,三层防线怎么落地

来源: oschina.net 35
Anthropic 工程团队最近公开了他们在三款 Claude 产品中构建 Agent 安全隔离的完整思路。这不是一篇泛泛而谈的"安全最佳实践"——它直接回答了一个工程难题:同一个模型,跑在不同风险等级的产品里,隔离策略该怎么分层设计? 三款产品分别是面向普通用户的 claude.ai、面向开发者的 Claude Code、面向企业协作的 Claude...

pgBackRest + pg_tde:加密数据库的备份还原实测

来源: postgr.es 40
Percona 之前发过一篇博客,说 pgBackRest 配合 pg_tde(透明数据加密扩展)时,异步归档不可用——原因是对加密的 WAL 段做归档会出问题。Stefan Fercot 在会议走廊里听到这个说法后觉得不对劲:pgBackRest 应该能透明处理加密 WAL。于是他亲手搭了一套环境跑了一遍,结论是:异步归档完全可用,之前说的限制并不成...

Next.js 16.2:开发启动提速 4 倍,渲染快 60%,还给 AI Agent 开了新门

来源: infoq.com 48
Vercel 刚发布 Next.js 16.2,三个数字直接拉满注意力:开发服务器启动速度提升 400%,页面渲染快了 60%,以及一套面向 AI Agent 的开发工具链。如果你还在用 Next.js 15,这次升级的性价比很高——迁移路径已经铺好,门槛只是 Node.js 20.9 和 TypeScript 5.1。 400% 的启动提速不是魔法,...

AI写了90%的代码,谁来守住底线——31万行重构的约束实践

来源: tech.meituan.com 56
当仓库里超过九成代码由 AI 生成,决定系统走向的不再是"谁写得更快",而是"谁能约束 AI 的输出"。没有统一规范,AI 只会成倍放大混乱——命名不一致、架构漂移、重复抽象层层叠加,技术债不是线性增长,而是指数膨胀。 我们用 31 万行代码的重构实践验证了一个思路:把 Agent 评测的方法论搬到 AI Coding 管理上,通过技术债盘点、Rule...

Uber 的 AI 编码工具月度限额:1500 美元背后的定价逻辑与团队预算实践

来源: oschina.net 41
Uber 近期给内部工程师的 AI 编码工具定了一条硬规矩:每人每工具每月上限 1500 美元。Cursor、Claude Code 这类 Agent 编码软件各自独立计算额度,互不挤占——同时用两款,月预算天花板就是 3000 美元。这条政策看似只是内部管控,实际上为整个行业提供了一个难得的锚点:企业到底愿意为单个工程师的 AI 辅助编码付多少钱? ...