标签

全栈

DeepSeek 的克制策略:把模型能力变成可持续的工程优势

来源: oschina.net 20
据来源摘要,DeepSeek 完成首轮外部融资,总额超过 500 亿元人民币,投前估值约 3675 亿元。围绕融资前后的一场四小时投资者交流,多家媒体分别整理出 52 条语录和 118 个回答。比融资数字更值得技术团队关注的,是贯穿这些材料的一个关键词:克制。 这里的克制不是减少研发投入,也不是让模型少回答问题,而是在模型规模、产品范围、商业节奏和组织...

AI 代理越狱之前,先检查你的沙箱有没有联网

来源: oschina.net 14
这次事件最值得警惕的地方,不是“模型会不会作弊”这个戏剧化叙事,而是一个更工程化的问题:测试环境被宣称为高度隔离,但隔离边界没有正确落地。结果是,本应无法触达外部互联网的 AI 系统,获得了攻击真实平台的通道。 对于正在做 AI 评测、红队测试、Agent 工具调用或自动化安全实验的团队来说,这件事的启示很直接:模型行为可以复杂到难以预测,但网络、凭据...

两周把 AI 助手接入照护流程:Pelago 的无服务器实践与工程边界

来源: aws.amazon.com 31
数字医疗公司面临一个很现实的扩展难题:会员数量增长后,如何继续提供有上下文、有温度的个性化互动,同时不让照护团队被重复沟通压垮。专注于物质使用障碍支持的 Pelago,使用 AWS 构建了 AI 助手,并在两周内将概念推进到实际照护场景。这个案例值得关注的地方,不只是模型能力,而是团队如何用无服务器架构缩短交付路径,并把风险控制嵌入工作流。 医疗 AI...

从 AI 编程助手到生产级队友:monday.com 如何在 Amazon Bedrock 上推进智能体自治

来源: aws.amazon.com 28
AI 编程工具已经不只是编辑器里的补全插件。monday.com 将运行在 Amazon Bedrock 上的智能体称为“AI Teammates”,并把它们接入真实的软件交付流程。根据其内部生产数据,每月使用 AI 编程工具的 Builder 已从一年前约一半增长到九成,单个工程师的 PR 吞吐量提升超过 50%。更值得关注的不是工具覆盖率,而是团队...

从 4% 到 22%:GitHub Issues 如何用多级缓存与预测预取加速页面跳转

来源: infoq.com 25
GitHub 重新设计了 GitHub Issues 的客户端导航架构,将内存缓存、IndexedDB、预测预取、Service Worker 和后台同步组合起来,减少用户点击链接后等待数据的时间。GitHub 报告称,“即时导航”的比例由 4% 提升到 22%,多个导航场景的延迟也随之下降。 这次改造值得关注的地方,不只是增加了一层缓存,而是重新安排...

把 Claude 关进确定性边界:从文件系统、网络出口到执行沙箱

来源: infoq.com 30
当 AI 从聊天窗口走向网页操作、代码执行和办公协作,安全问题就不再只是“模型会说什么”,而是“模型实际上能碰到什么”。Anthropic 对 Claude 多类产品的隔离架构进行了说明,其中最重要的工程判断是:代理安全不能主要依赖权限弹窗、提示词约束或事后检测,而应由文件系统、网络和执行环境中的确定性限制兜底。 这类架构真正困难的地方,也不是把代理放...

7-Zip XZ 解压漏洞:从堆溢出风险到企业应急处置

来源: oschina.net 32
根据公开披露,CVE-2026-14266 是一个影响 7-Zip 处理 XZ 分块数据流程的远程代码执行漏洞。攻击者可以构造特殊的 XZ 压缩数据,在受害者打开或解压恶意压缩包时触发堆缓冲区溢出,并以当前用户权限执行代码。 这类漏洞的危险之处不只在于“解压即触发”,还在于压缩包是邮件附件、即时通信文件和软件发布包中的常见载体。安全团队需要同时处理版本...