标签

LLM

当开发者开始指挥 AI Agent,技术大会也该换一种办​​法

来源: docker.com 51
Docker 联合主办 WeAreDevelopers World Congress North America,释放出的信号不只是一次活动合作。随着 AI Agent 进入编码、测试、文档和运维流程,开发者的工作正在从“亲手完成每一步”转向“定义目标、提供上下文、审查结果并承担责任”。当开发方式改变,服务开发者的技术大会也不能继续只靠演讲、展台和工具...

Postgres 19 拟默认启用 LZ4:从 TOAST 压缩到 B-tree 大键的完整路径

来源: postgr.es 48
Postgres 19 计划把默认 TOAST 压缩算法从 pglz 改为 LZ4。这不只是替换一个配置默认值:表内行、TOAST 表和索引都使用以 varlena 为基础的统一压缩框架,算法变化会同时影响写入 CPU、存储空间以及大索引键能否写入。 LZ4 从 Postgres 14 起已经可以显式启用。Postgres 19 的变化可以理解为一次谨...

模型更新了,真正的优势为什么没有变

来源: huggingface.co 48
更强的新模型不断出现,但模型升级并不会自动改写应用之间的竞争格局。根据“Newer Models, Same Advantage”这一标题,可以把核心问题理解为:当所有团队都能接入新模型时,原有优势是否仍然成立?答案通常取决于模型之外的系统能力,例如上下文质量、工具集成、评测体系、专有数据和反馈闭环。 由于来源没有提供进一步摘要,下面的分析是一种面向工...

在 GKE 上构建企业级 AI 安全防线:从机密计算到推理路径治理

来源: cloud.google.com 56
AI 应用从原型进入生产的速度,已经超过许多企业安全体系的调整速度。传统容器安全可以检查镜像漏洞、限制网络访问,却无法完整回答这些新问题:模型权重是否在硬件层受到保护?提示词注入能否在进入模型前被识别?Agent 执行生成代码时,怎样避免影响宿主节点? GKE 的 AI 工作负载安全蓝图给出的答案不是单一产品,而是一套纵深防御体系:基础设施层保护计算环...

在 Kubernetes 中用 vLLM 部署自托管大模型:从 GPU 调度到服务验证

来源: cncf.io 42
托管模型 API 仍然是许多业务的合适选择:接入快、运维负担低,也容易按调用量扩展。自托管并不是要取代它,而是提供另一种部署路径。当团队需要控制模型版本、数据流向、推理配置或基础设施成本时,可以考虑在 Kubernetes 中运行 vLLM,把 GPU 推理服务纳入现有的调度、发布和监控体系。 调用托管 API 时,团队主要管理请求、密钥、配额和业务降...

当 AI Agent 花钱快过账单告警:云凭证与成本护栏必须前移

来源: infoq.com 46
云成本治理过去主要防范人的误操作:工程师开错实例、忘记关闭测试环境,账单告警晚几个小时通常还有补救空间。但当携带云凭证的 AI Agent 能连续调用模型、创建资源并自动重试时,支出速度已经超过传统账单系统的反馈速度。 来源案例中,一家三人规模的代理机构因静态 AWS Access Key 被攻击者提取,一天内产生了 14,000 美元的 Amazon...

当 AI Agent 花钱比账单告警更快:云凭证与成本护栏如何重构

来源: infoq.com 37
云成本控制过去主要防范人的误操作:工程师开错实例、忘记关闭测试环境,账单告警通常还有时间介入。但当持有云凭证的是 AI Agent 或攻击者时,资源调用可以在几分钟内并发放大,而成本数据和预算通知可能要到数小时甚至约一天后才反映出来。 一支三人团队在静态 AWS Access Key 被提取后,一天内收到了 14,000 美元账单,攻击者主要消耗了 A...

两天重构两万行 Vue:真正驱动 AI 编码的是约束系统

来源: my.oschina.net 37
让 AI 在两天内参与重构两万行 Vue 项目,真正值得关注的并不是“0 行手写代码”,而是如何让生成代码变得可控。核心方法可以概括为三层:用 Skills 注入领域知识,用 固化项目规则,再把评审中发现的问题写回约束,让同类错误只出现一次。 这套思路把 AI 从临时问答工具变成了受项目规范约束的执行者。速度来自模型,稳定性则来自人建立的工程系统。 一...

Coding Agent 集体进入 deepin 应用商店:Linux 开发工具开始走向统一交付

来源: oschina.net 41
多款主流 Coding Agent 登陆 deepin 应用商店,真正值得关注的不只是“又多了几个 AI 工具”,而是它们开始通过 Linux 桌面用户熟悉的渠道完成分发。开发者不必再分别寻找安装包、核对下载来源和跟踪更新,Coding Agent 正从需要手工拼装的前沿工具,转变为可以统一安装和管理的日常开发软件。 Coding Agent 的迭代速...

别让 Coding Agent 重修旧 Bug:把本地会话变成可搜索的工程记忆

来源: oschina.net 37
Claude Code、Codex、opencode 之类的 Coding Agent 会持续把会话写入本地:有的是 JSONL,有的是 session 文件,也有工具使用 SQLite。项目一多,这些记录很容易膨胀到 GB 级。真正浪费的不是磁盘,而是其中已经验证过的排障过程无法被再次检索:同一个构建错误、代理配置或数据库边界条件,几周后又要从头调查...