分类

文章

从容器镜像到依赖树:SBOM、来源证明与 Attestation 的实践教训

来源: postgr.es 33
当一个 PostgreSQL 扩展项目从“能构建”走向“值得被依赖”,真正棘手的问题往往不再是 Dockerfile 能否跑通,而是:镜像里到底有什么?这些文件来自哪里?依赖是否完整?漏洞扫描器能否看见它们?未来出现新的供应链事件时,谁负责重建和发布? 围绕 CNPG-Extensions 的实践说明,SBOM、provenance 和 attesta...

PostgreSQL 的 max_files_per_process:不是硬上限,而是一池会回收的文件描述符

来源: postgr.es 40
看到 PostgreSQL 的 时,很容易把它理解成“每个服务进程最多只能打开这么多文件”。但它更准确的含义是一个文件描述符池:当池子满了,PostgreSQL 会关闭暂时不用的旧文件;之后需要访问这些文件时,再重新打开它们。 这个区别很重要。调低参数不一定会让访问立即失败,调高参数也不等于系统会无条件提供更多文件描述符。真正变化的,往往是文件重新打开...

Perplexity 让 GPT-6 Astra 参与端到端系统运维

来源: openai.com 28
Perplexity 正在把 GPT-6 Astra 的使用范围从单次问答扩展到更完整的工程工作流:它可以撰写沟通内容、修改软件,并监控生产系统。更值得注意的是,团队相比使用早期模型时不需要频繁介入,检查和确认的次数明显减少。 这意味着模型的价值不只在于生成一段代码,而在于能否持续参与从信息整理、变更执行到运行观察的闭环。与此同时,系统权限、变更边界和...

Kubernetes 1.37 默认启用原生直方图:更准的延迟分位数,更少的时序

来源: kubernetes.io 33
Kubernetes v1.37 将原生直方图(Native Histograms)提升到 Beta,并默认启用。这个变化直接影响 API Server 延迟、调度耗时、容器运行时操作等指标:Prometheus 可以用更少的时序覆盖更宽的数值范围,同时更准确地计算 P95、P99 等分位数。 升级 Kubernetes 并不等于监控系统已经完成迁移。...

生产环境中的 Agent 生命周期监控:用 AgentCore Evaluations 与 AWS DevOps Agent 构建双层闭环

来源: aws.amazon.com 32
多 Agent 系统上线后,故障通常不只是“服务是否存活”。一个航空订票系统可能返回了 HTTP 200,却把乘客引导到错误的航班;某个 Agent 可能因为工具调用延迟变高而反复重试,最终拖慢整个预订流程。传统的 CPU、内存和错误率监控,很难回答这些问题。 这类系统需要两层监控:一层持续衡量 Agent 的回答质量和行为表现,另一层负责调查承载 A...

别只看每百万 Token 价格:如何为 Amazon Bedrock 选择合适的 OpenAI 模型

来源: aws.amazon.com 39
在 Amazon Bedrock 上比较 OpenAI 模型时,只看每百万 Token 的单价,很容易得到一个看似精确、实际不够有用的结论。生产系统真正承担的成本,通常还包括重试、人工复核、工具调用、上下文长度,以及模型是否一次就能交付正确结果。 更可靠的评估方式,是把价格放回业务结果中:每个正确答案花了多少钱?一次 Agent 任务完整轨迹消耗了多少...

用 Amazon Bedrock AgentCore 构建可交互的 MCP Apps

来源: aws.amazon.com 31
MCP Apps 让模型调用工具的结果不再局限于纯文本。通过交互式 HTML widget,同一个 MCP Server 可以把表单、筛选器、图表或审批控件交给 AI Host 渲染,让用户直接在对话界面中完成操作。 这套能力的关键在于:MCP Apps 是与 Host 解耦的标准扩展。只要 ChatGPT、Claude 或其他 AI Host 支持对...

用 Helion 与 Hugging Face Kernels 构建、调优并分发高性能 GPU Kernel

来源: pytorch.org 28
Hugging Face Kernels 项目加入 Helion 支持后,GPU Kernel 的开发链路变得更完整:开发者可以用更接近 Python 和 PyTorch 的方式描述计算,通过自动调优寻找适合当前硬件与输入形状的配置,再借助 Hugging Face Kernels 进行打包和分发。重点不只是“写出一个能运行的 Kernel”,而是让它...

让 Devin 不只会写代码:GPT‑6 Astra 把“自证可用”推进到交付环节

来源: openai.com 36
Cognition 正在借助 GPT‑6 Astra 提升 Devin 测试软件、展示验证结果的能力。这里真正值得工程团队关注的,不只是模型能否生成更多代码,而是智能体能否把“我改完了”推进到“我执行了这些检查,结果如下,你可以据此审查”。目标也很明确:让工程师减少逐行阅读低风险代码的时间,把注意力放在行为变化、边界条件和发布风险上。 目前给出的信息没...

Termexo v0.8.7:用 avt 解析器修复终端空白与重绘阻塞

来源: oschina.net 28
终端工作台最难排查的一类问题,不是明显崩溃,而是 Agent 仍在运行,界面却突然空白,状态还显示为“已停止”。Termexo v0.8.7 将重点放在这类终端可靠性问题上:换用 解析器,并修复宽字符、窗口缩窄以及重绘阻塞相关故障。 Termexo 是一个 MIT 开源的 Windows 工作台,用于集中使用 Claude Code、Codex 和 O...