分类

文章

用异常预警与支出上限,为 Google Cloud AI 成本加上双重护栏

来源: cloud.google.com 20
生成式 AI 改变了云成本的增长方式:一个看似简单的提示词,背后可能触发长上下文推理、Agent 工具调用、容器扩容或大规模查询。请求数相同,并不意味着计算量和账单相同,因此仅观察 QPS、调用次数和月底预算告警,已经不足以控制 AI 工作负载的财务风险。 Google Cloud 在 Billing Console 中增加了两类原生能力:AI 服务早...

LFM2.5 编码器:在 CPU 上压低长上下文推理成本

来源: huggingface.co 17
LFM2.5-Encoders 把目标放在一个很现实的部署场景上:使用 CPU 处理长上下文编码任务。对检索、语义匹配、重排前的特征提取和文档聚类系统来说,这意味着团队可以重新评估是否每条推理链路都必须占用 GPU,同时也需要更严谨地测量延迟、内存和截断行为。 短句编码通常容易批处理,性能也相对稳定;输入变成长文档后,问题会明显复杂。分词时间、模型计算...

从 CTE 到 MERGE:PostgreSQL 11–18 值得掌握的 SQL 演进

来源: postgr.es 18
从 2018 年的 PostgreSQL 11 到 2025 年的 PostgreSQL 18,社区连续七年保持每年一个大版本,每个版本都带来约 150 到 200 项用户可见变化。运维、性能和复制占据了更新列表的大头,但 SQL 层也在稳定补齐能力:有些新语法减少了样板代码,有些功能让数据约束更贴近业务,还有一些改进直接改变了查询优化方式。 真正值得...

用 __all__ 管好 Python 模块的公开 API

来源: realpython.com 32
Python 模块里的函数、类和常量,默认都可以通过属性访问。但“可以访问”不等于“应该公开”。当调用方执行 时,模块级变量 决定哪些名称会被导入;在包的 中,它也能帮助维护者明确包级 API 的边界。 这使 不只是通配符导入的开关,更是一份可执行的公开接口清单。不过,它不是访问控制机制,也不会让内部对象真正变成私有对象。 通常是一个由字符串组成的列表...

把密钥关在编码代理够不到的地方:用 Docker Sandbox 降低供应链风险

来源: docker.com 31
AI 编码代理不只是生成代码。它通常还能执行 Shell、安装依赖、读取项目文件,并调用测试或部署工具。这种能力提高了开发效率,也扩大了攻击面:一旦代理下载到恶意依赖、执行受污染的安装脚本,或者被仓库中的提示注入误导,当前进程能够读取的凭据就可能被复制或外传。 真正的问题不是代理是否“值得信任”,而是它运行时拥有多少权限。更稳妥的做法是把代理视为可能执...

从流量断崖到 DNSSEC 故障:解读 2026 年第二季度重大互联网中断

来源: blog.cloudflare.com 20
互联网中断并不只有一种形态。自然灾害可能同时破坏供电、移动基站和海底光缆;政府要求的网络关闭往往在行政边界内迅速生效;DNSSEC 密钥轮换失误则可能让服务器仍然在线,却让启用验证的用户无法解析域名。Cloudflare Radar 对 2026 年第二季度流量遥测的分析,展示了这些事件如何以不同方式影响全球连接。 对运维团队而言,关键问题不是只确认“...

用 Python 的 __all__ 管好模块与包的公开 API

来源: realpython.com 15
Python 的 会把哪些名字带入当前命名空间?答案不只取决于函数和变量是否存在,还取决于模块是否声明了 。理解这套规则,不只是为了答对通配符导入的问题,更重要的是明确模块和包的公开边界,让调用方知道哪些名字可以稳定依赖。 当模块没有定义 时, 通常会导入所有不以下划线开头的名字。以下划线开头的名字会被视为内部实现细节。 执行: 下划线只是一种默认过滤...

Grafana Assistant 扩展至 30 多种数据源:自然语言开始串联可观测性上下文

来源: infoq.com 24
Grafana Labs 已将 Grafana Assistant 的查询能力扩展到 30 多种数据源。变化的重点不只是“支持列表变长”,而是让 AI 助手可以通过自然语言跨数据源查询并关联信息:工程师不必在指标、日志、追踪和事件页面之间反复切换,而可以从一个故障问题出发,逐步收集证据。 传统排障经常沿着固定路径展开:先看监控指标确认异常时间,再检索日...

当写代码不再稀缺:AI 时代工程师真正需要的四种能力

来源: infoq.com 27
AI 正在快速降低代码生成的成本,但软件工程并没有因此变成“描述需求,然后等待答案”。真正困难的部分仍然存在:判断应该解决什么、识别系统中的关键风险、理解生成代码的行为,以及确认最终结果是否改善了客户体验。 Ben Greene 结合创业经历提出了一组适应这种变化的工程思维:从简单方案开始、保持对代码的理解、优先攻击困难问题,并用客户影响衡量工作。在代...

德里高院裁定 OpenAI 训练使用新闻内容不侵权:关键在研究例外与证据链

来源: oschina.net 16
印度德里高等法院于当地时间 7 月 24 日裁定,OpenAI 使用亚洲国际新闻社(ANI)的内容训练人工智能模型,不构成版权侵权。法官 Amit Bansal 认为,这类行为落入印度《版权法》规定的研究类“合理使用”例外;同时,ANI 未能提交充分证据,证明 ChatGPT 的回复复制了其受版权保护的表达。 这项裁定值得技术团队关注,不是因为它给所有...