分类

文章

把 Hugging Face 模型放到 Foundry 托管计算上运行

来源: huggingface.co 42
“Hugging Face Models on Foundry Managed Compute”这个标题指向一个很实际的工程问题:模型已经在 Hugging Face 生态里,团队希望把运行环境交给 Foundry 的托管计算来承接,而不是自己维护 GPU 节点、镜像滚动、健康检查和扩缩容细节。 因为来源摘要为空,下面不把任何具体 API 说成官方事实...

Django 6.0.7 与 5.2.16 安全更新:缓存 Cookie、GDALRaster 与域名校验的三个低危坑

来源: djangoproject.com 43
Django 发布了 6.0.7 和 5.2.16 两个安全版本,修复三类低危问题:共享缓存可能保存带敏感 的响应、 处理 bytes 栅格时可能越界读取、 曾接受带换行的域名输入。单看评级都是 low,但它们都落在 Web 服务里很容易被忽略的边角:缓存、二进制解析、HTTP 头边界。 受影响的受支持分支包括 Django main、6.1 beta...

用 Python 客户端在终端里测试 MCP Server

来源: realpython.com 32
MCP Server 写完之后,最容易被忽略的不是工具函数本身,而是“它到底暴露了什么、参数是否对得上、资源和提示词能不能被客户端看见”。这类问题等到接入 IDE、Agent 或桌面客户端时再查,反馈链路太长。更直接的做法是写一个小型 Python MCP Client,在终端里枚举 server 的 tools、prompts、resources,并...

从董事会到供应链:英国网络韧性承诺真正要求企业补上的三块短板

来源: blog.cloudflare.com 41
英国政府的 Cyber Resilience Pledge 不是一份强制合规清单,而是一个自愿框架:组织承诺把基础网络安全治理做扎实,让董事会承担明确责任,并把供应链风险纳入日常管理。Cloudflare 加入这项承诺的意义在于,它把过去十多年反复强调的三件事放到了同一个公共语境里:让安全能力更普及、让领导层对安全负责、用透明度换取信任。 很多组织的安...

用 Python 命令行客户端给 MCP Server 做冒烟测试

来源: realpython.com 33
MCP Server 写完以后,真正麻烦的往往不是“能不能启动”,而是它暴露出来的 tools、prompts、resources 是否符合客户端预期。来源文章的核心思路很直接:写一个 Python 命令行 MCP Client,通过 stdio 连接本地 MCP Server,然后逐项测试工具、提示词和资源。这比只看日志靠谱,也比直接接入大模型前盲测...

AWS DevOps Agent 加入 AI 发布管理:让代码进生产前先过一遍“自动审查”

来源: infoq.com 44
AWS 扩展了 AWS DevOps Agent,新增面向发布管理的能力:在代码进入生产环境之前,评估代码变更,并自主执行软件测试。这件事的重点不只是“又多了一个 AI 助手”,而是发布流程里最容易靠经验、手工检查和临时会议兜底的环节,开始被更系统地自动化。 传统 CI/CD 管道擅长做确定性工作:拉代码、跑测试、构建镜像、发布到环境。它的问题也很明显...

给 AI Agent 上沙箱还不够:还要管工具、网络和数据边界

来源: cncf.io 35
Agentic AI 的工程实践正在快速变化。沙箱项目能把 Agent 放进隔离环境里运行,限制文件系统、进程、网络和系统调用,这是必要的第一道门。但如果 Agent 能拿到敏感凭据、能访问内网服务、能把中间结果发到外部工具,单靠沙箱并不能构成完整安全边界。 像 agent-sandbox 这类项目的价值在于:它把容器、权限隔离、临时文件系统等基础设施...

当熟悉的互联网消失后,工程师还能留下些什么

来源: oschina.net 39
一篇没有新框架、没有架构图、没有性能数字的博客登上 Hacker News 首页,反而说明了一个更扎实的问题:很多工程师记忆里的互联网,已经不是今天这个互联网。作者从 90 年代末出生、在美国乡下长大的个人经历出发,把 25 年里的网络使用方式串了起来。它的价值不在“发现了什么新技术”,而在提醒我们:互联网的形态不是自然定律,它会被平台、商业模式、搜索...

Kdenlive 26.04.3:26.04 系列的收官维护版,重点在稳定和工作流细节

来源: oschina.net 48
Kdenlive 26.04.3 已经发布。这个版本不是一次功能大改,而是 26.04 系列的最后一个维护版本,核心价值很明确:修错误、顺工作流、提高稳定性。对日常剪辑来说,这类版本往往比“大功能发布”更值得关注,因为它直接影响撤销、时间线操作、项目保存和长时间编辑的可靠性。 Kdenlive 是基于 MLT 框架、KDE 和 Qt 的开源非线性视频编...

EdgeBench 开源:把 Agent 放进 12 小时起步的真实环境任务里测

来源: oschina.net 34
字节 Seed 推出了 EdgeBench,一个面向“真实世界环境学习”的超长程 Agent 评测集。它不是让模型回答几道静态题,而是把 Agent 放进需要长期交互、持续试错和逐步适应的环境里。根据摘要,EdgeBench 覆盖 134 个真实且多样的任务,横跨六大能力领域,每个任务都允许 Agent 持续工作至少 12 小时;其中 51 个任务和完...