标签

AI

面向智能体企业的平台工程:统一管理应用、资源与 AI Agent

来源: cncf.io 32
云原生时代的平台工程,最初解决的是 Kubernetes、微服务、GitOps 和分布式架构带来的交付复杂度。随着 AI Agent 进入企业应用,平台面对的对象不再只有容器、数据库和流水线,还包括模型、提示词、工具权限、知识源与运行时策略。平台工程正在从“提供基础设施自助服务”演变为“管理应用、资源和智能体的统一控制面”。 传统内部开发者平台通常围绕...

Yelp 用 Training Orchestrator 统一机器学习模型训练

来源: infoq.com 33
当每个机器学习团队都维护一套 Spark 训练脚本时,训练平台很快会出现参数格式不一、依赖关系隐蔽、失败处理重复、运行过程难以审计等问题。Yelp 推出的内部框架 Training Orchestrator,试图把这些分散脚本收敛为配置驱动、基于 DAG 的统一执行模型。 这项变化的重点并不是简单地“少写几个 Spark 脚本”,而是把训练任务从团队私...

从留美到回国创业:AI 人才选择背后的系统工程

来源: oschina.net 35
7 月 18 日,卡内基梅隆大学教授 Russ Salakhutdinov 在 X 上回应了一个问题:在 CMU 获得博士学位的 Kimi 创始人杨植麟,为什么没有留在美国?这条帖子在 24 小时内获得 134 万次浏览。Salakhutdinov 不仅是杨植麟的博士导师,也曾担任苹果 AI 总监,因此,这场讨论很快越过个人履历,指向一个更值得工程师关...

让 AI Coding 真正进入交付链路:Harness 全链路研发智能体实践

来源: my.oschina.net 23
AI Coding 已经能快速补全函数、生成模块,甚至完成小型需求,但代码生成只占研发工时的一部分。来源复盘给出的比例是 10% 到 32%:其余时间仍消耗在需求澄清、接口对齐、代码审查、测试、部署和故障排查上。真正影响交付速度的,不是模型一次能写多少代码,而是它能否在一套可验证、可回滚、可追踪的流程中持续推进任务。 Harness 全链路研发智能体的...

从社区共识到 DBA-1:OAPE 如何打造独立的 PostgreSQL 认证

来源: postgr.es 29
PostgreSQL 生态拥有成熟的数据库、活跃的全球社区和大量专业从业者,却长期缺少一套由独立组织维护、面向社区且不绑定单一厂商的认证。Open Alliance for PostgreSQL Education(OAPE)正试图填补这块空白:它把一次关于“为什么没有独立 PostgreSQL 认证”的讨论,逐步变成了非营利组织、国际协作社区,以及即...

从年度演进到云原生架构:Postgres Summit US 2026 值得关注什么

来源: postgr.es 31
Postgres Summit US 2026 将于 9 月 30 日至 10 月 2 日在纽约 Convene 举行。这项活动此前名为 PGConf NYC,EDB 将以金牌赞助商身份参会,并由 PostgreSQL 专家、核心贡献者和技术创新者带来一系列通过 Call for Papers 入选的分享。已披露的议题跨度很大,从云原生转型、战略与架构...

在 Bard 成为 AI 之前,它先代表谷歌内部一个真实的人

来源: oschina.net 27
今天提到 Bard,很多人会先想到谷歌曾使用过的 AI 产品名称。但在 Claire Stapleton 的故事里,这个名字首先连接的不是模型、参数或对话框,而是一名在谷歌工作十二年、负责为组织书写和表达的人。 她 2007 年以传播助理身份加入谷歌,后来成为公司内部极有辨识度的声音。这个故事值得技术团队关注,因为它揭示了一个常被忽略的问题:当公司迅速...

Kimi K3 半天编码实测:复杂前后端改造中,真正值得看的不是跑分

来源: oschina.net 28
Kimi K3 近期在 AI 编程圈引起关注,甚至出现了“超越 Claude Fable 5”的评价。但对开发者来说,模型参数和排行榜只能说明一部分问题。更有价值的测试,是把模型放进一个真实代码库,让它处理跨前端、后端、接口和回归验证的连续任务。 来源所描述的测试正是如此:不是让模型补一个函数,而是用一个下午完成复杂前后端改造。摘要没有提供完整代码、量...

从模型评估安全事件看 AI 防御:如何识别高级网络能力并改进评测流程

来源: openai.com 30
OpenAI 与 Hugging Face 公布了 AI 模型评估期间一起安全事件的早期发现。现有信息重点不在某个单独漏洞,而在于:模型评估已经可能触及高级网络攻击能力,评测平台本身也必须被当作高价值安全环境来保护。 这类事件给开发者和安全团队一个明确信号:模型能力评估不能只关注准确率、任务完成率和推理成本,还要记录模型在工具调用、代码执行、网络访问以...

Fable 5 贵三倍之后:如何算清闭源 API 与开源模型的真实成本

来源: oschina.net 19
同一周内,Moonshot 的 Kimi K3 与阿里巴巴的 Qwen 3.8 相继发布,并被描述为追平 Anthropic 的 Fable 5;两者还计划开放模型权重。Wojciech Gryc 的分析没有继续比较榜单分数,而是把焦点转向财务问题:当能力差距缩小时,闭源模型高出约三倍的价格,究竟在为什么买单? 摘要没有给出完整的训练成本、推理单价和使...