来源: aws.amazon.com
33
当 AgentCore 代理和知识库位于不同 AWS 账户时,企业不必复制源数据,也不必把分析型数据迁移到代理所在账户。通过跨账户 IAM 授权,可以让一个账户中的 Amazon Bedrock AgentCore 代理调用另一个账户中的 Amazon Bedrock Knowledge Base,并从由 Amazon Redshift Serverl...
来源: infoq.com
44
数据平台接入一个新数据集,真正耗时的往往不是复制文件,而是反复确认字段、分类级别、处理步骤、质量规则和责任人,再把这些要求写进一套专用代码。AWS 介绍的规格驱动组合(specification-driven composition)换了一个切入点:用声明式规格表达意图,把实际处理交给可复用能力,并在执行前完成验证。AWS 报告称,这种方式可以把数据集...
来源: cloud.google.com
46
企业开始把大量 AI 智能体接入业务系统,基础设施面对的已不只是推理流量增长。智能体会持续调用模型、数据库和内部应用,负载既消耗 GPU、TPU 等稀缺资源,又具有明显的突发性。若仍把应用绑定到单一机型、单一区域或整块加速卡,结果通常是两个极端:高峰期申请不到容量,低谷期则有大量资源闲置。 动态容量管理的核心不是无限扩容,而是把需求分成可预测与不可预测...
来源: cloud.google.com
34
AI Agent 开始承担持续运行、批量执行和多步骤协作的任务后,企业面对的成本问题已经不同于传统的软件订阅。业务用户可能每天稳定使用生产力工具,开发团队却可能在发布前集中运行大量代码 Agent,后台 Agent 还会在夜间持续消耗模型推理资源。只按“每个用户多少钱”来管理,往往看不见真实的运行成本,也很难在创新和预算之间取得平衡。 面向 Gemin...
来源: kubernetes.io
25
Kubernetes v1.37 代号 Garhwal,包含 67 项增强:16 项进入 Stable、23 项进入 Beta、27 项进入 Alpha,另有 1 项弃用或移除。相比单纯增加 API,这一版本更值得关注的是几条清晰的工程主线:控制面在大规模集群中更能承受启动和恢复压力,HPA 可以按外部需求缩容到零,工作负载感知调度开始服务 AI/HP...
来源: cloud.google.com
44
强化学习和后训练工作流正在大量采用 Ray:训练器、推理引擎、rollout worker、数据管道和评估任务可以由同一个分布式运行时统一调度。但随着 agentic workflow 变得更复杂,模型生成的代码、工具调用和多轮交互也带来了新的问题:如何在不暴露宿主机的前提下,大规模、低延迟地执行不可信代码? Google 与 Anyscale 正在推...
来源: cloud.google.com
47
法律行业使用 AI,难点从来不只是模型能不能读懂合同。律师处理的是受特权保护的通信、带有伦理墙的案件资料、律所自己的审阅规则,以及持续变化的法律与监管要求。一个通用聊天机器人可以给出看似合理的答案,却无法自动满足权限继承、可追溯引用、保密和专业判断这些生产环境要求。 Gemini Enterprise for Legal 的核心思路,是在模型之外构建一...
来源: cloud.google.com
46
金融机构并不缺少能写摘要、生成表格的模型,真正稀缺的是能进入生产环境的 AI:它必须读取获授权的实时数据,遵守既有权限,在研究、授信和 KYC 流程中执行任务,并留下足够完整的证据链。Gemini Enterprise for Financial Services 的重点因此不是单独升级模型能力,而是把金融技能、MCP 数据连接、可执行 Agent、合...
来源: oschina.net
44
2026 上海开源软件应用创新大赛设置了 AI+工业软件、智算云、开源 AI 工具三个赛道,总奖池 100 万元。其中,智算云赛道关注的不是单一模型能力,而是如何用云基础设施加速、简化并稳定 AI 运行。异构算力调度、GPU 池化、分布式训练、应用开发平台、模型部署服务和 Serverless 推理,都属于这一方向可以覆盖的工程问题。 对准备参赛或建设...
来源: postgr.es
23
在 Kubernetes 上部署 PostgreSQL 只是起点。真正考验运维体系的,是运行数周或数月后出现的日常变更:实例内存不足、读流量需要更多副本、镜像需要更新。CYBERTEC PG Operator(CPO)将这些操作收敛为 PostgreSQL 自定义资源的期望状态修改,再由 Operator 配合 Patroni 执行有序切换,而不是由人...