2026-07-09
来源: huggingface.co
37
Agent 应用和传统搜索、问答系统的差别,不只是“多了一个大模型”。Agent 会规划、调用工具、写入状态、根据反馈重试。也就是说,数据不再只是被检索出来给人看,而是会被模型拿来做决策。因此,“Data for Agents”这个主题的关键,不是把所有资料塞进向量库,而是把数据整理成 Agent 能理解、能验证、能执行的上下文。 由于来源摘要没有提供...
2026-07-09
来源: aws.amazon.com
37
药物研发里的问题很少是“找一段文字”这么简单。研究人员更常问:某个靶点和疾病有什么证据链?候选化合物影响哪些通路?这篇来源文章讨论的核心变化是:把图数据库、生成式 AI 和 BYOKG(Bring Your Own Knowledge Graph,自带知识图谱)结合起来,用 GraphRAG 加速科学发现,同时尽量不牺牲科学完整性。 传统 RAG 通常...
2026-07-09
来源: aws.amazon.com
26
MCP Server 不再只是给本地 IDE 塞几个工具函数。这个方案把电商场景里的商品搜索、下单、评论提交和退货处理做成可被 Agent 调用的工具,并用 Amazon Bedrock AgentCore 承载运行时,用 Amazon Cognito 和双层 JWT 做身份边界,最后连接到 Mistral AI Studio 的 Vibe。重点不是“...
2026-07-08
来源: aws.amazon.com
34
Amazon Bedrock AgentCore Runtime 作为托管运行时,真正上线时绕不开一个问题:公网请求怎样进来,安全控制又怎样不被绕过?这篇方案的核心变化很明确:把入口收束到 internet-facing ALB,并在 ALB 前挂 AWS WAF,再通过 VPC Interface Endpoint 把流量送到 AgentCore R...
2026-07-08
来源: infoq.com
42
Airbnb 披露了 Sitar-agent 的架构:它是运行在 Kubernetes 服务旁边的 sidecar,用来把动态配置稳定地下发到数以万计的 Pod。这个系统每分钟要处理多次配置更新,核心挑战不是“能不能推送配置”,而是当规模、启动风暴、网络抖动和存储故障同时出现时,应用还能不能拿到可用配置。 这次重构的几个关键词很明确:Java 重写、用...
2026-07-08
来源: openai.com
27
OpenAI 这篇说明讨论的是一个高风险但绕不开的问题:AI 能否进入政府和国家安全工作流,以及应该以什么边界进入。核心不是“把模型接进系统”这么简单,而是要把负责任使用、民主问责、公共安全这些原则变成可执行的流程、权限和日志。 政府和国家安全场景有两个特点:影响范围大,错误代价高。一个客服机器人答错问题,通常可以回滚、补偿、重训;但在公共安全、情报分...
2026-07-08
来源: docker.com
32
AI Agent 正在把软件开发从“人写代码、工具辅助”推向“模型规划、调用工具、直接改动系统”。变化不只发生在 IDE 里。一个能读文件、跑测试、访问 API、提交代码、调用云资源的 Agent,已经把你的笔记本变成了一个高权限运行时。它不再只是开发环境,而是一个会执行真实动作的生产入口。 这也是“运行时治理”开始重要的原因:问题不再只是提示词写得好...
2026-07-08
来源: openai.com
26
OpenAI 的一项新分析指出,流行代码基准 SWE-Bench Pro 存在会影响评测可靠性和准确性的问题。对做模型选型、Agent 平台或内部编码助手的团队来说,这不是一个“榜单小插曲”:如果 benchmark 把噪声当信号,模型排名、采购决策和产品路线都会被带偏。 SWE-Bench 这一类评测的吸引力很明确:它把模型放进真实软件仓库,让模型修...
2026-07-08
来源: kubernetes.io
34
etcd v3.7.0 是一个不小的 minor release。它解决了大范围查询一次性缓冲带来的延迟和内存问题,引入 RangeStream;继续压低 Kubernetes 控制平面的 CPU 开销;同时把启动链路从遗留 v2store 中抽离出来,并完成 protobuf 依赖的大规模更新。对只运行官方镜像的团队来说,这更像一次需要认真读升级说明...
2026-07-08
来源: cncf.io
36
很多团队对 AI Agent 的第一反应不是“它能做什么”,而是“我敢不敢把它放进网络里”。这个担心很现实:Agent 会读上下文、调用工具、访问内部服务,一旦边界不清,它就可能从“助手”变成一条难审计的网络路径。来源摘要提到的核心问题正是这个:我们并不总是知道 Agent 到底会做什么,所以需要在网络层给它套上可观察、可限制、可回滚的边界。 NGIN...