标签

AI

Cloudflare 将 AI 爬虫拆成三类:搜索、智能体与训练该如何分别管控

来源: oschina.net 14
Cloudflare 重构了 AI 爬虫管控体系:原先“一键拦截所有 AI 机器人”的总开关,被拆成 Search、Agent、Training 三个独立选项,而且包括免费版在内的客户都可以分别配置。变化看似只是多了几个开关,实质上却把一个模糊的“是否允许 AI”问题,变成了三种目的、三套收益与三类风险的访问决策。 三段式分类最重要的价值,是把访问者身...

让搜索 Agent 自己改进:从结果评估到迭代实验的工程闭环

来源: my.oschina.net 28
让 Agent 调用一次搜索接口并不难:生成查询词、发送请求、读取结果即可。真正棘手的是,当召回内容不相关、答案缺少证据或搜索成本过高时,Agent 能否判断问题出在哪里,提出改动,并通过多轮实验验证搜索是否真的变好了。 火山引擎开源 Agent 驱动的搜索自迭代技术,值得关注的核心正是这种能力边界的推进:搜索不再只是 Agent 的一个工具,而是一个...

TaiXu-Admin V0.1.2:把 LLM Wiki、RAG 与 Agent 推向可维护的工程系统

来源: oschina.net 15
TaiXu-Admin V0.1.2 的变化集中在一个明确方向:让 LLM、RAG 和 Agent 不只能够运行,还能持续更新、重构和恢复。版本新增文档的 LLM Wiki 解析与搜索,同时调整热编译替换、知识库重构、历史记忆管理和异常处理机制。这些能力共同指向 AI 应用进入生产环境后最棘手的问题:知识会变化、组件要升级、上下文会膨胀,外部模型和工具...

Anthropic 澄清开放权重立场:不签公开信,不等于主张封禁

来源: oschina.net 22
Kimi-K3 开放权重后,一场围绕 AI 开放生态的争论迅速升温。Anthropic 没有签署相关公开信,其技术人员 Julian Schrittwieser 对产业领袖开放立场的嘲讽又获得大量传播。随后,CEO Dario Amodei 发表《我们对开放权重模型的立场》,试图澄清一个关键边界:Anthropic 从未主张禁止开放权重模型。 这场争论...

Kimi K3 开放权重与训练 Infra:从模型获取到工程评估

来源: oschina.net 14
月之暗面宣布在 Kimi K3 开放日发布模型权重、技术报告,并开源支撑模型训练的 MoonEP、FlashKDA 和 AgentEnv。真正值得关注的不只是“可以下载模型”,而是模型、训练方法和关键基础设施被放进了同一个开放体系:研究者可以检查技术细节,工程团队也有机会评估私有化部署、训练效率与智能体工作流。 现有摘要没有披露许可证、参数规模、硬件需...

从持续贡献到逻辑复制改进:Fujitsu 如何参与塑造 PostgreSQL 19

来源: postgr.es 27
PostgreSQL 19 的演进不只来自某个单独功能,也依赖企业工程团队长期参与补丁开发、代码审查和社区协作。Fujitsu 的 PostgreSQL 团队通过持续提交代码、获得社区认可,并推动逻辑复制相关改进,进一步扩大了其在 PostgreSQL 开源生态中的影响。 由于摘要没有列出具体补丁名称和最终合入状态,本文不会把尚未明确的细节写成既定功能...

用 CALM 测试识别企业平台的隐性衰退

来源: postgr.es 31
企业平台很少在某次故障中突然死亡。更常见的过程是:升级不断延期,发布窗口越来越长,恢复演练一再推迟,团队开始绕开平台建设旁路系统。监控仍然全绿,但组织已经不愿意再碰它。 CALM 平台测试关注的正是这种“稳定但正在失去未来”的状态。它不盘点平台拥有多少功能,而是判断平台增长之后,组织是否更有信心继续改变它。 CALM 由四个维度组成: C,Change...

SAP BDC Connect for BigQuery 正式可用:用零复制数据打通分析与 AI

来源: cloud.google.com 27
企业数据平台长期面临一个两难选择:复制 SAP 数据可以方便分析,却会引入延迟、重复存储、语义丢失和治理成本;不复制,则很难让云端分析与 AI 工具及时访问核心业务数据。SAP Business Data Cloud Connect for BigQuery 的正式可用,提供了第三种路径:在 SAP Business Data Cloud 与 BigQ...

突破传统 RAG 上限:在 AWS 上构建任务感知知识压缩

来源: aws.amazon.com 21
传统检索增强生成(RAG)擅长回答“哪份文档提到了这个术语”,但面对需要横跨数百份报告进行比较、归因和趋势分析的任务时,很快会碰到上下文窗口、检索召回率和推理成本的共同上限。任务感知知识压缩(Task-Aware Knowledge Compression,TAKC)换了一个切入点:不要等到查询到来后再临时拼接文档,而是围绕明确任务,提前把整个知识库压...

把 SageMaker AI 支持排障从数天缩短到数分钟:Deepgram 的 IAM 临时委派方案

来源: aws.amazon.com 26
当 Deepgram 语音模型运行在客户自己的 Amazon SageMaker AI 环境中时,真正棘手的往往不是模型本身,而是支持工程师如何在不索取长期凭证、不过度开放权限的前提下,快速看到故障现场。 Deepgram 为此引入了基于 AWS IAM 的临时委派机制。按照其披露的结果,这项集成把 SageMaker AI 支持工单的初步调查时间从数...