标签

工程效能

RAG 的下一站:能自己改代码、跑实验的知识底座

来源: my.oschina.net 45
去年你刚把 RAG pipeline 搭起来,向量库选了 Milvus,chunk 策略调了几轮,topK 从 5 改到 10 又改回 3——上线后效果还行,但每次新增文档都要人工造问答对验证检索质量。今年再看,有人已经让知识库自己改检索算法、自己跑 A/B 测试、自己决定哪版参数留下来。这不是噱头,是商汤开源的那套智能知识底座正在做的事。 大部分团队...

InfoQ 推出 AI 工程认证:生产级 AI 系统从业者该关注什么

来源: infoq.com 79
生产环境中跑大模型应用的人,最近几年都有一个共同感受——从 demo 到上线之间有一道巨大的沟。RAG 检索不准、agent 行为不可控、评估体系缺失、上线后延迟和成本飙升……这些问题不是靠换一个模型就能解决的。InfoQ 刚上线了一个为期五周的在线 AI Engineering 认证项目,面向已经在生产系统里做 AI 的资深从业者,覆盖 RAG、ag...

多租户 SaaS 平台的端到端入站请求链路追踪设计

来源: cncf.io 63
一个租户的请求从网关进入,经过鉴权、编排引擎、数据服务,最终落到下游第三方 API——中间跨越了十几条微服务调用。当这位租户反馈"响应变慢",你打开监控面板,看到的却是一堆散落在各服务日志里的碎片化 trace ID,根本拼不出一条完整链路。这就是大多数云原生 SaaS 平台在可观测性上的真实困境。 单租户系统里,一个 就能串联整条调用链。多租户平台引...

Cloudflare 用自建容器重写 Browser Run,拼完六层 Agent 基础设施

来源: infoq.com 54
Cloudflare 刚把 Browser Run 从第三方托管迁移到自家 Containers 平台上跑,并发能力翻了 4 倍、响应时间砍掉一半。这件事本身是个性能升级,但更值得注意的是——它把 Cloudflare 的 Agent 基础设施拼到了第六层,从计算到交易,一条链路全部收在边缘网络里。 Browser Run 是 Cloudflare 给...

Cloudflare 用自建容器重写 Browser Run,拼完六层 Agent 基础设施的最后一块

来源: infoq.com 46
Cloudflare 的 Browser Rendering 一直是开发者做网页抓取、自动化测试时的热门选择,但底层跑的是第三方托管方案,并发和延迟都有天花板。最近 Cloudflare 把整个 Browser Run 搬到了自家 Containers 平台上,并发能力翻了 4 倍、响应速度快了 50%。更重要的是,这一步把 Cloudflare 的 ...

Nova:让编码 Agent 并行跑起来,也让内部系统自动用上 AI

来源: dropbox.tech 49
当工程师同时处理三四个分支的 bugfix、重构和功能开发时,逐个喂 prompt 给 Copilot 式工具效率并不高。Nova 要解决的问题很直接:把编码 Agent 从"单线程聊天"升级为"多会话并行 + 系统级调度"。工程师可以同时开多个编码会话,内部系统也能把 Agent 当作工作流的一环自动调用——不需要人盯着屏幕等结果。 传统编码助手的工...

从零搭 RAG 太折腾?pgEdge RAG Server 把检索、融合、流式全打包了

来源: postgr.es 66
如果你最近访问过 docs.pgedge.com,大概率已经碰到了 Ellie——一个只从文档里找答案、不瞎编的 AI 助手。问她"多主复制怎么配"或"MCP Server 监听哪个端口",她会把相关文档片段拉出来拼成上下文,再交给 LLM 生成带来源引用的回答。Ellie 不是魔法,它背后跑的就是 pgEdge 刚开放出来的 RAG Server:一...

NocoBase 看板插件迎来 client-v2:无代码平台的新一代客户端架构落地

来源: oschina.net 66
NocoBase 本周发布更新日志,其中最值得关注的变动是看板(Kanban)插件正式增加了 支持。这意味着 NocoBase 正在把新一代客户端架构从核心模块逐步推向各个业务插件,看板作为高频使用的视图类型,率先完成迁移,对实际项目的影响比版本号变化更大。 NocoBase 的 是对原有客户端渲染层的重构版本。旧版客户端(client-v1)在插件加...

腾讯混元 Hy-MT2 翻译模型开源:33 语种 + 5 种方言互译,附指令遵循测试集

来源: oschina.net 64
机器翻译的痛点从来不是"能不能翻",而是"翻得准不准、听不听指令"。术语要锁定、风格要切换、方言要识别——这些需求在大模型时代反而更突出了。腾讯混元团队刚开源了 Hy-MT2 翻译模型家族,三个尺寸覆盖从轻量部署到高精度场景,还带了一个专门测"翻译模型到底听不听话"的 IFMTBench。值得认真看看。 Hy-MT2 这次开源了三个模型: 模型 参数量...