来源: my.oschina.net
45
去年你刚把 RAG pipeline 搭起来,向量库选了 Milvus,chunk 策略调了几轮,topK 从 5 改到 10 又改回 3——上线后效果还行,但每次新增文档都要人工造问答对验证检索质量。今年再看,有人已经让知识库自己改检索算法、自己跑 A/B 测试、自己决定哪版参数留下来。这不是噱头,是商汤开源的那套智能知识底座正在做的事。 大部分团队...
来源: infoq.com
79
生产环境中跑大模型应用的人,最近几年都有一个共同感受——从 demo 到上线之间有一道巨大的沟。RAG 检索不准、agent 行为不可控、评估体系缺失、上线后延迟和成本飙升……这些问题不是靠换一个模型就能解决的。InfoQ 刚上线了一个为期五周的在线 AI Engineering 认证项目,面向已经在生产系统里做 AI 的资深从业者,覆盖 RAG、ag...
来源: cncf.io
63
一个租户的请求从网关进入,经过鉴权、编排引擎、数据服务,最终落到下游第三方 API——中间跨越了十几条微服务调用。当这位租户反馈"响应变慢",你打开监控面板,看到的却是一堆散落在各服务日志里的碎片化 trace ID,根本拼不出一条完整链路。这就是大多数云原生 SaaS 平台在可观测性上的真实困境。 单租户系统里,一个 就能串联整条调用链。多租户平台引...
来源: infoq.com
54
Cloudflare 刚把 Browser Run 从第三方托管迁移到自家 Containers 平台上跑,并发能力翻了 4 倍、响应时间砍掉一半。这件事本身是个性能升级,但更值得注意的是——它把 Cloudflare 的 Agent 基础设施拼到了第六层,从计算到交易,一条链路全部收在边缘网络里。 Browser Run 是 Cloudflare 给...
来源: infoq.com
46
Cloudflare 的 Browser Rendering 一直是开发者做网页抓取、自动化测试时的热门选择,但底层跑的是第三方托管方案,并发和延迟都有天花板。最近 Cloudflare 把整个 Browser Run 搬到了自家 Containers 平台上,并发能力翻了 4 倍、响应速度快了 50%。更重要的是,这一步把 Cloudflare 的 ...
来源: dropbox.tech
49
当工程师同时处理三四个分支的 bugfix、重构和功能开发时,逐个喂 prompt 给 Copilot 式工具效率并不高。Nova 要解决的问题很直接:把编码 Agent 从"单线程聊天"升级为"多会话并行 + 系统级调度"。工程师可以同时开多个编码会话,内部系统也能把 Agent 当作工作流的一环自动调用——不需要人盯着屏幕等结果。 传统编码助手的工...
来源: cncf.io
49
2026 年 5 月 21 日,在明尼阿波利斯的 Observability Summit 上,CNCF 宣布 OpenTelemetry 正式毕业。从 2019 年 OpenTracing 与 OpenCensus 合并立项,到如今成为 CNCF 最高等级的毕业项目,OTel 走了将近七年。毕业不是终点——它意味着项目已经在大规模生产环境中站稳了脚,...
来源: postgr.es
66
如果你最近访问过 docs.pgedge.com,大概率已经碰到了 Ellie——一个只从文档里找答案、不瞎编的 AI 助手。问她"多主复制怎么配"或"MCP Server 监听哪个端口",她会把相关文档片段拉出来拼成上下文,再交给 LLM 生成带来源引用的回答。Ellie 不是魔法,它背后跑的就是 pgEdge 刚开放出来的 RAG Server:一...
来源: oschina.net
66
NocoBase 本周发布更新日志,其中最值得关注的变动是看板(Kanban)插件正式增加了 支持。这意味着 NocoBase 正在把新一代客户端架构从核心模块逐步推向各个业务插件,看板作为高频使用的视图类型,率先完成迁移,对实际项目的影响比版本号变化更大。 NocoBase 的 是对原有客户端渲染层的重构版本。旧版客户端(client-v1)在插件加...
来源: oschina.net
64
机器翻译的痛点从来不是"能不能翻",而是"翻得准不准、听不听指令"。术语要锁定、风格要切换、方言要识别——这些需求在大模型时代反而更突出了。腾讯混元团队刚开源了 Hy-MT2 翻译模型家族,三个尺寸覆盖从轻量部署到高精度场景,还带了一个专门测"翻译模型到底听不听话"的 IFMTBench。值得认真看看。 Hy-MT2 这次开源了三个模型: 模型 参数量...