标签

LLM

为 AI Agent 设计数据层:从事务系统到 MCP 与语义模型

来源: infoq.com 48
企业把大语言模型接入业务系统后,真正棘手的问题通常不是“模型会不会回答”,而是“模型能否在安全、准确、可控成本的前提下访问正确的数据”。Fabiane Nardon 分享了 TOTVS 面向企业级 AI Agent 的数据层思路:让确定性的事务逻辑继续由数据库和服务负责,把 LLM 放在理解意图、选择工具和组织结果的位置上。 这套方法的核心,是同时处理...

从 KV Cache 到生产服务:vLLM 在 PyTorch Conference 2026 的技术路线

来源: pytorch.org 51
PyTorch Conference North America 2026 将 vLLM 放在一组相互连接的技术议题中:KV cache 管理、分离式服务、硬件可移植性、内核优化、PyTorch 集成、Mixture-of-Experts(MoE)推理、注意力机制,以及生产环境服务。这个议程传递出一个清晰信号:高性能推理已经不只是“把模型跑起来”,而是...

Cloudflare BotBase 为机器人运营者补上可追踪、可修改的提交流程

来源: blog.cloudflare.com 41
Cloudflare 为 BotBase 机器人与智能体目录的运营者提供了一个更明确的管理入口。运营者现在可以在 Cloudflare Dashboard 中管理目录提交、跟踪审核状态、修改已提交信息,并通过行为模型更准确地声明机器人如何使用网站内容。 这次变化的重点不只是“多了一个页面”,而是把原本容易失控的一次性提交,变成一个可以持续维护的运营流程...

从“Postgres 很糟”到 PostgreSQL 深处:一名 DBA 的二十年进化路径

来源: postgr.es 33
一个数据库人的技术路线,往往不是从“我喜欢这项技术”开始,而是从一次故障、一次磁盘告急,或一场无法解释的生产事故开始。Shaun Thomas 与 PostgreSQL 的关系就是如此:早期因为膨胀、清理和升级问题而嫌弃它,后来却在真实生产环境中不断修复、自动化和扩展,最终成为 PostgreSQL 社区的长期贡献者。 这段经历最有价值的地方,不是某个...

让 Agent 像个“人”:从文本回答到有表情的实时数字角色

来源: oschina.net 41
大模型让 Agent 变得更会回答问题,但“会说”不等于“有活人感”。当 AI 被放进展厅讲解、情感陪伴、教育科普、文旅导览或人形机器人时,用户期待的并不是一个不断吐字的文本框,而是一个能理解语境、及时回应,并通过表情、语气和动作建立信任的角色。 这也是 AI 应用交互正在变化的地方:语言模型负责理解和生成内容,数字人或机器人负责把内容变成可感知的表达...

Memmy v1.1.1 支持 Linux:把持续积累的 AI 工作上下文带到终端

来源: oschina.net 42
Memmy v1.1.1 已正式发布,Linux CLI 安装资源也已上线。对习惯在终端里工作的开发者来说,这不只是增加一个平台选项:本地工作站、远程开发环境和 Linux 服务器上的 AI 工作,都可以使用同一类长期积累的项目上下文。 项目背景、历史排查过程、团队偏好,以及已经验证过的解决方案,往往不会在一次会话里全部用完。它们会随着任务推进逐步沉淀...

从 BLE 多点断连排查到音频指纹:网页如何“听见”设备差异

来源: infoq.com 38
在排查蓝牙低功耗(BLE)多点连接断开问题时,一项更值得警惕的发现浮出水面:有网站会通过 Web Audio API 创建几乎听不见的音频流,并分析设备音频链路的处理差异,用来区分用户设备。来源摘要指出,AliExpress 采用了这类静默音频流进行设备指纹识别。 这件事的重点不在于网页是否真的播放了“声音”,而在于浏览器、操作系统、驱动和音频硬件共同...

SpaceX 收购 Cursor 后,OpenAI 终止模型供应合同意味着什么

来源: openai.com 39
OpenAI 已决定在 Cursor 被 SpaceX 收购后,逐步结束向 Cursor 提供 OpenAI 模型的合同。这个决定的核心并不是某个 API 参数变化,而是一次供应关系变化:依赖 Cursor 中 OpenAI 模型能力的团队,需要重新评估模型可用性、配置方式、合同边界和迁移成本。 目前公开信息只表明 OpenAI 将结束相关合同,并没有...

从 AI 原型到可信产品:泰国初创公司加速器的落地启示

来源: openai.com 46
OpenAI 与泰国高等教育、科学、研究与创新部(MHESI)启动了一项为期八周的加速项目,帮助 10 家健康、 wellness 和教育领域的初创公司,把 AI 原型推进为值得用户信任的产品。这个消息的重点不只是“更多创业团队开始使用 AI”,而是产品开发的评价标准正在变化:能运行的演示只是起点,能解释、能审计、能在边界条件下保护用户的系统,才更接近...