2026-07-18
来源: infoq.com
33
企业数据接入 AI Agent,真正棘手的部分往往不是“能不能检索到文档”,而是 Agent 能否理解业务对象、关系、规则和当前状态。Pinecone Nexus 现已正式可用,定位为面向 AI Agent 的知识引擎:它把企业数据转换为 Agent 可以直接查询的结构化层,让业务语境能够被一次接入、整理并复用于多个 Agent。 这条路径的价值很明确...
2026-07-18
来源: infoq.com
43
Dolt 2.0 是开源版本化 SQL 数据库的一次重要升级。它把数据库的 Git 式版本管理能力,进一步延伸到存储生命周期管理:自动垃圾回收和压缩可以减少长期运行后的存储膨胀,同时新版也改进了对大型数据类型和向量数据的支持。 这意味着 Dolt 不再只是“能提交、能分支、能合并的 SQL 数据库”。对于需要保留历史版本、审计数据变化,或者管理机器学习...
2026-07-18
来源: infoq.com
34
Dolt 2.0 为开源版本控制 SQL 数据库带来了一次重要升级。它不只是继续提供类似 Git 的数据库分支、提交和合并能力,还开始自动处理长期运行数据库常见的存储问题:回收不再需要的数据、压缩存储内容,以及更好地承载大型数据和向量数据。 这意味着 Dolt 的使用重点可以从“如何保存每一次数据库变更”,进一步延伸到“如何让变更历史在持续增长后仍然可...
2026-07-18
来源: netflixtechblog.com
48
把大语言模型接入公司内部系统,难点通常不在于启动一个推理进程,而在于让它像数据库、消息队列一样成为稳定的基础设施:调用方不必关心模型部署在哪里,平台团队能够控制成本、延迟和权限,业务团队也能持续替换模型而不重写应用。围绕 “In-House LLM Serving at Netflix” 这一主题,可以把内部 LLM Serving 理解为一套完整的平...
2026-07-18
来源: aws.amazon.com
42
销售团队真正稀缺的资源不是数据,而是销售人员的时间。Amazon Quick 所描绘的 agentic AI 队友,重点不只是生成邮件,而是贯穿销售周期:找出优先级最高的潜在客户、准备触达内容、推进交易、协助成交,并在客户关系成熟过程中持续更新 CRM。 这种工作方式的价值在于把多个孤立动作组织成一条可执行链路。不过,企业要把这一思路落地,仍需明确数据...
2026-07-18
来源: cloud.google.com
35
Gemini Enterprise Agent Platform 展示的 13 个动手演示,不只是 13 个彼此独立的样例,而是一条完整的工程路径:用 ADK 编写智能体,通过 MCP 和 A2A 接入工具与其他智能体,部署到托管运行时,再补齐持久状态、安全治理、可观测性和持续评估。 真正值得关注的变化,是智能体开发开始从“写一个能回答问题的提示词”转...
2026-07-18
来源: cloud.google.com
43
Google Cloud 近期发布的信息覆盖 Cloud Run、Apigee、MCP、TPU、GKE、Firestore 和成本管理,但主线相当清晰:企业关注点已经从“模型能否完成任务”转向“Agent 能否被隔离、观测、治理并稳定扩缩容”。这意味着 AI 应用不再只是一个调用模型的 Web 服务,而是一套包含提示词构建、工具授权、代码沙箱、流量治理...
2026-07-17
来源: huggingface.co
38
图像与视频生成模型的微调,难点通常不在“让训练脚本跑起来”,而在于把单卡实验稳定扩展到多 GPU、多节点环境。围绕 NVIDIA NeMo AutoModel 与 Hugging Face Diffusers 的组合,可以把问题拆成两层:Diffusers 负责扩散模型、调度器和推理管线等模型语义,NeMo AutoModel 面向规模化训练所需的模型...
2026-07-17
来源: infoq.com
42
智能体 AI 带来的变化不只是模型更强,而是软件开始自主调用 API、操作数据并持续执行多步任务。CNCF 发布的技术分析提出了一个务实判断:支撑这类系统的关键能力,不必从零发明;现代分布式应用已经使用的云原生生态,可以继续承担调度、隔离、可观测性、安全策略和故障恢复等职责。 一个生产级智能体通常包含模型推理、工具调用、状态存储、任务队列和外部服务访问...
2026-07-17
来源: openai.com
41
企业评估 AI 项目时,最容易统计的是模型调用次数、Token 消耗和活跃用户数,但这些数字并不直接等于业务价值。Sarah Friar 提出的 AI 记分卡把注意力拉回四个更接近经营结果的维度:完成了多少有用工作、每个成功任务花费多少、系统是否可靠,以及算力投入带来了多少回报。 这套框架的价值不在于制造一个漂亮的总分,而在于让产品、工程和财务团队使用...