标签

AI

Blueking Lite 本周更新:CMDB 调度优化,加速大规模资产同步

来源: oschina.net 36
当 CMDB 管理的资产数量持续增长,采集任务堆积、同一任务重复执行以及自动关联速度下降,都会逐渐演变成数据延迟和资源浪费。本周 Blueking Lite 围绕 CMDB 的任务调度与大规模数据处理进行优化,重点降低任务堆积和重复执行风险,并提升资产同步及自动关联效率。 CMDB 采集通常连接云平台、虚拟化平台、网络设备或业务系统。一次采集可能包含拉...

AI 编程的 Token 经济学:用 11 条工程原则控制上下文、成本与偏航

来源: cloud.google.com 30
AI 编程助手接管了越来越多的代码输入工作,但工程师并没有因此卸下责任。新的核心任务是管理模型的注意力:让每次调用只读取必要上下文,选择与任务匹配的模型,并在自动化越界前及时止损。 Token 消耗并不只是账单问题。上下文膨胀会增加延迟,稀释关键指令,还可能让模型遗忘约束或产生幻觉。真正有效的优化,不是把提示词压缩到难以理解,而是建立一条短、清晰、可验...

生产级 AI Agent:从提示词实验走向平台、护栏与评测体系

来源: infoq.com 47
QCon AI Boston 2026 释放出的信号很明确:AI Agent 的工程重点正在从“怎样写出更好的提示词”转向“怎样让 Agent 在生产环境中稳定、可控、可评估地运行”。上下文管理、包围 Agent 的安全 harness,以及贯穿开发和上线流程的评测体系,开始成为真正决定系统质量的基础设施。 在原型阶段,团队往往把主要精力放在 syst...

Codex Micro:把 AI 编程 Agent 的常用操作搬到 13 键迷你键盘上

来源: oschina.net 45
OpenAI 的第一款自有品牌硬件没有选择手机或 AI 陪伴设备,而是瞄准了一个非常具体的开发场景:用手掌大小的可编程键盘控制 AI 编程 Agent。Codex Micro 由 OpenAI 与加拿大键盘厂商 Work Louder 合作设计,定价 230 美元,面向 Codex 用户提供 13 个矮轴按键。 这款设备值得关注的地方不只是多了几个快捷...

StaffDeck 开源:把企业数字员工从聊天机器人变成可维护的组织能力

来源: oschina.net 45
面壁智能联合东北大学-面壁智能数据智能联合实验室、清华大学 THUNLP 实验室、OpenBMB 与 AI9Stars 开源了企业数字员工平台 StaffDeck。它关注的不只是让 AI 接管重复沟通和标准化任务,而是数字员工从构建、运行到管理的完整过程:把散落在员工经验、业务文档和内部系统中的知识与流程,沉淀为可以维护、复用和持续改进的组织能力。 企...

从一纸投资公告,拆解 DeepSeek 超 3500 亿元估值是怎么算出来的

来源: oschina.net 41
开润股份(300577.SZ)7月16日晚间披露的一则关联投资进展公告,把 DeepSeek 的市场估值再次推到聚光灯下。按照公告中的出资额与持股比例推算,这家大模型公司的本轮融资后估值约为 3508.77 亿元。这个数字值得关注,但更重要的是看懂它的计算口径、成立条件,以及它与 IPO 定价、企业收入之间的区别。 私募融资中最常见的估值反推公式并不复...

Postgres 19 让手动 CHECKPOINT 从“立即全刷”变成可控操作

来源: postgr.es 29
在 Postgres 19 之前,手动执行 只有一种含义:立即处理所有待写页面,并在检查点完成后才把控制权交还给客户端。备份、升级和基准测试需要这种确定性,但在繁忙系统上,突然集中的写入也可能把存储延迟推高。 Postgres 19 为这条老命令增加了选项列表,并引入 与 。DBA 现在可以选择快速完成、平滑写入,或者明确要求检查点处理 unlogge...

Suno 泄露事件敲响警钟:AI 音乐训练数据必须可追溯

来源: oschina.net 33
据报道,生成式 AI 音乐平台 Suno 的内部源代码和数据采集信息遭到泄露。泄露材料被指显示,Suno 曾通过自动化程序从 YouTube Music、Deezer、Genius 等平台获取音乐、歌词和音频素材,用于训练 AI 音乐模型。由于现有摘要没有提供可独立核验的完整文件、采集规模和官方调查结论,具体指控仍应视为待验证信息;但事件暴露的工程问题...

把智能客服做成可控 Agent:从意图识别、工具调用到人工接管

来源: my.oschina.net 27
传统智能客服的主要矛盾已经不再是“能不能回答”,而是“能不能稳定解决问题”。听不懂用户意图时答非所问,遇到复杂任务时只会重复 FAQ,高峰期又无法有效分担人工压力。要从“机械应答”走向“服务伙伴”,关键并不是单纯换一个更大的模型,而是把客服 Agent 建设成一套边界清晰、过程可观测、结果可回退的工程系统。 一个可上线的客服 Agent,至少需要区分四...

跑得动大模型之前,先算清 AI 的显存账

来源: ruanyifeng.com 34
部署或训练 AI 模型时,参数量只是账单上的第一项。权重、KV Cache、中间激活、梯度、优化器状态和运行时工作区会在不同阶段争夺 GPU 显存。理解这些组成,才能回答三个实际问题:模型能否加载、请求能否达到目标并发、训练任务为什么突然 OOM。 由于来源摘要没有限定具体模型或框架,下面采用通用估算方法,并把代码明确作为可调整的实践示例。实际数字仍应...