标签

AI

AI 正在重画岗位边界:从替代单项任务到扩展个人能力

来源: openai.com 27
关于 AI 与工作的讨论,常被压缩成一个问题:它会替代哪些岗位?新的 OpenAI 研究提供了另一个观察角度:ChatGPT 用户正在跨越原有角色分工,承担过去较少接触的任务。变化的重点不只是把现有工作做快,而是扩大一个人能够完成的任务范围,并由此重新塑造岗位边界。 来源摘要没有给出行业占比、效率增幅或因果关系,因此不能据此断言 AI 已经普遍提升生产...

AI 训练存储选型:GPFS、Alluxio 与 JuiceFS 的架构差异和适用边界

来源: my.oschina.net 36
AI 存储选型不能只比较顺序吞吐量。数据加载、检查点保存、模型分发和特征读取会产生完全不同的 I/O 模式,而 GPFS、Alluxio 与 JuiceFS 解决问题的出发点也并不相同:GPFS 更接近高性能并行文件系统,Alluxio 侧重数据编排与缓存加速,JuiceFS 则以元数据服务和对象存储组合出分布式文件系统。 因此,这三者不是简单的同类替...

DataBuff v0.1.5:写入性能升级后,如何验证 OTLP 链路是否真正受益

来源: oschina.net 26
DataBuff v0.1.5 的核心变化指向写入性能。该版本相对 v0.1.4 包含 25 个提交,继续围绕云原生与微服务场景完善其 AI Native OpenTelemetry APM 能力:通过 OTLP 接入遥测数据,以 Apache Doris 统一存储,并在 Web 端提供服务拓扑、Trace、指标和多 Agent 排障能力。 对于已经接...

MineExplorer:把多模态大模型放进开放世界,重新检验长程规划能力

来源: tech.meituan.com 24
许多多模态评测像一场开卷考试:模型看到一张图片,回答一个问题,几秒内结束。但真实世界并不会把所有条件整齐地摆在上下文里。智能体需要持续观察环境、记住早先发现的信息、识别隐藏的前置条件,并在行动失败后调整计划。美团 LongCat 团队构建的 MineExplorer,正是为了把评测从这种相对静态的“温室”搬到动态开放世界中。 MineExplorer ...

当搜索评测不再拉开差距:LoHoSearch 如何用知识图谱重新校准智能体能力

来源: tech.meituan.com 24
过去一年,Search Agent 在 BrowseComp 等评测上的准确率从约 30% 快速提升到 90% 以上。这个数字说明模型进步很快,也暴露出一个评测难题:当大多数强模型都能取得高分,基准便难以继续区分它们的搜索、推理和证据组织能力。 美团开源 LoHoSearch,试图用知识图谱校准我们对搜索智能体能力的判断。它值得关注的不只是更难的题目,...

拆解前沿实验室智能体入侵:如何重建时间线、权限链与工具调用证据

来源: huggingface.co 13
来源标题将事件标记为“2026 年 7 月的前沿实验室智能体入侵”,但没有提供事件摘要、日志、受影响系统或处置结论。因此,本文不推测攻击者身份和具体入侵步骤,而是给出一套可落地的分析方法:面对具备模型推理、工具调用、长期凭证和外部连接能力的智能体系统,安全团队应如何重建技术时间线,并区分模型行为、控制平面操作与攻击者活动。 传统 Web 服务的调查通常...

ZGI 上线 Gitee:把 Agent 从演示原型带进可执行、可追踪的运行时

来源: oschina.net 24
创建一个能调用模型、工具和知识库的 Agent,通常只是工程的起点。进入真实环境后,团队还要回答一组更棘手的问题:任务由谁执行,失败后如何处理,运行过程怎样追踪,多个 Agent 又该如何统一管理。Agent Runtime 项目 ZGI 正式同步上线 Gitee,并开放源代码与部署文档,关注的正是 Agent 从 Demo 走向长期运行的这段距离。 ...

PixelSmash:一个恶意视频如何借 FFmpeg MagicYUV 解码器攻击电脑

来源: infoq.com 20
JFrog Security Research 披露了 FFmpeg 媒体框架中的 PixelSmash 漏洞。问题位于 MagicYUV 解码器,可能导致远程代码执行(RCE)或拒绝服务(DoS),并且据披露已存在约十六年。攻击者不需要复杂的网络交互:只要让目标应用处理一个特制媒体文件,就可能触发漏洞。 真正需要关注的不只是 FFmpeg 命令行工具...

Postgres 激进特性为何应该先在分支版本中经受真实负载

来源: postgr.es 38
Postgres 的竞争力不只来自某项查询优化技术。对大量生产用户而言,更重要的是开源、没有厂商锁定、维护路径清晰,以及出现问题时总能找到理解内核的人。它未必在每种负载下都最聪明,但通常足够可靠、足够可预测。 这也解释了为什么一个看起来很有价值的新特性,很难直接进入 Postgres 核心。核心代码承载着关键业务数据,每增加一条执行路径,社区就要长期承...