标签

全栈

Docker VMM:Docker Desktop 重写虚拟化层,面向容器重新优化开发体验

来源: infoq.com 40
Docker Desktop 的性能和稳定性,很大程度上取决于底层虚拟化层。Docker 现在推出 Docker VMM,将原本依赖的第三方虚拟化组件替换为由 Docker 自己控制和优化的虚拟机监控器,目标是让虚拟机行为更贴近容器工作负载。Docker VMM 已随 Docker Desktop 4.86 在 Mac 和 Windows 上开启公开 ...

当模型终于学会放下疫情:我们如何判断 COVID-19 已经结束

来源: medium.com 55
判断 COVID-19 是否“结束”,并不只是看某一天的感染人数下降。更难的问题是:当世界的行为、数据分布和风险结构都发生变化后,过去训练出来的模型是否仍然在描述现实。 这个问题的关键不在于模型还能不能预测,而在于它是否还在用已经失效的经验预测。疫情期间形成的数据规律可能来自封控、口罩、检测政策、就医行为和媒体关注度。当这些条件改变,模型就必须学会放下...

在 Google Cloud 上运行 Serverless Apache Spark:架构选择、成本调优与 AI 故障排查

来源: cloud.google.com 50
Apache Spark 仍然是企业级大数据处理的核心工具,但集群创建、YARN 调优、节点扩缩容以及闲置计算资源,会把数据工程团队拖入基础设施运维。Google Cloud 的 Managed Service for Apache Spark 提供了托管集群和 Serverless 两种路径,让团队可以根据工作负载、生态依赖、延迟要求和成本模型做出更...

AI 换台电脑就失忆?用开源同步把 Agent 上下文带走

来源: oschina.net 36
如果你同时使用 Hermes、Codex、opencode 等 AI 工具,很容易遇到一个具体而烦人的问题:白天在公司电脑上和 AI 讨论了几个小时,晚上回到家,换一台电脑后,AI 又像第一次见面一样。 这不是模型突然变笨了,而是上下文通常被保存在当前设备、当前目录或当前工具的本地环境里。设备一换,之前积累的对话、项目约定和工作状态也就跟着丢了。 ag...

WhatsApp 如何在不上传消息内容的前提下检测诈骗

来源: infoq.com 45
WhatsApp 正在有限范围内测试 Scam Alert:当非联系人发来消息时,设备端机器学习模型会判断其中是否存在潜在诈骗风险。真正值得关注的不只是分类模型,而是围绕模型建立的隐私架构:消息内容留在设备上,性能评估和模型交付则结合机密计算、Oblivious HTTP、差分隐私与模型透明度机制。 把模型放到手机上运行,可以避免将原始消息发送到服务器...

WhatsApp 如何用端侧机器学习识别诈骗,同时避免上传消息内容

来源: infoq.com 42
WhatsApp 正在有限范围内测试 Scam Alert:当陌生联系人发来消息时,端侧机器学习模型会判断其中是否存在潜在诈骗风险。这个方案值得关注的地方不只是“把模型放进手机”,而是如何在消息内容留在设备上的前提下,完成模型效果评估、遥测统计和模型交付。 根据公开摘要,这套架构组合了端侧推理、机密计算、Oblivious HTTP、差分隐私和模型透明...

从“囤算力”到“调算力”:算力互联如何走向毫秒级供需匹配

来源: oschina.net 43
算力基础设施正在经历一次重心迁移:企业不再只关心有多少 GPU、建了多少机房,而是开始追问这些资源能否被统一发现、快速调度,并根据任务需求弹性供给。国务院《AI+行动意见》强调智能算力互联互通和供需匹配,工信部相关行动则把目标进一步落到“盘活存量、精准对接、弹性供给”和“毫秒用算”上。 在这一背景下,超智算科技(S·AIDC)、共绩科技与开源中国围绕算...

从局部故障到全局雪崩:分布式系统如何避免渐进式坍塌

来源: infoq.com 33
分布式系统最危险的故障,往往不是某个组件直接宕机,而是一个局部问题沿依赖关系持续扩散:请求开始排队,线程池被占满,重试放大流量,共享资源耗尽,最终让原本健康的服务也失去响应。Sam Newman 借用土木工程中的“渐进式坍塌”概念,把 1968 年 Ronan Point 大楼事故与 AWS 等软件系统故障放在同一个分析框架中:局部损伤之所以演变成灾难...

GLM-5.3 跻身前沿模型区间:比 60 分更值得关注的是单任务成本

来源: oschina.net 34
智谱上线 GLM-5.3 API 后,最醒目的数字是 Artificial Analysis Intelligence Index 的 60 分。按照已公布信息,它与 Claude Fable 5、GPT-5.6 Sol 处于同一前沿区间,并与 Kimi K3 并列开源模型第一。不过,对真正需要部署编码代理、安全分析或长程任务系统的团队来说,评测分数只...