来源: aws.amazon.com
107
NVIDIA Nemotron 3 Ultra 正式登陆 Amazon SageMaker JumpStart。对于正在构建 Agentic AI 工作流的团队来说,这个消息值得关注:官方数据显示,该模型在推理任务上可实现约 5 倍加速、成本降低约 30%。这意味着原本需要多轮调用、链式推理的 Agent 场景,有了更经济的模型选择。 Nemotron...
来源: oschina.net
63
做过内容型产品的人都知道,图片处理这块"小事"能吃掉大量工程时间。用户上传一张 5MB 原图,手机端要 400px 宽的 WebP 缩略图,桌面端要 1200px 的 JPEG,海外用户还希望把图片里的中文说明翻译成英文——每一条需求背后都是一套裁剪、转换、存储、缓存逻辑。ImgFlux v0.1 把这些能力打包成一个读写分离的微服务,Docker C...
来源: blog.cloudflare.com
107
前端工具链的核心团队 VoidZero——Vite、Vitest、Rolldown、Oxc 和 Vite+ 的缔造者——正式加入 Cloudflare。这不是一次简单的"公司被收购",而是整个 JavaScript 构建生态的一次重心迁移。对每天在终端里跑 的开发者来说,最关键的问题只有一个:Vite 还是我的 Vite 吗? VoidZero 手里握...
来源: postgr.es
82
大多数被归咎于"数据库挂了"的 PostgreSQL 宕机,真正的故障点在更底层——内核的文件描述符(file descriptor)用完了,PostgreSQL 只是第一个倒下的进程。这篇文章拆解整个故障链路:从连接数膨胀到 FD 耗尽,从日志特征到诊断命令,再到根治方案和临时止血手段。 Linux 内核把几乎所有 I/O 对象都抽象为文件描述符:T...
来源: infoq.com
58
数据中心网络架构十几年来几乎没变过——胖树(fat-tree)是默认选项。AWS 最近公开了一项已经落地的大改动:他们用基于准随机图理论的扁平网络架构替代了胖树,新架构叫 Resilient Network Graphs,已经成为大多数新建数据中心的默认方案。路由器数量直接砍掉 69%,吞吐量提升 33%,网络功耗降低 40%。这不是论文里的设想,是已...
来源: aws.amazon.com
57
大规模运行 Bedrock 上的生成式 AI 应用时,运维团队很快会遇到一个棘手问题:告警太多、阈值太死、工单重复创建,SRE 散落在各处的通知缺乏上下文。Amazon Bedrock Ops Alert 正是为了解决这些痛点而设计的三层自动化监控方案——它不只是"检测→通知"的流水线,而是把阈值自适应、告警分类、工单去重和上下文推送串成一条自驱闭环。...
来源: aws.amazon.com
55
架构团队最常遇到的困境不是"没有需求",而是需求太多、每个都紧急、每个都重要。产品要新功能,运维要稳定性,安全要合规,基础设施要升级——所有倡议挤在一起,谁先谁后全靠嗓门大小。Tech Roadmap Prioritization(TRP)就是为解决这个问题设计的:一小时、一张矩阵、一群利益相关方,产出一份可执行的架构 backlog。 TRP 的关键...
来源: aws.amazon.com
63
表格数据是企业里最常见的数据形态——客户画像、交易流水、设备日志,几乎都落在结构化表格里。传统做法是逐任务训练 XGBoost 或 LightGBM,每个模型只管一个场景,换个任务就要重新调参。Fundamental 推出的 NEXUS(Large Tabular Model)试图用"预训练 + 微调"的范式把表格数据也拉进大模型路线:先在海量表格数据...
来源: blog.cloudflare.com
53
互联网的路由系统建立在信任之上:BGP 默认相信邻居通告的一切。这种信任带来了两类常见攻击——路由劫持(hijack)和路径泄漏(path leak)。RPKI 通过验证前缀的起源 AS,堵住了部分漏洞,但它无法判断 AS_PATH 中间跳是否被伪造。一个更简单、更古老的机制填补了这个缺口:First AS Enforcement——检查收到的路由中,...
来源: aws.amazon.com
69
深度学习容器动辄数 GB,拉取镜像往往成为冷启动的瓶颈。AWS 推出的 SOCI(Seekable OCI)通过"懒加载"让容器不必等整个镜像下载完就能启动——镜像层按需拉取,启动后再后台补齐剩余数据。这篇文章聚焦如何在公开的 Deep Learning AMI(DLAMI)和 Deep Learning Containers(DLC)上使用 SOCI...