标签

LLM

AI 能力加速之后,安全政策窗口不能再等待

来源: openai.com 33
AI 模型的能力正在快速提升,但安全证据、行业标准和公共政策并没有自动同步。Chris Lehane 的核心判断是:当 AI 变得更强时,社会需要的不是更宽松的观望期,而是更有力、可验证、能持续执行的安全机制。当前政策窗口仍然打开,企业、研究机构和监管者需要把讨论转化为具体行动。 过去,AI 安全常被当作模型发布前的附加检查:做一次红队测试,写一份风险...

GPT-6 Astra:面向企业工作的下一代智能模型

来源: openai.com 27
GPT-6 Astra 被定位为 OpenAI 面向企业场景的高能力模型,重点覆盖更强的推理、计算机操作,以及写作和设计判断。对开发团队而言,它的价值不只是“回答问题更准确”,而是能否进入真实工作流:理解复杂目标、操作工具、产出可审阅结果,并在关键步骤保留人的控制权。 传统模型通常以文本问答为边界:用户描述任务,模型返回一段文字。具备计算机使用能力的模...

Muse 把个人 AI 智能体搬进后台:关掉 App,任务为什么还能继续跑

来源: oschina.net 33
聊天窗口关闭,通常意味着一次 AI 交互结束。Meta 发布的个人 AI 智能体 Muse 试图改变这条默认规则:用户可以让它持续关注天气等外部条件,即使退出应用,任务仍会在后台运行。Muse 已登陆 App Store 和 Google Play,也可以通过 WhatsApp 使用。 真正值得开发者关注的并不是又多了一个聊天入口,而是它采用了一种更接...

Istio 1.29 将于 2026 年 10 月 12 日停止支持:现在就该规划升级

来源: istio.io 34
Istio 1.29 的支持将在 2026 年 10 月 12 日结束。届时,维护团队将不再把安全修复和关键缺陷修复回移到 1.29 分支。集群不会在这一天突然停止工作,但继续运行 1.29,会让团队在下一次严重漏洞出现时陷入被迫紧急升级的局面。 Istio 的次要版本支持周期持续到 N+2 版本发布后的六周。对 1.29 来说,N+2 是 1.31;...

React 19.3:View Transitions、Fragment Refs 与更安全的浏览器集成

来源: react.dev 30
React 19.3 带来了一组面向现代浏览器和复杂 UI 的新能力,包括 View Transitions、Fragment Refs、 和 Trusted Types。它们覆盖了页面切换动画、Fragment 级 DOM 操作、浏览器环境处理以及客户端安全策略。升级的重点不只是改版本号,而是确认应用的构建链、浏览器兼容策略和安全配置能否承接这些能力...

别只盯着基准分数:用自适应智能体推进科研探索

来源: azure.microsoft.com 24
对研发组织来说,智能体 AI 的价值不只是把某个基准测试再提高几分,也不是针对一个问题生成一次看似完整的答案。更值得关注的变化,是让 AI 参与持续探索:并行维护多个假设,用实验和文献证据检验它们,记录失败,从新信息中调整下一步行动。 这更接近真实的科学与工程工作。研究过程通常没有固定路线,好的系统必须知道何时继续深挖、何时补充证据,以及何时停止一条低...

在 SageMaker HyperPod 上扩展潜空间推理:解读 Pathway 的 BDH 架构

来源: aws.amazon.com 30
大语言模型通常把“思考过程”展开成一串 chain-of-thought(CoT)文本,而 Pathway 的 Baby Dragon Hatchling(BDH)选择了另一条路线:让推理发生在潜空间中,不必逐步输出推理 token。这种脑启发、后 Transformer 架构不仅改变了推理接口,也改变了训练、评测和基础设施优化的重点。Pathway ...

让模型在潜空间里思考:Pathway 如何在 SageMaker HyperPod 上开发 BDH

来源: aws.amazon.com 20
大语言模型通常通过不断生成 token 来展开推理,而 Pathway 的 Baby Dragon Hatchling(BDH)选择了另一条路线:它是一种受大脑启发的后 Transformer 架构,在潜空间中进行推理,而不是把完整的思维链逐 token 输出。这个变化不仅影响模型结构,也会改变训练、扩展和成本评估的方式。 Pathway 在 Amaz...

Kubernetes v1.37 工作负载感知调度:从 Pod 逐个排队到分层 Gang Scheduling

来源: kubernetes.io 41
AI 训练、分布式推理和复杂批处理任务很难用“每个 Pod 独立调度”的模型表达。一个包含 8 个 worker 和 1 个 driver 的训练任务,即使先启动了 3 个 worker,通常也无法产生有效进展,反而会长期占用 GPU、网络和 DRA 资源。 Kubernetes v1.37 继续推进 Workload-Aware Scheduling...

Termexo v0.8.3:让多 Agent 并行时的终端输入更跟手

来源: oschina.net 16
Termexo v0.8.3 已经发布。这次更新没有把重点放在增加更多 Agent,而是处理多任务工作台更容易暴露的两个体验问题:终端输入卡顿,以及任务启动后难以继续补充要求。对于同时运行 Claude Code、Codex CLI、OpenCode 和普通终端的 Windows 用户,这类优化往往比新增一个按钮更直接。 Termexo 是一个采用 M...