OpenAI、AIRPPU 与 WAN-IFRA 联合发起了一项 AI 计划,目标是帮助乌克兰新闻机构增强创新能力、组织韧性与独立新闻实践。公告传递的重点不是用机器替代记者,而是让身处高压环境的编辑部获得更可持续的技术能力。 对新闻机构来说,引入 AI 的难点从来不只是模型效果。消息来源保护、事实核查、编辑责任、基础设施中断和供应商依赖,都会直接影响最...
AI 可以快速找出代码中“看起来危险”的模式,但发现疑点并不等于确认漏洞。缺少可达性分析、运行时验证和稳定复现时,扫描结果很容易被误报与模型幻觉淹没。Google 开源的 Mantis 试图把 AI 从单纯的告警生成器变成执行漏洞生命周期的智能体框架,覆盖识别、验证、复现和修复。 传统扫描流程通常停在静态告警:某个输入可能未过滤、某个依赖版本可能受影响...
Google 开源了 Mantis,一个覆盖软件漏洞生命周期的 AI Agent 框架。它处理的不只是“发现可疑代码”,还包括验证漏洞、构造复现方式以及辅助修复。这个方向直指 AI 代码扫描的核心问题:模型能够生成大量看似合理的安全报告,但其中可能混有误报,甚至完全由幻觉产生的漏洞。 传统静态扫描器通常根据数据流、规则或模式输出告警。引入大模型后,扫描...
AI 的能力正在快速增强,但能力提升并不会自动带来可靠、可控或符合人类意图的行为。Jakub Pachocki 用“异质心智”提醒我们:面对越来越强的模型,不能只观察它在基准测试中答对了多少题,还要考虑它如何理解目标、利用工具,以及在陌生环境中采取什么行动。 这让对齐问题从一项模型研究任务,变成了完整的系统工程问题。更强的模型需要更严格的权限边界、持续...
OpenAI 内部的早期观察显示,编码智能体正在改变 AI 研究的工作方式:它们不仅补全代码,还能承担实现实验、运行测试、分析失败和准备后续修改等连续任务。真正值得关注的变化,不是单次生成了多少代码,而是研究人员能否用更短时间完成更多可靠的实验闭环。 来源摘要没有披露具体数值,因此本文不推断采用率或加速倍数,而是讨论这些早期信号背后的工程含义,以及团队...