标签

AI

空客把“域外法律风险”写进云采购评分表,主权云开始从口号变成控制项

来源: infoq.com 29
空客在云服务招标中,不只比较计算能力、可靠性和价格,还把抵御非欧洲域外法律影响的能力纳入评分,并最终选择 Scaleway 作为主权云供应商。这个决定并不意味着空客退出 AWS,而是用主权云补充现有多云架构。真正值得工程团队关注的变化,是“数据放在哪里”正在升级为“谁能依法要求访问数据、谁控制密钥、谁能操作控制平面”的系统性问题。 把工作负载部署在欧洲...

用 LangChain4j 构建代码智能体:Supervisor 与 Workflow 的调试取舍

来源: infoq.com 25
让代码智能体自己编写、测试并修复代码,难点通常不在于一次模型调用,而在于如何组织多轮行动。围绕 LangChain4j 文档进行的这项实验表明,智能体框架的架构选择会直接影响调试任务的执行速度、可控性和应对异常的能力。 实验聚焦于一个能够自主完成“写代码、跑测试、定位问题、修改代码、再次验证”的编码框架。其中值得关注的是两种常见组织方式:由中央决策者协...

从菲尔兹奖到 OpenAI:Tsimerman 转向 AI 安全意味着什么

来源: oschina.net 39
2026 年国际数学家大会公布本届菲尔兹奖得主后,雅各布·齐默尔曼(Jacob Tsimerman)宣布加入 OpenAI,并把研究方向转向 AI 安全。与一般的人才流动不同,这次转向值得开发者关注:前沿 AI 的问题已经不只是继续扩大模型,而是如何定义、验证并约束复杂系统的行为。 AI 安全包含许多不同层次的问题:模型是否遵循指令,是否会在压力测试中...

Wow v8.9.0:从获奖认可到可靠性全面进化

来源: oschina.net 23
Wow v8.9.0 正式发布。这个版本不只是一次功能更新,更集中展示了项目在核心可靠性、事件存储、消息基础设施、BI / ClickHouse 以及开发者体验上的阶段性演进。同时,Wow 荣获 KaiCode’26 Excellent Award(优秀奖),这份认可来自社区,也属于每一位使用、反馈和参与建设的开发者。 从版本摘要来看,v8.9.0 的...

Tails 7.10 改用 GNOME 标准关机流程:用 60 秒换取更可靠的数据保护

来源: oschina.net 25
Tails 7.10 调整了一个每天都会遇到、却很容易被忽视的环节:系统关机。新版采用 GNOME 的标准关机流程,关机速度可能比过去稍慢,但系统会更明确地提醒用户关闭应用程序、保存仍在编辑的文档,从而降低数据丢失风险。 旧式快速关机的优点很直接:操作完成后,系统迅速退出。问题在于,桌面应用可能仍有未写入磁盘的数据,例如尚未保存的文档、正在导出的文件,...

封禁开源 AI 模型,为什么可能先压垮依赖它们的初创公司

来源: oschina.net 22
近 200 家硅谷初创企业联名致信白宫,呼吁不要切断美国开发者获取中国开源 AI 模型的渠道。Particle 创始人 Suhail Doshi 的判断很直接:如果封禁突然落地,可能会有数百家公司迅速失去生存基础。 这场争论不只是模型来自哪个国家,也不只是开源与闭源之争。对依靠推理成本、模型可部署性和供应商竞争生存的初创公司来说,限制模型访问会直接改写...

Jotai v2.20 重整 Store 内核:优化高频更新,并为 v3 铺路

来源: infoq.com 35
Jotai v2.20.0 的重点不是增加一批面向业务的新 API,而是重整 Store 的内部构建模块,修复此前出现的性能回退,并改善高吞吐场景下的执行效率。普通 React 应用可以继续使用熟悉的 atom、useAtom 和 Provider;真正需要仔细检查升级影响的,是封装 Jotai Store、扩展底层能力或向其他项目提供状态工具的库作者...

Flux3 把声音带进生成主链路:多模态模型开始走向统一世界建模

来源: oschina.net 33
德国人工智能初创公司黑森林实验室(Black Forest Labs)发布了多模态基础模型 Flux3。与只生成图像或无声视频的模型不同,Flux3 基于 Self-Flow 架构,并为图像、视频、音频和动作配置专用编解码器,试图在同一套模型中理解和生成物理环境与数字环境。 更值得关注的是原生音频生成。根据发布摘要,Flux3 能一次生成最长 20 秒...

从 ReAct 循环到 Agent Harness:把模型行为变成可恢复的产品能力

来源: my.oschina.net 30
ReAct 解决了一个关键问题:让模型在“思考、行动、观察”的循环中调用工具并逐步完成任务。但当 Agent 进入真实产品,团队面对的不再只是模型能否完成任务,而是用户能否看见进度、暂停执行、确认高风险操作、从故障中恢复,并追溯每一步发生了什么。 这时,工程重心会从模型循环转向 Agent Harness。Harness 不是另一套推理方法,而是包围模...

微软两款自研模型进入公开预览:如何评估 MAI-Image-2.5-Pro 与 MAI-Voice-2-Flash

来源: oschina.net 22
微软宣布推出两款自研 AI 模型:面向高质量图像生成与编辑的 MAI-Image-2.5-Pro,以及面向语音场景的 MAI-Voice-2-Flash。两者目前都已进入公开预览阶段,意味着开发团队可以开始围绕真实业务流程进行验证,而不必只停留在模型能力演示。 这次发布值得关注的地方,不只是“又多了两个模型”,而是微软同时覆盖了图像质量和语音交互两类常...