2026-06-01
来源: oschina.net
40
OpenAI 推出 协议后,Codex CLI、各类开发者 Agent 纹纷跟进适配。问题在于——DeepSeek、MiniMax、智谱、小米等国产模型只暴露 Chat Completions API,协议不对齐,工具链直接断路。GodeX 做的事很明确:在中间当翻译层,把 Chat Completions 的请求/响应结构桥接成 OpenAI Res...
2026-06-01
来源: oschina.net
52
DBeaver 作为开源通用数据库工具,几乎是开发者桌面上的常驻软件。26.1 版本虽然不是大版本跳跃,但几处改动直击日常痛点——SQL 编辑器新增双花括号参数语法、AI 助手接入 OpenAI Codex 模型、元数据编辑器修复了刷新后计数消失的 bug。这些看似零散的更新,合在一起让"写 SQL、调数据、查结构"这条主线更顺畅。 此前 DBeave...
2026-06-01
来源: oschina.net
44
OpenAI 的 Codex CLI 和一系列开发者 Agent 工具正在快速铺开,但它们都绑定在 OpenAI 的 Responses API 上。国内开发者手里有 DeepSeek、智谱、MiniMax、小米等模型的 API Key,却因为接口格式不同,没法直接接入 Codex 生态。GodeX 1.0.0 的发布,本质上就是解决这个"最后一公里"...
2026-05-29
来源: openai.com
44
罕见病的诊断平均耗时 5-7 年,患者往往辗转多家医院、经历数十次误诊。波士顿儿童医院近期披露:借助 OpenAI 技术,他们已成功辅助诊断超过 40 例罕见病,同时减轻了临床团队的运营负担。这不是一个"AI 替代医生"的故事,而是一个"AI 把人类专家从信息沼泽里拉出来"的工程实践。 罕见病单病种发病率极低,但总数超过 7000 种,累及全球约 3 ...
2026-05-29
来源: openai.com
33
客户提了一个需求,工程师打开 IDE,从零开始写代码——这条路径在 AI 时代正在被压缩。Braintrust 团队最近分享了他们如何用 OpenAI 的 Codex 配合 GPT-5.5,把客户请求快速转化为可运行的代码,并在自己的评估平台上完成实验闭环。 这不是"AI 写代码然后人盲审"的粗糙流程,而是把 Codex 嵌进需求→代码→验证的完整链路...
2026-05-29
来源: openai.com
27
OpenAI 正式发布 Rosalind Biodefense 项目,将此前内部使用的 GPT-Rosalind 模型向经过审核的开发者和美国政府合作伙伴开放。这标志着前沿 AI 从通用对话场景,正式进入生物防御、公共卫生和疫情准备这类高敏感、高门槛领域——模型能力不变,但访问机制、使用边界和合作方资质都截然不同。 生物防御场景的数据和处理逻辑有几个鲜...
2026-05-29
来源: openai.com
36
前沿 AI 模型的能力越来越强,但"强到什么程度"和"安全到什么程度"不能只靠模型厂商自己说了算。OpenAI 近期公开了一份面向第三方评估者的实践手册(playbook),系统梳理了如何对前沿模型做可信的外部评估——覆盖能力探测、安全护栏验证、评估有效性三个核心维度。这份手册不是空泛的原则声明,而是给出了具体的评估流程、指标设计和常见陷阱提醒,对任何...
2026-05-28
来源: openai.com
33
软件交付中最慢的环节往往不是写代码,而是把模糊的业务需求拆解成可执行的技术任务。Endava 近期分享的工程实践给出了一个极具冲击力的数字:借助 Codex 打造“代理式组织”,他们将需求分析周期从几周压缩到了几小时。 这不再是 IDE 里按 Tab 键补全代码的单点提效,而是整个交付链路的重构。当 Agent 拥有规划能力,开发团队的工作流、分工阵型...
2026-05-28
来源: oschina.net
35
融资轮次越来越大,模型参数越来越多,发布会越来越密集——但一家公司到底有没有找到产品市场契合(PMF),答案不在新闻稿里,而在用户每月续费的账单上。开发者 Simon Willison 最近提出了一个朴素但有力的判断:Anthropic 和 OpenAI 已经实际达到了 PMF,依据不是估值,而是用户愿意付多少钱、实际用了多少次。 这个判断值得认真拆开...
2026-05-28
来源: openai.com
44
2024 年,EU AI Act 正式落地,加州 SB 1047 等州级法案也在加速推进。前沿模型的能力边界每推一步,合规压力就紧一步。OpenAI 此刻公开其 Frontier Governance Framework,本质上是在回答一个问题:模型能力分级、风险评估和安全干预,能不能变成一套可操作、可审计的工程流程,而不是事后公关稿? 下面拆解这套框...