2026-07-20
来源: oschina.net
28
DBeaver 26.1.3 已发布。这个版本继续围绕 AI 助手和日常数据库开发体验进行调整,重点包括 AI Engine 响应等待时间设置、GitHub Copilot 免费版模型列表修复、Engine 设置界面重新设计,以及将 GPT-5 设为 OpenAI 默认模型。对于把 DBeaver 同时当作数据库客户端和 AI 辅助工具使用的开发者来说...
2026-07-17
来源: openai.com
40
企业评估 AI 项目时,最容易统计的是模型调用次数、Token 消耗和活跃用户数,但这些数字并不直接等于业务价值。Sarah Friar 提出的 AI 记分卡把注意力拉回四个更接近经营结果的维度:完成了多少有用工作、每个成功任务花费多少、系统是否可靠,以及算力投入带来了多少回报。 这套框架的价值不在于制造一个漂亮的总分,而在于让产品、工程和财务团队使用...
2026-07-17
来源: oschina.net
43
OpenAI 的第一款自有品牌硬件没有选择手机或 AI 陪伴设备,而是瞄准了一个非常具体的开发场景:用手掌大小的可编程键盘控制 AI 编程 Agent。Codex Micro 由 OpenAI 与加拿大键盘厂商 Work Louder 合作设计,定价 230 美元,面向 Codex 用户提供 13 个矮轴按键。 这款设备值得关注的地方不只是多了几个快捷...
2026-07-17
来源: openai.com
27
生成式 AI 已经进入青少年的学习、创作和信息检索过程。真正需要解决的问题,不再是青少年会不会使用 AI,而是产品能否提供与年龄相匹配的保护,同时保留探索、提问和学习的空间。 围绕这一目标,OpenAI 正在从适龄保护、学习工具、家长控制和专家合作几个方向提高 ChatGPT 对青少年的安全性。这些措施指向同一个产品原则:青少年账户不能只是成人账户的缩...
2026-07-16
来源: oschina.net
34
OpenAI 发布 GPT-5.6 系列时,没有只推出一个通用模型,而是同时给出旗舰 Sol、均衡型 Terra 和经济型 Luna 三个层级。这种产品结构会直接改变应用架构:开发者不再只是决定“要不要调用 GPT-5.6”,而要在每次请求进入系统时判断任务难度、延迟目标、失败成本和预算上限。 已披露的价格中,Sol 的输入与输出价格分别为每百万 to...
2026-07-16
来源: openai.com
35
当语音与聊天机器人从演示环境进入真实业务,挑战便不再只是“模型能否回答问题”,而是能否稳定承接海量会话、识别高价值线索,并把复杂任务安全地交给企业系统。Cars24 使用 OpenAI 驱动的语音和聊天智能体,每月处理超过 100 万分钟的对话,并追回了 12% 的流失线索;与此同时,智能体工作流也开始进入公司内部的更多团队。 汽车交易会话通常横跨多个...
2026-07-15
来源: openai.com
33
美国的 AI 治理并不只有“联邦统一立法”这一条路。OpenAI 提出的“反向联邦主义”思路,是让州级法律先形成可观察、可比较的治理实践,再把其中有效的规则汇入全国框架。它试图同时保留地方试验的速度,以及国家标准所需的一致性与民主问责。 传统联邦主义通常从联邦政府划定边界,再由各州在边界内实施。这里的方向有所不同:州政府先针对现实问题制定规则,联邦层面...
2026-07-15
来源: openai.com
19
传统红队测试往往依赖人工编写攻击提示词:测试人员找到一个越狱或提示注入样本,模型团队修复,再开始下一轮。GPT-Red 展示了另一条路线:让自动化攻击者通过自博弈持续探索失败案例,并把测试结果反馈到后续攻击与防御中。这种机制关注的不只是单次攻击成功率,更重要的是能否形成可重复、可扩展的安全改进闭环。 人工红队的价值很高,尤其擅长发现依赖语境、社会工程和...
2026-07-14
来源: openai.com
26
企业进入智能体时代后,AI 成本不再只是一次模型调用的价格。一个智能体可能规划任务、查询系统、调用工具、反复重试,最后还需要人工审核。此时,只看 token 单价、调用次数或演示效果,很容易低估成本,也无法回答管理层真正关心的问题:每投入一美元,究竟完成了多少可用工作? 更合适的管理单位是“每美元有效工作量”。它把业务结果、质量门槛和全链路成本放在同一...
2026-07-14
来源: aws.amazon.com
31
OpenAI 的 GPT-5.6 Sol、Terra 和 Luna 现已在 Amazon Bedrock 正式可用。这意味着 AWS 用户可以通过 Bedrock 的推理基础设施使用这一模型家族,并沿用云平台提供的安全、可靠性与运维能力。对开发团队而言,真正需要解决的问题不是“多了三个模型名称”,而是如何确认区域与模型标识、建立统一调用层,并用数据决定...