标签

LLM

一套灰盒生成三款主题游戏:Playco 如何用 GPT-6 Astra 减少 50% 手工修复

来源: openai.com 46
游戏原型开发的难点,往往不是把角色放进场景,而是反复补齐主题素材、交互规则、界面文案和配置之间的细小断裂。Playco 使用同一套灰盒基础,通过 GPT-6 Astra 构建了三款不同主题的游戏原型,并报告称,相比此前使用的模型,人工修复次数减少了 50%。 这个结果值得关注,但重点不只是“模型会写更多代码”。更有价值的变化是:团队可以把稳定的玩法结构...

Legora 如何用 GPT-6 Astra 在几分钟内审查 41 份财务文件

来源: openai.com 21
Legora 将 GPT-6 Astra 用于一项财务审查工作流:系统在几分钟内处理了 41 份文件,找出了全部 4 个预先植入的错误,并将该流程的性能提高了近 40%。这个案例的价值不只是“模型读得快”,而是展示了大模型如何进入高风险、强证据要求的专业审查环节。 不过,摘要没有说明“性能”具体指准确率、吞吐量、审查时间还是综合指标。因此,在评估这类结...

GPT-6 Astra 来了:先验证能力,再把新一代模型接入生产系统

来源: openai.com 28
GPT-6 Astra 被定位为新一代智能模型,重点覆盖计算机操作、编程、网络安全和科学任务,并强调更强的对齐能力。对工程团队来说,真正关键的不是发布描述中的“更智能”,而是它能否在真实工作流中稳定地产生可验证、可约束、可审计的结果。 目前给出的信息没有包含基准测试、上下文窗口、价格、延迟或正式 API 细节,因此下面的接入方式属于可改造的工程实践,不...

别再让员工偷偷用 ChatGPT:用内网网关把大模型变成公司的“自来水”

来源: oschina.net 36
企业接入大模型,最难的往往不是调用 API,而是建立秩序:谁在用、用了多少、数据去了哪里、预算是否失控,以及某个密钥泄露后能不能立刻止损。 一个可落地的开源思路,是在企业内网部署一层轻量 API 网关,例如 这类项目。员工和内部应用只访问网关,由网关统一管理模型密钥、用户令牌、用量统计和访问权限。大模型因此更像公司内部的水电服务:统一接入,按人发卡,用...

灵界 OS v3.1.2:存储管理上线,交互体验与安全性同步升级

来源: oschina.net 45
灵界 OS v3.1.2 已经发布。本次版本的重点不在于堆叠大量新功能,而是把系统日常使用中最容易被忽略的两件事做好:交互反馈更细腻,以及应用存储更加透明、可管理。同时,版本还修复了 3 个 Bug 和 1 个安全漏洞。 新版本在设置中加入了“存储管理”页面,用户可以查看 与 的使用情况,并进一步了解相机、录音、已安装应用等不同应用的存储详情。 这类功...

Google Cloud 的智能体时代底座:从 AI 全栈协同到动态基础设施与数字主权

来源: cloud.google.com 23
Google 表示,Gartner 已连续第九年将其列入战略云平台服务魔力象限的领导者,并在“愿景完整性”维度上处于最远位置。比排名更值得工程团队关注的,是 Google Cloud 对下一阶段云基础设施的判断:企业需要把模型、智能体、应用、数据和算力放进同一个可调度、可治理的平台,同时控制性能、成本与合规边界。 这套思路可以归纳为三个设计原则:软硬件...

Meta Muse Spark 1.3:百万级上下文背后的 21 倍定价差

来源: oschina.net 44
Meta 最新的 AI 模型 Muse Spark 1.3,把上下文窗口扩展到 100 万 token,并将产品重点放在长周期、多步骤的 agentic workflow 上。它可以处理视频、图片和文档等多模态输入,工具调用的一阶成功率也比前代更高,代码能力在多个评测中被描述为与前沿模型持平。 真正值得工程团队拆解的,除了模型能力,还有它的定价方式:同...

Cohere Parse 5:让复杂企业文档变成可定位的结构化数据

来源: infoq.com 45
企业 PDF 很少只是连续文字:表格、扫描页、双栏排版、图表和脚注经常同时出现。Cohere 发布的 Parse 5 面向这类复杂场景,使用一个 23 亿参数的多模态基础模型,将视觉丰富的 PDF 转换为 Markdown,并同时返回内容对应的 bounding box 坐标。 这意味着文档解析的结果不再只有一段文本,还可以回答“这条数据在原始页面的什...

Pragmatic AI Shell v1.0:让自然语言安全进入终端

来源: oschina.net 44
终端助手正在从“补全一条命令”走向“理解你的意图并协助完成操作”。开源工具 Pragmatic AI Shell(smartcli)发布 v1.0,核心体验是:用户用自然语言描述目标,工具生成 shell 命令,经过安全过滤和人工确认后执行,并保留可审计记录。 这个版本还有两个很实际的变化:支持多个模型之间热切换,并提供不依赖 JRE 的原生二进制。对...

用 TRL 和 OpenEnv 训练编程模型画出水彩画

来源: huggingface.co 41
把代码模型放进一个可交互环境里,它就不再只是生成一次性答案,而是可以通过行动、观察结果、获得奖励,再调整下一步策略。以“用代码绘制水彩画”为例,模型需要同时处理程序语法、视觉构图和连续迭代,这正适合用 TRL 负责训练流程、用 OpenEnv 描述环境交互。 需要说明的是,来源标题只明确了训练方向,并没有给出具体环境实现、奖励函数或模型配置。下面的代码...