标签

LLM

开放式 ASR 榜单迎来首个全球南方语言:评测覆盖开始扩展

来源: huggingface.co 41
开放式自动语音识别(ASR)榜单新增了首个来自全球南方的语言。这一变化的意义不只在于榜单多了一项测试,而在于语音模型的公开比较开始触及过去经常被忽略的语言、地区和使用场景。 ASR 模型的排名通常依赖固定的数据集、统一的转写规范和可复现的评测脚本。这样的设计有助于横向比较,但也会带来一个明显边界:如果测试语言长期集中在资源丰富的市场,榜单反映的就主要是...

用 Amazon Quick 和 fal 搭建可复用的智能创意工作流

来源: aws.amazon.com 45
创意团队需要持续产出分镜、视觉草图、音乐视频概念等大量资产,但工具分散和人工传递上下文会让制作流程变慢。Amazon Quick 与 fal 通过 Model Context Protocol(MCP)连接后,可以把创意讨论、素材生成和结果整理放进一个可复用的 agent harness 中。 本文围绕两个实践场景展开:生成八格分镜,以及快速制作音乐视...

企业 AI 如何跨过试点陷阱:从用例筛选、双 COE 到生产 XOps

来源: cloud.google.com 39
企业采购大模型许可证并不等于获得 AI 回报。Pythian 在覆盖 27 个国家、约 500 名员工的内部推广中发现,真正拉开差距的不是每人每天节省几分钟,而是把 AI 嵌入工单处理、供应链预测和商品录入等高价值流程,并建立持续维护这些流程的组织能力。 这套方法最终形成了一条完整链路:Field CTO 战略与治理、平台部署、双 COE 执行,以及负...

用 Cloud Run 实例低成本部署长期运行的个人 AI Agent

来源: cloud.google.com 51
对于 OpenClaw、Hermes 这类面向个人开发者的 AI Agent,传统的无状态 Web 服务模型并不总是合适。它们通常需要长期运行、保存状态,而且大多数时间只服务一个用户。Cloud Run 实例正是为这类单实例、长生命周期工作负载提供了更贴近实际的运行方式。 Cloud Run 服务擅长处理无状态、高吞吐的 HTTP 请求。当一段时间没有...

Google Cloud 用 AI Agent 简化数据库生命周期管理

来源: infoq.com 54
数据库运维正在从“人工执行固定流程”转向“由 AI 协助完成上下文判断”。Google Cloud 最近推出 AI-powered Database Operations Agents,覆盖数据库接入和日常运维两个关键阶段:Onboarding Agent 用于简化数据库设置,Observability Agent 则帮助团队进行故障排查、性能优化与调...

Lody 开源:把 Coding Agent 的会话、状态与代码改动放进同一个协作空间

来源: oschina.net 51
当团队开始同时使用多个 Coding Agent,新的问题很快会出现:某个 Agent 改了什么,运行到了哪一步,为什么做出这个决定,会话能不能交给另一位成员继续?如果这些信息散落在个人电脑、终端窗口和不同会话中,协作很容易退化成反复询问和手动交接。 Lody 的开源版本正是针对这一类问题而来。它定位为 Coding Agent 协作工作空间,并于 8...

Cloudflare Wallets 接入 x402:能限制单笔支付,却管不住连续消费

来源: infoq.com 47
Cloudflare 宣布推出 Wallets,为 AI agent 提供稳定币余额和消费控制能力。它选择了 x402 作为支付通道,而 x402 目前已由 Linux Foundation 托管。不过,这套控制机制的边界很清晰:它可以约束一笔支付,却不会自动理解一连串交易组成的总风险。 更现实的问题是,Wallets 目前仍处在早期阶段,只有 han...

ChatGPT 与批判性思维训练:学生真正获得的,不只是更快的答案

来源: openai.com 34
生成式 AI 进入课堂后,讨论很容易停留在“学生会不会偷懒”这一层面。更值得研究的问题是:当 ChatGPT 与批判性思维训练同时出现时,学生能否写出更好的答案,提出更有原创性的观点,并把 AI 生成内容转化为自己的判断?一项针对 1,000 多名学生的随机研究,正是围绕 ChatGPT、批判性思维、原创性以及真实大学作业中的表现展开。 ChatGPT...

别再盲设 70:用真实行大小计算 PostgreSQL 表的 Fillfactor

来源: postgr.es 34
PostgreSQL 的 是一个很小、却经常被忽略的设置。它决定数据首次写入时,每个表页要填多满,并为后续更新预留多少空间。对频繁更新的表来说,合适的预留空间可能提高 HOT update 的机会,减少索引改写、WAL 和 I/O;但把所有表统一设成 70 或 80,同样是一种猜测。 更稳妥的做法是:先用真实数据估算平均行大小,再结合更新频率和监控结果...

GeoRA:为什么 RLVR 需要一套重新设计的 LoRA

来源: tech.meituan.com 32
ACL 2026 杰出论文奖公布后,全球共有 18 篇论文入选,其中包括美团履约技术团队的一项工作。GeoRA 关注的不是“如何把 LoRA 用到强化学习上”这么简单,而是一个更具体的问题:当模型通过可验证奖励进行训练时,传统低秩更新是否真的适合这种优化信号? 论文介绍了一种专为 RLVR(Reinforcement Learning with Ver...