标签

前端

把 LLM 评测从数周压缩到一天:一条可持续迭代的工程路径

来源: medium.com 44
LLM 应用真正拖慢迭代的,往往不是模型调用本身,而是准备数据、批量执行、人工复核和汇总结果之间的等待。来源标题给出了一个鲜明结果:评测周期从数周缩短到一天。由于摘要没有披露具体实现,下面不推测原团队的技术栈,而是给出一套可以这样实践的工程方案:让评测集可版本化,让任务并发执行,让失败能够恢复,并把人工判断集中在最有价值的样本上。 一次完整评测通常由多...

在 AWS 上构建符合 HIPAA 要求的 AI 语音预约系统:Nova 2 Sonic、Bedrock Guardrails 与隐私边界

来源: aws.amazon.com 37
医疗预约看似只是“找一个空闲时间”,实际却涉及患者身份、就诊原因、医生排班和联系方式等受保护健康信息(PHI)。ScienceSoft 的方案把 Amazon Nova 2 Sonic 与 Amazon Bedrock Guardrails 结合起来,让语音代理能够处理预约对话,同时把隐私保护、负责任 AI 和 HIPAA 合规要求放进同一条工作流。 ...

把 Claude 跑进企业生产环境:Google Cloud 上的端点、安全与成本设计

来源: cloud.google.com 36
把大模型接入原型只需要一次 API 调用,但把它稳定地服务给全球用户,还要处理算力调度、尾延迟、区域故障、数据驻留、访问控制和成本波动。Claude 在 Google Cloud Agent Platform 上以托管模型服务提供,把这些问题纳入企业已经使用的 IAM、VPC Service Controls、Cloud Logging 和 Cloud...

Genkit Agents API 预览:让 TypeScript 与 Go 智能体支持后台回合和人工审批

来源: infoq.com 45
Google 发布了面向 TypeScript 和 Go 的 Genkit Agents API 预览版。它试图把智能体应用里反复出现的基础设施问题收进统一的 接口:消息历史、工具调用循环、流式输出和状态持久化都由框架协调。更值得关注的是两个执行能力:客户端断开后仍可继续工作的 detached turns,以及能暂停工具、等待人工决定再恢复的 int...

Genkit Agents API 预览:用脱离式回合与人工审批构建可持续运行的智能体

来源: infoq.com 43
Google 发布了面向 TypeScript 和 Go 的 Genkit Agents API 预览版。它把消息历史、工具调用循环、流式输出和状态持久化收拢到统一的 接口背后,同时加入两个面向生产场景的重要能力:客户端断开后仍能执行的 detached turns,以及支持人工介入和恢复校验的 interruptible tools。 这次变化的重点...

Skyeye 云智能制造 v3.19.12:从零代码流程到 SaaS 制造业务平台

来源: oschina.net 54
Skyeye 云零代码智能制造系统发布 SaaS 模块 v3.19.12。该系统采用 Spring Boot、UNI-APP 与 Ant Design Vue 构建,覆盖 CRM、ERP、MES、项目管理、财务、考勤、招聘、售后、工作流和报表设计等业务。比版本号更值得关注的是它所呈现的平台思路:把制造企业的流程、数据和多端入口放进同一套可配置底座,并通...

DjangoCon US 2026 讲者阵容公布:如何规划一场高回报的技术大会

来源: djangoproject.com 50
DjangoCon US 2026 已公布讲者阵容,大会将于 8 月 24 日至 28 日在芝加哥举行。议题覆盖 Web 开发、API、部署、安全、测试、AI 以及 Django 生态的未来,讲者则来自贡献者、维护者、教育工作者和社区成员。完整日程尚未发布,但现在已经可以开始制定参会策略,而不是等到现场才临时挑选议题。 面对几十场技术分享,按标题逐个收...

把 Kubeflow 故障现场带回 Kubernetes:用 Headlamp 插件直查 CRD 与 Pod

来源: kubernetes.io 47
Kubernetes 已经承载了越来越多的 AI/ML 工作负载:Notebook、分布式训练、超参数搜索、流水线和 Spark 作业最终都会落到 Pod、存储卷、调度器与自定义资源上。Kubeflow 用 CRD 描述这些能力,但面向数据科学家的专用控制台往往隐藏了底层 Kubernetes 状态。Headlamp Kubeflow 插件补上了这层视...

把 AI 当作认知无障碍工具:为神经多样性工作者搭建执行功能支架

来源: aws.amazon.com 53
对一些神经多样性工作者来说,真正消耗精力的未必是专业任务本身,而是启动任务、拆分步骤、判断优先级、切换上下文,以及把零散想法整理成别人能理解的文字。此时,AI 不是锦上添花的效率工具,而是一种认知无障碍支持。 来源文章介绍了一套建立在 Amazon Quick 桌面端之上的日常系统。它利用 AI 桌面与 Web 助手补偿执行功能上的缺口,把模糊、混乱或...