标签

LLM

300 个 Agent 并行预测世界杯:Kimi 的 Agent 集群架构拆解

来源: oschina.net 42
2026 年美加墨世界杯将带来 104 场对决——从小组赛到决赛,48 支球队卷入完整赛程。Kimi 这次不是让一个模型"拍脑袋"猜胜负,而是直接拉起一个 300 子 Agent 的集群,从战术、球员、伤病、赛程、历史、舆情、天气、心理、赔率变动、专家观点十个维度并行研究每一场比赛,并在每轮赛前公开预测结果。 这件事的技术看点不在"谁会夺冠",而在:怎...

金融机构如何让 4000 人用上可信 AI——LSEG 的规模化实践

来源: openai.com 41
当伦敦证券交易所集团(LSEG)决定把 AI 推向全球业务时,它面对的不是"能不能写个 demo"的问题,而是"4000 名员工每天用、金融数据零容错、监管红线不能碰"的问题。他们选择与 OpenAI 合作,核心目标很明确:加速洞察产出、压缩发布周期、让信任成为规模化的前提而非事后补救。 金融行业的数据链路天然长——从市场行情、公司财报到宏观指标,中间...

免手操理赔报案:用 Strands Agents 与 Bedrock AgentCore Browser Tool 搭建智能 FNOL 流程

来源: aws.amazon.com 44
保险理赔的第一报案(FNOL,First Notice of Loss)是整个理赔链条的起点,也是最耗人力的环节之一。报案员需要一边听客户描述事故,一边在多个门户系统中录入信息、查询保单、校验字段——手眼并用,重复劳动密集。AWS 最近展示了一种新思路:用 Strands Agents SDK 做领域推理,用 Amazon Bedrock AgentC...

用 Amazon Q + New Relic MCP 搭建值班事故分拣 Agent

来源: aws.amazon.com 42
凌晨两点,PagerDuty 响了。你爬起来打开 New Relic 看仪表盘、翻日志、查部署记录、在 Slack 里同步进展、最后还要在 Asana 里建任务留档——整套流程走完,半小时过去了,其中大部分时间花在"找信息"而不是"做判断"上。 Amazon Q 的 Agent 能力加上 New Relic 的 MCP Server,可以把这套"人肉串...

用 ChromaDB 做向量检索与 RAG:从嵌入到实战查询

来源: realpython.com 40
向量数据库正在从"概念热词"变成工程日常。ChromaDB 作为轻量级、Python-first 的向量存储方案,适合本地开发和小规模 RAG(检索增强生成)场景。但真正上手时,很多人会卡在:嵌入怎么选?余弦相似度到底在算什么?collection 查询的参数怎么配?这篇文章把这些问题拆开,配上可以直接跑的代码。 嵌入(embedding)是把一段文本...

Nextdoor 工程师用 Codex 捕捉难复现 Bug、跨平台构建的实战路径

来源: openai.com 33
当 AI 编码工具从"写个函数试试"进化到"跑完整个任务链",它在工程团队里的角色就变了。Nextdoor 的工程师把 OpenAI Codex(搭载 GPT-5.5)当作一个可以并行跑多个分支的远程同事——不是替代人,而是把人从重复性探索中解放出来,让精力回到产品决策上。 Nextdoor 的移动端和后端都有那种"用户报了三次,本地永远复现不出来"的...

苹果的 AI 不是另一个 ChatGPT——Apple Intelligence 的差异化路径与开发者实践

来源: oschina.net 43
过去三年,AI 行业跑得极快。ChatGPT 定义了对话式交互,Gemini 把多模态推到前台,各类 Agent 和 AI Coding 工具几乎每个月都在刷新"效率天花板"。在这场竞速里,苹果像是一个迟到的选手——Apple Intelligence 自 2024 年公布后反复延期,功能分批上线,外界质疑声从未断过。 但"慢"不等于"缺席"。苹果选择...

Notion 用 Codex 做了什么:从一次性规格到语音输入,小团队的工程倍增器

来源: openai.com 35
OpenAI 的 Codex 不是又一个聊天机器人——它是一个能在沙盒里读代码、写代码、跑测试、提交 PR 的编码代理。Notion 的工程团队把它用到了一个有意思的极限:不是让它补全几行函数,而是让它从零生成完整的功能规格,甚至直接交付可运行的产品特性。他们的 AI Voice Input for Web 就是这么出来的。对小团队来说,这种用法值得拆...