标签

LLM

当 IDE 变成聊天窗口:Antigravity 2.0 为何激怒开发者

来源: oschina.net 59
Google 的 Antigravity 2.0 更新上线后,Reddit 的 r/google_antigravity 板块炸了锅。一位匿名开发者直呼这次更新是"灾难"——更新完成后,他熟悉的终端、源代码管理面板、文件树全部消失,整个工作区被替换成一个聊天界面风格的"智能体管理器"(Agent Manager)。写代码不再是打开编辑器敲键盘,而是对着...

Agent 前端的流式困境与 VAPD AgentKit 的解法

来源: my.oschina.net 58
做 Agent 产品的人大概都踩过同一个坑:后端换了协议,前端就要重写渲染逻辑。OpenAI 用 SSE,Anthropic 用自己的 event stream,自研模型可能直接推 WebSocket frame——每种后端的事件格式、分帧规则、工具调用信令都不一样。前端如果逐个适配,代码很快就会变成一坨协议耦合的意大利面条。 VAPD AgentKi...

VS Code 1.121:Mermaid 内置预览、远程 Agent 与模型路由

来源: oschina.net 57
VS Code 1.121 把几件开发者高频要做的事直接做进了编辑器里——画架构图不用再装第三方插件,AI Agent 可以跑到远程机器上干活,轻量级任务也能指定用哪个模型处理。这些改动不是花架子,而是把日常流程里的摩擦点逐个磨平。 以前在 VS Code 里写 Mermaid 图表,要么装社区插件,要么把 拖到在线渲染器。1.121 直接内置了 Me...

JeeSite 5.17.1:Vue 组件事件补齐、表格列拖拽、BPM 流程预选下一步处理人

来源: oschina.net 60
JeeSite 5.17.1 是一次偏"体验打磨"的迭代——Vue 分离端补上了几个开发者反复提的事件和参数缺口,BPM 发起流程时终于能看到下一步谁来接,AI 模块加了深度思考折叠。改动不大但每个都踩在实际痛点上,值得升级。 之前用 做弹窗选择,选完之后只能靠 回调拿到 value,想同步拿 label 得自己再查一遍字典。5.17.1 补了两个 V...

PostgreSQL width_bucket() 的那些坑,数据分析师踩过几回?

来源: postgr.es 59
做数据分析的人迟早会遇到一个需求:把连续数值分到几个区间里——年龄分段、消费分层、响应时间分桶。Excel 里拖几下就完事了,到了 PostgreSQL 就得靠 。这个函数本身并不复杂,但围绕它的"轻量级灾难"反复上演:一位数据分析师朋友最近又踩了同样的坑,Kaarel Moppel 决定把经验写下来,免得后人继续在暗处摸索。 的等宽分桶签名是: 逻辑...

用多模态大模型做裁判:Strands Evals 里的图像-文本评估实践

来源: aws.amazon.com 56
你做了一个发票识别模型,它返回"总金额:¥12,580"。数字看着合理,格式也没问题——但你怎么知道它真的从图片里读出来的,而不是"猜"的? 文本评估器回答不了这个问题。它只能比对输出和参考答案的字符串相似度,无法判断模型输出是否忠实于源图像。这正是 Strands Evals 引入 MLLM-as-a-judge(多模态大模型做裁判)的原因:让评估器...

用 SageMaker AI 和 vLLM 构建实时语音应用:从"等音频传完"到"边说边转"

来源: aws.amazon.com 58
语音代理、实时字幕、呼叫中心分析、无障碍辅助工具——这些场景的共同底座是实时语音转文字(streaming speech-to-text)。用户一边说话,系统一边出结果,整条链路跑在一条持久连接上,延迟必须压到毫秒级。 传统推理模式在这里直接卡壳:请求-响应架构要求音频全部收齐后才开始推理,等一段 10 秒的录音传完再出结果,体验已经崩了。Amazon...

在 Azure IaaS 上搭建高性能工作负载:别只挑 VM 规格,要看整体系统

来源: azure.microsoft.com 66
云上的性能瓶颈,往往不在 CPU 核数或内存大小本身,而在于计算、存储、网络三者之间的配合是否紧密。Azure 近期在 IaaS 层面推动的"系统级思路",核心就是一句话:别把 VM、磁盘、虚拟网络当成独立零件采购,而是把它们当作一个整体系统来设计。 这对跑 AI 训练、云原生微服务、关键业务数据库的团队尤其重要——单资源再强,如果网络吞吐跟不上磁盘 ...

用多 Agent 系统接管工程支持:Grab 数据仓库平台的实践

来源: infoq.com 59
数据仓库平台团队最头疼的事不是写新功能,而是日复一日回答"这个查询为什么慢""表为什么没更新""权限怎么配"。Grab 的 Central Data Team 也被这类重复性支持请求拖住了手脚,直到他们用多 Agent AI 系统把调查和优化两类工作拆开、交给专门的 Agent 处理,才把工程师的时间从"灭火"拉回到真正的平台建设上。 Grab 的数据...