分类

文章

三十年后还有人来修:一个陌生开发者如何接手 Roedy Green 的遗留代码

来源: oschina.net 33
如果一段代码活了三十年,原作者已经离世,最终却被一个完全陌生的开发者修好,你会怎么想?这不是文学化的设问。上周,类似的事情发生在 Roedy Green 的代码上。 Roedy Green 因“如何编写不可维护代码”而广为人知。他在 2023 年去世,但他留下的软件并没有因此停止运行。事情的起点,是开发者 lexvalo 试图把自己制作的 AI 应用 ...

Miora 全量上线:腾讯把多智能体协作带进创意工作流

来源: oschina.net 28
创意工具正在从“生成一张图、写一段文案”转向“接住一份需求并推进整个项目”。腾讯首个自研创意智能体 Miora(腾讯设计妙境)现已全量上线。根据官方介绍,它基于与 WorkBuddy 同源的智能体架构,通过多个 AI Agent 协作理解目标、规划流程,并在持续使用中记住用户的创作方式。新用户注册可获得 1000 积分。 这次变化的重点并不只是多了一个...

从看懂指令到动手执行:UnifoLM-OminiA-0.3 展示人形机器人的任务闭环

来源: oschina.net 35
宇树科技发布的人形机器人通用智能模型 UnifoLM-OminiA-0.3,重点不只是让机器人识别画面或回答问题,而是把环境感知、任务理解、动作规划与自主执行串成完整闭环。公开演示中,搭载该模型的 G1 可以搬运地面抱枕、识别物品颜色和数量,并执行抓取等现实任务。这类能力意味着机器人系统正在从单项动作展示,转向由统一任务目标驱动的连续作业。 家庭和康养...

OpenAI Presence:把企业级语音与聊天智能体接入真实工作流

来源: openai.com 39
OpenAI Presence 面向企业提供语音与聊天智能体平台,重点不是做一个孤立的对话演示,而是让组织能够在客户服务和内部流程中部署可信的智能体。对工程团队而言,真正的挑战也从“模型能否回答问题”转向身份认证、系统集成、人工接管、审计和持续评估。 企业智能体需要在多个系统之间完成闭环。例如,客服智能体可能要识别客户意图、查询订单、解释政策,并在权限...

Next.js 16.2.11 安全更新:App Router、Turbopack 与服务端请求风险处置指南

来源: oschina.net 33
Next.js 16.2.11 已发布,重点修复多项高危安全问题,影响范围涉及 App Router、Server Actions、Turbopack、中间件或代理、重写规则以及自定义服务器。对线上应用而言,这不是一个适合等待常规迭代窗口的版本:只要项目使用其中任一能力,就应尽快完成依赖升级、重新构建和针对性验证。 根据发布摘要,本次修复至少覆盖以下风...

Elasticsearch BBQ 实测:Jina v5 向量缩小 29 倍,recall@10 如何保持稳定

来源: my.oschina.net 26
向量检索系统最难控制的成本,往往不是生成嵌入,而是让数百万乃至数十亿条 float32 向量长期驻留在索引、磁盘和内存中。针对 Jina v5 嵌入的一项动手测试比较了 Elasticsearch 的 BBQ 与标准 float32 向量索引:在五种语言的数据上测量内存、磁盘和 recall@10,结果显示向量体积最多可缩小约 29 倍,同时没有观察到...

Firefox 153.0 为 Windows 带来 HDR 视频播放:启用条件、限制与排查方法

来源: oschina.net 34
Firefox 153.0 的一项重要变化,是在 Windows 上加入 HDR 视频播放支持。对视频平台、播放器开发者和内容团队来说,这意味着 Firefox 开始能够呈现更高亮度范围和更丰富的色彩,但能否真正进入 HDR 模式,仍取决于 Windows 设置、显示设备能力以及视频文件本身。 Firefox 153.0 要在 Windows 上播放 ...

Kimi K3 实战对标 Fable 5:开源模型为何能在 SWE-bench 上逼近商业模型

来源: oschina.net 36
关于大模型编程能力的讨论,正在从“哪家模型更聪明”转向更具体的问题:在真实软件工程任务里,模型能否稳定地修改代码、运行测试并提交可接受的补丁?Fireworks AI 的一组对照实验给出了一个值得关注的信号:在同一个 agent harness 中,Kimi K3 与 Fable 5 完成了 1030 个真实 agent 任务,开源模型在 SWE-be...

Gemini Flash 三连发:Google 正把高效输出变成模型竞争力

来源: oschina.net 41
Google 这次更新 Gemini Flash 系列,一口气公布了三个新型号,并额外预告两个后续方向,其中还有一个型号只面向政府使用。最受关注的是 Gemini 3.6 Flash:它被定位为编程、知识工作和多模态任务的主力模型。此次更新释放出的信号很明确:模型竞争不只是“回答得对不对”,还包括“用多少 token 才能完成任务”。 根据摘要中的信息...