2026-08-18
来源: openai.com
29
青少年使用 AI,重点不只是“能不能回答问题”,还包括能否帮助他们学习、形成批判性思维,并在遇到不确定或敏感内容时获得更稳妥的保护。ChatGPT for Teens 的方向,是把更强的内置保护、健康使用功能和家长控制结合起来,让 AI 成为学习工具,而不是替代判断力的捷径。 对学生来说,AI 最有价值的用法往往不是直接生成一份可以提交的答案,而是把复...
2026-08-18
来源: openai.com
23
Asana 使用 OpenAI Codex 重做一套过时的测试系统:原本预计需要五年的工程工作,在两周内完成,成本约为 12,000 美元。这个案例真正值得关注的,不只是代码生成速度,而是 AI 如何参与遗留系统替换、测试迁移和工程验证。 测试系统一旦过时,团队通常会陷入两难:继续维护它,工程师会不断为旧框架付出时间;直接替换它,又可能牵动大量测试用例...
2026-08-18
来源: oschina.net
36
从 2026 年 8 月起,欧盟《人工智能法案》将开始对新系统产生更直接的约束。根据来源摘要,法案第 50 条要求 AI 提供者让输出内容“可被检测为人工生成”。这意味着大语言模型可能需要在文本中嵌入某种可检测信号,也就是通常所说的文本水印。 问题在于:文本不是图片。图片水印通常依赖像素层面的冗余信息,裁剪、压缩或编辑会降低质量,但不一定能在不破坏图像...
2026-08-18
来源: oschina.net
44
企业内部的 RAG 项目往往不缺一个能回答问题的 Demo,真正缺的是文档管理、出处追踪、权限隔离、流式交互、Agent 编排和链路诊断能够同时工作的完整系统。Ollmo v0.1.0 的定位正是这类生产场景:面向私有化部署和团队协作,把 RAG、可视化 Agent、GraphRAG 与可观测能力整合到一个平台中。 典型 RAG 流程包括文档解析、文本...
2026-08-18
来源: oschina.net
40
Vercel Labs 在 GitHub 上开源了实验性编程语言 Zero。它最值得关注的地方,不是项目获得了多少 star 或 fork,而是它试图回答一个更基础的问题:如果代码主要由 AI Agent 生成、查询和修改,编程语言还应该继续以文本文件为唯一源头吗? Zero 的定位非常明确:它不是优先为人类程序员设计的语言,而是面向 AI Agent...
2026-08-18
来源: huggingface.co
43
传统文本向量模型把整段文本压缩成一个固定长度的向量,检索时只需计算一次向量相似度。多向量模型则保留多个词元或片段级向量,把查询与文档的细粒度匹配推迟到检索阶段完成,这种方法通常称为晚交互(Late Interaction)。 来源摘要未提供具体 API 和模型信息,因此下面不假定某个专用模型接口,而是基于 Sentence Transformers 的...
2026-08-18
来源: openai.com
23
当团队快速扩张、信息持续变化时,真正稀缺的往往不是数据,而是把数据转化为行动的能力。NVIDIA 团队使用 ChatGPT Work 来减少手工任务、连接快速变化的信号,并把已经验证有效的工作流推广到全球团队。 这类实践的重点不只是让个人更快完成一份文档,而是把分散在邮件、会议、报告和项目记录中的经验,沉淀成可复用、可协作、可持续改进的工作方式。 很多...
2026-08-18
来源: postgr.es
31
用户填写表单、点击提交,却迟迟看不到响应。于是他再次点击。问题在于:第一次请求可能已经成功写入数据库,只是响应在网络中丢失了。结果可能是两个潜客、两封确认邮件、两次 CRM 更新,以及两条分析事件。 这不是单纯的前端交互问题,而是一个缩小版的分布式系统问题。浏览器会重试,移动网络会在服务端提交成功后断开,Serverless 函数可能在提交后超时,队列...
2026-08-18
来源: huggingface.co
34
硬件没有扩容,工作负载也没有缩水,集群利用率却提高了 33 个百分点。来源标题给出的关键线索只有一个:变化发生在任务处理顺序上。由于摘要未提供具体调度器、负载类型和利用率口径,本文不推断原案例的实现细节,而是拆解这种结果背后的通用机制,并给出一个可以运行的装箱模拟。 集群调度可以看成带约束的装箱问题:节点是箱子,Pod、作业或虚拟机是待装入的物品。真实...
2026-08-18
来源: aws.amazon.com
43
NVIDIA Nemotron 3.5 Lightning 现已通过 Amazon SageMaker JumpStart 提供。它面向高吞吐量的 Agentic 工作负载,采用 30B 参数的 Mixture-of-Experts 架构,但每次推理只有约 3B 参数处于激活状态。根据来源摘要,在适合的 always-on Agent 场景中,它最高可...