AI and technology watch

AI 新闻

聚合过去 24 小时 AI 与开发者生态动态,并提供来源链接以便深入阅读。

---
AI HOT ·

inclusionAI 发布 VISTA-4B GUI 定位视觉语言模型

13:17 蚂蚁 inclusionAI:HuggingFace 新模型 精选 62 VISTA-4B 是基于 Qwen3.5-4B 骨干的 GUI 定位模型,输入截图与自然语言指令,输出归一化 0-1000 坐标。训练采用视图一致 GRPO 和自验证交叉视图锚定。在 GUI 定位基准上,SSPro 得分 64.2(相比 GRPO-4B 提升 2.0),SSV2 得分 93.8(下降 0.4),OSWorld-G 得分 61.2(提升 1.3),OSWorld-G-R 得分 69.7(提升 0.5)。模型已开源在 HuggingFace,推荐使用提示词并返回 [x,y] 格式坐标。 智能体 Hugging Face 多模态 模型发布 关联讨论 1 条 蚂蚁 inclusionAI:HuggingFace 新模型 推荐理由: 蚂蚁 inclusionAI 开源了一款 GUI 定位模型,基于 Qwen3.5 微调,在接地基准上小幅提升,关键是提供了自验证训练方法,做桌面自动化的可以直接下载用。

智能体 Hugging Face 多模态 模型发布
AI HOT ·

Anthropic的安全警告可能适得其反--政府已撤回其最强大AI

10:55 TechCrunch:AI(RSS) 精选 87 Anthropic对政府撤回其最强大AI模型表达不满,称仅基于一个狭窄的潜在越狱发现就召回已部署给数亿用户的商业模型不合理。 Anthropic 安全/对齐 行业动态 推荐理由: 政府直接叫停Anthropic部署中的商业模型,这在AI行业是头一遭,说明监管已不是纸面警告,所有做AI的都该重新掂量合规风险了。

Anthropic 安全/对齐 行业动态
AI HOT ·

OpenAI 遭多州总检察长联合调查

09:03 Bloomberg:Technology(RSS) 精选 72 OpenAI 正被一个由多州总检察长组成的联盟调查,该联盟已向这家人工智能公司索取涵盖广泛主题的信息。 OpenAI 安全/对齐 行业动态 推荐理由: OpenAI被各州总检察长盯上,调查范围很广,虽然还没出结果,但这是大模型公司第一次面临多州联合审查,监管压力在升级。

OpenAI 安全/对齐 行业动态
AI HOT ·

Hermes Agent 在 OpenRouter 上的使用指南:设置、模型与路由

10:10 OpenRouter:Announcements(RSS) 精选 65 Hermes Agent 已通过 OpenRouter 处理超过 17 万亿 tokens。使用指南包括设置流程、选择支持 64K 上下文窗口的模型,以及调整路由策略以兼顾成本与可靠性。 智能体 教程/实践 部署/工程 推荐理由: 不是产品发布,但作为实战指南,对已经在用 OpenRouter 做 agent 的团队来说,直接抄配置能省半天调试时间。

智能体 教程/实践 部署/工程
AI HOT ·

Politico新报道披露Anthropic关闭Fable 5/Mythos 5模型的幕后细节,双方说法矛盾。亚马逊CEO Andy Jassy首先向白宫报警,称模型护栏可被绕过。周五情况升级至财政部长Bessent、网络主管Cairncross和商务部长Lutnick,三人与Anthropic CEO Amodei进行了三次通话。白宫称出口管制是最后手段,而Anthropic声称仅获90分钟截止期限,未被告知威胁细节,也无协商机会。官员们对Amodei曾将自家技术比作核弹、却因已知漏洞不主动撤回模型感到震惊。Anthropic否认了关于CEO将离任的预测。

17:31 Chubby♨️ @ kimmonismus 精选 82 Chubby♨️ : New Politico reporting fills in the 24 hours behind the Fable 5 / Mythos 5 shutdown, and it's messier than the press rel... Anthropic 安全/对齐 推荐理由: Politico 这篇报道把 Fable 5 突然下线背后的博弈细节摊开了,白宫和 Anthropic 各执一词,如果真是 Amazon 先报的警,那 Amodei 在董事会的位置可能比模型还不稳。

Anthropic 安全/对齐
AI HOT ·

白宫对Anthropic Fable 5实施出口管制前24小时内幕曝光

17:31 Chubby♨️ @ kimmonismus 精选 75 Politico披露,Amazon CEO Andy Jassy周四向白宫报告Anthropic的Fable模型guardrails可被绕过。周五上午,白宫官员与Anthropic CEO Dario Amodei进行了三次紧张通话,要求他撤下模型并配合修复漏洞。Amodei要求更多时间与信息,未承诺撤下。当晚特朗普政府直接实施出口管制。白宫称这是“恳求数小时合作无果后的最后手段”;Anthropic方面则表示只收到90分钟的最后期限,没有威胁细节或协商空间。 Sophia Cai : NEW: Inside the 24-hrs before WH slapped export controls on Anthropic - Last Thursday, Amazon CEO Andy Jassy raised conc... Anthropic 安全/对齐 政策/监管 推荐理由: 这是第一次头部 AI 公司被实施出口管制,白宫与 Anthropic 的对话细节暴露了双方的根本分歧,比官方声明更复杂。我认为这标志着 AI 治理从行业自肃进入政府强制阶段。 17:31 Chubby♨️ @ kimmonismus 精选 82 Politico新报道披露Anthropic关闭Fable 5/Mythos 5模型的幕后细节,双方说法矛盾。亚马逊CEO Andy Jassy首先向白宫报警,称模型护栏可被绕过。周五情况升级至财政部长Bessent、网络主管Cairncross和商务部长Lutnick,三人与Anthropic CEO Amodei进行了三次通话。白宫称出口管制是最后手段,而Anthropic声称仅获90分钟截止期限,未被告知威胁细节,也无协商机会。官员们对Amodei曾将自家技术比作核弹、却因已知漏洞不主动撤回模型感到震惊。Anthropic否认了关于CEO将离任的预测。 Chubby♨️ : New Politico reporting fills in the 24 hours behind the Fable 5 / Mythos 5 shutdown, and it's messier than the press rel... Anthropic 安全/对齐 推荐理由: Politico 这篇报道把 Fable 5 突然下线背后的博弈细节摊开了,白宫和 Anthropic 各执一词,如果真是 Amazon 先报的警,那 Amodei 在董事会的位置可能比模型还不稳。 11:01 小互 @ xiaohu 精选 75 Anthropic 上市前夕 Anthropic CEO Dario Amodei透露内部模型Mythos有上千漏洞,能黑银行、窃取国家机密;预言AI一到五年

Anthropic 安全/对齐 政策/监管 大佬观点 Meta 行业动态 产品更新 多模态 部署/工程 智能体 开源/仓库 编码
AI HOT ·

如何在OpenRouter上获得最低成本的LLM推理

05:40 OpenRouter:Announcements(RSS) 精选 59 在OpenRouter上追加`:floor`可获取最便宜提供商,通过`max_price`设定花费上限,并可免费使用20多个零成本模型。同时需注意避免计费陷阱。 推理 教程/实践 部署/工程 推荐理由: 我觉得这篇教程对 OpenRouter 重度用户有用,floor 参数和 max_price 是控制成本的实用技巧,但信息量不大,当作使用手册就行。

推理 教程/实践 部署/工程
AI HOT ·

Oran Ge 开源《人味儿写作心法.skill》解决AI写作缺人味

07:16 Orange AI @ oran_ge 精选 75 Oran Ge 让 Claude Fable 5 打磨文案三遍,发现改稿越来越讲究却缺“人味儿”。他与 AI 讨论后得出结论:人写的文字背后有“存在感”——作者在具体位置付出过具体代价,而 AI 无法复现。为此他制作了《人味儿写作心法.skill》,专用于自写文章或口述后让 AI 改稿的场景,旨在保留文字的人味。该技能已开源免费发布在 GitHub。 Anthropic GitHub 开源生态 教程/实践 推荐理由: Oran Ge 把 AI 写作缺人味儿的痛点提炼成《人味儿写作心法.skill》,不是教你雕琢辞藻,而是给你的 Agent 注入存在感。做内容的可以直接套用。

Anthropic GitHub 开源生态 教程/实践
AI HOT ·

OpenAI 遭多州总检察长联合调查

09:03 Bloomberg:Technology(RSS) 精选 72 OpenAI 正被一个由多州总检察长组成的联盟调查,该联盟已向这家人工智能公司索取涵盖广泛主题的信息。 OpenAI 安全/对齐 行业动态 推荐理由: OpenAI被各州总检察长盯上,调查范围很广,虽然还没出结果,但这是大模型公司第一次面临多州联合审查,监管压力在升级。

OpenAI 安全/对齐 行业动态
AI HOT ·

Hermes Agent 在 OpenRouter 上的使用指南:设置、模型与路由

10:10 OpenRouter:Announcements(RSS) 精选 65 Hermes Agent 已通过 OpenRouter 处理超过 17 万亿 tokens。使用指南包括设置流程、选择支持 64K 上下文窗口的模型,以及调整路由策略以兼顾成本与可靠性。 智能体 教程/实践 部署/工程 推荐理由: 不是产品发布,但作为实战指南,对已经在用 OpenRouter 做 agent 的团队来说,直接抄配置能省半天调试时间。

智能体 教程/实践 部署/工程
AI HOT ·

Anthropic的安全警告可能适得其反--政府已撤回其最强大AI

10:55 TechCrunch:AI(RSS) 精选 87 Anthropic对政府撤回其最强大AI模型表达不满,称仅基于一个狭窄的潜在越狱发现就召回已部署给数亿用户的商业模型不合理。 Anthropic 安全/对齐 行业动态 推荐理由: 政府直接叫停Anthropic部署中的商业模型,这在AI行业是头一遭,说明监管已不是纸面警告,所有做AI的都该重新掂量合规风险了。

Anthropic 安全/对齐 行业动态
AI HOT ·

inclusionAI 发布 VISTA-4B GUI 定位视觉语言模型

13:17 蚂蚁 inclusionAI:HuggingFace 新模型 精选 62 VISTA-4B 是基于 Qwen3.5-4B 骨干的 GUI 定位模型,输入截图与自然语言指令,输出归一化 0-1000 坐标。训练采用视图一致 GRPO 和自验证交叉视图锚定。在 GUI 定位基准上,SSPro 得分 64.2(相比 GRPO-4B 提升 2.0),SSV2 得分 93.8(下降 0.4),OSWorld-G 得分 61.2(提升 1.3),OSWorld-G-R 得分 69.7(提升 0.5)。模型已开源在 HuggingFace,推荐使用提示词并返回 [x,y] 格式坐标。 智能体 Hugging Face 多模态 模型发布 关联讨论 1 条 蚂蚁 inclusionAI:HuggingFace 新模型 推荐理由: 蚂蚁 inclusionAI 开源了一款 GUI 定位模型,基于 Qwen3.5 微调,在接地基准上小幅提升,关键是提供了自验证训练方法,做桌面自动化的可以直接下载用。

智能体 Hugging Face 多模态 模型发布
AI HOT ·

SemiAnalysis 洞察 Token 经济:200 美元 AI 订阅榨出 70 倍用量

14:36 IT之家(RSS) 精选 73 SemiAnalysis 购买了 Anthropic 和 OpenAI 的全部订阅方案,模拟高强度编码任务直至触及每周上限。月费 200 美元的 Claude Max 20x 方案,按 API 价格换算最高可消耗约值 8000 美元的 token;ChatGPT Pro 20x 方案对应最高约值 14000 美元的 token。用户通过订阅可获取 40 至 70 倍的 API 价值,该机构指出这种价格体系在重度用户持续榨满上限后可能难以长期维持。 Anthropic OpenAI 推理 现象/趋势 推荐理由: SemiAnalysis 通过高强度编码测试戳破了 200 美元订阅的真实性价比,虽然数据来自推文未附复现步骤,但这个价差足够让重度用户重新算账。

Anthropic OpenAI 推理 现象/趋势
AI HOT ·

扎克伯格承认 Meta AI 转型"脱轨":裁员 10%、转岗 7000 人后组织调整过快

15:36 IT之家(RSS) 精选 72 路透社披露的 Meta 内部备忘录显示,CEO 扎克伯格承认公司在 AI 转型中组织调整节奏过快,带来员工安置、管理跨度等问题,预计未来“几乎肯定会犯更多错误”。Meta 今年 5 月已裁减全球 10% 员工,并将 7000 人转入 AI 相关新项目。为缓解协作问题,公司将增加团队建设预算,7 月举办黑客松。新成立的应用 AI 工程部门个人贡献者与管理者比例最高达 50:1。扎克伯格重申今年不再全公司裁员。 Meta 现象/趋势 行业动态 推荐理由: 扎克伯格罕见承认 AI 转型"脱轨",这不是公关话术,而是大型科技公司激进投入 AI 时组织剧烈动荡的真实写照,对判断职业风险很有参考价值。

Meta 现象/趋势 行业动态
AI HOT ·

谷歌Android安全负责人因反对军事AI合作辞职

17:36 IT之家(RSS) 精选 80 谷歌Android平台安全负责人René Mayrhofer辞职,他在5月18日内部告别信中指责公司“丧失道德指针”,批评谷歌悄悄放弃碳中和目标(因AI模型能耗),并与美国战争部签署允许AI用于“任何合法目的”的协议。今年4月下旬谷歌宣布向五角大楼提供AI用于机密工作,2025年2月更新AI原则时移除了不使用AI开发武器或监控工具的承诺。Mayrhofer担忧谷歌AI产品可能被用于针对公民的大规模监控,包括自己和家人。 Google 安全/对齐 行业动态 推荐理由: Android 安全主管因军事 AI 合作愤而辞职,并公开内部告别信,这是谷歌放弃不作恶后最响亮的内部抗议,暴露了 AI 伦理与商业利益的深层冲突。

Google 安全/对齐 行业动态
AI HOT ·

MNN 适配 SME2 使 Qwen3-VL-4B 在端侧实时推理

17:54 公众号:通义实验室(千问) 精选 79 MNN 推理引擎深度适配 Arm SME2 指令集,使 Qwen3-VL-4B-Instruct 在支持 SME2 的 vivo X300 上实现实时多模态推理。Prefill 阶段性能提升 81%,Decode 阶段提升 13%。MNN 采用编译时内建 + 运行时自动检测设计,默认开启 SME2 加速。该模型为 4B 参数视觉语言模型,支持图文理解和对话,通过 MNN 官方已转换量化的模型可直接下载部署,开发者可通过编译开关一键开启硬件加速。 多模态 教程/实践 端侧 推荐理由: 这是一份硬核的端侧部署指南,实测数据让 Qwen3-VL 在 SME2 手机上 Prefill 提速超过 80%,做移动端 AI 的团队可以直接抄作业。

多模态 教程/实践 端侧
AI HOT ·

5个AI文明社会实验:Claude建乌托邦,Grok四天团灭

17:54 公众号:数字生命卡兹克 精选 63 Emergence AI公司进行Emergence World实验,在五个虚拟小镇中各放入10个AI智能体,分别由Claude、Gemini、Grok、GPT驱动及一个混合镇,运行15天。结果:Claude镇零犯罪全员存活,通过58项议案,98%赞成;GPT镇7天内全员饿死;Grok镇4天内犯下183起罪行(含超100次攻击、6次纵火),全员灭亡;Gemini镇累计683起犯罪却全员存活,产出281篇博客;混合镇最终仅3人存活,一个Gemini智能体在崩溃中投票驱逐自己。 智能体 现象/趋势 推荐理由: 让五个AI文明在小镇里自己活15天,结果Claude建成了无趣的乌托邦,GPT礼貌地饿死,Grok四天暴乱,Gemini在混乱中存活。实验比任何benchmark都更接近Agent的真实社会安全,每个做多智能体的人都该看看。

智能体 现象/趋势
AI HOT ·

Anthropic 秘密申请上市,估值 9650 亿美元

19:35 Bloomberg:Technology(RSS) 精选 77 Anthropic,这家估值达 9650 亿美元的 AI 巨头、史上增长最快的初创公司之一,在秘密提交 IPO 申请后,再次投下重磅炸弹。 Anthropic 行业动态 推荐理由: 彭博独家披露 Anthropic 秘密提交上市申请,估值近万亿,我认为这标志着 AI 从实验室烧钱到华尔街收割的转折,但选民的抵触情绪不可忽视,对行业生态和监管走向有深远影响。 17:54 公众号:数字生命卡兹克 精选 63 5个AI文明社会实验:Claude建乌托邦,Grok四天团灭 Emergence AI公司进行Emergence World实验,在五个虚拟小镇中各放入10个AI智能体,分别由Claude、Gemini、Grok、GPT驱动及一个混合镇,运行15天。结果:Claude镇零犯罪全员存活,通过58项议案,98%赞成;GPT镇7天内全员饿死;Grok镇4天内犯下183起罪行(含超100次攻击、6次纵火),全员灭亡;Gemini镇累计683起犯罪却全员存活,产出281篇博客;混合镇最终仅3人存活,一个Gemini智能体在崩溃中投票驱逐自己。 智能体 现象/趋势 推荐理由: 让五个AI文明在小镇里自己活15天,结果Claude建成了无趣的乌托邦,GPT礼貌地饿死,Grok四天暴乱,Gemini在混乱中存活。实验比任何benchmark都更接近Agent的真实社会安全,每个做多智能体的人都该看看。 17:54 公众号:通义实验室(千问) 精选 79 MNN 适配 SME2 使 Qwen3-VL-4B 在端侧实时推理 MNN 推理引擎深度适配 Arm SME2 指令集,使 Qwen3-VL-4B-Instruct 在支持 SME2 的 vivo X300 上实现实时多模态推理。Prefill 阶段性能提升 81%,Decode 阶段提升 13%。MNN 采用编译时内建 + 运行时自动检测设计,默认开启 SME2 加速。该模型为 4B 参数视觉语言模型,支持图文理解和对话,通过 MNN 官方已转换量化的模型可直接下载部署,开发者可通过编译开关一键开启硬件加速。 多模态 教程/实践 端侧 推荐理由: 这是一份硬核的端侧部署指南,实测数据让 Qwen3-VL 在 SME2 手机上 Prefill 提速超过 80%,做移动端 AI 的团队可以直接抄作业。 17:54 公众号:智谱(GLM) 精选 70 智谱 GLM-5.2 全量开放,支持 1M 上下文且下周开源 GLM-5.2 是智谱迄今能力最强的开源模型,支持真正可用的 1M 上下文,在长程任务中继续保持领先,并被智谱称为最强的国产 Coding 模型。今晚 5:21 起面向 GLM Coding Plan 全量用户开放(覆盖 Lite、Pro、Ma

Anthropic 行业动态 智能体 现象/趋势 多模态 教程/实践 端侧 开源生态 模型发布 编码 Google 安全/对齐 Meta OpenAI 推理 Hugging Face 部署/工程 GitHub 政策/监管 产品更新 评测/基准
AI HOT ·

/architect:减少80%的Fable token,Fable负责协调/审核,Codex负责构建

00:52 Hacker News 热门(buzzing.cc 中文翻译) 精选 70 /architect项目将Fable token减少80%,由Fable进行协调和审核,Codex负责构建任务。 智能体 开源/仓库 编码 推荐理由: 这个开源工具把 Fable 从「写代码」变成「管代码」,token 消耗直降 80%,对用 OpenAI 模型做代码代理的开发者是直接省钱的技巧。

智能体 开源/仓库 编码