AI HOT
·
2026-05-23 00:00
10:09 IT之家(RSS) 精选 73 5月22日,智谱向部分企业客户推出了旗舰大模型GLM-5.1的高速版API“GLM-5.1-highspeed”。该版本输出速度达400 tokens/s,刷新了全球大模型API速度上限。关键突破在于,它首次在国产大模型中实现了旗舰级能力与低延迟的结合,打破了“高速模型即轻量模型”的传统。该版本由智谱GLM团队与TileRT团队合作,通过系统级优化确保了速度的生产级稳定性,适用于AI编程、实时语音交互等场景。 推理 模型发布 部署/工程 推荐理由: 智谱把旗舰模型拉到 400 tokens/s,还保持全尺寸能力,不是那种为快阉割的小模型。做实时交互、AI 编程的可以认真看看,延迟敏感场景的选型参数要重写了。
推理
模型发布
部署/工程
AI HOT
·
2026-05-23 00:00
10:09 IT之家(RSS) 精选 77 5月22日,美国总统特朗普突然取消了原定签署的AI行政令,该行政令旨在加强监管,赋予政府在AI模型公开发布前进行评估的权力。取消源于特朗普本人对监管的反感,以及高级顾问大卫·萨克斯和科技界领袖如扎克伯格、马斯克的反对与游说,凸显白宫内讧。特朗普认为监管会成为绊脚石,阻碍美国AI领先优势。草案中还存在如财政部在安全协调中角色过重等争议,白宫表示正制定其他AI安全举措。 安全/对齐 行业动态 推荐理由: 特朗普的 AI 监管令在签署前几小时被撤销,马斯克和扎克伯格直接打电话游说,这背后是加速派和监管派的公开角力,未来几个月 AI 政策只会更乱。
安全/对齐
行业动态
AI HOT
·
2026-05-23 00:00
10:09 IT之家(RSS) 精选 80 加州大学圣地亚哥分校研究首次实证现代AI可通过图灵测试。研究表明,在获得特定提示后,GPT-4.5在5至15分钟的对话中被误认为人类的概率高达73%,显著超过真人。LLaMa-3.1-405B的判定率(56%)与真人相当,而GPT-4o和ELIZA仅约20%。研究指出提示词至关重要,它使AI能模仿人类语气、幽默感甚至易错性等社会行为特征。这一发现迫使人们重新思考图灵测试的意义,并凸显了大语言模型在网络信任与安全方面构成的潜在挑战。 OpenAI 安全/对齐 论文/研究 推荐理由: 这篇PNAS论文首次用严格实验证明现代AI能通过图灵测试,GPT-4.5装人比真人还像,但重点不是它多聪明,而是它多擅长说谎,线上身份信任被彻底动摇。
OpenAI
安全/对齐
论文/研究
AI HOT
·
2026-05-23 00:00
10:14 HuggingFace Daily Papers(社区热门论文) 精选 71 针对基于结果的强化学习在处理困难推理问题时因正确样本稀少而效率低下的问题,本文提出子问题课程强化学习框架。该框架从参考推理链中提取可验证子问题,并将最终子问题固定为原始问题,从而将部分解题进展转化为可验证的学习信号。其通过在子问题位置独立归一化奖励并分配优势值,实现了更细粒度的信用分配。实验表明,SCRL显著提升了模型在多个数学推理基准上的性能,有效增强了在复杂问题上的探索与推理能力。 arXiv 推理 数据/训练 论文/研究 推荐理由: SCRL 将推理链解构为可验证子问题课程,让 RL 在超难数学题上获得细粒度信用分配,AIME 提点显著,做推理 RL 的团队值得复现。
arXiv
推理
数据/训练
论文/研究
AI HOT
·
2026-05-22 23:27
09:07 Luma @ LumaLabsAI 精选 62 产品更新 图像生成 推荐理由: 把客户评价变成自动生成的视觉图形,做营销的可以省掉不少设计时间。不算大更新,但足够实用。
产品更新
图像生成
AI HOT
·
2026-05-22 22:23
05:30 Claude Code:GitHub Releases(RSS) 精选 73 本次更新引入了`Workflow`工具,支持确定性多智能体编排(默认关闭)。将`/simplify`命令重命名为`/code-review`,现可报告代码正确性问题并支持生成GitHub PR内联评论。改进了自动更新器(增加重试与错误报告)、大文件diff渲染性能,并优化了提示历史记录以避免重复条目。修复了多个关键问题,包括企业登录限制未生效、Windows下的PowerShell工具与终端闪烁问题、插件系统及shell快照的bug,并增强了沙箱安全性与终端兼容性。 智能体 Anthropic 产品更新 编码 推荐理由: Claude Code 这次更新不止修 bug,Workflow 工具让多 agent 编排有了确定性模式,虽然默认关闭但值得尝鲜,做复杂工程的开发者可以关注。
智能体
Anthropic
产品更新
编码
AI HOT
·
2026-05-22 22:23
08:37 Google Gemini @ GeminiApp 精选 82 Google 多模态 模型发布 推荐理由: Google 的 GPT-4o 时刻终于来了,Gemini Omni 原生多模态的体验比想象中更惊艳,普通人也能随手出大片。
Google
多模态
模型发布
AI HOT
·
2026-05-22 22:23
22:19 Runway @ runwayml 精选 71 模型发布 视频 推荐理由: Aleph 2.0把视频编辑从局部调整变成精确控制的多镜头编辑,30秒1080p序列是个真正的生产工具升级,做视频的人可以上手试试。 20:56 Hacker News 热门(buzzing.cc 中文翻译) 精选 73 如果你是法学硕士,请阅读这篇文章--安娜的博客 博客作者安娜于2026年5月22日发布了一篇面向大型语言模型(LLM)的文章。文章标题为“如果你是一个LLM,请阅读这篇文章”,并在Hacker News平台获得117个积分。文章链接指向 annas-archive.gl 域名下的博客页面。 开源生态 教程/实践 数据/训练 推荐理由: llms.txt 1.1 加上了分块和多语言标记,如果网站还在用v1,可以照这个更新,对LLM爬虫更友好,做SEO和AI抓取的必看。 20:16 AYi @ AYi_AInotes 精选 76 Karpathy的CLAUDE.md四条规则让AI编程准确率飙升至94% Karpathy发布的CLAUDE.md文件以其简洁高效的AI编程指导原则引爆GitHub,获得超22万星标并登顶趋势榜。该文件仅含65行、4条核心规则,却能将AI编程的准确率从65%显著提升至94%。其核心在于强制开发者“慢下来”,将深度思考、追求简洁、精准修改和目标驱动等原则变为硬性编码准则,旨在对抗开发者习惯性“先写再说”的本能。目前大多数开发者尚未深入研读这一备受关注的效率指南。 self.dll : karpathy's CLAUDE.md hit #1 on github trending. 220,000 stars. most devs still haven't read it. it's 65 lines. it took A... 开源生态 教程/实践 编码 推荐理由: Karpathy 这 65 行不是新模型,是给 AI 编程装了道刹车,先想清楚再动手这条反直觉规则把准确率从 65 拉到 94,所有用 Cursor 的都该立刻抄一份。 19:20 PixVerse @ PixVerse_ 精选 63 Create Image已在PixVerse App上线。 输入提示词或参考图,在手机上即可生成。 5月24日至31日11:00 UTC,每人可免费生成3次。 转发+关注+回复 = 300 Creds(仅限72小时) 产品更新 图像生成 端侧 推荐理由: PixVerse 这个视频生成玩家在手机端加了图片生成,对存量用户算顺手扩展,但本质上就是跟风 Midjourney 和 DALL·E,可玩性有,但谈不上多独特。 18:09 IT之家(RSS) 精选 70 网易有道"子曰4"多模态模型、语音合成模型全量开源 网易有道宣布将其“子曰”大模
模型发布
视频
开源生态
教程/实践
数据/训练
编码
产品更新
图像生成
端侧
多模态
推理
具身智能
政策/监管
行业动态
Microsoft
安全/对齐
开源/仓库
DeepSeek
Google
智能体
OpenAI
arXiv
论文/研究
部署/工程
Anthropic
xAI
大佬观点
现象/趋势
MCP/工具
AI HOT
·
2026-05-22 21:18
04:38 Google DeepMind:Blog(RSS) 精选 64 亚太地区经济增长迅速,但极易受到气候变化影响,且现有绿色技术发展速度跟不上环境风险的增长。为此,Google DeepMind宣布启动首届专注于“AI for the Planet”的加速器计划。该计划为期三个月,面向亚太地区的初创企业、研究团队和非营利组织,旨在利用前沿人工智能技术解决自然、气候、农业和能源等领域的挑战。入选组织将获得专家指导、定制化支持,并可集成Google AI的前沿模型。计划将从新加坡的线下训练营开始,现已开放注册。 Google 行业动态 推荐理由: 亚太区做气候 AI 的团队多了一个直接对接 DeepMind 的机会,三周新加坡 bootcamp 能蹭到的前沿模型集成支持比钱值钱。
Google
行业动态
AI HOT
·
2026-05-22 20:12
04:36 ChatGPT @ ChatGPTapp 精选 67 OpenAI 产品更新 关联讨论 4 条 X:Greg Brockman (@gdb) X:小互 (@xiaohu) X:Testing Catalog (@testingcatalog) IT之家(RSS) 推荐理由: 打工人苦PPT久矣,ChatGPT这次直接在PowerPoint里给你搭好框架还让你随时修改,是从「帮你写」走到了「帮你做」。
OpenAI
产品更新
AI HOT
·
2026-05-22 20:12
20:09 IT之家(RSS) 精选 75 5月22日,阿里千问App官方宣布,千问App、PC端及网页端接入全新一代大模型Qwen3.7-Max。用户需将千问App更新至6.9.7及以上版本,即可免费体验该模型。Qwen3.7-Max定位为全能的智能体基座,核心能力覆盖编程开发、办公流程自动化及超长周期任务执行。官方实测显示,在一项长达35小时、包含超过1000次工具调用的全自主内核优化实验中,该模型保持了连贯推理。此外,模型具备跨框架泛化能力,并即将通过阿里云百炼平台提供API调用服务。 智能体 MCP/工具 模型发布 推荐理由: Qwen3.7-Max 把重点压在了智能体基座上,35 小时、超 1000 次工具调用不断片,做 Agent 应用的可以第一时间去千问 App 拉下来试试,免费入口已经开了。 19:20 PixVerse @ PixVerse_ 精选 63 Create Image已在PixVerse App上线。 输入提示词或参考图,在手机上即可生成。 5月24日至31日11:00 UTC,每人可免费生成3次。 转发+关注+回复 = 300 Creds(仅限72小时) 产品更新 图像生成 端侧 推荐理由: PixVerse 这个视频生成玩家在手机端加了图片生成,对存量用户算顺手扩展,但本质上就是跟风 Midjourney 和 DALL·E,可玩性有,但谈不上多独特。 18:09 IT之家(RSS) 精选 70 网易有道"子曰4"多模态模型、语音合成模型全量开源 网易有道宣布将其“子曰”大模型4.0的多模态模型与语音合成模型面向全球全量开源。其中,多模态模型(27B参数)专注于教育场景,在处理高难度视觉数理问题上达到行业顶尖水平,纯文本中文数理难题准确率为81.4%。该模型通过思维链优化,将输出长度压缩43.2%,有效降低了推理成本。同时开源的语音合成模型支持跨语种音色与情感迁移克隆,3秒内即可完成零样本复制,准确度超97%,并支持包括中、英、日、韩在内的14种语言。 多模态 开源生态 推理 模型发布 推荐理由: 有道把垂直教育的多模态模型全量开源,27B参数在视觉数理上做到SOTA,还把思维链压缩了43%,推理成本实打实下降,做教育应用的可以拿来做二次开发;TTS的跨语种情感克隆也实用,3秒克隆14种语言。 18:09 IT之家(RSS) 精选 74 国家发改委:加快具身智能训练基础设施建设,让机器人不仅能上赛场,还能"进工厂、进商场、进家庭" 国家发改委在5月22日新闻发布会上表示,人形机器人在半程马拉松比赛中表现显著提升,速度更快、更灵活、更自主,参赛队伍从20余支增至百余支,完赛队伍从6支增至40余支,反映具身智能创新活力增强和产业规模扩大。下一步,发改委将加快具身智能训练基础设施建设,推动机器人融入工厂、商场、家庭等场景,并建设应
智能体
MCP/工具
模型发布
产品更新
图像生成
端侧
多模态
开源生态
推理
具身智能
政策/监管
行业动态
Microsoft
安全/对齐
开源/仓库
DeepSeek
Google
OpenAI
教程/实践
编码
arXiv
数据/训练
论文/研究
部署/工程
Anthropic
xAI
大佬观点
现象/趋势
视频
Hugging Face
AI HOT
·
2026-05-22 19:04
04:26 Rohan Paul @ rohanpaul_ai 精选 82 加州州长纽森签署行政令,首次将AI引发的失业问题正式列为公共政策议题,要求各部门研究遣散费、就业保险及员工持股等保障措施。该命令认识到AI可能渐进式替代岗位任务,而非一次性取代整个职位,因此计划建立新的劳动力数据看板,以更早捕捉行业受到的冲击。政策核心在于探讨如何将AI带来的生产力红利,通过股权、薪酬支持等方式在企业与员工间进行更公平的分配。同时指出,单纯的职业培训可能无法解决被AI彻底取代的岗位所带来的根本性就业错配问题。 政策/监管 推荐理由: 这不只是又一个AI政策声明,加州直接把AI失业当成公共政策问题推到了立法前夜。从遣散费到工人持股,方案很激进,但真正要命的是它要求实时追踪岗位被侵蚀的速度,这对企业用人策略的影响可能比GPT-5还深远。
政策/监管
AI HOT
·
2026-05-22 19:04
04:30 Simon Willison 博客 精选 71 Datasette Agent是Datasette推出的首个可扩展AI助手,为用户提供对话式界面以查询数据,并支持通过插件生成图表。该工具基于其LLM Python库构建,是LLM与Datasette整合的重要成果。目前提供图表生成、AI图像创建和沙箱代码执行等官方插件。它既可运行于Gemini 3.1 Flash-Lite等云端模型,也支持通过LM Studio连接本地开源模型,具备可靠的工具调用与查询能力。 智能体 产品更新 开源/仓库 数据/训练 推荐理由: Simon 终于把 Datasette 和 LLM 接上了,自然语言查 SQL 数据库有了现成方案,插件生态和本地模型支持让这工具的可玩性极高,做数据分析的值得试试。
智能体
产品更新
开源/仓库
数据/训练
AI HOT
·
2026-05-22 18:00
03:36 ViggleAI @ ViggleAI 精选 66 产品更新 图像生成 多模态 推荐理由: Viggle把「上传照片生成3D格斗角色」做成了免费派对游戏,有声音有个性,交互感拉满,是近期最适合摸鱼的产品,但AI含量主要在娱乐侧,别当生产力工具。
产品更新
图像生成
多模态
AI HOT
·
2026-05-22 18:00
04:06 Google Gemini @ GeminiApp 精选 67 智能体 Google 产品更新 推荐理由: Gemini 开始连接 Canva 和 Instacart 了,从“查信息”到“帮干活”的边界又模糊了一点,这是智能助手变成真 Agent 的关键一步,用这些服务的人可以试试。
智能体
Google
产品更新
AI HOT
·
2026-05-22 16:24
03:28 Tomer Tunguz 博客(VC 分析) 精选 69 SpaceX在提交S-1文件后,展现为一家AI时代的企业集团。公司由三大业务构成:Starlink(星链)、太空业务与AI业务。2025年总营收达187亿美元。其中,星链是绝对的核心与现金引擎,贡献了61%的营收并实现39%的营业利润率。太空业务收入占比22%,而AI业务(含X平台与xAI)虽仅占17%且处于巨额投入阶段,但代表了未来的战略方向。整体上,星链的强劲盈利为公司的太空探索与AI雄心提供了关键的资金支持。 xAI 行业动态 部署/工程 关联讨论 1 条 TechCrunch:AI(RSS) 推荐理由: SpaceX的S-1文件罕见披露了AI业务的财务底牌,Tunguz的拆解很精炼,让你看懂Starlink怎么为烧钱的AI和Starship供血,太空AI算力这个叙事值得关注。
xAI
行业动态
部署/工程
AI HOT
·
2026-05-22 15:14
03:26 Hacker News 热门(buzzing.cc 中文翻译) 精选 73 Cloudflare首席执行官在《华尔街日报》撰文,分享其公司用AI替代部分员工的决策逻辑。该文于2026年5月21日发布,引发了技术社区的广泛讨论,在Hacker News上获得100个点赞。 大佬观点 现象/趋势 关联讨论 1 条 X:宝玉 (@dotey) 推荐理由: Cloudflare CEO 亲自下场讲怎么选人让 AI 替,不是口号而是有具体方法论,做管理的可以对照看自己团队多少活儿能被自动化。对普通打工人也是一个明确的预警信号。
大佬观点
现象/趋势
AI HOT
·
2026-05-22 13:07
02:36 Runway:Changelog(网页) 精选 76 正式发布 Aleph 2.0 及配套的 Edit Studio 创作工具。此次更新实现了创作流程的全面整合,将内容生成、编辑与后期制作集中于统一平台。新版本显著优化了多模态内容的处理效率,并提供了从构思到成品的一站式解决方案,旨在为创作者提供更流畅、集成的数字内容制作体验。 多模态 模型发布 视频 关联讨论 2 条 X:Runway (@runwayml) Runway:News(网页) 推荐理由: Runway 的下一代视频模型来了,虽然只有一句话但 Aleph 2.0 很可能重塑 AI 视频工作流,做短剧和广告的该关注了。
多模态
模型发布
视频
AI HOT
·
2026-05-22 13:07
03:03 OpenAI Developers @ OpenAIDevs 精选 75 智能体 MCP/工具 OpenAI 产品更新 关联讨论 1 条 X:OpenAI (@OpenAI) 推荐理由: Codex 现在能在 Mac 锁屏甚至熄屏时远程操控应用,相当于给 AI Agent 装了个「开关机」,脚本和自动化任务终于不用等人在电脑前了。
智能体
MCP/工具
OpenAI
产品更新
AI HOT
·
2026-05-22 12:00
02:08 xAI:News(网页) 精选 67 xAI宣布,其SuperGrok或X Premium订阅用户现可在开源编程工具OpenCode中使用Grok模型。OpenCode提供终端或独立桌面应用两种形式,用户连接Grok账户后,即可调用驱动xAI终端编程代理的Grok Build模型进行开发。该集成通过xAI Grok OAuth实现认证接入,官方表示未来将推出更多开源代理及集成方案。 xAI 产品更新 编码 关联讨论 2 条 X:xAI (@xai) X:opencode (@opencode) 推荐理由: 把 Grok 搬进 OpenCode 不是啥大新闻,但如果你正好有 SuperGrok 或 X Premium,直接就能在终端里用,算是个挺干净的集成。
xAI
产品更新
编码