AI HOT
·
2026-06-17 03:20
15:05 🚨 AI News | TestingCatalog @ testingcatalog 精选 75 Karan Goel : We released Sonic-3.5 and Ink-2, the #1 streaming models for text to speech and speech to text you can use in your voice... 智能体 模型发布 语音 推荐理由: Cartesia 同时发布实时语音合成和识别两个模型的迭代版,双双登顶第三方基准,80ms 首音频延迟让语音代理的交互感接近真人,做实时语音应用的开发者可以重点看一下。
智能体
模型发布
语音
AI HOT
·
2026-06-17 03:20
16:40 MarkTechPost(RSS) 精选 71 Google Cloud 发布 Open Knowledge Format (OKF) v0.1,一种供应商中立的 Markdown 规范,为 AI 智能体提供结构化上下文知识。OKF 将知识表示为带 YAML 前置元数据的 markdown 文件目录,每个概念对应一个文件,通过 `type`、`title`、`description` 等少量保留字段实现互操作。无需专有服务、SDK 或运行时,目录可托管在 GitHub、以 tarball 传输或挂载到任意文件系统。OKF 旨在解决组织内部知识碎片化问题——表结构、指标定义、runbook 等散落在不同 catalog 和 wiki 中,各厂商方案互不兼容。遵循最少意见原则,只强制 `type` 字段,生产者和消费者可独立实现。使用场景包括数据团队将 BigQuery 表定义导出为代码、为智能体存储 incident runbook、跨组织知识交换等。 智能体 Google MCP/工具 产品更新 推荐理由: 这是 Karpathy LLM Wiki 思想的首个工业级标准化尝试,把散落在各处的内部知识统一成 agent 可读的 markdown 规范,对构建 AI 应用的团队是切实的工程改进,值得加入设计检查清单。
智能体
Google
MCP/工具
产品更新
AI HOT
·
2026-06-17 03:20
17:57 The Decoder:AI News(RSS) 精选 72 中国 AI 初创公司 DeepSeek 完成首轮外部融资,募资超 500 亿元人民币(约 74 亿美元),估值超 500 亿美元。投资结构特殊:多数投资者将资金投入 CEO 梁文锋管理的有限合伙企业,无投票权且锁定期五年;仅国资 AI 基金直接投资并保留投票权。创始人梁文锋个人投入约 200 亿元,腾讯和宁德时代为主要外部投资者。梁文锋表示优先基础 AI 研究与 AGI 开发,将继续开源。DeepSeek 去年初凭 V3、R1 模型获全球关注,今年 4 月发布运行于华为芯片的最大开源权重模型 V4,并将 V4 Pro 永久折扣 75%,输入价格约为 OpenAI GPT-5.5 的 1/11,输出价格约为 1/35。 DeepSeek 开源生态 行业动态 推荐理由: DeepSeek 首次外部融资估值冲到 500 亿美元,交易结构却排除了投资人话语权,看得出梁文锋仍把控制权抓得很紧,开源路线和极致性价比是最大的筹码。
DeepSeek
开源生态
行业动态
AI HOT
·
2026-06-17 02:14
12:39 Qwen:Blog Retrieval(API) 精选 72 Qwen-RobotWorld以语言为统一动作接口,采用双流Multimodal Diffusion Transformer(MMDiT)架构,将Qwen2.5-VL作为动作编码器。在4个基准测试中取得顶尖成绩,统一20余种机器人形态,基于860万跨场景训练对和1300多项操作技能。语言接口标准化500多种动作类别,支持操作、自动驾驶、室内导航的联合训练。还支持Scene2Robot人类到机器人转移及2–4路多视角几何一致视频生成。 具身智能 多模态 模型发布 推荐理由: 具身智能的世界模型长期受限于单一形态,Qwen-RobotWorld用语言统一动作接口,把操作、驾驶、导航合训,多视角几何一致性和人类演示迁移是过去一年最扎实的落地信号,做机器人的别错过。
具身智能
多模态
模型发布
AI HOT
·
2026-06-17 02:14
12:39 Qwen:Blog Retrieval(API) 精选 72 Qwen-RobotManip 是通义千问基于 Qwen-VL 的视觉-语言-动作(VLA)基础模型,引入覆盖表示、运动和行为三维度的统一对齐框架。仅使用开源机器人数据集和人演示视频,构建约 38,100 小时预训练语料,涵盖 15 种机器人形态。在 LIBERO-Plus 达 91.4%,RoboTwin-C2R Hard 达 69.4%,RoboCasa365 Composite-Unseen 达 14.9%,EBench 达 45.6%,RoboTwin-IF 达 72.0%,并在 RoboChallenge Table30 v1 generalist track 夺冠。模型采用 80 维状态-动作表示、人-机器人数据合成管道(1,933 小时第一人称视频转 24,808 小时数据)及上下文策略适配。 具身智能 开源生态 数据/训练 模型发布 推荐理由: Qwen 这次发布的机器人模型,用统一对齐框架把跨实体数据规模化训练跑通了,OOD 泛化大幅领先,做具身智能的值得认真看一下。
具身智能
开源生态
数据/训练
模型发布
AI HOT
·
2026-06-17 02:14
13:58 OpenRouter:Announcements(RSS) 精选 75 13个平台提供免费LLM API,含永久免费层与试用额度。OpenRouter拥有20+免费模型,单密钥无需信用卡;Groq以约320 tokens/秒运行Llama 3.3 70B;Google AI Studio支持1M上下文;Mistral实验层约10亿token/月但需同意数据训练;Cerebras约1M token/天;GitHub Models提供GPT-4o、Claude 3.5 Sonnet等前沿模型。各免费层有速率限制、数据训练授权、上下文缩减等隐藏成本,建议早期测试2-3个方案并设置故障转移。 评测/基准 部署/工程 推荐理由: 免费 LLM API 不是免费的,这篇文章把 13 家平台的隐藏成本、速率限制和真实可用性都算清楚了,想省钱的开发者值得花五分钟看一遍。
评测/基准
部署/工程
AI HOT
·
2026-06-17 02:14
4 6 信源 · 11分钟前
AI HOT
·
2026-06-17 01:07
12:39 Qwen:Blog Retrieval(API) 精选 70 Qwen 发布 Qwen-RobotNav,基于 Qwen3-VL 在 15.6M 样本上训练,统一了视觉语言导航、目标导航、目标跟踪、自动驾驶和具身问答五个领域,无需修改架构即可在推理时切换任务模式和观察参数。模型在多项基准取得 SOTA:VLN-CE RxR 成功率 76.5%,HM3Dv2 目标导航 75.6%(仅 RGB),EVT-Bench 跟踪率 90.0%,NAVSIM PDMS 91.4,以及三项 EQA 新标杆。模型暴露四个可调轴(视觉 token 预算、时间衰减、相机权重、帧采样模式)。作为智能体系统的一部分,上层规划器 Qwen3.7-Plus 在 EXPRESS-Bench 上提升 15.4%,导航步数减少 77%。模型已零样本部署在 Unitree Go2 四足机器人上,无需环境微调。 具身智能 模型发布 关联讨论 4 条 Qwen:Blog Retrieval(API) 公众号:通义实验室(千问) X:通义千问 / Qwen (@Alibaba_Qwen) MarkTechPost(RSS) 推荐理由: 把导航任务看作上下文配置问题,单一模型覆盖从跟随指令到自动驾驶五种任务,在四足机器人上零样本部署,具身智能的工程化样本。
具身智能
模型发布
AI HOT
·
2026-06-17 00:00
10:00 IT之家(RSS) 精选 70 字节跳动火山引擎旗下火山方舟体验中心于 6 月 15 日上线 Seedance 2.0 Mini 视频生成模型,计划近期开放 API。该模型比 Seedance 2.0 Fast 快 2 倍,输出质量相当。图生视频定价 0.023 元/千 tokens,视频生视频 0.014 元/千 tokens,720P 规格下单秒生成成本约 0.5 元,较 Seedance 2.0 标准版降低约一半。模型面向电商内容生产、营销素材批量生成、UGC 创作及特效玩法等高频率、大规模视频生成场景。 模型发布 视频 推荐理由: Seedance 2.0 Mini 把视频生成成本压到 0.5 元/秒,比标准版便宜一半,对做大批量电商素材和 UGC 的团队是个实际信号,值得等 API 开放后看实测。
模型发布
视频
AI HOT
·
2026-06-17 00:00
10:21 公众号:数字生命卡兹克 精选 69 当前毕业生面临论文AIGC率检测荒诞困境。学生手写摘要被判定99%AI率,纯AI写部分却为0%。学校要求AIGC率不超40%,学生用Claude反复修改并花上百元检测费(维普20元/篇,知网/万方2元/千字符),最终降至36.1%。答辩时老师要求改回学术表达,AI率回升至37.21%。同一论文在不同平台检测结果差异巨大(48%、44%、59%)。部分平台提供降重收费服务,少数学校已改用AI使用声明表替代一刀切检测。 现象/趋势 评测/基准 推荐理由: 作者通过一个毕业生的真实经历,把AIGC检测的荒谬性扒得干净利落——这不是技术问题,是一刀切懒政的代价。看完你会理解为什么「证明你是人」比写论文更难。
现象/趋势
评测/基准
AI HOT
·
2026-06-17 00:00
11:00 IT之家(RSS) 精选 70 支付宝今日开启 AI 版邀测,用户可右滑进入新版界面,在对话框或语音中输入指令,由“阿宝”助手代办事项。以查询公积金为例,阿宝自动匹配对应小程序和服务入口,用户点击确认即可完成,将多步跳转折叠为一句指令。所有涉及资金变动和支付的环节均需用户本人确认。首批放出 100 个邀请码。 智能体 产品更新 推荐理由: 支付宝的AI版右滑唤起阿宝,把查公积金等繁琐流程压成一句话,是超级App从陈列式向对话式转型的实质性信号,做生活服务产品的都该盯一下。
智能体
产品更新
AI HOT
·
2026-06-17 00:00
3 5 信源 · 1天前
AI HOT
·
2026-06-16 22:22
22:01 IT之家(RSS) 精选 73 小米云端轻量化 Claw 产品正式版发布,搭载与 OpenClaw 框架深度适配的 MiMo-V2.5-Pro 模型,原生兼容 MCP 协议,无需额外提示词。支持百万级上下文、单会话千次以上工具调用,MTP 三层解码架构使推理吞吐效率提升约 3 倍。联动金山办公,支持 Word/Excel/PPT/PDF,实现 AI 生成、预览与在线编辑闭环。ClawEval 中 Pass³ 达 63.8%,Token 消耗降低 40%-60%。免费用户每日体验时长升级至 4 小时,上线 TokenPlan 分层订阅,限时特惠 ¥14.9/月。 智能体 MCP/工具 产品更新 推荐理由: 这是小米在AI agent领域的一次务实落地,整合金山办公让工具链有真实场景,定价14.9元月费对普通用户很友好,但技术层面主要是框架适配,没有代际突破。
智能体
MCP/工具
产品更新
AI HOT
·
2026-06-16 22:22
22:18 SiliconFlow @ SiliconFlowAI 精选 65 硅基流动上线月之暗面Kimi K2.7 Code模型。基于K2.6改进,专注编码与智能体任务。32B激活/1T总参,VLM多模态,支持交错思考与多步工具调用。相比K2.6,推理token使用减少30%,减少过度思考;长程编码任务指令遵循和完成率提升。性能接近GPT5.5与Opus 4.8。价格:缓存输入0.19/输入0.94/输出4.00每百万token。 多模态 模型发布 编码 推荐理由: K2.7 Code 在编码上逼近 GPT-5.5 和 Opus 4.8,同时推理 token 用量降低 30%,对追求前沿编码能力又在意成本的技术团队是个实用选择,硅基流动上的定价也给了明确预期。 22:16 Elon Musk @ elonmusk 精选 70 AI 将实现 Stockfish 级别的编码和通用计算机使用 SpaceX : SpaceX has exercised the option to acquire @cursor_ai in an all-stock transaction with the goal of building the world's ... xAI 编码 行业动态 推荐理由: SpaceX 全资收购 Cursor,同时 xAI 与 Cursor 联合训练的模型即将发布,Musk 放话要做出 Stockfish 级别的编码能力。不管最终是否兑现,AI 编程工具的格局都要变一变了。 22:01 IT之家(RSS) 精选 73 小米 MiMo Claw 正式版发布,搭载 MiMo-V2.5-Pro 旗舰模型 小米云端轻量化 Claw 产品正式版发布,搭载与 OpenClaw 框架深度适配的 MiMo-V2.5-Pro 模型,原生兼容 MCP 协议,无需额外提示词。支持百万级上下文、单会话千次以上工具调用,MTP 三层解码架构使推理吞吐效率提升约 3 倍。联动金山办公,支持 Word/Excel/PPT/PDF,实现 AI 生成、预览与在线编辑闭环。ClawEval 中 Pass³ 达 63.8%,Token 消耗降低 40%-60%。免费用户每日体验时长升级至 4 小时,上线 TokenPlan 分层订阅,限时特惠 ¥14.9/月。 智能体 MCP/工具 产品更新 推荐理由: 这是小米在AI agent领域的一次务实落地,整合金山办公让工具链有真实场景,定价14.9元月费对普通用户很友好,但技术层面主要是框架适配,没有代际突破。 21:30 公众号:数字生命卡兹克 精选 67 WorkBuddy日活飙升至行业第二的3-4倍,非技术用户涌入 从3月至今,WorkBuddy日活用户数已达行业第二名的3-4倍,用户不再限于开发者,大量HR、运营、行政等非技术
多模态
模型发布
编码
xAI
行业动态
智能体
MCP/工具
产品更新
现象/趋势
OpenAI
DeepSeek
开源生态
Google
语音
部署/工程
评测/基准
具身智能
数据/训练
视频
其他
arXiv
Hugging Face
Anthropic
安全/对齐
大佬观点
GitHub
教程/实践
Meta
图像生成
搜索
推理
AI HOT
·
2026-06-16 21:16
07:59 IT之家(RSS) 精选 73 苹果AI版Siri迟迟未上线,项目负责人迈克·罗克韦尔在WWDC技术分享会上透露,去年团队曾做出在原有Siri基础上小幅改良、新增工具调用的可运行版本,但因无法达到产品愿景,最终选择推倒重来,完整从零重构系统,依托全新大模型搭建。重构后的Siri拥有独立应用程序,原生支持多模态交互,隐私保护贯穿底层架构,并覆盖iPhone、iPad、Mac、Apple Watch、Vision Pro、CarPlay、AirPods等全平台,提供统一连贯体验。 大佬观点 语音 推荐理由: 苹果AI版Siri推迟的真实原因浮出水面——不是技术卡壳,而是主动选择推倒重来,这对所有做大模型应用升级的产品团队是个值得细读的决策复盘。
大佬观点
语音
AI HOT
·
2026-06-16 21:16
09:02 AYi @ AYi_AInotes 精选 78 五角大楼宣布已将超2/3日常AI工作流从Anthropic转移,目标9月前清零。起因是年初五角大楼要求Anthropic签署协议允许Claude用于大规模监控和全自动武器,CEO Dario Amodei以模型不可靠为由拒绝。五角大楼将其列为“供应链风险”,起诉未果。OpenAI调整立场获得订单。Polymarket预测6月底前和解概率仅9%。此事件凸显AI公司需在原则与政府合作间抉择。 Polymarket : JUST IN: Pentagon announces it has transitioned over two-thirds of its daily AI workflows off Anthropic to rival AI vend... Anthropic OpenAI 安全/对齐 行业动态 推荐理由: 五角大楼用对付华为的'供应链风险'清单切掉Anthropic,这事儿把AI公司的立场选择逼到了明面。技术好只是入场券,愿配合敏感用途才是通行证,AI公司从此要被迫选边站了。
Anthropic
OpenAI
安全/对齐
行业动态
AI HOT
·
2026-06-16 21:16
09:59 Berkeley RDI:Blog(AI 安全与评测) 精选 83 2026年6月,伯克利RDI发布Agents’ Last Exam(ALE)基准,包含1,500余项源于真实工作的任务,覆盖55个非体力职业。对Fable 5、GPT-5.5、Composer 2.5等前沿智能体的测评显示:在最困难层级成功率均为0%;整体任务表现接近,但单任务成本差异巨大(Fable 5约$15.70,GPT-5.5约$3.80,Composer 2.5约$1.33)。CLI子集ALE-CLI最佳通过率仅25.2%。主要失败模式是智能体未验证输出即宣称完成。数据集、代码及CLI子集已开源。 智能体 arXiv Hugging Face 开源生态 推荐理由: 在Fable 5发布后,Berkeley的ALE基准首次大规模量化了agent在专业任务上的真实水平,最难任务0%成功率的结果值得所有押注agent落地的团队冷静下来。
智能体
arXiv
Hugging Face
开源生态
AI HOT
·
2026-06-16 21:16
10:00 IT之家(RSS) 精选 73 教育部“阳光志愿”信息服务系统今日全新升级上线,依托招生、学籍、就业等海量官方数据,免费为考生和家长提供志愿填报服务。系统支持31个省区市本专科普通批次志愿筛选,输入高考成绩、位次及个性化条件即可快速生成合理参考方案。AI助手“智慧小招”24小时在线解答政策规则。平台数据由高校直接报送、官方核验,真实可靠。同时推出专业倾向测评和21项生涯测评工具,帮助学生认清特长、规划未来。 产品更新 其他 推荐理由: 教育部把AI助手“智慧小招”整合进官方志愿填报系统,数据权威是最大卖点,对考生和家长是实用的免费升级,但对AI行业来说,这只是一个典型的政府服务智能化案例。
产品更新
其他
AI HOT
·
2026-06-16 21:16
21:15 Qwen @ Alibaba_Qwen 精选 72 通义千问推出Qwen-Robot Suite,包含三个基础模型:Qwen-RobotNav统一5种导航任务(指令跟随、点目标、物体目标、目标追踪、自动驾驶),具备可控观测协议和智能体工具接口;Qwen-RobotManip实现异构机器人统一状态-动作空间,基于38,100+小时开源语料预训练;Qwen-RobotWorld是单一世界模型,支持20+具身形态,通过自然语言动作接口预测物理世界未来(涵盖操作、驾驶、导航)。三个模型可独立使用或组合,构成通用智能体的底层工具包。 具身智能 模型发布 推荐理由: 通义千问这次一口气发了三个具身基础模型,把导航、操控和环境模拟统一成一个套件,这相当于给机器人领域搭了一套操作系统级基座,虽然离落地还远,但全栈能力已经显出来了。 19:47 TechCrunch:AI(RSS) 精选 74 SpaceX 以 600 亿美元股票收购 AI 编程公司 Cursor SpaceX 在历史性 IPO 数天后,同意以 600 亿美元股票收购 AI 编程初创公司 Cursor,旨在帮助其围绕 xAI 构建的 AI 部门追赶主要 AI 实验室。此前 Cursor 正接近完成一轮 20 亿美元融资,估值 500 亿美元,投资方包括 Andreessen Horowitz、Thrive 和 Nvidia。SpaceX 在 IPO 期间向投资者表示,其 AI 产品可寻址市场达 26 万亿美元。交易预计于今年第三季度完成。 编码 行业动态 关联讨论 5 条 The Verge:AI(RSS) IT之家(RSS) X:Testing Catalog (@testingcatalog) Hacker News 热门(buzzing.cc 中文翻译) X:阿易 AI Notes (@AYi_AInotes) 推荐理由: SpaceX 收购 Cursor 不只是天价交易,更是马斯克 AI 版图拼上关键一块,对 AI 编程工具市场格局冲击不小。 17:57 The Decoder:AI News(RSS) 精选 72 DeepSeek 完成首轮外部融资,估值超 500 亿美元 中国 AI 初创公司 DeepSeek 完成首轮外部融资,募资超 500 亿元人民币(约 74 亿美元),估值超 500 亿美元。投资结构特殊:多数投资者将资金投入 CEO 梁文锋管理的有限合伙企业,无投票权且锁定期五年;仅国资 AI 基金直接投资并保留投票权。创始人梁文锋个人投入约 200 亿元,腾讯和宁德时代为主要外部投资者。梁文锋表示优先基础 AI 研究与 AGI 开发,将继续开源。DeepSeek 去年初凭 V3、R1 模型获全球关注,今年 4 月发布运行于华为芯片的最大开源权重模型 V4,并将 V4 Pro
具身智能
模型发布
编码
行业动态
DeepSeek
开源生态
智能体
Google
MCP/工具
产品更新
语音
现象/趋势
部署/工程
评测/基准
数据/训练
多模态
视频
其他
arXiv
Hugging Face
Anthropic
OpenAI
安全/对齐
大佬观点
GitHub
教程/实践
Meta
图像生成
搜索
推理
xAI
AI HOT
·
2026-06-16 20:11
04:59 GitHub Blog 精选 59 GitHub Copilot CLI 为初学者提供了常用斜杠命令的概述,帮助用户通过命令控制终端中的 AI 智能体。 GitHub 教程/实践 编码 推荐理由: 如果你是刚用上 Copilot CLI 的开发者,这篇官方指南把最常用的 slash 命令都讲清楚了,上手很快;老用户可以直接跳过。
GitHub
教程/实践
编码