MIAOYUN | 模型上新及AI新鲜事儿 260619

本周AI行业产品与技术集中更新:秒云Tokens管家接入GLM5.2、Kimi K2.7 Code、MiniMax M3等多款主流模型;腾讯、阿里、字节、智谱、MiniMax、Kimi等多家厂商接连开源或发布通用、视频、代码类大模型;阿里云、小米、昆仑万维推出全新AI Agent;微信支付AI工具箱、腾讯元宝知识库等AI配套工具同步升级。技术层,清华元认知框架、李飞飞2D转3D生成方案、田渊栋可自主实验的递归AI系统、谷歌统一Agent知识的OKF开放格式;市场侧,Token产业权威研究报告,DeepSeek大额首轮融资,Anthropic模型解禁谈判失败,一起来回顾本周发生的AI新鲜事儿吧!

模型上新

「秒云Tokens管家」模型上新,上架GLM 5.2、Kimi K2.7 Code及MiniMax M3模型

6月15至17日,「秒云Tokens管家」模型上新,新上架智谱最强旗舰模型GLM 5.2、月之暗面Kimi K2.7 Code编程模型及稀宇科技原生多模态旗舰模型MiniMax M3。「秒云Tokens管家」定位一站式可观测大模型API智能网关,以云原生技术为底座,把API聚合、智能调度与Token管控能力、运维优化深度融合,打造“API调用+Token管控+质量监测+成本优化”的一站式服务闭环。目前平台已全面接入以下AI大模型:

  • 智谱最新旗舰模型GLM-5.2、GLM-5.1、GLM-5;
  • 月之暗面最新Kimi K2.7 Code编程模型,原生多模态模型Kimi-K2.6、K2.5系列;
  • 稀宇科技原生多模态旗舰模型MiniMax M3、MiniMax M2.7、M2.5;
  • 字节豆包Seedance 2.0视频生成模型;
  • 深度求索最新旗舰级MoE模型DeepSeek-V4系列,含Pro、Flash版本、V3、V3.1、V3.2、R1系列;
  • 阿里通义千问Qwen3-max-2026-01-23、Qwen3.5、3.6系列;
  • 海外顶级大模型等……

AI 大模型

商汤推出「SenseNova U1」图文交错增强版开源模型

6月12日,商汤推出「SenseNova U1-8B-MoT-Interleaved」图文交错增强版开源模型,针对绘本、多页PPT、图文教程等长序列图文创作优化,解决多轮生成角色漂移、图文脱节等问题;该模型在角色画风统一、图文语义匹配、画面瑕疵优化上实现升级,新增多页PPT自动生成功能,经教程、绘本、手绘过程、PPT四大场景实测,生成内容逻辑连贯、视觉效果更佳,目前模型已在Hugging Face、GitHub、魔搭社区全球开源。

月之暗面开源「Kimi K2.7 Code」模型,Token消耗减少30%

6月12日,月之暗面Kimi正式发布并开源「Kimi K2.7 Code」编程模型,该模型相较K2.6大幅提升长上下文编程、智能体自主执行能力,多项代码基准测试成绩显著上涨,平均Token消耗减少30%;目前企业与开发者可通过Kimi API开放平台、Kimi Code Plan等渠道使用该模型,其1M token标准输入、输出价格与K2.6保持一致,缓存输入价格下调至1.3元,使用时必须开启思考模式才能发挥最优效果。此外,高速版(输出速度达普通版5-6倍)定价为普通版的2倍,后续还会分阶段向不同用户开放体验。

1B参数「HRM-Text」开源,分层递归架构刷新推理模型思路

6月13日,Sapient Intelligence推出的「HRM-Text」仅1B参数、训练成本约1500美元,依托分层递归推理架构,采用高低双模块、潜空间推理模式,在多项推理任务中表现亮眼。该模型已完整开源,技术思路也被图灵奖得主Bengio团队的GRAM模型借鉴,分层递归、潜空间推理成下一代AI推理架构的重要方向。HRM系列逐步从符号推理拓展到自然语言领域,提出推理与知识解耦的思路,证明模型升级不止依赖规模扩张,为低算力团队提供了新方案。

里约市政IT团队开源「Rio 3.5 397B」模型跻身全球顶尖开源模型

6月14日,巴西里约热内卢市政府旗下IT公司IplanRIO开源的「Rio 3.5 397B」模型引发AI圈关注,该模型以Qwen3.5-397B-A17B为基座做二次训练,凭借混合专家架构、百万级上下文窗口以及SwiReasoning动态推理框架,在多项基准测试中超越Qwen 3.7 Plus等主流开源模型,跻身全球第一梯队。本周另一款同基座模型「Nex-N2-Pro 397B」也表现亮眼,可对标顶级闭源模型;该模型采用MIT协议,支持商用与研究,也让行业再次探讨闭源与开源两条AI发展路径。

腾讯Robotics X联合开源「HyVLA-0.5」具身智能VLA模型

6月15日,腾讯Robotics X联合福田实验室、混元团队开源「HyVLA-0.5」具身智能VLA模型,依托自研亚毫米级指套式UMI设备,搭建超万小时人类示教数据集,无需遥操作数据即可完成跨机器人真机部署,在RoboTwin 2.0仿真基准中成功率超90%,位居开源模型榜首。模型创新引入FlowPRO强化学习方案,利用机器人失败数据优化策略,让真机任务成功率接近满分;其在架构、训练、部署等环节完成全栈设计,支持多类机器人跨本体迁移与稳定运行。

Kimi API开放平台上线「Kimi K2.7 Code」高速版,提速5-6倍

6月15日,Kimi API开放平台上线「Kimi K2.7 Code」高速版,输出速度为普通版的5-6倍,常规场景约180 Token/s,短上下文可达260 Token/s,定价为普通版2倍;该版本也同步登陆Kimi Code Plan,抢先体验可参与内测,7月起逐步对对应会员开放,其用量消耗为普通版3倍。K2.7 Code相较K2.6代码能力大幅提升,长上下文表现优化,Token消耗平均减少30%,各项基准测试成绩均有明显上涨,使用该系列模型需开启思考模式。

稀宇科技正式开源「MiniMax M3」模型,并发布MSA技术论文

6月15日,稀宇科技正式开源「MiniMax M3」原生多模态旗舰模型,并发布MSA稀疏注意力技术论文,该模型总计428B参数、激活参数23B,是首款从零完成多模态混合预训练的开源模型,依托MSA技术有效降低长上下文计算成本。目前M3登顶多项权威开源模型榜单,推理、编码、金融等场景表现优异,兼具强劲实力与超高性价比;官方已将模型输出速度优化至80 TPS,后续还将继续提速,同时上线调用量看板,并将持续优化服务稳定性,助力用户低成本规模化部署。

字节跳动推「Seedance 2.0 Min」轻量化视频生成模型

6月16日,字节跳动推「Seedance 2.0 Min」轻量化视频生成模型,主打高性价比与更快生成速度,运动表现优于同系列Fast版本,支持图文音视频多模态参考素材输入,人物一致性、音画同步等能力表现亮眼,但存在物理逻辑、镜头切换等细节瑕疵。该模型生成成本较原版降低约五成,标准会员最低0.16元/秒,目前可在即梦AI、小云雀、火山方舟体验,API将于6月22日开放,适配短视频创作、创意草稿、批量产出等场景。

阿里千问发布「Qwen-Robot Suite」具身智能模型套件

6月16日,阿里千问发布「Qwen-Robot Suite」具身智能模型套件,包含Qwen-RobotNav、Qwen-RobotManip、Qwen-RobotWorld三款配套基础模型,分别负责机器人移动导航、机械臂操作交互、物理场景动态预测,通过统一语言接口打通视觉语言认知与物理动作的表征鸿沟;三款模型依托海量开源机器人与人机合成数据训练,在多项导航、操作、世界预测权威基准取得SOTA成绩,可零样本适配多类机器人本体,既可单独使用也能搭配Qwen通用大模型搭建完整物理智能体闭环系统。

智谱正式上线并开源「GLM-5.2」模型

6月17日,智谱正式上线并开源「GLM-5.2」模型,该模型主打代码能力与长程任务处理,在Code Arena前端开发评测中位列全球第二,是综合表现顶尖的开源模型。具备1M无损上下文,长程任务性能处于Claude Opus 4.7与4.8之间,前端、后端及复杂工程调试等编码能力较前代大幅提升,还新增思考档位控制功能;依托IndexShare等技术完成架构优化,上线首日便适配华为昇腾等多款国产算力平台。模型采用MIT开源协议,可自由商用部署,已同步开放API、在线体验及配套Agent工具,未来团队将继续攻关全自治智能体系统相关技术。

阿里正式上线实时交互开放式世界模型「HappyOyster 1.0」

6月17日,阿里正式上线实时交互开放式世界模型「HappyOyster 1.0」,区别于仅输出成片的文生视频,可通过文本或图像生成能持续推演、实时操控的数字世界,拥有世界探索、实时导演两大核心功能,支持自由漫游、物理交互、剧情暂停回溯与多分支创作;其依托世界状态建模、内生一致性、开放因果动作空间、长时序音视频协同四大核心技术实现场景长期稳定、角色道具不变形、自主推演物理因果、音画同步生成;该模型可应用于游戏原型制作、虚拟陪伴、互动短剧、虚拟直播、文旅虚拟场景等领域,官方网站现已开放注册,API预计7月初对外开放。

AI Agent

阿里云桌面AI助理QoderWork上线「意识」功能

6月16日,阿里云桌面AI助理QoderWork上线「意识」功能,集成记忆、反思、技能进化三大模块,采用分层记忆存储、本地可编辑Markdown记忆文件,搭配带备份回滚机制的反思流程;依托多因子评分模型判断是否触发反思,借助分叉会话降低算力开销,还能自动识别高频任务生成可自定义处置的技能建议,产品同时搭载多类创作工作台与各行业专业套件。

小米云端轻量化AI Agent产品「MiMo Claw」正式版上线

6月16日,小米云端轻量化AI Agent产品「MiMo Claw」正式版上线,搭载深度适配OpenClaw框架的MiMo-V2.5-Pro旗舰模型,具备百万级长上下文、MTP三层解码提速、原生MCP工具调用等能力,Token消耗相较同类产品降低40%-60%;本次产品联动金山办公,打通Word、Excel、PPT、PDF全链路文档生成、预览与编辑办公闭环,同时采用云端免部署模式,支持7×24小时专属智能体运行。平台升级免费用户每日单次使用时长至4小时并开放全部核心功能,面向高频专业用户推出可灵活叠加的TokenPlan分层订阅,设置限时优惠定价,同时兼顾存量用户历史额度、套餐叠加与退费折算等权益规则。

天工「Skywork 3.1」发布,画布设计+多智能体打通商用全流程

6月17日,昆仑万维发布「Skywork 3.1」,海内外同步上线画布设计工具「Skywork Design」与多智能体并行调度「Dynamic Workflows」两大功能;Design支持在无限画布制作统一规范的完整UI项目,留存多轮迭代记录,适配建站、APP原型等场景;Workflows可拆解大规模任务、多智能体分工校验并断点续跑,高效处理批量生成、全量排查等工作;两大功能与天工主站数据互通,设计成果可多格式导出,实现从AI简易Demo到完整商用产品的全流程落地。

AI 工具

微信支付AI接入工具箱2.0发布,五大升级大幅降本提效

6月15日,微信支付正式推出AI接入工具箱2.0,针对初代版本的使用痛点完成五大升级:支持9种语言并做专属语义适配,打破海外开发者翻译障碍;知识库实现全产品覆盖,新增技术、金融研发两大AI专家能力;上线CLI动态排障功能,开发者可在编码环境内查询订单状态、排查问题;将文档图表转为Mermaid格式,Token消耗降低50%;同时新增知识库自动同步功能,保证本地版本持续最新,全方位提升开发者对接、调试与使用效率。

腾讯元宝打通ima知识库,精准溯源原文,一键存库

6月15日,腾讯元宝打通ima公开知识库,用户在元宝提问时,平台除联网搜索外,还可直接引用ima公开知识库里的海量专业知识,回答更精准、条条可溯源。此外,点击信源引用卡片可直接跳转ima原文,还能一键加入个人知识库,接着提问。目前,ima已覆盖金融、法律、医疗、教育等20余个行业。

技术突破

田渊栋团队推出全自动AI研究系统,迈出递归式AI自我改进关键一步

6月12日,田渊栋联合创立的Recursive Superintelligence发布首款自动化AI研究系统,实现AI自主完成“提想法-写代码-跑实验-分析结果-迭代优化”的全流程闭环,并在NanoChat小模型训练、NanoGPT速度竞速、GPU内核优化三大基准测试中均刷新SOTA成绩,其中将GPU内核优化与硬件理论极限的差距缩小18%。该系统内置防奖励作弊机制,支持跨任务复用优化模式,但目前在开放性科研问题上仍有局限。此前Anthropic已发文警示递归AI风险,其Claude已承担超八成代码编写工作,并呼吁行业建立前沿AI开发的暂停机制。

李飞飞World Labs连发三篇3D生成论文,落地2D模型赋能3D生成路线

6月13日,李飞飞联合创立的空间智能公司World Labs一次性发布三篇首批学术论文,均由实习生主导,核心思路是依托成熟2D生成模型与海量二维数据降低3D内容生成门槛。其中World Tracing可从单张图像还原完整三维几何结构;Modality Forcing让文生图模型兼具深度感知与3D推理能力;Flex4DHuman能从普通单目视频重建动态4D人体,各项技术均取得不错效果。

清华NLP联合提出元认知知识增强框架「Know More」、「Know Clearer」

6月15日,清华NLP联合哈工大、AI9Stars发表论文,提出元认知知识增强框架「Know More」,「Know Clearer」,针对大模型自信度与真实能力脱节、易产生幻觉的问题,先验证准确率随模型不确定性指数衰减的规律;框架由CGKE知识扩展、CDKC知识校准构成,前者划分知识掌握/混淆/缺失分区并针对性补全梳理知识,后者结合强化学习对齐模型主观置信与客观答题效果;在主流大模型与多套评测集测试后,该方法提升问答精度、降低校准误差,强化模型自知边界的能力,为缓解大模型幻觉提供可行方案,论文已被ICML2026 Spotlight收录。

谷歌开源「OKF」开放知识格式,破解AI Agent知识互通难题

6月16日,谷歌开源「OKF」(开放知识格式)通用规范,旨在解决AI Agent相关知识碎片化、格式不统一、难以互通复用的行业痛点。该规范基于Markdown文件目录构建,搭配YAML头部结构化字段,仅做最小约束,不绑定平台与SDK,遵循独立生产消费、非平台化三大设计原则;谷歌还同步推出数据生成Agent、静态HTML可视化工具及多组示例文件,并已在谷歌云知识目录完成适配,目前规范为v0.1版本且支持向后兼容,全部内容及代码均在GitHub开源。

市场动态

中国工业互联网研究院联合发布《Token驱动智能经济研究报告(2026年)》

6月13日,中国工业互联网研究院联合近百家机构与企业发布《Token驱动智能经济研究报告(2026年)》,报告指出Token已完成从技术符号到新型生产要素的三次跃迁,我国日均Token调用量已达140万亿;报告构建了Token价值度量与复合定价模型,提出TDN分发网络及“生产-调度-消费”三层产业生态,同时梳理了技术、企业、产业层面的落地痛点并给出对应解决路径,还前瞻预判了六大发展趋势,并从技术、标准、基建等七个维度给出产业治理建议,强调掌握Token相关规则将助力我国抢占智能经济发展主导权。

举报引发管制,Fable 5、Mythos 5两款模型解禁谈判宣告失败

因亚马逊举报存在越狱风险,美国商务部紧急对Anthropic的Fable 5、Mythos 5两款顶级大模型下达出口管制令并全网下架;6月15日Anthropic团队赴华盛顿谈判试图解禁,最终谈判破裂,美方提出需彻底解决越狱问题才可有限恢复使用,而该要求在技术上难以实现。事件背后实则是双方意识形态冲突与沟通失当,Anthropic的一系列操作被美方视作挑衅。此前已有百位美国顶尖网络安全专家联名呼吁解禁,认为两款模型多用于网络防御,盲目封禁弊大于利,还会削弱美国AI竞争力,此次事件也成为对美国AI监管模式的一次考验。

DeepSeek完成首轮超500亿元融资,整体估值超3380亿元

6月16日,国内AI企业DeepSeek完成首轮超500亿元融资,整体估值超3380亿元,创下国内AI行业单笔融资纪录。本轮采用特殊交易结构,多数资金注入CEO梁文锋管理的有限合伙企业,外部投资者无投票权且股份锁定五年,仅国家人工智能产业投资基金直接入股、不受锁定期限制并享有投票权;出资方包括梁文锋、腾讯、宁德时代、京东等企业及机构。此次融资意在筛选长期价值投资者、保障团队控制权,也将为其模型研发、业务落地与人才储备提供资金支撑,这家此前长期依靠母公司自给自足的AI实验室正式开启资本化新阶段。

Your browser is out-of-date!

Update your browser to view this website correctly. Update my browser now

×