苹果COO杰夫威廉姆斯将在“月底卸任”年底退休 :曾被认为是库克潜在接班;人

2025-07-24 06:08:20      来源:凤凰资讯

IT之家7月8日消息,据小米技术消息,计算机视觉国际大会ICCV2025论文录用结果公布,小米两篇论文凭借创新性研究成果成功入选:视频理解大模型核心技术Q-Frame,推出行业首个动态帧选择与分辨率自适应框架,实现即插即用;持续学习框架AnalyticSubspaceRouting(Any-SSR),成功解决大语言模型在持续学习领域的核心难题「灾难性遗忘」问题。

据介绍,计算机视觉国际大会ICCV与国际计算机视觉与模式识别会议CVPR、欧洲计算机视觉国际会议ECCV并称为计算机领域世界三大顶级学术会议,每两年举办一次。其中,ICCV2025年投稿量达11239篇,录用率为24%。上述两篇论文代表了小米AI团队在基座大模型领域的最新探索成果,其中视频理解大模型核心技术Q-Frame由小米AI团队全面自研,大模型持续学习框架Any-SSR由小米AI团队联合华南理工大学攻关。

全自研视频理解大模型核心技术Q-Frame

在视频理解大模型(Video-LLMs)的研究中,小米AI团队针对传统“均匀帧采样”处理方式存在时间碎片化信息丢失、盲目采样及算力浪费等问题痛点,推出全自研的Q-Frame核心技术,该成果以论文《Q-Frame:Query-awareFrameSelectionandMulti-ResolutionAdaptationforVideo-LLMs》入选ICCV2025。

Q-Frame作为视频理解大模型核心技术,是行业首个动态帧选择与分辨率自适应框架,也是首个无需训练,市面上各类视频理解大模型基座均可即插即用的算法框架。Q-Frame拥有三大行业首次创新,能够精准理解视频内容与用户问题,通过精准捕捉跟用户问题最相关的视频关键内容,将有效信息量提升5倍:

跨模态查询检索(Cross-modalQueryRetrieval,CQR)

查询感知帧选择(Query-awareFrameSelection,QFS)

多分辨率自适应(Multi-ResolutionAdaptation,MRA)

在MLVU评测集上,Q-Frame使Qwen2-VL的理解准确率从55.5%提升至65.4%;在LongVideoBench上,让GPT-4o的准确率从53.3%提升到58.6%。此外,其多分辨率自适应特性可根据内容重要性和查询需求动态调整帧分辨率,避免算力浪费。

通过采用动态查询感知帧选择和多分辨率自适应,Q-Frame还有效解决了「均匀帧采样」策略下时间碎片化的信息丢失、问题无感知的盲目采样和分辨率一刀切的算力浪费三大难题。与传统均匀选帧、统一处理方式不同,在有限计算资源下,Q-Frame可使模型更高效准确理解视频。

此外,Q-Frame具有即插即用(plug-and-play)的特点,可与市场上现有的各类视频理解大模型兼容,无论是开源模型还是闭源模型,无需对模型进行额外的训练或微调。以VILA-V1.5和Qwen2-VL等开源模型为例,在集成Q-Frame后,这些模型在视频理解任务上的性能均得到了显著提升。同样,对于闭源的GPT-4o模型,Q-Frame也展现出了良好的兼容性,进一步证明了其广泛的适用性。

Q-Frame在小米「人车家全生态」战略中有着多元的应用场景,目前正在持续探索和落地:小米YU7发布时提到的哨兵模式中,能够分清楚普通的风吹草动和可能带来剐蹭、碰撞的危险行为;智能家居中,能够在监控画面中找到最关键的画面,帮助用户解答问题;在小爱视频问答场景中,可以直接定位到视频中能够解答问题的片段开始播放等。

大模型持续学习框架Any-SSR

在大语言模型(LLMs)持续学习(ContinualLearning,CL)领域,往往会因新任务的学习而导致对旧任务知识的遗忘,即灾难性遗忘问题。小米AI团队联合华南理工大学针对这一难题开展研究,其成果《AnalyticSubspaceRouting:HowRecursiveLeastSquaresWorksinContinualLearningofLargeLanguageModel》成功入选ICCV2025。

Any-SSR框架作为行业首个将递归最小二乘法(RecursiveLeastSquares,RLS)引入大语言模型持续学习的技术框架,通过分析路由机制,动态地把不同任务分配到独立子空间学习,避免任务间知识干扰,创新性解决了大语言模型持续学习中灾难性遗忘问题。同时,利用低秩适应(Low-RankAdaptation,LoRA)与分析路由相结合的方式,实现了新旧知识的无缝整合与动态学习。

在一系列技术创新的基础上,Any-SSR方法实现了“近乎完美”的知识保留(即不遗忘),同时能无缝地学习新知识。在实验中,Any-SSR在TRACE基准测试上的表现显著优于其他方法,包括多任务学习(MTL)等,不仅在整体性能(OP)上取得了优异成绩,还实现了零反向知识转移(BWT)。

IT之家从小米技术获悉,过去五年,小米集团研发投入约1020亿元,在2025年的300亿研发投入中,大约有四分之一将被用于AI相关方向。未来五年(2026-2030年),小米还将在核心技术赛道再投入2000亿元。

  近日,农业农村部、水利部、应急管理部、中国气象局联合下发通知,要求各地立足加强组织领导,落实工作责任,分区分类指导,细化实化措施,确保夏播作物种足种满,奠定秋粮和全年粮食丰收基础。

责编:张坚昌编辑

现在就出发

  农业农村部派出3个由司局级干部带队的工作组和7个科技小分队,赴河北、山西、江苏、安徽、山东、河南、陕西7省,指导各地做好抗旱准备和应对工作,保质保量完成夏收夏播。

藏海传上国务院新闻见面会了

  中国煤矿文工团成立于1947年东北解放区,是国家级艺术院团中历史最悠久的单位之一。2005年,加挂了“中国安全生产艺术团”的牌子。2018年9月,转隶到文化和旅游部。

陈赫快从宋亚轩身上下去

  笔者跟多位省级、市级税务人士交流得知,目前并没有全国性查税部署。一些地方根据当地税收大数据风险提示等对个别企业查税,是日常工作,也是税务部门正常履职。毕竟税务部门主要负责税收、社会保险费和有关非税收入的征收管理,发现偷逃税、少缴税行为,理应依法制止,否则就是渎职。

在暨大科技加持后的体育会有多强

  新疆机场集团总经理吕辉斌表示,国泰航空开通乌鲁木齐至香港航线,标志着乌鲁木齐天山国际机场的航线网络又一次升级,满足了新疆及周边地区旅客日益增长的出行需求,不仅提升了乌鲁木齐机场的国际化水平,也将进一步增强新疆的区位优势和影响力,共同助力打造乌鲁木齐成为连接亚欧区域门户复合型国际航空枢纽目标。

留英博士迷奸多人想化学阉割减刑遭拒

  受高空低槽东移影响,16日河南省有分散性阵雨、雷阵雨,雨量分布不均,中西部局部中雨或大雨,并伴有短时强降水、雷暴大风等强对流天气。

单依纯第五

  北京、上海、广州是3大全方位门户复合型功能的国际航空枢纽,成都、深圳、重庆、昆明、西安、乌鲁木齐、哈尔滨是7大区位门户复合型功能的国际航空枢纽。/p>

女子想开蜜雪冰城结果加盟奶爸王子

  2023年7月,中共中央总书记、国家主席、中央军委主席习近平在四川考察时指出,四川要发挥高校和科研机构众多、创新人才集聚的优势和产业体系较为完善、产业基础雄厚的优势,在科技创新和科技成果转化上同时发力。/p>

美国型钻地弹仅次于核武器

  “积极管理你的核心业务,这真是一剂难吃的药。我们有很多艰苦的工作要做。”墨菲表示,虽然底特律汽车制造商需要重新思考在中国的经营方式,但美国电动汽车领导者特斯拉的情况略有不同,与传统的底特律汽车制造商相比,特斯拉在电动汽车零部件方面拥有大约1.7万美元的成本优势,这有助于该公司在中国市场的发展,使其有“更大的发展空间”。(汪品植)