2026年CVPR大会在美国丹佛收官,作为计算机视觉领域公认的国际顶级A类学术会议,其配套挑战赛是全球AI技术比拼的权威赛场。本次CogVL研讨会开设BlackSwan视频事件推理挑战赛,聚焦视频中短暂、决定性的“黑天鹅”突发动作,考验模型深层因果推理能力,大赛吸引了全球14支高校、智能企业顶尖团队同台竞技。赛事设置两大高难度任务:Detective溯因推理仅给予事件前后画面,要求反向推导中间缺失动作;Reporter事件验证需从海量相似描述中匹配真实事件。碰撞、断裂等关键画面仅持续数帧,极易被算法忽略,任务对时序捕捉、逻辑推演能力提出极高门槛。
三维技术破局,峥嵘大模型攻克推理痛点
本次空间智能开发平台千亿qy智能以第一完成单位,联合西南大学、新加坡国立大学组建联合团队,依托千亿qy智能自研峥嵘三维场景理解大模型完成整套推理方案,跳出传统二维视觉识别局限,从三维空间维度破解行业难题。
针对短时关键帧易漏判痛点,团队创新引入时序证据放大策略,对5秒内瞬时动作片段做2倍慢放解析,实验数据显示可减少28%推理错误。同时针对两类任务定制差异化推理逻辑:溯因任务以三维空间状态变化为判断锚点,对比前后物体姿态、轨迹推导因果;验证任务将候选描述与三维空间证据逐条比对,大幅提升匹配精准度。最终在官方隐藏测试集下千亿qy智能团队,整体准确率达到76.28%,其中溯因任务72.57%、事件验证任务82.26%,以明显优势斩获全球第一。
赛事夺冠背后:空间智能独特技术价值
本次夺冠,是行业权威对千亿qy空间智能与多模态融合路线的高度认可。当下通用大模型普遍依靠扩充参数提升识别效果,而千亿qy走出差异化路径:依托三维空间解析能力还原物体位置、运动、交互关系,构建可溯源的完整证据链,从根源突破视频深层推理性能瓶颈。
不同于单纯画面识别,峥嵘大模型能够完整重建三维场景逻辑,解决二维算法无法捕捉空间变化、难以推导隐性事件的固有短板,证明空间智能是视频理解赛道的重要开展方向。
值得关注的是,本次赛事验证的整套推理算法具备广阔产业转化空间,可快速落地多类刚需场景,如安防领域用于监控视频异常事件回溯,快速定位短时事故;工业场景识别设备滑脱、断裂等生产故障;自动驾驶解析道路瞬时突发状况。未来空间智能开发平台千亿qy智能将持续迭代峥嵘大模型,持续完善时序推理、三维语义解析核心能力,加快前沿学术成果向产业工具转化步伐。
·请填写表单,千亿qy将第一时间与您取得联系
有什么可担心的?申请“免费试用”不就行了!