
极佳视界在成立之初就认定世界模型是语言模型之后AGI下一个最重要的方向。
据IPO早知道消息,通用世界模型北京市重点实验室于10月11日正式揭牌。
据介绍,该实验室于今年5月获批,是国内首个世界模型方向的省部级重点实验室,由北京极佳视界科技有限公司作为依托单位。清华大学自动化系长聘教授、系副主任鲁继文受聘担任实验室学术委员会主任,极佳视界联合创始人、首席科学家朱政受聘担任实验室主任。
实验室依托单位极佳视界创始人兼CEO黄冠在致辞中表示,AGI不能只停留在语言智能,更需要在物理三维空间中理解、生成、预测和行动的能力,而这些能力的实现有赖于通用世界模型的突破。实验室将锚定"通用世界模型方法与技术"核心科学问题,围绕基础理论、关键技术体系与典型应用系统开展系统性攻关,面向具身智能、自动驾驶、内容创作等场景,坚持原始创新与产业转化双轮驱动,力争产出一批具有全球引领性的标志性科研成果。极佳视界作为依托单位,将在人才、经费、算力、场地、数据等方面为实验室提供长期保障,并推动实验室面向高校和科研院所开放共享。

以下系极佳视界创始人兼CEO黄冠的演讲精选:
北京市很早就把世界模型列为人工智能、通用智能,特别是物理智能的重点发力方向,作为一家以基础模型为核心的企业和团队,这份耐心和对我们的支持尤其珍贵。
今天要揭牌的实验室是国内首个世界模型方向的省部级的重点实验室,极佳视界作为依托单位,我们一定把实验室支持好,让科研人员能够安心地做长期的、有价值的事情。今天我从三个方向给大家汇报一下相关的工作,分别是为什么我们认为世界模型这么重要,以及实验室的定位和要做的事情,以及极佳视界作为依托单位如何去支持。
过去几年,AGI在整个语言模型发展的方向取得了突飞猛进,突破式、颠覆式的进展。但是我们看到的AGI能力还是停留在数字语言空间,它拥有非常强的,无论是我们看到的聊天、写代码、做Agent,在数字语言空间理解、生成、预测和行动的能力。但是AGI肯定不能只停留在语言智能上,AGI更需要在物理的三维空间中理解、生成、预测、行动。而实现这些能力的核心我们认为已经收敛到需要通用世界模型的突破,在这个背景之下,在今年8月份世界机器人大会上,我们首次提出了通用世界模型的L1到L5的分级。
在全球范围内首次系统性地提出通用世界模型的分级,可以类比应该在2023年左右,OpenAI也提出了语言模型的L1到L5分级,也非常好地指导了语言模型的发展,希望通过通用世界模型的分级,从生成视觉真实的视频世界不断往更高级别,走向世界动作模型,动作的生成,走向3D几何的生成,走向精准物理的生成,最终抵达可长程运营的通用的无限世界,为行业提供一个世界模型路径,让大家更清楚地看到通用世界模型非常大的价值,以及坚实的路径。
在世界模型方向,我们认为它的两个非常大的应用场景主要集中在物理智能和内容创作方向,当前极佳视界围绕这些方向已经构建起了从世界模型的基础模型,到原生的产品到通用场景三位一体的布局,以通用世界模型为核心,为具身智能、智能驾驶、内容创作等方向持续供给数据、仿真和创作的生产力。
更进一步我们也把世界模型对于世界的理解、预测转化为行动,驱动通用机器人进入家庭和工厂。在具身智能方向,我们也是一两个月前发布的最新一代的具身基础模型GigaBrain-0.7,首次将世界模型引入形成了三系统的架构,并结合在线强化学习形成持续自进化的闭环,能够在行业首次实现超过20分钟,超过20个子任务一镜到底的长程执行,这个模型也是我们内部评测看到第一次能够全面地和全球最先进的全面对标甚至形成一些方向的领先优势。
同时,我们在世界生成模型GigaWorld-1在国际权威的世界模型评测WorldArena上击败了Google、英伟达这些国际巨头,获得全球第一,我们的GigaBrain-PingPong模型能够实现人形机器人全自主的高动态乒乓球对打,我们在一个月前发布了结果,当时也刷新了人类和机器人连续人机对打的纪录。
在自动驾驶方向,DriveDreamer系列的模型和DriveDreamer Engine系列的产品能够支持长时间的视频生成、数据生成,能够支持多视角生成(RGB和激光雷达),多传感器的跨传感器一致的生成,相关的模型和产品已经与超过30家全球头部的汽车主机厂和自动驾驶公司达成了签约定点和量产合作。
在内容创作方向,一粟模型是国内最早一批Sora级别的视频生成模型,我们基于一粟模型和一粟产品也在持续推进,包括向长镜头、长时间、三维和物理的一致性和长程的生成,致力于走向工业级的高质量的影视创作,为整个文化的发展和传承提供更大的支持和助力,极佳视界全新一代的视频生成基础模型和全模态通用世界模型,也将在年内发布全新版本。
面向通用世界模型的重大机遇,实验室会锚定以下核心目标:一是面向国家的战略需求,服务北京市国际科技创新中心建设;二是夯实基础理论的底座,引领全球通用世界模型的技术发展;三是坚持产学研贯通,培育通用世界模型领域的国际领军力量。
实验室围绕通用世界模型方法和技术的核心科学问题,围绕世界模型基础理论、关键技术体系和典型应用场景,开展系统性攻关,应用场景包括具身智能、自动驾驶、内容创作等多个方向。
实验室坚持原始创新和产业转化双轮驱动,贯通基础研究、技术攻关系统验证和产业落地的全链条。力争产出一批具有全球引领性的标志性科研成果,助力我国通用世界模型和物理智能前沿赛道,抢占未来发展的制高点。
极佳视界在2023年成立之初,我们就认定世界模型是语言模型之后AGI下一个最重要的方向,三年多来我们在具身智能、自动驾驶、内容创作等多个方向上把当初的判断一步步做成技术、做成产品。但我们也清楚,实验室牌子的揭开只是把考卷发了下来,题目很有挑战,需要长期的投入。我们会和各位专家一起一道题一道题地去答,让通用智能更深入地去理解世界、创造世界,也更有能力改变世界。
4001102288 欢迎批评指正
All Rights Reserved 新浪公司 版权所有
