91官网使用讲解 ▫️第一步:选择/拖拽文件至软件中点击“♓添加91官网”按钮从电脑文件夹选择文件《jycnm.com》,或者直接拖拽文件到软件界面。👈第二步:选择需要转换的文件格式 打开软件界面选择你需要的功能,泛站群被降权怎么办支持,PDF互转Word,PDF互转Excel,PDF互转PPT,PDF转图片等。⛑️第三步:点击【开始转换】按钮点击“开始转换”按钮, 开始文件格式转换。等待转换成功后,即可打开文件。三步操作,顺利完成文件格式的转换。
今年WAIC(世界人工智能大会)期间,观察许多人都在谈论世界模型,都谈但说的世界说未必是同一件事。
7月19日,模型在上海西岸国际会展中心,回事同一场论坛上,观察91免费成人视频软件两种不同的都谈声音先后登台。中国科学院院士、世界说南京大学副校长周志华讲述了决策层世界模型依然面临的模型现实:推演误差和交互试错的高昂成本。他的回事团队最近有些许进展,但这仍是观察他口中“正在探索的方向”之一,而非已经解决的都谈问题。
昆仑万维董事长兼CEO(首席执行官)方汉则给出一种判断。世界说“2026年是模型‘世界模型元年’。AI不再只停留在生成内容,回事而是开始理解世界怎么运行,预判行动会带来什么结果。”
一个“探索中”,一个“元年”。产业已经在抢跑,但世界模型的地基还没打完。
同一个世界模型,公司各自“解题”
每家公司对世界模型的界定,几乎都精准卡在自己正在做的事情上。
腾讯不做硬件本体,只承担具身大脑平台的角色。腾讯首席科学家、Robotics X实验室主任、福田实验室主任张正友认为,机器人行业就像iOS与安卓、Mac与Windows,也会分化出“全栈自研”和“平台+生态”两条路,腾讯选的是后者。
在模型上,他认为VLA(视觉语言动作模型)短板明确,没有预测能力,而世界模型可以基于行动后果做预测。世界模型下一个有价值的方向,在于模型同时传递语言和图像信息,能推理,也具备想象力。
智象未来创始人兼CEO梅涛认为,一个真正的世界模型有三个要素:表达、推演、构造世界。实现这些的关键在于,让模型真正建立起对物理世界统一的认知。这也就是91高清下载智象未来坚持原生全模态大模型的初衷:不是做一个更大的拼接模型,而是在最底层把“世界的运行规律”刻进模型的DNA里,以统一的方式理解视觉、语言、动作和空间关系。
梅涛认为,如果我们仅仅是把世界进行复现,本质上只是在做现有知识的压缩、拟合与复刻。在这样的范式下,人类五千年文明积累的信息量上限,就是AI的能力上限。
但他也坦言,现在包括视频、多模态、具身、3D在内的各种世界模型,离真正的世界模型还比较遥远。
生数科技同样基于视频数据训练世界模型,强调对物理世界的理解。生数科技CEO骆怡航认为,世界模型必须同时具备感知理解、预测想象、行动三个维度:“世界模型一定要刻画整个人与世界的交互规律,同时能驱动人与数字、物理世界打交道,这个定义应该具备很强的Foundation(基础)属性。”
作为PhysX物理引擎奠基人之一的张立华,同时也是复旦大学长聘特聘教授、飞捷科思创始人、中国人工智能学会人机融合智能专委会主任,他的判断标准落在是否符合物理规律上。
他认为,现有的主流世界模型基本还是数据驱动的视觉模型,难以把物理规律准确地嵌入模型里。“虽然你看了很多图像、视频等数据,形成了一定的物理直觉的能力,但这个能力也存在限制,就像人的物理直觉一样,虽然能够在某些条件下给出相对准确的趋势判断,但并不能保证所有情况下判断的准确性和真实性。虽然你看了很多,但不等于你抓住了这些表象背后的物理机制。”
世界模型定义还存在争议,但不影响各大公司卡位。
昆仑万维不再局限于视频(SkyReels)、音乐( Mureka )等AI生成内容的动漫91免费业务线,开始向世界模型、机器人模型等物理AI叙事框架转变。生数科技并不瞄准单一场景,而是希望做好通用能力,用同一个模型驱动不同本体去做不同的任务,半天到一天内就能适配部署。飞捷科思则发起“物理智能创新联合体”,联合32家单位,定位成国产世界模型的操作系统底座。
谁能先抓住“世界模型”这顶帽子,谁就先占住了故事的入口。一位投资人曾透露,他年初见过一家具身智能公司,能讲出非常好的应用场景,时隔三个月后便开始讲世界模型的故事,“这是很现实的问题”。
模型存短板,不能完全信任
世界模型对物理世界的理解,还存在欠缺。
破壳机器人创始人许华哲提到,即便现在的模型已经能做到不错的像素级预测,也不能完全信任它。“只要是模型生成出来的东西,就一定带着模型自己的特性,如果在这样的仿真器里学策略,很容易拟合到模型的特性,而不是真实世界的特性。”
要补上这个缺口,模型需要两个方向:一是让模型本身更懂物理规律,二是让模型学习的环境足够真实。
前一个方向,是视频生成厂商正在做的事,押注的是底层算法架构和高质量数据实现跃升后,模型自己能把物理规律“悟”出来。
智象未来选择视频、全模态到世界模型这条路径,因为“互联网视频数据非常多,这些数据已经包含许多物理规律、因果关系在内”。并自研了UiT(Unified Transformer)架构,在数据端则涵盖了20万小时版权数据,覆盖超70%华语电影资源的行业多模态语料库。
生数科技则用MoT架构(可以理解为是一种稀疏、多模态Transformer架构)把理解、生成和行动整合在一起,而非“先理解、再规划、羞羞漫画3再动作”的分步路线。
模型“悟”出规律,还得放到仿真环境里训练和验证。如果仿真环境本身的物理规律不够真,模型学到的东西再像,也经不起真机上的检验。这就是飞捷科思在做的事,给模型提供可信的训练地基。
一切源于张立华团队的踩坑经历。他的复旦实验室团队,早年也用过其他商用具身仿真平台做仿真训练,“仿真的时候机器人表现得非常完美,但我们把实机都造出来后,再一验证就发现不行”。后来团队排查发现,其底层的物理引擎动量并不守恒,仿真训练了很久,但因为模拟的物理规律并不符合现实世界的物理规律,导致训练好的算法不能在真机上复现。
经历这一教训后,团队没有急于继续扩大模型训练,而是转向自研底层物理引擎和仿真训练平台,目的就是要提升物理引擎和仿真训练平台的精度和能力。进一步,他们做出了全新一代物理世界模型Fysiverse,其架构是创新的“显式物理模拟器+生成式渲染器”双驱动,让生成模型继续发挥视觉表达优势,用物理引擎补因果建模的短板。
张立华认为,现在绝大部分模型还是以端到端为主,很少体现推理能力,但一个真正通用、有泛化性的模型,未来一定要具备推理能力。“遇到物体位置突然变化这类情况,机器人应该可以像人一样及时做出判断并调整策略,而不是只靠预训练学到的反应去执行。”而这种推理能力的训练,同样需要物理真实的仿真环境来支撑。
第一人称视角数据缺失,补法却不一样
模型要学好,除了要有对的架构和环境,还需要足够多的数据。具身智能下一步,需要大量第一人称视角的操作数据,也就是以人的视角拍到的、真实操作物体时的黄免费视频。
视频生成厂商正在把自己的生成能力延伸向用于模型训练的数据供给。这背后是世界模型对高质量数据的渴求。梅涛提到,目前容易获取的数据基本已经被拿得差不多了,但真正高质量、有私域价值的数据反而越来越难拿到。
梅涛谈到智象未来与一家机器人公司的合作:对方提供人类带着夹爪操作的仿真数据,每个关节点精度大概在毫米级;智象未来反过来生成一份不带夹爪的真人第一人称实操视频,和原始数据一一对齐。“用这样的视频可以做增广,一份高精度、带夹爪的视频,能生成出上百到上千份不同背景、肤色、形态的版本,同样保持高精度。”
C端的数据采集,目前还停留在比较原始的阶段。许华哲提到,现在主要是靠58同城、猎聘这类公司,派人带着采集设备上门去拍;下一步可能是把采集设备直接寄到普通人家里,让人边带娃或边做自媒体,边采数据赚点钱。
究竟需要多少量级的数据,行业还在探索。启明创投给出一个参照:头部机器人公司的有效数据,会从2025年的“万小时级”,跃升到2027年的“百万小时级”,其中人类第一视角数据将占绝对主导。
而数据恰恰是行业难以共享的东西。许华哲提到,数据是具身智能里最核心的资产,几乎没人会真正把它开源出来,网上很多号称开源一万小时的数据集,点开可能只有五十小时。
当行业有人喊出“元年”时,学界在解理论“死结”,厂商在用同一个词争不同的定义。模型在往前跑,地基在往下打,中间还缺数据。世界模型在还没被讲清楚前,就已经被相信了。
今年WAIC(世界人工智能大会)期间,许多人都在谈论世界模型,但说的未必是同一件事。
7月19日,在上海西岸国际会展中心,同一场论坛上,两种不同的声音先后登台。中国科学院院士、南京大学副校长周志华讲述了决策层世界模型依然面临的现实:推演误差和交互试错的高昂成本。他的团队最近有些许进展,但这仍是他口中“正在探索的方向”之一,而非已经解决的问题。
昆仑万维董事长兼CEO(首席执行官)方汉则给出一种判断。“2026年是‘世界模型元年’。AI不再只停留在生成内容,而是开始理解世界怎么运行,预判行动会带来什么结果。”
一个“探索中”,一个“元年”。产业已经在抢跑,但世界模型的地基还没打完。
同一个世界模型,公司各自“解题”
每家公司对世界模型的界定,几乎都精准卡在自己正在做的事情上。
腾讯不做硬件本体,只承担具身大脑平台的角色。腾讯首席科学家、Robotics X实验室主任、福田实验室主任张正友认为,机器人行业就像iOS与安卓、Mac与Windows,也会分化出“全栈自研”和“平台+生态”两条路,腾讯选的是后者。
在模型上,他认为VLA(视觉语言动作模型)短板明确,没有预测能力,而世界模型可以基于行动后果做预测。世界模型下一个有价值的方向,在于模型同时传递语言和图像信息,能推理,也具备想象力。
智象未来创始人兼CEO梅涛认为,一个真正的世界模型有三个要素:表达、推演、构造世界。实现这些的关键在于,让模型真正建立起对物理世界统一的认知。这也就是智象未来坚持原生全模态大模型的初衷:不是做一个更大的拼接模型,而是在最底层把“世界的运行规律”刻进模型的DNA里,以统一的方式理解视觉、语言、动作和空间关系。
梅涛认为,如果我们仅仅是把世界进行复现,本质上只是在做现有知识的压缩、拟合与复刻。在这样的范式下,人类五千年文明积累的信息量上限,就是AI的能力上限。
但他也坦言,现在包括视频、多模态、具身、3D在内的各种世界模型,离真正的世界模型还比较遥远。
生数科技同样基于视频数据训练世界模型,强调对物理世界的理解。生数科技CEO骆怡航认为,世界模型必须同时具备感知理解、预测想象、行动三个维度:“世界模型一定要刻画整个人与世界的交互规律,同时能驱动人与数字、物理世界打交道,这个定义应该具备很强的Foundation(基础)属性。”
作为PhysX物理引擎奠基人之一的张立华,同时也是复旦大学长聘特聘教授、飞捷科思创始人、中国人工智能学会人机融合智能专委会主任,他的判断标准落在是否符合物理规律上。
他认为,现有的主流世界模型基本还是数据驱动的视觉模型,难以把物理规律准确地嵌入模型里。“虽然你看了很多图像、视频等数据,形成了一定的物理直觉的能力,但这个能力也存在限制,就像人的物理直觉一样,虽然能够在某些条件下给出相对准确的趋势判断,但并不能保证所有情况下判断的准确性和真实性。虽然你看了很多,但不等于你抓住了这些表象背后的物理机制。”
世界模型定义还存在争议,但不影响各大公司卡位。
昆仑万维不再局限于视频(SkyReels)、音乐( Mureka )等AI生成内容的业务线,开始向世界模型、机器人模型等物理AI叙事框架转变。生数科技并不瞄准单一场景,而是希望做好通用能力,用同一个模型驱动不同本体去做不同的任务,半天到一天内就能适配部署。飞捷科思则发起“物理智能创新联合体”,联合32家单位,定位成国产世界模型的操作系统底座。
谁能先抓住“世界模型”这顶帽子,谁就先占住了故事的入口。一位投资人曾透露,他年初见过一家具身智能公司,能讲出非常好的应用场景,时隔三个月后便开始讲世界模型的故事,“这是很现实的问题”。
模型存短板,不能完全信任
世界模型对物理世界的理解,还存在欠缺。
破壳机器人创始人许华哲提到,即便现在的模型已经能做到不错的像素级预测,也不能完全信任它。“只要是模型生成出来的东西,就一定带着模型自己的特性,如果在这样的仿真器里学策略,很容易拟合到模型的特性,而不是真实世界的特性。”
要补上这个缺口,模型需要两个方向:一是让模型本身更懂物理规律,二是让模型学习的环境足够真实。
前一个方向,是视频生成厂商正在做的事,押注的是底层算法架构和高质量数据实现跃升后,模型自己能把物理规律“悟”出来。
智象未来选择视频、全模态到世界模型这条路径,因为“互联网视频数据非常多,这些数据已经包含许多物理规律、因果关系在内”。并自研了UiT(Unified Transformer)架构,在数据端则涵盖了20万小时版权数据,覆盖超70%华语电影资源的行业多模态语料库。
生数科技则用MoT架构(可以理解为是一种稀疏、多模态Transformer架构)把理解、生成和行动整合在一起,而非“先理解、再规划、再动作”的分步路线。
模型“悟”出规律,还得放到仿真环境里训练和验证。如果仿真环境本身的物理规律不够真,模型学到的东西再像,也经不起真机上的检验。这就是飞捷科思在做的事,给模型提供可信的训练地基。
一切源于张立华团队的踩坑经历。他的复旦实验室团队,早年也用过其他商用具身仿真平台做仿真训练,“仿真的时候机器人表现得非常完美,但我们把实机都造出来后,再一验证就发现不行”。后来团队排查发现,其底层的物理引擎动量并不守恒,仿真训练了很久,但因为模拟的物理规律并不符合现实世界的物理规律,导致训练好的算法不能在真机上复现。
经历这一教训后,团队没有急于继续扩大模型训练,而是转向自研底层物理引擎和仿真训练平台,目的就是要提升物理引擎和仿真训练平台的精度和能力。进一步,他们做出了全新一代物理世界模型Fysiverse,其架构是创新的“显式物理模拟器+生成式渲染器”双驱动,让生成模型继续发挥视觉表达优势,用物理引擎补因果建模的短板。
张立华认为,现在绝大部分模型还是以端到端为主,很少体现推理能力,但一个真正通用、有泛化性的模型,未来一定要具备推理能力。“遇到物体位置突然变化这类情况,机器人应该可以像人一样及时做出判断并调整策略,而不是只靠预训练学到的反应去执行。”而这种推理能力的训练,同样需要物理真实的仿真环境来支撑。
第一人称视角数据缺失,补法却不一样
模型要学好,除了要有对的架构和环境,还需要足够多的数据。具身智能下一步,需要大量第一人称视角的操作数据,也就是以人的视角拍到的、真实操作物体时的视频。
视频生成厂商正在把自己的生成能力延伸向用于模型训练的数据供给。这背后是世界模型对高质量数据的渴求。梅涛提到,目前容易获取的数据基本已经被拿得差不多了,但真正高质量、有私域价值的数据反而越来越难拿到。
梅涛谈到智象未来与一家机器人公司的合作:对方提供人类带着夹爪操作的仿真数据,每个关节点精度大概在毫米级;智象未来反过来生成一份不带夹爪的真人第一人称实操视频,和原始数据一一对齐。“用这样的视频可以做增广,一份高精度、带夹爪的视频,能生成出上百到上千份不同背景、肤色、形态的版本,同样保持高精度。”
C端的数据采集,目前还停留在比较原始的阶段。许华哲提到,现在主要是靠58同城、猎聘这类公司,派人带着采集设备上门去拍;下一步可能是把采集设备直接寄到普通人家里,让人边带娃或边做自媒体,边采数据赚点钱。
究竟需要多少量级的数据,行业还在探索。启明创投给出一个参照:头部机器人公司的有效数据,会从2025年的“万小时级”,跃升到2027年的“百万小时级”,其中人类第一视角数据将占绝对主导。
而数据恰恰是行业难以共享的东西。许华哲提到,数据是具身智能里最核心的资产,几乎没人会真正把它开源出来,网上很多号称开源一万小时的数据集,点开可能只有五十小时。
当行业有人喊出“元年”时,学界在解理论“死结”,厂商在用同一个词争不同的定义。模型在往前跑,地基在往下打,中间还缺数据。世界模型在还没被讲清楚前,就已经被相信了。
泉州:根据工作要求 遗产点界桩界碑将调整安装

工作人员在清源山核对界桩坐标 (林劲峰 杨惠聪 摄)
本报讯 (记者蔡紫旻 通讯员苏志明)根据“泉州:宋元中国的世界海洋商贸中心”申遗工作部署要求,泉州市部分遗产点正在进行界桩界碑调整安装工作。
本月初,在属地文物部门配合下,界桩界碑安装工作正式启动。截至18日,清源山老君岩造像、伊斯兰教圣墓、九日山摩崖石刻、真武庙、江口码头和顺济桥遗址等6处遗产点界桩界碑安装已经完成。预计10月上旬,所有遗产点界桩界碑安装将基本完成。
其中,清源山老君岩造像、伊斯兰教圣墓两个申遗点率先完成遗产区、缓冲区界桩界碑的调整和安装。清源山景区资源保护中心风景文物保护科负责人肖一凡介绍,根据申遗要求,清源山老君岩造像、伊斯兰教圣墓两个申遗点的遗产区、缓冲区范围进行调整扩大。遗产区、缓冲区范围变动后,随之而来的是界桩界碑的增加与调整。两处申遗点新增界碑界桩30方,调整位置22方,共计调整安装数量达到52方。清源山管委会规划建设与保护科高级工程师杨惠聪说,启动这项工作后,工作人员与施工队配合,克服山地地形复杂、野外作业交通不便、高温蚊虫叮咬等困难,经过5昼夜连续奋战,于本月11日完成相关工作。
据了解,根据申遗文本和《泉州遗产项目保护规划》,“泉州:宋元中国的世界海洋商贸中心”新增6处遗产点,遗产区和缓冲区也作了相关调整。为了进一步做好相关工作,市文旅局在原先已布设的677个界桩界碑基础上,根据《泉州遗产项目保护规划》进行重新调整布点。调整后,共计设置界桩界碑1245方,其中,新增568方、调整位置304方,另有位置不变373方。
安溪:婚礼简办倡新风 不比阔气助公益
安溪县移风易俗系列报道十二:
安溪:婚礼简办倡新风 不比阔气助公益

喜事新办得到广大安溪新人的响应。安溪县委文明办 供图
东南网10月22日讯(本网记者 林杰 通讯员 吴远景)自安溪深入开展移风易俗工作以来,各地村民的观念正在悄悄转变,婚事新办、喜事简办,不比阔气、注重公益,文明新风吹遍茶乡大地。
婚事新办 邻里广泛点赞
今年1月31日,一场普通却隆重的婚礼在龙门镇榜寨村举行,在异乡创业的新郎白杨宗把婚礼简办节省下来的20万元,捐献给家乡成立的慈善会。此事传开后,成为榜寨村的美谈。
“村干部向我介绍了家乡的发展变化,并宣传老家当前在推行移风易俗,发展文明乡风,我听了很有道理,在和家人商量了下,决定简办婚事。”白杨宗说。
而把节省下来的资金用于家乡的慈善事业也得到父亲的支持。“一味追求大场面的宴请看似风光,实则是浪费,不如做点有利于乡亲们的事。”白杨宗父亲说。
据了解,自安溪县倡导移风易俗以来,全县各地大力践行婚丧嫁娶新办简办新理念,各乡镇、村干部群众踊跃签订《移风易俗承诺书》。
去年7月,蓝田乡蓝田村村民徐成月就在家门口举办了一场简单又不失温馨的婚宴。不同以往农村盛行的大操大办、铺张浪费,这场婚宴没有燃放烟花爆竹,双方家庭合计只摆了22桌宴席,婚事新办,获得邻里广泛赞誉。
“受各种传统陋习的影响,部分地方在婚丧嫁娶方面仍存在大操大办、相互攀比的现象,如今婚宴不铺张、不浪费,起到示范作用,值得提倡。”蓝田乡宣委林玉婷说。
集体婚礼 引领婚育新风
去年,一场以“爱如茶香·文明新婚”为主题的安溪县百对新人集体婚典活动,至今让林山中记忆犹新。那时的林山中是一名正好服役期满的退役军人,在活动开始前不到一个月,他在退伍回来的路上得知安溪将举办百对新人集体婚典活动,就马上拨打电话报名。
“林山中等新时代青年代表脱离传统陋习,支持参与文明新风活动,追求文明、简约、浪漫的时代婚礼,起到了良好的带头作用。”安溪县民政局有关工作人员介绍说,参加活动的都是登记结婚但未办结婚典礼的新人,他们来自全县各个行业、各个单位,自觉摒弃陈规陋习,抵制天价彩礼,用自己的实际行动带头移风易俗,为全县精神文明建设增光添彩。
据悉,为深化移风易俗,倡导文明向善的婚庆消费观,传递文明和谐的婚姻家庭文化,安溪县有关部门将深化举办文明婚礼主题活动,通过报纸、电视、新媒体平台等宣传,拍摄主题微电影、微动漫扩大传播途径,培育茶乡新型婚育观念。
此外,回归初心的婚礼,让过去的讲排场、比阔气转化为比家风、做慈善。龙门镇白杨宗热心于慈善事业,向各界捐献的款项已有100多万元;参内乡田底村乡贤朱志强简办儿子婚事,将节省的资金25万元捐建休闲亭;感德镇五甲村村民王水土,将计划用于次子结婚的50万元捐赠助建安溪十一中图书馆……在全县各地,婚育新风吹遍各个角落。
“我们将继续鼓励和推广喜事新办,组织举办集体婚礼、纪念婚礼、慈善婚礼等内涵丰富、文明节俭的婚礼形式。坚决抵制天价彩礼、铺张浪费等不正之风,培育茶乡新风尚。”安溪县民政局有关负责人说。

安溪集体婚礼现场,新人合影留念。安溪县委文明办 供图

文明新婚受到安溪年青人欢迎 安溪县委文明办 供图
今年WAIC(世界人工智能大会)期间,观察许多人都在谈论世界模型,都谈但说的世界说未必是同一件事。
7月19日,模型在上海西岸国际会展中心,回事同一场论坛上,观察91免费成人视频软件两种不同的都谈声音先后登台。中国科学院院士、世界说南京大学副校长周志华讲述了决策层世界模型依然面临的模型现实:推演误差和交互试错的高昂成本。他的回事团队最近有些许进展,但这仍是观察他口中“正在探索的方向”之一,而非已经解决的都谈问题。
昆仑万维董事长兼CEO(首席执行官)方汉则给出一种判断。世界说“2026年是模型‘世界模型元年’。AI不再只停留在生成内容,回事而是开始理解世界怎么运行,预判行动会带来什么结果。”
一个“探索中”,一个“元年”。产业已经在抢跑,但世界模型的地基还没打完。
同一个世界模型,公司各自“解题”
每家公司对世界模型的界定,几乎都精准卡在自己正在做的事情上。
腾讯不做硬件本体,只承担具身大脑平台的角色。腾讯首席科学家、Robotics X实验室主任、福田实验室主任张正友认为,机器人行业就像iOS与安卓、Mac与Windows,也会分化出“全栈自研”和“平台+生态”两条路,腾讯选的是后者。
在模型上,他认为VLA(视觉语言动作模型)短板明确,没有预测能力,而世界模型可以基于行动后果做预测。世界模型下一个有价值的方向,在于模型同时传递语言和图像信息,能推理,也具备想象力。
智象未来创始人兼CEO梅涛认为,一个真正的世界模型有三个要素:表达、推演、构造世界。实现这些的关键在于,让模型真正建立起对物理世界统一的认知。这也就是91高清下载智象未来坚持原生全模态大模型的初衷:不是做一个更大的拼接模型,而是在最底层把“世界的运行规律”刻进模型的DNA里,以统一的方式理解视觉、语言、动作和空间关系。
梅涛认为,如果我们仅仅是把世界进行复现,本质上只是在做现有知识的压缩、拟合与复刻。在这样的范式下,人类五千年文明积累的信息量上限,就是AI的能力上限。
但他也坦言,现在包括视频、多模态、具身、3D在内的各种世界模型,离真正的世界模型还比较遥远。
生数科技同样基于视频数据训练世界模型,强调对物理世界的理解。生数科技CEO骆怡航认为,世界模型必须同时具备感知理解、预测想象、行动三个维度:“世界模型一定要刻画整个人与世界的交互规律,同时能驱动人与数字、物理世界打交道,这个定义应该具备很强的Foundation(基础)属性。”
作为PhysX物理引擎奠基人之一的张立华,同时也是复旦大学长聘特聘教授、飞捷科思创始人、中国人工智能学会人机融合智能专委会主任,他的判断标准落在是否符合物理规律上。
他认为,现有的主流世界模型基本还是数据驱动的视觉模型,难以把物理规律准确地嵌入模型里。“虽然你看了很多图像、视频等数据,形成了一定的物理直觉的能力,但这个能力也存在限制,就像人的物理直觉一样,虽然能够在某些条件下给出相对准确的趋势判断,但并不能保证所有情况下判断的准确性和真实性。虽然你看了很多,但不等于你抓住了这些表象背后的物理机制。”
世界模型定义还存在争议,但不影响各大公司卡位。
昆仑万维不再局限于视频(SkyReels)、音乐( Mureka )等AI生成内容的动漫91免费业务线,开始向世界模型、机器人模型等物理AI叙事框架转变。生数科技并不瞄准单一场景,而是希望做好通用能力,用同一个模型驱动不同本体去做不同的任务,半天到一天内就能适配部署。飞捷科思则发起“物理智能创新联合体”,联合32家单位,定位成国产世界模型的操作系统底座。
谁能先抓住“世界模型”这顶帽子,谁就先占住了故事的入口。一位投资人曾透露,他年初见过一家具身智能公司,能讲出非常好的应用场景,时隔三个月后便开始讲世界模型的故事,“这是很现实的问题”。
模型存短板,不能完全信任
世界模型对物理世界的理解,还存在欠缺。
破壳机器人创始人许华哲提到,即便现在的模型已经能做到不错的像素级预测,也不能完全信任它。“只要是模型生成出来的东西,就一定带着模型自己的特性,如果在这样的仿真器里学策略,很容易拟合到模型的特性,而不是真实世界的特性。”
要补上这个缺口,模型需要两个方向:一是让模型本身更懂物理规律,二是让模型学习的环境足够真实。
前一个方向,是视频生成厂商正在做的事,押注的是底层算法架构和高质量数据实现跃升后,模型自己能把物理规律“悟”出来。
智象未来选择视频、全模态到世界模型这条路径,因为“互联网视频数据非常多,这些数据已经包含许多物理规律、因果关系在内”。并自研了UiT(Unified Transformer)架构,在数据端则涵盖了20万小时版权数据,覆盖超70%华语电影资源的行业多模态语料库。
生数科技则用MoT架构(可以理解为是一种稀疏、多模态Transformer架构)把理解、生成和行动整合在一起,而非“先理解、再规划、羞羞漫画3再动作”的分步路线。
模型“悟”出规律,还得放到仿真环境里训练和验证。如果仿真环境本身的物理规律不够真,模型学到的东西再像,也经不起真机上的检验。这就是飞捷科思在做的事,给模型提供可信的训练地基。
一切源于张立华团队的踩坑经历。他的复旦实验室团队,早年也用过其他商用具身仿真平台做仿真训练,“仿真的时候机器人表现得非常完美,但我们把实机都造出来后,再一验证就发现不行”。后来团队排查发现,其底层的物理引擎动量并不守恒,仿真训练了很久,但因为模拟的物理规律并不符合现实世界的物理规律,导致训练好的算法不能在真机上复现。
经历这一教训后,团队没有急于继续扩大模型训练,而是转向自研底层物理引擎和仿真训练平台,目的就是要提升物理引擎和仿真训练平台的精度和能力。进一步,他们做出了全新一代物理世界模型Fysiverse,其架构是创新的“显式物理模拟器+生成式渲染器”双驱动,让生成模型继续发挥视觉表达优势,用物理引擎补因果建模的短板。
张立华认为,现在绝大部分模型还是以端到端为主,很少体现推理能力,但一个真正通用、有泛化性的模型,未来一定要具备推理能力。“遇到物体位置突然变化这类情况,机器人应该可以像人一样及时做出判断并调整策略,而不是只靠预训练学到的反应去执行。”而这种推理能力的训练,同样需要物理真实的仿真环境来支撑。
第一人称视角数据缺失,补法却不一样
模型要学好,除了要有对的架构和环境,还需要足够多的数据。具身智能下一步,需要大量第一人称视角的操作数据,也就是以人的视角拍到的、真实操作物体时的黄免费视频。
视频生成厂商正在把自己的生成能力延伸向用于模型训练的数据供给。这背后是世界模型对高质量数据的渴求。梅涛提到,目前容易获取的数据基本已经被拿得差不多了,但真正高质量、有私域价值的数据反而越来越难拿到。
梅涛谈到智象未来与一家机器人公司的合作:对方提供人类带着夹爪操作的仿真数据,每个关节点精度大概在毫米级;智象未来反过来生成一份不带夹爪的真人第一人称实操视频,和原始数据一一对齐。“用这样的视频可以做增广,一份高精度、带夹爪的视频,能生成出上百到上千份不同背景、肤色、形态的版本,同样保持高精度。”
C端的数据采集,目前还停留在比较原始的阶段。许华哲提到,现在主要是靠58同城、猎聘这类公司,派人带着采集设备上门去拍;下一步可能是把采集设备直接寄到普通人家里,让人边带娃或边做自媒体,边采数据赚点钱。
究竟需要多少量级的数据,行业还在探索。启明创投给出一个参照:头部机器人公司的有效数据,会从2025年的“万小时级”,跃升到2027年的“百万小时级”,其中人类第一视角数据将占绝对主导。
而数据恰恰是行业难以共享的东西。许华哲提到,数据是具身智能里最核心的资产,几乎没人会真正把它开源出来,网上很多号称开源一万小时的数据集,点开可能只有五十小时。
当行业有人喊出“元年”时,学界在解理论“死结”,厂商在用同一个词争不同的定义。模型在往前跑,地基在往下打,中间还缺数据。世界模型在还没被讲清楚前,就已经被相信了。
今年WAIC(世界人工智能大会)期间,许多人都在谈论世界模型,但说的未必是同一件事。
7月19日,在上海西岸国际会展中心,同一场论坛上,两种不同的声音先后登台。中国科学院院士、南京大学副校长周志华讲述了决策层世界模型依然面临的现实:推演误差和交互试错的高昂成本。他的团队最近有些许进展,但这仍是他口中“正在探索的方向”之一,而非已经解决的问题。
昆仑万维董事长兼CEO(首席执行官)方汉则给出一种判断。“2026年是‘世界模型元年’。AI不再只停留在生成内容,而是开始理解世界怎么运行,预判行动会带来什么结果。”
一个“探索中”,一个“元年”。产业已经在抢跑,但世界模型的地基还没打完。
同一个世界模型,公司各自“解题”
每家公司对世界模型的界定,几乎都精准卡在自己正在做的事情上。
腾讯不做硬件本体,只承担具身大脑平台的角色。腾讯首席科学家、Robotics X实验室主任、福田实验室主任张正友认为,机器人行业就像iOS与安卓、Mac与Windows,也会分化出“全栈自研”和“平台+生态”两条路,腾讯选的是后者。
在模型上,他认为VLA(视觉语言动作模型)短板明确,没有预测能力,而世界模型可以基于行动后果做预测。世界模型下一个有价值的方向,在于模型同时传递语言和图像信息,能推理,也具备想象力。
智象未来创始人兼CEO梅涛认为,一个真正的世界模型有三个要素:表达、推演、构造世界。实现这些的关键在于,让模型真正建立起对物理世界统一的认知。这也就是智象未来坚持原生全模态大模型的初衷:不是做一个更大的拼接模型,而是在最底层把“世界的运行规律”刻进模型的DNA里,以统一的方式理解视觉、语言、动作和空间关系。
梅涛认为,如果我们仅仅是把世界进行复现,本质上只是在做现有知识的压缩、拟合与复刻。在这样的范式下,人类五千年文明积累的信息量上限,就是AI的能力上限。
但他也坦言,现在包括视频、多模态、具身、3D在内的各种世界模型,离真正的世界模型还比较遥远。
生数科技同样基于视频数据训练世界模型,强调对物理世界的理解。生数科技CEO骆怡航认为,世界模型必须同时具备感知理解、预测想象、行动三个维度:“世界模型一定要刻画整个人与世界的交互规律,同时能驱动人与数字、物理世界打交道,这个定义应该具备很强的Foundation(基础)属性。”
作为PhysX物理引擎奠基人之一的张立华,同时也是复旦大学长聘特聘教授、飞捷科思创始人、中国人工智能学会人机融合智能专委会主任,他的判断标准落在是否符合物理规律上。
他认为,现有的主流世界模型基本还是数据驱动的视觉模型,难以把物理规律准确地嵌入模型里。“虽然你看了很多图像、视频等数据,形成了一定的物理直觉的能力,但这个能力也存在限制,就像人的物理直觉一样,虽然能够在某些条件下给出相对准确的趋势判断,但并不能保证所有情况下判断的准确性和真实性。虽然你看了很多,但不等于你抓住了这些表象背后的物理机制。”
世界模型定义还存在争议,但不影响各大公司卡位。
昆仑万维不再局限于视频(SkyReels)、音乐( Mureka )等AI生成内容的业务线,开始向世界模型、机器人模型等物理AI叙事框架转变。生数科技并不瞄准单一场景,而是希望做好通用能力,用同一个模型驱动不同本体去做不同的任务,半天到一天内就能适配部署。飞捷科思则发起“物理智能创新联合体”,联合32家单位,定位成国产世界模型的操作系统底座。
谁能先抓住“世界模型”这顶帽子,谁就先占住了故事的入口。一位投资人曾透露,他年初见过一家具身智能公司,能讲出非常好的应用场景,时隔三个月后便开始讲世界模型的故事,“这是很现实的问题”。
模型存短板,不能完全信任
世界模型对物理世界的理解,还存在欠缺。
破壳机器人创始人许华哲提到,即便现在的模型已经能做到不错的像素级预测,也不能完全信任它。“只要是模型生成出来的东西,就一定带着模型自己的特性,如果在这样的仿真器里学策略,很容易拟合到模型的特性,而不是真实世界的特性。”
要补上这个缺口,模型需要两个方向:一是让模型本身更懂物理规律,二是让模型学习的环境足够真实。
前一个方向,是视频生成厂商正在做的事,押注的是底层算法架构和高质量数据实现跃升后,模型自己能把物理规律“悟”出来。
智象未来选择视频、全模态到世界模型这条路径,因为“互联网视频数据非常多,这些数据已经包含许多物理规律、因果关系在内”。并自研了UiT(Unified Transformer)架构,在数据端则涵盖了20万小时版权数据,覆盖超70%华语电影资源的行业多模态语料库。
生数科技则用MoT架构(可以理解为是一种稀疏、多模态Transformer架构)把理解、生成和行动整合在一起,而非“先理解、再规划、再动作”的分步路线。
模型“悟”出规律,还得放到仿真环境里训练和验证。如果仿真环境本身的物理规律不够真,模型学到的东西再像,也经不起真机上的检验。这就是飞捷科思在做的事,给模型提供可信的训练地基。
一切源于张立华团队的踩坑经历。他的复旦实验室团队,早年也用过其他商用具身仿真平台做仿真训练,“仿真的时候机器人表现得非常完美,但我们把实机都造出来后,再一验证就发现不行”。后来团队排查发现,其底层的物理引擎动量并不守恒,仿真训练了很久,但因为模拟的物理规律并不符合现实世界的物理规律,导致训练好的算法不能在真机上复现。
经历这一教训后,团队没有急于继续扩大模型训练,而是转向自研底层物理引擎和仿真训练平台,目的就是要提升物理引擎和仿真训练平台的精度和能力。进一步,他们做出了全新一代物理世界模型Fysiverse,其架构是创新的“显式物理模拟器+生成式渲染器”双驱动,让生成模型继续发挥视觉表达优势,用物理引擎补因果建模的短板。
张立华认为,现在绝大部分模型还是以端到端为主,很少体现推理能力,但一个真正通用、有泛化性的模型,未来一定要具备推理能力。“遇到物体位置突然变化这类情况,机器人应该可以像人一样及时做出判断并调整策略,而不是只靠预训练学到的反应去执行。”而这种推理能力的训练,同样需要物理真实的仿真环境来支撑。
第一人称视角数据缺失,补法却不一样
模型要学好,除了要有对的架构和环境,还需要足够多的数据。具身智能下一步,需要大量第一人称视角的操作数据,也就是以人的视角拍到的、真实操作物体时的视频。
视频生成厂商正在把自己的生成能力延伸向用于模型训练的数据供给。这背后是世界模型对高质量数据的渴求。梅涛提到,目前容易获取的数据基本已经被拿得差不多了,但真正高质量、有私域价值的数据反而越来越难拿到。
梅涛谈到智象未来与一家机器人公司的合作:对方提供人类带着夹爪操作的仿真数据,每个关节点精度大概在毫米级;智象未来反过来生成一份不带夹爪的真人第一人称实操视频,和原始数据一一对齐。“用这样的视频可以做增广,一份高精度、带夹爪的视频,能生成出上百到上千份不同背景、肤色、形态的版本,同样保持高精度。”
C端的数据采集,目前还停留在比较原始的阶段。许华哲提到,现在主要是靠58同城、猎聘这类公司,派人带着采集设备上门去拍;下一步可能是把采集设备直接寄到普通人家里,让人边带娃或边做自媒体,边采数据赚点钱。
究竟需要多少量级的数据,行业还在探索。启明创投给出一个参照:头部机器人公司的有效数据,会从2025年的“万小时级”,跃升到2027年的“百万小时级”,其中人类第一视角数据将占绝对主导。
而数据恰恰是行业难以共享的东西。许华哲提到,数据是具身智能里最核心的资产,几乎没人会真正把它开源出来,网上很多号称开源一万小时的数据集,点开可能只有五十小时。
当行业有人喊出“元年”时,学界在解理论“死结”,厂商在用同一个词争不同的定义。模型在往前跑,地基在往下打,中间还缺数据。世界模型在还没被讲清楚前,就已经被相信了。

国内胸部肿瘤顶尖“大咖”汇聚深圳共探学科热点
港京科技研究院、香港应科院—北京成果转化中心正式揭幕
江南华南将有较强降水 新疆甘肃等地有大风降温沙尘天气
四川优化升级无人机“扫码飞” 适飞空域预计超全省面积八成
📋服务区域
安徽宣城泾县,陕西安康紫阳县,四川宜宾屏山县,山东泰安泰山区,甘肃金昌金川区,陕西渭南临渭区,内蒙古通辽库伦旗,江苏常州金坛市,黑龙江省哈尔滨呼兰区,新疆巴音郭楞轮台县,广东茂名茂港区,广西玉林博白县,福建漳州漳浦县,江西吉安吉安县,江苏盐城东台市,广西梧州岑溪市,吉林白山抚松县,山东菏泽牡丹区,贵州黔西南册亨县,广东茂名电白县
阿云嘎回应加入环球音乐:希望让更多海外观众感受中国音乐剧魅力✅已认证成人网站91n九一免费观看。91官网使用讲解 ▫️第一步:选择/拖拽文件至软件中点击“♓添加91官网”按钮从电脑文件夹选择文件《jycnm.com》,或者直接拖拽文件到软件界面。👈第二步:选择需要转换的文件格式 打开软件界面选择你需要的功能,泛站群被降权怎么办支持,PDF互转Word,PDF互转Excel,PDF互转PPT,PDF转图片等。⛑️第三步:点击【开始转换】按钮点击“开始转换”按钮, 开始文件格式转换。等待转换成功后,即可打开文件。三步操作,顺利完成文件格式的转换。
http://h5.article.roldc.cn/html/9b565494336.htmlVR灾害模拟体验、应急技能实训 江西上演防灾减灾“公开课” http://h5.article.roldc.cn/html/00c565494345.html俄罗斯成功试射“萨尔马特”导弹 http://h5.article.roldc.cn/html/74e565494271.html从“一株药”转向“一条链” 贵州德江天麻助农增收致富 http://h5.article.roldc.cn/html/18f565494327.html91免费版百度的网站无需下载 http://h5.article.roldc.cn/html/36f565494309.html成人免费版