📌 抖音 热搜榜 共15条
📌 微博 热搜榜 共15条
📌 搜狐 热榜新闻 共15条
📌 ACfun弹幕网 热榜 共15条
📌 爱范儿 快讯 共15条
  • 1 中科融合亮相CIOE 2026:以MEMS智能光学连接空间显示与具身智能 2026年9月9日至11日,第27届中国国际光电博览会(CIOE 2026)在深圳国际会展中心(宝安)举行。中科融合携Iris Green、Iris Color、Iris AR及NANO微小型多模态高速扫描模组亮相2号馆2A157展位,展示自主MEMS智能光学平台在骑行HUD、车载投影、AR近眼显示及机器人3D感知领域的应用成果——以米粒大小的MEMS微振镜为核心器件,将显示与感知能力延伸至骑行、车载、AR与机器人等多元终端。本次参展,中科融合围绕MEMS芯片、光学设计、算法控制与模组集成,呈现从核心器件到应用模组的技术链条。基于同一芯片技术,形成“光显示”与“光感知”两大产品线:四款代表性展品分别面向信息显示与空间感知需求,展现同一MEMS技术平台在不同终端中的延展能力,为汽车、AR、机器人及智能硬件领域的产品开发,提供从核心器件到可量产方案的完整光学解决方案。从车载投影到AR眼镜,拓展MEMS-LBS空间显示应用随着显示功能向汽车、移动设备和可穿戴终端延伸,光机的体积、功耗与集成方式,正在成为产品设计中的关键约束。传统投射方案受制于体积、功耗与户外显示能力,难以满足移动与便携场景的需求。中科融合以自主MEMS微振镜为核心,发展MEMS-LBS(激光束扫描)显示技术,通过控制激光束高速扫描形成图像,将小型化、免调焦与低功耗整合为系统级能力:无需透镜、无需对焦,在任何距离与角度下均可保持画面清晰,为数字信息融入汽车座舱、骑行视野与日常佩戴场景提供显示基础。Iris Green作为面向骑行场景的抬头显示,将导航方向、骑行数据及提醒信息直接投射至骑行者前方路面,采用免调焦显示方式,使骑行者在行进过程中无需转移视线即可获取信息;同时支持车队标识、个性图案等内容的路面投射,为团队骑行提供可视化互动方式。Iris Color面向车载全彩投影应用,凭借贴地安装即可覆盖整车侧身幅面的超宽视场角,实现迎宾光毯、动态地面投影及座舱氛围显示等应用场景,以紧凑型光机与灵活投射能力,适配整车有限安装空间及多样化显示需求。面向AR近眼显示,中科融合持续推进光机微型化:光模组体积约0.9cc,典型入眼亮度达到10000 nits,在正午强光环境下画面依然清晰锐利;在平均画面亮度(APL)为20%的条件下,典型功耗约0.15 W,可显著降低显示系统功耗、缓解整机续航压力。Iris AR以体积、亮度与功耗的综合优势,为轻量化信息显示终端提供可直接集成的微型光机方案,支持导航、提词、消息提示等应用方向的快速开发。从车载投影到骑行HUD,再到AR近眼显示,中科融合持续复用并迭代MEMS扫描、激光控制、算法补偿及光机集成能力,形成覆盖多个终端的统一技术架构。相关MEMS微振镜模组已通过AEC-Q100相关可靠性测试,车规级认证为车载应用的工程化导入提供了器件层面的必要保障。NANO聚焦机器人末端,支撑近距离精细作业在光感知方向,中科融合聚焦具身智能的末端感知需求——头部视觉存在盲区,指尖触觉反馈滞后,在执行操作前对物体细节的实时感知尤为关键。NANO微小型多模态高速扫描模组面向机器人手腕及末端执行器的有限安装空间,以约一部手机重量的轻量形态,将近距离三维视觉部署于更靠近操作对象的位置,为抓取、插接、装配及位姿纠偏等精细任务提供亚毫米级空间数据。NANO基于自主MEMS面阵结构光技术,工作距离覆盖100—400 mm,支持15 fps、每帧30万点或10 fps、每帧130万点的点云输出,并可同步输出三维点云与彩色图像。在机械臂与工件同步运动的动态工况下,系统仍能保持稳定精度:三维点云与2D图像信息相结合,使目标识别、定位与动态作业引导不再依赖静态成像,实现动态环境下的持续感知。针对更复杂的工业作业需求,NANO PRO采用面结构光与线移扫描相结合的双模态方案,可应对高反金属、黑色吸光材料、透明件等常规三维成像难以处理的材质,覆盖焊接引导等高难度作业场景。NANO与NANO PRO分别侧重高帧率动态感知与复杂工况适应,形成面向差异化作业需求的产品组合。在系统集成方面,NANO支持USB 3.1 Gen 1、GMSL2/3及Type-C一线通供电,整机功耗低于5 W。小型化结构、低功耗设计与标准化接口相结合,可有效降低末端视觉的集成与部署难度,推动3D感知从独立设备向整机功能模块演进。以自主MEMS平台推进器件与应用协同光显示与光感知面向两类不同的信息需求:空间显示关注如何将信息自然地呈现于人,机器人视觉关注如何使机器准确获取空间数据。两类应用对输出形式与系统设计的要求各有侧重,同时共享精密光束控制、算法与模组集成等底层能力。中科融合以自主MEMS微振镜为技术底座,协同设计芯片、光学、算法与模组,推动光显示与光感知在统一技术平台上持续演进、相互增益。9月9日下午,中科融合感知智能研究院副总经理程诚博士亮相全球空间计算产业发展论坛,发表《MEMS智能光学技术创新与微型投影应用探索——中科融合的产品布局与产业化实践》主题演讲,分享从核心器件到终端应用的产业化实践,并与产业伙伴深入交流微型光学系统在车载、AR及新型智能终端中的应用方向。此次亮相CIOE 2026,中科融合呈现的不是四件展品,而是一颗自主MEMS微振镜贯穿光显示与光感知两条产品线的平台化能力——从核心器件到终端应用,已在国内率先跑通完整产业化闭环。当海外厂商仍以多套方案分立布局、将不同应用锁定于不同器件时,中科融合将空间显示与三维感知拉回至同一颗芯片、同一套系统架构之内。芯片不自主,光学就永远受制于人——这是中国空间计算与具身智能产业必须跨越的关键门槛。中科融合接下来的目标很明确:沿自主MEMS技术路线持续打通、打深、做透,让每一束从中国自主MEMS微振镜出发的光,都成为国产智能终端在空间计算时代对标全球方案的底气所在。
  • 2 蚂蚁阿宝三大车载AI能力亮相2026外滩大会 9月9日至12日,2026 Inclusion·外滩大会在上海举办。大会集中展示AI智能体从技术创新走向规模化民生商用的最新成果,在智能座舱板块,支付宝重磅发布三大全新产品能力,让车内AI服务从“基础交互”迈入“全场景可交易、全链路能办事”的新阶段。此前,支付宝发布AHA多智能体跨端互联协议体系,打通跨设备、跨品牌的智能服务壁垒,推动“蚂蚁阿宝”车载服务规模化落地。对超级服务智能体 “阿宝” 而言,手机是其原生核心服务屏,而智能座舱正成为除手机之外第二个重要的服务终端。依托蚂蚁阿宝生态中万余项AI化适配的生活服务资源,服务能力实现从手机屏向车机屏的多端复用。商家完成一次服务适配,即可通过阿宝分发至手机、车机、AI眼镜等多个终端,把完整的生活办事能力延伸至出行场景。目前相关服务已覆盖17家主流车企、超1600万辆智能汽车,新增60余家定点合作车企,覆盖场景包括缴停车费、买电影票、点咖啡等高频用车需求,坐进车内,通过车载语音助手说一句 “帮我缴停车费””帮我买张电影票”,蚂蚁阿宝即可调起服务完成履约,构建起成熟的车载AI服务生态底座。立足扎实的生态基础,本届外滩大会蚂蚁阿宝座舱业务聚焦车主高频刚需,全新上线高速手机+、车载电影票智能下单、座舱一键加油三大能力,实现车载服务场景的精准扩容与体验升级。针对多终端协同使用痛点,支付宝实现手机与座舱的无缝跨端联动服务。依托AHA协议的安全互联能力,用户出行途中未完成的服务任务,下车后可在手机端继续办结,真正实现跨终端服务无断点、体验一体化。全新上线的座舱电影票服务补齐了车载影音休闲交易短板。车主无需手动操作手机、跳转小程序,仅通过语音唤醒蚂蚁阿宝智能体,即可一键完成影片筛选、影院定位、场次选择、在线支付全流程操作,让车内休闲服务实现“开口即办、即时成交”。针对车主高频用车刚需,支付宝落地座舱一键加油能力,用户在车内即可通过语音指令唤醒服务,自动匹配就近油站、完成核销与支付,全程无需下车、无需手动操作,大幅提升自驾出行效率,打造轻量化、无接触的智慧加油新体验。在高速场景,结合高速手机+无卡畅行模式的落地推广,支付宝打造高速通行座舱新体验,用户不仅可实现座舱一键开通绑定,还可实现高速出口不用开车窗、不用取还卡、不用掏手机,座舱语音操作直接支付高速费,秒抬杆、快通行。本次外滩大会的能力升级,进一步完善了支付宝车载智能服务体系。未来,支付宝将持续开放AHA跨端协议与智能体技术能力,深化与各大车企的生态合作,迭代车载专属服务场景,落地轻量化、可商用、高安全的座舱AI解决方案,推动汽车智能服务从功能智能化,迈向交易智能化、服务生态化的全新阶段。
  • 3 华硕灵耀携手Intel首登北京时装周,以高定秀场叙事重塑时尚精品美学 SS2027北京时装周启幕,华硕灵耀作为首个登上北京时装周T台的笔记本电脑品牌,以AI PC承载时尚态度,让内敛、精致、恒久的灵耀美学,成为都市精英人群的质感生活符号。9月12日,华硕灵耀x Intel携手北京时装周特约设计师WOAVE品牌创始人 王冬 联合发布「光耀新生 A Light Within」专场定制秀,多套限定时尚造型将灵耀系列AI PC融入秀场叙事,开创科技与时尚共生的全新美学范式。当科技材质的触感与天然面料的肌理彼此映照,在北京时装周秀场之上,华硕灵耀大“秀”时尚精品美学,灵感、科技与时尚活力融合绽放。模特接连登场、踏光而至,步履穿行于光影之间,手持华硕灵耀系列笔记本,生动诠释「光耀新生 A Light Within」的秀场主题。现场,华硕上海设计中心设计总监 黄圣杰 与设计师 王冬 展开深度对谈,为到场嘉宾、媒体解析「光耀新生 A Light Within」跨界合作的内核共鸣。本次定制秀场的联合呈现,并非一次简单的跨界联动,而是两者设计理念、审美追求、价值表达的高度契合与双向成就。“WOAVE”坚持工匠精神与当代设计并行,通过编织、拼接、解构及非遗手工技艺,赋予厚重、成熟和季节化的传统材质拥有轻盈、流动、立体且富有建筑感的廓形表达。华硕灵耀以科技器物承载时尚态度,依托材质创新、性能突破、前沿AI应用,演绎着功能与美学的完美平衡。实现高级极简审美传递,凭借内敛、精致、恒久的灵耀美学,成为新时代精英人群的质感生活符号。对谈中,王冬提及,“基于与华硕灵耀的设计理念共鸣,我们共同探索了关于高端材料、精密制造与创造力的全新边界,完成了一场精彩的时尚秀场。”WOAVE时装与华硕灵耀高科技陶瓷铝机身所体现的轻薄、温润、耐磨与精密制造形成巧妙呼应,时装的松弛高级氛围与灵耀内敛轻奢的美学底蕴高度统一。科技与时尚不再是跨界碰撞,而是同频美学的双向共生表达。而本次专场定制秀的主题立意,则根植于华硕灵耀全新迭代的新时代品牌内核。黄圣杰强调,“「光耀新生 A Light Within」是华硕灵耀的新时代品牌内核,光,既象征华硕灵耀与Intel带来的科技能量,也代表创作者内心持续生长的灵感;新生,则意味着材料与传统工艺在当代语境中的重新觉醒”。华硕灵耀秉承“以人为本”的初心,以材质创新、性能突破、AI进化迭代产品,鼓舞精英阶层拥有高效生产力装备,在喧嚣世界守住内心秩序,于平衡专注中积蓄力量、突破自我。从轻薄设计到高端材质,从创新科技到创作体验,华硕灵耀以精密工艺重塑美学温度,以AI科技赋能当代生活,这场与WOAVE的美学共创,全维揭开灵耀的时尚精品美学内涵,让到场观众亲眼见证科技硬件的时尚艺术张力,切身感受工艺、美学与性能的共生之美。不止于秀场的视觉美学演绎,秀场外华硕灵耀携手Intel特设品牌独立时尚精品美学展区,线下展陈全新华硕灵耀14 2026 AI超轻薄本、灵耀精品美学周边,让参展观众实现从“看见灵耀美学”到“体验灵耀实力”的完整感知。华硕灵耀14 2026整机轻约1.2kg、薄至13.9mm,机身A面采用华硕创新高科技陶瓷铝材质,兼具轻薄随行的便携体验、细腻温润的独特触感与坚固耐磨的精密品质,搭配北极蓝、珊瑚粉、茶釉棕三款自然灵感配色,将山川风物的自然意境凝于机身方寸之间,极简线条克制高级,尽显恒久耐看的轻奢质感。机身内置70Wh长寿大电池,可实现长达29.6小时的持久续航,满足适配移动办公、差旅出行、户外创作等多元场景。搭载14英寸2.8K 120Hz OLED华硕好屏,专业级色彩表现全面赋能视觉创作、审美品鉴。它搭载第三代英特尔® 酷睿™ Ultra 7处理器,带来至高49 TOPS NPU AI算力,实现本地化、高效率的AI创作赋能。搭配“小硕知道”AI智能助手、StoryCube一站式工作智能媒体中心等本地AI应用,一键解锁文案梳理、图像创作、素材整理等智能操作,大幅降低创作门槛、提升办公效率。新增专属联名AI工具“小硕 x WorkBuddy”,华硕账号一键互通,华硕渠道注册的WorkBuddy新用户可领取200专属积分。从T台秀场的美学共生,到线下展区的性能体验,华硕灵耀以首登北京时装周的跨圈共创,深度链接科技、时尚与艺术,完成AI PC时尚美学的一大探索。华硕灵耀x Intel品牌独立时尚精品美学展区(北京东城区王府井大街北街)将持续开放至9月17日,欢迎广大时尚爱好者、创作者与科技用户亲临现场,亲身解锁灵耀美学与实力兼具的时尚精品内核。
  • 4 像素蛋糕PC端10.0、iPad版和手机版亮相、像素芝士、像素吐司同步推出 2026年9月10日,像素系列秋季发布会在厦门康莱德酒店如期而至。五年前,像素蛋糕发布滑杆式可视化修图,诞生于一个追问:“能不能让专业的后期创作,更简单一点?”;五年后,从“操作标准”到“批量时代”,从“效果可视化”到“全链提效”,再从“智能体”到“AI点修”,答案正变得愈发清晰。伴随像素蛋糕PC端10.0、像素蛋糕iPad版、像素蛋糕手机版、像素芝士、像素吐司产品集中亮相,像素系列以“新起点”重构,完成从“单点提效”到“流程焕新”的系统性衍进,以产品生态矩阵重新定义影像创作全链路。从桌面端到移动端,从静态图像到动态影像,从个人创作者到团体机构——像素系列正以产品分层布局的方式,完成对影像创作生态的全方位渗透。像素蛋糕作为行业领先支持端侧计算的可视化编辑工具,本次更新至10.0版本,以“与‘十’俱进的创作新起点”完成人像、色彩、创意三大方向的体系化升级。像素蛋糕iPad版为行业移动端修图工作站,焕新后定位“旅拍神器”与“一平米创作台”,一次拍摄即是一次专业服务,打通“拍—修—看—取”的完整闭环。像素芝士定位景区出片中台,依托景区共研大模型提供面向景区、整场活动的全链路影像生态服务,并以“像素芝士×百城点位”计划助力100个点位焕新,推动建设数字景区旅拍服务。像素蛋糕手机版聚焦移动端专业影像创作,以“零帧起手,定格生活中的创作多面手”回应更广泛的摄影兴趣人群。像素吐司作为视频精修产品线,以达芬奇/PR内嵌模式、剪辑精修丝滑接力的方式,把一次拍摄变成更多内容产品,赋能创作者实现动态影像的产品创收。像素系列核心产品线既保持独立定位,又形成协同效应。品牌正以生态化布局,构筑起覆盖从拍摄到交付、从静态到动态的全链路影像基础设施。如果说像素系列产品线的布局是横向的生态扩张,那么像素蛋糕10.0的此次升级则是纵向的技术穿透。本次10.0版本正式推出五大维度的技术迭代,覆盖人像精修、创意生成、色彩科学、宠物精修和AI点修五个领域。针对应季旅拍场景,推出多项人像精修功能,祛汗珠、衣服祛汗渍、AI祛体毛、闭眼修复、AI加腹肌、AI瘦手臂、面部提拉……几乎囊括人像修图的核心刚需。针对婚纱摄影高频痛点,发布裙摆平整、裙子蓬松、鞋子祛污、AI换天空等功能的一键调用。同时,在色彩科学层面完成体系化升级,搭载16bit•AI Raw引擎,升级AI局部追色与质感色彩配置文件,调色性能优化40%+。行业首创AI点修重磅发布,标志着修图进入点修时代,既能一点自动关联功能,也能自动调用像素助手执行复杂任务;像素助手即日起全面公测,创成式填充支持一句话秒改画面,重新定义了AI时代的图像创作方式。同时,首次将宠物修图纳入专业流程。宠物亮眼、宠物眼神光、宠物祛碎毛三项功能,配合“宠物一生”全周期6大必拍套系将宠物棚拍、爱宠上门、宠物街拍三大应用场景全部打通。知名摄影嘉宾现场以“第二增长曲线”为题分享——“换一条赛道,不换掉你的本事”,为从业者带来诸多启发与灵感。布局已成,纵深已就,所有能力的最终指向,是场景——是那些真实发生的拍摄现场、是每一位创作者的日常。像素蛋糕10.0面向婚纱摄影、主题写真、全家福、儿童摄影、证件照等棚内场景,也覆盖旅拍、目的地婚礼、活动拍摄、婚礼跟拍、街拍等户外现场。像素芝士延伸至企业活动、婚礼婚庆、文旅景区、体育赛事、演出活动等现场影像服务场景——在台州神仙居,像素芝士深度绑定爆款打卡位,让游客拍摄率和客单实现大幅提升,让每一处创作现场,成为新业务的起点。像素蛋糕手机版以不同场景下的专业色彩表现,回应更广泛人群的兴趣拍摄。“随时精致的活人感”面向出游与扫街,“破框而出的CG感”聚焦二次元展会,“零帧起手的现场感”切入音乐现场。追星族、Coser、旅行家、运动选手、扫街达人、户外咖等,正在被逐一触达。从专业现场到街头日常,从商业摄影到兴趣表达——“你在哪里,哪里就是创作的起点。”这句话,正是像素系列场景版图的最佳注脚。像素系列五年衍进,以“从单点提效到流程焕新”为内核,共同构成影像创作AI时代的全新底座。
  • 5 WPS AI获得国际表格AI评测全球第一 近日,国际表格AI评测SpreadsheetBench更新V2 Full榜单,WPS AI以50.86%的综合成绩排名第一,并通过官方Verified验证,综合成绩高于Claude Opus 4.6、GPT-5.2、Gemini 3.1 Pro等国际主流AI模型。V2共包含321项任务,平均每项任务涉及11.8个工作表、593.5个单元格修改,考察AI对复杂表格的整体处理能力。同一时期,金山办公在学术侧也有新进展。8月30日至9月4日,2026年国际文档分析与识别会议(ICDAR 2026)在奥地利维也纳举行,同期举办的DAS 2026上,金山办公一项面向复杂办公图像处理的研究成果获正式收录并现场展示,聚焦AI生成文档图像、手机截图等素材的文字识别和文档还原。一个验证了AI执行复杂办公任务的能力,一个夯实了底层文档处理技术——两项进展分别来自第三方评测和国际学术评审,共同指向金山办公在办公领域的长期积累。
  • 6 迈向原生世界状态的统一多模态世界模型,大晓机器人联合南洋理工大学S-Lab发布Puffin-World 近日,大晓机器人联合南洋理工大学S-Lab等机构发布并开源统一多模态世界模型框架Puffin-World。作为面向空间智能与具身智能的成果,Puffin-World首次在一个统一多模态框架中,将物理、几何和外观定义为三种原生的三维世界状态,并贯通重力场感知、自由视点空间仿真、三维世界生成与重建以及闭环探索,预测机器人行动后世界将处于什么状态。Puffin-World同步开源代码、模型和Puffin-16M数据集,包括1500万组视觉—语言—相机三元组和100万条具有挑战性的旋转轨迹,并开放覆盖28个公开数据集、约4450万张图像的绝对相机位姿标注,为机器人仿真、合成数据生产与具身智能训练提供可复现、可扩展的技术底座。针对机器人训练来说,需要的并不是一段视觉上逼真的视频,而是能够支撑感知、定位、规划和行动的环境信息:当前相机处于什么姿态,重力方向是否稳定,场景结构如何延续,机器人移动后将看到什么。图像只是世界状态的一部分,物理方向、空间几何和视觉外观共同构成机器人真正需要的训练环境。统一构建三种原生状态——物理、几何与外观Puffin-World从三维世界状态本身出发,将其建模为三种相互关联的原生状态:三种状态共同构成从“世界如何存在”到“世界如何被交互”的完整表达。模型生成新视角时,不仅要回答画面应该是什么样,还要保证该画面在物理方向和三维结构上成立。为统一绝对方向和跨视角运动,Puffin-World提出Omni-Camera相机表示,将重力锚定的绝对相机信息与基于射线的相对几何结合起来。模型先从参考图像中精确理解相机的横滚角、俯仰角和视场角,再通过物理传播机制,将参考视角中的重力信息传递至后续视角。即使相机经历连续旋转和长轨迹移动,整个生成过程也拥有一个稳定的物理参照系。地平线不会随意漂移,场景的上下关系不会在运动中失真,生成视角与目标相机轨迹也能保持一致。Puffin-World还在同一次生成过程中联合输出RGB外观和深度几何,使生成结果能够直接用于三维重建,而不必在视频生成之后再依赖独立的深度估计模块补充空间结构。由此,世界生成与世界重建不再是前后割裂的两个步骤,而成为同一个状态预测过程。一个模型完成四件事,从理解世界走向闭环探索Puffin-World可以在一个模型中统一四类过去往往需要不同系统分别完成的任务。第一,单图理解相机物理信息。输入一张图片,模型能够结合地平线、垂直结构和场景构图进行空间推理,预测相机相对于真实物理世界的横滚角、俯仰角和垂直视场角,同时生成场景语义描述。模型不仅识别“图中有什么”,还理解“当前视角以怎样的姿态看到了它”。第二,自由视点空间仿真。除文字描述外,用户还可以明确指定相机方向和视场角。模型据此生成符合目标机位的画面,使文生图从内容控制进一步走向精确的空间控制。第三,三维世界生成与重建。模型可以从文字、单张图像或少量参考图像出发,按照指定相机轨迹生成多个新视角,并同步预测每个视角的外观和深度。不同视角随后可以汇聚为具有一致空间结构的三维世界。第四,闭环自校准探索。当相机姿态偏离重力方向时,模型可以先感知当前物理状态,再推理需要执行的修正动作,并生成动作执行后的目标观察,由此形成“状态感知—动作预测—结果生成—再次校准”的闭环,高效扮演World Action Model (WAM)角色。技术报告还展示了模仿式世界探索能力,即从同一初始视角出发,按照给定相机轨迹扩展并探索新的三维世界。这四类能力并非四个模型的简单拼接,而是由同一套视觉、语言、相机和世界状态表征共同支撑。任务的变化不再依赖切换系统,而由输入内容、相机条件和视图角色决定。这种统一性,使Puffin-World更接近机器人从感知、推理到行动的完整工作链路。1600万核心数据与4450万开放标注,扩大世界模型训练底座世界模型能否理解复杂空间,很大程度上取决于训练数据是否同时具备视觉内容、场景语义、绝对相机信息和多样化运动。为此,团队构建了Puffin-16M数据集,包含两个组成部分。Puffin-Cam-15M提供1500万组视觉—语言—相机三元组,覆盖室内、室外、真实和合成等多种场景,并包含不同分辨率、宽高比、相机姿态和视场角。它不仅告诉模型图像中有什么,还告诉模型这张图像是在怎样的相机观测条件下形成的。Puffin-Traj-1M则提供100万条具有挑战性的旋转轨迹,覆盖连续俯仰、横滚、偏航、复合运动以及360度环视等复杂情况,重点补足传统三维数据集在大幅旋转和长轨迹探索方面的不足。与主要描述视角之间相对变化的数据不同,Puffin-16M进一步引入相机相对于重力和真实世界的绝对方向。模型不仅学习“相机从上一帧移动了多少”,还要理解“相机当前在世界中处于什么方向”。除自建数据集外,团队还利用Puffin-World精准的物理世界感知能力为28个公开数据集补充绝对相机位姿标注,覆盖约4450万张图片,包括ImageNet、CC12M、Objects365、ScanNet、DL3DV和GPIC等。标注内容包括横滚角、俯仰角和视场角,可用于研究不同视觉数据中的机位偏差,也可为相机条件生成、物理世界理解和空间智能训练提供大规模监督。更重要的是,Puffin-World同步开放代码、模型和数据集。开源的不只是一个算法实现,而是一套从数据、标注、训练到评测的完整技术链路,使研究机构和产业开发者可以围绕机器人仿真、合成数据、虚拟现实、三维内容生产与具身智能开展后续开发。四项SOTA,从相机理解到三维生成Puffin-World的统一能力在四项Benchmark中取得SOTA成绩。在相机到真实世界理解任务上,Puffin-World在Stanford2D3D、MegaDepth、TartanAir和LaMAR四个公开基准上取得最佳或并列最佳的中位误差,并在大多数AUC指标上领先。其中,在Stanford2D3D上,Puffin-World对横滚角、俯仰角和垂直视场角的中位误差分别为0.29度、0.53度和1.62度,显示出较强的绝对相机理解能力。在相机可控生成基准Puffin-Cam-Bench上,模型生成结果的上方向、纬度和重力方向中位误差分别为0.84度、1.26度和0.79度,FID为75.93,均优于参与比较的通用图像生成模型和已有相机可控生成方法。这意味着Puffin-World不仅能够生成质量较高的图像,还能让生成画面准确服从指定的相机状态。在Puffin-Traj-Bench上,Puffin-World取得18.00的PSNR、0.613的SSIM和0.288的LPIPS;生成轨迹的横滚角、俯仰角和视场角中位误差分别为0.80度、1.10度和2.96度。其中,PSNR、LPIPS以及三项相机控制误差均取得最优结果。在RealEstate10K三维世界生成测试中,Puffin-World取得17.22的PSNR、0.595的SSIM和0.318的LPIPS,三项视觉一致性指标均优于对比方法。这些结果表明,Puffin-World并非只在单一任务上提高图像质量,而是在相机物理理解、灵活空间控制、几何一致性生成和三维重建之间建立了相互支撑的统一能力。从“生成一段看起来合理的视频”,到“预测一个具有物理、几何和外观一致性的世界状态”,Puffin-World推动世界模型从视觉内容生成进一步走向可感知、可校准、可探索和可重建的三维环境。这也是世界模型真正进入机器人训练与具身智能应用所需要完成的一次范式转变。
  • 7 面壁智能 MiniCPM5-2B 模型登顶 Hugging Face Trending Top 1 面壁智能 MiniCPM5-2B 模型登顶 Hugging Face Trending Top 1,AA 综合 23 分居全球 4B 以下开源模型第一。本 2B 参数量即可完成工具调用、深度搜索、代码生成等智能体任务,端侧通用 Agent 雏形初现。
  • 8 蚂蚁集团CEO韩歆毅:8小时之外的智能体爆发是必然趋势 在2026 Inclusion外滩大会上,为加快智能服务生态发展,支付宝宣布设立“智能体涌现奖”,每年投入1000万,寻找有用、有趣的生活智能服务,年度大奖奖金100万元。9月10日起,在支付宝内右滑对阿宝说“智能体涌现奖”,即可了解赛事、报名参赛,普通用户也可参与“许愿”想要的智能服务。开发者作品入围后不仅可获得现金奖励,适合面向市场的成熟作品还可接入阿宝,为10亿用户提供服务,开展持续经营。蚂蚁集团CEO韩歆毅认为,8小时之外的智能体爆发是必然趋势。支付宝表示希望通过智能体涌现奖,促成以“智能服务供给”满足“碎片化生活需求”的供需循环,在小程序生态之外,构建面向AI时代的智能体生态。
  • 9 QQ音乐推出星悦会员,全新权益聚焦线下音乐娱乐生活全场景 近日,QQ音乐宣布正式推出全新会员权益体系——星悦会员。该会员体系不同于已有的线上音乐会员,将会更多专注在线下音乐娱乐生活全场景,为用户提供更多专属、优质、优先的音娱生活权益,包括但不限于:演唱会专属区域、稀有演出专享购门票、线上演出专属弹幕、演唱会专属折扣、线下活动会员专场以及在QQ音乐上结合当期线下活动的bubble、装扮等尊享权益。此次星悦会员的推出,使得QQ音乐会员体系在此前进一步丰富线上音乐体验的同时,更完善了线下娱乐生活场景下的权益。既为用户带来全方位的视听感受,也进一步丰富了用户的音乐娱乐全场景和综合体验。近年来,腾讯音乐持续强化以IP为核心的多元内容生态建设,在深化战略合作的同时持续提升内容自制与艺人培养能力,让乐迷感受更丰富的音乐魅力。此外,还持续将优质IP价值从线上延伸至线下,举办音乐会、音乐节、粉丝见面会等大型现场活动。具体落到QQ音乐平台上,像QQ音乐超级巅峰之夜这样结合了线上音乐榜单与线下演出活动的大型演艺IP已连续多年举办,受到了广大乐迷的欢迎。包括还举办了像王安宇“宇你相见”粉丝见面会等结合音乐与流行的线下活动,也给乐迷带来更多与明星艺人近距离相聚的专享机会。未来,在星悦会员将线下演出、艺人周边、活动专场等场景纳入会员权益体系后,平台不仅能够为用户提供更多可玩性,更能将线上玩法实实在在地转化为线下驱动力,实现平台IP价值的最大化释放。在用户需求日益多元、线下演出市场持续火爆的背景下,这是QQ音乐在音乐娱乐服务场景上的进一步探索,这一模式也有望为业内打开新的增长空间。
  • 10 索尼正式发布首款全画幅鱼眼变焦G镜头FE 8-14mm F3.5 Fisheye G 2026年9月8日,索尼(中国)有限公司正式发布首款全画幅鱼眼变焦G镜头FE 8-14mm F3.5 Fisheye G(SEL814G)。一支镜头可呈现两种不同类型的鱼眼视角:8mm 端圆形鱼眼视角,变焦至14mm则切换为对角线鱼眼视角;在约314克的紧凑镜身中实现索尼G镜头的高分辨率影像表现,具备双线性马达的快速精准自动对焦以及专业镜身操控设计,适用于风光、建筑、人像及水下摄影等多元题材。还可搭配索尼电影摄影机CineAltaV 2分体拓展系统组成双镜头配置,支持3D VR内容创作。FE 8-14mm F3.5 Fisheye G镜头将E卡口原厂镜头群的广角端拓展至8mm,填补了索尼全画幅鱼眼镜头的产品空白。从鱼眼超广角到超远摄长焦,索尼E卡口镜头焦段覆盖更加完整,为影像创作者提供更丰富多元的产品选择。FE 8-14mm F3.5 Fisheye G从圆形鱼眼到对角线鱼眼,一支镜头覆盖丰富视角相较其他鱼眼镜头,FE 8-14mm F3.5 Fisheye G可呈现两种鱼眼视角。搭配全画幅机身拍摄时,在8mm端,可以180°视角拍摄全画幅圆形鱼眼影像;在14mm端,可以覆盖全画幅180°对角线鱼眼影像。用户可结合拍摄主体与创作意图,灵活切换视角、调整构图,满足风光、建筑、人像、水下等多元题材的创作需求。支持两种鱼眼模式丰富的创作题材 – 风光丰富的创作题材 – 建筑丰富的创作题材 – 水下轻巧机身,兼顾便携性与空间内容创作FE 8-14mm F3.5 Fisheye G镜头直径约63.1毫米,长度约82.8毫米,重量仅约314克,无论手持拍摄还是搭配稳定器使用,均拥有出色的便携性。镜头采用内变焦结构,可最大程度减少变焦过程中重心的偏移。搭配两套索尼电影摄影机CineAltaV 2 分体系统2拍摄时,两枚镜头的光轴间距约为64毫米,接近人眼平均瞳距,可支持包括VR在内的空间内容创作,呈现自然的纵深感与距离感。出色的便携性G镜头品质,全焦段高解析力表现镜头搭载了4枚ED(低色散)镜片、1枚ED(低色散)非球面镜片及2枚非球面镜片,能有效抑制画面范围内的色差及多种像差,在整个变焦范围内保持优秀的高解析力表现。镜头最近对焦距离约0.15米,长焦端最大放大倍率约0.22倍,可呈现极具张力的鱼眼近摄视角。全焦段优秀的高解析力表现最近对焦距离约为0.15米自动对焦性能与操控设计,照片视频皆从容FE 8-14mm F3.5 Fisheye G搭载了两个线性马达,搭配Alpha 9 III等索尼微单™相机时,可实现最高120张/秒高速连拍,同时支持自动对焦与自动曝光跟踪,在人像、水下、视频等场景下可高效完成创意拍摄。操控性方面,针对鱼眼拍摄优化改进,配备对焦环、变焦环、光圈环三环独立操控结构,同时提供变焦及对焦锁定设置,防止误操作。镜头具备防尘防潮设计,前端镜片具备氟涂层,可从容应对户外拍摄环境。优异的自动对焦性能及操控设计价格与上市时间FE 8-14mm F3.5 Fisheye G(SEL814G)将于2026年9月中旬上市,建议零售价为9,999元。
  • 11 荣耀Magic9 系列定档9月28日:“苔青”配色亮相,携手ARRI打造“掌中电影机” 9月9日,荣耀正式宣布,全新年度旗舰荣耀Magic9 系列将于9月28日正式发布。作为荣耀品牌焕新后的首款旗舰系列力作,荣耀Magic9 系列秉承“敢想敢不同”的品牌态度,承接荣耀Magic系列十年技术沉淀,致敬创造者,将在外观、影像、AI及操作系统等方面迎来全面焕新与进化。荣耀Magic9 Pro Max汲取早期电影工业的经典色调,带来极具辨识度的全新配色——“苔青”。在设计上,新机镜头模组深度汲取了传奇电影机 ARRIFLEX 系列的设计精髓,将经典的“三镜头转塔”系统融入背部架构,三颗正圆摄像头呈标志性的“1+2”三角排布,复刻纯正的电影机械秩序。整机采用 Unibody 全金属机身与无缝拼接工艺,金属触感与深邃的“苔青”色彩交融,散发出电影工业独有的扎实高级质感,整机握持手感与精致度迎来全面跃升。在硬核细节上,荣耀Magic9 Pro Max以精细打磨工艺打造出极窄平行双轨微缝天线,不仅在视觉上做到了工业级的纯粹规整,更在天线极致收窄的同时,依然保持了顶级的稳定信号表现,真正做到了从内到外、由表及里的纯正电影工业与高端旗舰质感。影像配置方面,荣耀Magic9 Pro Max带来“双两亿”影像方案,搭载2亿阿莱云台级主摄、1/1.28英寸超大底传感器,与2亿阿莱超夜神长焦、1/1.4英寸超大底传感器,在解析力与光学防抖上实现跨越式升级。同时,新机深度延续与百年电影巨头ARRI的联合研发,全链路贯穿光学、底层算法与经典色彩科学,引入专业影视工业标杆ARRI LogC3曲线,保留丰富的光影与色彩信息,让移动影像真正拥有电影级质感,无缝接入专业电影工作流。为了进一步拓宽移动影像的专业创作边界,荣耀Magic9 系列同步推出了两款全新“拇指增距镜”、“巨炮增距镜”—— 荣耀长焦增距镜G200与荣耀长焦增距镜G500。其中,荣耀长焦增距G200(200mm)主打极致小巧,为当前行业内200mm等效焦距体积最轻量便携的增距镜方案;荣耀长焦增距G500(500mm)则主攻极限远摄,是目前手机行业焦段最长的外接增距镜,让移动长焦探索更远距离。荣耀CEO李健表示:“荣耀Magic系列,为创造而生,致敬创造者”。荣耀Magic9 系列是一次涵盖设计美学、极致影像、底层系统的全维度重构与突破,也是荣耀“敢想,敢不同”给出的全新答案。新机不仅迎来了辨识度极高的设计焕新与领先的影像系统突破,更将首发搭载全新荣耀MagicOS 11,以 Agentic OS 打开主动智能与想象的边界,开启人机交互的新范式。与此同时,结合当前行业爆料信息,荣耀Magic9 系列还将带来跨越式电池续航表现,并有望首发安卓阵营首个方形前摄等极具前瞻性的创新设计。
  • 12 荣耀Robot Phone亮相威尼斯:开启影像创作的电影化未来 荣耀作为威尼斯国际电影节“华语电影全球推广系列活动”官方影像战略伙伴,继戛纳国际电影节、上海国际电影节之后,第三次登上国际A类电影节舞台。电影节期间,荣耀全球首台掌上电影机Robot Phone再度亮相,荣耀Magic9全新配色苔青迎来全球首次曝光,获得影视与科技圈层的广泛讨论。面对复杂多变的拍摄环境,普通手机往往难以实现专业级的稳定运镜,而荣耀Robot Phone的硬件创新恰好能解决创作者的这一真实痛点。Robot Phone采用钛合金机械云台架构,可实现多轴运动,支持拍摄主体自动追踪,让手机首次拥有机器人级4DoF自由度。此外,面对旗舰手机寸土寸金的内部空间,荣耀的云台架构不仅将加工精度推进至±0.005mm,更让整体尺寸大幅缩减65%。对于威尼斯电影节这类大型活动现场,这套硬件方案意味着创作者不必携带笨重的专业设备,就能够从普通快照直接切换至电影级运镜效果,印证了移动终端也可以承载片场级别的动态影像创作需求。荣耀Robot Phone凭借在移动影像领域的实际表现,在威尼斯国际电影节现场得到了海外主流媒体的关注与认可。根据以摄影见长的《名利场》(Vanity Fair)报道指出,Robot Phone的产品实力不只体现在纸面参数,更落地于真实的拍摄场景。在电影节现场,Robot Phone既能跟随嘉宾踏上红毯,也能深入活动幕后,捕捉官方镜头常常忽略的人物神态与细节,还原威尼斯独有的氛围感。可见,Robot Phone的出现,让手机不再仅仅是记录画面的工具,更如同口袋中的摄像助理,可实实在在的拓宽影像创作边界。除了硬件及设计上的创新外,让智能手机掌握电影级的表达语言,也是Robot Phone的另一大核心看点。作为荣耀与全球电影工业标杆阿莱(ARRI)合作落地的首款产品,Robot Phone将阿莱的影像科学与专业工作流融入其中,搭载2亿像素主摄可录制阿莱LogC3格式,兼容阿莱广色域与阿莱风格色彩,调色工作流高度对齐专业电影工业标准。现场实测中,环境光线剧烈变化时,设备可以维持稳定可控的画面表现。威尼斯本身光线环境复杂,从潟湖强烈日光转入室内,从建筑阴影切换到水面反光,在这类复杂场景下,这套影像技术不再停留于概念宣传,真正成为创作者手中可用的工具。此外据了解,荣耀与阿莱联合打造的影像技术将全面应用于Magic9系列。中国科技凭借硬核创新收获海外业界点赞,而在本届电影节中,华语创作者也带着本土故事与创作思考站上世界光影舞台,蓝鸿春导演的《给阿嬷的情书》便是其中代表。该影片在拍摄过程中大量启用非职业演员,蓝鸿春在开拍前会花费大量时间与演员相处磨合,建立深厚情感羁绊,消解表演紧张感,让演员自然流露真实情绪。在面对海外媒体专访时,蓝鸿春也分享了影片的创作理念与幕后故事。他表示,尽管是首次到访意大利,内心却倍感亲切。意大利电影深刻影响着自己的创作,《偷自行车的人》所代表的新现实主义创作理念,也投射到这部作品当中,坚持将镜头对准普通人的生活。这部扎根潮汕土地的故事,让潮汕乡土故事与遥远的威尼斯产生奇妙联结。故事地域背景虽遥远,但传递的情感具备共通性,能够引发全球观众的共情。一边是中国科技以技术突破重构移动影像的创作边界,一边是华语电影以本土叙事传递普世的人文温度。在第83届威尼斯国际电影节的舞台上,硬核科技力量与动人的东方故事交相辉映,中国科技与华语电影双双闪耀水城威尼斯。科技工具赋能艺术表达,人文故事赋予技术温度,二者并肩出海,也让世界看见来自中国的影像力量,为全球影视行业带来全新的想象空间。
  • 13 MiniMax H3会员限时免费无限用!SkyProduction限免活动第二弹来了 8月28日-9月1日,SkyProduction(天工工作台)联合阿里巴巴通义万相,推出了Wan 3.0模型限时免费活动,时长反响热烈。无论是Wan 3.0的30s视频指出、多模态参考、精准修改能力,还是SkyProduction(天工工作台)的资产管理、无限画布、团队协作,都广受用户好评。而今天,SkyProduction的限免活动迎来了第二弹:Minimax H3模型,也要在SkyProduction产品上限时免费、无限使用了!相比libTV、oiioii等类似产品,您将在SkyProduction(天工工作台)上,获得最实惠的Minimax H3模型的使用权限!活动时间:9月9日-9月14日活动产品:SkyProduction中国大陆版,网址:https://skyproduction.cn对于短剧、漫剧、短片和广告创作者来说,同一个动作往往要试几种表演,同一场戏也需要比较不同的画面方案。最宠创作者的SkyProduction,希望通过本次活动减轻大家反复生成的积分成本,让创作者有更多空间试镜头、挑结果、打磨作品!一、首日会员免费用,新开会员、充值积分再享加赠本次限免活动,分“9月9日当日”和“9月10-14日”两个阶段。9月9日当日,无论此前已购买会员,还是当天首次开通会员,均可享受H3限免! 在限免权益内,使用指定H3模型生成视频不消耗积分,创作者可以把待测试的提示词和参考素材拿出来,多试几版。9月10日至14日,活动转入消费加赠阶段,具体分为两种方式:首先,对于“首次开通会员”的用户,按购买的会员类型获赠限免天数。 赠送天数由会员档位、个人或团队类型,以及月付、季付、年付周期共同决定。具体详见下表:参考会员价格:此项权益仅适用于“首次”开通会员的用户,升级会员不加赠,也不补赠档位之间的天数差。例如,首次购买旗舰版个人会员(月付)获赠3天,随后升级为至尊版个人会员(季付),通过购买会员获得的加赠总计仍为3天。第二,“已经是会员的用户”购买积分,也可按充值档位获赠限免! 购买积分额度和获得限免天数的关系如下:每位用户在本次活动中,每个充值档位仅可获得一次加赠,不同档位可叠加。例如,用户先充值¥800,获赠1天;再次充值¥800,不再加赠;但用户之后再充值¥2,000,可再获赠3天,累计获赠4天。9月14日是购买获赠的截止日,已获得的权益可以继续使用。 9月15日起,新购买会员或积分不再加赠,但此前获得的限免天数不会因活动结束而清零。例如,某用户在9月14日首次开通至尊版团队会员(年付),获赠7天限免,则限免可以使用到9月21日。本次限免仅限MiniMax H3 768P模型。权益期间须保持有效会员身份,工作室的权益由团队所有成员共享。二、MiniMax H3:把创作要求带进画面与声音之所以选择对Minimax H3模型限免,是因为这款模型确实有其独特优势:它是一款通用多模态生成模型,能够理解不同素材之间的关联,执行创作指令,并联合生成视频与原生立体声。对影视创作者而言,这些能力对应着几项具体需求:首先,把动作、场景和镜头要求一起交给模型。 创作者可以在提示词中描述人物如何行动、场景呈现什么氛围,以及镜头怎样观察人物,让一次生成承载更完整的拍摄意图。例如,同样是人物走进房间,可以分别尝试紧张、迟疑或轻松的表演方向,再挑选符合剧情的结果。第二,Minimax H3模型可以让多模态参考素材参与创作。 文字之外,还可以上传参考图片、参考视频和参考音频。创作者可以围绕同一组素材调整动作与镜头描述,比较不同表达方式,为后续制作积累候选方案。第三,用音画配合丰富叙事。 H3原生音画生成的能力,使对白、环境声、音效与画面可以共同参与内容表达。一段短视频里的脚步声、环境变化和人物反应,都能成为传递情绪与节奏的元素。SkyProduction本次开放的是自部署H3 768P版本,支持文生视频及当前开放的参考生成方式。创作者可结合实际生成结果,判断它适合承担哪些镜头任务,并在限免权益内继续尝试和调整。三、从内容出海到镜头精修,SkyProduction让创作进一步落地Minimax H3限免,让会员有机会把更多创意拿出来试。而真正投入短剧制作,还需要知道哪些情节值得拍、哪些片段需要改,以及怎样为不同市场制作版本。围绕这些具体需求,SkyProduction把剧本生成、剧本翻译、出海改编、镜头精修、长视频生成放进同一套工作台,让创作者能够继续打磨作品。生成之前,先把故事准备好对于AI短剧,剧本质量决定了后面每一步会不会返工。SkyProduction(天工工作台)把小说转剧本、剧本评分和剧本翻译放在同一条创作链路里,帮你生成能打的剧本。对于手中已有小说的创作者,“小说转剧本”可以把叙述、心理活动和关键情节整理成人物、场景、动作与对白,形成适合继续修改的剧本框架。“剧本评分”则从故事结构、人物设定、冲突推进和节奏等方面提供评价与修改建议,帮助创作者找到值得优先打磨的内容。先把故事理顺,再进入镜头测试,后续制作也更有方向。同一个故事,继续制作海外版本对于想要做出海短剧的生产者而言,外语不好、不懂对方文化,是很令人头疼的问题。SkyProduction的一系列功能就是为解决这个问题而生的。“剧本本地化翻译”结合角色名、人物关系、术语和上下文处理目标语言表达,把对白翻成更自然的目标语言,同时保留原剧本的场景、动作和格式。对于已有短剧的团队,平台还提供“短剧出海转绘”。你可以上传原短剧,直接进入海外改编制作流程。从剧本阶段的语言处理,到已有作品的版本改编,创作者可以根据需求选择相应的工具!从镜头规划到长视频成片,再逐段打磨上传一份完整剧本后,SkyProduction(天工工作台)的导演级Agent,就开始自动操作了!它会先帮你把人物、场景和道具找出来,分析剧情关系,再继续推进资产生成、分镜拆解和视频镜头制作。在Agent流程里,可以选择Seedance 2.0“智能创作”或“智能分镜”模式。想快速出片,可以走更精简的路径;想让人物站位和镜头关系更稳,可以使用站位图锁定,再进入分镜脚本、线稿图和视频镜头生成。如果你觉得还不够,那么“3D导演台”可以让镜头规划更具体:人物站在哪里、面向哪个方向、摄影机从什么角度拍摄,都可以先在三维空间里调整,再将选定视角截图用于后续创作。遇到双人对话、多人同框等场景,也能提前梳理人物之间的空间关系,把拍摄意图表达清楚。进入生成阶段,平台提供“直出10分钟视频”能力,为完整场景和较长篇幅的故事提供创作空间。创作者可以围绕一段情节展开人物互动、动作变化与节奏安排,再从整体效果中判断哪些段落值得保留、哪些地方需要继续打磨。成片后的修改同样有工具承接。如果某一段动作不自然、表情不合适,或台词表现未达到预期,可以通过“片段重拍”针对选定部分重新生成,保留其他可用内容,减少整段返工。“视频裁剪”则用于截取需要的片段,整理可用素材,为后续剪辑做好准备。从提前规划镜头,到生成较长内容,再到逐段修改,SkyProduction(天工工作台)让创作者能够把精力落到每一个具体的画面和表演上,让作品更可控,更能逐步接近导演脑海中的预期。最后,大家不要忘了我们的活动时间:9月9日,会员可进入SkyProduction体验H3限免;9月10日至14日,符合条件的新开会员和积分充值继续享受加赠。带上正在打磨的故事、参考素材和你激动的心,让下一次视频创作从天工工作台开始!SkyProduction(天工工作台)官网:www.skyproduction.cn
  • 14 从 15 秒到5 分钟,AI 视频创作进入单反级交付时代 2026年9月8日,智象未来(HiDream.ai)旗下内容创作智能体vivago R1全球上线,国内版本「够搭」全新升级发布。今年7月,vivago R1 于 WAIC 2026 首次亮相。作为全球首个无限时长内容创作智能体,R1 引起 AI 视频领域广泛关注。今天,R1正式面向全球用户开放。vivago R1 的核心突破,在于实现了从一句成片时代的 “生成片段” 到 “完全交付作品” 的范式跃迁。它依托智象“基础模型 + 智能体”双轮驱动技术战略,让创作者以自然语言对话的方式,即可完成从创意表达到高质量成片交付的完整创作流程。R1的上线,标志着AI视频创作进入“单反级交付时代”。每一位普通创作者,都能独立完成专业团队级的品质大片。01 从Sora的15秒,到R1的五分钟Sora 用15秒视频惊艳世界,成为 AI 视频生成的重要转折点。但时至今日,15-30秒的片段式生成依然是行业主流。R1 的突破在于,能够一次性稳定输出5分钟高质量视频,并支持无限次多轮延长。长视频的难点,不只是把时长拉长,而是让故事在多镜头、多角色、多场景之间持续成立。R1 通过 Agent 系统对长任务进行规划与调度:主 Agent 拆解创意,子 Agent 协同完成脚本、分镜、角色、场景与音效,确保角色形象、场景风格和叙事节奏在多段落中保持一致。同时,依托智象自研 HD-AgentOS 的全流程调度与治理能力,R1 内容有效可用成功率提升至85%,显著降低“抽卡”概率,让视频创作更具确定性。R1 还优化了跨镜头角色一致性和场景过渡自然度,弱化 AI 视频常见的“塑料感”和“瞬移感”,实现更自然的运镜衔接与音画对齐,让长视频更接近实拍质感。02 Chat-First (对话优先):让创作回到表达本身好的创作工具,应当顺应人的表达本能。对于视频创作而言,起点不应是节点、画布和参数,而应是创作者想要表达的内容。R1因此选择 Chat-First (对话优先)路线。因为对话是人类最自然的表达方式,也是 AI 最友好的创作入口。当前 AI 视频工具大致有两条路线:一类是画布式、节点式工作流,将模型、工具和参数交给用户自行连接和调试,自由度高,但门槛也高;另一类是 R1 的对话式路线,用户只需用自然语言描述需求,R1 即可自动生成视频,并支持在对话中持续调整和迭代。这种体验背后,是“做后”与“做厚”两条原则。“做后”,是把专业创作者的判断、审美和经验编码进 Agent 编排能力,形成强大的中后台;“做厚”,是构建 SkillHub,将抽象 AI 能力转译为产品广告、角色视频、故事短片、品牌内容等真实创作场景,让用户更容易理解能做什么、如何开始。在完整流程中,用户只需表达目标,Agent 负责拆解和执行,SkillHub 则作为翻译层,自动匹配并编排所需 Skill 组合,将用户意图转化为可执行任务序列。R1 的对话式创作,不是把复杂消灭,而是把复杂藏在简单背后。它让创作从“灵感闪现”到“进入执行”,缩短到只剩一句话。03 原生全模态基础架构,让 AI创作走向项目制视频生成的另一大挑战,是一致性:同一个角色、同一种声音,如何在数十个镜头、多次生成转换中始终如一。智象未来的解法,是以基础模型与智能体系统双轮驱动,共同支撑复杂视频创作。一方面,智象自研的原生全模态世界模型技术理念,为 R1 提供多模态理解与生成基础能力。它能将文本、图片、视频、参考资产、文档说明和历史创作结果纳入同一任务语境,让 Agent 理解“任务全貌”,而非单点指令。另一方面,智能体系统负责将模型能力组织为可持续推进的创作流程,在脚本、分镜、角色、场景、镜头和音效之间进行规划与调度,确保复杂叙事中的角色形象、声音特征和风格前后一致。这让创作不再是一次次孤立生成,而是围绕同一项目持续推进。用户可以“说不清的直接给”,R1 则在统一上下文中理解、组织、执行并持续迭代。同时,R1 推出资产库功能,沉淀用户生成、筛选并认可的内容,并可在后续创作中复用。一次创作不再只是一次性输出,而会成为下一次创作的素材基础。基础模型决定能力上限,智能体系统负责把能力转化为稳定、可控、可复用的作品交付。04 全球创作者用作品说话:R1 让表达成为生产力在今天举办的vivago R1「够搭」沉浸式工作坊活动上,来自全球不同领域的创作者们,采用线上和线下的方式,分享R1的使用心得,并展示他们制作的作品。近期,AI 版《西游记》上线后引发热议。活动现场,一位创作者也用 R1 尝试了这一经典题材的再创作,并生成近 5 分钟西游题材作品。从角色造型、场景氛围到东方奇幻质感,R1 对经典文本的视觉转译能力得到直观呈现。在真人质感上,R1 同样表现出色。另一位创作者带来一支励志短片,讲述体育老师周岚从迟疑到重新出发的过程。画面中,奔跑时的肌肉震颤、汗水光泽,以及脚步压过塑胶跑道的颗粒质感都被细腻还原,让人物情绪更具真实感。提示词:体育老师周岚在训练与接力比赛中面对自己的迟疑。来到第二道弯,她一度想停下,却继续迈步,坚持跑向终点。次日清晨,她主动再次接过接力棒。影片将人物转变放进呼吸、步伐与交接棒等具体动作,以持续奔跑呈现重新出发的过程。提交提示词后,R1 会自动理解人物关系、情绪转折与动作节奏,生成对应角色、场景与关键画面。创作者无需复杂操作,只需通过对话补充想法,即可推进内容生成。在商业广告片制作上,R1 也展现出较强适配能力。现场一位 AI 创作者分享了红色折叠手机广告案例。R1 根据提示词理解产品、人物与场景关系,生成手机多视图、女设计师造型、工作室与户外生活场景,以及包袋、色卡、草图等视觉资产,呈现从创作、出行到回归设计的日常灵感流动。提示词:一位年轻女设计师在一天中穿梭工作室、城市街道、咖啡馆和海边,用红色折叠手机记录色彩、构图与生活中的灵感,再将所见带回工作台。影片围绕手机开合、拍照和查看素材的使用动作,串联从创作到出行、再回到设计的日常。现场之外,多位海外创作者也通过线上连线分享创作体验。一位创作者表示:“视频创作的终点,就是一次表达。”这也道出了许多体验 R1 用户的共同感受:当复杂流程被隐藏在对话之后,创作者可以更专注于表达本身。05 开创视频Agent新标准:CHATSR1的实践充分表明,当产品真正进入专业场景,行业需要的就不再是零散的能力清单,而是一套可衡量、可依赖的交付标准。智象提炼出一套面向视频 Agent 的评估框架——CHATS,用于衡量一个视频 Agent 是否具备真正的作品交付能力:C(Consistency)一致性:角色、场景、风格在多镜头中保持稳定;H(Human Intent)意图理解:准确理解用户创意,并能在多轮对话中持续推进;A(Audio & Visual)视听完整度:不仅生成画面,也能组织声音、节奏与整体视听体验;T(Timeline & Tale)时间线与叙事:让故事在多个镜头、多个段落中持续成立;S(Stability)稳定交付:降低反复生成和返工成本,提高内容可用率。这五个维度,不是实验室里的理想指标,而是 R1 在真实创作内测场景中被众多内测用户反复验证过的能力边界。智象希望通过构建一个用户视角的标准,推动AI Agent产品的更好发展。2024年5月,vivago.ai 上线,成为全球最早一批公开可用的 AI 视频生成产品;今年5月,vivago.ai登顶Product Hunt日榜第一;今天,vivago.ai全球用户突破7000万。两年时间,智象从“第一个可用”走到第一个“单反级交付”。这就是 vivago R1 中 “R” 所承载的意义:一面是 Reasoning,用深度推理把灵感变成作品;一面是 Rock,致敬 “The Show Must Go On” 的创作精神——无论如何,创作终将继续。在AI视频时代,vivago R1 希望让创作从一次生成,变成持续对话:The CHATS must go on。只要对话继续,故事就不会停下。立即体验vivago.ai够搭 goudaai.com够搭,你的 AI 创意好搭子。
  • 15 蔚来能源与云南交投新一批合作共建高速换电站正式投入运营 2026年9月8日,继2024年蔚来能源携手云南交投落地首批高速换电站之后,双方联合共建的新一批蔚来高速换电站正式全面投运。此次规模化站点落地,是蔚来能源深耕云南、完善西南高速补能网络的重要布局,也推动云南高速新能源补能基础设施建设迈入规模化、网络化、高品质发展新阶段,以科技力量助力云南区域绿色交通高质量发展。此次投运的蔚来换电站,均落地于云南交投管辖的核心高速服务区,精准布局省内多条交通动脉,实现重点高速通道双向补能全覆盖:G5621昆楚大高速地索坪服务区(双向)、G85银昆高速会泽服务区(双向)、G78汕昆高速师宗服务区(双向)、G5京昆高速元谋服务区(双向)、G8511昆磨高速通关服务区(双向),以规模化布局重塑全省高速公路新能源补能新格局。从试点到全域铺开,此批换电站的集中落地,是蔚来能源与云南交投深度协同、共建共享的标志性成果,标志着双方高速充换电基础设施合作迈入规模化、常态化、深度化的全新阶段。
📌 51CTO 推荐榜 共15条
热搜日期: 24小时更新数据