文/VR陀螺
AI指环、AI眼镜、AI手机、AI操作系统、AI生3D、机器狗、人形机器人、灵巧手,以及占据大半个展台的AI大模型服务器与液冷设备……
走进2026世界人工智能大会,很难用某一种产品概括今年的WAIC。如果硬要说某种趋势的话,那就是AI正在进入越来越多的硬件形态,也在沿着内容生成、终端交互、算力基础设施和具身智能等方向快速扩张。
今年的大会也比往年更加庞大。7月17日至20日,WAIC 2026首次采用世博、张江、西岸“三地四馆”的布局,展览总面积突破10万平方米,1100余家企业带来3000余项展品,超过300款产品在大会期间全球首发,智算与具身智能两条赛道均聚集了超过200家企业。

相比于去年,今年「AI眼镜」参展数量激增,几乎是去年的2倍,代表厂商包括:阿里、Rokid、INMO、 VITURE、BleeqUp、李未可、Moonix、亮亮视野、玄景、科大讯飞等品牌厂商,还有移远通信、形意智能、亿境、莫界、创通联达等上游厂商。VR/MR方面,虽然没有直接的品牌厂商展出,但在部分具身智能的展台上,看到了基于6DoF VR/MR的遥操作展示。
从等待唤醒到主动服务,AI 眼镜开始自己“动起来”
主动式AI,正在全面渗透到各种形态的AI眼镜中。
李未可在WAIC首日正式发布了新一代AI 眼镜——李未可X-AI记忆眼镜,这是一款以“长期记忆”为核心卖点的硬件产品,其中,针对“记录”方面,便支持主动式AI记录。
眼镜可以通过智能场景感应判断用户是否处于会议、面谈、展会交流等场景,自动启停录音或拍摄,无需用户寻找按键或反复发出语音指令。记录结束后,系统还会整理出会议纪要、结论与待办,并进一步调用腾讯云WorkBuddy生成文稿、方案、邮件草稿等内容。

无独有偶,日前已正式开卖的Moonix莫奈AI眼镜除了低至14.9g的重量外,“主动式AI”也是其核心卖点。其核心逻辑是“无感记录+AI生成”,其在APP端,用户可以开启“智能记录”,它会每隔2分钟记录10秒环境音,以此为前提,眼镜可以持续积累用户的信息,并每日完成一次AI总结。

主动式记录的能力解决了记录类产品长期存在的一个问题:真正值得保存的信息,往往散落在自然交流过程中。用户很难在每次重要内容出现前,都提前意识到“现在需要开始录音”。由眼镜判断什么时候记录、记录哪些内容,再将信息整理成可调用的长期记忆,AI才有机会变成持续参与工作和生活的助手。
Rokid也在从操作系统层面推动主动式AI。WAIC 2026现场,乐奇Rokid展示了Rokid Glasses、Rokid AR、Rokid Helmet等多款智能眼镜产品,在乐奇AI助手2.0版本,Rokid Glasses已实现了“主动智能”,包括但不限于行程自动记录、定时主动提醒等功能。

千问AI眼镜也在向同一方向推进。今年5月,千问AI眼镜S1已经上线主动服务能力,可以结合天气、时间和用户状态,提醒用户出门带伞或抬头活动。到了WAIC 2026,千问进一步宣布将AI眼镜升级为“智能体眼镜”,通过眼动追踪、全双工语音等硬件能力增强环境感知,并支持按需调用第三方Skill和Agent,尝试把提醒延伸到打车、闪购、行程规划等具体服务。
VR头显走进机器人展台,遥操作成为新入口
AI眼镜在争夺人的日常信息,VR/MR头显则开始采集人的动作。
在本届WAIC的具身智能展区,机器人依然是最拥挤的赛道之一。机械臂抓取、灵巧手操作、人形机器人巡检和产线作业随处可见。相比机器人能否跑步、跳舞,今年厂商更加关心它们能否进入工厂、药房、仓库和家庭,完成稳定、可复制的任务。
大语言模型可以从互联网获得文本、图片和视频,机器人需要学习的抓取力度、手臂轨迹、身体姿态和空间判断,却很难直接从网络内容中获得。在WAIC现场了解到,真实数据的采集方式和积累规模,已经成为机器人行业过去一年最受关注的问题之一。

而VR/MR头显恰好提供了一套相对成熟的解决方案。与实际玩VR游戏略有不同,操作者佩戴头显进行SLAM定位后,可以将头显放置于旁边或挂于脖前,核心在于使用手柄或围绕自身进行一系列的交互,让机器人实现抓握、下蹲、挥手等动作。在WAIC现场,星辰智能展示的星辰智能T1机器人,正是此类方案的代表。此外,VR陀螺从现场了解到,目前VR遥操作并没有相对统一的标准,各家在手柄上定义也不太相同。

除了具身智能厂商自定义VR/MR遥操作外,国内部分VR/MR硬件厂商也在积极拓宽VR/MR在具身智能数采方面的应用。今年3月,大朋(DPVR)发布「RoboPilot」机器人遥操训练方案,将VR技术直接嵌入机器人远程控制与训练链路;6月初,PICO宣布联合英伟达推出基于Isaac平台的开源机器人遥操作方案「Isaac Teleop」,将XR设备接入机器人仿真与训练体系。
世界模型,AI 3D进入下一阶段
除了AI眼镜和机器人,AI生成3D也是WAIC 2026现场颇为集中的一条技术路线。
过去两年,文生3D、图生3D的主要目标,是用一句话或一张图片生成一个角色、道具、商品或工业零件。模型的几何结构、纹理质量、拓扑规范和生成速度,是厂商展示能力时最常使用的指标。
今年现场出现了一个明显变化:部分AI 3D厂商不再满足于生成单个模型,而是开始生成可以进入、探索和交互的完整场景。“世界模型”也由机器人和自动驾驶领域的技术概念,进一步进入游戏、XR和3D内容生产。

VAST旗下Tripo AI展示的Project Eden便沿着这一方向展开。按照官方定义,它希望构建一个支持多人和智能体共同进入、具有持续状态的交互世界。用户在场景中移动一个物体或改变环境后,这一结果不会随着视角切换或下一次进入而消失,其他用户进入同一世界时,也能看到此前留下的变化。
Tripo 3D产品经理Steven告诉VR陀螺:“我们会先把场景中的动态物体和静态物体通过语义方式分离出来,判断哪些东西可能移动,哪些东西通常不会移动。用户拿起一块石头时,系统需要计算这块石头受到的力,以及它会对周围环境产生什么影响,但不需要把整个场景全部重新计算一遍。”
在现场演示中,飞机螺旋桨可以影响海浪,两辆赛车从不同视角观看时,其位置与运动关系仍然保持一致。Steven表示,传统生成视频更多是在预测画面,而世界模型需要先建立一个真实存在的场景状态,再让不同摄像机从中进行观察。“场景本身已经存在,从不同视角看到的状态和物理关系应该是一致的。用户在里面做出的改变也需要被记录下来。”

从生成画面走向模拟世界,意味着AI 3D需要同时解决空间一致性、物体语义、物理碰撞、时间变化和长期记忆。其难度也远高于生成一段看起来合理的视频。目前,这类世界模型能够生成和维持的场景规模仍然有限。Steven坦言,场景大小、生成时间和交互复杂度都受到算力制约,现阶段更适合从游戏等场景切入,再随着模型效率和终端算力提升,逐步扩展世界的面积与交互方式。
与世界模型同时升温的,还有3D Gaussian Splatting,即3D高斯泼溅。相比传统Mesh通过顶点、边和面描述三维物体,3D高斯利用大量具有位置、大小、颜色、透明度等属性的高斯点表示空间。它在新视角合成和实时渲染方面具备优势,因此迅速进入数字人、空间扫描、XR内容、游戏场景和世界模型等方向。

VAST在今年发布的TripoSplat,可以从一张图片直接生成3D高斯资产。其核心变化是根据物体不同区域的复杂程度动态分配高斯数量:细节丰富的位置使用更高密度,结构简单的位置减少数据量,从而在画质与计算成本之间进行平衡。
不过,3D高斯的视觉表现,并不意味着它已经能够全面替代Mesh。Steven告诉VR陀螺:“3D高斯已经发展了几年,但它还没有取代Mesh,一个很重要的原因就是可编辑性。现在虽然开始出现光照编辑、绑定等能力,但可编辑高斯和4D高斯的数据量非常大。如果实时编辑和资源消耗解决不好,它就很难真正进入大规模生产流程。”
厂商盘点
以下为WAIC 2026 XR相关展位内容:
阿里巴巴
在WAIC大会现场,千问宣布将AI眼镜升级为智能体眼镜。升级后,眼镜可通过智能体强化服务与决策能力,并能按需调用第三方Skill和Agent。同时,千问还推出全双工语音、眼动追踪、体征监测等一系列全新硬件技术,以增强智能体眼镜对物理世界的感知与交互能力。

据介绍,上述硬件技术将在年内应用于千问AI智能体眼镜;已发售的千问AI眼镜S1、G1也将通过OTA引入Agent能力,进一步提升个性化任务理解和办事能力。今年以来,千问持续推进AI硬件布局,千问的首款AI智能体耳机也在WAIC现场正式亮相。
蚂蚁集团
蚂蚁集团现场发布并展示了LingDevice OS 1.0。该系统定位为原生安全Agent引擎和协作平台,可适配AI眼镜、AI耳机等不同形态终端。

LingDevice OS提供数字支付、生活服务、智能体生态和开发工具,支持“一次开发、多设备分发”,并通过隐私沙箱实现终端与智能体之间的可信连接。交互方面,系统可接入声纹、虹膜和智能指环手势等能力。
蚂蚁集团在现场还展示了一款搭载该系统的全彩AI眼镜参考样机,该产品采用衍射光波导及MicroOLED屏幕,可实现实时翻译、导航、提词和拍照等功能。

科大讯飞在此次大会展示了讯飞AI眼镜,作为该产品重量约40克,定位翻译、提词和办公AI助理,支持多场景翻译,并可通过唇动识别和多模态降噪在复杂环境中锁定发言人。

该产品将近眼显示、实时翻译和多模态降噪结合,主要面向跨语言交流、会议和商务办公场景。除翻译字幕外,眼镜还可用于提词、会议记录、内容整理和办公辅助。科大讯飞此次同时展出了翻译机、AI翻译耳机、录音笔和办公本等产品,AI眼镜被纳入其从声音采集、翻译到内容处理的效率工具体系。
乐奇Rokid
乐奇Rokid在展会上集中展出了乐奇AI眼镜、新一代Rokid AR空间计算设备Rokid AR、AI Helmet智能骑行头盔以及专为智能眼镜打造的原生AI操作系统YodaOS。

其中,乐奇AI眼镜主要承担日常拍摄、翻译、AI问答和生活服务入口功能;Rokid AR为新一代空间计算产品,搭载骁龙空间计算平台,支持6DoF空间定位、58°视场角和4D高斯空间重建,是该产品首次在全球大型展会上公开亮相。AI Helmet则将4K循环骑行录像、高德骑行导航、多人组队对讲和AI语音交互整合到头盔中,将Rokid的AI能力从眼镜扩展至骑行装备。
YodaOS则从系统架构层面完全围绕眼镜形态重新设计,搭建了极速交互界面、多维感知层、智能能力层以及场景落地层,让AI眼镜真正变成“随身AI伙伴”的底层基础设施。
李未可科技
AI创新企业李未可科技在大会现场正式发布了全球首款AI记忆眼镜——李未可X-AI记忆眼镜。
该产品售价799元起,采用透明镜腿和快拆镜框设计,主体约26克,摄像头采用约10克的磁吸模组,支持1200万像素拍照和1440P视频。眼镜本体配备4颗麦克风,安装模组后可扩展至6颗,支持10小时以上持续录音和约30天待机。用户在不需要视觉记录时可以拆下摄像头,在会议室等敏感场景中也能形成更明确的隐私边界。

产品的软件核心为WakeeMemory现实记忆架构,能够对会议、拜访、差旅和日常沟通中的人物、事件、时间、任务及关系进行结构化处理,并在需要时重新召回。通过与腾讯云WorkBuddy合作,记录生成的待办和项目背景还能进一步转化为文档、PPT、日程及跨系统执行任务,形成“记录—理解—召回—执行”的完整链路。
心眸科技
心眸科技此次展出了标准版Moonix AI眼镜及首次公开亮相的Moonix Pro。标准版整机仅14.9克,不搭载摄像头,主要通过音频采集会议、对话和灵感信息;Moonix Pro重量约19.9克,在标准版基础上加入摄像头和视频记录能力,通过不到5克的重量增量补充视觉感知,计划于8月正式推出。现场还设置了30余款镜框试戴区,强调轻量化与传统眼镜外观的结合。

产品同时支持自动记录与用户主动发起记录,不再完全依赖“唤醒—发出指令—等待回答”的传统交互方式。内容进入Moonix App后,可自动生成纪要、待办和信息洞察,并沉淀为用户的个人数字记忆。
BleeqUp
致敬未知在现场展示了旗下BleeqUp超影擎四合一AI运动拍摄眼镜,该产品集成高清第一视角运动相机、开放式蓝牙耳机、运动护目镜和实时通信功能,并通过AI完成视频素材识别、自动剪辑和运动数据融合。

产品重点解决传统运动相机需要手持或固定安装、普通智能眼镜又缺少运动防护和数据能力的痛点。除现有眼镜外,BleeqUp还在展会期间披露“AI+运动健康”战略,提出从记录运动数据向实时建议、训练优化及个性化干预延伸。
VITURE
AR眼镜品牌VITURE在本次WAIC上,带来了基于VITURE Luma Ultra的6DoF AR眼镜体验。据介绍,VITURE Luma Ultra主要通过眼镜内置的独特计算芯片以及双目深度摄像头实现6DoF,为了获得完整的6DoF的体验,通常需要搭配VITURE 颈环 Pro(Pro Neckband)使用。

VR陀螺在现场可以体验到类似于AR版本的“愤怒小鸟”和“画画”等小游戏,52度的FOV不算大,但对于一款小游戏而言,沉浸感也完全足够。其SLAM算法相对稳定,不会因为用户的太大移动,抖动等产生严重偏移。手势识别也较为精准,整体AR小游戏打造了一个非常务实的AR生态基础。
据现场工作人员介绍,除了上半年已经发布的原生3DoF眼镜VITURE Beast外,预计在今年内,VITURE还会有更多新品与大家见面。
微光科技
微光科技在现场展示了旗下玄景M5、L3和M6等系列AI眼镜。M5是一款夹片式单绿色AR眼镜,可直接安装在用户原有近视镜上,使用户无需更换日常眼镜即可获得翻译、提示和AI信息显示功能。

L3采用模块化“可进化”设计,基础状态是一副普通眼镜;安装智能镜腿后可变为AI音频眼镜,再增加AR显示模块后升级为AI+AR眼镜。产品搭载自研鸿雁AIOS和鸿雁Agent,支持端侧实时翻译、语音摘要和本地数据处理。
M6则采用模块化全彩光波导显示,显示模组可以按使用需求切换和升级。其核心思路不是一次性固定所有硬件,而是让用户后续更换显示或智能模块,减少整机迭代带来的重复购买。
形意智能
形意智能现场展出了AI Camera Glasses系列、AR99、AR99 Pro、C100,以及面向执法、医疗和无障碍场景的多款行业产品。
AR99采用Micro LED与体全息光波导方案,整机约28克,支持实时翻译字幕、AR导航、手机消息同步、会议转写和演讲提词;C100为双目AI+AR眼镜,进一步强化导航、翻译和AI问答能力。新一代AR99 Pro则在轻量化和显示效果方面继续升级,并可与智能戒指等外设协同交互。

行业产品中,形意·007面向执法、巡检和安防,提供第一视角录像、远程音视频传输及人车抓拍;形意·医联可连接医疗设备,支持手术导航、画面放大和远程会诊;形意·知音则面向视障和低视力用户提供环境识别、文字阅读和语音辅助。
京东
京东以“AI进入物理世界”为主题亮相上海世博展览馆,集中展示JoyInside“AI Home”、具身智能数据全链路基础设施。在具身智能展示区域,京东带来了自研的JoyEgoCam头戴式数据采集设备,戴上设备即可记录第一视角作业数据,并转化为具身智能的学习素材。
在京东展台,影目展示了INMO GO3、仅供京东渠道销售的GO 3晶透版、INMO AIR3和王嘉尔联名款Magic AI Glasses。GO3定位AI翻译眼镜,采用双目单绿色Micro LED与衍射光波导方案,视场角30°、入眼亮度1500尼特,支持261种语言在线互译及多种离线语言。产品采用8毫米窄镜腿、空气鼻托和约53克机身,并围绕AI商务、会议辅助及翻译体验进行了软件升级。

AIR3为一体式全彩AR眼镜,采用0.44英寸Micro OLED与阵列光波导,单眼分辨率为1920×1080,视场角36°、刷新率120Hz,主要面向全彩内容、空间显示和娱乐应用。Magic AI Glasses则由WHL原创并由王嘉尔参与产品设计与定义。近期,这款AI眼镜官宣在北美发售,首批预定已达5万台。

雷鸟创新在京东展区展出了RayNeo X3 Pro,该产品搭载高通骁龙AR1 Gen 1平台,支持6DoF空间定位与SLAM环境建图。其采用MicroLED微显示器与双目衍射光波导,搭载雷鸟自研Firefly光引擎,光引擎体积约0.36cc。眼镜还配备3颗麦克风,并集成加速度计、陀螺仪、磁力计、环境光传感器及佩戴检测传感器。

软件层面,X3 Pro运行RayNeo AIOS并接入Google Gemini,支持实时翻译、彩色抬头导航、会议转写、提词器和第三方Android应用。
XREAL同样出现在京东展区,展品为XREAL 1S。产品采用索尼0.68英寸Micro-OLED屏幕,搭载自研空间计算芯片,支持原生3DoF空间显示、实时2D转3D,以及等效500英寸的虚拟巨幕体验,还支持软件瞳距调节及三档和自动电致变色。音频部分采用经过Bose工程师调校的定制扬声器,并配备4麦克风阵列和“隐秘空间声场3.0”。

亿境虚拟此次展示了已量产的AI拍摄眼镜、AI音频眼镜及MR头显解决方案,并重点推出“全天候主动环境感知”多模态可穿戴解决方案。相比传统产品等待用户发出指令,该方案希望通过声音、视觉和环境信息持续判断用户所处场景及潜在需求。

其同时还在展会期间发布“亿灵”AI智能中枢,希望将眼镜从拍摄或音频工具升级为持续感知环境、理解场景并主动提供服务的终端。其核心面向B端客户,可结合客户品牌、模型和应用生态进行定制。
万有引力
空间计算芯片企业万有引力在WAIC现场展示了基于空间计算MR芯片X100打造的百克级MR参考设计X100-M1,最高支持8K/120Hz超高清MR显示输出,且时延低至9ms,运动到光子(Motion-to-Photon)延迟仅3ms。在AI能力方面,X100支持眼动追踪、手势识别、显示处理以及ISP全链路AI优化,并支持端侧小模型部署。

除MR参考设计外,万有引力还展示了面向XR/AI硬件的眼动追踪技术。该方案支持双相机融合,具备最高60°离轴追踪范围,在算法与部署上,支持CV、AI及混合算法的灵活应用,并提供完善的全流程标定与适配方案。可应用于注视点渲染、精准交互、显示补偿、自动瞳距调节以及视觉健康监测等场景。VR陀螺现场观察到,其参考设计仅需2颗摄像头即可实现眼动追踪。

此外,万有引力同步展出了专为AI眼镜和AI随身硬件打造的VX100 ISP芯片。该芯片封装尺寸仅4.2mm,支持最高1080p 30fps拍摄,并集成眼动追踪、多级唤醒以及智能场景识别能力,为AI终端提供低功耗视觉处理能力。

极豪科技在大会现场展示了JVE眼动交互解决方案,该方案支持眼球追踪、虹膜及巩膜识别、视线深度预测等能力,可帮助智能眼镜判断用户正在看哪里、关注什么,并将视线动作转化为设备可以理解和执行的交互指令。该方案方案整体体积最小可达1.69mm³,重量低至6.7mg。
此外,极豪科技还在现场带来了互动游戏“看进世界杯”,体验者戴上智能眼镜,看准足球上的目标点并短暂停留,即可完成一次射门。

亮亮视野
亮亮视野在WAIC现场展示了Leion Hey2。产品采用单绿色Micro LED与双目衍射光波导方案,整机约49克,入眼亮度2500尼特,支持100多种语言实时互译,翻译延迟低于0.5秒;眼镜单机续航约8小时,搭配充电盒可达到96小时。

中科创达旗下的创通联达在现场展示的TurboX AI眼镜解决方案采用高通平台与MCU双芯片架构,并对Android与RTOS双系统进行优化。该方案重量仅35克,通过5麦克风+波束成形+双扬声器提供沉浸式音频,随身AI助手支持会议纪要、日程记录提醒、主动备忘回溯、会议白板/草图细化等功能。

其蓝牙高频场景功耗降低约30%,待机功耗降低约75%,开机速度提升约75%,拍照响应速度提升约50%,并能够脱离手机独立运行,典型场景下续航时间可超12小时续航。
移远通信
WAIC现场,移远通信带来了Hawk系列自研一体化光波导轻量化AI+AR眼镜参考设计、自研分体式BirdBath AR眼镜参考设计、Dolphin系列自研AI+AR算力单元三款XR解决方案。
其中,AI+AR眼镜Hawk系列包含光波导和BirdBath眼镜,光波导眼镜拥有“高通第一代骁龙AR1平台+物奇微WQ7036”和“酷芯微ARS45+物奇微WQ7036”两款架构选型,客户可根据场景和成本需求,灵活选择。此外,这款光波导眼镜创新支持三档电致变色,镜片可根据环境光线自动调节透光度,有效解决AR眼镜室内外切换时显示效果差异明显的痛点。

BirdBath AR眼镜参考设计则强调沉浸式视觉体验,FOV达50±1°,单眼分辨率为1920×1080,支持60至120fps刷新率,同样配备3档电致变色和0至400度屈光度调节功能。Dolphin系列AI+AR算力单元基于高通跃龙™ Q-6690和QCS8550两大平台,分为5G端云融合版和端侧算力版。
投稿/爆料:tougao@youxituoluo.com
稿件/商务合作: 林南(微信 19250561593) 六六(微信 13138755620)
加入行业交流群:林南(微信 19250561593)
版权申明:本文为VR陀螺原创,任何第三方未经授权不得转载。如需转载请联系微信:vrtuoluo233 申请授权,并在转载时保留转载来源、作者以及原文链接信息,不得擅自更改内容,违规转载法律必究。文中有图片、视频素材来自互联网或无法核实出处,如涉及版权问题,请联系本网站协商处理。
元宇宙数字产业服务平台
下载「陀螺科技」APP,获取前沿深度元宇宙讯息