一张照片就能“捏”出有形象、能对话的AI玩伴,京东旗下的JoyAI App近日上线的UGC数字人功能,把原本属于大厂秀肌肉的数字人技术,变成了普通用户触手可及的玩具。用户只需上传一张正面照片,系统即可自动生成专属虚拟数字分身,支持一键复刻写实形象,或通过预制模板将本人面貌重塑为二次元卡通风格。搭配用户自己的语音,即可解锁“专属陪伴”模式——无论是闲聊、倾诉,还是点外卖、查金融、学英语、规划行程,数字人都能以全双工对话的方式即时响应。
这项功能的背后,是JoyAI自研的“万能博士”技术底座。该底座集成了语言大模型、语音大模型和数字人大模型,实现了行业领先的实时全双工交互——用户与数字人的对话可以随时打断、自然接话,而不像传统语音助手那样需要等待一段话说完再触发回答。从技术原理看,这相当于将文本对话、语音合成与3D面部驱动在实时推理管道中完成端到端联动,对延迟和模型协调能力提出了较高要求。JoyAI团队在推荐理由中自称“传一张照片就能捏的大众玩具”,坦率承认其核心并非硬核突破,而是将现有技术打包为低门槛产品。
当前数字人赛道正从PGC(专业生产内容)向UGC(用户生成内容)快速演进。此前,AI数字人主要服务于直播带货、虚拟偶像等商业场景,用户很难低成本“捏”出一个属于自己的替身。JoyAI这一步,实际上是将数字人的“形象自定义”和“语音自定义”两个维度同时开放给C端,再结合预训练的通用对话能力与生活服务工具链,试图解决“有形象但不会说话”“能说话但长得不像我”的旧问题。然而,与市面上已有的“一键生成数字分身”类产品(如HeyGen、Synthesia等)相比,JoyAI的特色在于其内嵌的全双工对话引擎和即时生活服务集成,而非单纯的形象克隆。
对于普通用户,这项功能的最大价值在于“零门槛上手即用”。不需要学习任何AI工具,拍张照片、录一句语音,就能获得一个随时待命的虚拟玩伴。它既是情绪陪伴者,也是生活助手——可以陪你吐槽,也能帮你叫外卖。不过,从行业角度看,该功能并未在数字人底层技术上带来代际突破。形象克隆的精度、对话连贯性、服务场景覆盖深度仍有改进空间。用户对“专属感”的持久需求,将倒逼JoyAI在模型个性化、长期记忆和多模态交互上持续进化。
对京东而言,JoyAI可以视为其AI能力面向消费者场景的一次重要落地。数字人+全双工语音+生活服务,三者结合有望在电商辅助、智能客服、家庭陪伴等领域形成差异化竞争力。短期来看,这种“捏”出来的AI玩伴更适合尝鲜用户和轻度场景;长期而言,谁能真正让数字人记住你的习惯、理解你的情绪、主动为你服务,谁才能在C端数字人赛道中跑出来。目前,JoyAI已经迈出了“让每个人拥有一个数字自己”的第一步,接下来的关键,是让这个“自己”真正学会陪伴。