你一定见过这样的画面:在拥挤的街头,视障朋友小心翼翼地探出盲杖,或者不得不一次次向路人开口求助:“请问,前面的路该怎么走?”
这种“必须不断提问才能获得片刻安心”的困境,在AI时代有可能成为历史。在9月9日的京东全球科技探索者大会上,京东展示了一款接入JoyAI-VL-Interaction全模态交互模型的AI眼镜,就展现了这一可能。
这款AI眼镜不是普通的问答机器——而是学会了及时发现和自主判断。JoyAI-VL-Interaction让它主动“看见”危险:当用户走到路口,它不再等待“前面有车吗”这句提问,而是像一个警觉的同伴,在车辆靠近时主动低声提醒:“注意,左后方有电动车正在接近。”
它会判断“什么时候该说话”:面对连续发生的车流、台阶和行人,它能区分哪些是背景噪音,哪些是紧急事件。它知道在平稳路段保持安静,只在关键时刻“开口”,既不聒噪,也不缺席。
它有“背后智囊团”支持:遇到复杂的路线规划,它会默默联动后台的Agent智能体来处理,自己则继续专注于观察眼前的路,两不耽误。 简单说,它把AI从“你问我才答”的客服,变成了一位知冷暖、懂时机的生活守护者。
公开评测显示,在覆盖监控预警、实时计数、实时翻译、时间感知、直播导览等58项真实流式场景的真人盲评中,JoyAI-VL-Interaction对比豆包视频通话助手总体胜率为77.6%,对比Gemini视频通话助手总体胜率为87.9%,在针对流式视频的实时理解、主动回复与长程记忆方面达到世界顶级水平。
京东这款JoyAI-VL-Interaction全模态模型已全栈开源。从一副AI眼镜出发,京东正在尝试让大模型走向真实世界中的持续感知与自主交互。JDD期间,京东JoyAI基础模型矩阵进一步升级,持续推动AI从数字世界迈向物理世界,探索让模型能力进入更多真实生产生活场景。
4001102288 欢迎批评指正
All Rights Reserved 新浪公司 版权所有