LightNav-0:一个只用一个摄像头就能指挥四种机器人的导航大脑
一篇讲述通用导航AI模型LightNav-0的深度解读:如何用单一视觉语言模型,靠指点和动作分词技术,同时搞定指令跟随、找物体、跟踪目标三类任务,还能零成本换装到不同机器人身体上。
一篇讲述通用导航AI模型LightNav-0的深度解读:如何用单一视觉语言模型,靠指点和动作分词技术,同时搞定指令跟随、找物体、跟踪目标三类任务,还能零成本换装到不同机器人身体上。
9月10日,知名AI算力产业研究机构科智咨询联合全球算力服务平台算力海洋即将正式发布《中国词元工厂发展白皮书(2026)》(以下简称白皮书)。
论文提出Super Library Agent问题,让AI智能体顺序生成多个相关应用时同步维护共享库。通过摘要匹配的候选提取和调用图辅助迁移,在减少代码冗余和维护成本的同时保持功能完整,实验覆盖WebGen-Bench与...
近日,由中科曙光牵头、中国电子技术标准化研究院等20多家单位共同参与编制的三项行业标准——《高性能计算机刀片服务器计算刀片电气技术规范》(SJ/T 11719-2026)、《高性能计算机刀片服务器计算刀片机械技术规范》(...
当用户获取信息的方式从“翻网页”变为“问AI”,品牌被大模型理解、引用与推荐的能力,正成为影响市场认知的新坐标。在这场从链接排名向共识塑造的转变中,生成式引擎优化(GEO)已从早期概念演变为品牌数字化布局的重要组成部分。
苹果推出折叠屏手机iPhone Duo,搭载A20 Pro芯片,钛金属机身,采用无折痕多层折叠屏设计,256GB版本起售价1999美元,10月23日发货。
MIT团队开发出磁激活可注射纳米天线HITMAN,能选择性杀灭耐药性胶质母细胞瘤细胞,动物实验显示可延长生存期且无明显毒副作用。
要判断一套系统是否称得上 AI Scientist,有两个核心的条件:第一,实验开始前,问题没有现成答案。第二,实验结束后,系统是否能够通过实验给出能指导后续研究的新结论——Sapient Intelligence 联合...
本文解读了PRISK评测框架的研究成果,揭示了13个主流大模型在个性化过程中普遍存在的三类风险:无关信息注入、答案选项收窄、以及对用户观点的过度讨好,并分析了背后的成因与应对局限。
未来的智能体不会被限定在单一环境中,围绕同一个目标,在云、边缘和物理设备之间协同运行,完成一整套跨环境任务。这也构成了Arm Everywhere China的三条主线:边缘AI、物理AI和云AI。
上海交大团队构建150万条五级安全标注的多模态数据集SafeAtlas-VL,训练出能同时判断图像、请求、回答风险等级并输出连续分数的SafeAtlas Guard模型,8B版本F1超越现有最强基线约4个百分点。
论文提出SHAPE框架,借数学教育学的语义空间与启发式概念,拆解AI解题的思维轨迹,发现策略比表面特征更能预测答案对错,且RL后训练会让策略使用趋于收窄,启发式提示可提升训练效果。
论文提出图像捆绑组合IBC新范式,突破传统逐张打分检索局限,构建IBCBench基准数据集,并提出BundleWeaver智能体框架实现动态照片组合检索,精确匹配率大幅超越现有方法。
研究者搭建3D游戏环境MineAmongUs,让AI在《among us》中同时展现语言和肢体欺骗行为,归纳出23种骗术并验证:非语言的伪装与杀人时机把控,比编造谎言更能决定胜负。
论文提出VAT训练框架,通过模拟验证过程和动态权重分配,让投机解码的草稿模型学会预判自身是否会被目标模型拒绝,在EAGLE-3和DFlash上实现最高11.4%接受长度提升和8.7%推理加速,且无需改动模型架构。
NVIDIA发布CUDA Toolkit 13.4,新增Windows on Arm支持、Rubin架构预览、MPS V3及CCCL 3.4等多项GPU开发与性能优化功能。
NVIDIA介绍Dynamo框架的Encode-Prefill-Decode解耦技术,在图像密集、短中等输出及量化MoE模型场景下可将首token延迟降低最高5倍,端到端响应提速最高7倍。