清华大学如何让AI训练像流水线一样高效?单轮异步优化让大模型学习不再"等人"
清华大学提出单轮异步强化学习方法SAO,用单条数据替代组批训练,配合双边裁剪与价值模型优化,使大模型训练稳定超1000步并刷新数学编程多项基准。
清华大学提出单轮异步强化学习方法SAO,用单条数据替代组批训练,配合双边裁剪与价值模型优化,使大模型训练稳定超1000步并刷新数学编程多项基准。
据GM Authority援引知情人士消息,通用汽车正考虑通过与上汽合资的五菱品牌,将五菱缤果Pro紧凑型电动车重新贴牌为雪佛兰,推向全球重点市场,以期尽快向经销商提供更实惠的电动车选择。若加拿大被列入目标市场,北美消费...
Meta FAIR提出SDM架构,通过稀疏寻址将线性RNN的记忆容量提升千倍,在不增加计算量的前提下大幅改善长文本检索与知识推理能力。
上海AI实验室等机构开发的SciReasoner,是首个能同时处理蛋白质、分子和晶体结构,并生成可检验推理轨迹的科学基础模型,在86个基准测试中67项达到最佳。
这项由欧洲多所大学联合完成的研究,通过数据收集、持续预训练和微调,成功为极度小众的Pharo编程语言打造出可在普通电脑实时运行的AI代码补全工具,小模型性能超越参数量数百倍的通用大模型。
英伟达CEO黄仁勋于7月15至16日访问东京,达成涵盖日本整个科技生态的系列协议:包括国家级AI工厂Noetra项目(日本政府承诺5年投入1万亿日元)、与发那科、川崎重工、索尼等顶级机器人企业的Cosmos模型合作,以及...
LaMem-VLA是南京理工大学等三所高校提出的双重记忆机器人框架,通过将短期视觉记忆和长期语义记忆融入模型推理过程,显著提升机器人执行长程任务的成功率。
京东氧气AI商品中台(Oxygen AIIC)通过大语言模型与视觉语言模型,构建了覆盖千亿级商品知识资产的全链路生产与服务系统,将商品信息丰富度提升至3.35倍。
KAIST等机构提出LLM-as-a-Tutor框架,通过动态追加题目条件,让AI强化学习训练中的难度随模型能力自动升级,解决题目过易导致学习信号失效的问题。
今天讲的出海案例是龙磁科技,这家磁性材料与芯片电感企业拟投3.584565亿元建设越南二期,新增1万吨湿压磁瓦和2.5万吨预烧料产能。
研华持续推进“Edge Computing + AI-Powered WISE Solutions”战略,聚焦工业AI应用层,以边缘智算为基础,以全栈软硬件协同为能力支撑,推动AI从单点应用走向业务闭环。
这项来自明尼苏达大学等机构的研究发现,大语言模型在强化学习后训练中,只需训练中间少数几层即可匹配甚至超越全参数训练效果,且这一规律跨模型、跨任务高度稳定,为更高效的AI训练策略提供了新思路。