AWS推出CloudWatch Omni统一AI智能体可观测性
AWS发布CloudWatch Omni,将AI Agent、应用与基础设施遥测数据整合至统一平台。新工具支持LangGraph、CrewAI等主流Agent框架,可通过自然语言查询和内置AI助手自动定位根因,现有Clo...
AWS发布CloudWatch Omni,将AI Agent、应用与基础设施遥测数据整合至统一平台。新工具支持LangGraph、CrewAI等主流Agent框架,可通过自然语言查询和内置AI助手自动定位根因,现有Clo...
本文解读ENOKI框架:通过将AI回答拆解为可验证的文本锚定事实三元组,实现幻觉检测中claim级验证与span级定位的统一,支持大模型、规则、编码器三种引擎按需切换,并配套发布ENOKIQA双粒度数据集。
ShallowStream提出只用大模型浅层建立视频流检索索引,深层仅对检索命中的证据激活,在保持流式视频理解准确率的同时,把单帧预填充和端到端延迟分别降低最多52.1倍和11.9倍。
MIT研究人员借助AI算法优化脂质纳米粒子(LNP)配方,使mRNA疫苗可在室温下稳定储存长达一年,或在约38摄氏度环境中保存两个月,免疫效果与原版Moderna疫苗相当,有望解决RNA疫苗依赖超低温冷链的难题。
随着AI与异构集成需求驱动封装体积增大、层数增加、布线精密化,基板正从通用产品演变为面向特定应用的专用方案。供应商即便有产能,也未必能满足特定架构的良率与工艺窗口要求,基板选择正提前至系统架构设计阶段。
NVIDIA发布开源运行时框架OpenShell 0.1.0,通过沙箱执行、凭据管理和策略分析,对AI智能体的系统访问权限实施强制管控。Cadence、Slack、Gecko Robotics已率先采用,支持企业自动化、...
NVIDIA推出开放式AI智能体安全平台,包含OpenShell沙箱运行时和BlueField硬件级监控组件Sentry,通过带外策略执行与实时行为检测,为自主AI智能体提供独立安全控制层。
Capital One企业AI副总裁Rashmi Shetty指出,推进智能体AI须优先构建稳健的数据基础与平台优先架构,在部署应用前完成治理与安全合规设计。该行已将智能体AI用于汽车购买助手及内部客服等场景,并强调可观...
NASA已在火星探测器、国际空间站和卫星上测试生成式AI,探索让航天器自主规划任务的可能性。研究人员认为,随着深空任务通信延迟加剧、任务数量增多,不确定性推理能力将成为航天器必备能力。
Citrix发布补丁修复NetScaler ADC和Gateway中两个CVSS评分9.5的严重零日漏洞(CVE-2026-88771、CVE-2026-88772),均可被未授权攻击者远程执行任意代码,CISA已将其列...
AI工具降低了创建仿冒网站的门槛,谷歌指控网络犯罪分子利用AI生成150万个恶意URL。文章指出,企业需将域名视为品牌资产而非技术工具,通过监控仿冒域名、定期审计域名组合、跨扩展名注册品牌域名等策略,在AI驱动的互联网环...
文章指出,医疗机构在暂停AI工具时面临隐性成本,包括人员替代、数据衔接与业务连续性保障。作者建议将中断演练纳入采购评估,要求供应商明确停机后的容量、责任分配与恢复流程,以确保关闭AI的权力能够真正落地执行。
沃尔沃自动驾驶解决方案(VAS)宣布,其部署于瑞典和挪威矿场的自动驾驶重型卡车车队已累计自主运输300万吨矿石,超越2025年原定100万吨目标,标志着无人驾驶采矿运输技术迈入商业成熟阶段。
RAND Health发布综述显示,生成式AI使用与青少年抑郁、焦虑、饮食障碍及自杀倾向等心理健康问题存在关联,依赖性使用在有精神科基础疾病的青少年中风险更高,但现有证据多为横断面研究,因果关系尚待纵向研究验证。
本文介绍OR-Clarify基准与InterOPT框架,研究AI在运筹优化建模前能否主动识别信息缺口并澄清,而非默默假设。InterOPT分两阶段追踪缺口并决策提问,选择题模式下恢复率大幅领先,开放式模式仍存在提前收工的...
针对自动驾驶和机器人常见的视觉定位难题,提出AdaptVPR框架,用AI生成同一地点不同天气遮挡的困难训练样本,并配合几何验证机制过滤不合格图片,在多个基准上显著提升识别准确率。
AllSpark团队推出Iris-mini与Iris-pro搜索智能体,通过网页超链接反向构造多跳难题、双重过滤训练数据、结合强化学习与上下文管理,在BrowseComp等四大基准上取得开源模型最佳成绩。
谷歌团队推出MaxKernel,一套用大语言模型配合真实编译反馈自动生成TPU硬件内核的多智能体系统。它支持人机协作、全自动优化、图搜索三种模式,在JaxBench基准上实现1.58倍加速,部分任务甚至超越人类专家手工调...
大模型修bug时常把代码改得面目全非。研究者用400道注入bug的编程题构建评测框架,发现顶级模型普遍存在过度编辑现象,提示词能显著缓解,强化学习则能让模型学会更持久的克制编辑习惯。
RISE是一种让大模型用自身强化学习训练轨迹外推出"未来教师",再逐字蒸馏回当前模型的训练方法。无需外部模型或答案提示,在数学、理科、代码、智能体任务上全面超越RLVR训练和已有自蒸馏方法,且额外计算开销仅1.3到1.6...