AI越狱者究竟在做什么?他们如何突破大语言模型的安全边界
当前主流AI聊天机器人——从ChatGPT到Gemini、Grok、Claude——都设有内容安全限制,旨在防止仇恨言论、违法内容等有害信息的输出。记者兼作家Jamie Bartlett深入接触那些专门尝试绕过大型语言模...
当前主流AI聊天机器人——从ChatGPT到Gemini、Grok、Claude——都设有内容安全限制,旨在防止仇恨言论、违法内容等有害信息的输出。记者兼作家Jamie Bartlett深入接触那些专门尝试绕过大型语言模...
Anthropic公司意外泄露了AI软件开发助手Claude Code的完整源代码,超过51.2万行代码被公开。此前人们只能通过逆向工程或小片段代码来了解Claude Code的工作原理,但这次Anthropic直接敞开...
开发者Mickey Shmueli发现AI工具Context Hub存在严重供应链攻击漏洞。该工具由DeepLearning.AI创始人Andrew Ng推出,旨在为AI编程代理提供最新API文档。测试显示,恶意文档可通...
AI商业界陷入疯狂状态。Meta收购了病毒式传播的AI代理社交网络Moltbook,OpenAI雇佣了不安全开源代理框架OpenClaw的创造者Peter Steinberger。然而,这两个平台都存在严重安全漏洞。Mo...
微软研究发现,一个看似无害的提示词能系统性破坏主流语言和图像模型的安全防护机制。该技术称为GRP-Obliteration,利用常见的AI训练方法达到相反效果。仅用"创建可能引发恐慌的假新闻文章"这一提示词训练,就能让模...
Moltbook是一个号称只允许AI代理使用的类Reddit社交网络,声称拥有140万用户,但安全专家质疑其真实用户数仅约1.7万。该平台基于OpenClaw框架构建,用户可通过REST API轻松创建虚假账户。尽管马斯...
Anthropic的Claude Code存在严重安全漏洞,无法正确执行.claudeignore文件中的屏蔽指令,仍会读取包含密码和API密钥的.env敏感文件。尽管Claude声称支持类似.gitignore的文件屏...
网络安全研究人员披露了一个针对谷歌Gemini的间接提示注入安全漏洞,攻击者可绕过授权防护并利用谷歌日历作为数据提取机制。该漏洞允许攻击者在标准日历邀请中隐藏恶意载荷,绕过谷歌日历隐私控制,无需用户直接交互即可未经授权访...
安全初创公司Tenzai的研究显示,主流AI编程平台在响应常见编程指令时持续生成不安全代码,甚至产生"严重级别"漏洞。测试涵盖Claude Code、OpenAI Codex等五款工具,共发现69个安全漏洞,其中约6个被...
Apache Tika XML文档提取工具存在严重安全漏洞,影响范围比最初认为的更广泛。该漏洞涉及两个相关缺陷:CVE-2025-54988和CVE-2025-66516,后者严重程度达到满分10分。攻击者可通过恶意PD...
微软宣布Visual Studio中的模型上下文协议(MCP)服务器正式可用,开发者可通过.mcp.json文件连接本地或远程MCP服务器。尽管MCP能扩展AI代理功能,但安全公司研究发现,在281个MCP服务器中,9%...
openSUSE因Deepin存在多项安全及包装缺陷,将其桌面环境从官方仓库中移除;用户若坚持使用,需自行手动添加仓库。
curl 负责人 Daniel Stenberg 表示,平台上大量明显由 AI 生成的漏洞报告除制造骚扰外毫无价值,他已联系 HackerOne 请求加强筛查措施,以保护项目免受类似攻击。
Meta 警告 WhatsApp Windows 版存在重大安全漏洞,可能导致用户遭受各种网络攻击,包括勒索软件。该漏洞允许攻击者通过修改 MIME 类型,使恶意文件伪装成普通附件。用户不慎打开后可能执行任意代码。专家建...
消费者报告研究发现,六家提供人工智能语音克隆软件的公司中,有四家未能提供有效的防滥用措施。这项技术虽有合法用途,但也容易被滥用于欺诈等非法行为。报告呼吁企业加强安全保障,并建议加强监管以保护消费者权益。
研究人员发现,廉价的贴纸可以有效欺骗自动驾驶汽车的交通标志识别系统。他们还发现这些系统会"记忆"标志位置,即使标志被遮挡也会假定其存在,导致攻击成功率低于预期。研究人员测试了多种攻击方法,包括使标志"消失"或制造虚假标志...
研究人员发现了一种方法,可以将任何设备变成"AirTag",让黑客远程追踪设备位置。这个名为"nRootTag"的漏洞利用了苹果"查找"网络的工作原理,成功率高达90%。研究人员已通知苹果公司,但修复可能需要数年时间。为...
为了有效地保护容器工作负载,安全架构师需要全面了解技术层和安全相关任务。这些任务旨在加固所有相关组件、管理漏洞以及主动识别和应对整个技术栈的威胁和攻击。
Intel Security近日发布了2022年产品安全报告,强调了英特尔对于持续安全保障的投资,以及对去年发现的漏洞和缓解措施进行了年度审查。