上海AI Lab开源AgentDoG:给Agent装诊断式护栏
AI Agent现在能干的事越来越多了。读文件、写代码、调API、执行shell命令——不再只是聊天,是真的在操作。但问题来了:如果Agent在执行过程中某一步出了问题,现有的安全系统能发现吗?答案是
阅读全文AI Agent现在能干的事越来越多了。读文件、写代码、调API、执行shell命令——不再只是聊天,是真的在操作。但问题来了:如果Agent在执行过程中某一步出了问题,现有的安全系统能发现吗?答案是
阅读全文Claude Code上线之后,很多人开始让AI直接操作自己的项目。改bug、重构代码、跑测试——AI不只是聊天了,它在执行shell命令。港大、山大、CMU和NUS的几个人觉得这事不对劲:如果AI能
阅读全文RAG系统正在大规模落地,从搜索引擎到企业知识库,从智能客服到决策支持,几乎所有需要实时知识的AI应用都在依赖检索增强生成。这个架构的核心逻辑很简单:用户提问后,系统先从外部知识库检索相关文档,再把检
阅读全文来源 | 智合标准化建设作者 | 智合标准中心2026年5月,中央网信办发布“清朗·整治AI应用乱象”专项行动首批典型案例,集中曝光利用AI生成虚假新闻、深度伪造人脸实施诈骗等典型违规行为。这是继AI
阅读全文每年一到攻防演练季,防守侧就开始焦虑。攻击队准备了几个月,防守队往往只有几周准备时间。今年更麻烦的是,AI Agent进了业务系统,攻击面变了,传统的防守思路不够用了。360数字安全集团刚发了一份20
阅读全文你有没有想过一个问题:你和AI的每一次对话,它都记住了什么?别急着说“无所谓”。如果这些记忆里混进了黑客植入的东西呢?更可怕的是,AI会把记忆里的“毒药”当成事实,在未来的每一次交互中,不自觉地按照黑
阅读全文Agent(智能体)正在从"会聊天"进化到"会做事"。它能读邮件、写代码、调API、操作数据库——但这也意味着,一旦Agent被攻破,损失不再是一段对话记录,而是真实的业务数据和系统权限。清华大学清新
阅读全文做威胁情报分析最烦的环节是什么?拿到一份安全事件报告,通读全文,然后手动把里面的攻击手法一个个映射到MITRE ATT&CK矩阵上,再对比已知APT组织的TTP档案做归因。这个过程,熟练的分析师也要花
阅读全文传统蠕虫有个致命弱点:它只会一种打法。WannaCry靠EternalBlue一个漏洞横扫全球,微软出了补丁,传播就停了。打补丁就能防住,这是过去四十年网络防御的基本逻辑。多伦多大学CleverHan
阅读全文Docker镜像的安全扫描工具不少,Trivy、Hadolint、Docker Scout……但有个问题一直没解决:扫出来的CVE列表谁看得懂?一个中等规模的Dockerfile,Trivy能扫出20
阅读全文卡巴斯基发了2026安全报告。报告数据来自MDR、事件响应、损害评估、SOC咨询,覆盖2021到2025年。我挑几个重点说。好消息和坏消息高严重性事件从2021年的14.3%降到了2025年的3.8%
阅读全文GitHub上有一个仓库,113,000个Star。什么概念?Vue.js是48K,React是230K,PyTorch是85K。它比PyTorch还高。这个仓库叫awesome-llm-apps,作
阅读全文2026年5月14日至16日,全球顶级黑客竞赛Pwn2Own Berlin在柏林OffensiveCon大会期间举行。本届比赛创下两项历史纪录:47个唯一零日漏洞被现场攻破,总奖金发放1,298,25
阅读全文传统渗透测试的流程:找安全公司→报价几万到十几万→等几周→拿到一份PDF报告。Strix把这个流程压缩到几小时,而且不需要安全专家在场。GitHub 25.7K Star,每天运行1300+次渗透测试
阅读全文做PPT是职场人的永恒痛点。传统工具要么太丑,要么太贵,要么太复杂。最近发现一个叫 html-ppt-skill 的开源项目,一行 npx skills add 装好,任何支持 AgentSkill
阅读全文5月27日和28日,荷兰警方和国家网络安全中心NCSC-NL先后发了公告。我第一眼盯住的是那个数字。1700万。被控制的设备数量。荷兰全国人口大约1750万。被卷进去的设备数量,跟整个荷兰的人口差不多
阅读全文最近发现一个有意思的开源项目——DeepSeek-Reasonix。它是一个专门为 DeepSeek API 优化的终端 AI 编程代理,MIT 开源许可证,目前 GitHub 已获得 14,600+
阅读全文近日,Anthropic发布了Project Glasswing(玻璃翼计划)的首份进展报告。这份报告披露了一组让安全行业坐不住的数字:他们用尚未公开发布的Claude Mythos Preview模
阅读全文5月26日,安全研究团队 Adversa AI 披露了一种名为 SymJack 的攻击技术。一个精心构造的恶意仓库,可以让 AI 编程助手在开发者点击"批准"的瞬间,把自己的配置文件替换成攻击者控制的
阅读全文2026年2月,图灵奖得主Yoshua Bengio牵头发布了一份报告。100多位专家、30多个国家参与,名字叫《2026年国际人工智能安全报告》——目前全球最权威的AI安全评估。它的核心判断很直接:
阅读全文又是一次刷新记录的供应链攻击。5月18日,一个代号"巨齿鲨"(Megalodon)的自动化攻击行动,在6小时内向GitHub推送了5718个恶意提交,感染了5561个代码仓库。攻击者不需要盗你的账号—
阅读全文最近一周AI圈子不太平。PraisonAI、Ollama、OpenClaw、Claude Code,几个主流AI编程工具接连曝出严重漏洞。最夸张的是PraisonAI——官方5月11日下午发布安全公告
阅读全文5月19日到20日,法国和荷兰牵头,18个国家同步动手,关掉了一个叫 First VPN 的服务。这不是普通的VPN。它专门卖给网络犯罪分子用,勒索软件团伙靠它隐藏身份,至少25个勒索组织是它的客户。
阅读全文你用ChatGPT、Claude这些AI的时候,有没有想过一个问题:为什么同一个系统提示词、同一份文档,你每次提问都要重新"喂"给模型?模型是不是每次都在重新读一遍?答案是:技术上确实在重新计算,但A
阅读全文以前做渗透测试,终端开七八个窗口,nmap扫端口、gobuster爆破目录、nuclei跑漏洞模板,每个工具单独敲命令、等结果、再决定下一步。现在我在AI对话框里打一句话,150个安全工具自己排着队干
阅读全文如果AI系统被用来协助AI安全研究,它会不会偷偷搞破坏?比如故意让安全测试结果看起来比实际更好,或者在代码里埋雷?英国AI安全研究所(UK AISI)最近发布了一篇论文,专门测试了Claude系列模型
阅读全文Agent 很热闹,生产现场很骨感过去一年,几乎每个团队都做过 AI Agent。一个输入框,一个大模型,几个工具,一段写得很漂亮的 System Prompt,再配上一个炫酷的前端,看起来就像
阅读全文苹果花了5年、几十亿美元打造的MIE内存保护系统,被一家安全公司用Anthropic的AI模型5天攻破。近日,《华尔街日报》披露了一则震惊安全圈的消息:安全公司Calif的研究人员使用Anthropi
阅读全文最近,360漏洞研究院发布了一份关于OpenClaw生态的安全分析报告。这次审计没有走传统人工渗透的老路,360引入了一个自研的"漏洞挖掘智能体",用Agent对抗Agent的方式,对OpenClaw
阅读全文2026年5月,算泥社区发布了一份《Agent Skills技术与安全白皮书》,系统梳理了AI Agent技能体系的技术架构、攻击方法和防御方案。目前国内聚焦Agent Skills安全的公开研究不多
阅读全文