<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:content="http://purl.org/rss/1.0/modules/content/"><channel><title>安全 on AI 实战派 · 从技术到赚钱</title><link>https://guijiagi.com/categories/%E5%AE%89%E5%85%A8/</link><description>Recent content in 安全 on AI 实战派 · 从技术到赚钱</description><generator>Hugo</generator><language>zh-cn</language><copyright>本站内容采用 CC BY-NC-SA 4.0 国际许可协议授权</copyright><lastBuildDate>Wed, 07 Oct 2026 17:42:00 +0800</lastBuildDate><atom:link href="https://guijiagi.com/categories/%E5%AE%89%E5%85%A8/index.xml" rel="self" type="application/rss+xml"/><item><title>模型供应链攻击：一个恶意权重文件能有多危险</title><link>https://guijiagi.com/posts/2026-10-07-ai-model-supply-chain-attack/</link><pubDate>Wed, 07 Oct 2026 17:42:00 +0800</pubDate><guid>https://guijiagi.com/posts/2026-10-07-ai-model-supply-chain-attack/</guid><description>PyTorch pickle 反序列化漏洞、投毒模型、被篡改的 LoRA 适配器。拆解 AI 时代的供应链风险与防御底线。</description></item><item><title>训练数据抽取：大模型到底记住了什么</title><link>https://guijiagi.com/posts/2026-10-07-training-data-extraction-leakage/</link><pubDate>Wed, 07 Oct 2026 17:36:00 +0800</pubDate><guid>https://guijiagi.com/posts/2026-10-07-training-data-extraction-leakage/</guid><description>Carlini 等人证明大模型会逐字复述训练语料。拆解记忆与泛化的边界，以及隐私数据如何从权重里被「钓」出来。</description></item><item><title>越狱研究：从人工词到 GCG 自动攻击，对齐防线如何被击穿</title><link>https://guijiagi.com/posts/2026-10-07-llm-jailbreak-gcg-autodan/</link><pubDate>Wed, 07 Oct 2026 17:30:00 +0800</pubDate><guid>https://guijiagi.com/posts/2026-10-07-llm-jailbreak-gcg-autodan/</guid><description>GCG、AutoDAN 这类自动越狱方法用优化找出模型看不见的后缀。拆解越狱的攻击机理与对齐研究的军备竞赛。</description></item><item><title>提示注入攻防：当用户输入变成对系统的篡改</title><link>https://guijiagi.com/posts/2026-10-07-prompt-injection-attack-defense/</link><pubDate>Wed, 07 Oct 2026 17:24:00 +0800</pubDate><guid>https://guijiagi.com/posts/2026-10-07-prompt-injection-attack-defense/</guid><description>间接提示注入能让检索到的网页、文件内容劫持 Agent。拆解攻击路径、为什么难防，以及纵深防御的现实手段。</description></item></channel></rss>