@Unc1e UNC.LA
你好,我是 @Unc1e。
做网络安全,也写一点工程实践、工作和生活。
这里是我的个人主页。文章认真写,项目慢慢做;偶尔也放一些自己觉得有意思的小东西。
研究来源本文的起点是 Liu et al. 的论文 Beyond the Prompt: Jailbreaking Function-Calling LLMs via Simulated Moderation Traces(arXiv 2607.00481)。SMT 即 Simulated Moderation Traces,模拟审核轨迹:针对带工具调用能力的商用大模型的多轮越狱手法。本文使用的基线 harness 来自论文配套的实现仓库。 ...
一个报表产品同时接入 PostgreSQL 和 SQL Server。用户要查“金额超过 100 元的订单,按编号倒序取前 10 条”,系统就要生成两种 SQL。 把自然语言需求转成 SQL,通常叫 NL2SQL(Natural Language to SQL)。当产品接入多个数据库时,可以先确定查询含义,再转换成各自的 SQL 方言。本文关注的就是后一步。 ...
凌晨一点半,你放下手机。十分钟前你只打算「刷一会儿」,现在脖子是僵的,眼睛是干的,心里有点空。刚才那一个多小时,好像什么都没留下。 ...
研究来源本文的研究起点是 Liang、Li、Yu 于 2024 年提交的论文 Universal and Context-Independent Triggers for Precise Control of LLM Outputs,以及腾讯玄武实验室在 Black Hat USA 2025 公开的 Agent RCE 演示。GCG 与更早的 UAT 谱系分别来自 Zou et al. 2023 和 Wallace et al. 2019。 ...
来源AAAI 2026 标题An LLM-based Quantitative Framework for Evaluating High-Stealthy Backdoor Risks in OSS Supply Chains 作者Zihe Yan, Kai Luo, et al. (SJTU / Tsinghua / Tencent Xuanwu Lab) 原文arXiv:2511.13341 DOI10.1609/aaai.v40i2.37116 代码github.com/XuanwuLab/HSBRiskEvaluator 适合读者做供应链安全、Linux 发行版依赖治理、红队目标选择的人 简介从攻击者视角把高隐蔽后门拆成四步,用 APT 依赖、GitHub 社区行为和 LLM 语义评估给仓库打 HSBR 分。在 Debian 66 个高优先级 GitHub 仓库上验证,并用 xz 回放。 ...
逆向 Claude Code Auto 模式:每次工具调用前的 64 个 token 安全防线 Claude Code 的 auto 模式从 8 月 14 日起成了 Pro、Max、Team 新会话的默认权限档。我想搞清楚它到底靠什么防止 agent 干出格的事。 ...
我拆开 Burp AT 的 jar,本来想找一样东西:它把 GPT 的客户端藏哪了。 找了半天,答案是——没藏,因为压根不存在。 ...
一个数字,一开始是没有重量的。直到我把它换算成"东西"。 ...
这是一页关于汉字字体调性与屏幕科学的交互式小抄。 你可以在页面里试试字号滑块、行距实验,以及“一键换魂”字体彩蛋: 打开单页:字有脾气 · 汉字字体调性与屏幕科学 ...
最近AI红队是越做越多了,有一半时间在想怎么打 Agent,另一半时间在想: 真要落地防护,应该长什么样(打完了,怎么防?) 我自己写过一个本地优先的 Agent Runtime Guard(ARG),也拆了下微软刚开源的 Agent Governance Toolkit(AGT)。拆完之后,判断其实挺清楚: ...