新增 Moments 板块

详细记录如何在 Hugo + PaperMod 主题中添加Moments板块,包括内容目录创建、自定义布局编写、首页按钮配置以及发布注意事项。

April 3, 2026 · 2 min · 283 words · Bob

多智能体通信攻击-3

本文研究了在协作场景中,恶意代理如何利用辩论影响其他智能体的决策。提出了一种评估尺度来衡量恶意代理的有效性,并介绍了基于说服力和推理增强的方法来进行防御。实验结果表明这些方法可以有效减少攻击者的影响。

April 1, 2026 · 5 min · 959 words · Bob

多智能体通信攻击-2

该文章研究了多智能体协作系统在存在恶意或故障的智能体时的弹性。作者提出了两种方法:AUTOTRANSFORM和AUTOINJECT,以增强系统的安全性并提高其对单节点故障的抵抗能力。通过实验,探究了不同结构(线性、平面和分层)和下游任务对多智能体协作系统弹性和抗干扰的影响。

March 30, 2026 · 1 min · 142 words · Bob

越狱攻击-1

本文提出了一种名为PathSeeker的新型黑盒大语言模型越狱攻击方法,通过多智能体强化学习和基于词汇丰富度的奖励机制,在不依赖代理模型生成有害参考答案的前提下突破LLM的安全对齐防御。

March 25, 2026 · 3 min · 533 words · Bob

多智能体通信攻击-1

这篇论文研究了大型语言模型(LLM)为基础的多智能体系统(MAS),特别是在通信攻击方面。作者介绍了一些相关的背景知识和现有方法,并提出了一种新的通过通信攻击来评估系统的策略。该论文还讨论了在多智能体系统中使用大型语言模型的安全问题以及可能的解决方案。

March 23, 2026 · 5 min · 1000 words · Bob

对抗攻击-1

本文讨论了神经网络的可解释性和鲁棒性问题,并通过引入自然基和随机基两个公式证明了单个高层神经元无法对应具体语义信息。此外,介绍了对抗样本的概念及其构造方法。文章指出神经网络具有高表达能力但低可解释性和低鲁棒性。

March 21, 2026 · 1 min · 74 words · Bob

软工-3-Software Architecture Recovery Augmented With Semantics

摘要内容

March 18, 2026 · 1 min · 28 words · Bob

数据库安全指南

该博客文章讨论了多人操控同一数据库的开发场景,以及相关的安全风险和防御措施。作者建议使用单独设置公网数据库账号、最小权限化并修改默认端口等方法来提高安全性,并给出了具体的SQL代码示例。同时,还介绍了封IP的方法以防止恶意攻击者。

March 17, 2026 · 1 min · 157 words · Bob

LLM-Agent 安全-1

本文介绍了针对LLM代理的安全分类方法和对抗攻击。提出了AgentDojo、ARE、CheatAgent等评估框架,并讨论了GIGA攻击方法及其应用,旨在提高大模型在各种任务中的可靠性和安全性。

March 16, 2026 · 4 min · 822 words · Bob

软工-2

本文研究了软件结构重构,分析了3468条帖子以确定常见的重构类型和最常导致重构的结构问题。同时总结了开发者面临的六种常见风险,并探索了解决方案以及潜在危害。通过人工筛选和移除重复答案得到合格帖子的数据集,并收集其浏览量、评分等信息进行进一步分析。

March 15, 2026 · 2 min · 261 words · Bob
微信二维码

扫一扫,加我微信