语音大模型已应用于语音助手、智能客服和人机交互等场景,其训练、微调和数据构建过程常依赖第三方平台或外部数据提供方,可能因数据与计算资源外包引入后门风险。现有研究表明,语音大模型对不同方言的理解存在显著偏差,该偏差可成为新型后门攻击面。针对方言差异引发的新型安全攻击隐患,本文开展了方言触发式语音大模型后门攻击的研究。该方法以目标方言语音作为触发条件,通过音频数据投毒与语音合成构建后门样本,使训练后的语音大模型在接收目标方言输入时生成毒性回答,从而实现方言驱动的精准歧视攻击。本文在多个数据集和主流语音大模型上进行了实验验证。实验结果显示,该方法在不同任务场景下均能取得较高攻击成功率,且对干净语音输入下的模型可用性影响有限。实验证实,方言触发后门攻击导致的精准歧视攻击具有可行性与严重的现实危害性,并揭示了语音大模型在外包训练、数据投毒和自然语言变体输入场景中的潜在安全风险。
针对现有深度伪造视频检测方法多停留于二分类判别、缺少检测证据支撑的问题,本文开展了基于关键视觉证据的深度伪造视频的可解释检测方法研究。实验从输入视频中提取多段连续片段的RGB(red green blue)帧与光流图,依托前端检测模型完成视频真伪判别,并采用Grad-CAM(gradient-weighted class activation mapping)算法生成RGB分支与光流分支热力图,用以表征图像静态伪造痕迹、视频运动不一致性及模型核心关注区域。在此基础上,结合帧级预测分数与双分支融合得分筛选代表性关键视觉证据,将RGB帧、RGB分支热力图、光流图、光流分支热力图作为4类视觉输入,支撑后续结构化解释文本生成与解释模型微调。为兼顾解释质量与部署成本,本文构建了“大模型标注、轻模型生成”的轻量化可解释检测框架。首先依托ChatGPT-5.4-High的强视觉理解能力,结合关键视觉证据与视频真实标签生成初始结构化解释文本,经人工校验筛选后形成高质量结构化解释标注数据集;再以该数据集为监督信号,采用LoRA(low-rank adaptation)微调方法优化Qwen-3.5-4B模型,使该轻量模型可基于检测结果与关键视觉证据,低成本生成格式规范、证据匹配、逻辑一致的结构化解释文本。实验结果表明,该方法可有效保留前端检测模型决策的独立性,解释一致性指标达到0.876。用户对模型输出结果的准确性、完整性与可理解性评价优良,各项评分介于4.75~4.89分(满分5分),可为深度伪造视频检测结果的分析与复核提供可靠依据。
针对图数据节点异常行为检测任务中存在的邻域噪声干扰、类别分布不平衡以及预测结果缺乏可靠性刻画的问题,本文提出一种基于自表示图神经网络的共形异常行为检测方法。首先,利用图神经网络在图结构上进行消息传递,学习融合节点属性与局部邻域信息的基础表征,获得初始判别结果。其次,在表示空间中构建节点间的核自表示关系,刻画潜在的结构性关联,并将重构关系引入分类过程,从而增强异常节点表征的可分性,同时利用重构系数与重构残差为异常判定提供结构依据。最后,在独立校准集上对模型输出结果进行共形校准,通过构造结构感知非一致性分数,为样本生成具备覆盖性保障的预测集合与不确定性量化信息。该机制能够支持高置信度异常告警、可疑样本复核和低风险样本筛除,从而提升异常检测结果的可靠性与可操作性。在多个公开异常行为图数据集上的实验结果表明,该方法能够有效提升异常类识别能力,增强预测结果的可靠性,并为评论欺诈、非法交易识别及账户异常检测等场景提供更稳健的技术支撑。
生成式文本隐写主要依托语言模型生成隐写文本,然而,现有方法多基于单一语料库训练模型、生成随机长度的隐写文本,导致隐写文本的风格与长度无法适配动态变化的消息类型与信道条件。因此,本文提出一种大语言模型辅助的智能文本隐写传输方法,可有效降低隐写文本的传输开销。首先,采用多类语料库对大语言模型开展参数微调,得到适配不同语料风格的适配器。在隐写阶段,依据微调后大语言模型输出的词元概率分布,通过自适应动态分组筛选词元,递归嵌入秘密信息。其次,本文设计了双智能体强化学习框架,结合实时信道状态、攻击成功率等安全指标,对语料库类型、输出句子长度及发射功率等进行自适应优化。该方法综合考量隐写安全需求与实际传输环境,构建奖励函数对所选策略进行优劣评估,以此指导隐写策略与发射功率的优选,实现隐蔽性与传输鲁棒性的动态平衡。实验结果表明,相较于采用自适应动态分组算法的传输方法,本文方法在保证嵌入率、信息散度基本一致的前提下,传输时延同比下降38.5%,且攻击成功率稳定在0.83%。
360°视频传输可为用户提供可交互的全景观看体验,但存在带宽占用高、传输时延大、恶意干扰等问题,严重降低用户体验质量。为此,本文提出一种基于强化学习的边缘辅助360°视频抗干扰传输技术,依托网络边缘的用户视口预测等信息,联合优化视频分块传输排序、功率分配与码率选择策略,以适配干扰、用户视口及网络环境的动态变化。本文设计轻量级多输出指针网络,对视频分块空间位置、信道增益、干扰强度等状态特征进行编码,通过注意力机制量化各视频分块的重要程度,在网络输出层实现抗干扰传输策略的联合优化选择。构建360°视频抗干扰传输博弈模型,分析斯塔克尔伯格均衡点的存在条件,推导得到用户体验质量的性能上界。实验结果表明,相较于基线技术,所提技术的视口体验质量提升约36.2%,功耗降低约15.3%,验证了该技术在动态干扰、视口及网络环境变化场景下的鲁棒性与有效性。
车载毫米波雷达由于其成本较低、不受光照、烟雾等恶劣环境影响的特点,在自动驾驶中得到广泛应用。然而,随着道路上车载雷达数量的增多以及频谱资源(77~81GHz)的稀缺性日益凸显,雷达间的相互干扰问题变得愈发严重,所产生的鬼影目标会降低雷达的灵敏度,显著提升虚警概率,从而严重威胁自动驾驶安全。针对这一问题,本文提出一种联合出发角—到达角—多普勒信息的多域联合鬼影目标去除方法。核心发现在于,干扰信号与目标回波存在非对称传播特性,即目标回波为往返传播,而干扰信号为单程传播。首先,本文在出发角—到达角域进行联合角度估计,利用干扰单程传播无出发角信息这一特点,实现干扰与目标回波在角度域的分离。对于位于零度角附近的鬼影目标,本文通过引入慢时间域伪随机编码,将其变换至多普勒域,再通过构建最大化信干噪比的优化模型将其去除。实验结果表明,所提方法能够有效去除雷达间干扰所产生的鬼影目标,提升雷达在复杂电磁环境下的感知可靠性。
深度学习技术发展迅速,深度神经网络模型已广泛应用于图像识别、自然语言处理等诸多领域。然而,深度神经网络模型的训练依赖大数据与计算资源,成本高昂,其知识产权保护问题日益凸显。因此,本文提出一种基于对抗样本的双重深度神经网络模型版权保护算法。该算法利用基于动量迭代的快速梯度符号法生成对抗样本,将水印信息嵌入对抗样本,并对模型进行重新训练;通过对抗样本与水印样本双重验证,实现模型版权的有效认证。该方案无须修改模型参数与结构,仅通过数据处理即可实现,操作简便实用,具备良好的鲁棒性。实验结果表明,该方案对高斯滤波、裁剪及压缩攻击具有较强的鲁棒性。
网站暗链检测面临巨大挑战,传统方法模型泛化能力不足、高度依赖特征工程,且检测结果缺乏可解释性。为更好地应对上述挑战,本文提出一种思维链提示驱动的大语言模型零样本暗链检测方法。该方法依托大语言模型自然语言理解与复杂推理能力,结合面向暗链检测场景设计的思维链提示策略,能够有效提升模型泛化能力,并输出检测结果解释。本文采用主客观指标量化评估模型性能,同时验证思维链提示策略在暗链检测中的有效性,具体指标包括准确率、精确率、召回率以及F1值。实验结果表明,该方法的F1值达到0.98,相较于基线方法性能更优。该研究为高质量数据集匮乏场景下的暗链检测提供了一种有效的技术方案,也为通用大语言模型应用于网络安全检测任务进一步奠定研究基础。
针对轻量级分组密码Simeck32/64算法,本文提出一种基于残差神经网络的差分−线性区分器构造方法,并基于该方法开展密钥恢复攻击研究。该方法融合差分分析与线性分析的技术优势,设计了同时包含密文对差分值与线性掩码分量的新型输入数据格式,搭建深度残差一维卷积神经网络模型,用于捕捉密码算法多轮加密过程中产生的复杂统计偏差。通过聚合多组密文对构建模型输入样本,有效提升了模型对微弱统计特征的感知能力。相较于现有基于单一差分分析的神经网络区分器,该方法在7~10轮加密区间内,可依托更低的数据复杂度实现更高的区分准确率。基于所构建的差分−线性区分器,本文完成了9~13轮Simeck32/64算法的密钥恢复攻击,实验结果验证了该差分−线性分析方法应用于神经网络辅助密码分析的有效性与可行性。