Asm2Vec粗读笔记

Asm2Vec是一种针对汇编代码的表示学习模型,旨在增强二进制克隆搜索的稳健性,抵御代码混淆和编译器优化的影响。该模型无需任何先验知识,能学习汇编代码的语义关系,提高代码表示的鲁棒性。Asm2Vec的主要贡献包括提出新的汇编代码克隆检测方法、开发的表示学习模型能捕捉token的语义关联,并在面对混淆和优化时表现更优。
摘要由CSDN通过智能技术生成

Asm2Vec: Boosting Static Representation Robustness for Binary Clone Search against Code Obfuscation and Compiler Optimization

阅读笔记 S&P 2019

背景

软件在初始开发的时候,会用到大量的同源库,因此在底层的汇编代码中会存在大量的克隆情况,而汇编代码克隆检测的作用主要是探索汇编层面代码的相似性,以得到已知的编程错误与0day漏洞同时也能用来在源代码不可用的情况检测软件侵权。

概述

本文提出将汇编程序的词汇语义关系和汇编函数的向量表示结合起来,论文研究出了了汇编代码表示学习模型Asm2Vec。它只需要汇编代码作为输入,不需要任何先验知识如汇编函数之间的正确映射。它可以在汇编代码的token之间找到并合并丰富的语义关系。论文表明,学习的表示形式更鲁棒,并且相对于混淆和优化所引入的变化,其性能明显优于现有方法。

贡献

1.论文提出了一种用于汇编代码克隆检测的新方法。这是利用表示学习来为汇编代码构造特征向量的第一项工作,同时能够减轻人工工作。
2.开发了一个用于汇编代码语法和控制流图的表示学习模型Asm2Vec,学习token之间的潜在词法语义,并将汇编函数表示为相互加权的集合语义的混合。
3.Asm2Vec在代码混淆和编译器优化方面更具弹性。

创新点</

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值