
Ensamblador de solo cabecera en tiempo de compilación en C++2x para la codificación de instrucciones x86/x86-64
Una biblioteca C++20 de solo encabezado para codificación de instrucciones x86/x86-64 en tiempo de compilación.
Este proyecto tiene doble licencia bajo la Boost Software License 1.0 y la MIT License. Puedes elegir cualquiera de las dos.
#include "static_asm.hpp"
using namespace static_asm::x86::registers;
using namespace static_asm::x86::instructions;
// Construir código máquina en tiempo de compilación
constexpr auto code = core::assemble(
mov(rax, 0x12345678), // mov rax, imm32
add(rax, rcx), // add rax, rcx
xor_(r8, r8), // xor r8, r8
call(rax), // call rax
ret() // ret
);
// code es std::array<uint8_t, N> - ¡completamente constexpr!
// Registro a registro
add(rax, rbx); // 48 01 D8
sub(ecx, edx); // 29 D1
and_(r8, r9); // 4D 21 C8
or_(rsi, rdi); // 48 09 FE
xor_(eax, eax); // 31 C0 (idioma común para poner a cero un registro)
cmp(rax, rcx); // 48 39 C8
// Registro con inmediato
add(rax, 0x10); // 48 83 C0 10 (sign-extended imm8)
add(rax, 0x10000); // 48 05 00 00 01 00 (imm32)
sub(ecx, 100); // 83 E9 64
and_(rdx, 0xFF); // 48 83 E2 FF
// Con operandos de memoria
add(eax, dword_ptr(rbx)); // 03 03
add(rax, qword_ptr(rcx + 0x10)); // 48 03 41 10
sub(dword_ptr(rsp + 0x20), eax); // 29 44 24 20
// Registro a registro
mov(rax, rbx); // 48 89 D8
mov(eax, ecx); // 89 C8
mov(r8, r9); // 4D 89 C8
// Inmediato a registro
mov(rax, 0x12345678); // 48 C7 C0 78 56 34 12
mov(eax, 0xDEADBEEF); // B8 EF BE AD DE
// Operaciones de memoria
mov(rax, qword_ptr(rbx)); // 48 8B 03
mov(eax, dword_ptr(rcx + 0x10)); // 8B 41 10
mov(qword_ptr(rsp + 0x8), rax); // 48 89 44 24 08
mov(dword_ptr(rbp - 0x20), 0x100); // C7 45 E0 00 01 00 00
// Extensión de cero/signo
movzx(eax, bl); // 0F B6 C3 (extensión cero de byte a dword)
movzx(rax, bx); // 48 0F B7 C3 (extensión cero de word a qword)
movsx(eax, cl); // 0F BE C1 (extensión de signo de byte a dword)
movsx(rax, dx); // 48 0F BF C2 (extensión de signo de word a qword)
movsxd(rax, ecx); // 48 63 C1 (extensión de signo de dword a qword)
// Cargar dirección efectiva
lea(rax, qword_ptr(rbx + rcx * s4)); // 48 8D 04 8B
lea(rax, qword_ptr(rbx + rcx * s8 + 0x10)); // 48 8D 44 CB 10
// Intercambio
xchg(rax, rbx); // 48 87 D8
// [base + índice*escala]
mov(eax, dword_ptr(rbx + rcx * s1)); // 8B 04 0B
mov(eax, dword_ptr(rbx + rcx * s2)); // 8B 04 4B
mov(eax, dword_ptr(rbx + rcx * s4)); // 8B 04 8B
mov(eax, dword_ptr(rbx + rcx * s8)); // 8B 04 CB
// [base + índice*escala + desplazamiento]
mov(rax, qword_ptr(rbx + rcx * s4 + 0x10)); // 48 8B 44 8B 10
mov(rax, qword_ptr(r12 + r13 * s8 + 0x1000)); // 4B 8B 84 EC 00 10 00 00
// Almacenar en dirección SIB
mov(dword_ptr(rax + rdx * s4), ecx); // 89 0C 90
mov(qword_ptr(rbx + rsi * s8 + 0x20), rax); // 48 89 44 F3 20
// LEA con SIB (útil para cálculos de direcciones)
lea(rax, qword_ptr(rbx + rcx * s4)); // 48 8D 04 8B
lea(rax, qword_ptr(rdi + rsi * s8 + 0x100)); // 48 8D 84 F7 00 01 00 00
// Desplazar por 1
shl(eax, 1); // D1 E0
shr(rax, 1); // 48 D1 E8
sar(ecx, 1); // D1 F9
// Desplazar por inmediato
shl(eax, 4); // C1 E0 04
shr(rax, 8); // 48 C1 E8 08
sar(rdx, 16); // 48 C1 FA 10
// Desplazar por registro CL
shl(eax, cl); // D3 E0
shr(rax, cl); // 48 D3 E8
// Rotar
rol(eax, 1); // D1 C0
ror(rax, 8); // 48 C1 C8 08
rcl(ecx, cl); // D3 D1
rcr(rdx, 1); // 48 D1 DA
// Un solo operando (resultado en rdx:rax)
mul(rbx); // 48 F7 E3 (sin signo: rdx:rax = rax * rbx)
imul(rcx); // 48 F7 E9 (con signo: rdx:rax = rax * rcx)
div(rbx); // 48 F7 F3 (sin signo: rax = rdx:rax / rbx, rdx = resto)
idiv(rcx); // 48 F7 F9 (división con signo)
// IMUL de dos operandos (dest = dest * src)
imul(rax, rbx); // 48 0F AF C3
imul(ecx, edx); // 0F AF CA
// IMUL de tres operandos (dest = src * imm)
imul(rax, rbx, 10); // 48 6B C3 0A
imul(ecx, edx, 1000); // 69 CA E8 03 00 00
// Saltos incondicionales
jmp(0x10); // EB 10 (corto, offset de 8 bits)
jmp(0x1000); // E9 00 10 00 00 (cercano, offset de 32 bits)
jmp(rax); // FF E0 (indirecto)
jmp(here); // EB FE (jmp $, bucle infinito)
// Saltos condicionales (offset de 8 bits)
jz(0x10); // 74 10
jnz(0x20); // 75 20
jb(0x08); // 72 08 (por debajo/acarreo)
jae(0x08); // 73 08 (por encima o igual/sin acarreo)
jl(0x10); // 7C 10 (menor que, con signo)
jge(0x10); // 7D 10 (mayor o igual, con signo)
// Saltos condicionales (offset de 32 bits para ramas largas)
jz_near(0x10000); // 0F 84 00 00 01 00
jnz_near(0x20000); // 0F 85 00 00 02 00
// Llamada y retorno
call(rax); // FF D0 (llamada indirecta)
call(0x100); // E8 00 01 00 00 (llamada relativa)
ret(); // C3
ret(0x10); // C2 10 00 (retorno y extrae 16 bytes)
// Mover si la condición es verdadera (¡sin penalización de bifurcación!)
cmovz(rax, rbx); // 48 0F 44 C3 (mover si cero)
cmovnz(eax, ecx); // 0F 45 C1 (mover si no cero)
cmovl(rax, rdx); // 48 0F 4C C2 (mover si menor, con signo)
cmovge(ecx, esi); // 0F 4D CE (mover si mayor o igual, con signo)
cmovb(rax, rbx); // 48 0F 42 C3 (mover si por debajo, sin signo)
cmovae(edx, edi); // 0F 43 D7 (mover si por encima o igual, sin signo)
// Con fuente de memoria
cmovz(rax, qword_ptr(rbx)); // 48 0F 44 03
cmovnz(eax, dword_ptr(rcx + 0x10)); // 0F 45 41 10
// Prueba de bit
bt(eax, 5); // 0F BA E0 05
bt(rax, rbx); // 48 0F A3 D8
// Prueba de bit y establecer/restablecer/complementar
bts(eax, 10); // 0F BA E8 0A (prueba y establece)
btr(rax, rcx); // 48 0F B3 C8 (prueba y restablece)
btc(edx, 3); // 0F BA FA 03 (prueba y complementa)
// Escaneo de bits
bsf(eax, ecx); // 0F BC C1 (escanear hacia adelante el primer 1)
bsr(rax, rbx); // 48 0F BD C3 (escanear hacia atrás el primer 1)
// Conteo de población y ceros iniciales/finales
popcnt(eax, ecx); // F3 0F B8 C1
lzcnt(rax, rbx); // F3 48 0F BD C3
tzcnt(eax, edx); // F3 0F BC C2
// Intercambio de bytes
bswap(eax); // 0F C8 (invierte el orden de bytes)
bswap(rax); // 48 0F C8