Skip to content
View aisamuraiagent-source's full-sized avatar
🖥️
➰💻➰
🖥️
➰💻➰

Block or report aisamuraiagent-source

Block user

Prevent this user from interacting with your repositories and sending you notifications. Learn more about blocking users.

You must be logged in to block users.

Maximum 250 characters. Please don’t include any personal information such as legal names or email addresses. Markdown is supported. This note will only be visible to you.
Report abuse

Contact GitHub support about this user’s behavior. Learn more about reporting abuse.

Report abuse

Renan Raad

Engenheiro de Segurança de IA — Verificação Formal (SMT/z3) + Red Team / Ofensivo

GET — Governance Epistemic Twin · Reside no Brasil (presencial · híbrido · remoto) · Aberto a remoto na UE · Cidadão da UE (Espanha)

Capacidade não é autoridade. Eu construo o controle entre o que um agente de IA pretende e o que ele executa: determinístico, fail-closed, evidence-first. Cada afirmação vira um artefato reconferível: um hash, uma assinatura, um teste reproduzível — não uma alegação.

O humano é necessário — não opcional — para a proteção da IA. A IA assiste; a autoridade, a decisão e a assinatura são sempre humanas. Nunca sozinho: sempre dois.

Defesa e ataque no mesmo gesto: a mesma busca de satisfatibilidade (SMT/z3) que um red team usa para achar bypass de autoridade/IAM, eu aponto contra o próprio controle. Método ofensivo fechado como defesa. Blue e Red no mesmo sistema.

Foco

Segurança de agentes de IA e enforcement determinístico (fail-closed) · Verificação formal de autorização (SMT/z3, execução simbólica) · Red Team ofensivo autorizado para fortalecer a defesa · Validação Blue Team · Modelagem de ameaças · Remediação segura · Revisão humana obrigatória · Evidência à prova de adulteração (hash chains, assinaturas Ed25519, timestamp).

Prova pública (reproduzível)

z3-reversing — SMT/z3 na segurança: provar que não há bypass (UNSAT) e achar um; 18.000 desafios resolvidos mais picoCTF; certificado assinado Ed25519.

ai-threat-model-dependency-risk-lab — modelagem de ameaças, risco de dependências, plano de remediação.

FCCSecurity-Public — console defensivo, governança de release, registros de validação.

Método

Escopo, Revisão, Remediação, Validação, Evidência, Sanitização. Cada afirmação é limitada por: fato observado, inferência razoável, hipótese, recomendação, desconhecido.

Fronteira

Defensivo-primário. Material público é sanitizado: sem segredos, dados privados, alvos ao vivo, credenciais, cadeias de exploit, persistência, evasão ou malware. Atividade ofensiva é autorizada, escopada e lab-safe (labs próprios e CTFs públicos), só para fortalecer defesa. A IA assiste; o humano escopa, revisa, decide e assina a evidência.

A prova é a prática.

Pinned Loading

  1. capability-not-authority capability-not-authority Public

    Capability Is Not Authority — an AI code-agent authorization field case (evidence-first, Ed25519-signed).

    HTML

  2. z3-reversing z3-reversing Public

    Python 1

  3. lab-records lab-records Public

    Signed, sanitized records of real defensive security work - every artifact ships with a SHA-256 sidecar for independent verification.

    1

  4. aisamuraiagent-source aisamuraiagent-source Public

    Defensive AI Systems Builder focused on Codex CLI, Codex Security, secure remediation, patch validation, and audit-ready evidence.