Skip to content
KitploitKITPLOIT
OutilsBlog
Soumettre
OutilsBlog
Soumettre

Outils de Hacking, PenTest et Cybersécurité pour votre Arsenal de Sécurité !

Kitploit est un répertoire d'outils de hacking, de cybersécurité et de pentesting. Découvrez les dernières mises à jour des projets pour trouver des vulnérabilités, analyser des systèmes, automatiser les tests et renforcer votre sécurité.

··Flux·Contact·Confidentialité·© 2026 Kitploit

Répertoire d'outils

Catégories

Voir toutes les catégories
Loading categories
bitcoder-v2-research — Dépôt de recherche documentant les plafonds de généralisation des LLM dans la détection de vulnérabilités de sécurité du code, avec une évaluation croisée sur des ensembles de données synthétiques et réels (Juliet, OWASP, CVEfixes, VUDENC) pour les injections SQL, les traversées de chemin et les défauts de contrôle d'accès. | Kitploit
Outils/GitHubGitHub/bytepro-ai/bitcoder-v2-research
Analyse StatiqueAnalyse des VulnérabilitésAnalyse de CodeSécurité WebApprentissage AutomatiqueArticles et RechercheApprentissage et ÉducationSécurité de l'IA

Populaires

Voir tout →

Découvrez les outils les plus utilisés par notre communauté.

Explorer tous les outils

Parcourez notre collection d'outils

Voir tous les outils →
GitHub
bytepro-ai/bitcoder-v2-research

bitcoder-v2-research

Voir le dépôt
11il y a 9 joursPas encore vérifié

À propos

Dépôt de recherche documentant les plafonds de généralisation des LLM dans la détection de vulnérabilités de sécurité du code, avec une évaluation croisée sur des ensembles de données synthétiques et réels (Juliet, OWASP, CVEfixes, VUDENC) pour les injections SQL, les traversées de chemin et les défauts de contrôle d'accès.

Partager

Recherche BitCoder-v2

Organisation : Bytepro AI
Statut : Recherche active — dépôt privé
Cible : arXiv Q3 2026 + ARC Prize Paper Track Nov 2026

Objectif de recherche

Documenter empiriquement que le plafond de la requête unique observé dans le raisonnement mathématique (SAIR, arXiv:2504.18897) se reproduit dans la détection de vulnérabilités de sécurité du code, confirmant que l'hypothèse du routeur est indépendante du domaine.

Affirmation de l'article

gpt-oss-20b + une antisèche structurée égalise les modèles de pointe sur les distributions synthétiques (Juliet, OWASP Benchmark) mais s'effondre sous un changement de distribution vers des données réelles (CVEfixes, VUDENC), documentant un plafond de généralisation dans les LLM pour les tâches de sécurité du code.

Catégories de vulnérabilités

CatégorieCWESource de données
Injection SQLCWE-89VUDENC + Juliet + synthétique
Traversée de cheminCWE-22VUDENC + Juliet + synthétique
Identifiants codés en durCWE-798Juliet + synthétique
Modèle de requête N+1—Synthétique uniquement
Contrôle d'accès casséCWE-284Synthétique uniquement

Conception expérimentale

Matrice d'évaluation croisée :

  • Synthétique → Synthétique (référence)
  • Synthétique → Réel (changement de distribution — effondrement attendu)
  • Réel → Réel (plafond de capacité)
  • Réel → Synthétique (vérification de transfert)

Modèles

  • Référence : gpt-oss-20b via OpenRouter (raisonnement supprimé, température basse — correspond à la méthodologie SAIR)
  • Référence de pointe : GPT-4o ou Claude Sonnet via Together AI
  • Cible : Qwen2.5-14B affiné sur l'ensemble de données BitCoder

Structure du dépôt

  • scripts/ — scripts de traitement de données et d'évaluation
  • data/processed/ — jeux de données traités (gitignorés si privé)
  • experiments/ — résultats et analyse
  • cheatsheets/ — connaissances structurées sur les vulnérabilités (privé)
  • models/ — configurations d'affinage (points de contrôle gitignorés)
  • papers/ — brouillons d'articles
Télécharger l’outil