Skip to content
KitploitKITPLOIT
工具博客
提交
工具博客
提交

黑客、渗透测试和网络安全工具,武装您的安全武器库!

Kitploit 是一个黑客、网络安全和渗透测试工具的目录。发现最新的项目更新,查找漏洞、分析系统、自动化测试并加强你的安全。

··订阅源·联系·隐私·© 2026 Kitploit

工具目录

分类

查看所有分类
Loading categories
bitcoder-v2-research — 记录代码安全漏洞检测中 LLM 泛化上限的研究仓库,基于合成与真实世界数据集(Juliet、OWASP、CVEfixes、VUDENC)对 SQL 注入、路径遍历和访问控制缺陷进行交叉评估。 | Kitploit
工具/GitHubGitHub/bytepro-ai/bitcoder-v2-research
静态分析漏洞分析代码分析Web安全机器学习论文与研究学习与教育AI 安全
GitHubbytepro-ai/bitcoder-v2-research

bitcoder-v2-research

记录代码安全漏洞检测中 LLM 泛化上限的研究仓库,基于合成与真实世界数据集(Juliet、OWASP、CVEfixes、VUDENC)对 SQL 注入、路径遍历和访问控制缺陷进行交叉评估。

查看仓库
118天前尚未审核

最受欢迎

查看全部 →

发现我们社区最常用的工具。

探索所有工具

浏览我们的工具集合

查看所有工具 →
分享

BitCoder-v2 研究

组织: Bytepro AI
状态: 活跃研究 — 私有仓库
目标: arXiv Q3 2026 + ARC Prize 论文赛道 Nov 2026

研究目标

实证记录在数学推理(SAIR,arXiv:2504.18897)中观察到的单次提示上限在代码安全漏洞检测中复现, 从而证实路由假设是领域无关的。

论文主张

gpt-oss-20b + 结构化速查表在合成分布(Juliet、OWASP Benchmark)上可媲美前沿模型, 但在分布偏移到真实世界数据(CVEfixes、VUDENC)时崩溃, 记录了 LLM 在代码安全任务上的泛化上限。

漏洞类别

类别CWE数据来源
SQL 注入CWE-89VUDENC + Juliet + 合成
路径遍历CWE-22VUDENC + Juliet + 合成
硬编码凭据CWE-798Juliet + 合成
N+1 查询模式—仅合成
失效的访问控制CWE-284仅合成

实验设计

交叉评估矩阵:

  • 合成 → 合成(基线)
  • 合成 → 真实(分布偏移 — 预期崩溃)
  • 真实 → 真实(能力上限)
  • 真实 → 合成(迁移检查)

模型

  • 基线:gpt-oss-20b,通过 OpenRouter(抑制推理,低温度 — 与 SAIR 方法论一致)
  • 前沿参考:GPT-4o 或 Claude Sonnet,通过 Together AI
  • 目标:在 BitCoder 数据集上微调的 Qwen2.5-14B

仓库结构

  • scripts/ — 数据处理与评估脚本
  • data/processed/ — 已处理数据集(私有时 gitignored)
  • experiments/ — 结果与分析
  • cheatsheets/ — 结构化漏洞知识(私有)
  • models/ — 微调配置(检查点已 gitignored)
  • papers/ — 论文草稿
下载工具