风控日报 — 2026-09-11

📊 筛选总结

  • 原料:51 条入文件 — GitHub 仓库搜索 50 + Trending 20 + HN 18 + arXiv 36 条原始中 14 条进入原料
  • arXiv(累计 879 条中 2 条相关,噪声率 99.8%):13 条全部无关(新批次 2609.105xx,09-09 提交日期,非缓存:量子行走首次检测相变、HR 8799 第五行星 JWST 成像、航空 400Hz 电力故障检测、强湍流波前传感器、nuisance 参数 normalizing flow、蝌蚪星系运动学、协方差矩阵 GNN 理论综述(VNN,纯理论)、Image-to-3D 测试时观测、LZ230616 中微子散射、gap-entropy 猜想、Q-曲率刚性×2、随机微分同胚维数);1 条打破全噪声:2609.10537 LL-Verifier(LLM 自主形式建模+模型检测器自动发现应用逻辑漏洞,27 个 IoT 访问控制协议实证——见今日 #5),44 期以来首次命中
  • 剔除 · 已覆盖/重复 14 条:veriguard[09-09 ★★]、marketplace-phaas-tracker[08-14 已入图]、FFraud-com 邮箱+IP 库×2[07-14 已收录]、FelipeGardenghiDev[09-10 ★★]、RazorPulse[09-05]、TemporalStore[09-05 剔]、lucidfence[08-07]、defi-risk-screening[07-26 恶意]、relflow[08-15 ★★]、weiwen-law-dsh[08-27 ★★★]、perishable[07-01 已剔]、portfolio-risk/finpulse 投资 VaR 域外族、游戏规则引擎 mault/gladiator/legado×3、warden-desk[09-05]、卡片游戏碰撞
  • 剔除 · 恶意残留:5 个已确认恶意仓库不重复验证(yoelpa6680/upi-fraud-gnn[07-26]、Para99999/payment-fraud-detector[07-26]、hgthangbq-lang/defi-risk-screening[07-26]、gilangcowokull/SnifTern.ai[07-26]、amit2410256/UPI-Fraud-GNN[09-10 已剔]);Infrai astroturf 第 6 例:CianWinslow370/fintech-document-decision(INFRAI_API_KEY+{ok,data,error,metadata} 封套+llms.txt 三件套指纹齐备,Python 版新变体——09-10 明日动作"第 6 例是否出现"当日命中)
  • 剔除 · 过薄/域外 7 条:Magistrate/InspectHome 同 owner 同日建仓(房产产权/挂牌平台,纯营销 README+0 代码+root 带"Roxanne-Ardary-Business-Card.md"个人名片——疑似个人 SEO 网络而非风控项目)、fraudshield-public 纯前端作品集、aml-core 语义营销语言与风控无关、arcswarm DeFi 国库域外、Vladimir-Ristic 315B README 硕士论文壳、SecureSphere-AI roadmap 8/10 未勾选
  • 筛出:4 条工程高信号 + 1 条 arXiv 破冰 + 1 条威胁情报专题
  • 主题一 · 验证与审计终于合流:三个独立样本(企业报销的确定性 OT 引擎、印度旅游安全的确定性多因子风险引擎、LLM 逻辑漏洞的形式验证)不约而同把"可解释/可验证"做成第一性需求
  • 主题二 · 威胁情报双线:zip 家族 3 个恶意仓第 3 日全部存活(587,686 字节两仓逐字节同尺寸——同构建管线的最强指纹);Infrai astroturf 转入 Python 语言带

今日高信号

1. MZarc/OES — 加班/报销反欺诈的确定性规则引擎:Next.js 15 全栈参考实现(企业级加班计算+报销反欺诈+排班自动化平台:动态班次检测(按打卡时间识别 First/General/Second/Night 班次策略)+确定性 OT 计算;报销侧 receipt 图像审计+claim 核验;Drizzle ORM+PostgreSQL 17+Better Auth+PWA 离线同步+Cloudflare R2;vitest 测试+docker 自托管)【信号:★★】

MZarc/OES(0★, TypeScript, 09-10 单日新建, 2.4MB, MIT)README 工程叙事完整:17KB、特性矩阵+部署双路径(Vercel+Supabase 云免费层 / Windows/Linux Docker 自托管)。验证确认 root 27 文件全部真实(app/components/domain/db/tests/workers 分层),package.json+vitest 在位,无恶意模式命中。

风控视角:"内部欺诈"场景的工程空白补位——本库交易反欺诈/AML 样本密集,但员工报销反欺诈(虚假加班申报、重复报销、发票造假)是内部风控的高频真实场景,此前只有零星覆盖。OES 的价值在其确定性声明:"Deterministic Overtime Engine"——加班费计算是资金动作,规则必须可复算可审计,这与 feelc[09-10] 的"确定性执行"和 app-fraud-interdiction[09-10] 的"后果性决策纯确定性"同一条治理线在 HR 场景的落地。receipt 图像审计是新元素(对照国内费控系统的发票 OCR 验真)。⚠️ 单日新仓、无 CI 徽章、反欺诈规则深度未知(README 未展开具体规则)。与 风控策略 的内部风控场景相关。→ GitHub

2. sukhdev31/sentinelpay- — 支付风控决策平台的"新入行者教科书":可解释规则+三信号族+不可变审计(FastAPI 实时评分服务:8 条可解释规则+RF 监督模型+Isolation Forest 异常+共享设备/已确认欺诈 IP 的图风险代理;versioned decision policy+稳定 reason codes;PostgreSQL 不可变交易/决策审计链+Redis 在线特征/缓存边界+幂等评分+API Key;分析台+Alembic 迁移+Docker Compose+CI+tests+typing+lint+runbooks)【信号:★★】

sukhdev31/sentinelpay-(0★, Python, 09-10 单日新建, 52KB, 无 license)最难得的是 README 的声明边界段:开宗明义"模型仅在可复现合成数据上训练评估,不声明银行级准确率,未经验证/治理/安全审查不得用于真实金融决策"——并逐项列出 FACT/推断边界。验证确认 root 14 文件结构真实(src/tests/migrations/docs 分层+pyproject+Dockerfile+compose)。

风控视角:教学族的可解释决策样板——与 09-05 adarshthakur9240 sentinelpay(ULB 0.17% 全家桶)同名不同物、与 09-09 jeganathan(PR-AUC 0.999 当战绩)同日相对:这份的"规则+监督+异常+图"四信号组合不新,新的是把决策策略版本化+稳定 reason codes+不可变审计链做成一等公民——这正是"评估即证据链"谱系(cher-ry→Vignesh→jeganathan)强调的工程化落地件:每笔裁决可回放、可解释、可问责。名字撞车+同日新建提示注意后续是否出现第 4 个 sentinelpay(该命名已 4 owner 复用)。⚠️ 单日新仓、合成数据、无 license。与 实时风控引擎 的决策审计和 风控模型 的可解释性相关。→ GitHub

3. arnnnnaaavvvvv/IGNITE — 确定性多因子风险引擎的旅游安全样本:6 地形档案×可解释安全分(印度全域旅游安全+路线规划:确定性数学多因子风险引擎(明确拒绝黑盒 ML),6 类地形档案(高山/海岸/野生动物/沙漠/河流平原/城市遗产)动态切换权重向量;融合实时天气+海拔采样+PostGIS 风险多边形+人群瓶颈+应急设施邻近度,输出完全数学可解释的安全分+实时改路+低 connectivity 区 SOS 派发;28 邦+8 联邦属地全覆盖;live 实测部署)【信号:★】

arnnnnaaavvvvv/IGNITE(9★, Python/FastAPI+React, 08-18 建→09-10 推送, 587KB)是 hackathon 出身(JUDGE_ONE_PAGER.md)但工程超出平均:ARCHITECTURE.md+vercel 部署+PostGIS 空间计算。验证确认 root 结构真实,无恶意模式。

风控视角:"可解释风险分"的跨域镜像——它把风控引擎的三个正确性标准在旅游域做全了:① 确定性(同输入同输出,可复算);② 场景化权重(6 地形档案=规则包按场景路由,对照 veriguard[09-09] 的五区规则表);③ 完全数学可解释(每个安全分可拆解为因子贡献)。反诈/支付风控的"风险分"常被业务方当作黑盒,IGNITE 是向业务方演示"可解释风险分长什么样"的干净教学样本。SOS 派发+低网区设计也给出"风控动作分层"(提示/改路/SOS)的直观类比。⚠️ 域外(旅游安全≠金融风控)、hackathon 属性、9★ 小众。与 风控策略 的可解释性相关。→ GitHub

4. Sandesh14015/CASHNET — 金融情报调查平台的数据诚实度样本:合成/推断/公开数据三色标注(面向调查人员的网络犯罪金融情报平台:从诈骗报案出发→投诉指标关联→账户分析→多跳资金流→加密货币溯源(BTC/ETH/Tron 公链 API 实连)→VASP 归因→风险评分→地理空间预测→ATM 提现热点→干预复盘→审计报告全链路;数据透明度表逐组件标注 SYNTHETIC/MODEL_INFERENCE/PUBLIC_DATA/NOT_CONNECTED 四类;报告区分 FACT/MODEL_INFERENCE/SYNTHETIC;可插拔 provider 架构)【信号:★★】

Sandesh14015/CASHNET(1★, TypeScript+Python, 08-25 建→09-10 推送, 76MB, 无 license)体量与诚意并存:README 用整张表逐组件声明数据来源性质,NCRP/SAHYOG/UPI/政府系统全部标注 NOT_CONNECTED"永不访问/未实现"——主动声明没接的比吹接了的更可信。验证确认 root 42 文件(artifacts/api-server/lib/ml_pipeline/tests/docker-compose/render.yaml 等)真实齐备。

风控视角:"数据血统工件化"的调查端样本——此前两次收录过数据血统:fraudshield-ml[08-27] 的 checksum 锁定数据快照(训练侧)与 graph-fraud-ai 的指标血统披露(评估侧),CASHNET 补上调查/情报侧:每个结论组件标注数据来源性质,报告区分 FACT 与模型推断。这正是反诈资金链调查(国内电诈资金流分析)最需要的纪律——调查报告里的"模型猜的"和"链上查的"必须可区分,否则结论不可质证。多跳资金流+VASP 归因+ATM 提现热点是完整的链上-线下混合追踪参考架构。⚠️ 76MB 大仓需自行核查数据目录、合成数据演示定位、无 license。与 反欺诈体系 的资金链调查相关。→ GitHub

5. arXiv 破冰 — LL-Verifier:LLM 自主形式建模+模型检测器自动发现应用逻辑漏洞(2609.10537:应用逻辑漏洞(logic flaws)绑定业务语义与威胁模型,人工发现难扩展;框架用 LLM 从自然语言协议描述+安全目标自动生成形式逻辑模型(基于 Maude 的新逻辑语言),转为逻辑状态机后用逻辑级模型检测穷尽验证;27 个广泛使用的 IoT 设备访问控制协议实证评估)【信号:★★(方法论,风控应用待迁移)】

验证确认 arXiv API 元数据与原料摘要一致(cs.CR 主类)。这是 07-17 以来 44 期全噪声后第一条真实相关论文——关键词碰上了"transaction monitoring"查询。

风控视角:"规则引擎正确性验证"的学术对应物——feelc[09-10] 用 SMT 在执行前证明规则完备性/无冲突,LL-Verifier 用 LLM 建模+模型检测在协议层找逻辑漏洞:两者共享同一洞察——业务逻辑错误(规则打架、状态机死角、授权旁路)可以也应该被形式化验证捕获,而不是等线上事故。风控迁移点:支付风控的规则集本身(限速+黑名单+阈值组合)就是一个协议状态机,LLM 从策略文档自动生成形式模型+模型检测找规则间矛盾,是 feelc 路线的"存量规则库审计"补件(feelc 管增量创作、LL-Verifier 管存量体检)。⚠️ IoT 访问控制域、非金融实证、工程落地成本未知(待验证)。与 实时风控引擎 的规则治理和 风控归因 Agent 项目 的规则层验证直接相关。→ arXiv

6. 威胁情报专题 — zip 家族第 3 日全存活:两仓 587,686 字节逐字节同尺寸;Infrai astroturf 第 6 例当日命中(① 昨日 3 个已确认恶意仓 zip 复测:TRDGNN Software-v1.4.zip 200/587,686B、sulemanyou card-detection-fraud-credit-v3.1.zip 200/587,686B(与前两者逐字节同尺寸——同构建管线的最强指纹)、Zen7 Zen_Payment_Agent_v1.7.zip 200/584,580B——无一 404,投放方未弃号,威胁窗口持续;② Infrai astroturf 第 6 例:CianWinslow370/fintech-document-decision(09-10 当日新建、0★、MIT)——INFRAI_API_KEY+{ok,data,error,metadata} 响应封套+llms.txt 三件套指纹齐备,README 自称"payments 团队的 audit-friendly 决策服务"但主叙事是 Infrai API 推广教程;与 09-08 第 4/5 例(Go)同战役,语言从 Go 转入 Python)【信号:★★★(威胁情报)】

验证实录(主会话 Python urllib):三 zip HEAD 全部 HTTP 200 且 content-length 与 09-10 记录逐字节一致;fintech-document-decision 的 README head 中 INFRAI_API_KEY、Infrai 响应封套、llms.txt、ai.rerank 全部命中,root 文件列表与 09-08 两例同构(LICENSE+README+llms.txt+src+tests 六件套)。恶意仓库累计维持 29 个(Infrai astroturf 单列计数,今日 +1=6 个)。

风控视角:三个采集纪律升级。其一,zip 存活=威胁窗口持续:3 个恶意仓连续 3 日可下载,"复查是否 404"(昨日明日动作)已执行——结论是投放方仍在维护下载链路,wiki/digest 中已链接的仓库名仅作威胁情报引用、永不作技术引用的纪律有效。同字节尺寸(587,686×2)把"同一构建管线"判断从 ±2KB 聚类带收紧到逐字节证据。其二,Infrai 战役跨语言复制:SMS 教程(×3)→Go 风控服务(×2)→Python 决策服务(今日),指纹三件套(键名/封套/llms.txt)跨语言稳定,grep -l "INFRAI_API_KEY" 可作为采集管道的自动初筛——该战役对本工作流的针对性(伪装成"可运行的风控服务代码"混过代码质量筛选)已在 09-08 预警,今日第 6 例验证预警有效。其三,今日 arXiv 破冰(#5)提醒验证纪律要对称:44 期全噪声养成的"扫一眼就丢"惯性差点错过 LL-Verifier——drop-all 默认保留,但摘要里出现"business-specific semantics + logic model checking"这类组合词时值得 10 秒钟二次确认。→ TRDGNN、fintech-document-decision


技术趋势

  • 确定性引擎跨域合流:OES(报销/加班)、IGNITE(旅游安全)、sentinelpay-(支付评分)三个互不相关的仓同日把"确定性/可解释"写进核心卖点——"资金动作与后果性决策必须确定性可复算"正从治理论述变成工程默认(与 feelc/app-fraud-interdiction[09-10] 同向)。
  • 数据诚实度三色标注兴起:CASHNET 逐组件标注 SYNTHETIC/MODEL_INFERENCE/PUBLIC_DATA/NOT_CONNECTED,sentinelpay- 开篇声明"仅合成数据、不声明银行级准确率"——"主动披露边界"成为新仓差异化信号,对照 jeganathan[09-09] 的完美指标当战绩是反面教材。
  • 形式验证进入应用逻辑安全:LL-Verifier(LLM 建模+模型检测)与 feelc 的 SMT 证明构成"增量创作验证+存量审计"互补对——风控规则库的正确性验证有了两条学术/工程路径。
  • 威胁情报双线持续:zip 家族 3 日存活且两仓逐字节同尺寸(同构建管线最强指纹);Infrai astroturf 第 6 例跨语言复制(Go→Python),指纹三件套稳定可 grep。
  • arXiv 44 期全噪声首次破冰:2609.10537(LL-Verifier)成为 879 条累计中第 2 条相关——drop-all 默认维持,但"business semantics+formal verification"组合词值得 10 秒二次确认。

行业案例

  • 企业内部风控:OES 的加班/报销反欺诈——动态班次检测+receipt 图像审计(内部欺诈场景的工程补位)。
  • 印度反诈调查:CASHNET 的报案→资金流→加密溯源→ATM 热点全链路,逐组件数据来源标注(调查报告可质证性)。
  • 印度旅游安全:IGNITE 的 6 地形档案×可解释安全分+SOS 分层派发(确定性风险引擎的跨域镜像)。
  • IoT 协议安全:LL-Verifier 对 27 个访问控制协议的实证(形式验证方法论的规模化样本)。

值得深入

  • LL-Verifier 的 Maude 逻辑语言与成本:LLM 生成形式模型的准确率如何度量?模型检测在千条规则级规则库上的状态爆炸怎么控?(论文实证止于 27 个 IoT 协议,金融规则库迁移成本待验证)
  • CASHNET 的 provider 架构:synthetic/public/NOT_CONNECTED 三态 provider 的切换机制与 ml_pipeline 的 temporal split 实现——调查平台的工程骨架可参照。
  • zip 家族溯源:587,686 字节逐字节同尺寸的两仓 zip 能否解包对比元数据(时间戳/注释字段/构建路径)聚类出构建环境指纹?
  • OES 的报销审计规则深度:README 未展开具体反欺诈规则,需读 domain/ 层确认是营销话术还是真实现。