风控日报 — 2026-10-05

📊 筛选总结

  • 原料:58 条入文件 — GitHub 44 + 采集器 arXiv 14;HN / Trending 0 条通过过滤;HN Algolia 7 日 fraud 补查 3 条全低信号(2pt:法国社保欺诈视频、optimal fraud 非零旧文、agent 自发欺诈推文——连续第 3 期同一批残留),0 条入选
  • arXiv:采集器 14 条全部无关(与 10-04 完全同一批次 2610.02xxx 逐 ID 一致——API 缓存态,脑 MRI/企业数据 agent 基准/Kali 网安工具基准/3D avatar/太阳耀斑等已知噪声不重判);词组直查 14 篇 — 0 篇新采(14/14 已采:直查连续第 7 期零新增,2609.24016 尾部 ID 首次触底=查询窗口已耗尽,观察目标改为等待 10 月新提交自然入窗)
  • 剔除 · 已覆盖/重复 11 条:openpitkit/pit+officer[10-02 采]、SiteQ8/Asli[09-24 采]、isacunha1207-lab/guardiao-pix[10-03 采 今日复推]、YesitsSaish/T03-MuleTrace[10-04 采 迟到捕获——昨日新仓今日才入采集流,已采不重复]、mahima2604/autonomous-fraud-detection-engine[09-27 剔不定论 维持]、jugqdc-sudo/warden-desk[09-05 剔]、NilimKr/JeevOne[10-02 剔 健康监测域外]、Oz134/perishable-inventory[10-01 剔]、TSEC-GRC/tsec-website[09-22 剔 营销站]、utkarshpatil1601/FinGraph[10-04 剔过薄 今日再现]、matrixarkai/TemporalStore[09-26 复核域外]
  • 剔除 · 域外/过薄 6 条:zaynabideen/fleet-driver-drowsiness(车载疲劳驾驶安全域外)、samkos234/AEGIS-Risk-Engine("185M txns/$42B GMV/回收 $34.8M" 全营销级数字不可证、HTML 单页仓未验证)、YoussElo/AI-Finance-Portfolio(Kaggle 教学笔记本仓)、luigibrb/srd-rules-engine(桌游规则引擎)、jimmyshultz/fraudwatch(空壳:README 仅 13B 标题一行、"drift monitoring" 描述无任何实现内容)、FlorCavero/LoanDecisionApi(邻近域借贷决策——树内 publish.zip 4,624,060B 判为部署产物非载荷:10-02 提交"Preparing GitHub Actions" 早于 README 最终版、README 全篇 dotnet publish+OIDC/Key Vault 纪律、与 585KB 恶意尺寸带无关——不计恶意,"树内 zip 需逐个判成因"的边界样本)
  • 剔除 · 恶意 +0 新(累计维持 41):批次残留 5 个(hgthangbq-lang/defi-risk-screening、yoelpa6680/upi-fraud-gnn、Para99999/payment-fraud-detector、primatewakeisland574/payment-channel-guide、hypopigmentationnudemouse124/fraud-detection-analytics-case[09-20 恶 载荷 462,519B 复测 200])不重复验证;Amy7007/VPN-Detector 抽查载荷 Detector-VP-consulate.zip 466,717B 复测 200——466-463KB 尺寸带第 3 例(与 firefox-ffa 492KB 带、家族 585KB 带并立的第三条字节指纹线)
  • 剔除 · astroturf +0 新(累计维持 23):今日采集流 0 例——第 18 例后脉冲投放连续第 5 日静默
  • 筛出:2 条 ★★★ 工程 + 3 条 ★★ 工程 + 1 条 教学参照 + 1 条 邻近域 + 1 条威胁情报专题(8 条)
  • 主题一 · 欺诈调查 copilot 的"治理壳"标准化:fraudsentinel 把编排器→专家 agent→输出验证→自动路由(人工/升级/例外队列)做成可运行范式,与 RazorRisk[10-02] 证据工具、ojuri[09-28] 报告代写三代同谱
  • 主题二 · 实时风控栈的完整开源供给:oddsmaker(Flink+Kafka+ClickHouse 全栈游戏风控平台)与 payment-risk-engine(Spring Boot 3+Kafka Java 参照)同日到位——从教学管线到平台级实现的两级供给
  • 主题三 · 威胁情报稳态:恶意仓家族第 4 次隔日交替触碰(A 对 2m42s 紧窗回归)+8 载荷字节全稳;api-evangelist 厂商档案族加装反冒充 banner——合法文档仓开始主动防御"下载链接"冒充

今日高信号

1. mrigankchoudhary/fraudsentinel — 治理型欺诈调查 agent copilot:编排器→四专家 agent→输出验证→自动路由,"未经人类角色批准不触碰账户"的可运行实现(Python(无 license,10-04 当日建+推送,0★,1.1MB/77 文件全源码无二进制,README 12.7KB)——Agentic AI Digital Transformation Hackathon 银行赛道参赛作:调查员打开告警→按 Investigate→编排器装配脱敏证据→四个专业化 agent 并行→输出验证层校验→自动路由(人类/升级/例外队列);唯一自动动作例外=确定性硬规则触发的临时冻结(temporary hold)——"Nothing touches an account until a human with the right role says so";本地 Ollama 运行零 API key(python3 data/seed.py+python3 app/server.py 两条命令起全栈,合成银行数据内置))【信号:★★★】**

mrigankchoudhary/fraudsentinel(0★, Python, 无 license, 10-04 建→推送, 77 文件:py×20/sql×3/无二进制, README 12.7KB)恶意 grep 唯一命中为 Ollama 官网下载链接(合法安装指引)、Infrai×0。与 techieemike/fraudsentinel-ai[07-24 采] 同名不同主(owner+内容区分,后者是 Kafka+XGBoost 流式管线)。

风控视角:欺诈调查 agent 的"治理壳"有了第三个可对照实现——09-28 以来该形态快速收敛:ojuri[09-28] 出调查报告(LLM 代写)、RazorRisk[10-02] 四确定性证据工具+独立复核 pass、本仓编排器+验证器+三路自动路由——三者共同点是把"agent 的输出不可信"当架构第一假设:本仓的输出验证层对应 RazorRisk 的 Jev 复核 pass(独立校验而非自证),三路路由(人类/升级/例外队列)对应强制 HITL 清单。"唯一自动动作=确定性硬规则的临时冻结"是行动面上最锋利的设计:ML/agent 永远不能直接处置账户,唯一例外也限定在可解释的确定性规则+可逆动作(hold 非 deduct)。全本地 Ollama 使银行数据不出域,是合规约束下的可部署形态。⚠️ 0★ 当日 hackathon 仓、无 license、四 agent 的具体分工与验证器判据 README 未展开、无真实银行数据验证。与 风控归因 Agent 项目 直接相关。→ GitHub

cuihairu/oddsmaker(0★, Java, MIT, 2025-10-24 建→10-04 推送, 233,728KB/1,068 blobs:java×593/sql×78/vue×32, README 10.2KB)恶意 grep 零命中、Infrai×0;树内唯一 zip 为 Superset 仪表盘 bundle(BI 导入包,合法语境)、唯一 jar 为标准 gradle-wrapper。

风控视角:游戏风控(营销反作弊+支付风控的交叉域)第一次有平台级完整开源实现入栏——此前该域样本全是单点(广告反作弊规则、设备指纹脚本),本仓给出的是风控与增长共用一条数据链路的架构语义:A/B 实验平台与实时检测同库、虚拟经济分析与支付异常同仓——"风控内建(built-in risk)"而非旁路风控系统的定位与 ERP 内插件 trustgate[10-02] 同向但体量大三个数量级;检测项"广告奖励异常+账号/设备/IP 聚集"正是国内互动广告反作弊(素材激励场景)的核心规则族;六级风险输出动作把"告警→处置"的动作词表标准化(对照 CEP 复杂事件处理教学里缺位的"检测之后做什么")。⚠️ 0★ 单人维护一年、README 架构描述与 593 个 Java 文件的实现深度未逐模块走读、无生产部署声明、演示站点规模未知。与 实时风控引擎 平台形态章节、反欺诈体系 营销反作弊章节相关。→ GitHub

3. Karan-Rastogi/payment-risk-engine — Java 实时支付风控参照实现:Spring Boot 3+PostgreSQL+Redis+Kafka 的毫秒级 approve/review/decline 三决策(Java 17(MIT,09-20 建→10-04 推送,0★,1.1MB/60 文件 java×37 全源码,README 4.1KB)——"Banks and payment processors handle millions of transactions per day, and even a 0.1% fraud rate translates to massive financial losses"——对齐 JP Morgan/Visa/Stripe 的核心问题语义:每笔交易毫秒内三分类决策(approve/flag for review/decline);经典四件套栈(Spring Boot 3 Web+PostgreSQL 持久化+Redis 缓存+Kafka 事件流))【信号:★★(工程教学参照,隔日重推)】**

Karan-Rastogi/payment-risk-engine(0★, Java, MIT, 09-20 建→10-04 推送, 60 文件无二进制, README 4.1KB)恶意 grep 零命中、Infrai×0。09-21 曾以"描述过薄"剔除、今日以完整树重推——隔日重推样本:剔除判据应跟随仓库实质而非当日描述字段。

风控视角:JVM 技术栈实时风控的最小完整参照——本栏 Python 系管线已饱和(fraudshield[10-01] 六模块/techieemike[07-24] NestJS 全栈),Java/Spring 系的可走读实现一直缺位(国内大厂风控主力栈恰是 Java+Kafka+Flink);60 文件 37 个 Java 类的体量刚好在"半天走读完"的粒度:Kafka 消费→特征取数(Redis 缓存模式)→评分→三决策输出,是面试叙事"实时风控引擎架构"的可运行注脚。与 fraudshield-ai[10-01] 构成同题双语言对照(六模块规则 vs 三决策管线)。⚠️ 0★ 教学级、无压测数据、规则/模型实现深度未披露、09-21 首见时描述过薄的历史判据待本次树走读校准。与 实时风控引擎 相关。→ GitHub

4. Payloadhq/payload-flow (RevRule) — 可编程收入规则引擎:任意经济事件→版本化有状态跨轨规则图→可审计权益分配,"remainder 规则类型精确守恒资金池"(TypeScript(MIT,10-04 当日建+推送,0★,125KB/49 文件 ts×29 全源码,README 8.7KB)——"One generic engine, no industry branches":Stripe 支付/x402 结算/版税账单行统一为"合格经济事件"输入;确定性求值引擎:规则按优先序从池中消费(net = amount − processingCost)、remainder 是一种经验证的规则类型、精确守恒池(分配完毕零泄漏);托管 Rail API 已上线(fly.dev)+浏览器 Sandbox 免 key 可玩;场景=创作者经济分账/SaaS 市场分成/机器商务微支付同构配置)【信号:★★(规则引擎范式迁移)】**

Payloadhq/payload-flow(0★, TypeScript, MIT, 10-04 当日建→推送, 49 文件无二进制, README 8.7KB)恶意 grep 零命中、Infrai×0、托管 API+Sandbox 双入口真实。

风控视角:规则引擎的"权益分配"问题域是风控规则引擎的对偶面——风控规则引擎回答"这笔交易放不放",RevRule 回答"这笔收入归谁":共享的工程内核是版本化规则+确定性求值+审计轨迹(谁在哪个规则版本下被分配/被拦截同样可回溯);"remainder 守恒"的显式验证对风控直接可借——限额与冻结资金的守恒校验(每笔冻结必有去向:解冻/扣款/核销,零悬置)是资金侧合规检查的形式化表达;跨轨(cross-rail)抽象把 Stripe/x402/银行轨统一进一张规则图,与 payments-agent-audit[10-04] 的"轨终局性"分层互补:前者管分账语义、后者管控制时相。⚠️ 0★ 当日仓、收入分配域非风控域(范式迁移价值为主)、托管 API 的合规属性未声明。与 风控策略 规则引擎章节相关。→ GitHub

api-evangelist/koin(610KB)/incognia(219KB)/forter(455KB, README 11.4KB)/tongdun(480KB)等,恶意 grep 命中均为反冒充声明本身("never ask you to download"),Infrai×0。

风控视角:两层信号叠在一个仓族上:① 商业风控 API 生态的免费图谱——Forter(订单级 trust-or-not 决策)、Incognia(位置指纹 risk assessment)、Koin(拉美 BNPL 反欺诈)等头部供应商的端点/认证/定价结构被统一格式化归档,做供应商选型或"商业产品能力对标"时是现成的一手参照(对照国内同盾档案:品牌已切换为小盾未来,公开 API 面收缩——国内风控 SaaS 生态的一枚时代注脚);② 反冒充 banner 是对"下载链接型恶意仓"瘟疫的直接防御响应——与本栏 41 例恶意仓监控同源同型:合法文档仓开始显式声明"我们永远不会给你下载链接",这句话本身已成为区分合法档案仓与载荷仓的高质量负向指纹(恶意仓 README 的主 CTA 恰恰总是下载)。⚠️ 档案由单人维护、非厂商官方(准确性以厂商文档为准)、部分档案滞后于产品迭代。与 反欺诈体系 商业产品章节、实时风控引擎 供应商对标相关。→ Koin、Forter

6. Babu3097/payments-fraud-lakehouse — Databricks 湖仓欺诈监控教学管线:PaySim→Auto Loader 增量→ medalion 三层→星型模型→对账门禁(Python+SQL(无 license,10-04 当日建+推送,0★,198KB/60 文件 sql×21+py×12,README 3.5KB+CI badge 真实)——phases 0-5/7 完成(tooling/repo skeleton/bronze/silver/gold/自动化):PaySim 合成移动货币数据+Python 日增生成器+英国银行假日参照 API;对账即门禁:"do the totals in gold match the raw source? (the run fails if not)"——gold 层与原始源总额不符则 CI 失败)【信号:★(教学参照)】**

Babu3097/payments-fraud-lakehouse(0★, Python, 无 license, 10-04 当日建→推送, 60 文件无二进制)恶意 grep 零命中、Infrai×0。

风控视角:湖仓架构(medallion bronze/silver/gold)做欺诈监控的最小完整教学样板——fraudshield[10-01]/payment-risk-engine[今日 #3] 是"流式检测"视角,本仓补"分析型监控"视角:欺诈率按交易类型/金额带/时段的下钻、异常客户/商户规则标记——两条视角正是生产风控的批流双链;对账即 CI 门禁是把数据质量做成可执行约束的干净示范(风控特征平台的特征回溯性争议大半源于缺这道门)。⚠️ 0★ WIP(5/7 阶段)、教学级、PaySim 合成数据、无 license。与 实时风控引擎 批链相关。→ GitHub

7. TinkerAILab/uk-company-risk-pipeline — 英国 Companies House 全量 570 万企业→可解释支付风险评分:逾期申报作为清算/破产前导信号(Python(无 license,10-01 建→10-04 推送,0★,13KB/10 文件 py×7 极简管线,README 2.6KB)——作者来自信贷催收一线(credit control);双摄入(REST API 增量+月度快照 5.7M 行 bulk CSV→Parquet 411MB 压缩 85%)+14 种不一致状态标签归并为 5 类+数据质量自动检查;已披露发现(10-01 快照):仅 1.8% 的活跃公司逾期申报财务账目,而面临强制除名的公司中 58%、清算中的公司中 89% 逾期——逾期申报是经营恶化的强前导)【信号:★(邻近域 ⚠️)】**

TinkerAILab/uk-company-risk-pipeline(0★, Python, 无 license, 10-01 建→10-04 推送, 10 文件无二进制)恶意 grep 命中为企业数据下载指引(合法语境)、Infrai×0。

风控视角:B2B 信贷风控(企业客户"会不会按时付款")的公开数据实现样本——与消费信贷欺诈域互补:570 万企业的申报行为序列是免费的公开特征源,"逾期申报→清算"的 1.8%→89% 分层是教科书级的单特征区分度披露(比多数模型指标更有迁移价值);对供应链金融/商户准入场景,"gov 注册行为健康度"是与交易流水正交的特征族。⚠️ 邻近域(非交易反欺诈)、13KB 原型体量、评分模型本身尚未出现在树内(pipelines 先行)、无 license。与 风控模型 特征工程章节相关。→ GitHub

8. 威胁情报专题 — 恶意仓家族第 4 次隔日交替触碰(A 对 2m42s 紧窗回归)+8 载荷字节全稳+第三字节带(466KB)登记+argus 第 9 期+复活仓第 5 次推送(① 隔日交替第 4 次确认:B 对(trade-intel+deepguard)10-03 07:28 35s 紧窗→A 对(Zen7+TRDGNN)10-04 06:48:10Z/06:50:52Z=2m42s 紧窗——09-30 全家族同日异常后,隔日单对+紧窗纪律完全归位(紧窗第 23/24 次观测保持);② 8 载荷字节全稳:Zen7 双载荷 1,394,759/584,580B+TRDGNN 三载荷 1,394,742×2/587,686B+trade-intel 531,063B+deepguard 538,362B+edge-upi 585,382B+firefox 492,541B+Muhafiz 489,945B 全部 HEAD 200 与基线一致——同日高频触碰+载荷零变动=纯搜索排名维护;③ 第三字节带登记:Amy7007/VPN-Detector 载荷 Detector-VP-consulate.zip 466,717B——与 hypopigmentationnudemouse124 的 462,519B 构成 466-463KB 新带(第 3 条字节指纹线,继 585KB±2KB 主带、firefox 492KB 带之后),同带异主=同构建工具链的又一线索;④ argus 诱饵第 9 期:README 8,441B 逐字节一致(Lexi×13);⑤ 复活仓第 5 次推送:Cardinalfishepitaph683 pushed_at 10-04 23:19:20Z(连日高频推送)+载荷 src/fraud_credit_card_detection_3.5.zip 584,990B 200 不变——复活→再维护态持续,静置判定标准不变;⑥ api-evangelist 反冒充 banner(见 #5)——合法生态对"下载链接 CTA"模式的显式防御开始出现)【信号:★★★(威胁情报)】**

验证实录(cron 主会话批量脚本 data/verify_risk_2026_10_05.py + _p2-p4,约 65 API/HTTP 调用):14 候选仓 metadata+/readme raw 端点+恶意模式 grep+Infrai 计数;7 选中仓 git trees recursive 全树走查(fraudsentinel 77 文件/payload-flow 49/PR-engine 60/lakehouse 60/uk-risk 10/oddsmaker 1,068/LoanDecisionApi 66——二进制逐一判成因);oddsmaker README 风控章节+技术栈抓取(Flink/Kafka/ClickHouse 证实);LoanDecisionApi publish.zip 成因判定(commits API:10-02 "Preparing GitHub Actions" 早于 README);4 watch 仓 commits 触碰窗口+载荷清单;8 zip HEAD 字节核对(8/8 200 全一致);CCFD 复活仓+argus 复测;VPN-Detector/hypopigmentationnudemouse124 载荷抽查;HN Algolia 7 日补查 0 入选;arXiv 直查 14 篇全已采(0 新增)。风控视角:监控语义两条沉淀:① 隔日交替节奏在第 4 次观测后升级为稳定运行假设(非"预测"):登记窗口+载荷字节即可,节奏漂移(宽窗/同日/缺勤)才升级调查——09-30 式全家族同日仍视为单日异常直至再现;② 字节带聚类正式三线并行(585KB 主带/492KB 带/466-463KB 新带)——"同带异主"作为同工具链指标的判例+1;LoanDecisionApi publish.zip 是"树内 zip 需逐个判成因"的反面判例:4.6MB 部署产物≠载荷,判据是提交时间线+README 指令语义而非"有 zip 即恶意"。已链接仓库名仅作威胁情报引用、永不作技术引用。→ deepguard(勿用)、Zen7(勿用)


技术趋势

  • 欺诈调查 agent 的治理壳三代收敛:ojuri[09-28] 报告代写 → RazorRisk[10-02] 证据工具+独立复核 → fraudsentinel[今日] 编排+验证+三路路由——三家互不知情却共享同一架构判断:"agent 输出不可信"是第一假设,行动面永远留给确定性规则+人类角色。
  • 实时风控的开源供给两级齐备:教学级(payment-risk-engine Java 四件套、lakehouse 批链)到平台级(oddsmaker 1,068 文件 Flink+Kafka+ClickHouse 全栈)——个人开发者可走读的完整参照链形成,Java 系缺位被补上。
  • 规则引擎的问题域在对偶面扩张:RevRule(收入分配:remainder 守恒)与 ipo-proof[10-04](申购资格:attestation)把"版本化规则+确定性求值+审计"内核带出风控域——内核相同、守恒对象不同。
  • 合法生态开始主动反冒充:api-evangelist 15 库统一加装反下载 banner——"下载链接 CTA"作为恶意指纹被社区反向收编,威胁情报与开源治理开始共享同一判据集。

行业案例

  • 游戏行业的风控内建平台(oddsmaker):单公司部署+game_id+environment 隔离边界——游戏数据基础设施把风险控制列为与 analytics/experimentation 并列的一等能力,营销反作弊(广告奖励异常)与支付风控同引擎。
  • 英国公司注册数据的一线信贷实践(uk-company-risk-pipeline):信贷催收从业者用公开 Companies House 数据自建客户健康度评分——公开 gov 数据+一线经验的个人数据工程样本。
  • API Evangelist 的生态档案模式:独立第三方对商业风控 API surface(Forter/Incognia/Koin/同盾)的标准化 profile——供应商选型信息的中立化基础设施。

值得深入

  • fraudsentinel 四 agent 的分工与验证器判据:README 未展开的编排细节——专家 agent 的输入隔离(脱敏证据如何防串供)是治理壳的关键未读面。
  • oddsmaker 实时检测链路:Flink 作业的规则/模型分布与"账号/设备/IP 聚集"的具体实现(593 个 Java 文件中的风控模块走读)。
  • uk-company-risk 的评分模型落地:树内尚无模型文件——申报行为特征族的后续工程(14→5 状态归并之外的第二期)。
  • 字节带 466-463KB 的成员增长:新带第 3 例后观察是否吸引更多同带载荷入栏(同工具链聚类假设的检验窗口)。