风控日报 — 2026-09-04

📊 原料:41 条入文件(GitHub/HN/Trending 33 条 + arXiv 8 条全部无关——新批次 2609.02xxx(09-02 提交日期,非缓存):WASP-195 热海王星自转轴、LLM 用户反馈信号、frb100-40 最优性证书、语音 BCI 统一度量、判别式世界模型 web agent、2D 光催化剂 PBE 赝金属度修复、SolarWM 长时程视频世界模型、光机械超混沌。arXiv 全噪声小计:连续 39 期(07-17→09-04)全噪声,累计 824 条中 1 条相关,噪声率 99.9%。剔除构成:12 条已覆盖/重复(phaas-tracker[08-14 已入图]、justcheckingmate 三见、FFraud-com×2 四见、RecoverAI、TemporalStore、obligation-net-optimizer、portfolio-risk、warden-desk、Fraudora-Sentriq[09-01 已剔]、AML-Graph-Fraud-Detection[昨日 ★★ 已入图]、gnn-ieee、phase 游戏规则引擎)+ 4 个已确认恶意仓库残留不重复验证(VPN-Detector[07-26]、defi-risk-screening[07-26]、payment-channel-guide[08-09]、upi-fraud-gnn[07-26])+ 5 条域外/厂商 stub/关键词碰撞(classmesh 课堂签到、perishable 生鲜库存、socure-docv 厂商 SDK、gheisenberg/AML 机器学习课程碰撞)+ 3 条过薄/空仓(real-time-transaction-risk-engine- 零文件、UPI-Fraud-Detection-System 2 commits 空 README、RazorShield 2 commits 自认"not yet implemented"且图+LLM 调查概念已被 governor/GangZero 线覆盖)+ 1 条同质剔除(Riskora 混合决策管道族第 6+ 例)+ 1 个新确认 astroturf(MatsJohansson2781/fintech-sms-risk-alerts:README 全文实为 Infrai SMS API 教程+INFRAI_API_KEY 推广——08-19 NilsBerg9082、08-28 ArjunPatel3961 同模式第 3 例)。今日 0 新确认恶意仓库(09-02 后重新起算 2 日),累计维持 21 个。今日筛出 6 条高信号(7 个仓库,virtualryder 两仓同治理核合并一条)。今日主题是"自评不合格"与"治理核跨域泛化":Card-Testing-Sentinel 把 stress 评估的最终裁决 MIXED 和 production ready: false 直接写进项目快照表——诚实申报从"声明局限"进化到"自评不合格";virtualryder 用同一套版本化治理核(Cedar deny-by-default+人工签署门+WORM)横跨福利与药物警戒两个法定裁量域——"LLM 永不决策"纪律第一次成体系地离开金融场景。


今日高信号

1. Card-Testing-Sentinel (nirajj12) — 授权前拦截 card-testing:把"自评 MIXED"写进项目快照(Razorpay AI Buildathon 2026 Track 02;检测点在 Razorpay order 创建之前(pre-authorization);44 个因果行为信号来自设备上的历史尝试序列;HistGB Model v3.1+Policy v2;stress 评估四指标:攻击 REVIEW+ recall 96.40% / 正常用户 REVIEW+ 20.72% / 正常 BLOCK 0.16% / stress PR-AUC 0.6470;最终裁决列直接写 MIXED、production ready: false;280 Python+69 前端测试通过;Railway live demo 200)【信号:★★★】

nirajj12/Card-Testing-Sentinel(0★, Python/FastAPI/React 18, 08-25 建→09-03 推送, 38 commits, MIT, 17MB)攻击的靶心是 card-testing 序列:单笔失败不可疑,"连续拒付+快速换卡+session churn+bot 探测"的序列才可疑——所以模型读的是同设备早前尝试的可信历史,不是当前单笔。README 快照表把评估当成一等公民:四个 stress 指标与"最终裁决 MIXED/production ready false"并排列出。

风控视角:"评估即证据链"谱系(08-26 预注册→08-27 conformal→08-28 对抗逃逸→08-29 监控自审计→今日自评不合格)的新台阶——主动给自己的系统打 MIXED 是第一次见;96.4% 攻击召回的代价是 20.7% 正常用户进审查(摩擦率明示),这正是"告警量=运营成本"的诚实表达。事前拦截窗口(order 创建前)与国内"支付前风险 interception"同构。与 实时风控引擎 的决策点位和 反欺诈体系 的 card-testing 相关。→ GitHub

2. virtualryder 治理核家族(benefits_eligibility_agent + pharmacovigilance_agent)— "LLM 永不决策"成体系跨出金融(同一版本化 governed-core 横跨公共福利与药物警戒两个垂直;Cedar deny-by-default+forbid-wins;人工签署门(caseworker commit 每一个裁定);no_self_commit/no_self_fraud_referral 工具级拒绝(LLM 发起即被拒);不利裁定强制 advance-notice HOLD——"平台保护正当程序,而非模型";fail-closed PII 掩码先于审计;WORM 防篡改审计;kill-switch 29/29+按租户预算 24/24 门实测;benefits 96 commits v0.4.0-pilot-rc1(09-03)+ pharma 51 commits v0.3.0-pilot-rc1)【信号:★★★】

virtualryder/benefits_eligibility_agent(0★, Python/CDK, 07-17 建→09-03 推送, Apache-2.0, 96 commits)与 virtualryder/pharmacovigilance_agent(0★, 同栈, 07-18 建, 51 commits)是"Governed Agent Platform"的两个垂直:福利助手做资格审查+redermination+多付发现准备(PILOT-SCOPE 明列"永远不会做"清单:不裁定、不利动、不涉欺诈转介、不写系统记录——每条都对应一个 Cedar 工具拒绝);药物警戒 agent 做 ICSR 上报+ICH E2B(R3) 严重性规则+"永不自行提交"。AgentCore Gateway(MCP+CUSTOM_JWT)ENFORCE 实测+teardown 留痕,governed-core 作 fail-closed 兜底+对齐 oracle。

风控视角:"LLM 决策边界"谱系(08-27 governor 架构隔离→09-02 证据 schema→09-03 代数钳位→今日跨域平台化)的第四跃迁:第一次有人把这套护栏做成可复用的治理核卖进两个法定裁量域——工具拒绝式护栏(LLM 无该工具)与 max-lattice(LLM 输出被钳位)是同一思想的两条实现路径;"advance-notice HOLD"把合规动作(事先通知期)编码成平台状态机而非流程文档。国内对应:反欺诈 SaaS 的"多行业合规等级包"思路。与 风控归因 Agent 项目 的证据约束和 实时风控引擎 的人工复核门直接同构。→ benefits · pharmacovigilance

3. luxfi/aml — Go 原生实时 AML/CFT 服务:重型平台的"轻端"样本(**167 个 Go 文件/85 commits;amld 暴露 /v1/aml/* 版本化 API;制裁名单=规范化 append-only catalog(带 SHA256 溯源,任意上游源可接入);PEP+负面新闻筛选;velocity/金额阈值限额;客户风险分层;交易前 hooks;签名 webhook 下发人工复核;case 管理;pkg/anomaly 孤立森林异常检测;多租户 iam/jwks/tenant**)【信号:★★】

luxfi/aml(0★, Go, 07-29 建→09-03 推送, 216 blobs)没有 README——AGENTS.md 只是一行 stub,真正的文档是 docs/INTEGRATIONS.md(13KB:七段集成接口规格,明确"specifies interfaces, not any particular commercial data provider")。制裁名单被建模成带 fetch 时间与 SHA256 的目录记录而非硬编码源,PEP/负面媒体/velocity/风险分层/pre-txn hooks/case 全部走统一 HTTP 面。

风控视角:AML 开源栈的"轻重两端"成形:09-02 CF-Intelligence(Python 759 commits 重型全家桶)vs 今日 luxfi(Go 微服务+接口规格先行)——同一域的两种工程哲学对照;"制裁名单=可插拔 catalog+SHA256 溯源"与 fraudshield-ml 的 checksum 快照(09-02)同属数据血统工件化线索;pre-transaction hooks 是"交易前风控面"的 Go 形态。⚠️ 无 README、license NOASSERTION、0★、无测试可见。与 反洗钱-AML 和 实时风控引擎 的服务化相关。→ GitHub

4. Muhafiz-AI (saifkhandev) — 乌尔都语诈骗文本检测:全球反诈工具的语言盲区(阿里云黑客松卡拉奇赛区作品;SMS/WhatsApp/通话录音诈骗检测,English/Urdu/Roman Urdu/Mixed 四语;Whisper STT 转写+scikit-learn 分类;FastAPI+Next.js 16 全栈;repo 内带 76KB 重训练管道 run_retrain_v3_pipeline.py+65KB/42KB 数据增强管道+进展报告 HTML/PDF+REEVALUATION_PROPOSAL 自审文档+真实数据集 xlsx)【信号:★★】

saifkhandev/Muhafiz-AI(1★, Python, 08-29 建→09-03 推送, 12 commits, MIT)的问题框架是:主流国际反垃圾工具读不懂 Roman Urdu/乌尔都语原文——巴基斯坦每年因电话/短信诈骗损失数十亿卢比,受害者集中在老人/农村/数字文盲人群。工程深度在 repo 内可证:多版重训练管道、数据集、自审提案文档齐全。

风控视角:语言覆盖=反诈能力的直接样本——国内反诈场景同构点:方言/混合语诈骗文本("Romaji 化中文""拼音缩写")同样是通用模型的盲区;"通话录音→Whisper 转写→文本分类"是语音反诈的最小可行链路。⚠️ README 宣称"99.6% adversarial accuracy"无口径(待验证)、黑客松作品、12 commits。与 反欺诈体系 的反诈电线相关。→ GitHub

5. merchant-risk-scoring (jeswintobias) — 商户入网后行为监控:商户维度第二战场(Razorpay AI Buildathon 2026;问题框架:KYC/工商登记只能证明"合法存在",无法预测"入网后欺诈经营"——坏人过完 KYC 才开始收赃/拒付/提现跑路;velocity/金额波动/卡与设备多样性/身份信号/设备熵/时间模式六类特征;XGBoost+LightGBM ensemble+SHAP 解释+LLM 起草缓解告警;处置=payout holds/reviews/account freezes;FastAPI+React/Tailwind)【信号:★★】

jeswintobias/merchant-risk-scoring(0★, Jupyter/Python, 08-30 建→09-03 推送, 11 commits, 16MB)把商户风险从"入网时一次性审查"拉到"入网后持续监控":bad actor 的生命周期是过 KYC→正常经营积累→突然收赃卡交易→chargeback 堆积→提现消失,所以监控必须吃实时交易流的聚合行为特征。

风控视角:商户生命周期风控与 09-03 adaptive-merchant-risk-engine 构成一对:adaptive 管"在营商户的个体基线偏移",本仓管"入网早期的行为定型"——两仓合起来是收单侧商户风控的完整时间轴(入网筛查→早期定型→在营基线);"LLM 只起草告警文案、处置动作是确定性 payout hold"再次落在治理线上。⚠️ 竞赛作品、0★、无 license、held-out 评估未见。与 风控策略 的商户维度相关。→ GitHub

6. wl.traders.p2p (niiikkid) — P2P/USDT 跑分平台的开源形态:风控的"对象侧"参照(Laravel 11/PHP 8.3/Vue 3/MySQL 8/Redis;744 commits/17MB 真实产品级代码量;P2P 收单+ payout+USDT 记账+商户 API(H2H+callback+请求日志)+争议(disputes)工作流+佣金结算;admin/merchant/trader/teamlead/support 五角色面板;俄语文档;"antifraud" 是 process 团队面板的一个模块)【信号:★】

niiikkid/wl.traders.p2p(0★, Vue/PHP, 09-01 建→09-03 推送, 无 license, 2200 blobs 干净无恶意文件)是罕见的"对手侧基础设施"开源样本:自建 P2P 交易平台的完整后台(订单分配/争议仲裁/佣金/多角色运营台),俄语市场语境。

风控视角:跑分平台/换币商的工程形态一手参照——国内"跑分平台"打击案例里的角色分工(商户/接单人/团队长/客服)在这里就是五个面板;从平台方视角看 disputes 工作流与 antifraud 模块的摆放位置,正是风控需求渗透进非金融平台的样本。⚠️ 俄语文档、无 license、无测试、合规风险自明(用于真实 P2P 经营的法律责任在运营者)。与 反洗钱-AML 的水房/跑分侧相关。→ GitHub


技术趋势

  • 诚实申报进化到"自评不合格":Card-Testing-Sentinel 把 stress 评估最终裁决 MIXED 与 production ready: false 写进 README 快照表——"评估即证据链"谱系五连(预注册→conformal→对抗逃逸→监控自审计→自评否决)之后,主动给系统打不合格成了新表达。
  • 治理核跨域泛化:virtualryder 一套版本化 governed-core 复用到福利/药物警戒两个法定裁量域——"LLM 永不决策"线(governor→证据 schema→代数钳位→跨域平台化)第一次成体系离开金融;工具拒绝式护栏与 max-lattice 钳位是同一思想的两条实现路径。
  • AML 开源栈轻重两端:luxfi Go 微服务(接口规格先行/167 文件)vs CF-Intelligence Python 重型平台(759 commits 全家桶)——同域两种工程哲学,选型论述有了双锚点。
  • 语言覆盖=反诈能力:Muhafiz 的 Roman Urdu 盲区直指国内"方言/拼音缩写诈骗文本"同构问题;Whisper 转写→文本分类是最小语音反诈链路。
  • 商户风控时间轴补全:入网早期定型(merchant-risk-scoring)+在营基线偏移(adaptive-merchant,09-03)——收单侧商户维度从单点走向生命周期。
  • Razorpay Buildathon 累计 7 样本(Docket/mule/adaptive/vajra/Card-Testing/merchant-risk-scoring/sentinel[同质未入])——同一赛题的多答案对照继续产出评估方法论素材。
  • arXiv 连续 39 期全噪声:新批次 2609.02xxx(非缓存)仍 100% 域外,累计 824 条中 1 相关(99.9%)。

行业案例

  • Razorpay AI Buildathon 2026 Track 02:Card-Testing-Sentinel(授权前拦截)与 merchant-risk-scoring(入网后监控)两个新样本
  • Governed Agent Platform(AWS Bedrock AgentCore):福利/药物警戒双垂直共享治理核,Cedar ENFORCE 实测
  • 巴基斯坦反诈:Muhafiz-AI 的四语诈骗文本检测(阿里云黑客松卡拉奇赛区)
  • 俄语 P2P 市场:wl.traders.p2p 的跑分平台全后台

值得深入

  1. Card-Testing-Sentinel 的 44 个因果行为信号定义与 stress 评估协议——事前拦截特征工程的可移植清单。
  2. virtualryder 的 PILOT-SCOPE.md "永远不会做"清单与 Cedar 策略对应关系——合规条款→工具拒绝的映射模板。
  3. luxfi/aml 的 INTEGRATIONS.md 七段接口规格——AML 服务对外集成的接口设计参照(制裁 catalog 数据模型)。
  4. Muhafiz 的重训练管道谱系(run_pipeline→augmented→retrain→retrain_v3)——小语种低资源场景的迭代路径。