风控日报 — 2026-10-07

📊 筛选总结

  • 原料:54 条入文件 — GitHub 43 + 采集器 arXiv 11;HN / Trending 0 条通过过滤
  • arXiv:采集器 11 条全部无关(新批次 2610.068xx,10-05 提交:LLM 硬件侧信道成员推断、有向图多尺度聚类、量子干涉成像、base model token cue、人形机器人运动模仿、超表面波计算 DoA、串并视频扩散、差分隐私在线学习等已知噪声类别不重判);词组直查 15 篇 — 3 篇新采(2610.04138 HERMES 账户盗用图谱 + 2610.05379 解释保真度漂移 + 2610.05825 Quantile-TabDDPM——连续第 2 期 10 月新提交入窗)+ 12 篇已采
  • 剔除 · 已覆盖/重复 12 条:insurance-fraud-intelligence-poc[10-05 采 今日再现]、payment-risk-engine[10-05 采 隔日重推维持]、oddsmaker[10-05 采 今日再现]、T03-MuleTrace[10-04 采]、Wallet-Risk-Scanner[09-26 采 今日仍 190★]、mahima2604[09-27 剔不定论维持]、warden-desk[09-05 剔今日再现维持]、research-blei-e[07-01 剔叙事仓再现维持]、perishable-inventory[10-01 剔维持]、leyline[10-05 剔桌游维持]、FinGraph[10-04 剔过薄维持]、AI-Finance-Portfolio[10-05 剔维持]
  • 剔除 · 域外/过薄 10 条:nprox/AML-DCGAN(描述=CLIP 图像生成 GAN——AML 纯关键词碰撞)、zachstow/fraud-detection(README 0B 空壳)、Zion-support/fraud-transaction-monitor(落地页壳仓:1917B README 全外链无代码语义)、moeraza/datalchemy-site(营销落地页)、AayushH1510/portfolio-risk-engine(投资组合教学域外)、VarZ-96(描述一行过薄)、annazheng149/stochastic-pricing-engine(随机定价域外)、hoachauphuoc/vf-logistics(物流 hackathon 邻近域)、Iviwe-spot/financial-fraud-detection-mlops(仅合成数据生成器第一步无检测)、TheRealMenace10040/microqc-insight(QC 微生物 LIMS 域外)
  • 剔除 · 恶意 +0 新(累计维持 41):批次残留 7 个不重复验证(hgthangbq-lang[07-26 恶]、yoelpa6680[07-26 恶]、heydsqi-dsq[07-26 恶]、Arma8559[07-27 恶]、bintang3703[09-16 恶]、primatewakeisland574[09-19 恶]、Amy7007/VPN-Detector[07-26 恶——今日复测载荷仍 200/466,717B 活跃分发中])
  • 剔除 · astroturf +0 新(累计维持 24):今日采集流 0 例——脉冲投放静默第 2 日
  • 生态归并:api-evangelist 6 条(veriff/iovation/nivelo/zest-ai/telnyx-verify/incognia 复推)随 #7 生态条一笔带过,档案族观察满 1 周后降频
  • 筛出:1 条 ★★★ 工程 + 2 条 ★★ + 4 条 ★ + 3 条 arXiv 直查新采 + 1 条威胁情报专题(10 条)
  • 主题一 · T&S 规则引擎进入开源纪元:Discord 培育的 osprey(487★/ROOST 基金会)把"规则引擎+调查工作台"从风控域正式扩散到信任与安全域——事件到达即评估+实体标签持久化+调查发现回流为新规则
  • 主题二 · 流式支付风控的可解释 Java 参照变厚:acilione 的 Flink+Kafka+ClickHouse 五规则族(无钱款移动的明确立场)与 oddsmaker[10-05]/payment-risk-engine[10-05] 构成平台/应用/教学三级开源供给
  • 主题三 · 威胁情报转折日:恶意仓家族同日双簇触碰+全家族载荷路径轮换+4 仓消失(家族首次下架成立)——GitHub 打击与运营自保的边界首次可观测

今日高信号

1. roostorg/osprey — Discord 出身的开源 T&S 规则引擎+调查控制台:"Automate the obvious and investigate the ambiguous"(Python(Apache-2.0,2025-09 建→10-06 推送,487★,1,380 blobs:py×601+tsx×162+rs×116,README 4KB 精炼)——ROOST(Robust Open Online Safety)基金会项目,原为 Discord 内部反 spam/abuse/botting 系统开源;平台事件流接入→人写规则逐事件评估→自动动作+实体标签(label 持久化)+verdict/effects 回推业务系统;规则语言 SML(结构化规则语言)+UDF 扩展+跨事件状态追踪;调查控制台供分析师查询/图表化→调查发现转化为新规则的闭环;adopters 含 Bluesky/Discord)【信号:★★★】**

风控视角:T&S(信任与安全)域的规则引擎第一次以基金会背书+生产级体量开源——与风控规则引擎同构但场景词表不同(spam/abuse/botting vs 交易欺诈/营销作弊,bot 检测直接同域);三个可迁移设计:① label 作为规则输出的一等公民——给实体打标签并持久化,正是风控"名单/画像"语义的规则引擎原生化(命中即标记,后续规则可引用标签);② 调查→新规则的回流闭环——分析师在控制台的调查产物直接变成下一条规则,与 fraudsentinel[10-05] 的"调查 copilot"互补(那边 AI 辅助调查、这边调查产出沉淀为确定性规则);③ ROOST 基金会模式本身是信号:平台安全基础设施正在走 CNCF 式的开源基金会路径,风控中台可对照。⚠️ README 短而架构细节在 docs/(本次未逐模块走读)、SML 表达力边界未评估、"风控交易域"直接套用需二次开发。与 风控策略 规则引擎章节、反欺诈体系 bot 检测章节相关。→ GitHub

风控视角:与 payment-risk-engine[10-05] 同题但工程语义深一层的流式参照:① 五规则族是"velocity+设备+新设备大额+拒绝后批准"的经典组合,DECLINE_THEN_APPROVAL(先拒后批)是小额测试攻击(testing attack)的教科书规则,其余四仓很少显式列出;② 规则更新走 Kafka 独立流(规则即数据)——规则热更新不重启作业,是国内"规则引擎热部署"需求的最小 Flink 实现;③ event-time timers+按 key 分区状态是 velocity 类特征的正确流式姿势(对照教学仓常见的"Redis 计数器"简化);④ "只算分不动钱"的声明把风控引擎与支付执行的关注点分离写进了 README——与 fraudsentinel[10-05] 的"唯一自动动作=临时冻结"同谱系:决策引擎的行动面最小化。⚠️ 0★ 个人项目、license 字段异常(NOASSERTION)、合成数据、无压测指标。与 实时风控引擎 直接相关。→ GitHub

3. malek-alhu/marketplace-phaas-tracker — PhaaS(钓鱼即服务)基础设施追踪+套件拆解:对 Classiscam/Telekopye 级运营的可执行威胁情报工程(HTML/JS(无 license,2026-06 建→10-06 推送,0★,284 blobs:js×112+txt×103+md×14——evidence/ 目录存 urlscan JSON×2(1MB 级捕获)、kit-source/decompressed/ 存拆解后的套件 JS(1.4MB 级)——keyless 自更新 tracker 持续监控运营方的基础设施轮换(证书/域名/IP 日级轮换);覆盖 impersonating OLX/Subito/Kleinanzeigen 等 ~120 品牌、窃取全卡数据+3-D Secure/OTP;产出=IOC+套件分析+检测签名)【信号:★★(威胁情报工程)】**

风控视角:PhaaS 威胁情报的"可执行化"样本——多数 APT/钓鱼报告止步于 PDF IOC 列表,本仓把情报做成三件可运行工件:① keyless tracker(无需 API key 的自更新基础设施监控)是对抗"日级轮换"的工程答案——风控的外部威胁源建设可直接抄这个形态;② kit-source 拆解保留了混淆前后对照,检测签名可以直接对着套件源码写(对照恶意仓家族的字节带聚类:产业链两端的工程化程度在趋同);③ 3-D Secure/OTP 实时窃取意味着"有 3DS 不等于安全"——交易风控的 OTP 校验环节不能作为最终控制点。⚠️ 0★ 单人研究、无 license、品牌名均为被冒充方(注意措辞)。与 反欺诈体系 外部威胁章节相关。→ GitHub

4. FFraud-com 数据对 + Intellitrace 印证 — 开源风控数据基础设施:1.2M 恶意 IP 库+219k 一次性邮箱域名库(蜜罐 30 分钟重建、MIT 无 key),供应商文案与实际数据对齐可追溯(① ip-fraud-database(30★,MIT/NOASSERTION,06-30 建→10-06 推送):宣称 1,200,000+ confirmed-malicious IPs(C2/botnet/phishing/brute force 分类评分)——实测树内 threat-ips/confirmed-abusive.csv 38,002,977B + disposable-email-domains.txt 3,508,423B 真实落盘;② disposable-email-domains(6★同栈):宣称 219,000+→badge 实测 221,893——宣称数字与仓库 badge/文件可互相印证(数据每 30 分钟自蜜罐+社区重建);③ Shivam2005Goel/Intellitrace_hackathon(1★,TypeScript,98 blobs:tsx×48+py×23)——供应链金融欺诈 6 层图原生架构(发票指纹/物理校验/图拓扑/跨贷方匹配,FastAPI+Neo4j+Redis),README 28.9KB 详细分层叙事)【信号:★(数据基础设施+邻近印证)】**

风控视角:IP 库/邮箱库是规则引擎最底层的外部特征源,"免费+MIT+无 key+30 分钟更新"把接入门槛打到零——对照 10-05 采的 maskbreak(商业 SaaS 免费层+转化漏斗)与 api-evangelist 档案族的商业 API:风控数据供给的开源公益层正在成形(蜜罐自采数据的模式与 Spur/AbuseIPDB 同型);顺手做了一次宣称-实存核对:38MB CSV 与 1.2M 宣称量级一致、badge 数字 221,893 与 README 219k+ 一致——数据源尽调的最小动作就是"拉下来数一遍"。Intellitrace 的 6 层架构叙事(发票指纹→物理校验→图拓扑→跨贷方)是供应链金融欺诈这个稀缺域的形态参照(⚠️ hackathon 仓、0★、合成 demo 数字为 badge 装饰)。与 实时风控引擎 特征源、反欺诈体系 数据基础设施相关。→ ip-fraud-database、disposable-email-domains、Intellitrace

5. vinaykumar101997/Fintech-Fraud-Auditor-Pro — AML 审计流水线:规则→统计→图→AI→合规官,SAR 草稿必须人类批准+全决策审计日志(Python(MIT,09-22 建→10-06 推送,0★,40 blobs:py×25 无二进制)——银行交易账本输入:快速规则+统计筛出可疑→AI 模型对照 AML 指引复核→合规官批准后才起草 SAR(Suspicious Activity Report)→每条决策入 audit log;README 立场:"Having an AI model review every one would be slow and expensive"——AI 只审规则精选后的子集)【信号:★(AML 治理壳 +1)】**

风控视角:"agent/LLM 输出不可信"治理壳谱系的 AML 域第 4 例——ojuri[09-28] 报告代写→RazorRisk[10-02] 证据工具→fraudsentinel[10-05] 编排+三路路由→本仓 AI 只读精选子集+SAR 人类门禁:四家共享同一架构判断(ML 不做终审、行动面留给人),差异在 AI 的权限位置(本仓最保守:AI 只是复核员)。漏斗式成本叙事(规则筛选后才过模型)是 AML 高误报场景的正确算力分配。⚠️ 0★、MIT、40 blobs 原型体量、图分析深度未披露。与 风控策略 AML 章节相关。→ GitHub

6. plx/ferric-rules — Rust 重写的 CLIPS 兼容前向链规则引擎:deffacts/defrule/salience/Rete 全保留,无全局状态可嵌入(Rust(10-06 推送,0★,README 10KB)——"CLIPS battle-tested but it's a C library with global state, which makes it awkward to embed":保留 deffacts/defrule/salience/完整 Rete join 网络/modules+focus stacks/deffunction/defgeneric/CLIPS 标准库(math/string/multifield/predicates);去掉全局状态与线程不安全单例——每个 Engine 实例完全独立;编译为 Rust crate 或 C 库(ffi);嵌入包 TypeScript/Python 就位;明确不支持 COOL 对象系统;logical dependencies 尚未实现)【信号:★(规则引擎基础设施)】**

风控视角:1980 年代专家系统引擎的现代化移植,对风控规则引擎的"嵌入形态"是直接参照——国内风控规则引擎多为"平台侧 Web 配置+下发"形态,ferric-rules 代表另一极:进程内嵌入式(毫秒级、无网络、随应用分发)——对应端上风控/SDK 风控(设备侧预筛)与低延迟场景(对照 InputLayer[10-06] 的进程内活规则层);salience(规则优先级)+focus stack(模块焦点)是 CLIPS 四十年沉淀的规则组织语义,比多数自研规则引擎的"优先级数字"更成熟。⚠️ 0★ 早期("functional but early")、logical dependencies 未实现(真依赖语义缺失影响规则撤销类需求)。与 风控策略 规则引擎章节相关。→ GitHub

7. api-evangelist 生态简报 — veriff(身份验证+PEP/制裁筛查)/ iovation(TransUnion TruValidate 设备指纹)/ nivelo(工资支付风控)/ zest-ai(信贷风控 AI)/ telnyx-verify(电话验证 2FA)+ incognia 复推:商业风控 API 图谱本周新增 6 个档案(Markdown 档案(0★,10-06 同日推送,全部带反冒充 PROVENANCE banner)——档案族 10-05 专条后转入低频观察:名单型更新,不再逐条展开;顺带归并今日 raw 中的 6 条 api-evangelist 复推)【信号:★(生态图谱·降频)】**

风控视角:本周新增档案恰好补齐身份验证供应商面(Veriff 文档+生物识别+PEP 筛查、Telnyx 电话验证、iovation 设备指纹)——KYC/身份验证是风控栈里供应商集中度最高的环节,档案化对照可直接用于选型。观察满 1 周后本栏对该家族降频为简报(名单型更新无新语义不展开)。→ veriff、iovation

8. arXiv 2610.04138 — HERMES:账户盗用(ATO)检测的双尺度关系图 transformer——局部会话图×全局生态气候 token,130M 会话生产数据(10-02 提交(美国金融机构实操论文)——生产系统用表格模型逐会话打分丢弃关系结构;HERMES = Micro-GT(会话周边时序安全邻域的关系感知 attention)+ Macro-GT(non-anticipative climate tokens 概括欺诈动态/平台漂移/基础设施复用 + 自适应类原型追踪欺诈/良性模式演化);1.3 亿+高风险交易会话评估:客户摩擦 -44.44%、欺诈召回 +24.66%(vs 生产系统))【信号:★★★(生产级图谱检测)】**

来源:arXiv:2610.04138。风控视角:ATO 域第一篇"双尺度"架构的生产级量化——直查通道连续第 2 期破冰后的重磅:① "局部关系×全局生态"的分解回答了图风控的老问题(GNN 只看邻域会漏"平台级欺诈潮")——climate token 用非预期性(non-anticipative)约束保证无未来信息泄漏,是时序图特征工程里少见的显式防泄漏设计;② 优化目标是摩擦-召回双降(-44% 摩擦同时 +25% 召回)而非单 AUC——与生产风控的真实优化函数一致(误报成本=客户摩擦);③ "基础设施复用"作为宏观 token 的输入语义,与设备指纹/代理检测的特征族相通。⚠️ 单一机构数据、复现依赖其内部生态状态定义。与 风控模型 图模型章节、反欺诈体系 ATO 章节相关。→ arXiv

9. arXiv 2610.05379 — 解释保真度会在数据漂移下衰减:IEEE-CIS 上的受控实验——"解释是绑定模型的工件,需要独立监控"(10-04 提交——模型性能监控是标配,解释保真度极少被同样纪律地监控,即使金融/医疗等受监管域;IEEE-CIS 交易欺诈数据集上:统计显著协变量漂移+无可检出概念漂移的受控设定;ExIFFI 生成局部解释,三层评估(路径有效性/结构行为/干预下保真度);结论:旧解释对新模型仍保持决策相关性,但保真度一致地低于新解释;结构稳定性≠功能保真)【信号:★★(模型治理实证)】**

来源:arXiv:2610.05379。风控视角:给"模型可解释性义务"补上了时效维度——监管复查常问"当年为什么拦这笔",本篇实证说明模型重训后旧 SHAP/旧解释不再忠实:解释必须与产生它的模型版本绑定存档(解释工件版本化),且解释质量要进监控大盘(不只是性能指标)。与 iseqlplus[10-06] 的特征出处账本互补:那边管特征定义可追溯、这边管解释结论可追溯——两者合成特征平台治理的完整版图。⚠️ 单数据集(IEEE-CIS)、ExIFFI 单一解释方法、"无系统性扩大的差距"是有限窗口结论。与 风控模型 可解释性章节相关。→ arXiv

10. arXiv 2610.05825 — Quantile-TabDDPM:分位数正则化扩散模型做极端不平衡表格数据合成——重尾少数类(欺诈样本)的合成增强(10-05 提交——高不平衡分类(FinTech/医疗)中,标准扩散模型的二次误差损失缺乏对稀有极端值的结构敏感;提出 quantile-regularized denoising objective(二次损失+分位数损失项)显式捕捉稀有事件、保留原去噪目标理论性质;真实信用卡交易数据集(极端类不平衡)上验证)【信号:★(样本增强技术面)】**

来源:arXiv:2610.05825。风控视角:欺诈检测的类不平衡军备库里多了"分位数感知扩散"一档——SMOTE→CTGAN→TabDDPM→分位数正则化的演进主线是"合成器对重尾的敏感度";对欺诈样本天然重尾(金额/频率长尾)的交易域,损失函数层面修正是比采样层面更干净的干预。⚠️ 单数据集、合成数据用于欺诈检测有"合成泄漏→评估虚高"的经典风险(论文未讨论对抗性评估协议)。与 风控模型 样本不平衡章节相关。→ arXiv

11. 威胁情报专题 — 转折日:家族首次下架成立 + 全家族载荷路径轮换 + 双簇同日 + 4 仓消失(① 下架成立:Muhafiz 整仓 404 第 2 期(10-06 首报→今日复检仍 404)——41 例恶意仓监测以来首例下架判定成立;同日 firefox-ffa、edge-upi、argus 诱饵仓(Lexi README 10 期逐字节稳定后)三个整仓也 404 消失——单日 4 仓消失为监测以来最重;② 全家族载荷路径轮换(与 A 对触碰同晚):Zen7 README 21:54:57Z+TRDGNN 21:57:41Z 更新后,11 条基线路径中 10 条 GET 404——逐仓核对新 README CTA:Zen7→Sapharensian/Zen_Payment_Agent_v1.7.zip(584,580B 与旧 p2 字节完全一致)、trade-intel→tests/intelligence_graph_trade_v2.2.zip(531,063B 同字节)、deepguard→src/deepguard/templates/Software_3.2.zip(538,362B 同字节)、TRDGNN→configs/Software-v1.4.zip 路径存活但字节 1,394,742→587,686(同路径换内容,名义 v1.4 装载原 v1.6 字节——路径不变载荷换是更隐蔽的轮换变体);③ 双簇同日:B 对(trade-intel 06:09:03Z+deepguard 06:08:30Z)晨窗+A 对(Zen7 21:54:57Z+TRDGNN 21:57:41Z)夜窗——09-30 全家族同日后第 2 例非隔日、首例"晨 B 夜 A"分簇;复活仓 10-05 推送后静默、载荷 584,990B 200 不变;④ 基线脚本笔误自证:VPN-Detector "404" 复查发现 10-06 基线把路径误写为 docs/(真实路径在 detector/src/main/java/com/cherepavel/vpndetector/detector/ 深嵌 7 层)——实测 200/466,717B 未变,印证"基线必须逐字复制脚本"纪律(10-06 教训的正面闭环);⑤ 存活家族 9→4+复活仓,载荷二进制全家族未变(585KB±2KB 带成员依旧),变的是路径与清单)【信号:★★★(威胁情报)】**

验证实录(批量脚本 data/family_watch_2026_10_07.py + followup/fixup×2,约 75 API/HTTP 调用;新基线已注册:Zen7=v1.7.zip 584,580B、trade-intel=v2.2.zip 531,063B、deepguard=Software_3.2.zip 538,362B、TRDGNN=Software-v1.4.zip→587,686B 名义陷阱备注)。风控视角:监控语义三条沉淀:① 下架+轮换+同日触碰并存的语义解读:GitHub 平台打击(4 仓消失,含 10 期稳定的 argus 诱饵)与运营自保(载荷路径全迁、README 重写)首次在同日可观测——"字节带不变只迁路径"表明载荷供给未升级、分发面在收缩重构,与 10-06 的"收缩阵线"假设一致;② 同路径换字节(TRDGNN v1.4)进入轮换变体清单:基线核对必须字节而非仅路径——路径 200≠载荷未变;③ 双簇分窗(晨 B 夜 A)若复现,"隔日交替"模型升级为"日内双窗"模型(登记不建模,下期看)。已链接仓库名仅作威胁情报引用、永不作技术引用。→ deepguard(勿用)、Zen7(勿用)


技术趋势

  • T&S 基础设施开源化:osprey(Discord→ROOST 基金会)证明反滥用规则引擎可以走基金会开源路径——风控规则引擎的"事件→规则→标签→调查→新规则"全闭环第一次有 487★ 级的公开参照。
  • 流式风控 Java 参照三级供给成形:oddsmaker[10-05](平台级)→acilione(应用级,规则热更新走 Kafka)→payment-risk-engine[10-05](教学级)——Flink+Kafka 栈的可走读梯度完整。
  • 图风控的"双尺度"化:HERMES 的 micro-GT×macro-GT(局部关系+全局生态气候)给出 GNN 风控从"会话图"升维到"生态感知"的架构模板,且优化目标对齐生产的摩擦-召回双降。
  • 解释治理的时效维度:2610.05379 实证"解释随模型重训衰减"——解释工件版本化+解释保真度监控进入模型治理清单(与特征出处账本合流)。
  • 威胁情报:家族转折日(下架成立+载荷路径全轮换+同路径换字节变体);同路径换字节提示基线核对必须字节级而非路径级。

行业案例

  • Discord 的反滥用体系外溢(osprey):内部 T&S 系统经基金会开源,adopters 已含 Bluesky——平台安全基础设施的"开源-基金会-多租户"路径有了第一个大规模样本。
  • PhaaS 运营的工程化对抗(marketplace-phaas-tracker):~120 品牌冒充+3DS/OTP 实时窃取的运营,被 keyless tracker+套件源码拆解对等反制——威胁情报工程的对称性样本。

值得深入

  • osprey 的 SML 规则语言与状态模型:跨事件状态追踪的实现(1,380 blobs 中的核心模块)——label 生命周期与规则引用语义。
  • HERMES 的 climate token 构造:非预期性约束的形式化定义与基础设施复用特征的输入清单(论文附录级走读)。
  • 双簇分窗假设:晨 B 夜 A 的分窗若连续 2 期复现,家族节奏模型从"隔日交替"升级为"日内双窗"。
  • TRDGNN 同路径换字节的载荷比对:新 587,686B 与原 v1.6 是否逐字节一致(下载哈希比对——仅威胁情报用途)。