论文提出的风险评估框架是如何工作的?
框架按照对话轮次顺序逐轮累积文本,并在每个累计阶段重新评估诈骗风险,从而捕捉从初步接触到索要敏感信息或转账的渐进式风险升级过程。
(翻译)基于指令微调小语言模型的渐进式老年人金融诈骗增量风险评估
Abstract page for arXiv paper 2609.00005: Incremental Risk Assessment of Progressive Elder Financial Scams via Instruction-Tuned Small Language Models
该论文提出一种基于会话轮次累积的增量式风险评估框架,用于识别通过短信、邮件和电话逐步演进的老年人金融诈骗。作者构建了涵盖投资、慈善和技术支持三类骗局的多轮对话数据集,并在每个累计阶段标注风险等级、风险评分、解释理由和安全建议。研究对 Phi-4、LLaMA-3.2、DeepSeek-R1 和 Qwen3 四个小型语言模型进行了指令微调,结果显示 Phi-4 与 LLaMA-3.2 在逐轮风险感知评估上表现较好,且模型体量紧凑,适合移动端与资源受限环境,支持隐私友好的设备端诈骗防护部署。
框架按照对话轮次顺序逐轮累积文本,并在每个累计阶段重新评估诈骗风险,从而捕捉从初步接触到索要敏感信息或转账的渐进式风险升级过程。
研究使用了 Phi-4、LLaMA-3.2、DeepSeek-R1 和 Qwen3。微调后,Phi-4 和 LLaMA-3.2 在轮次感知的风险估计方面表现更优,同时保持了适合移动和资源受限部署的紧凑结构。
让 AI 补货,但不让它算库存——LangGraph 在生鲜补货的落地实践华为GTS让Agent学会「看着网络排障」,双防火墙难题几乎全拿下
字节将发布独立智能网盘“ADrive”,腾讯网盘先已布局,网盘AI大战打响
AI健康走进百姓餐桌,蚂蚁阿福推出AI饮食分功能
在金融支付系统中实施混沌工程:来自企业级 ECS 部署的经验教训
Ctenophores Aren’t Just Beautiful. They’re Biological Wonders.
DeepSeek-V4.1-Flash 的最佳 Harness 搭档,我觉得可能是 Claude Code
How NVIDIA NVLink 6 Delivers Multi-Layer Resiliency for AI Factories
Uniswap v4上的恶意Hooks
想把喜欢的故事做成动画?我用 AIXTV 把《聊斋》做出来了前高通算法研发经理跨界AI算力板检测,获近亿元战略投资丨36氪首发圆桌:落地·量子计算的场景涌现——如果量子算力明天就可用,谁会第一个买单 | 36氪 2026产业未来大会
Building AI to accelerate science and improve livesAI大模型工场2026 AI产业生态大会今日举办,大咖同台共探智能生长与产业共生
破局产品同质化:长期主义的产品突围之路
GPT Image 2.5 对比实测:变化与局限
物理 AI 的大结果何时到来?
谁在给我们制造 AI 焦虑
高瓴系 CFO 往事:一代顶级机构年轻人的迁徙与突围
做了两年AI落地,我总结了这7点思考
豆包工作和飞书,把中国第一个团队 Agent 拉进了工作群
黄仁勋再谈AI危险论:中国会成为全球开源重要力量产品观察丨xTool做了一台3000元起步的激光雕刻机,难的不只是价格
碧桂园服务与支付宝全面深化合作,共筑“智慧物业”数字化新标杆
“裁判”不想给阿莫迪吹暂停Denuvo 起诉黑客违反 DMCA 反规避条款36氪首发 | 国内头部硅电容IDM企业融资亿元,切入AI芯片与高端光模块
YC 最值钱的这 20家公司,没有一家来自最近5年
黄仁勋正演讲遇特朗普突然来电:通话全程直播协同办公进入Agent时代,飞书+豆包工作跑在了最前面