2026/08/14发布
三个月前我调了整整一周的Attention mask,今天把Transformer原理、原生多头注意力与Flash Attention的完整对比
2026/08/14发布
信用卡欺诈真实数据实测:SMOTE、随机欠采样、class_weight三种方案在F1与PR-AUC上的差距。附可直接运行的sklearn/im
2026/08/14发布
全参微调7B模型显存爆炸(105GB+),换成QLoRA只用了7.7GB。本文用ChatGLM2-6B实测数据说话,讲清楚LoRA原理、三种微调
PHP
2026/08/14发布
一次压测事故引发的PHP运行模式深度对比。用QPS、内存、延迟数据说话:PHP-FPM在8000 RPS时CPU打满,Swoole冲到45000
2026/08/14发布
线上Redis集群缓存穿透事故复盘,手写LRU与LFU两种淘汰算法,JAVA8实现+PHP调用压测。QPS从5800提到12000,缓存命中率从