优化尝试 #2：内联 hash_of_hash 计算
====================================

日期：2026-01-16
状态：✅ 成功

## 修改内容
将 contains_impl 中的 hash_of_hash 函数调用替换为直接内联代码：
- 消除函数调用开销
- 使用更紧凑的 h1/h2 计算表达式
- 将 f ^= ... 改为 f ^ fp == T::default()

## 理论依据
虽然 #[inline(always)] 应该让编译器内联，但手动内联可以：
1. 确保编译器不会因为某些原因跳过内联
2. 允许使用更紧凑的表达式
3. 减少临时变量的分配

## 性能结果

| 过滤器 | 查询性能变化 | 累计变化 |
|--------|--------------|----------|
| BinaryFuse8 | +0.81% | ~+6.5% |
| BinaryFuse16 | +0.82% | ~+8.6% |
| BinaryFuse32 | +0.97% | ~+4.6% |

## 结论
提升幅度较小但仍为正向，值得保留。
