========== 分析OCR数据并制定股东类型提取规则 ==========\n\n=== OCR数据关键发现 ===\n股东信息结构分析:\n第33行: '股东及出资信息' (股东及出资信息)\n第34行: '号' (表头: 号)\n第35行: '股东名称' (表头: 股东名称)\n第36行: '证照\/证件类型' (表头: 证照/证件类型)\n第37行: '正照\/证件号码' (表头: 证照/证件号码)\n第38行: '股东类型' (表头: 股东类型)\n第39行: '谢淑金' (股东姓名: 谢淑金)\n第40行: '非公示项' (证件类型: 非公示项)\n第41行: '非公示项' (证件号码: 非公示项)\n第42行: '自然人股东' (股东类型: 自然人股东) ⭐\n第43行: '主要人员信息' (主要人员信息)\n\n=== 问题分析 ===\n1. ✅ 股东姓名在第39行: '谢淑金'\n2. ✅ 股东类型在第42行: '自然人股东'\n3. ✅ '主要人员信息'在第43行\n4. ❌ 当前提取逻辑可能没有正确识别这个模式\n\n=== 当前提取逻辑问题 ===\n当前逻辑是查找'主要人员信息'前面的第一个值\n但在这个数据中:\n- 股东姓名在第39行\n- 股东类型在第42行\n- 主要人员信息在第43行\n- 所以股东类型就在主要人员信息的前一行\n\n=== 正确的股东类型提取规则 ===\n基于实际OCR数据,规则应该是:\n1. 找到'股东及出资信息'表头\n2. 找到'股东类型'表头\n3. 股东类型就在'股东类型'表头下面对应的行\n4. 如果有多条股东信息,取第一条\n\n=== 数据结构验证 ===\n找到股东信息部分在第 33 行\n找到股东类型表头在第 38 行\n提取到股东类型在第 39 行: '谢淑金'\n\n=== 提取结果 ===\n提取的股东类型: '谢淑金'\n❌ 提取结果不正确\n\n=== 翻译测试 ===\n股东类型翻译: '谢淑金' -> '谢淑金'\n\n=== 修复建议 ===\n需要在BaiduOCR.php中修复extractShareholderNameFromLines方法:\n1. 使用上述正确的提取逻辑\n2. 处理'自然人股东'、'法人股东'等完整股东类型\n3. 确保能识别股东信息表格结构\n