统一社会信用代码批量校验工具
批量提取并验证企业统一社会信用代码
数据安全保障
此工具的所有数据处理均在您的浏览器本地完成,发票文件不会被上传到任何服务器,绝对保障您的数据隐私与安全。
工具介绍
在日常财务、开票、税务核对以及企业信息录入等场景中,经常需要处理大量的“企业税号”(即统一社会信用代码)。由于统一社会信用代码由18位字母和数字组成,人工核对极易出现少位、错位或输错字符等情况。
本工具专门为财务人员和企业信息管理人员设计,能够从大段杂乱无章的文本(如微信聊天记录、邮件、网页内容)中一键批量提取所有的 18 位信用代码,并严格按照国家标准 GB 32100-2015 的算法规则进行合法性校验,快速找出格式错误、包含非法字符或校验码错误的无效税号。
使用步骤
1. 将包含企业税号/统一社会信用代码的文本(哪怕是夹杂着其他文字的聊天记录)直接粘贴到页面上方的文本输入框中。
2. 点击“提取并校验”按钮。系统会自动运用正则算法精准提取其中的18位信用代码,并执行严格的国标算法校验。
3. 在下方的表格中,您可以直观地看到所有提取出的信用代码。系统会用绿色和红色标签明确标示出“正确”和“错误”的代码,并给出具体的错误原因。
4. 您可以通过上方的快捷按钮只看“校验错误”的数据,并一键导出完整的校验结果 Excel 表格,方便进一步的核对和处理。
知识科普:统一社会信用代码构成与校验算法
根据国家标准《法人和其他组织统一社会信用代码编码规则》(GB 32100-2015),统一社会信用代码共由 18位 阿拉伯数字或大写英文字母组成(不使用 I、O、Z、S、V,以免与数字混淆)。具体由五部分组成:
- 第 1 位:登记管理部门代码(如:1代表机构编制,5代表民政,9代表工商/市场监管等)。
- 第 2 位:机构类别代码(如:1代表企业,2代表个体工商户,3代表农业专业合作社等)。
- 第 3 - 8 位:登记管理机关行政区划码(6位阿拉伯数字,同身份证前6位)。
- 第 9 - 17 位:主体标识码(即原来的组织机构代码,9位字符)。
- 第 18 位:校验码(用于检验前17位是否输入错误)。
第 18 位校验码的计算算法:
- 字符映射:将代码中的字符映射为 0-30 的数值(0-9不变,A=10, B=11... 依次剔除I,O,Z,S,V后排到Y=30)。
- 分配权重:前 17 位字符分别对应固定的权重值:
1, 3, 9, 27, 19, 26, 16, 17, 20, 29, 25, 13, 8, 24, 10, 30, 28。 - 求和取模:将前 17 位字符映射的数值与其对应的权重相乘,然后将所有的乘积相加求和(Sum)。接着,将求和结果对 31 求余数(Mod = Sum % 31)。
- 计算校验码:校验码字符的数值 =
31 - Mod。如果该结果等于 31,则校验码数值为 0。 - 反查字符:最后,将计算得出的数值反查映射表,得到第 18 位应当是什么字符。如果计算得出的字符与用户输入的第 18 位不符,即代表该信用代码输入有误。
常见问答
Q: 为什么有些看起来是税号的数字没有被提取出来?
本工具严格按照国家标准的 18 位长度进行提取。如果文本中的税号不足 18 位,或者被拆分成了多段,工具将不会将其识别为有效的社会信用代码。请检查原始文本中的税号是否完整。
Q: 校验结果显示正确,就一定是真实存在的企业吗?
不一定。本工具的“校验正确”仅代表该代码在算法逻辑上是符合国家标准生成规则的,能够排查出绝大多数因手误导致的错填。但并不代表该企业一定在工商局真实注册,如需核实企业真实性,请访问国家企业信用信息公示系统。
Q: 工具会保存我输入的文本或提取出来的税号吗?
绝对不会。本工具的所有文本解析、正则提取和算法校验逻辑,都是通过 JavaScript 在您的浏览器本地完成的。您输入的数据不会通过网络发送到任何服务器,请放心使用。
Q: 为什么提取结果比我输入的税号数量少?
为了方便后续处理,系统在提取出所有的信用代码后,会自动进行“去重”操作。如果您输入的文本中包含多个完全相同的税号,在最终的结果列表中只会保留一条记录。
工具介绍
在日常财务、开票、税务核对以及企业信息录入等场景中,经常需要处理大量的“企业税号”(即统一社会信用代码)。由于统一社会信用代码由18位字母和数字组成,人工核对极易出现少位、错位或输错字符等情况。
本工具专门为财务人员和企业信息管理人员设计,能够从大段杂乱无章的文本(如微信聊天记录、邮件、网页内容)中一键批量提取所有的 18 位信用代码,并严格按照国家标准 GB 32100-2015 的算法规则进行合法性校验,快速找出格式错误、包含非法字符或校验码错误的无效税号。
使用步骤
1. 将包含企业税号/统一社会信用代码的文本(哪怕是夹杂着其他文字的聊天记录)直接粘贴到页面上方的文本输入框中。
2. 点击“提取并校验”按钮。系统会自动运用正则算法精准提取其中的18位信用代码,并执行严格的国标算法校验。
3. 在下方的表格中,您可以直观地看到所有提取出的信用代码。系统会用绿色和红色标签明确标示出“正确”和“错误”的代码,并给出具体的错误原因。
4. 您可以通过上方的快捷按钮只看“校验错误”的数据,并一键导出完整的校验结果 Excel 表格,方便进一步的核对和处理。
知识科普:统一社会信用代码构成与校验算法
根据国家标准《法人和其他组织统一社会信用代码编码规则》(GB 32100-2015),统一社会信用代码共由 18位 阿拉伯数字或大写英文字母组成(不使用 I、O、Z、S、V,以免与数字混淆)。具体由五部分组成:
- 第 1 位:登记管理部门代码(如:1代表机构编制,5代表民政,9代表工商/市场监管等)。
- 第 2 位:机构类别代码(如:1代表企业,2代表个体工商户,3代表农业专业合作社等)。
- 第 3 - 8 位:登记管理机关行政区划码(6位阿拉伯数字,同身份证前6位)。
- 第 9 - 17 位:主体标识码(即原来的组织机构代码,9位字符)。
- 第 18 位:校验码(用于检验前17位是否输入错误)。
第 18 位校验码的计算算法:
- 字符映射:将代码中的字符映射为 0-30 的数值(0-9不变,A=10, B=11... 依次剔除I,O,Z,S,V后排到Y=30)。
- 分配权重:前 17 位字符分别对应固定的权重值:
1, 3, 9, 27, 19, 26, 16, 17, 20, 29, 25, 13, 8, 24, 10, 30, 28。 - 求和取模:将前 17 位字符映射的数值与其对应的权重相乘,然后将所有的乘积相加求和(Sum)。接着,将求和结果对 31 求余数(Mod = Sum % 31)。
- 计算校验码:校验码字符的数值 =
31 - Mod。如果该结果等于 31,则校验码数值为 0。 - 反查字符:最后,将计算得出的数值反查映射表,得到第 18 位应当是什么字符。如果计算得出的字符与用户输入的第 18 位不符,即代表该信用代码输入有误。
常见问答
Q: 为什么有些看起来是税号的数字没有被提取出来?
本工具严格按照国家标准的 18 位长度进行提取。如果文本中的税号不足 18 位,或者被拆分成了多段,工具将不会将其识别为有效的社会信用代码。请检查原始文本中的税号是否完整。
Q: 校验结果显示正确,就一定是真实存在的企业吗?
不一定。本工具的“校验正确”仅代表该代码在算法逻辑上是符合国家标准生成规则的,能够排查出绝大多数因手误导致的错填。但并不代表该企业一定在工商局真实注册,如需核实企业真实性,请访问国家企业信用信息公示系统。
Q: 工具会保存我输入的文本或提取出来的税号吗?
绝对不会。本工具的所有文本解析、正则提取和算法校验逻辑,都是通过 JavaScript 在您的浏览器本地完成的。您输入的数据不会通过网络发送到任何服务器,请放心使用。
Q: 为什么提取结果比我输入的税号数量少?
为了方便后续处理,系统在提取出所有的信用代码后,会自动进行“去重”操作。如果您输入的文本中包含多个完全相同的税号,在最终的结果列表中只会保留一条记录。