使用正则表达式提取数字时,需根据具体场景选择合适的匹配模式:纯整数用\d+;带符号的小数可用-?\d+\.?\d*;严格匹配浮点数用-?\d+\.\d+;结合上下文用捕获组提取ID、版本、金额等,可有效避免错误匹配,显著提高精准度。
正则表达式提取数字,关键在于根据场景需求选择合适模式:用d+获取连续数字块;需兼顾符号和小数时,-d+.d* 虽有效但需后处理;严格匹配浮点数则用-d+.d+更精准;结合上下文使用捕获组提取ID、版本、金额,效果更佳。

长期稳定更新的攒劲资源: >>>点此立即查看<<<
正则表达式提取字符串中的数字,需根据不同类型——纯整数、带符号数字、小数、科学计数法或连续数字片段——选择对应模式。不同场景应区别对待,不宜一概使用d+。
此模式最为常见,适用于从文本中提取所有独立数字块。例如,文本“订单号:12345,金额:67.89,折扣-5%”用d+即可得到12345、67、89、5。具体要点如下:
d+ —— 匹配一个或多个连续数字字符d等价于[0-9],不匹配小数点、负号或小数部分import re
text = "温度23.5℃,湿度-45%,编号A123B456"
re.findall(r'd+', text) # → ['23', '5', '45', '123', '456']
当需要保留数字原始语义(如-12.34或3.14159)时,仅靠d+不够,必须覆盖符号和小数点。此时需使用更高级的模式:
-d+.d* —— 支持可选负号、至少一位整数、可选小数点及后续数字-d+.d+|-.d+|.d+,但通常用-d+.d*并过滤空结果更实用-d+.d*((用负向先行断言排除结尾为小数点的情况)-d+.d* + 后处理(如float(x)尝试转换,跳过无效项)若明确需要小数(如价格、坐标),需确保小数点前后至少有一位数字。例如:
-d+.d+ —— 匹配带小数点的标准浮点数,如3.14、-0.001-d+.d+,但会误匹配“123.”(末尾小数点)-(:d+.d+|d+.|.d+|d+),再用逻辑过滤纯小数点或空段ast.literal_eval或float()),正则提取后建议转类型校验当数字有固定位置或前缀(如“ID: 10086”、“版本 v2.3.1”)时,可用捕获组提高准确性:
r'ID:s*(d+)' → 只取冒号后的数字r'v(d+.d+.d+)' → 捕获形如v1.2.3的完整版本r'(d+(:.d+))' → 匹配后面的数字(含小数)re.search()或re.finditer()获取group(1),比全量findall更可控侠游戏发布此文仅为了传递信息,不代表侠游戏网站认同其观点或证实其描述