0

0

php内核函数natsort浅析

PHP中文网

PHP中文网

发布时间:2016-05-17 09:31:00

|

1712人浏览过

|

来源于php中文网

原创

今天发现了php有个自然排序的函数----natsort,第一次听说了原来还有一种叫做“自然排序”的算法,很好奇,官方手册(http://us.php.net/manual/en/function.natsort.php)

bool natsort ( array &$array )  
This function implements a sort algorithm that orders alphanumeric strings in the way a human being would while maintaining key/value associations. This is described as a "natural ordering". An example of the difference between this algorithm and the regular computer string sorting algorithms (used in sort()) can be seen in the example below.

据官方手册还可以得到这样的结果:

     img1.png     img2.png     img10.png     img12.png 

显然这很适合对类似文件名的排序。从结果看这种自然算法应该是去掉头和尾的非数字部分,然后对留下来的数字部分进行排序,究竟是不是,还是看一下php源码吧。

//从ext/standard/array.c抽取的相关代码如下  
static int php_array_natural_general_compare(const void *a, const void *b, int fold_case) /* {{{ */  
{  
    Bucket *f, *s;  
    zval *fval, *sval;  
    zval first, second;  
    int result;  
    f = *((Bucket **) a);  
    s = *((Bucket **) b);  
    fval = *((zval **) f->pData);  
    sval = *((zval **) s->pData);  
    first = *fval;  
    second = *sval;  
    if (Z_TYPE_P(fval) != IS_STRING) {  
        zval_copy_ctor(&first);  
        convert_to_string(&first);  
    }  
    if (Z_TYPE_P(sval) != IS_STRING) {  
        zval_copy_ctor(&second);  
        convert_to_string(&second);  
    }  
    result = strnatcmp_ex(Z_STRVAL(first), Z_STRLEN(first), Z_STRVAL(second), Z_STRLEN(second), fold_case);  
    if (Z_TYPE_P(fval) != IS_STRING) {  
        zval_dtor(&first);  
    }  
    if (Z_TYPE_P(sval) != IS_STRING) {  
        zval_dtor(&second);  
    }  
    return result;  
}  
/* }}} */  
static int php_array_natural_compare(const void *a, const void *b TSRMLS_DC) /* {{{ */  
{  
    return php_array_natural_general_compare(a, b, 0);  
}  
/* }}} */  
static void php_natsort(INTERNAL_FUNCTION_PARAMETERS, int fold_case) /* {{{ */  
{  
    zval *array;  
    if (zend_parse_parameters(ZEND_NUM_ARGS() TSRMLS_CC, "a", &array) == FAILURE) {  
        return;  
    }  
    if (fold_case) {  
        if (zend_hash_sort(Z_ARRVAL_P(array), zend_qsort, php_array_natural_case_compare, 0 TSRMLS_CC) == FAILURE) {  
            return;  
        }  
    } else {  
        if (zend_hash_sort(Z_ARRVAL_P(array), zend_qsort, php_array_natural_compare, 0 TSRMLS_CC) == FAILURE) {  
            return;  
        }  
    }  
    RETURN_TRUE;  
}  
/* }}} */  
/* {{{ proto void natsort(array &array_arg) 
   Sort an array using natural sort */  
PHP_FUNCTION(natsort)  
{  
    php_natsort(INTERNAL_FUNCTION_PARAM_PASSTHRU, 0);  
}  
/* }}} */

 然是第一次查看php的内核代码,不过凭借多年看代码的经验,还是很容易找到这个自然排序算法的核心就是函数:strnatcmp_ex(位于ext/standard/strnatcmp.c文件中)。

立即学习PHP免费学习笔记(深入)”;

/* {{{ compare_right 
 */  
static int  
compare_right(char const **a, char const *aend, char const **b, char const *bend)  
{  
    int bias = 0;  
    /* The longest run of digits wins.  That aside, the greatest 
       value wins, but we can't know that it will until we've scanned 
       both numbers to know that they have the same magnitude, so we 
       remember it in BIAS. */  
    for(;; (*a)++, (*b)++) {  
        if ((*a == aend || !isdigit((int)(unsigned char)**a)) &&  
            (*b == bend || !isdigit((int)(unsigned char)**b)))  
            return bias;  
        else if (*a == aend || !isdigit((int)(unsigned char)**a))  
            return -1;  
        else if (*b == bend || !isdigit((int)(unsigned char)**b))  
            return +1;  
        else if (**a < **b) {  
            if (!bias)  
                bias = -1;  
        } else if (**a > **b) {  
            if (!bias)  
                bias = +1;  
        }  
     }  
     return 0;  
}  
/* }}} */  
/* {{{ compare_left 
 */  
static int  
compare_left(char const **a, char const *aend, char const **b, char const *bend)  
{  
     /* Compare two left-aligned numbers: the first to have a 
        different value wins. */  
    for(;; (*a)++, (*b)++) {  
        if ((*a == aend || !isdigit((int)(unsigned char)**a)) &&  
            (*b == bend || !isdigit((int)(unsigned char)**b)))  
            return 0;  
        else if (*a == aend || !isdigit((int)(unsigned char)**a))  
            return -1;  
        else if (*b == bend || !isdigit((int)(unsigned char)**b))  
            return +1;  
         else if (**a < **b)  
             return -1;  
         else if (**a > **b)  
             return +1;  
     }  
        
     return 0;  
}  
/* }}} */  
/* {{{ strnatcmp_ex 
 * call in array.c: strnatcmp_ex(Z_STRVAL(first), Z_STRLEN(first), Z_STRVAL(second), Z_STRLEN(second), fold_case); 
 */  
PHPAPI int strnatcmp_ex(char const *a, size_t a_len, char const *b, size_t b_len, int fold_case)  
{  
    char ca, cb;  
    char const *ap, *bp;  
    char const *aend = a + a_len,  
               *bend = b + b_len;  
    int fractional, result;  
    if (a_len == 0 || b_len == 0)  
        return a_len - b_len;  
    ap = a;  
    bp = b;  
    while (1) {  
        ca = *ap; cb = *bp;  
        /* skip over leading spaces or zeros */  
        while (isspace((int)(unsigned char)ca) || (ca == '0' && (ap+1 < aend) && (*(ap+1)!='.')))  
            ca = *++ap;  
        while (isspace((int)(unsigned char)cb) || (cb == '0' && (bp+1 < bend) && (*(bp+1)!='.')))  
            cb = *++bp;  
        /* process run of digits */  
        if (isdigit((int)(unsigned char)ca)  &&  isdigit((int)(unsigned char)cb)) {  
            fractional = (ca == '0' || cb == '0');  
            if (fractional)  
                result = compare_left(&ap, aend, &bp, bend);  
            else  
                result = compare_right(&ap, aend, &bp, bend);  
            if (result != 0)  
                return result;  
            else if (ap == aend && bp == bend)  
                /* End of the strings. Let caller sort them out. */  
                return 0;  
            else {  
                /* Keep on comparing from the current point. */  
                ca = *ap; cb = *bp;  
            }  
        }  
        if (fold_case) {  
            ca = toupper((int)(unsigned char)ca);  
            cb = toupper((int)(unsigned char)cb);  
        }  
        if (ca < cb)  
            return -1;  
        else if (ca > cb)  
            return +1;  
        ++ap; ++bp;  
        if (ap >= aend && bp >= bend)  
            /* The strings compare the same.  Perhaps the caller 
               will want to call strcmp to break the tie. */  
            return 0;  
        else if (ap >= aend)  
            return -1;  
        else if (bp >= bend)  
            return 1;  
    }  
}  
/* }}} */

从strnatcmp_ex函数中的:

while (isspace((int)(unsigned char)ca) || (ca == '0' && (ap+1 < aend) && (*(ap+1)!='.')))  
    ca = *++ap;  
while (isspace((int)(unsigned char)cb) || (cb == '0' && (bp+1 < bend) && (*(bp+1)!='.')))  
    cb = *++bp;

所以,我觉得应该字符串(当前位置开始)中前面的空字符和数字前面的‘0’不会参与比较,比较的结果应该和

http://us.php.net/manual/en/function.natsort.php

Linux加PHP加MySQL案例教程
Linux加PHP加MySQL案例教程

通过大量实例系统全面地介绍了Linux+PHP+MySQL环境下的网络后台开发技术,详尽分析了近30个典型案例。 本书以培养高级网站建设与管理人才为目标,内容循序渐进,由浅入深,通过大量的实例系统全面地介绍了Linux+PHP+MySQL环境下的网络后台开发技术。 本书详尽分析了近30个典型案例。包括计数器、网站流量统计、留言扳、论坛系统、聊天室、投票与调查、用户管理、新闻发布系统、广告轮播

下载

http://sourcefrog.net/projects/natsort/example-out.txt

 

所说的一样,但是在我的php5.2.9中对于“0”的处理结果却不一样(例如“img002.png”与“img1.png”,我的理解应该是前者大于后者,不过在我的5.2.9中却是前者小于后者),原因还没想清楚,可能是5.2.9的一个bug,也可能是自己还没有理解清楚源码的意思。下次配置好环境再好好测试,好好消化~~

 

在array.c中有两个重要的数据结构很值得我们关注:

Bucket:  http://www.phpchina.cn/bbs/viewthread.php?tid=88505

zval:      http://www.laruence.com/2008/08/22/412.html

相关文章

PHP速学教程(入门到精通)
PHP速学教程(入门到精通)

PHP怎么学习?PHP怎么入门?PHP在哪学?PHP怎么学才快?不用担心,这里为大家提供了PHP速学教程(入门到精通),有需要的小伙伴保存下载就能学习啦!

下载

相关标签:

php

本站声明:本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn

热门AI工具

更多
DeepSeek
DeepSeek

幻方量化公司旗下的开源大模型平台

豆包大模型
豆包大模型

字节跳动自主研发的一系列大型语言模型

通义千问
通义千问

阿里巴巴推出的全能AI助手

腾讯元宝
腾讯元宝

腾讯混元平台推出的AI助手

文心一言
文心一言

文心一言是百度开发的AI聊天机器人,通过对话可以生成各种形式的内容。

讯飞写作
讯飞写作

基于讯飞星火大模型的AI写作工具,可以快速生成新闻稿件、品宣文案、工作总结、心得体会等各种文文稿

即梦AI
即梦AI

一站式AI创作平台,免费AI图片和视频生成。

ChatGPT
ChatGPT

最最强大的AI聊天机器人程序,ChatGPT不单是聊天机器人,还能进行撰写邮件、视频脚本、文案、翻译、代码等任务。

相关专题

更多
java入门学习合集
java入门学习合集

本专题整合了java入门学习指南、初学者项目实战、入门到精通等等内容,阅读专题下面的文章了解更多详细学习方法。

2

2026.01.29

java配置环境变量教程合集
java配置环境变量教程合集

本专题整合了java配置环境变量设置、步骤、安装jdk、避免冲突等等相关内容,阅读专题下面的文章了解更多详细操作。

2

2026.01.29

java成品学习网站推荐大全
java成品学习网站推荐大全

本专题整合了java成品网站、在线成品网站源码、源码入口等等相关内容,阅读专题下面的文章了解更多详细推荐内容。

0

2026.01.29

Java字符串处理使用教程合集
Java字符串处理使用教程合集

本专题整合了Java字符串截取、处理、使用、实战等等教程内容,阅读专题下面的文章了解详细操作教程。

0

2026.01.29

Java空对象相关教程合集
Java空对象相关教程合集

本专题整合了Java空对象相关教程,阅读专题下面的文章了解更多详细内容。

3

2026.01.29

clawdbot ai使用教程 保姆级clawdbot部署安装手册
clawdbot ai使用教程 保姆级clawdbot部署安装手册

Clawdbot是一个“有灵魂”的AI助手,可以帮用户清空收件箱、发送电子邮件、管理日历、办理航班值机等等,并且可以接入用户常用的任何聊天APP,所有的操作均可通过WhatsApp、Telegram等平台完成,用户只需通过对话,就能操控设备自动执行各类任务。

25

2026.01.29

clawdbot龙虾机器人官网入口 clawdbot ai官方网站地址
clawdbot龙虾机器人官网入口 clawdbot ai官方网站地址

clawdbot龙虾机器人官网入口:https://clawd.bot/,clawdbot ai是一个“有灵魂”的AI助手,可以帮用户清空收件箱、发送电子邮件、管理日历、办理航班值机等等,并且可以接入用户常用的任何聊天APP,所有的操作均可通过WhatsApp、Telegram等平台完成,用户只需通过对话,就能操控设备自动执行各类任务。

16

2026.01.29

Golang 网络安全与加密实战
Golang 网络安全与加密实战

本专题系统讲解 Golang 在网络安全与加密技术中的应用,包括对称加密与非对称加密(AES、RSA)、哈希与数字签名、JWT身份认证、SSL/TLS 安全通信、常见网络攻击防范(如SQL注入、XSS、CSRF)及其防护措施。通过实战案例,帮助学习者掌握 如何使用 Go 语言保障网络通信的安全性,保护用户数据与隐私。

8

2026.01.29

俄罗斯Yandex引擎入口
俄罗斯Yandex引擎入口

2026年俄罗斯Yandex搜索引擎最新入口汇总,涵盖免登录、多语言支持、无广告视频播放及本地化服务等核心功能。阅读专题下面的文章了解更多详细内容。

622

2026.01.28

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
PHP课程
PHP课程

共137课时 | 10.1万人学习

JavaScript ES5基础线上课程教学
JavaScript ES5基础线上课程教学

共6课时 | 11.2万人学习

PHP新手语法线上课程教学
PHP新手语法线上课程教学

共13课时 | 0.9万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号