在使用DEDECMS的过程中,很多时候我们从其他网站复制内容时会遇到一个问题:其中的图片在保存时无法自动将远程图片下载到本地。这种情况尤其常见于一些大型网站(如新浪博客、网易等),这些网站对图片进行了防盗链处理,导致图片地址没有明确的后缀名。因此,使用DEDECMS默认的下载远程图片功能时,往往无法实现预期效果。
为了解决这个问题,我们需要深入了解DEDECMS在检索远程图片时的正则表达式逻辑。经过分析发现,DEDECMS在匹配远程图片时,其正则表达式中加入了图片格式的限制条件。以下是DEDECMS默认使用的正则表达式:

preg_match_all("/(src)=[\\\\"|'| ]{0,}(http:\\\\/\\\\/([^>]*)\\\\.(gif|jpg|png))/isU", $body, $img_array);
    
然而,像新浪博客中的图片地址 `http://static2.photo.sina.com.cn/orignal/54a625bft848ec4ffa561&690&690` 并没有明确的图片后缀名,因此无法通过上述正则表达式进行匹配和下载。
找到了问题的根源,接下来就可以着手解决。我们需要修改DEDECMS的核心文件 `/dede/inc/inc_archives_functions.php` 中的相关函数。具体步骤如下: 1. 打开文件 `/dede/inc/inc_archives_functions.php`。 2. 找到以下两个函数: - `function GetCurContent($body, &$litpic, $autolitpic)` - `function GetCurContent($body)` 3. 在大约第11行和第89行的位置,找到匹配远程图片的规则:

preg_match_all("/(src)=[\\\\"|'| ]{0,}(http:\\\\/\\\\/([^>]*)\\\\.(gif|jpg|png))/isU", $body, $img_array);
    
4. 将其修改为以下代码:

preg_match_all("/src=[\\\\"|'|\\\\s]{0,}(http:\\\\/\\\\/([^>]*))(\\\\"|'|\\\\s)/isU", $body, $img_array);
    
完成上述修改后,DEDECMS就能正确识别并下载那些没有明确后缀名的远程图片了。
需要注意的是,DEDECMS默认的正则表达式设计是有其合理性的——它仅匹配图片文件(如 `.gif`, `.jpg`, `.png`),从而避免误匹配到其他类型的文件(如JS、FLASH)。然而,这种限制也带来了不便,尤其是在编辑内容时,我们通常能够直观判断某个链接指向的是图片还是其他文件类型。 通过上述修改,您可以更灵活地处理远程资源,同时也要注意确保所下载的图片来源合法合规,避免侵犯他人版权。