0

0

利用百度接口

php中文网

php中文网

发布时间:2016-07-29 08:58:32

|

1182人浏览过

|

来源于php中文网

原创

我的图片爬完啦,下面的是我利用百度图片接口的代码!很简单哦~~~~拿去用吧,别谢我。。。哈哈!!!利用百度接口我纠结的就是解密那里,效率可能会低一些,我是一个字母一个字母的去找的!不知道还有没有更快速一些的办法,在这里也请教你们啦,如果有好的方法告诉我一下哈!

   /**
    *  通过百度来搜索图片链接,然后下载(这里先在本地电脑进行测试,没有放到服务器上,因为我的服务器磁盘空间太小,由于是图片,怕存不下)
    *  1.先取出我的车辆的id 和 modelname
    *  2.利用百度搜索图片的接口获取图片JSON信息
    *  3.解析JSON ,遍历里面的data ,拿到objUrl
    *  4.对objUrl 进行解密
    *  5.检测解密后的objUrl 的可用性
    *  6.获取可用的objUrl 图片到本地
    */ 
    public function getImageFromBaidu(){     // 这个是我自己的业务方法,你可以根据自己的需要去调整,但是里面也有需要注意的地方
        // 开启关闭浏览器不中断请求
        ignore_user_abort(true);
        set_time_limit(0);
        
        $carList = M('car')->field('id,modelname')->select();
        foreach($carList as $car){
            \Think\Log::write('即将获取'.$car['modelname'].'的图片数据','WARN');
            // 请求接口,拿到JSON数据
            $jsonResult = $this->useBaiduSearch($car['modelname']);
            if($jsonResult == null || $jsonResult == '') 
            {
                \Think\Log::write($car['modelname'].'的JSON获取失败','WARN');
                continue;
            }
        
            $jsonResult = str_replace("'",'"',$jsonResult);  // 返回来的json数据一定记得将里面的 单引号 替换成双引号!php4 以上对json数据要求比较严格
            $jsonResult = preg_replace('/,\s*([\]}])/m', '$1', $jsonResult);
            $jsonArray = json_decode($jsonResult,true);
            // 循环里面的data 部分,因为他是stdclass 类型,所以需要 ->
            foreach($jsonArray['data'] as $data){
                $objUrl = $data['objURL'];
                if(!$objUrl){
                    \Think\Log::write('objUrl 不可用','WARN');
                    continue;
                }
                // 对objUrl 进行解密
                $objUrl = $this->decodeObjUrl($objUrl);
                
                // 测试这个url是否可用
                if($this->http_status($objUrl))
                    continue;
                // 如果可用,进行下载
                $result = getImage($objUrl,'','./Uploads/'.$car['modelname'].'/');
                if(!$result){
                    \Think\Log::write($objUrl.'获取失败','WARN');
                }
            }
            \Think\Log::write($car['modelname'].'的图片数据获取完毕','WARN');
            sleep(1);
        }
    } 
    
    
    /* 
    *   使用百度图片搜索接口获取图片json内容数据
    *   @param string $word 搜索关键词
    *   @return json
    */
    public function useBaiduSearch($word=''){   // 这个才是真正请求的JSON数据,你可以根据自己的语言进行变换,接口地址就是baseUrl,里面的$word 即为关键词
        if($word == '') return null;
        // 下面这个是我利用的url,如果你用时不好用了,你可以参考我前面的文章 “寻找百度图片搜索接口--one two three”,自己再找下
        $baseUrl = 'http://image.baidu.com/search/acjson?tn=resultjson_com&ipn=rj&ct=201326592&fp=result&ie=utf-8&oe=utf-8&word='
                .$word.'&pn=30&rn=30&gsm=700001e&1457697756442=';
        return file_get_contents($baseUrl);
    }
    /**
    *  解密objUrl
    *  @param string $objUrl 要解密的objUrl 
    *  @return string 解密后的objUrl
    *  这里的解密密码,来自百度js文件,如果有改动,也请参考前面的文章,自行寻找
    */
    public function decodeObjUrl($objUrl = ''){
        if($objUrl == '') return '';
        // 这里的解密对照以百度js里面的为准
        \Think\Log::write('准备解密一个objurl:'.$objUrl,'WARN');
        $map = array(
            'w' => "a", 'k'=> "b", 'v'=> "c", '1'=> "d",
            'j'=> "e", 'u'=> "f", '2'=> "g", 'i'=> "h",
            't'=> "i", '3'=> "j", 'h'=> "k", 's'=> "l",
            '4'=> "m", 'g'=> "n", '5'=> "o", 'r'=> "p",
            'q'=> "q", '6'=> "r", 'f'=> "s", 'p'=> "t",
            '7'=> "u", 'e'=> "v", 'o'=> "w", '8'=> "1",
            'd'=> "2", 'n'=> "3", '9'=> "4", 'c'=> "5",
            'm'=> "6", '0'=> "7", 'b'=> "8", 'l'=> "9",
            'a'=> "0",
            '_z2C$q'=> ":",
            '_z&e3B'=> ".",
            'AzdH3F'=> "/"
        );
        
        $objUrl = str_replace('_z2C$q',$map['_z2C$q'],$objUrl);
        $objUrl = str_replace('_z&e3B',$map['_z&e3B'],$objUrl);
        $objUrl = str_replace('AzdH3F',$map['AzdH3F'],$objUrl);
        
        for($i=0;$i<strlen($objUrl);$i++){
            $temp = $map[$objUrl[$i]];
            if($temp!=''){
                $objUrl[$i] = $temp;
            }
        }
        \Think\Log::write('获取到了一个objurl:'.$objUrl,'WARN');
        return $objUrl;
    } 
顺便赠送你一个检测403、404、500页面的代码:
   /**
    *  判断是否为404\500\403页面
    *  @param string $url 即将请求的页面
    *  @return bool
    */
    public function http_status($url) {
        $ch = curl_init();
        curl_setopt($ch, CURLOPT_URL, $url);
        curl_setopt($ch, CURLOPT_HEADER, 1);
        curl_setopt($ch, CURLOPT_NOBODY, 1);
        curl_setopt($ch, CURLOPT_RETURNTRANSFER, 1);
        curl_setopt($ch, CURLOPT_TIMEOUT, 5);
        $status = curl_exec($ch);
        
        curl_close($ch);
        $have404 = strpos($status,'Location: /Error/404.html');
        $have500 = strpos($status,'Location: /Error/500.html');
        $have403 = strpos($status,'Location: /Error/403.html');
        if($have404 || $have500 || $have403){
            \Think\Log::write('发生错误啦:'.$have403.':'.$have404.':'.$have500,'WARN');
            return true;
        } 
        return false;
    }
ok!完活,最后再配上我抓到的图片的几张截图:

利用百度接口

利用百度接口

天天团购系统
天天团购系统

天天团购系统是一套强大的开源团购程序,采用PHP+mysql开发,系统内置支付宝、财付通、GOOGLE地图等接口,支持短信发送团购券和实物团购快递发货等;另外可通过Ucenter模块,与网站已有系统无缝整合,实现用户同步注册、登陆、退出。 天天团购系统是一套创新的开源团购程序,拥有多达10项首创功能,同时支持虚拟和实物团购,内置类似淘宝的快递配送体系,并提供强大的抽奖、邀请返利等营销功能,让您轻松

下载

以上就介绍了利用百度接口,包括了方面的内容,希望对PHP教程有兴趣的朋友有所帮助。

热门AI工具

更多
DeepSeek
DeepSeek

幻方量化公司旗下的开源大模型平台

豆包大模型
豆包大模型

字节跳动自主研发的一系列大型语言模型

通义千问
通义千问

阿里巴巴推出的全能AI助手

腾讯元宝
腾讯元宝

腾讯混元平台推出的AI助手

文心一言
文心一言

文心一言是百度开发的AI聊天机器人,通过对话可以生成各种形式的内容。

讯飞写作
讯飞写作

基于讯飞星火大模型的AI写作工具,可以快速生成新闻稿件、品宣文案、工作总结、心得体会等各种文文稿

即梦AI
即梦AI

一站式AI创作平台,免费AI图片和视频生成。

ChatGPT
ChatGPT

最最强大的AI聊天机器人程序,ChatGPT不单是聊天机器人,还能进行撰写邮件、视频脚本、文案、翻译、代码等任务。

相关专题

更多
Golang 生态工具与框架:扩展开发能力
Golang 生态工具与框架:扩展开发能力

《Golang 生态工具与框架》系统梳理 Go 语言在实际工程中的主流工具链与框架选型思路,涵盖 Web 框架、RPC 通信、依赖管理、测试工具、代码生成与项目结构设计等内容。通过真实项目场景解析不同工具的适用边界与组合方式,帮助开发者构建高效、可维护的 Go 工程体系,并提升团队协作与交付效率。

1

2026.02.24

Golang 性能优化专题:提升应用效率
Golang 性能优化专题:提升应用效率

《Golang 性能优化专题》聚焦 Go 应用在高并发与大规模服务中的性能问题,从 profiling、内存分配、Goroutine 调度、GC 机制到 I/O 与锁竞争逐层分析。结合真实案例讲解定位瓶颈的方法与优化策略,帮助开发者建立系统化性能调优思维,在保证代码可维护性的同时显著提升服务吞吐与稳定性。

2

2026.02.24

Golang 面试题精选:高频问题与解答
Golang 面试题精选:高频问题与解答

Golang 面试题精选》系统整理企业常见 Go 技术面试问题,覆盖语言基础、并发模型、内存与调度机制、网络编程、工程实践与性能优化等核心知识点。每道题不仅给出答案,还拆解背后的设计原理与考察思路,帮助读者建立完整知识结构,在面试与实际开发中都能更从容应对复杂问题。

1

2026.02.24

Golang 运行与部署实战:从本地到云端
Golang 运行与部署实战:从本地到云端

《Golang 运行与部署实战》围绕 Go 应用从开发完成到稳定上线的完整流程展开,系统讲解编译构建、环境配置、日志与配置管理、容器化部署以及常见运维问题处理。结合真实项目场景,拆解自动化构建与持续部署思路,帮助开发者建立可靠的发布流程,提升服务稳定性与可维护性。

3

2026.02.24

Golang 疑难杂症解决指南:常见问题排查与优化
Golang 疑难杂症解决指南:常见问题排查与优化

《Golang 疑难杂症解决指南》聚焦开发过程中常见却棘手的问题,从并发模型、内存管理、性能瓶颈到工程化实践逐步拆解。通过真实案例与调试思路,帮助开发者定位问题根因,建立系统化排查方法。不只给出答案,更强调分析路径与工具使用,让你在复杂 Go 项目中具备持续解决问题的能力。

1

2026.02.24

Golang 入门学习路线:从零基础到上手开发
Golang 入门学习路线:从零基础到上手开发

Golang 入门路线涵盖从零到上手的核心路径:首先打牢基础语法与切片等底层机制;随后攻克 Go 的灵魂——接口设计与 Goroutine 并发模型;接着通过 Gin 框架与 GORM 深入 Web 开发实战;最后在微服务与云原生工具开发中进阶,旨在培养具备高性能并发处理能力的后端工程师。

0

2026.02.24

中国研究生招生信息网官方网站入口 研招网网页版在线入口
中国研究生招生信息网官方网站入口 研招网网页版在线入口

中国研究生招生信息网入口(https://yz.chsi.com.cn) 此网站是研究生报名入口的唯一官方网站

95

2026.02.24

苹果官网入口与在线访问指南_中国站点快速直达与iPhone查看方法
苹果官网入口与在线访问指南_中国站点快速直达与iPhone查看方法

本专题汇总苹果官网最新可用入口及中国站点访问方式,涵盖官网直达链接、iPhone官方页面查看方法与常见访问说明,帮助用户快速进入苹果官方网站,便捷了解产品信息与官方服务。

14

2026.02.24

Asianfanfics官网入口与访问指南_AFF官方平台最新登录地址
Asianfanfics官网入口与访问指南_AFF官方平台最新登录地址

本专题系统整理Asianfanfics(AFF)官方网站最新可用入口,涵盖官方平台最新直达地址、官网登录方式及中文访问指引,帮助用户快速、安全地进入AFF平台浏览与使用相关内容。

15

2026.02.24

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
Excel 教程
Excel 教程

共162课时 | 18.8万人学习

Pandas 教程
Pandas 教程

共15课时 | 1.1万人学习

C# 教程
C# 教程

共94课时 | 10.1万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号