php怎么做自动获取,从新浪财经或者雅虎财经获取到所有A股数据?
可以用ForeSpider数据采集系统试一下,系统已将框架都搭建好,直接根据网页结构进行相应配置即可,还有大量实战教程可以参考。这是采集新浪财经上市公司高管信息的教程,可供您参考。
采集网站
【场景描述】采集新浪财经所有行业板块中上市公司的高管信息。
【源网站介绍】
新浪财经,提供7X24小时财经资讯及全球金融市场报价,覆盖股票、债券、基金、期货、信托、理财、管理等多种面向个人和企业的服务。
【使用工具】前嗅ForeSpider数据采集系统
【入口网址】
http://finance.sina.com.cn/stock/sl/#sinaindustry_1
【采集内容】
采集新浪财经所有行业板块中上市公司的高管信息。
【采集效果】如下图所示:
l 思路分析
配置思路概览:
l 配置步骤
1. 新建采集任务
选择【采集配置】,点击任务列表右上方【+】号可新建采集任务,将采集入口地址填写在【采集地址】框中,【任务名称】自定义即可,点击下一步。
选择列表链接,点击完成按钮,即创建任务完成。
2.获取行业链接
①用浏览器打开该网页,查看各行业的链接规律,发现行业链接规律为:http://vip.stock.finance.sina.com.cn/mkt/#new_+行业名称首字母
比如:
http://vip.stock.finance.sina.com.cn/mkt/#new_cbzz (船舶制造)
http://vip.stock.finance.sina.com.cn/mkt/#new_tchy (陶瓷行业)
②所以获取行业链接的方法为:将各行业关键词的首字母设置为关键词,用脚本拼接行业链接。
③设置关键词,具体步骤如下所示:
关键词文本如下:
new_blhy;new_cbzz;new_cmyl;new_dlhy;new_dqhy;new_dzqj;new_dzxx;new_fdc;new_fdsb;new_fjzz;new_fzhy;new_fzjx;new_fzxl;new_glql;new_gsgq;new_gthy;new_hbhy;new_hghy;new_hqhy;new_jdhy;new_jdly;new_jjhy;new_jrhy;new_jtys;new_jxhy;new_jzjc;new_kfq;new_ljhy;new_mtc;new_mthy;new_nlmy;new_nyhf;new_qczz;new_qtxy;new_slzp;new_snhy;new_sphy;new_stock;new_swzz;new_sybh;new_syhy;new_tchy;new_wzwm;new_ylqx;new_yqyb;new_ysbz;new_ysjs;new_zhhy;new_zzhy
④高级设置,设置一个关键词参数,具体操作如下图所示:
⑤编写关键词拼写链接的脚本:
具体脚本文本如下:
var sear=EXTRACT.GetSearch(this); //关键词获取
var k=sear.Search();//查找关键词
while(k){ //遍历关键词
url u;//定义一个url
u.urlname="http://vip.stock.finance.sina.com.cn/mkt/#"+k.wd;//拼接行业链接
u.title="新浪行业@"+k.wd;//将标题设置为关键词名称
u.entryid=this.id;
u.tmplid=1;//关联模板1
k=sear.Search();//查找下一个关键词
RESULT.AddLink(u);//输出一个url值
}
⑥采集预览,查看行业链接是否正确。
3. 获取翻页链接
①观察发现,有部分行业数据量比较大,有多页数据,需要翻页。
打开【其他行业】板块,发现4页数据,点击F12,右侧出现请求,点击第二页,观察发现请求:是翻页请求链接。如下图所示
补充:下图为请求response转译后内容,可看出其中有第二页中的内容,故确定此链接为翻页请求链接。
②复制翻页请求链接:
③同样方法,找到第三页和第四页请求链接,并复制出来。
④观察链接,发现规律如下图所示:
⑤写翻页链接脚本,具体操作如下所示:
脚本文本:
var hangye=URL.title.Right("@");//定义hangye为当前链接标题@右侧内容,即行业名称首字母
url u;//定义一个url
for(var i=1;i<=3;i++){//for循环表示翻页
u.urlname = "http://vip.stock.finance.sina.com.cn/quotes_service/api/json_v2.php/Market_Center.getHQNodeData?page="+i+"&num=80&sort=symbol&asc=1&node="+hangye;//根据翻页链接规律,拼翻页
u.title = hangye; //返回链接名称为行业
u.tmplid = 2;//关联模板2
RESULT.AddLink(u);
}
⑥采集预览,如下图所示,表示翻页链接已生成。
4. 采集公司链接
①在浏览器中打开几个公司链接,可发现规律为:
②而公司id则在模板01获取到的翻页链接请求中,采集预览,在浏览器中打开任意一个翻页请求,经观察发现,这是一个json,公司id为每个对象的symbol值。
③新建模板02,并在其下新建一个链接抽取
④脚本如下所示:
脚本文本:
var ur=URL.urlname;//定义ur变量为当前请求链接,即翻页请求链接
var doc = EXTRACT.OpenDoc(CHANN, ur, "");//打开请求
var tstr = doc.GetDom().GetSource();//打开请求中的dom树,并获取源码,定义源码为tstr
jScript js;//定义一个js
var obj = js.RunJson(tstr);//执行tstr代码并返回一个对象
for(var i=0;i<=79;i++){
var obj_a=obj[i];//定义obj_a为第i个对象
var goodsname=obj_a.symbol;
EXTRACT.CloseDoc(doc);//关闭请求
url u;
u.urlname="https://finance.sina.com.cn/realstock/company/"+goodsname+"/nc.shtml";//拼公司链接
u.title=URL.title;//将标题设置为关键词名称
u.entryid=this.id;//定义goodsname为对象中的symbol值,即公司id
u.tmplid=3;//关联模板03
RESULT.AddLink(u);
}
⑤点击采集预览,如下所示:
5. 抽取公司高管链接
①新建一层模板03,并新建一个链接抽取。
②在浏览其中打开任意一个公司的链接,并再打开企业高管页面链接。
观察发现,企业高管页面链接规律为:
http://vip.stock.finance.sina.com.cn/corp/go.php/vCI_CorpManager/stockid/+公司id+.phtml
③填写脚本如下:
④采集预览,如下所示:
6.抽取高管链接
①新建模板04,在其下新建一个数据抽取,具体操作如下所示:
②填写示例地址,复制任意一个企业高管链接,在下图所示位置:
点击右上角保存后,双击模拟浏览器空白处,模拟浏览器加载出该页面。
③点击模板预览
④经观察发现,高管链接规律为,都包含:http://vip.stock.finance.sina.com.cn/corp/view/vCI_CorpManagerInfo.php?stockid=
⑤地址过滤,将地址中含有http://vip.stock.finance.sina.com.cn/corp/view/vCI_CorpManagerInfo.php?stockid=的链接都过滤出来。
7.抽取高管数据
①新建模板05,在其下新建一个数据抽取。
②关联模板,将模板04关联至模板05。
填写示例地址,将任意一个高管链接填写至如下位置:
③新建一个数据表单,具体步骤和字段属性如下所示:
④关联数据表单,如下图所示:
⑤数据取值
A. uname:打开浏览器,F12,查看高管名称,发现其在源码中,如下图所示。
使用脚本取值,具体如下图所示:
B. usex:使用定位取值的方法,进行取值。
C. ubirth:定位取值(同上)
D. Uedu:定位取值(同上)
E. Country:定位取值(同上)
F. Intro:定位取值(同上)
G. Company:定位取值(同上)
⑥采集预览
l 采集步骤
模板配置完成,采集预览没有问题后,可以进行数据采集。
①首先要建立采集数据表:
选择【数据建表】,点击【表单列表】中该模板的表单,在【关联数据表】中选择【创建】,表名称自定义,这里命名为【qiyegaoguan】(注意命名不能用数字和特殊符号),点击【确定】。创建完成,勾选数据表,并点击右上角保存按钮。
②选择【数据采集】,勾选任务名称,点击【开始采集】,则正式开始采集。
③采集中:
④采集结束后,可以在【数据浏览】中,选择数据表查看采集数据,并可以导出数据。
⑤导出的文件打开如下图所示:
有哪些黑科技App可以推荐一下?
1.全世界:超级文科(历史、政治、地理、音乐、美术、心理、哲学、战争)资讯学习利器
时空柱:绝对眼前一亮、超级酷炫的学习功能,横向对比中西历史,纵向对比上下几千年。学习历史,一目了然。
关系图谱:了解历史时间,全方位覆盖,层层递进。
关系图谱:了解一个人的所有事项,一目了然。
时空地图;每一个历史事件,对应的年份、地理位置、人物、历史事件,同一事件发生的大事,一目了然。
时间线:时间顺序梳理整个过程,学习历史用更生动有趣的方式。
人物族谱:来龙去脉、融会贯通。
同样品质的内容,覆盖:知识树、全古迹、全战争、全哲学、全心理、全画作、全音乐、美术史、音乐史、科技史、全古迹、国家简史、全国家。
中国断代史:
世界国别史:
top100分类:
全世界,是一个能开启过去和未来点的超级app,用过的人大多会把它归类为“黑科技”。
2.时光序:以一敌百的规划类应用,秒杀一切同类,不服来战先来两个普通功能:
透明桌面插件,显示日程不是原点而是文字和不同的颜色,一天、一月的规划一目了然。
桌面重要/紧急四象限插件,很多人的梦寐以求:
接下来才是重点:
规划,酷炫的同时还得好用、好看
数据统计,一目了然
多端同步,满足不同场景:甚至很多人用它来传输文件
特色黑科技:艾宾浩斯遗忘曲线记忆日程(这一个功能就被可开发为一个软件)
帮助孩子提高学习成绩超级武器之一,自动生成复习计划。
此外:事项记录、倒数纪念日、习惯打卡、备忘录、日记、记账、喝水、专注、读书......
(它在不断进化,每一项就是别的一个软件的特色)
部分功能预览图(实际界面比这还要好几倍,这个仅仅是预览图):
网友评价:
就这?还有。
3.扫描王全能宝:扫描界的良心软件,同样不服来战职场办公需要用到把图片转化为文本或表格,文本很简单,我们只说“图片转表格”,比如下面这张图:
这是一张打印出的电子表格,如果需要扫描为电子档,很多软件会败下阵来,而很多优质的软件非常贵,有的甚至按次收费(不良心啊)。
使用扫描王全能宝效果如下:
效果非常好,一键导出为excel格式,大大提升工作效率(不加班的秘密)。
作为对比,看看白描和迅捷ocr的成绩:
扫描王全能宝(90分)>白描(80分)>迅捷ocr(70分)。
注意:
其他的扫描软件有:一个木函ocr、极度扫描、天若ocr等(后期可能会进行复杂场景对比),但论即超级实惠又效果超好,扫描王全能宝应该首屈一指。
因为扫描仅仅是它的功能之一,未来可期,价格实惠:
4.笛云听写:免费语音转文字,效果好0付费,网友评价秒杀讯飞(开玩笑)办公场景除了图片文字识别还有语音识别,比如做会议记录,录制讲话音频等,网友的痛点是好用的太贵,便宜的广告多不好用。
你需要这款黑科技:无广告,全免费(每天10小时转写时长,还不够你用啊)
此外免费的也有好软件,识别率达到96%,除非专业人士,完全够用:
支持外部文件导入识别:
支持多端同步:
网友评价:被topbook、少数派等多家大V号推荐的黑科技:
但是,不得不告诉你,它有一个很大的缺陷:不支持同步转写。如果你有同步转写需求,请看下一个软件:
5.考拉语音转文字:同步语音转文字,效率神器,好用不贵
实时转写、实时翻译、文字转语音,付费软件就是这么牛
录音转文字实时转写功能测试:效果不错
文字转语音:多种音色可选择
实时翻译:支持多种语言间转换,各种场景不担心语言问题。
5.一个木函:手机中的百宝箱,要什么有什么,称得上黑科技以拼图为例:
有时候需要把很多张图片拼接起来,用一个木函一键就搞定了。
这只是它几十个超级功能的一个,所以给公认为手机黑科技。
6.essentialpim PRO:少有人知道的软件,但足够厉害,任何时候都拿得手被三星、惠普等超级巨头选择的日程管理(桌面及手机端)
7.图怪兽:手机作图神器,设计神器,超级黑科技(超好用+超实惠)一次付费,终生不愁:
日签、海报、培训、日报、倒计时、logo、邀请函、表情包、喜报、总结、汇报:
覆盖新媒体、电商、教育培训、餐饮美食、企业管理、金融保险、影视宣传、营销推荐:
8.万能遥控:没有遥控板,没关系。任何人都需要的黑科技,不然怎么开空调
9.河豚直播APP、蓝鲸体育:免费看NBA等体育赛事10.同样:听说你喜欢艺术,怎能错过的黑科技100万高清图库随意下:
40万中外艺术家:
书画、印鉴、书籍:随便搜
10万电子书库,随心看:
黑科技要么超高效率解决问题、要么提供优质资源信息,以上这些软件做到了。
其他的超级软件:头条、得到、喜马拉雅、知乎等等,至于看电影、电视剧的软件,拉轰把这类消耗型的软件再好也不是黑科技,顶多是让人颓废的黑科技。
手机端如此,电脑端更多:
比如电脑端的黑科技:
word内置范文搜索神器:
文件夹整理超级神器:
比snipaste更好用的截图软件:
一个软件效率加1,10个软件效率加10,10个网站再加10,如果能够融汇贯通呢?效率翻10倍。拉轰持续更新。
转发+关注,你懂的。有问题、需要请留言。有推荐,一起更好。
您们平常去哪里下载音乐歌曲?
在如今,有许多的音乐软件,让使用的用户越来越纠结该使用哪款比较好。目前有多个音乐软件互相竞争,有时很难分辨,那么我就借助本文介绍下以下几款软件的特点吧,各个音乐软件的版权也竞争比较激烈,不同歌手可能在不同的音乐软件上,所以我们一起来看看以下吧,希望能给你带来一些帮助。
1、网易云音乐
网易云音乐相对比较综合,所拥有的版权也相对较多。最主要的特点是评论功能,每一首歌下面都有各种各样的评论,有时看评论也是一种乐趣。其次是云盘功能,可以上传自己的音乐,它会自己进行自动匹配。最后它还有排行功能,能看到本周和总的听歌次数排行。网易云主要的是它的互动功能强大,分享好友的歌单与喜爱的音乐,互相评论点赞。
2、酷狗酷我音乐
酷狗酷我音乐也算是很有历史的音乐软件了,但是整体界面可能不如网易云音乐那样整洁舒适,歌曲数量也挺多。特点可能就是它能搜索到各种歌曲的伴奏,伴奏多样,关联的直播平台繁星直播也是依赖于酷狗音乐,伴奏比较好找。
3,QQ音乐--音乐你的生活
QQ音乐:QQ音乐是腾讯公司推出的一款免费音乐应用,拥有海量音乐在线试听、最流行音乐在线首发、歌词翻译、手机铃声下载、高品质无损音乐试听、最全无损曲库、正版音乐下载等功能。
4,虾米音乐。
很多人下载虾米音乐最主要的原因是它有好几个热门歌手的独家版权,例如五月天,林宥嘉,刘若英,田馥甄等,要想在线听这些歌手的歌曲就必须去虾米音乐了,整体界面还可以,如果你正好喜欢那些独家版权歌手的歌曲,那就别犹豫快下一个吧。
音乐软件还是要看个人习惯于偏爱,每个软件都有利弊,根据喜好相信大家都能找到适合自己的软件享受音乐。
哪有免费学习的网站?
从古至今,学习这个模式是一直存在的,善于学习,取之精华,能使自己更加强大。今天不努力,成就了别人,因此每个人都需要不断的学习,如果你没有好的平台,那么我来分享10个免费的学习网站,只要你愿意学,能改你一生。
一、慕课网主打当今最热门的行业,人工智能、云计算、大数据等课程,还能与学习爱好者交流,不懂的问题都可以在网站上提问,热心回答的人并不少。
二、Word联盟只会在Word中打字插图?这种傻瓜式的操作已经不算什么了,网站里海量的办公软件的教程,支持搜索查看教程。
三、ExcelHomeExcel在所有办公软件中最热门的了,也许是因为比Word好看一些,比PPT简洁一些,但是内部学习的知识就多了,这里提供Excel的函数公式、VBA发开等图文+视频教程。
四、办公资源网站提供了各种各样的PPT模板和PPT的制作教程,让你学习,同时还有免PPT背景图与PPT音效素材免费供你下载。
五、CAD图库设计出精致的CAD图纸需要不断的积累,因此要多学多看,在迅捷CAD图库中,海量的CAD图纸供你免费下载,CAD制图前不防先看看图纸吧。
六、我要自学网在知乎上深受60万网友的好评,学习的内容非常广泛,可能就是因为这一点,满足了大众的需求。例如电脑办公、影视动画、网页设计等等的专业。
七、多呗专注于互联网技术的自学网站,此外还有非常人性化的学习资源,对于大学生而言,面试、初出职场都缺乏经验,这里还提供这些教学。
八、W3school主打的是HTML、JavaScript、Web等专业,说白了好网站打交道的,最适合程序员学习。
九、doyoudo主要面向的是平面设计、三维动画、特效合成等课程,学些的途径也是特别的多,还附加资源导航,在学习中获取资源。
十、第一口语网学英语是每个人的噩梦,但是不得不说英语太重要了,即使你是零基础,这个自学网站里依然可以把你变成佛祖级的大神,就怕你不肯学。
这10个免费的自学网站,我们不可能把所有的都要学会,挑出一个,大家每天坚持半小时的学习,养成终身学习的习惯,能改变你一生。最后,需要这个10个网站链接的朋友,欢迎私信我:“自学网”,获取地址,也可以收藏。