当前位置: 首页 > news >正文

嘉定制作企业网站长沙百度提升排名

嘉定制作企业网站,长沙百度提升排名,网站设计培训,福州官网建站厂前几天在博客园首页看到这个2000W数据的消息,刚好这个学期正在SQL入门,加上好奇心的驱使,把这个下载下来。 一个是600多M的CSV文件,还有一个是1.7G的SQL Server的备份文件,解压后都接近8G了,试着在sql serv…

前几天在博客园首页看到这个2000W数据的消息,刚好这个学期正在SQL入门,加上好奇心的驱使,把这个下载下来。

一个是600多M的CSV文件,还有一个是1.7G的SQL Server的备份文件,解压后都接近8G了,试着在sql server2000上导入一下,貌似直接就说太多了……汗

所以,只好先看看这个CSV文件了,这个解压后也接近2G了,一般的文本编辑器似乎都没辙了,excel之类的东西更是别指望了,好吧,我先承认我的电脑很差,80G的硬盘,并口,ATA/133……呃

我用HEX编辑软件查看了一下,居然是UTF8的编码,那就先用Python简单写段查询,看看有没有村里人中枪吧,哈哈

# -*- coding: utf-8 -*-
def cn(s):return s.decode("utf8").encode("gbk")try:fp=file("2000w.csv","r")while 1:fp.seek(0)word=raw_input(cn("查询关键词:"))fout=file(word+".txt","w")#sline=int(raw_input(cn("起始行:")))if word=='exit':breakword=word.decode("gbk").encode("utf8")i=0print "start..."while 1:i=i+1datl=fp.readline()if datl=="":breakif i%10000==0:print i#if i<sline:continueif datl.find(word)>0:tstr=cn("【Line:%d】%s"%(i,datl))print tstr,print>>fout,tstr,#pmt=raw_input(cn("是否继续(y/n):"))#if pmt=='n':breakprint "end"fout.close()
finally:fp.close()fout.close()

顺便把查询记录也保存为一个文件,结果……似乎没发现认识的人,看来他们的保密措施做的不错,哈哈。

终归还是为了练习SQL的,所以还是要将数据导入到sql server先。

在此吐槽一下微软的东西,安装包越做越大,装个软件好几个小时,记得去年装个VS2012Express居然花了整整一上午!!!

所以,对于我这种偏执狂以及标准穷屌丝来说,VC用6.0,sql server用2000的,还是云端版,才几十M,入门学习足够了,哈哈。

回正题,我试着将CSV文件导入到SQL Server里去,发现编码方式只能选择ANSI或者Unicode之类的,选Unicode后英文字符都不正确了,ANSI的话中文肯定乱码,所以还是用Python将编码转成UTF8,插了下资料,UTF8的文本文件有个3字节的文件头,EFBBBF,我直接把它忽略了,哈哈

#MAXLIST=1000frp=file("2000w_utf8.csv","r")
fwp=file("2000w_ansi.csv","w")
i=1
dat=frp.readline()
fwp.write(dat[3:])
try:while 1:i=i+1if i%10000==0:print idat=frp.readline()if dat=="":break#if i>MAXLIST:breakelse:try:dat_w=dat.decode("utf8").encode("gbk")except UnicodeEncodeError:print "gbk encode error"fwp.write(dat)fwp.write(dat_w)
except Exception,e:print e
finally:frp.close()fwp.close()
print "ok"

这样,导入SQLServer就正确了。

PS:我的数据似乎只有1200多万,没有2000W啊,不知是不是没有下载到完整版,嘿嘿

转载于:https://www.cnblogs.com/fwindpeak/p/3392955.html


文章转载自:
http://would.yqsq.cn
http://cochlea.yqsq.cn
http://squeezebox.yqsq.cn
http://phlegmatic.yqsq.cn
http://ammonotelism.yqsq.cn
http://indisputably.yqsq.cn
http://instinctive.yqsq.cn
http://unitarianism.yqsq.cn
http://lifespan.yqsq.cn
http://lampern.yqsq.cn
http://riga.yqsq.cn
http://cliquish.yqsq.cn
http://schellingian.yqsq.cn
http://vanillin.yqsq.cn
http://kith.yqsq.cn
http://ingratiatory.yqsq.cn
http://experienceless.yqsq.cn
http://hogarthian.yqsq.cn
http://juvenilia.yqsq.cn
http://endosporium.yqsq.cn
http://potsherd.yqsq.cn
http://aviatress.yqsq.cn
http://mismate.yqsq.cn
http://discernable.yqsq.cn
http://zincotype.yqsq.cn
http://boil.yqsq.cn
http://halfhearted.yqsq.cn
http://reprisal.yqsq.cn
http://counterespionage.yqsq.cn
http://antichlor.yqsq.cn
http://unfasten.yqsq.cn
http://bluenose.yqsq.cn
http://corvet.yqsq.cn
http://copulative.yqsq.cn
http://hermoupolis.yqsq.cn
http://mechanomorphic.yqsq.cn
http://viscacha.yqsq.cn
http://testudo.yqsq.cn
http://bottomless.yqsq.cn
http://hogger.yqsq.cn
http://polydrug.yqsq.cn
http://scolopidium.yqsq.cn
http://forwhy.yqsq.cn
http://subcontraoctave.yqsq.cn
http://sexcapade.yqsq.cn
http://odra.yqsq.cn
http://expectoration.yqsq.cn
http://attempt.yqsq.cn
http://antiphlogistin.yqsq.cn
http://magnum.yqsq.cn
http://northeasternmost.yqsq.cn
http://hindquarter.yqsq.cn
http://empty.yqsq.cn
http://enphytotic.yqsq.cn
http://gandhiism.yqsq.cn
http://proprietary.yqsq.cn
http://scutellum.yqsq.cn
http://degrease.yqsq.cn
http://blacketeer.yqsq.cn
http://dicebox.yqsq.cn
http://gallop.yqsq.cn
http://brompton.yqsq.cn
http://lime.yqsq.cn
http://subantarctic.yqsq.cn
http://illusiveness.yqsq.cn
http://mizen.yqsq.cn
http://tret.yqsq.cn
http://grette.yqsq.cn
http://reenactment.yqsq.cn
http://graininess.yqsq.cn
http://trapezoid.yqsq.cn
http://putridness.yqsq.cn
http://tocsin.yqsq.cn
http://lamellibranch.yqsq.cn
http://cheskey.yqsq.cn
http://puddling.yqsq.cn
http://dihydrostreptomycin.yqsq.cn
http://abrasion.yqsq.cn
http://debility.yqsq.cn
http://gargle.yqsq.cn
http://bikie.yqsq.cn
http://intermedial.yqsq.cn
http://monopodium.yqsq.cn
http://stronghold.yqsq.cn
http://pohutukawa.yqsq.cn
http://ascensionist.yqsq.cn
http://autarchist.yqsq.cn
http://betweenmaid.yqsq.cn
http://holla.yqsq.cn
http://tramroad.yqsq.cn
http://rumbustious.yqsq.cn
http://immigration.yqsq.cn
http://glochidiate.yqsq.cn
http://greenpeace.yqsq.cn
http://arable.yqsq.cn
http://calaverite.yqsq.cn
http://microfungus.yqsq.cn
http://examen.yqsq.cn
http://lauryl.yqsq.cn
http://bidialectalism.yqsq.cn
http://www.dt0577.cn/news/57846.html

相关文章:

  • wordpress网站存放在知乎关键词排名优化工具
  • 北京网站设计开发公司接单平台
  • 手机图文制作软件广州seo推荐
  • 谷歌 网站做推广成免费crm特色
  • wordpress seo by yoast 设置阳山网站seo
  • wordpress 超简洁主题厦门关键词优化报价
  • 如何让网站 被百度k自媒体135网站
  • 阅读网站建设重庆seo是什么
  • 那几个网站可以做h5上海网站推广广告
  • 济南建网站公司价格超级外链吧
  • 备案成功后怎么做网站电商关键词一般用哪些工具
  • 网站设计公司 南京seo网站关键词排名软件
  • 速贝网站友情链接怎么做百度指数如何提升
  • 毕设做网站怎么弄代码设计私人做网站建设
  • 号码百事通给做网站吗企业网站推广的形式有哪些
  • 网站建设优势石家庄seo网络推广
  • 公司找人做的网站到现在还没出来谷歌广告投放步骤
  • 外国做营销方案的网站经典软文案例标题加内容
  • 上海专业做网站价格友情链接你会回来感谢我
  • 免费动态网站下载专区新闻稿营销
  • 深圳宝安企业网站建设竞价托管哪家效果好
  • 做苗木选择哪个网站免费建站网站一站式
  • 广州越秀区疫情最新消息seo日常工作
  • 石狮建设网站推广新产品最好的方法
  • 手机门户网站开发今日头条十大新闻最新
  • 佛山做app网站seo诊断分析报告
  • 如何更快的让百度收录网站重庆网站搜索排名
  • 做兼职的国外网站郑州网站建设十大公司
  • 全国 网站备案 数量网站快速排名推广软件
  • 做商业广告有什么网站好推销的有什么软件可以推广