可以在此基础上结合正则表达式做成更好的效果,希望大家能分享一下Xmlhttp的session共享技术
<html>
<head>
<title>AUTOGET</title>
<metahttp-equiv="Content-Type"content="text/html;charset=gb2312">
</head>
<bodybgcolor="#FFFFFF"style="font-family:Arial;font-size:12px">
<%
'=================================================
'FileName:Getit.Asp
'Intro:AutoGetDataFromRemoteWebSite
'Author:Babyt(阿泰)
'URL:http://blog.csdn.net/babyt
'createAt:2002-02Lastupdate:2004-09
'DBTable:data
'TableField:
'UID->Long->KeepIDOfthepages
'UContent->Text->KeepContentOfthePages(HTML)
'=================================================
Server.ScriptTimeout=5000
'onerrorresumenext
Setconn=Server.createObject("ADODB.Connection")
conn.open"Provider=Microsoft.Jet.OLEDB.4.0;DataSource="&Server.MapPath("getit.mdb")
Setrs=Server.createObject("ADODB.Recordset")
sql="select*fromdata"
rs.opensql,conn,1,3
DimcomeFrom,myErr,myCount
'========================================================
comeFrom="http://www.xxx.com/U.asp?ID="
myErr1="该资料不存在"
myErr2="该资料已隐藏"
'========================================================
'***************************************************************
'只需要更改这里i的始点intMin和终点intMax,设定步长intStep
'每次区间设置成5万左右。估计要两个多小时。期间不需要人工干预
'****************************************************************
intMin=0
intMax=10000
'设定步长
intStep=100
'==========================================================
'以下代码不要更改
'==========================================================
CallGetPart(intMin)
Response.write"已经转换完成"&intMin&"~~"&intMax&"之间的数据"
rs.close
Setrs=Nothing
conn.Close
setconn=nothing
%>
</body>
</html>
<%
'使用XMLHTTP抓取地址并进次内容处理
FunctionGetBody(Url)
DimobjXML
OnErrorResumeNext
SetobjXML=createObject("Microsoft.XMLHTTP")