久久亚洲精品天码av,午夜福利屄插穴,午夜福利视频91,亚欧美爽爽爽爽爽,亚洲欧美日韩色色图片,青青操在线观看,精品天堂麻豆av,无码av东京热,婷婷成人亚洲少妇

官方微信|手機(jī)版|本站服務(wù)|買家中心|行業(yè)動態(tài)|幫助

產(chǎn)品|公司|采購|招標(biāo)

網(wǎng)絡(luò)信息

參考價面議
具體成交價以合同協(xié)議為準(zhǔn)
  • 公司名稱杭州比丘信息工程有限公司
  • 品       牌
  • 型       號
  • 所  在  地杭州市
  • 廠商性質(zhì)生產(chǎn)廠家
  • 更新時間2017/6/27 18:16:41
  • 訪問次數(shù)5341
在線詢價 收藏產(chǎn)品 查看電話 同類產(chǎn)品

聯(lián)系我們時請說明是 制藥網(wǎng) 上看到的信息,謝謝!

       服務(wù):計算機(jī)軟硬件、電子智能系統(tǒng)、數(shù)碼產(chǎn)品、網(wǎng)絡(luò)信息技術(shù)的開發(fā)、研究、技術(shù)服務(wù)、成果轉(zhuǎn)讓;通信工程、計算機(jī)網(wǎng)絡(luò)工程的設(shè)計、安裝、施工(涉及資質(zhì)證憑證經(jīng)營);批發(fā)、零售:計算機(jī)軟硬件,網(wǎng)絡(luò)設(shè)備,電子智能設(shè)備,辦公自動化設(shè)備及耗材

計算機(jī)軟硬件、電子智能系統(tǒng)、數(shù)碼產(chǎn)品、網(wǎng)絡(luò)信息技術(shù)的開發(fā)、研究、技術(shù)服務(wù)、成果轉(zhuǎn)讓;通信工程、計算機(jī)網(wǎng)絡(luò)工程的設(shè)計、安裝、施工(涉及資質(zhì)證憑證經(jīng)營);批發(fā)、零售:計算機(jī)軟硬件,網(wǎng)絡(luò)設(shè)備,電子智能設(shè)備,辦公自動化設(shè)備及耗材
屬于網(wǎng)絡(luò)內(nèi)容挖掘(Web content mining)研究的一部分,主要包括結(jié)構(gòu)化數(shù)據(jù)抽取(Structured Data Extraction)、信息集成(Information integreation)和觀點挖掘(Opinion mining)等。
 結(jié)構(gòu)化數(shù)據(jù)抽取(Structured Data Extraction)的目標(biāo)是從Web頁面中抽取結(jié)構(gòu)化數(shù)據(jù)。這些結(jié)構(gòu)化數(shù)據(jù)往往存儲在后臺數(shù)據(jù)庫中,由網(wǎng)頁按一定格式承載著展示給用戶。例如論壇列表頁面、Blog頁面、搜索引擎結(jié)果頁面等
網(wǎng)絡(luò)信息 產(chǎn)品信息

           傳統(tǒng)的網(wǎng)絡(luò)數(shù)據(jù)抽取是針對抽取對象手工編寫一段專門的抽取程序,這個程序稱為包裝器(wrapper)。近年來,越來越多的網(wǎng)絡(luò)數(shù)據(jù)抽取工具被開發(fā)出來,替代了傳統(tǒng)的手工編寫包裝器的方法。目前的網(wǎng)絡(luò)數(shù)據(jù)抽取工具可分為以下幾大類(實際上,一個工具可能會歸屬于其中若干類):
  ?開發(fā)包裝器的語言(Languages for Wrapper Development):用戶可用這些語言方便地編寫包裝器。例如Minerva,TSIMMIS,Web-OQL,F(xiàn)LORID,Jedi等。
  ?以HTML為中間件的工具(HTML-aware Tools):這些工具在抽取時主要依賴HTML文檔的內(nèi)在結(jié)構(gòu)特征。在抽取過程之前,這些工具先把文檔轉(zhuǎn)換成標(biāo)簽樹;再根據(jù)標(biāo)簽樹自動或半自動地抽取數(shù)據(jù)。代表工具有Knowlesys,MDR。
  ?基于NLP(Natural language processing)的工具(NLP-based Tools):這些工具通常利用filtering、part-of-speech tagging、lexical semantic tagging等NLP技術(shù)建立短語和句子元素之間的關(guān)系,推導(dǎo)出抽取規(guī)則。這些工具比較適合于抽取那些包含符合文法的頁面。代表工具有 RAPIER,SRV,WHISK。
  ?包裝器的歸納工具(Wrapper Induction Tools):包裝器的歸納工具從一組訓(xùn)練樣例中歸納出基于分隔符的抽取規(guī)則。這些工具和基于NLP的工具之間zui大的差別在于:這些工具不依賴于語言約束,而是依賴于數(shù)據(jù)的格式化特征。這個特點決定了這些工具比基于NLP的工具更適合于抽取HTML文檔。代表工具有:WIEN,SoftMealy,STALKER。
 

 

  ?基于模型的工具(Modeling-based Tools):這些工具讓用戶通過圖形界面,建立文檔中其感興趣的對象的結(jié)構(gòu)模型,“教”工具學(xué)會如何識別文檔中的對象,從而抽取出對象。代表工具有:NoDoSE,DEByE。
 

 

  ?基于本體的工具(Ontology-based Tools):這些工具首先需要專家參與,人工建立某領(lǐng)域的知識庫,然后工具基于知識庫去做抽取操作。如果知識庫具有足夠的表達(dá)能力,那么抽取操作可以做到*自動。而且由這些工具生成的包裝器具有比較好的靈活性和適應(yīng)性。代表工具有:BYU,X-tract。
 

 

  網(wǎng)絡(luò)數(shù)據(jù)抽取技術(shù)流程的實現(xiàn)
 其具體步驟如下(以zui通用的‘Knowlesys采集’步驟為例)
 

 

  

 

  *步,確立采集目標(biāo),即由用戶選擇目標(biāo)。
 

 

  第二步:提取特征信息,即根據(jù)目標(biāo)的網(wǎng)頁格式,提取出采集目標(biāo)數(shù)據(jù)的通性。
 

 

  第三步:網(wǎng)絡(luò)信息獲取,即利用工具自動的把頁面數(shù)據(jù)把存到數(shù)據(jù)庫。
 

在找 網(wǎng)絡(luò)信息 產(chǎn)品的人還在看

提示

×

*您想獲取產(chǎn)品的資料:

以上可多選,勾選其他,可自行輸入要求

個人信息:

利津县| 柯坪县| 广汉市| 息烽县| 光泽县| 浦北县| 郯城县| 星子县| 洪泽县| 黑山县| 逊克县| 扶绥县| 通江县| 横山县| 科尔| 蓬安县| 绥德县| 颍上县| 开化县| 和林格尔县| 边坝县| 桃源县| 柳林县| 来宾市| 辽阳市| 齐齐哈尔市| 宜都市| 莫力| 长宁区| 开平市| 板桥市| 平远县| 合阳县| 淮滨县| 谢通门县| 娄底市| 和田县| 襄樊市| 赤水市| 紫阳县| 隆林|