色哟哟视频在线观看-色哟哟视频在线-色哟哟欧美15最新在线-色哟哟免费在线观看-国产l精品国产亚洲区在线观看-国产l精品国产亚洲区久久

0
  • 聊天消息
  • 系統(tǒng)消息
  • 評論與回復
登錄后你可以
  • 下載海量資料
  • 學習在線課程
  • 觀看技術視頻
  • 寫文章/發(fā)帖/加入社區(qū)
會員中心
創(chuàng)作中心

完善資料讓更多小伙伴認識你,還能領取20積分哦,立即完善>

3天內不再提示

谷歌重磅發(fā)布自然問題數據集,包含30萬個自然發(fā)生的問題和人工注釋的答案

DPVg_AI_era ? 來源:lq ? 2019-01-25 09:07 ? 次閱讀

今天,谷歌重磅發(fā)布自然問題數據集(Natural Questions),包含30萬個自然發(fā)生的問題和人工注釋的答案,16000個示例,并發(fā)起基于此數據集的問答系統(tǒng)挑戰(zhàn)賽。有望成為自然語言理解領域的SQuAD!

開放領域問題回答(QA)是自然語言理解(NLU)中的一項基準任務,它的目的是模擬人類如何查找信息,通過閱讀和理解整個文檔來找到問題的答案。

比如,給定一個用自然語言表達的問題“為什么天空是藍色的?”("Why is the sky blue?”),QA系統(tǒng)應該能夠閱讀網頁(例如“天空漫射”的維基百科頁面)并返回正確的答案,即使答案有些復雜和冗長。

然而,目前還沒有可以用于訓練和評估QA模型的大型、公開的自然發(fā)生問題(即由尋求信息的人提出的問題)和答案數據集。

這是因為構建用于QA任務的高質量數據集需要大量的真實問題來源,并且需要大量人力來為這些問題尋找正確答案。

為了促進QA領域的研究進展,谷歌今天發(fā)布自然問題數據集(Natural Questions, NQ),這是一個用于訓練和評估開放領域問答系統(tǒng)的新的、大規(guī)模語料庫,也是第一個復制人類查找問題答案的端到端流程的語料庫。

Natural Questions數據集

NQ的規(guī)模非常龐大,包含30萬個自然發(fā)生的問題,以及來自Wikipedia頁面的人工注釋答案,用于訓練QA系統(tǒng)。

此外,NQ語料庫還包含16000個示例,每個示例都由5位不同的注釋人提供答案(針對相同的問題),這對于評估所學習的QA系統(tǒng)的性能非常有用。

Natural Questions數據集中的示例

由于回答NQ中的問題比回答瑣碎問題(這些問題對計算機來說已經很容易解決)需要有更深入的理解,谷歌還發(fā)起了一項基于此數據集的挑戰(zhàn)賽,以幫助提高計算機對自然語言的理解。

NQ挑戰(zhàn)賽排行榜

NQ數據集包含307K訓練示例、8K開發(fā)示例和8K測試示例。

目前,NQ挑戰(zhàn)賽排行榜上只有谷歌的BERT模型和DecAtt-DocReader模型的成績。在論文中,谷歌證明在長答案選擇任務上的人類的最優(yōu)成績?yōu)?7% F1,在短答案選擇任務上人類的最優(yōu)成績?yōu)?6%。

來自谷歌搜索的真實問題

NQ是第一個使用自然發(fā)生的查詢創(chuàng)建的數據集,并專注于通過閱讀整個頁面來查找答案,而不是從一個短段落中提取答案。

為了創(chuàng)建NQ,我們從用戶提交給Google搜索引擎的真實、匿名、聚合的查詢開始。

然后,我們要求注釋者通過通讀整個維基百科頁面來找到答案,就好像這個問題是他們自己提出的一樣。注釋者需要找到一個長答案和一個短答案,長答案涵蓋推斷問題所需的所有信息,短答案需要用一個或多個實體的名稱簡潔地回答問題。

對NQ語料庫的注釋質量進行評估,顯示準確率達到90%。

注釋包含一個長答案和一個短答案

研究人員在論文《自然問題:問答研究的基準》(Natural Questions: a Benchmark for Question Answering Research)中對數據收集的過程進行了全面描述,論文已發(fā)表在《計算語言學協(xié)會會刊》(Transactions of the Association for computing Linguistics)。大家也可以在NQ網站上查看更多來自數據集的示例。

自然語言理解挑戰(zhàn)

NQ的目的是使QA系統(tǒng)能夠閱讀和理解完整的維基百科文章,其中可能包含問題的答案,也可能不包含問題的答案。

系統(tǒng)首先需要確定這個問題的定義是否足夠充分,是否可以回答——許多問題本身基于錯誤的假設,或者過于模糊,無法簡明扼要地回答。

然后,系統(tǒng)需要確定維基百科頁面中是否包含推斷答案所需的所有信息。我們認為,相比在知道長答案后在尋找短答案,長答案識別任務——找到推斷答案所需的所有信息——需要更深層次的語言理解。

我們希望NQ的發(fā)布以及相關的挑戰(zhàn)賽將有助于推動更有效、更強大的QA系統(tǒng)的開發(fā)。我們鼓勵NLU社區(qū)參與進來,并幫助縮小目前最先進方法的性能與人類上限之間的巨大差距。

聲明:本文內容及配圖由入駐作者撰寫或者入駐合作網站授權轉載。文章觀點僅代表作者本人,不代表電子發(fā)燒友網立場。文章及其配圖僅供工程師學習之用,如有內容侵權或者其他違規(guī)問題,請聯(lián)系本站處理。 舉報投訴
  • 谷歌
    +關注

    關注

    27

    文章

    6171

    瀏覽量

    105508
  • 數據集
    +關注

    關注

    4

    文章

    1208

    瀏覽量

    24727
  • 自然語言
    +關注

    關注

    1

    文章

    288

    瀏覽量

    13359

原文標題:NLP新基準!谷歌重磅發(fā)布開放問答數據集,30萬自然提問+人工注釋答案

文章出處:【微信號:AI_era,微信公眾號:新智元】歡迎添加關注!文章轉載請注明出處。

收藏 人收藏

    評論

    相關推薦

    自然語言處理與機器學習的關系 自然語言處理的基本概念及步驟

    Learning,簡稱ML)是人工智能的一核心領域,它使計算機能夠從數據中學習并做出預測或決策。自然語言處理與機器學習之間有著密切的關系,因為機器學習提供了一種強大的工具,用于從大
    的頭像 發(fā)表于 12-05 15:21 ?522次閱讀

    語音識別與自然語言處理的關系

    人工智能的快速發(fā)展中,語音識別和自然語言處理(NLP)成為了兩重要的技術支柱。語音識別技術使得機器能夠理解人類的語音,而自然語言處理則讓機器能夠理解、解釋和生成人類語言。這兩項技術
    的頭像 發(fā)表于 11-26 09:21 ?440次閱讀

    ASR與自然語言處理的結合

    ASR(Automatic Speech Recognition,自動語音識別)與自然語言處理(NLP)是人工智能領域的兩重要分支,它們在許多應用中緊密結合,共同構成了自然語言理解和
    的頭像 發(fā)表于 11-18 15:19 ?439次閱讀

    自然語言處理與機器學習的區(qū)別

    人工智能的快速發(fā)展中,自然語言處理(NLP)和機器學習(ML)成為了兩核心的研究領域。它們都致力于解決復雜的問題,但側重點和應用場景有所不同。 1. 自然語言處理(NLP) 定義:
    的頭像 發(fā)表于 11-11 10:35 ?615次閱讀

    AI智能化問答:自然語言處理技術的重要應用

    自然語言處理(NLP)是人工智能領域的一重要分支,它致力于使計算機能夠理解、解釋和生成人類語言。問答系統(tǒng)作為NLP的一重要應用,能夠精確地解析用戶以
    的頭像 發(fā)表于 10-12 10:58 ?474次閱讀
    AI智能化問答:<b class='flag-5'>自然</b>語言處理技術的重要應用

    自然語言處理技術有哪些

    自然語言處理(Natural Language Processing,簡稱NLP)是人工智能領域的一分支,它致力于使計算機能夠理解、解釋和生成人類語言。自然語言處理技術的發(fā)展已經取得
    的頭像 發(fā)表于 07-03 14:30 ?1196次閱讀

    自然語言處理模式的優(yōu)點

    自然語言處理(Natural Language Processing,簡稱NLP)是人工智能領域的一重要分支,它致力于使計算機能夠理解、生成和處理人類語言。隨著技術的發(fā)展,自然語言處
    的頭像 發(fā)表于 07-03 14:24 ?809次閱讀

    自然語言處理是什么技術的一種應用

    自然語言處理(Natural Language Processing,簡稱NLP)是人工智能和語言學領域的一分支,它涉及到使用計算機技術來處理、分析和生成自然語言文本。
    的頭像 發(fā)表于 07-03 14:18 ?980次閱讀

    自然語言處理包括哪些內容

    自然語言處理(Natural Language Processing,簡稱NLP)是人工智能領域的一重要分支,它涉及到計算機與人類語言之間的交互。NLP的目標是讓計算機能夠理解、生成和處理人類語言
    的頭像 發(fā)表于 07-03 14:15 ?971次閱讀

    自然語言處理屬于人工智能的哪個領域

    自然語言處理(Natural Language Processing,簡稱NLP)是人工智能(Artificial Intelligence,簡稱AI)領域的一重要分支。它涉及到計算機與人類語言
    的頭像 發(fā)表于 07-03 14:09 ?1390次閱讀

    什么是自然語言處理 (NLP)

    自然語言處理(Natural Language Processing, NLP)是人工智能領域中的一重要分支,它專注于構建能夠理解和生成人類語言的計算機系統(tǒng)。NLP的目標是使計算機能夠像人類一樣
    的頭像 發(fā)表于 07-02 18:16 ?1215次閱讀

    自然語言處理技術的原理的應用

    自然語言處理(Natural Language Processing, NLP)作為人工智能(AI)領域的一重要分支,旨在使計算機能夠理解和處理人類自然語言。隨著互聯(lián)網的普及和大
    的頭像 發(fā)表于 07-02 12:50 ?542次閱讀

    神經網絡在自然語言處理中的應用

    自然語言處理(NLP)是人工智能領域中的一重要分支,它研究的是如何使計算機能夠理解和生成人類自然語言。隨著人工智能技術的飛速發(fā)展,神經網絡
    的頭像 發(fā)表于 07-01 14:09 ?524次閱讀

    **十萬級口語識別,離線自然說技術,讓智能照明更懂你**

    隨著人工智能技術的普及,智能家居設備開始走進千家戶。而智能照明系統(tǒng)作為其不可或缺的一部分,占據著舉足輕重的地位。 所謂智能照明,就是通過語音、手機/平板應用程序、無線面板或遙控技術實現智能控制
    發(fā)表于 04-29 17:09

    谷歌交互世界模型重磅發(fā)布

    谷歌模型
    北京中科同志科技股份有限公司
    發(fā)布于 :2024年02月28日 09:13:06
    主站蜘蛛池模板: 国产成人高清在线观看播放| RUNAWAY韩国动漫免费官网版| 91久久线看在观草草青青| 国产中文在线观看| 亚洲精品国产AV成人毛片| 国产偷国产偷亚洲高清人乐享| 忘忧草在线| 国产性夜夜性夜夜爽91| bt成人社区| 三八成人网| 国产乱人伦AV麻豆网| 新香蕉少妇视频网站| 久久99国产精品无码AV| 又大又硬又爽免费视频| 可以看的黄页的网站| 99热视频这里只有久久精品| 色噜噜噜亚洲男人的天堂| 麻豆精品乱码WWW久久密| 啊…嗯啊好深男男小黄文| 我就去色色| 日本美女论坛| 国产午夜精品一区二区三区 | 草莓视频免费看| 亚洲AV色香蕉一区二区9255 | 肉多荤文高h羞耻校园| 免费在线亚洲视频| 波多久久亚洲精品AV无码| 最近的2019中文字幕国语完整版 | 有码 亚洲 制服 国产 在线| 学生小泬无遮挡女HD| 我半夜摸妺妺的奶C了她| 欧美性类s0x| 国产亚洲制服免视频| 91欧美秘密入口| 中国农村妇女真实BBWBBWBBW| 日本理伦片午夜理伦片| 欧美性类s0x| 欧美成人中文字幕在线看| 国产乱码免费卡1卡二卡3卡四卡| 粉嫩自拍 偷拍 亚洲| 一本道亚洲区免费观看|