色哟哟视频在线观看-色哟哟视频在线-色哟哟欧美15最新在线-色哟哟免费在线观看-国产l精品国产亚洲区在线观看-国产l精品国产亚洲区久久

0
  • 聊天消息
  • 系統消息
  • 評論與回復
登錄后你可以
  • 下載海量資料
  • 學習在線課程
  • 觀看技術視頻
  • 寫文章/發帖/加入社區
會員中心
电子发烧友
开通电子发烧友VIP会员 尊享10大特权
海量资料免费下载
精品直播免费看
优质内容免费畅学
课程9折专享价
創作中心

完善資料讓更多小伙伴認識你,還能領取20積分哦,立即完善>

3天內不再提示

LLM之外的性價比之選,小語言模型

E4Life ? 來源:電子發燒友網 ? 作者:周凱揚 ? 2024-06-03 05:15 ? 次閱讀



電子發燒友網報道(文/周凱揚)大語言模型的風靡給AI應用創造了不少機會,無論是效率還是創意上,大語言模型都帶來了前所未有的表現,這些大語言模型很快成為大型互聯網公司或者AI應用公司的殺手級產品。然而在一些對實時性要求較高的應用中,比如AI客服、實時數據分析等,大語言模型并沒有太大的優勢。

在動輒萬億參數的LLM下,硬件需求已經遭受了不小的挑戰。所以面對一些相對簡單的任務,規模較小的小語言模型(SLM)反而更加適合。尤其是在端側的本地AI模型,在低功耗算力有限的邊緣AI芯片支持下,小語言模型反而更適合發揮最高性能,而不是促使硬件一味地去追求更大規模模型的支持。

微軟Phi

2023年,微軟推出了一個基于Transformer架構的小語言模型Phi-1,該模型只有13億參數,且主要專注于基礎的Python編程,實現文本轉代碼。整個模型僅僅用到8塊A100 GPU,耗時四天訓練完成的。

這也充分說明了小語言模型的靈活性,在LLM普遍需要成百上千塊GPU,花費數十乃至上百天的時間完成模型的訓練時,SLM卻只需要千分之一的資源,就可以針對特定的任務打造適合的模型。

近日,微軟對Phi模型進行了全面更新,推出了Phi-3-mini、Phi-3-small和Phi-3-medium三個版本。其中Phi3-mini是一個38億參數的小語言模型,同步推出的Phi-3-small和Phi-3-medium分別為70億參數和140億參數的模型。

Phi-3-mini有支持4K和128K兩個上下文長度的版本,也是這個規模的模型中,第一個支持到最高128K上下文長度的版本,微軟聲稱其性能甚至超過不少70億參數的大模型。通過在搭載A16芯片的iPhone 14上測試,在純粹的設備端離線運行下,Phi-3-mini可以做到12 token每秒的速度。

谷歌Gemma


在Gemini模型獲得成功后,基于大語言模型框架Gemini,谷歌也開發了對應的輕量小語言模型Gemma。Gemma分為20億參數和70億參數的版本,其中20億參數的Gemma可以在移動設備和筆記本電腦上運行,而70億參數的版本則可以擴展至小型服務器上。雖然資源占用不高,但Gemma在各項基準測試中,依然可以與更大規模的模型相媲美,比如130億參數的Llama-2等。

此外,谷歌不僅提供了預訓練版本的Gemma,也支持通過額外的訓練來實現模型調優,用于修改Gemma模型的行為,提高其在特定任務上的表現,比如通過人類語言互動進行訓練,提高聊天機器人中響應式對話輸入的表現等。

?
Gemma與Llama-2的性能對比/谷歌


在對運行設備的要求上,Gemma自然比不上大哥Gemini,但谷歌與英偉達合作,針對從數據中心到云端再到RTX AI PC的GPU都進行了優化,這樣一來不僅具有廣泛的跨設備兼容性,也能確保擴展性和高性能的雙重優勢。

寫在最后


小語言模型的出現為行業帶來了新的選擇,尤其是在大多數大模型應用還是在不斷燒錢的當下,小語言模型加速落地的同時,也提供了訓練成本更低的解決方案。但與此同時,小語言模型的缺陷依然不可忽視,比如其規模注定了無法存儲足夠的“事實性知識”,其次這類小語言模型很難做到多語言支持。但我們必須認清小語言模型的存在并不是為了替代大語言模型,而是提供一個更加靈活的模型方案。

聲明:本文內容及配圖由入駐作者撰寫或者入駐合作網站授權轉載。文章觀點僅代表作者本人,不代表電子發燒友網立場。文章及其配圖僅供工程師學習之用,如有內容侵權或者其他違規問題,請聯系本站處理。 舉報投訴
  • 模型
    +關注

    關注

    1

    文章

    3490

    瀏覽量

    50023
  • 大模型
    +關注

    關注

    2

    文章

    3033

    瀏覽量

    3839
  • LLM
    LLM
    +關注

    關注

    1

    文章

    320

    瀏覽量

    688
收藏 0人收藏

    評論

    相關推薦
    熱點推薦

    小白學大模型:從零實現 LLM語言模型

    在當今人工智能領域,大型語言模型LLM)的開發已經成為一個熱門話題。這些模型通過學習大量的文本數據,能夠生成自然語言文本,完成各種復雜的任
    的頭像 發表于 04-30 18:34 ?331次閱讀
    小白學大<b class='flag-5'>模型</b>:從零實現 <b class='flag-5'>LLM</b><b class='flag-5'>語言</b><b class='flag-5'>模型</b>

    無法在OVMS上運行來自Meta的大型語言模型LLM),為什么?

    無法在 OVMS 上運行來自 Meta 的大型語言模型LLM),例如 LLaMa2。 從 OVMS GitHub* 存儲庫運行 llama_chat Python* Demo 時遇到錯誤。
    發表于 03-05 08:07

    新品| LLM630 Compute Kit,AI 大語言模型推理開發平臺

    LLM630LLM推理,視覺識別,可開發,靈活擴展···LLM630ComputeKit是一款AI大語言模型推理開發平臺,專為邊緣計算和智能交互應用而設計。該套件的主板搭載愛芯AX63
    的頭像 發表于 01-17 18:48 ?598次閱讀
    新品| <b class='flag-5'>LLM</b>630 Compute Kit,AI 大<b class='flag-5'>語言</b><b class='flag-5'>模型</b>推理開發平臺

    小白學大模型:構建LLM的關鍵步驟

    隨著大規模語言模型LLM)在性能、成本和應用前景上的快速發展,越來越多的團隊開始探索如何自主訓練LLM模型。然而,是否從零開始訓練一個
    的頭像 發表于 01-09 12:12 ?842次閱讀
    小白學大<b class='flag-5'>模型</b>:構建<b class='flag-5'>LLM</b>的關鍵步驟

    什么是LLMLLM在自然語言處理中的應用

    隨著人工智能技術的飛速發展,自然語言處理(NLP)領域迎來了革命性的進步。其中,大型語言模型LLM)的出現,標志著我們對語言理解能力的一次
    的頭像 發表于 11-19 15:32 ?3384次閱讀

    如何訓練自己的LLM模型

    訓練自己的大型語言模型LLM)是一個復雜且資源密集的過程,涉及到大量的數據、計算資源和專業知識。以下是訓練LLM模型的一般步驟,以及一些關
    的頭像 發表于 11-08 09:30 ?1399次閱讀

    使用LLM進行自然語言處理的優缺點

    自然語言處理(NLP)是人工智能和語言學領域的一個分支,它致力于使計算機能夠理解、解釋和生成人類語言。大型語言模型
    的頭像 發表于 11-08 09:27 ?1972次閱讀

    新品|LLM Module,離線大語言模型模塊

    LLM,全稱大語言模型(LargeLanguageModel)。是一種基于深度學習的人工智能模型。它通過大量文本數據進行訓練,從而能夠進行對話、回答問題、撰寫文本等其他任務
    的頭像 發表于 11-02 08:08 ?942次閱讀
    新品|<b class='flag-5'>LLM</b> Module,離線大<b class='flag-5'>語言</b><b class='flag-5'>模型</b>模塊

    LLM模型推理加速的關鍵技術

    LLM(大型語言模型)大模型推理加速是當前人工智能領域的一個研究熱點,旨在提高模型在處理復雜任務時的效率和響應速度。以下是對
    的頭像 發表于 07-24 11:38 ?1647次閱讀

    模型LLM與ChatGPT的技術原理

    在人工智能領域,大模型(Large Language Model, LLM)和ChatGPT等自然語言處理技術(Natural Language Processing, NLP)正逐步改變著人類
    的頭像 發表于 07-10 10:38 ?1521次閱讀

    llm模型本地部署有用嗎

    在當今的人工智能領域,LLM(Large Language Model,大型語言模型)已經成為了一種非常受歡迎的技術。它們在自然語言處理(NLP)任務中表現出色,如文本生成、翻譯、摘要
    的頭像 發表于 07-09 10:14 ?1142次閱讀

    llm模型有哪些格式

    LLM(Large Language Model,大型語言模型)是一種深度學習模型,主要用于處理自然語言處理(NLP)任務。
    的頭像 發表于 07-09 09:59 ?1304次閱讀

    LLM模型和LMM模型的區別

    LLM(線性混合模型)和LMM(線性混合效應模型)之間的區別如下: 定義: LLM(線性混合模型)是一種統計
    的頭像 發表于 07-09 09:57 ?2343次閱讀

    llm模型和chatGPT的區別

    LLM(Large Language Model)是指大型語言模型,它們是一類使用深度學習技術構建的自然語言處理(NLP)模型
    的頭像 發表于 07-09 09:55 ?1895次閱讀

    LLM模型的應用領域

    在本文中,我們將深入探討LLM(Large Language Model,大型語言模型)的應用領域。LLM是一種基于深度學習的人工智能技術,它能夠理解和生成自然
    的頭像 發表于 07-09 09:52 ?1185次閱讀
    主站蜘蛛池模板: 亚洲免费网站在线观看 | 少妇人妻偷人精品视蜜桃 | 久久精品手机观看 | 伊人国产视频 | 新版孕妇bbwbbwbbw | 蜜芽亚洲欧美一区二区电影 | 性吧 校园春色 | 被肉日常np高h | 国产人妻人伦精品久久久 | 边做边爱播放3免费观看 | 久久婷婷五月综合色丁香花 | 鸥美一级黄色片 | 久久黄色免费 | 国产精品久久久久久无码专区 | 日韩欧美一区二区三区在线视频 | 97国产成人精品免费视频 | 给个男人都懂的网址2019 | 亚洲国产在线视频精品 | 黄色精品视频 | 国产精品线路一线路二 | asian极品呦女xx农村 | 欧美国产影院 | 果冻传媒2021精品影视 | 99久久精品国产亚洲AV | 久久天堂网| 丝瓜视频樱桃视频在线观看免费 | 久久精品国产亚洲AV妓女不卡 | 无码中文字幕av免费放 | AV色蜜桃一区二区三区 | 日韩欧美一区二区三区免费观看 | 美女脱了内裤张开腿让男人爽 | 啊轻点啊再深点视频免费 | 久久丫线这里只精品 | 日本bbwhd| 91系列在线观看免费 | 超碰人热人人热人人看 | 岳打开双腿开始配合日韩视频 | 亚洲黄视频在线观看 | 中文无码第3页不卡av | 冠希和阿娇13分钟在线视频 | 囯产少妇BBBBBB高潮喷水一 |

    電子發燒友

    中國電子工程師最喜歡的網站

    • 2931785位工程師會員交流學習
    • 獲取您個性化的科技前沿技術信息
    • 參加活動獲取豐厚的禮品