超越GPT-4，史丹佛團隊手機可跑的大模型火了，一夜下載量超2k-人工智慧-PHP中文網

首頁

科技週邊

人工智慧

超越GPT-4，史丹佛團隊手機可跑的大模型火了，一夜下載量超2k

王林

Apr 07, 2024 pm 04:19 PM

產業史丹佛大學 ai 智能體

在大模型落地應用的過程中，端側 AI 是非常重要的方向。

近日，史丹佛大學研究人員推出的 Octopus v2 火了，受到了開發者社群的極大關注，模型一夜下載量超 2k。

20 億參數的 Octopus v2 可以在智慧型手機、汽車、個人電腦等端側運行，在準確性和延遲方面超越了 GPT-4，並將上下文長度減少了 95%。此外，Octopus v2 比 Llama7B RAG 方案快 36 倍。

不少網友感嘆：裝置端 AI 智慧體的時代到來了！

超越GPT-4，史丹佛團隊手機可跑的大模型火了，一夜下載量超2k

論文：Octopus v2: On-device language model for super agent
##論文網址：https ://arxiv.org/abs/2404.01744
模式首頁：https://huggingface.co/NexaAIDev/Octopus-v2

模型概述

Octopus-V2-2B 是一種開源語言模型，擁有20億參數，專為Android API量身定制。它可以在Android設備上無縫運行，並將實用性擴展到從Android系統管理到多個設備的編排等各種應用程式。

超越GPT-4，史丹佛團隊手機可跑的大模型火了，一夜下載量超2k

通常，檢索增強產生 (RAG) 方法需要對潛在函數參數進行詳細描述（有時需要多達數萬個輸入 token）。基於此，Octopus-V2-2B 在訓練和推理階段引入了獨特的函數token 策略，不僅使其能夠達到與GPT-4 相當的性能水平，而且還顯著提高了推理速度，超越了基於RAG 的方法，這使得它對邊緣運算設備特別有利。

超越GPT-4，史丹佛團隊手機可跑的大模型火了，一夜下載量超2k

Octopus-V2-2B 能夠在各種複雜場景中產生單獨的、嵌套的和並行的函數呼叫。

資料集

為了訓練、驗證和測試階段採用高品質資料集，特別是實現高效訓練，研究團隊用三個關鍵階段創建資料集：

產生相關的查詢及其關聯的函數呼叫參數；
#由適當的函數元件產生不相關的查詢；
透過Google Gemini 實現二進位驗證支援。

超越GPT-4，史丹佛團隊手機可跑的大模型火了，一夜下載量超2k

研究團隊編寫了 20 個 Android API 描述，用於訓練模型。以下是一個Android API 描述範例：

def get_trending_news (category=None, region=&#39;US&#39;, language=&#39;en&#39;, max_results=5):"""Fetches trending news articles based on category, region, and language.Parameters:- category (str, optional): News category to filter by, by default use None for all categories. Optional to provide.- region (str, optional): ISO 3166-1 alpha-2 country code for region-specific news, by default, uses &#39;US&#39;. Optional to provide.- language (str, optional): ISO 639-1 language code for article language, by default uses &#39;en&#39;. Optional to provide.- max_results (int, optional): Maximum number of articles to return, by default, uses 5. Optional to provide.Returns:- list [str]: A list of strings, each representing an article. Each string contains the article&#39;s heading and URL.    """

登入後複製

模型開發與訓練

該研究採用Google Gemma-2B 模型作為框架中的預訓練模型，並採用兩種不同的訓練方法：完整模型訓練和LoRA 模型訓練。

在完整模型訓練中，研究使用 AdamW 最佳化器，學習率設定為 5e-5，warm-up 的 step 數設定為 10，採用線性學習率調度器。

LoRA 模型訓練採用與完整模型訓練相同的最佳化器和學習率配置，LoRA rank 設定為 16，並將 LoRA 應用於以下模組：q_proj、k_proj、v_proj、o_proj、up_proj、down_proj。其中，LoRA alpha 參數設定為 32。

對於兩種訓練方法，epoch 數皆設定為 3。

使用以下程式碼，就可以在單一 GPU 上執行 Octopus-V2-2B 模型。

from transformers import AutoTokenizer, GemmaForCausalLMimport torchimport timedef inference (input_text):start_time = time.time ()input_ids = tokenizer (input_text, return_tensors="pt").to (model.device)input_length = input_ids ["input_ids"].shape [1]outputs = model.generate (input_ids=input_ids ["input_ids"], max_length=1024,do_sample=False)generated_sequence = outputs [:, input_length:].tolist ()res = tokenizer.decode (generated_sequence [0])end_time = time.time ()return {"output": res, "latency": end_time - start_time}model_id = "NexaAIDev/Octopus-v2"tokenizer = AutoTokenizer.from_pretrained (model_id)model = GemmaForCausalLM.from_pretrained (model_id, torch_dtype=torch.bfloat16, device_map="auto")input_text = "Take a selfie for me with front camera"nexa_query = f"Below is the query from the users, please call the correct function and generate the parameters to call the function.\n\nQuery: {input_text} \n\nResponse:"start_time = time.time () print ("nexa model result:\n", inference (nexa_query)) print ("latency:", time.time () - start_time,"s")

登入後複製

評估

Octopus-V2-2B 在基準測試中表現出卓越的推理速度，在單一A100 GPU 上比「Llama7B RAG 解決方案」快36 倍。此外，與依賴叢集 A100/H100 GPU 的 GPT-4-turbo 相比，Octopus-V2-2B 速度提高了 168%。這種效率突破歸功於 Octopus-V2-2B 的函數性 token 設計。

超越GPT-4，史丹佛團隊手機可跑的大模型火了，一夜下載量超2k

Octopus-V2-2B 不僅在速度上表現出色，在準確率上也表現出色，在函數呼叫準確率上超越「Llama7B RAG 方案」31%。 Octopus-V2-2B 實現了與 GPT-4 和 RAG GPT-3.5 相當的函數呼叫準確率。

超越GPT-4，史丹佛團隊手機可跑的大模型火了，一夜下載量超2k

有興趣的讀者可以閱讀論文原文，了解更多研究內容。

以上是超越GPT-4，史丹佛團隊手機可跑的大模型火了，一夜下載量超2k的詳細內容。更多資訊請關注PHP中文網其他相關文章！

本網站聲明

本文內容由網友自願投稿，版權歸原作者所有。本站不承擔相應的法律責任。如發現涉嫌抄襲或侵權的內容，請聯絡admin@php.cn

熱AI工具

熱工具

熱門話題

Java教學

1677

CakePHP 教程

1430

Laravel 教程

1333

PHP教程

1278

C# 教程

1257

Related knowledge

DeepMind機器人打乒乓球，正手、反手溜到飛起，全勝人類初學者 Aug 09, 2024 pm 04:01 PM

但可能打不過公園裡的老大爺？巴黎奧運正在如火如荼地進行中，乒乓球項目備受關注。同時，機器人打乒乓球也取得了新突破。剛剛，DeepMind提出了第一個在競技乒乓球比賽中達到人類業餘選手等級的學習型機器人智能體。論文地址：https://arxiv.org/pdf/2408.03906DeepMind這個機器人打乒乓球什麼程度呢？大概和人類業餘選手不相上下：正手反手都會：對手採用多種打法，機器人也能招架得住：接不同旋轉的發球：不過，比賽激烈程度似乎不如公園老大爺對戰。對機器人來說，乒乓球運動

首配機械爪！元蘿蔔亮相2024世界機器人大會，發布首個走進家庭的西洋棋機器人 Aug 21, 2024 pm 07:33 PM

8月21日，2024世界機器人大會在北京隆重召開。商湯科技旗下家用機器人品牌「元蘿蔔SenseRobot」家族全系產品集體亮相，並最新發布元蘿蔔AI下棋機器人－國際象棋專業版（以下簡稱「元蘿蔔國象機器人」），成為全球首個走進家庭的西洋棋機器人。作為元蘿蔔的第三款下棋機器人產品，全新的國象機器人在AI和工程機械方面進行了大量專項技術升級和創新，首次在家用機器人上實現了透過機械爪拾取立體棋子，並進行人機對弈、人人對弈、記譜複盤等功能，

Claude也變懶了！網友：學會給自己放假了 Sep 02, 2024 pm 01:56 PM

開學將至，該收心的不只即將開啟新學期的同學，可能還有AI大模型。前段時間，Reddit擠滿了吐槽Claude越來越懶的網友。「它的水平下降了很多，經常停頓，甚至輸出也變得很短。在發布的第一周，它可以一次性翻譯整整4頁文稿，現在連半頁都輸出不了！」https:// www.reddit.com/r/ClaudeAI/comments/1by8rw8/something_just_feels_wrong_with_claude_in_the/在一個名為“對Claude徹底失望了的帖子裡”，滿滿地

世界機器人大會上，這家承載「未來養老希望」的國產機器人被包圍了 Aug 22, 2024 pm 10:35 PM

在北京舉行的世界機器人大會上，人形機器人的展示成為了現場絕對的焦點，在星塵智能的展台上，由於AI機器人助理S1在一個展區上演揚琴、武術、書法三台大戲，能文能武，吸引了大量專業觀眾和媒體的駐足。在有彈性的琴弦上優雅的演奏，讓S1展現出速度、力度、精準度兼具的精細操作與絕對掌控。央視新聞對「書法」背後的模仿學習和智慧控制進行了專題報道，公司創始人來傑解釋到，絲滑動作的背後，是硬體側追求最好力控和最仿人身體指標（速度、負載等），而是在AI側則採集人的真實動作數據，讓機器人遇強則強，快速學習進化。而敏捷

ACL 2024獎項發表：華科大破解甲骨文最佳論文之一、GloVe時間檢驗獎 Aug 15, 2024 pm 04:37 PM

本屆ACL大會，投稿者「收穫滿滿」。為期六天的ACL2024正在泰國曼谷舉辦。 ACL是計算語言學和自然語言處理領域的頂級國際會議，由國際計算語言學協會組織，每年舉辦一次。一直以來，ACL在NLP領域的學術影響力都名列第一，它也是CCF-A類推薦會議。今年的ACL大會已是第62屆，接收了400餘篇NLP領域的前沿工作。昨天下午，大會公佈了最佳論文等獎項。此次，最佳論文獎7篇（兩篇未公開）、最佳主題論文獎1篇、傑出論文獎35篇。大會也評出了資源論文獎（ResourceAward）3篇、社會影響力獎（

李飛飛團隊提出ReKep，讓機器人具備空間智能，還能整合GPT-4o Sep 03, 2024 pm 05:18 PM

視覺與機器人學習的深度融合。當兩隻機器手絲滑地互相合作疊衣服、倒茶、將鞋子打包時，加上最近老上頭條的1X人形機器人NEO，你可能會產生一種感覺：我們似乎開始進入機器人時代了。事實上，這些絲滑動作正是先進機器人技術+精妙框架設計+多模態大模型的產物。我們知道，有用的機器人往往需要與環境進行複雜精妙的交互，而環境則可被表示成空間域和時間域上的限制。舉個例子，如果要讓機器人倒茶，那麼機器人首先需要抓住茶壺手柄並使之保持直立，不潑灑出茶水，然後平穩移動，一直到讓壺口與杯口對齊，之後以一定角度傾斜茶壺。這

分散式人工智慧盛會DAI 2024徵稿：Agent Day，強化學習之父Richard Sutton將出席！顏水成、Sergey Levine以及DeepMind科學家將做主旨報告 Aug 22, 2024 pm 08:02 PM

會議簡介隨著科技的快速發展，人工智慧成為了推動社會進步的重要力量。在這個時代，我們有幸見證並參與分散式人工智慧（DistributedArtificialIntelligence，DAI）的創新與應用。分散式人工智慧是人工智慧領域的重要分支，這幾年引起了越來越多的關注。基於大型語言模型（LLM）的智能體（Agent）異軍突起，透過結合大模型的強大語言理解和生成能力，展現了在自然語言互動、知識推理、任務規劃等方面的巨大潛力。 AIAgent正在接棒大語言模型，成為目前AI圈的熱門話題。 Au

鴻蒙智行享界S9全場景新品發表會，多款重磅新品齊發 Aug 08, 2024 am 07:02 AM

今天下午，鸿蒙智行正式迎来了新品牌与新车。8月6日，华为举行鸿蒙智行享界S9及华为全场景新品发布会，带来了全景智慧旗舰轿车享界S9、问界新M7Pro和华为novaFlip、MatePadPro12.2英寸、全新MatePadAir、华为毕昇激光打印机X1系列、FreeBuds6i、WATCHFIT3和智慧屏S5Pro等多款全场景智慧新品，从智慧出行、智慧办公到智能穿戴，华为全场景智慧生态持续构建，为消费者带来万物互联的智慧体验。鸿蒙智行：深度赋能，推动智能汽车产业升级华为联合中国汽车产业伙伴，为

See all articles

超越GPT-4，史丹佛團隊手機可跑的大模型火了，一夜下載量超2k

熱AI工具

Undresser.AI Undress

AI Clothes Remover

Undress AI Tool

Clothoff.io

Video Face Swap

熱門文章

熱工具

記事本++7.3.1

SublimeText3漢化版

禪工作室 13.0.1

Dreamweaver CS6

SublimeText3 Mac版

熱門話題