跳到主要內容

新時代的開始:大型語言模型從新穎工具變為商業必需

Appier 技術長陳明愉博士

人們對大型語言模型(LLM)的態度已經從單純的嘗鮮轉變為實際需求,如 ChatGPT 和 Bard 等大型語言模型已逐漸成為商業領域中不可或缺的工具。預計到 2027 年,企業在生成式人工智慧(AI)解決方案上的投入將達到 1,511 億美元,且 2023 到 2027 年的複合年增長率將達到 86.1%,顯示企業對 AI 應用的興趣正在急速上升。

大型語言模型已從最初的熱門話題轉變為企業的策略焦點,力求將 AI 更深度地融入商業運作中。例如,麥肯錫的年度 AI 發展現狀調查顯示,有三分之一的企業至少在一項業務中固定採用生成式 AI。同時,有 25% 使用 AI 的企業表示生成式 AI 已被納入其董事會議程,凸顯了 AI 在企業決策面的重要性。

隨著生成式 AI 解決方案的發展更具策略性和針對性,企業加大技術應用的態勢必將提升整體績效,使 2024 年成為企業採用大型語言模型的關鍵一年。這項演進標誌著新時代的來臨,在這個時代中, AI 不再只是一項實驗性工具,更是企業發展策略和營運的基本要素。

大型語言模型應用:2023 年與 2024 年

在 2023 年,雖然有部分公司員工開始嘗試使用 ChatGPT 及其他大型語言模型工具,這些工具主要用於撰寫電子郵件或回覆訊息。更具前瞻性的人可能會利用這些工具來撰寫提案或其他篇幅較長的文件。然而,有鑑於大型語言模型生成的內容可能出現不符事實或類似幻覺的情況,大多數時候,這些內容僅用於內部參考,並不適合用於外部公開場合。

然而現在,經過一年的實驗和改進,大型語言模型開發人員已經準備好推出──或者已經推出面向企業的商務版產品,以滿足企業開發的需求。其中最受矚目的,莫過於「客戶服務」和「內容創建」兩大應用領域,今年,這兩項應用的品質與採用率可望有顯著的提升。

為什麼是 2024 年?

2024 年將成為大規模採用大型語言模型應用程式的轉捩點之年,背後驅動的兩大關鍵因素是「技術演進」和「市場情緒」。自從 ChatGPT 於 2022 年 11 月面世以來,大型語言模型技術已經從單純完善文案和分析模型,演變成為功能全面的聊天機器人,不僅能執行程式碼、運用工具,還能存取外部知識和搜尋網路。換言之,在短短不到 12 個月的時間裡,這項具有革命性意義的工具已徹底改變了整個技術社群的面貌。

然而,如果高階主管不買賬,這些技術演進便難以在市場上獲得認可──這正是 2023 年的瓶頸所在。現在,大多數執行長都已達成共識,認為在業務營運中採用 AI 解決方案是當務之急,他們明確表示,投資 AI 至關重要。隨著更多針對特定垂直產業的大型語言模型問世,企業採用和部署這些生成式 AI 解決方案將變得更加容易。 2024 年,大型語言模型開發人員還將著手解決一項關鍵挑戰──資料安全。技術開發人員將提供一個讓企業將數據存在其內部系統的解決方案,進而提供更安全、更強大的產品,以滿足那些重視風險管理的執行長的需求,獲得他們的青睞。

2023 年,各國政府及其他監管機構在規範 AI 方面面臨挑戰。去年 12 月,歐盟就《AI法案》達成共識,這是一項具里程碑意義的法案,旨在對 AI 的使用進行規範和限制。該法案一經實施,以及隨後可能出台的相關法案,將對科技公司開發 AI 解決方案的方式產生深遠影響。簡言之,這些法案將對何種行為是許可的、何種行為是禁止的,建立基本的規則框架。

隨著更強大的功能、更廣泛的支持以及更清晰的認識,預期大型語言模型應用程式將在全球各大型企業中得到更具規模化的採用。

客戶服務、內容創作與大型語言模型

想像一下,如果 ChatGPT 是網站上的客服聊天機器人,你根本無法分辨真人與機器人。而將 大型語言模型聊天機器人整合到客戶服務中,也為企業提供了一個節省成本的機會,能隨時為客戶提供服務。實際上,隨著消費者對企業和企業體驗的要求越來越高,這些大型語言模型聊天機器人可以提供更個人化的互動,並且提高客戶滿意度。

使用大型語言模型創建內容的優點之一是速度快。如果你不滿意它生成的結果,只需重新調整提示措辭,不到一分鐘就能獲得新的結果。這在行銷和廣告領域尤其有用,因為多變量測試和迭代是獲致最佳化內容的關鍵。無論是廣告標語、充滿資訊的部落格文章,甚至是短篇小說,大型語言模型都能夠借助其被訓練過的大量數據來產生新的想法和文本。

除了速度之外,讓企業購買和使用這些大型語言模型進行內容創作的原因還包括內容的多樣性,像形式、風格和語氣。在 ChatGPT 剛出現的時候,人們擔心所有的內容最終會變得千篇一律。如果讓 ChatGPT 寫一篇關於某個主題的部落格文章,同時兼顧搜尋引擎優化,可能會導致所有文章一成不變;但由於提示工程(prompt engineering)的存在,這項擔憂並未發生。

只要稍微改變一下提示用語,ChatGPT 和解決方案就能就同一主題產生不同的內容。更重要的是,使用者可以要求大型語言模型內容創作者採用某種寫作風格或語氣。當然,這也是迭代的關鍵所在,因為最優秀的用戶會反覆使用大型語言模型來訓練它,讓它聽起來更像自己。大型語言模型的最終目標是讓在最短的時間內產出聽起來像公司創作的優秀內容。

大型語言模型將如何重新定義 2024 年以及企業的未來

隨著 2024 年的到來,大型語言模型從實驗工具到重要商業資產的轉變變得越來越清晰。這些模型在技術能力方面取得了顯著的進步,如今在客戶服務和內容創建等領域發揮至關重要的影響力,能夠提供無與倫比的效率和客製化服務。今年不僅是技術進步的一年,也是將這些工具整合到業務運營結構中,並與不斷變化的監管環境和執行策略持續對焦的一年。

LLM 的廣泛採用證明了其徹底改變企業營運、溝通和創新方式的潛力。在我們見證這一轉變的過程中,我們可以清楚地看到,大型語言模型不僅是企業未來的一部分,它們還在積極塑造未來,在數位化日益加劇的世界中為企業的成長和效率開創新的途徑。

關於 Appier

Appier 是一家以人工智慧(AI)為核心的軟體即服務(SaaS)公司,運用 AI 協助企業進行商業決策。 Appier 成立於 2012 年,以實現 AI 的普及化為願景,透過軟體智慧化將 AI 轉換為投資回報,助力客戶實現業務成長。如今在亞太地區、歐洲及美國擁有 17 個營業據點,並於東京證券交易所掛牌上市(股票代號 4180)。欲了解更多訊息,請造訪 www.appier.com

螢幕擷取畫面 2024-05-08 110432

留言

這個網誌中的熱門文章

為什麼電視直播比賽總是比網路快?看低延遲串流如何搶秒數

  大多時候,你在網路上看的 Live 直播串流,其實不是與現實世界完全同步的即時轉播,先看看以下這些場景,相信對你來說並不陌生。 NBA 冠軍賽才正看到精彩處,隔壁鄰居卻突然爆出一陣歡呼,原來,用電視觀賞同一場比賽的他們,比你早 30 秒歡呼慶祝三分球入網,不小心點開社群媒體,更發現朋友們早已發文熱烈討論比賽結果。 就像電影被暴雷一樣,少了即時參與的驚喜感、提早知道結局,觀看直播活動的樂趣頓時大打折扣。 或是,收看跨年演唱會時,正當你興高采烈倒數最後 30 秒時,才發現,窗外的慶祝煙火已經此起彼落,大家都已經跨入新的一年,只有你還停留在前一年。 雖然從絕對時間來看,這些狀況都僅有延遲短短幾秒鐘,但在體感上,觀賞體驗卻大受影響,用「失之毫釐,差之千里」來形容再恰當不過。 使用直播串流時,為什麼你的世界總是比別人慢幾秒?原因正是「串流延遲」。 從攝影機到觀眾螢幕的層層關卡 串流延遲,指的是攝影機拍到影像後,直到觀眾端螢幕出現畫面的時間差。 一般來說,有線電視直播約延遲 5 到 10 秒,而 YouTube、LINE、Twitch 等多數 OTT 平台,延遲大多介於 15 秒至 30 秒,距離延遲秒數低於 3 秒的「超低延遲」(Ultra Low Latency)標準,還有一大段距離,這也讓現有直播內容的互動效果有限。 但想克服延遲並不容易,光是一段畫面要從現場攝影機,傳到電腦和手機螢幕,中間所需流程多到難以想像。 KKStream 執行副總李卓軒 Kevin C.H. Lee 解釋,這流程大致包含一開始的攝影機收取影音訊號,接著需轉換訊號、傳輸、上傳雲端、加密、備份,傳到終端裝置後再解碼,最後才是播放。 這整段「螢幕到螢幕」的過程,就像是將包裹從A點運送到B點,只要中間有幾個環節耽誤,就會讓整體運送時間不斷疊加。「每個步驟都要優化,只要有個點延遲很高,加總起來就無法達到超低延遲的標準,這需要很強的技術掌控力。」Kevin 說。 另一個挑戰則在於,由於各大終端裝置原廠(如Apple、Google)雖然有提供低延遲串流相對應的規範,但並未說明實際的執行細節,因此串流技術業者只能自己摸索。 受限於技術瓶頸,目前大多數的直播串流服務,只能在延遲、直播規模和影像品質三者間取捨。例如,常見的視訊會議軟體,像是 Zoom、Google Meet,雖然延遲相對低,但參與人數上...

COSCUP x UbuCon Asia 2026 錄取攤位公告/Full List of Accepted Community Booths at COSCUP x UbuCon Asia 2026

Full List of Accepted Community Booths at COSCUP x UbuCon Asia 2026 COSCUP x UbuCon Asia 2026 Booth now release. See which community you can meet on COSCUP x UbuCon Asia 2026. No. Community Introduction 01 UbuCon Asia HackMD 02 Ubuntu Community & Ubuntu-TW HackMD 03 Cloud Native Taiwan User Group x WasmEdge HackMD 04 Automotive Grade Linux HackMD 05 Ruby Taiwan HackMD 06 Wikimedia Movement in AI Era HackMD 07 t2linux HackMD 08 Twinkle AI HackMD 09 Taiwan JVM team HackMD 10 Interledger Foundation HackMD 11 SITCON Student Information Technology Conference HackMD 12 OpenEverest HackMD 13 WordPress Taiwan Community HackMD 14 OSPN (Open Source People Network) Japan HackMD 15 GolangTW HackMD 16 opencocon distribution HackMD 17 Open Culture Foundation HackMD 18 GDG TW (Google Developers Groups Taiwan) HackMD 19 FediDev KR & FediLUG (Japan) HackMD 20 Blockchain and Distributed Ledger HackMD 21 Open-EP (E-Paper) Community HackMD 22 FOSS for All HackMD 23 ...

你的程式碼,你的硬體,你的 AI。掌握你的晶片未來。Your code, your hardware, your AI. Own your silicon future.

在 Tenstorrent,我們從晶片設計的最底層開始打造一切。我們不只採用 RISC-V,更將我們的擴充指令集規格全數公開。指令集架構 (ISA) 與硬體架構也完全開源。整個軟體堆疊,從韌體 (firmware)、運算核心 (compute kernels) 到編譯器,全都放在 GitHub 上,並採用你真正能用的授權條款 (Apache 2.0 / GPL)。我們的下一代晶片 Blackhole,旨在掃除傳統設計的低效率,讓你直接掌控資料流 (dataflow),實現更高的速度與電源效率。 Blackhole p150 (單晶片,次世代架構): 32G 記憶體,512GB/s 頻寬 387 TFLOPS (BFP8) / 774 TFLOPS (FP8) 大規模可程式化 RISC-V 核心陣列 算子函式庫、編譯器,整個軟體堆疊 — 全部開源 (OSS) 以原生 CCL 達成真正的多卡擴充,拒絕使用 PCIe workaround $1399 Wormhole n300 (雙晶片,經市場驗證的成熟架構): 24G 記憶體,576GB/s 頻寬 262 TFLOPS (BFP8) / 466 TFLOPS (FP8) 大規模可程式化 RISC-V 核心陣列 算子函式庫、編譯器,整個軟體堆疊 — 全部開源 (OSS) 以原生 CCL 達成真正的多卡擴充,拒絕使用 PCIe 土炮 $1499 現已上市。 立即在官網購買運算卡,或在我們的雲端平台上體驗。 如果你受夠了嚴苛的 EULA (使用者授權合約) 或處處受限的記憶體;又或者,你一直想親自動手,深入探索驅動你類神經網路的 C++ 程式碼;甚至想挑戰組合語言,親眼見證它...