跳到主要內容

將 Vision AI 部署到全美上千家得來速:Berry AI 的大規模落地挑戰

將 Vision AI 部署到全美上千家得來速:Berry AI 的大規模落地挑戰

在美國開車經過得來速,多數人不會注意窗口旁那台計時器。但對店家而言,那串數字幾乎等同營收:服務速度決定一條車道每小時能服務的車輛數,車流一旦回堵,顧客就會流失。
Berry AI(華捷智能)以 Vision AI 量測得來速各環節的耗時、定位流程瓶頸,再將數據轉化為店長可即時使用的判斷依據:哪個環節最慢、人力該如何調配。
這件事乍看只是個計時器。但一個能做出 demo 的模型,和一個讓上千家門市每天賴以決策的系統,中間隔著四道關卡。

挑戰一:未曾見的場景,也必須維持準確率

攝影機的架設高度、角度、車道幾何,每家門市都不同,光線與天氣也持續變化。在單一門市的高準確率,不代表在其餘的數百家門市同樣成立。逐店手動調參不可規模化,因此重點落在資料品質與評估方法。如何對未見過的場景維持穩定泛化,是我們投入最深、也仍在持續解決的問題。

挑戰二:在運算資源有限的邊緣裝置上做即時推理

在雲端能運行,與在算力與功耗受限的邊緣裝置上即時完成推論,是截然不同的工程。模型量化與壓縮、吞吐與延遲的取捨、影像串流的接取與解碼、程序記憶體的配置與壓縮,每一項優化都至關重要。

挑戰三:把上百萬筆事件,變成可靠的每日報表

破千家門市每天產生上百萬筆事件,記錄每一台車的進場、排隊、取餐、離場。要將它們即時轉化為上千份準確的報表,需處理高吞吐的事件接取、亂序與遲到事件的補正,以及可重現、跨店一致的彙整邏輯。

挑戰四:上千套 AI 系統,要每天都準確運作、穩定運行

上千台物聯網電腦與攝影機遍佈全美各地。硬體故障、網路中斷、攝影機失焦或視角偏移都會發生,要在規模下維持準確率與妥善率,可觀測性至關重要:逐店、逐裝置追蹤系統健康狀態,主動偵測並自動處置異常,是需要長期投入的系統工程。

關於我們

Berry AI 於 2019 年自上市公司飛捷科技獨立,兼具新創的敏捷,以及母公司在硬體與資金上的支持。2022 年在美國啟動試營運,2025 年簽訂炸雞連鎖 Zaxby's 的全品牌導入合約(近千家門市),2026 年 5 月再宣布與破千間門市的 Culver's 全品牌合作。目前 Berry AI 是全美 QSR 產業部署最廣的 Vision AI 系統,導入速度仍在加快,2025 年營收首度突破億元、年增近兩倍,團隊也持續擴編。我們團隊成員來自 Microsoft、Appier、HTC 與多家 AI 新創;公司為 Nvidia Inception 成員。

 

加入我們

We are hiring!
Senior Full-Stack Engineer
Senior Platform & System Engineer
Senior Machine Learning Engineer

留言

這個網誌中的熱門文章

為什麼電視直播比賽總是比網路快?看低延遲串流如何搶秒數

  大多時候,你在網路上看的 Live 直播串流,其實不是與現實世界完全同步的即時轉播,先看看以下這些場景,相信對你來說並不陌生。 NBA 冠軍賽才正看到精彩處,隔壁鄰居卻突然爆出一陣歡呼,原來,用電視觀賞同一場比賽的他們,比你早 30 秒歡呼慶祝三分球入網,不小心點開社群媒體,更發現朋友們早已發文熱烈討論比賽結果。 就像電影被暴雷一樣,少了即時參與的驚喜感、提早知道結局,觀看直播活動的樂趣頓時大打折扣。 或是,收看跨年演唱會時,正當你興高采烈倒數最後 30 秒時,才發現,窗外的慶祝煙火已經此起彼落,大家都已經跨入新的一年,只有你還停留在前一年。 雖然從絕對時間來看,這些狀況都僅有延遲短短幾秒鐘,但在體感上,觀賞體驗卻大受影響,用「失之毫釐,差之千里」來形容再恰當不過。 使用直播串流時,為什麼你的世界總是比別人慢幾秒?原因正是「串流延遲」。 從攝影機到觀眾螢幕的層層關卡 串流延遲,指的是攝影機拍到影像後,直到觀眾端螢幕出現畫面的時間差。 一般來說,有線電視直播約延遲 5 到 10 秒,而 YouTube、LINE、Twitch 等多數 OTT 平台,延遲大多介於 15 秒至 30 秒,距離延遲秒數低於 3 秒的「超低延遲」(Ultra Low Latency)標準,還有一大段距離,這也讓現有直播內容的互動效果有限。 但想克服延遲並不容易,光是一段畫面要從現場攝影機,傳到電腦和手機螢幕,中間所需流程多到難以想像。 KKStream 執行副總李卓軒 Kevin C.H. Lee 解釋,這流程大致包含一開始的攝影機收取影音訊號,接著需轉換訊號、傳輸、上傳雲端、加密、備份,傳到終端裝置後再解碼,最後才是播放。 這整段「螢幕到螢幕」的過程,就像是將包裹從A點運送到B點,只要中間有幾個環節耽誤,就會讓整體運送時間不斷疊加。「每個步驟都要優化,只要有個點延遲很高,加總起來就無法達到超低延遲的標準,這需要很強的技術掌控力。」Kevin 說。 另一個挑戰則在於,由於各大終端裝置原廠(如Apple、Google)雖然有提供低延遲串流相對應的規範,但並未說明實際的執行細節,因此串流技術業者只能自己摸索。 受限於技術瓶頸,目前大多數的直播串流服務,只能在延遲、直播規模和影像品質三者間取捨。例如,常見的視訊會議軟體,像是 Zoom、Google Meet,雖然延遲相對低,但參與人數上...

COSCUP x UbuCon Asia 2026 錄取攤位公告/Full List of Accepted Community Booths at COSCUP x UbuCon Asia 2026

Full List of Accepted Community Booths at COSCUP x UbuCon Asia 2026 COSCUP x UbuCon Asia 2026 Booth now release. See which community you can meet on COSCUP x UbuCon Asia 2026. No. Community Introduction 01 UbuCon Asia HackMD 02 Ubuntu Community & Ubuntu-TW HackMD 03 Cloud Native Taiwan User Group x WasmEdge HackMD 04 Automotive Grade Linux HackMD 05 Ruby Taiwan HackMD 06 Wikimedia Movement in AI Era HackMD 07 t2linux HackMD 08 Twinkle AI HackMD 09 Taiwan JVM Team HackMD 10 Interledger Foundation HackMD 11 SITCON Student Information Technology Conference HackMD 12 OpenEverest HackMD 13 WordPress Taiwan Community HackMD 14 OSPN (Open Source People Network) Japan HackMD 15 GolangTW HackMD 16 opencocon distribution HackMD 17 Open Culture Foundation HackMD 18 GDG TW (Google Developers Groups Taiwan) HackMD 19 FediDev KR & FediLUG (Japan) HackMD 20 Blockchain and Distributed Ledger HackMD 21 Open-EP (E-Paper) Community HackMD 22 FOSS for All HackMD 23 ...

你的程式碼,你的硬體,你的 AI。掌握你的晶片未來。Your code, your hardware, your AI. Own your silicon future.

在 Tenstorrent,我們從晶片設計的最底層開始打造一切。我們不只採用 RISC-V,更將我們的擴充指令集規格全數公開。指令集架構 (ISA) 與硬體架構也完全開源。整個軟體堆疊,從韌體 (firmware)、運算核心 (compute kernels) 到編譯器,全都放在 GitHub 上,並採用你真正能用的授權條款 (Apache 2.0 / GPL)。我們的下一代晶片 Blackhole,旨在掃除傳統設計的低效率,讓你直接掌控資料流 (dataflow),實現更高的速度與電源效率。 Blackhole p150 (單晶片,次世代架構): 32G 記憶體,512GB/s 頻寬 387 TFLOPS (BFP8) / 774 TFLOPS (FP8) 大規模可程式化 RISC-V 核心陣列 算子函式庫、編譯器,整個軟體堆疊 — 全部開源 (OSS) 以原生 CCL 達成真正的多卡擴充,拒絕使用 PCIe workaround $1399 Wormhole n300 (雙晶片,經市場驗證的成熟架構): 24G 記憶體,576GB/s 頻寬 262 TFLOPS (BFP8) / 466 TFLOPS (FP8) 大規模可程式化 RISC-V 核心陣列 算子函式庫、編譯器,整個軟體堆疊 — 全部開源 (OSS) 以原生 CCL 達成真正的多卡擴充,拒絕使用 PCIe 土炮 $1499 現已上市。 立即在官網購買運算卡,或在我們的雲端平台上體驗。 如果你受夠了嚴苛的 EULA (使用者授權合約) 或處處受限的記憶體;又或者,你一直想親自動手,深入探索驅動你類神經網路的 C++ 程式碼;甚至想挑戰組合語言,親眼見證它...