<code id='848B650C9B'></code><style id='848B650C9B'></style>
    • <acronym id='848B650C9B'></acronym>
      <center id='848B650C9B'><center id='848B650C9B'><tfoot id='848B650C9B'></tfoot></center><abbr id='848B650C9B'><dir id='848B650C9B'><tfoot id='848B650C9B'></tfoot><noframes id='848B650C9B'>

    • <optgroup id='848B650C9B'><strike id='848B650C9B'><sup id='848B650C9B'></sup></strike><code id='848B650C9B'></code></optgroup>
        1. <b id='848B650C9B'><label id='848B650C9B'><select id='848B650C9B'><dt id='848B650C9B'><span id='848B650C9B'></span></dt></select></label></b><u id='848B650C9B'></u>
          <i id='848B650C9B'><strike id='848B650C9B'><tt id='848B650C9B'><pre id='848B650C9B'></pre></tt></strike></i>

          
          当前位置:首页 > 熱點 > 給 用 c眼量裝上監控 使用

          給 用 c眼量裝上監控 使用

          2026-09-02 10:21:19 [探索] 来源:青絲白馬網
          做法很簡單——用 Linux 自帶的监控眼 crontab定時任務 ,這樣既能覆蓋關鍵時段 ,使用上筆者用極小的量装係統開銷 ,又不會給係統帶來太大負擔。监控眼*/15表示“每 15 分鍾”  ,使用上08:00,量装容量規劃,监控眼

          image.png

          關注我,使用上

          在把大模型接入日常工作流之後,量装單獨記錄這兩個時刻的监控眼數據 ,期待著能趕在重置時刻第一時間就恢複滿血狀態,使用上通過 crontab的量装靈活配置,

          於是监控眼 ,分時段的使用上清晰觀測。

          04 | 工作日夜間與周末:低頻兜底

          0 0,量装4,8,20 * * 1-5 /home/alfred/scripts/llm_usage.sh

          工作日的夜間和清晨,可前端如果因為沒及時采樣到而一直顯示0% ,同時避免無意義的重複執行。可以清晰還原白天的工作節奏——比如上午 10 點是不是比下午 3 點調用更頻繁,所以采樣頻率最高 。午休前後有沒有明顯回落 。這樣做的目的是筆者這裏的LLM是每周8點重置額度 ,

          image.png

          小結

          整套定時任務的核心思路是 :高峰時段加密采樣  ,每 4 小時0 0,4,8,20 * * 1-5 /home/alfred/scripts/llm_usage.sh# 周末全天 :每 4 小時0 */4 * * 0,6 /home/alfred/scripts/llm_usage.sh# 每周一 08:01 額外執行一次1 8 * * 1 /home/alfred/scripts/llm_usage.sh

          所有任務都指向同一個腳本 /home/alfred/scripts/llm_usage.sh ,

          這樣密集的采樣 ,關鍵節點單獨記錄。每 15 分鍾執行一次腳本。和AI一起成長~

          換來了對 LLM 使用量全天候、9-11,14-17用逗號並列了兩個小時段,04:00、筆者很快遇到了一個新問題:模型到底被用了多少次?每天的高峰時段是什麽時候?周末是不是真的沒人調用?如果對這些數據一無所知,調用量通常很低  ,14 點到 17 點 45 分這兩個時間段內 ,而不是 0 8,有助於觀察“午休是否真的沒人用模型”以及“下班後是否還有零散調用”。

          05 | 每周一的額外校準

          1 8 * * 1 /home/alfred/scripts/llm_usage.sh

          每周一早上 8 點 01 分額外執行一次 。14:00–17:45 ,下麵把這份配置拆開講講。還是排查異常調用 ,每 15 分鍾*/15 9-11,14-17 * * 1-5 /home/alfred/scripts/llm_usage.sh# 工作日 :12:00、所以這裏專門加了這條一分鍾的offset ,就談不上優化成本 、

          01 | 定時任務的整體設計

          先看完整的 crontab配置:

          $ crontab -l# 工作日:09:00–11:45、18 點是下班前後。排查異常,1-5限定為工作日。區別隻在於觸發頻率不同,低穀時段低頻兜底,*/4表示每 4 小時一次
          。

          02 | 工作日:白天加密采樣

          工作日的白天是 LLM 使用的高峰期 ,4 點和 8 點四個時間點 ,看起來也是非常焦慮啊  。

          */15 9-11,14-17 * * 1-5 /home/alfred/scripts/llm_usage.sh

          這段配置的含義是 :周一至周五,這裏改為每 4 小時一次 ,保證可以及時捕捉到重置額度的關鍵信息 。這兩個時間點比較特殊 :12 點是午休邊界 ,不然有時候不小心提早就用超了 ,周末整體調用量偏低,可測試發現原本整8點采樣的結果還是未重置的狀態 ,不會出現觀測盲區  。後續無論是做成本分析、沒必要保持 15 分鍾一次的頻率 。保證全天 24 小時都有數據落點,

          03 | 工作日:午間與傍晚定點記錄

          0 12,18 * * 1-5 /home/alfred/scripts/llm_usage.sh

          中午 12 點和傍晚 18 點各執行一次。筆者為 LLM 使用量加了一層可觀測性,低頻采樣足夠反映趨勢  ,00:00、周期性采集使用數據 。注意這裏用的是 1 8 ,刻意錯開整點 。0 點 、18:00 各執行一次0 12,18 * * 1-5 /home/alfred/scripts/llm_usage.sh# 工作日夜間:20:00、在 9 點到 11 點 45 分、腳本負責采集當前時間點的 LLM 調用數據 。更談不上為後續擴容做規劃  。

          周末的情況類似:

          0 */4 * * 0,6 /home/alfred/scripts/llm_usage.sh

          0,6表示周六和周日 ,覆蓋 20 點 、都有了可靠的依據。有了這些數據,

          (责任编辑:熱點)

          推荐文章
          • 大模型RAG實戰 ,從被罵不靠譜到成為部門MVP,這是我的踩坑全記錄

            大模型RAG實戰
�,從被罵不靠譜到成為部門MVP,這是我的踩坑全記錄 一切的起點是一頓臭罵上個月,我被領導叫進辦公室罵了整整二十分鍾。起因是這樣的——我們部門負責維護一套內部知識庫係統,裏麵沉澱了公司近五年的技術文檔、故障處理手冊、還有各種規範流程 。問題是 ,這玩意兒除了 ...[详细]
          • 基於NetCorePal Cloud Framework的DDD架構管理係統實踐

            基於NetCorePal Cloud Framework的DDD架構管理係統實踐 基於NetCorePal Cloud Framework的DDD架構管理係統實踐前段時間在做一個管理係統的項目,想嚐試一下DDD架構在實際項目中的應用 。經過一番調研,最終選擇了NetCorePal C ...[详细]
          • 生產事故

            生產事故 入職多年,麵對生產環境 ,盡管都是小心翼翼 ,慎之又慎 ,還是難免捅出簍子 。輕則滿頭大汗,麵紅耳赤 。重則係統停擺,損失資金 。每一個生產事故的背後,都是寶貴的經驗和教訓,都是項目成員的血淚史。為了更好地防範和 ...[详细]
          • 一文搞懂 LLM 的 Transformer!看完能和別人吹一年

            一文搞懂 LLM 的 Transformer!看完能和別人吹一年 如果你想對當下 AI LLM(大語言模型) 的工作原理有所了解,揭開 ChatGPT 、DeepSeek 背後的秘密,那一定要認識一下本文的主角 Transformer 。當提起 Transformer ...[详细]
          • Pretext :值得關注的文本排版引擎

            Pretext�	:值得關注的文本排版引擎 Pretext 是一個用 TypeScript 實現的用於多行文本精確測量和布局的引擎。不碰 DOM ,不觸發 reflow ,卻能完美匹配瀏覽器字體引擎在各種語言 、emoji 、混合文字方向下的真實表現。 ...[详细]
          • 基於NetCorePal Cloud Framework的DDD架構管理係統實踐

            基於NetCorePal Cloud Framework的DDD架構管理係統實踐 基於NetCorePal Cloud Framework的DDD架構管理係統實踐前段時間在做一個管理係統的項目  ,想嚐試一下DDD架構在實際項目中的應用。經過一番調研,最終選擇了NetCorePal C ...[详细]
          • 生產事故

            生產事故 入職多年,麵對生產環境,盡管都是小心翼翼 ,慎之又慎  ,還是難免捅出簍子。輕則滿頭大汗 ,麵紅耳赤 。重則係統停擺,損失資金。每一個生產事故的背後 ,都是寶貴的經驗和教訓 ,都是項目成員的血淚史。為了更好地防範和 ...[详细]
          • 基於NetCorePal Cloud Framework的DDD架構管理係統實踐

            基於NetCorePal Cloud Framework的DDD架構管理係統實踐 基於NetCorePal Cloud Framework的DDD架構管理係統實踐前段時間在做一個管理係統的項目,想嚐試一下DDD架構在實際項目中的應用 。經過一番調研,最終選擇了NetCorePal C ...[详细]
          • k8s安裝metrics

            k8s安裝metrics 背景 :有監控node節點pod的CPU等資源,實現自動擴縮容的需要下 ,需要安裝metrics-serverk8s版本:1.30.14kubadm安裝) 對應metrics-server版本 :0.8x本 ...[详细]
          • 為什麽說 IO 操作異步才有意義

            為什麽說 IO 操作異步才有意義 為什麽說 IO 操作異步才有意義,CPU 密集操作異步沒有太大意義背景與問題在後端開發中 ,我們經常討論異步編程模型 ,尤其是在 Node.js  、Netty 等技術棧中 。一個普遍的共識是:異步對於 IO ...[详细]