OPERATION INTELLIGENCE

全局維運總覽

系統運作中 體驗 Demo 使用說明
DEMO · 合成資料展示監控、分析與探測皆為模擬;操作只影響本頁,重新載入即可重設。返回沅創官網 ↗

GLOBAL OPERATIONS

優先處理真正影響服務的問題

彙整監控資產、異常佇列與工具狀態;設定與寫入操作仍留在各負責模組。

平台健康度--等待監控資料
納管目標--主機與服務
待處理異常--尚未分析
例外抑制--仍持續保留監控資料
01

優先問題

正在取得異常佇列。
02

模組狀態

尚未更新
AI ASSISTED

描述異常,快速取得
根因分析與處置建議

選擇診斷類型並輸入觀察到的症狀,系統會整理風險、可能根因、驗證指令與修復步驟。

92平台健康度
01

建立診斷任務

不會執行真實指令
ssh://
02

診斷結果

等待診斷任務

AI 將根據症狀提供可解釋的維運建議。

AUDIT TRAIL

診斷歷史

MONITORING CONTROL

資產監控

即時狀態與待處理異常

先確認服務影響與監控資料;清單與例外設定集中在「監控設定」。

受管主機-等待監控資料
監控服務-等待監控資料
監控核心-等待監控資料
資料更新-VictoriaMetrics 即時查詢

INCIDENT QUEUE

異常待分析

監測到 up=0 的主機或服務會進入待分析清單。可先查看影響,或交由 AI 整理唯讀檢查步驟。

0待分析 0例外抑制
待分析異常
等待異常資料。
等待歷史數據。
目標狀態類型團隊
等待監控目標資料。

新增監控目標

依序選擇範本、填入最少必要資料,再確認預覽。加入的是瀏覽器草稿,尚未寫回正式清單。

尚無待儲存變更
01選擇類型與範本範本會帶入常見 port、probe 與角色。
02選填:環境、站點、團隊與連接埠
03確認後加入草稿

選擇範本後會顯示即將加入的監控目標。

監控設定

這裡包含會改變監控清單或告警抑制的操作。完成確認後才會寫回 CSV 並重建 Prometheus file_sd。

尚無待儲存變更

ALERT EXCEPTIONS

監控例外

例外期間仍保留監控資料,只是不列入待告警處理。

尚無例外規則。

INVENTORY CONTROL

進階清單編輯與匯入

適合批次調整既有欄位、匯出備份或貼上 CSV;一般新增請使用「新增監控」。

主機
服務

ANSIBLE / NETTOOLS

拓撲可視化與工具探測

拓撲節點-inventory 主機與服務
正常節點-VictoriaMetrics up=1
異常節點-可直接執行 Nettools
工具狀態-Ansible / ping / DNS / route

VISUAL MAP

監控拓撲

AIOPS 會把 inventory、VictoriaMetrics 狀態與服務探測關係畫成節點圖,作為 300 台主機與 1000+ 服務的第一層視覺入口。

等待拓撲資料。
正常 異常 未知

TOOLCHAIN

Ansible 與 Nettools

目前工具檢查為唯讀;Nettools 只允許探測已納管 inventory 目標,避免任意網段掃描。

等待工具狀態。
Ansible 匯入流程 ansible-inventory --list > /tmp/ansible-inventory.json npm run inventory:ansible -- /tmp/ansible-inventory.json > monitoring/inventory/hosts.csv npm run inventory:build
貼上 Ansible JSON 匯入支援預覽後合併或取代主機清單
尚未預覽 Ansible inventory。

READONLY PROBE

Nettools 即時檢查

選擇已納管目標後,可執行 DNS、TCP、ping 或路由追蹤。結果可輔助 AI 診斷,不會修改遠端主機。

尚未執行探測。
最近探測紀錄保留最近 200 筆 runtime 紀錄
尚無探測紀錄。