天時間提高了的運維自動化一個層持後2次AI加將公司

核心指標有了,加持自動化運維、后天化提下一步就是时间司從痛點解決問題。各種係統或者有專門團隊來做的自动 ,因為公司本身沒有幾個人  ,层次自己做開發、加持要怎樣去思考  。后天化提

AI時代下的时间司變化

在傳統的軟件開發時代  ,這些都不是自动核心問題。

可以一鍵發布,层次建設成本和使用人員的加持學習成本等。可恢複 、后天化提

而我做的时间司這個從開發到上線用了兩小時 。反而更靈活更可以擁抱超變化。自动之前測試環境發布 、层次但是那些看起來花哨的功能都是有成本的 。在這種不涉及核心業務的場景下可以先盡量簡單的滿足需求,恢複和應急。設計了長遠規劃,

階段二和階段四內容較多,那SLA服務等級肯定不能低於3個9。還有一鍵停服 ,可觀測方麵前端有實際發布內容的展示 。

近期工作安排包括自動化測試 、發布按鈕會展示發布狀態。確實是弱爆了 。根據核心指標來拆解問題 。其他人使用的時候學習成本就是跟我確認一下 ,咱們就一步一步做。

這其中工作簡單的就是自動化運維。後端有發布節點目前狀態的實時展示 ,用管理員賬號登錄後我們的操作界麵長這樣 。

在電腦的管理端,同時也滿足 一些應用不發布的個性化需求 。而AI時代 ,需要隨時隨地手機上也可以方便的操作 、安全的東西都不便於公開講,找不到再自己按照公司的階段和情況把核心指標定下來。

比如說公司跟客戶承諾7*24小時不間斷服務。要技術選型 ,觀測  、包括 資源成本  ,還有心跳檢查等狀態檢查 。咱們今天隻討論階段一的過程 。之前的運維流程也不完善,發布過程中 ,檢查服務卡死會自動dump後重啟。

這個功能相比較其他公司用了各種框架  ,單發圖

階段二

階段四

大規劃有了,三個9怎麽做 ,自己做設計、那到底要做到哪些,可應急。恢複和應急方麵支持回滾 。我先出了一個總體規劃 。但是這些都有額外的安全措施。做到什麽程度呢。平均每人2分鍾 。也沒有設備和人力去界麵化操作 。四個9怎麽做,我定的核心指標是 :可觀測 、這是自動恢複 。或者用了什麽技術 ,

指標定了 ,否則就不安全了 。生產環境發布都需要上服務器上手工搞。那代碼設計一開始就要考慮可擴展,可能要選框架來滿足長遠需求 。

總體規劃

我的建議是優先找公司的標準 ,但我今天真正要講的不是做了什麽,係統重構變得簡單 ,核心是麵對一句話需求 ,網上一大堆。自己驗收上線還是挺爽滴。

我拿到的需求就是 做全公司的自動化運維。自動化運營和安全等一些工作 。

運維提效

每個階段也要先訂核心指標 。一鍵重啟等應急操作 。

針對我們公司的現狀 ,自己做產品 、

娛樂
上一篇:基於NetCorePal Cloud Framework的DDD架構管理係統實踐
下一篇:別再吹牛了 ,100% Vibe Coding 存在無法自洽的邏輯漏洞!