來源于:開云手機在線官網入口
發布時間:2026-07-29 23:56:00
文章摘要:
開云手機在線官網入口:超越OpenAI、Anthropic!深信服AI突圍CyberGym評測 位列全球前四、國內第一-開云手機在線官網入口 超越OpenAI、Anthropic!深信服AI突圍CyberGym評測 位列全球前四、國內第一-開云手機在線官網入口
近日,信服在面向全球頂尖 AI 安全能力的突圍國際權威基準測試 CyberGym 中,Sangfor AI 取得了優異表現。評測開云線上登錄平臺入口在依托純國產基座模型(GLM-5.2)的位列固定模型配置下,系統面對涵蓋 ARVO 與 OSS-Fuzz 的全球前國全量高難度漏洞挑戰,在 1,內第507 項任務中成功解決 1,301項,整體成功率達到 86.3%。信服本次評測中,突圍Sangfor AI 與 OpenAI、評測Anthropic、位列Meta 等全球頭部科技廠商的全球前國模型與智能體同場競技,最終整體評測成績躋身全球前四,內第位列國內參評團隊第一。信服開云線上登錄平臺入口 CyberGym作為全球權威 AI 安全評測體系,突圍摒棄了傳統的評測靜態或小規模理論測試,聚焦于真實世界的復雜挑戰——涵蓋大量主流開源軟件與高難度歷史漏洞(如 ARVO、OSS-Fuzz 等)。它嚴格考驗大模型與安全 Agent 在海量源碼、復雜上下文及多階段對抗環境下的自主推理、漏洞復現與 PoC 驗證能力,因其貼近真實工業界防護場景、驗證標準嚴苛,被視為全球范圍內評估代碼安全大模型實戰能力最具含金量的權威靶場之一。而Sangfor AI 不僅交出了一份完整、公開且經得起嚴苛驗證的實戰答卷,更充分展現了“國產大模型 + 自研安全智能體架構”在復雜代碼安全對抗與漏洞自動化驗證中的高水準落地效果,進一步證明了國產大模型在應對高強度工業級安全挑戰時的堅實競爭力與廣闊應用前景。 深信服Sangfor AI 的Agent系統: 將模型能力轉化為可驗證的安全能力 漏洞挖掘不是一次性的代碼分析或 PoC 生成,而是在信息不完備的條件下,持續提出假設、獲取證據、排除錯誤路徑并形成最終結論的研究過程。單一模型可以完成局部推理,但要穩定處理長鏈路探索、并行假設和嚴格驗證,還需要一套能夠組織、保留并約束這些能力的系統機制。為了破解這一難題,Sangfor AI 并未采用簡單的概率堆砌,而是開創性的構建了“智能體群體(Agent Swarm)協同作戰”架構,并引入了嚴密的“證據管治”機制,確保每一步漏洞調查步驟都清晰可信: 有界探索:圍繞不同的安全假設分別開啟獨立、邊界清晰的調查分支,讓多個可能的解釋可以并行推進,而不會互相污染、也不會讓某個未經證實的假設悄悄變成集體共識; 證據持久化:各調查分支之間通過“證據”而非完整對話歷史來協同——已被驗證的觀察和已被證偽的路徑都會被保留下來,避免同一條錯誤路徑被反復重新試錯; 動態假設裁決:一個協調層持續基于不斷演化的證據狀態,判斷哪些假設仍然成立、哪些問題尚待解決、哪里還值得繼續投入,讓每一輪探索都成為對搜索空間的有效收窄; 對抗式候選評審:當證據支持某個具體的觸發方案時,系統才會構造候選輸入并提交“對抗式評審”——評審會同時挑戰“這次崩潰是否可復現”以及“這次崩潰是否真的對應目標漏洞”,未通過評審的候選會被打回、用于修正下一步探索方向,只有真正經受住檢驗的候選,才會成為系統最終提交的安全結論。 正如項目團隊在技術設計中所強調的:“以假設拓展探索,以證據裁定結論。” 這套機制讓系統敢于「廣撒網」式地探索多種假設,又能在真正下結論前把關得足夠嚴格,最終,在來源于 ARVO 的任務上取得 87.2% 的成功率,在來源于 OSS-Fuzz 的任務上取得 77.7% 的成功率,綜合成功率達到86.3%。 不止于登榜:創新成果如何真正走進企業研發流程 隨著AI技術的快速發展,攻擊者正利用 AI 大幅降低漏洞分析與攻擊利用門檻,壓縮從漏洞發現到規模化利用的時間窗口。對企業而言,必須搶在攻擊者之前發現、驗證并修復漏洞。而過去開發安全所依賴規則匹配的傳統 SAST,必須加速向具備自主推理、代碼理解、業務邏輯分析和漏洞驗證能力的安全Agent轉型。新的安全Agent既要精準識別 SQL 注入、命令執行等常規漏洞,更要深入理解復雜業務流程,發現越權訪問、認證繞過等傳統工具難以覆蓋的高風險問題。與此同時,能否依托國產開源大模型實現AI開發安全系統的關鍵能力突破,成為掌握代碼安全的主動權的關鍵。 而“登榜CyberGym”所代表的絕不僅是一張亮眼的評測成績單,更是 AI 安全 Agent 在真實企業級代碼安全場景中的戰斗力映射。Sangfor AI的前沿技術正加速沉淀并賦能深信服全線產品,深度融入企業研發全流程,為企業級用戶帶來切實的價值質變: 提升漏洞檢出能力:有效攻克傳統 SAST 盲區,全面識別業務邏輯漏洞、越權與認證繞過,大幅拓寬代碼安全覆蓋率。 降低人工審計成本:憑借 AI 自動化完成代碼理解、跨文件關聯分析、攻擊路徑推理與風險驗證,大幅解放安全專家的繁重人工勞動力。 減少誤報、提升效率:依靠多階段推理與嚴苛的證據驗證機制壓降誤報率,使研發人員能夠聚焦真正亟需修復的風險,告別無效整改。 縮短研發交付周期:將安全檢測前移至研發編寫與 CI/CD 流水線中,實現“代碼提交即自動審計”,大幅降低后期返工成本,加速業務高效上線。 提升企業整體安全能力:幫助企業在更早階段筑牢防線,遏制因數據泄露、業務中斷帶來的合規與經濟風險,為數字化業務保駕護航。 對于廣大企業用戶而言,AI 安全 Agent 的核心價值遠不止于“發現更多漏洞”,更在于以極高準確率、極低人工成本與極快響應速度,實現研發效率與代碼安全的同步跨越。 此次,深信服在CyberGym評測中的卓越成績,是代碼安全智能化道路上的一個重要里程碑。未來,深信服將繼續深耕大模型安全技術創新,將前沿技術轉化為企業實際業務場景中的生產力,持續踐行“讓每個用戶的數智化更簡單,更安全”的承諾。
返回首頁