數據安全與人工智能運營公司Rubrik近日在Rubrik FORWARD大會上宣佈推出Rubrik Annapurna的下一階段產品,為企業數據智能平台建立面向非結構化數據的AI就緒數據層。
非結構化數據佔現代企業數據總量的百分之九十。由於企業缺乏對這些文件資產的可見性,關鍵業務數據長期處於孤島狀態,無法被數據科學和AI應用所觸及。傳統的做法是通過昂貴的提取、轉換、加載流程將數據複製到數據湖中,企業需要為整個數據環境付費,卻只用到其中不足百分之十的數據。
Rubrik首席產品官Anneka Gupta表示:「多年來,讓非結構化數據可用於AI的模式意味着要移動、轉換並二次存儲數據,同時為整個數據資產付費,卻只用到其中一小部分。Annapurna徹底顛覆了這一模式。它直接在數據所在位置激活數據,僅交付數據智能平台實際需要的內容,並使基礎設施成本與消耗量對齊。」
Annapurna運行於Rubrik Security Cloud統一管理平台之上,可自動發現、掃描和索引分佈於NAS、S3及對象存儲中的數十億個文件。系統將可查詢的文件元數據目錄直接發布至數據湖倉,企業只需提取模型訓練、微調和推理所需的精確數據子集,管道成本隨實際消耗量彈性擴展。
Annapurna的核心功能包括:跨存儲系統的自動化數據發現、原生數據湖倉集成、按需驅動的管道經濟模式、持續治理保護源系統訪問控制,以及基於零信任基礎架構的不可變鏈custody功能。
派珀·桑德勒公司首席技術官Corey West表示:「Annapurna為我們的AI計劃提供了一種自動化的方式來映射、治理和索引數據資產,無需額外的ETL堆棧即可減少跨職能配置和數據主權要求的摩擦。」
Rubrik Annapurna目前已向符合資格的企業合作伙伴開放。公司表示原生數據湖倉連接器支持將在未來版本中推出,該產品可與現有存儲及數據湖倉環境協同部署,無需新增基礎設施或代理程序。
責任編輯:張俊 SF065