Skip to Content
Find dismissed updates here
Edit My Preferences

에버퓨어, 기업 데이터 준비도 격차 분석 보고서 발표… 기업 데이터 3분의 1 이상 ‘다크 데이터’

광범위하게 존재하는 ‘다크 데이터’, 기업 AI 준비도에 중대한 위험 초래
에버퓨어, 기업 데이터 준비도 격차 분석 보고서 발표

서울 – 2026년 9월 17일 – 스토리지 및 데이터 관리 혁신을 선도하는 에버퓨어(구 퓨어스토리지)는 시장조사기관 옴디아(Omdia)와 함께 ‘기업 데이터 준비도 격차 분석(Exploring the enterprise data readiness gap)’ 보고서(영문)를 발표했다. 이번 보고서는 기업의 데이터 준비도 격차가 확대되고 있는 현황과 함께, 수집·저장되지만 거의 재사용되지 않는 ‘다크 데이터(dark data)’가 초래하는 위험을 조명한다. 다크 데이터에는 중복되거나 오래됐거나 불필요한(Redundant, Obsolete and Trivial, ROT) 데이터가 다수 포함돼 있다.

AI의 성능은 기반이 되는 데이터에 좌우되는 만큼, 기업이 보유한 정보의 품질은 그 어느 때보다 중요해지고 있다. 그러나 기업이 더 많은 AI 모델과 분석을 대규모로 구축하면서 다크 데이터가 걸림돌로 부상하고 있다. 가치가 낮은 ROT 데이터와 가치가 높은 정보가 뒤섞이면 비용과 위험이 증가하고 비즈니스 성과가 저하될 수 있다.

위협받는 기업 데이터 준비도

기업들이 데이터를 AI에 활용할 수 있도록 가시성과 거버넌스, 신뢰성을 확보하는 데 주력하면서 데이터 관리는 빠르게 핵심 비즈니스 우선순위로 자리 잡고 있다. 그러나 다크 데이터는 여전히 이를 가로막고 있다. 조사에 따르면 조직의 99%가 다크 데이터를 보유하고 있으며, 절반 이상(51~75%)의 조직에서 다크 데이터가 전체 기업 데이터의 3분의 1 이상(37%)을 차지하는 것으로 나타났다. 가치가 높은 데이터를 구분하고 활용하지 못하면 상당한 비용 낭비, 잠재적인 규제 준수 또는 보안 취약점, 인사이트 및 혁신 창출 기회 상실 등 심각한 문제로 이어질 수 있다.

AI 시스템이 효과적으로 운영되기 위해서는 최신 데이터가 필요한 만큼, 기업의 데이터 준비도 부족은 AI의 실제 운영 환경 적용에 심각한 위험을 초래하고 있다. 이는 가정에 그치지 않고 이미 실제 운영 환경에서 나타나고 있다.

  • 조직의 97%가 AI 파일럿에서 실제 운영 환경으로 전환하는 데 어려움을 겪고 있으며, 62%는 중간에서 심각한 수준의 장애 요인에 직면하고 있다.
  • IT 리더의 68%는 AI를 실제 운영 환경으로 전환할 때 데이터 관리를 가장 큰 과제로 꼽았다.
  • 63%는 스토리지 사일로와 데이터의 무분별한 분산·증가를 AI 성공을 가로막는 주요 장벽으로 지목했다.

AI 도입이 가속화됨에 따라 조직은 데이터와 기반 인프라 모두에 대해 더욱 높은 수준의 가시성과 통제력을 확보해야 한다. 성공을 위해서는 데이터가 어디에 위치하는지, 어떻게 사용되고 있는지, 그리고 해당 데이터가 가장 정확하고 최신 상태의 사본인지 파악하는 것이 중요하다.

가치와 위험에 따른 데이터 매핑

다크 데이터의 위험을 인식하는 것과 이를 실제로 관리할 수 있는 가시성과 통제력을 확보하는 것은 별개의 문제다. IT 리더의 76%는 다크 데이터를 중대한 비즈니스 위험으로 인식하고 있으며, 75%는 실행 가능한 인사이트를 도출하는 것이 AI 성공에 중요하다고 답했다. 그러나 여전히 조직의 58%는 데이터 환경에 대한 기본적인 가시성조차 확보하지 못하고 있다.

조직은 다크 데이터를 단순한 부담 요소로만 바라보기보다, 데이터의 비즈니스 가치와 위험이라는 두 가지 기준으로 데이터를 적극적으로 매핑하고 어떤 데이터를 활성화하고, 거버넌스를 적용하고, 보존하거나 삭제할지 결정해야 한다. 이는 일회성 작업이 아니라 정기적인 조정이 필요한 지속적인 과정이다.

에버퓨어는 조직이 데이터 현황을 평가하고 개선할 수 있도록 다음과 같은 프레임워크를 제안한다.

  • 고가치·고위험(High Value, High Risk): 민감한 데이터는 엄격한 거버넌스와 철저한 접근 통제, 강력한 보안 체계 아래에서만 활성화한다.
  • 고가치·저위험(High Value, Low Risk): AI 이니셔티브에 신속하게 활용할 수 있도록 즉각적인 데이터 탐색과 활성화를 우선시한다.
  • 저가치·고위험(Low Value, High Risk): 보안을 강화하고 데이터를 최소화하거나 영구 삭제해 책임 및 규제 준수 위험을 줄인다.
  • 저가치·저위험(Low Value, Low Risk): 아카이빙하거나 삭제해 스토리지 비용을 절감하고 데이터의 무분별한 분산·증가를 억제한다.

현대의 조직은 SaaS, 하이브리드 클라우드, 온프레미스는 물론 기존 워크로드와 AI 워크로드에 걸쳐 갈수록 복잡해지는 환경을 관리해야 한다. 데이터를 가치와 위험에 따라 분류하면 조직이 진정한 데이터 중심 아키텍처로 전환하는 과정에서 명확한 로드맵을 확보할 수 있다.

AI에 데이터를 전달하기 전에 불필요한 노이즈를 최소화하기 위해 ROT 데이터를 식별하고 제거해야 한다. 마찬가지로 다크 데이터 역시 식별·분류하고 위험을 평가함으로써 앞서 제시한 프레임워크를 데이터 활성화에 적용하고, 데이터의 가치를 신속하고 대규모로 최적화해야 한다. 분산된 데이터 환경을 AI에 즉시 활용할 수 있고, 스스로 설명 가능하며, 거버넌스가 적용된 데이터셋으로 전환함으로써 조직은 데이터에 대한 통제력을 되찾고 데이터의 잠재 가치를 온전히 실현할 수 있다.

주요 경영진 인사이트

에버퓨어코리아 전인호 지사장은 “국내 기업들이 빠른 속도로 AI 도입을 확대하고 있지만, 데이터에 대한 가시성이 확보되지 않은 상태에서 속도만 높이는 것은 위험할 수 있다. 기업들은 복잡한 규제 환경과 증가하는 보안 위협 및 비용 부담에 동시에 대응해야 한다”라며 “결국 혁신을 가속화할 수 있는 기업은 어떤 데이터셋에 대해서도 ‘어디에 있는가’, ‘누가 사용하고 있는가’, ‘신뢰할 수 있는가’라는 세 가지 질문에 명확히 답할 수 있는 조직이다. 데이터 우선주의(Data Primacy) 접근법은 이러한 질문을 비즈니스 전략의 중심에 두고 기업이 앞으로 나아갈 수 있는 길을 제시한다”고 말했다.

옴디아 수석 애널리스트 사이먼 로빈슨(Simon Robinson)은 “대부분의 조직에서 기업 데이터 준비도 격차는 이를 파악하고 해소하는 데 필요한 가시성이 부족하기 때문에 여전히 제대로 관리되지 않는 위험으로 남아 있다”며 “그러나 이러한 사각지대를 해소할 수 있는 조직에는 혁신적인 기회가 열려 있다. 이전까지 파악되지 않았거나 파편화돼 있던 방대한 데이터를 신뢰할 수 있고 맥락을 갖춘 인텔리전스로 전환해 AI 구축을 가속화하고, 더 나은 의사결정을 지원하며, 더 큰 비즈니스 가치를 창출할 수 있다”고 말했다.

에버퓨어 데이터 관리 부문 총괄 아시시 굽타(Ashish Gupta)는 “기업은 신뢰할 수 없는 데이터를 기반으로 신뢰할 수 있는 AI를 구축할 수 없다. 중복되거나 오래됐거나 불필요한 ROT 데이터는 AI에 맥락을 제공해야 하는 데이터 계층에 노이즈를 발생시켜 부정확한 AI 추론의 위험을 높인다”며 “더 나은 AI를 위한 해법은 단순히 더 많은 데이터를 추가하는 것이 아니라 관련성이 높고 풍부한 맥락을 갖춘 데이터를 사용하는 데 있다. 이를 위해서는 데이터 환경 전반을 종합적으로 이해하고 이를 바탕으로 비즈니스 가치를 실현해야 한다”고 말했다.

자세히 알아보기

에버퓨어 소개

에버퓨어(Everpure, NYSE: P)는 업계를 선도하며 지속적으로 진화하는 스토리지 및 데이터 관리 플랫폼을 통해 조직이 데이터를 직접 통제할 수 있도록 지원한다. 에버퓨어는 기업의 데이터가 AI 시대에 즉시 활용될 수 있도록 접근성과 지능화, 성능을 보장함으로써 데이터의 잠재력을 극대화할 수 있도록 지원한다. 또한 데이터 관리를 간소화하는 동시에 성능을 확장하고 에너지 소비를 크게 절감한다. 에버퓨어는 10년 이상 업계 최고 수준의 순추천고객지수(Net Promoter Score, NPS)를 기록하며 전 세계 혁신 기업들의 선택을 받고 있다. 자세한 내용은 에버퓨어 웹사이트(www.everpuredata.com/kr)에서  확인할 수 있다.

미디어 문의
Lee Nugent
Head of Communications, APJ
지원하지 않는 브라우저입니다.

오래된 브라우저는 보안상 위험을 초래할 수 있습니다. 최상의 경험을 위해서는 다음과 같은 최신 브라우저로 업데이트하세요.

Personalize for Me
Steps Complete!
1
2
3
Continue where you left off
Personalize your Everpure experience
Select a challenge, or skip and build your own use case.
미래를 대비한 가상화 전략

모든 요구 사항에 맞는 스토리지 옵션.

모든 규모의 AI 프로젝트 지원

데이터 파이프라인, 교육 및 추론을 위한 고성능 스토리지

데이터 손실 방지

데이터를 보호하는 사이버 복원력 솔루션

클라우드 운영 비용 절감

Azure, AWS 및 프라이빗 클라우드를 위한 비용 효율적인 스토리지.

애플리케이션 및 데이터베이스 성능 가속화

로우 레이턴시 스토리지로 애플리케이션 성능을 극대화하세요.

데이터센터 전력 및 공간 사용 절감

데이터센터 활용률을 높이는 리소스 효율적 스토리지

Confirm your outcome priorities
Your scenario prioritizes the selected outcomes. You can modify or choose next to confirm.
Primary
Reduce My Storage Costs
Lower hardware and operational spend.
Primary
Strengthen Cyber Resilience
Detect, protect against, and recover from ransomware.
Primary
Simplify Governance and Compliance
Easy-to-use policy rules, settings, and templates.
Primary
Deliver Workflow Automation
Eliminate error-prone manual tasks.
Primary
Use Less Power and Space
Smaller footprint, lower power consumption.
Primary
Boost Performance and Scale
Predictability and low latency at any size.
What’s your role and industry?
We've inferred your role based on your scenario. Modify or confirm and select your industry.
Select your industry
Financial services
Government
Healthcare
Education
Telecommunications
Automotive
Hyperscaler
Electronic design automation
Retail
Service provider
Transportation
Which team are you on?
Technical leadership team
Defines the strategy and the decision making process
Infrastructure and Ops team
Manages IT infrastructure operations and the technical evaluations
Business leadership team
Responsible for achieving business outcomes
Security team
Owns the policies for security, incident management, and recovery
Application team
Owns the business applications and application SLAs
Describe your ideal environment
Tell us about your infrastructure and workload needs. We chose a few based on your scenario.
Select your preferred deployment
Hosted
Dedicated off-prem
On-prem
Your data center + edge
Public cloud
Public cloud only
Hybrid
Mix of on-prem and cloud
Select the workloads you need
Databases
Oracle, SQL Server, SAP HANA, open-source

Key benefits:

  • Instant, space-efficient snapshots

  • Near-zero-RPO protection and rapid restore

  • Consistent, low-latency performance

 

AI/ML and analytics
Training, inference, data lakes, HPC

Key benefits:

  • Predictable throughput for faster training and ingest

  • One data layer for pipelines from ingest to serve

  • Optimized GPU utilization and scale
Data protection and recovery
Backups, disaster recovery, and ransomware-safe restore

Key benefits:

  • Immutable snapshots and isolated recovery points

  • Clean, rapid restore with SafeMode™

  • Detection and policy-driven response

 

Containers and Kubernetes
Kubernetes, containers, microservices

Key benefits:

  • Reliable, persistent volumes for stateful apps

  • Fast, space-efficient clones for CI/CD

  • Multi-cloud portability and consistent ops
Cloud
AWS, Azure

Key benefits:

  • Consistent data services across clouds

  • Simple mobility for apps and datasets

  • Flexible, pay-as-you-use economics

 

Virtualization
VMs, vSphere, VCF, vSAN replacement

Key benefits:

  • Higher VM density with predictable latency

  • Non-disruptive, always-on upgrades

  • Fast ransomware recovery with SafeMode™

 

Data storage
Block, file, and object

Key benefits:

  • Consolidate workloads on one platform

  • Unified services, policy, and governance

  • Eliminate silos and redundant copies

 

What other vendors are you considering or using?
Thinking...
Your personalized, guided path
Get started with resources based on your selections.
My Updates
No updates at this time.