Skip to content

Latest commit

Β 

History

History
136 lines (84 loc) Β· 5.46 KB

File metadata and controls

136 lines (84 loc) Β· 5.46 KB
Clust/
β”œβ”€β”€ LICENSE
β”œβ”€β”€ README.md
β”œβ”€β”€ clust
β”œβ”€β”€ docs
β”œβ”€β”€ examples
└── setting

CLUST Introduction

What is Clust?

CLUST(CLUStering Technologies of fragmented data for time-based data analysis)

μ‹œκ³„μ—΄ λ°μ΄ν„°λŠ” μ„œλ‘œ λ‹€λ₯Έ 데이터 μ£ΌκΈ°, ν’ˆμ§ˆ, μ–‘, 길이, μ €μž₯ ν˜•μ‹, μˆ˜μ§‘ 및 ν™œμš© λͺ©μ  등을 κ°–λŠ”λ‹€. κ·ΈλŸ¬λ―€λ‘œ 이질적인 λ‹€μˆ˜μ˜ μ‹œκ³„μ—΄ 데이터λ₯Ό ν†΅ν•©ν•˜μ—¬ λΆ„μ„ν•˜λŠ” 것은 단일 μ‹œκ³„μ—΄ 데이터λ₯Ό λΆ„μ„ν•˜λŠ” 것 보닀 더 μ–΄λ ΅λ‹€. κ·ΈλŸ¬λ―€λ‘œ CLUST κΈ°μˆ μ€ 이와 같은 λ‹€μˆ˜ μ‹œκ³„μ—΄ 데이터λ₯Ό 보닀 μ‰½κ²Œ λ‹€λ£¨λŠ” 것을 λͺ©ν‘œλ‘œ κ°œλ°œλ˜μ—ˆλ‹€.

CLUST ν”Œλž«νΌμ€ 크게 두가지가 μžˆλ‹€. ν•˜λ‚˜λŠ” μ—¬λŸ¬ μ†ŒμŠ€μ˜ 데이터λ₯Ό μ‰½κ²Œ μ°Ύκ³  ν†΅ν•©ν•˜λŠ” 도ꡬ인 CLUST Data Management Server 이며, λ‹€λ₯Έ ν•˜λ‚˜λŠ” 데이터λ₯Ό νƒμƒ‰ν•˜λŠ” κΈ°λŠ₯을 μ œκ³΅ν•˜λŠ” CLUST Data Analytics Server 이닀. CLUST ν”Œλž«νΌμ€ μ „λ¬Έκ°€κ°€ μ•„λ‹Œ μ‚¬μš©μžλ„ μ‚¬μš©ν•˜κΈ° μ‰¬μš΄ μ›Ή μΈν„°νŽ˜μ΄μŠ€λ₯Ό μ œκ³΅ν•˜λ©° λ‹€μ–‘ν•œ μ‹œλ‚˜λ¦¬μ˜€μ—μ„œ ν™œμš©λ  수 μžˆμŠ΅λ‹ˆλ‹€. CLUST νŒ¨ν‚€μ§€λŠ” 두 μ„œλ²„μ—μ„œ μ‚¬μš©ν•˜λŠ” λͺ¨λ“ˆμ‹ Python νŒ¨ν‚€μ§€λ‘œ Githubμ—μ„œ κ³΅κ°œλ˜μ—ˆλ‹€. CLUST PackageλŠ” λ‹€μ–‘ν•œ ν˜•μ‹κ³Ό ν’ˆμ§ˆλ‘œ μ €μž₯된 μ—¬λŸ¬ μ‹œκ³„μ—΄ 데이터λ₯Ό ν™œμš©ν•˜λŠ” κΈ°λŠ₯을 μ œκ³΅ν•œλ‹€.

(Eng) Time series data have different data cycles, quality, quantity, length, storage format, collection and utilization purposes, etc. Therefore, integrating and analyzing multiple heterogeneous time series data is more difficult than analyzing a single time series data. Therefore, CLUST technology was developed with the goal of easier handling of such multiple time series data. There are two main CLUST platforms. One is CLUST Data Management Server, a tool to easily search and integrate data from multiple sources, and the other is CLUST Data Analytics Server, which provides the ability to explore data. The CLUST platform provides an easy-to-use web interface even for non-expert users and can be utilized in a variety of scenarios. The CLUST package is a modular Python package used on both servers and is published on GitHub. CLUST Package provides the ability to utilize multiple time series data stored in various formats and qualities.

CLUST PACKAGES

CLUST PackagesλŠ” 뢄석, 데이터 인좜 및 처리, 데이터 κ²°ν•©, 메타 생성, 데이터 처리, 데이터 ν’ˆμ§ˆ ν–₯상, 데이터 ν™œμš© 도ꡬ, 데이터 λ³€ν™˜, κΈ°κ³„ν•™μŠ΅ 및 일련의 κ³Όμ •μ˜ νŒŒμ΄ν”„λΌμΈ ꡬ성을 μœ„ν•œ μ†Œν”„νŠΈμ›¨μ–΄λ₯Ό μ œκ³΅ν•œλ‹€. ν•΄λ‹Ή νŒ¨ν‚€μ§€λŠ” Github에 κ³΅κ°œλ˜μ–΄ 있으며 https://github.com/ClustProject/Clust μ—μ„œ 확인할 수 μžˆλ‹€. λ³Έ ν™ˆνŽ˜μ΄μ§€λŠ” ν•΄λ‹Ή μ†ŒμŠ€μ½”λ“œμ— λŒ€ν•œ κ°„λ‹¨ν•œ μ„€λͺ…κ³Ό μ†Œκ°œλ‘œ 이루어진닀.

CLUST PLATFORM

CLUST κΈ°μˆ μ„ μ΄μš©ν•˜μ—¬ μ‹œκ³„μ—΄ 데이터λ₯Ό μ‹œκ°ν™”, 처리, λΆ„μ„ν•˜λŠ” ν”Œλž«νΌκ³Ό 메타 데이터λ₯Ό 같이 ν™œμš©ν•˜μ—¬ 데이터λ₯Ό 생성, 처리, 좜λ ₯ λ“± κΈ°μˆ μ„ μ μš©ν•œ ν”Œλž«νΌ 2κ°€μ§€λ₯Ό μ†Œκ°œν•œλ‹€.

CDA(CLUST Data Analytics) ν”Œλž«νΌμ€ λ³΅μž‘ν•œ 데이터셋에 λŒ€ν•΄ μ—¬λŸ¬ κ°λ„λ‘œ 뢄석할 수 μžˆλŠ” 도ꡬλ₯Ό μ œκ³΅ν•©λ‹ˆλ‹€. μ‚¬μš©μžλ“€μ€ ν•˜λ‚˜μ˜ μΈν„°νŽ˜μ΄μŠ€μ—μ„œ μ†μ‰½κ²Œ 데이터 μΆ”μΆœ, 뢄석, 데이터 μ‹œκ°ν™” 처리λ₯Ό ν•  수 있으며, 볡합적 μ‹œκ°„ λ°μ΄ν„°μ…‹μ—μ„œ μ§κ΄€μ μœΌλ‘œ 톡찰λ ₯을 얻을 수 μžˆμŠ΅λ‹ˆλ‹€.

CDM(CLUST Data Management) ν”Œλž«νΌμ€ μ‹œκ³„μ—΄ 데이터와 메타 데이터λ₯Ό λ‹€λ£¨λŠ” ν”Œλž«νΌμœΌλ‘œ, μ‚¬μš©μžκ°€ 데이터 μž…λ ₯, 확인, 생성, 검색, 톡합 처리 κΈ°μˆ μ„ 적용 κ°€λŠ₯ν•œ κΈ°λŠ₯을 μ œκ³΅ν•©λ‹ˆλ‹€.

Repository For Open Software On Github

CLUST Packages

  • analysis
  • data
  • ingestion
  • integration
  • meta
  • ML
  • pipeline
  • preprocessing
  • quality
  • tool
  • transformation