Spatial State Subset Modeling for Low-Memory Data Compression

Resolve Bottlenecks,
Find Innovative Solutions
Generate Solutions

Solution Overview

Problem

Current data processing techniques face inefficiencies in modeling large sequences of data, analyzing patterns, determining probabilities, and reducing entropy without loss, particularly due to high memory and computational costs, and the inability to efficiently compress random-like data.

Innovation Solution

The method identifies a subset of states within a data system using a spatial statistical model that represents systemic characteristics and relationships, allowing for efficient modeling and compression by creating identifiers that correspond to probable states, reducing memory and processing requirements.

Engineering Contradictions & Design Principles

VSEngineering Contradiction Analysis

1Loss of information

If adaptive modeling is used to model more patterns, then compression ratio is improved, but memory resources are depleted and computational cost increases

Engineering Contradiction:
Improvecompression ratioVSAvoidmemory resources
Core Design Contradiction:
Loss of informationVSQuantity of substance

Solution Approach 1:

The patent extracts only the essential probability information needed for compression by using arithmetic coding to represent probability distributions compactly. Instead of storing complete adaptive models or dictionaries, the system extracts and transmits only the necessary probability parameters, significantly reducing memory requirements while maintaining compression effectiveness.

Inventive Principle:
Principle #2Taking out (Extraction)

Solution Approach 2:

The patent transforms the representation of probability distributions from discrete frequency counts into continuous probability space using arithmetic coding. This dimensional transformation allows the system to model complex patterns with continuous probability values rather than discrete state frequencies, reducing the memory footprint from exponential to polynomial complexity.

Inventive Principle:
Principle #17Another dimension (Dimensionality change)

2Loss of information

If adaptive modeling is used to model more patterns, then compression ratio is improved, but computational cost increases

Engineering Contradiction:
Improvecompression ratioVSAvoidcomputational cost
Core Design Contradiction:
Loss of informationVSDevice complexity

Solution Approach 1:

The patent replaces the mechanical process of updating and querying large adaptive dictionaries or Huffman trees with arithmetic coding operations. Instead of traversing complex data structures to encode/decode symbols, the system uses straightforward arithmetic operations on probability intervals, dramatically reducing computational complexity from O(n) to O(1) per symbol.

Inventive Principle:
Principle #28Mechanics substitution (Replace mechanical system)

Solution Approach 2:

The patent changes the parameters used for modeling from discrete frequency counts to continuous probability distributions. This parameter transformation allows the system to achieve high compression ratios by accurately modeling symbol probabilities without requiring large amounts of training data or complex adaptive structures, reducing both computational and memory requirements.

Inventive Principle:
Principle #35Parameter changes

3Device complexity

If static index or dictionary is used, then computational cost is reduced, but compression ratio deteriorates when number of patterns is large

Engineering Contradiction:
Improvecomputational costVSAvoidcompression ratio
Core Design Contradiction:
Device complexityVSLoss of information

Solution Approach 1:

The patent introduces dynamics into the probability modeling process by allowing probability distributions to adapt to the input data characteristics. Using arithmetic coding, the system dynamically adjusts probability estimates based on observed frequencies while maintaining a compact representation. This dynamic adaptation achieves high compression ratios for large pattern sets without requiring large static dictionaries or indexes.

Inventive Principle:
Principle #15Dynamics

Data Source

PatentUS10127498B2Utilizing spatial probability models to reduce computational resource and memory utilization
Publication Date: 2018.11.13 MIRAL LAB LLC
  • US10127498B2 patent drawing
  • US10127498B2 patent drawing
  • US10127498B2 patent drawing

AI summary

A method, article comprising machine-readable instructions and apparatus that processes data systems for encoding, decoding, pattern recognition/matching and data generation is disclosed. State subsets of a data system are identified for the efficient processing of data based, at least in part, on the data system's systemic characteristics.