Visual Image Audio Composition System

Resolve Bottlenecks,
Find Innovative Solutions
Generate Solutions

Solution Overview

Problem

Current systems cannot convert preferred visual images and GPS data into real-time audio compositions based on user inputs for audio parameters, compatibility, and storage, limiting personalized audio generation in various settings.

Innovation Solution

A method and system using a computer system with a processor, visual image display, sound database, and audio composition program to generate audio compositions by scanning visual images, selecting regions, and assembling audio blocks based on user inputs, allowing real-time or offline conversion of visual images into audio.

Engineering Contradictions & Design Principles

VSEngineering Contradiction Analysis

1Adaptability or versatility

If visual images are converted to audio compositions in real-time based on user inputs, then personalization and user control are improved, but system complexity and processing requirements increase

Engineering Contradiction:
Improveuser control over audio compositionVSAvoidsystem complexity
Core Design Contradiction:
Adaptability or versatilityVSDevice complexity

Solution Approach 1:

The system segments the visual image into multiple regions and processes each region independently to generate corresponding audio blocks. This segmentation allows real-time processing of complex images by dividing them into manageable portions, each contributing to different aspects of the audio composition based on user-selected parameters.

Inventive Principle:
Principle #1Segmentation

Solution Approach 2:

The system performs preliminary actions by pre-processing visual images to identify and segment regions before audio generation. User preferences and audio parameters are pre-configured and applied during the conversion process, enabling real-time personalized audio composition without requiring complex runtime decision-making.

Inventive Principle:
Principle #10Preliminary action

2Manufacturing precision

If visual images are converted to audio compositions offline, then processing accuracy and quality are improved, but time consumption and productivity decrease

Engineering Contradiction:
Improveaudio composition qualityVSAvoidprocessing speed
Core Design Contradiction:
Manufacturing precisionVSProductivity

Solution Approach 1:

The system implements dynamic processing that adapts between real-time and offline modes based on user needs. In real-time mode, processed audio composition is generated quickly with standard quality parameters. In offline mode, the system performs more thorough processing with enhanced quality settings, allowing users to choose the appropriate balance between speed and quality for different applications.

Inventive Principle:
Principle #15Dynamics

Data Source

PatentUS11004434B2Systems and methods for visual image audio composition based on user input
Publication Date: 2021.05.11 ELKINS ROY
  • US11004434B2 patent drawing
  • US11004434B2 patent drawing
  • US11004434B2 patent drawing

AI summary

The present invention relates to systems and methods for visual image audio composition. In particular, the present invention provides systems and methods for audio composition from a diversity of visual images and user determined sound database sources.