1️⃣ User selects translation mode (Text-to-Text, Speech-to-Speech, One-to-Many) 2️⃣ User provides input (Typed text or Spoken words via Microphone) 3️⃣ Preprocessing (Speech-to-text conversion, Noise reduction, Language detection) 4️⃣ Translation to the selected target language(s) 5️⃣ Output (Translated text displayed, Speech generated for playback) 6️⃣ Data Storage (Translations stored in MongoDB for future retrieval)