Skip to content
View KaiX-Jr's full-sized avatar
:atom:
⚡ Engineering scalable APIs, neural vision & audio systems 🔌 Building high-thro
:atom:
⚡ Engineering scalable APIs, neural vision & audio systems 🔌 Building high-thro

Highlights

  • Pro

Block or report KaiX-Jr

Block user

Prevent this user from interacting with your repositories and sending you notifications. Learn more about blocking users.

You must be logged in to block users.

Maximum 250 characters. Please don’t include any personal information such as legal names or email addresses. Markdown is supported. This note will only be visible to you.
Report abuse

Contact GitHub support about this user’s behavior. Learn more about reporting abuse.

Report abuse
KaiX-Jr/README.md

Hi there, I'm Swapnoneel Mondal 👋

Full-Stack Engineer & AI Systems Builder focused on high-performance web applications, multimodal intelligence, spatial computer vision, and modern developer tools.


🌐 Portfolio & Live Systems


🌟 Featured Projects

👁️ DynoVision

Autonomous AI Computer Vision Engine & Generative Ambient Acoustic Synthesizer: Ingests live webcam feeds in real time using client-side MediaPipe (Hands, Pose, Face 52 blendshapes) and TensorFlow.js COCO-SSD to detect kinetic motion, gestures, emotions, and surroundings—modulating procedural Web Audio polyphonic soundscapes and Gemini AI generative audio descriptions.

  • 🌐 Live Application: dynovision.netlify.app
  • 📦 GitHub Repository: KaiX-Jr/dynovision
  • 🛠️ Tech Stack: React 19, TypeScript, MediaPipe Tasks Vision, TensorFlow.js, Web Audio API, Tone.js, Google Gemini Flash Lite, Tailwind CSS v4

Cognitive Academic Operating System for students: classroom blackboard vision digitization with Gemini 2.5 Flash, active recall quiz engine, 75% attendance bunk simulation, and real-time cloud persistence.


🛠️ Tech Stack & Skills

  • Frontend & UI: Next.js 16 (App Router), React 19, TypeScript, Tailwind CSS v4, Framer Motion, KaTeX, Lucide Icons
  • AI & Computer Vision: Google Gemini 2.5 Flash, MediaPipe (Face, Hands, Pose), TensorFlow.js, Multimodal Vision OCR, Prompt Engineering
  • Backend & Database: Node.js, Express, Upstash Redis, REST APIs, Google OAuth 2.0
  • Audio & Procedural Acoustics: Web Audio API, Tone.js Synthesizers, Binaural Frequency Synthesis, HTML5 Canvas Visualizers

📬 Connect With Me

Pinned Loading

  1. PortfolioV2 PortfolioV2 Public

    Official Portfolio V2 of Swapnoneel Mondal — Computer Science Scholar & High-Performance Frontend Engineer. Built with Next.js 16, React 19, TypeScript, Liquid Glass UI, Web Audio API, and mobile t…

    TypeScript 1

  2. scholar-os scholar-os Public

    The Cognitive Operating System for Scholars — Next.js academic dashboard with Gemini Vision OCR, attendance tracking, CGPA projection, habit streaks & deep work focus synthesis.

    TypeScript 1

  3. dynovision dynovision Public

    Autonomous AI Computer Vision Engine detecting objects, hand gestures, body posture & facial emotion to synthesize real-time adaptive ambient soundscapes.

    TypeScript 1