Full-Stack Engineer & AI Systems Builder focused on high-performance web applications, multimodal intelligence, spatial computer vision, and modern developer tools.
- 💼 Personal Portfolio: swapnoneelmondal.vercel.app
- 👁️ DynoVision: dynovision.netlify.app
- 🚀 Scholar OS: scholardashboard.vercel.app
👁️ DynoVision
Autonomous AI Computer Vision Engine & Generative Ambient Acoustic Synthesizer: Ingests live webcam feeds in real time using client-side MediaPipe (Hands, Pose, Face 52 blendshapes) and TensorFlow.js COCO-SSD to detect kinetic motion, gestures, emotions, and surroundings—modulating procedural Web Audio polyphonic soundscapes and Gemini AI generative audio descriptions.
- 🌐 Live Application: dynovision.netlify.app
- 📦 GitHub Repository: KaiX-Jr/dynovision
- 🛠️ Tech Stack: React 19, TypeScript, MediaPipe Tasks Vision, TensorFlow.js, Web Audio API, Tone.js, Google Gemini Flash Lite, Tailwind CSS v4
Cognitive Academic Operating System for students: classroom blackboard vision digitization with Gemini 2.5 Flash, active recall quiz engine, 75% attendance bunk simulation, and real-time cloud persistence.
- 🌐 Live Application: scholardashboard.vercel.app
- 📦 GitHub Repository: KaiX-Jr/scholar-os
- 🛠️ Tech Stack: Next.js 16 (App Router), React 19, TypeScript, Tailwind CSS, Upstash Redis, Google Gemini 2.5 Flash, KaTeX
- Frontend & UI: Next.js 16 (App Router), React 19, TypeScript, Tailwind CSS v4, Framer Motion, KaTeX, Lucide Icons
- AI & Computer Vision: Google Gemini 2.5 Flash, MediaPipe (Face, Hands, Pose), TensorFlow.js, Multimodal Vision OCR, Prompt Engineering
- Backend & Database: Node.js, Express, Upstash Redis, REST APIs, Google OAuth 2.0
- Audio & Procedural Acoustics: Web Audio API, Tone.js Synthesizers, Binaural Frequency Synthesis, HTML5 Canvas Visualizers
- 🌐 Portfolio: https://swapnoneelmondal.vercel.app
- 🐙 GitHub: @KaiX-Jr