Multimodal AI โ models processing text, images, audio, and handwriting โ is applied across the wiki: mllm-scientific-visualization-literacy, llm-handwritten-math-grading, multimodal-ai-feedback-learning, and vismatic-secure-sandbox-cs-education show multimodal understanding expanding what AI can assess and tutor (educational-nlp, intelligent-tutoring).
Related Pages
- slidesqaqa-pedagogical-question-generation โ joint text+visual reasoning for slide-based question generation
๐ 13 other pages tagged multimodal
- An Interpretable Closed-Loop Intelligent Tutoring System for Multimodal Affective Feedback in Asynchronous Presentation Training
- ANVIL: Analogies and Videos for Lecturers
- Automated Grading of Handwritten Mathematics Using Vision-Capable LLMs
- Benchmarking Large Language Models for Diagnosing Students' Cognitive Skills from Handwritten Math Work
- Educational VLM Evaluation
- Educator's Guide to Multimodal Learning with GenAI
- LLM-based Multimodal AI Feedback Produces Equivalent Learning and Better Student Perceptions than Educator Feedback
- Multimodal Dialogue in STEM Education
- Multimodal Learning with Generative AI
- SAVVY: Student Attention Visualization for Video-based Learning Analysis
- Slide Deck Q&A Quality Assurance App: A Multi-Stage Pipeline for Pedagogical Question Generation
- Students' multimodal prompting practices as epistemic work in AI literacy development
- TurtleAI: Benchmarking Multimodal Models for Visual Programming in Turtle Graphics