{"as_of":"2026-08-10T16:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4134a366fe46596fe08f1cc861bac3888eacfb8b494d1b368d3f96141515d4f2","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T11:49:12.454087Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.22369/citation-record","integrity":"/paper/2507.22369/integrity","json":"/paper/2507.22369/citation-record.json","paper":"/paper/2507.22369"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3479.36620","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:49:14.811309Z","title":"A chatgpt-based approach for questions generation in higher education,","venue":null,"work_id":"afc44dac-aba5-4355-949a-08a152ce148d","year":2024},"citing_paper":{"arxiv_id":"2507.22369","last_updated":"2025-09-02T02:23:20Z","snapshot_observed_at":"2026-08-10T02:09:40.417957Z","submitted_at":"2025-07-30T04:25:14Z","title":"Exploring the Application of Visual Question Answering (VQA) for Classroom Activity Monitoring","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T11:49:09.102483Z"},"links":{"citing_paper":"/paper/2507.22369"},"observation_digest":"sha256:2287d17688858c48c4ffe7e261fed391989a9ca03c35d632705ecd8b6712aa96","observation_id":"da1c715d-b9d2-42be-9909-59ebe72646d7","resolution":{"observed_at":"2026-08-06T11:49:14.944252Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0116.20901","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:49:14.522212Z","title":"Using learning analytics to assess students’ behavior in open-ended programming tasks,","venue":null,"work_id":"abe72bb5-57df-4e27-a98e-016aeb2be742","year":2011},"citing_paper":{"arxiv_id":"2507.22369","last_updated":"2025-09-02T02:23:20Z","snapshot_observed_at":"2026-08-10T02:09:40.417957Z","submitted_at":"2025-07-30T04:25:14Z","title":"Exploring the Application of Visual Question Answering (VQA) for Classroom Activity Monitoring","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T11:49:09.165676Z"},"links":{"citing_paper":"/paper/2507.22369"},"observation_digest":"sha256:89c1e552cf80d0aad9f3bb453b63df80720dde8908a7f23dba39c61b4716708f","observation_id":"bfa9626f-4697-43d0-9efd-6e910235c343","resolution":{"observed_at":"2026-08-06T11:49:14.605536Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:49:18.247673Z","title":"Ta-student vqa: Multi-agents training by self-questioning,","venue":null,"work_id":"f136b854-0c75-4fb8-99f8-590b2d592f51","year":2020},"citing_paper":{"arxiv_id":"2507.22369","last_updated":"2025-09-02T02:23:20Z","snapshot_observed_at":"2026-08-10T02:09:40.417957Z","submitted_at":"2025-07-30T04:25:14Z","title":"Exploring the Application of Visual Question Answering (VQA) for Classroom Activity Monitoring","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T11:49:09.259652Z"},"links":{"citing_paper":"/paper/2507.22369"},"observation_digest":"sha256:06b5d4661201c6aa1a46a9a0310a42919b47415c7b9775a72ab5bddd72eb5194","observation_id":"50159e76-bdf9-4ae7-92fd-e3016a4a60a4","resolution":{"observed_at":"2026-08-06T11:49:18.403119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:49:17.965319Z","title":"Bozkir, C","venue":null,"work_id":"680d0ef6-ca21-4466-af40-cb46969b659f","year":2025},"citing_paper":{"arxiv_id":"2507.22369","last_updated":"2025-09-02T02:23:20Z","snapshot_observed_at":"2026-08-10T02:09:40.417957Z","submitted_at":"2025-07-30T04:25:14Z","title":"Exploring the Application of Visual Question Answering (VQA) for Classroom Activity Monitoring","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T11:49:09.358836Z"},"links":{"citing_paper":"/paper/2507.22369"},"observation_digest":"sha256:720275571dc9e3a0955ce032ec1df98e5b7f0c65e63e6ccb4ddece8d90a98e52","observation_id":"c6845e70-a543-4a93-9e0a-094e609879e8","resolution":{"observed_at":"2026-08-06T11:49:18.111605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:49:17.582673Z","title":"What is visual question answering (vqa)?","venue":null,"work_id":"d1a41d92-8791-456f-b07c-8e3f540382e2","year":2023},"citing_paper":{"arxiv_id":"2507.22369","last_updated":"2025-09-02T02:23:20Z","snapshot_observed_at":"2026-08-10T02:09:40.417957Z","submitted_at":"2025-07-30T04:25:14Z","title":"Exploring the Application of Visual Question Answering (VQA) for Classroom Activity Monitoring","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T11:49:09.450587Z"},"links":{"citing_paper":"/paper/2507.22369"},"observation_digest":"sha256:239f9791475426755d6124c03ada05a82f301e4e47b33c186320571e999485c7","observation_id":"082d6326-045f-4c59-9d95-e66065c068da","resolution":{"observed_at":"2026-08-06T11:49:17.740668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.10227","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:49:14.189813Z","title":"From image to language: A critical analysis of visual question answering (vqa) approaches, challenges, and opportunities,","venue":null,"work_id":"dc8079e8-361f-435c-948b-744f3322eca6","year":2024},"citing_paper":{"arxiv_id":"2507.22369","last_updated":"2025-09-02T02:23:20Z","snapshot_observed_at":"2026-08-10T02:09:40.417957Z","submitted_at":"2025-07-30T04:25:14Z","title":"Exploring the Application of Visual Question Answering (VQA) for Classroom Activity Monitoring","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T11:49:09.563963Z"},"links":{"citing_paper":"/paper/2507.22369"},"observation_digest":"sha256:5ef41856514ae05461d97c89eae480cde5fcde5754f96fb7f1cc7ef9b2cc9b04","observation_id":"66397703-cac3-4cab-8d04-c41d3fd072be","resolution":{"observed_at":"2026-08-06T11:49:14.335749Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:49:17.285746Z","title":"Aiqam’25: The 2nd acm workshop on ai-powered ques- tion answering systems for multimedia,","venue":null,"work_id":"d4fe9462-41e9-4ffe-805d-0e83d4d221ad","year":2025},"citing_paper":{"arxiv_id":"2507.22369","last_updated":"2025-09-02T02:23:20Z","snapshot_observed_at":"2026-08-10T02:09:40.417957Z","submitted_at":"2025-07-30T04:25:14Z","title":"Exploring the Application of Visual Question Answering (VQA) for Classroom Activity Monitoring","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T11:49:09.641167Z"},"links":{"citing_paper":"/paper/2507.22369"},"observation_digest":"sha256:2c4f515f2e88d685fbd0e75c4797c4d71364c35d21b1a4a3cd164a084a74115b","observation_id":"172b2f2a-8464-46ed-9c8c-57c36b8879ec","resolution":{"observed_at":"2026-08-06T11:49:17.424197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.07825","last_updated":"2024-09-09T11:08:17Z","snapshot_observed_at":"2026-08-10T02:10:09.342490Z","submitted_at":"2023-05-13T02:46:41Z","title":"Student Classroom Behavior Detection based on YOLOv7-BRA and Multi-Model Fusion","version":2},"cited_work":{"arxiv_id":"2305.07825","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.07825","snapshot_observed_at":"2026-08-06T11:49:13.851153Z","title":"Student Classroom Behavior Detection based on YOLOv7-BRA and Multi-Model Fusion","venue":"cs.CV","work_id":"1a0ad39b-d6c6-41c8-9e82-964dc7e903e7","year":2023},"citing_paper":{"arxiv_id":"2507.22369","last_updated":"2025-09-02T02:23:20Z","snapshot_observed_at":"2026-08-10T02:09:40.417957Z","submitted_at":"2025-07-30T04:25:14Z","title":"Exploring the Application of Visual Question Answering (VQA) for Classroom Activity Monitoring","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T11:49:09.721364Z"},"links":{"cited_paper":"/paper/2305.07825","citing_paper":"/paper/2507.22369"},"observation_digest":"sha256:ce01032a0dd772f8d4b927a0108a07716b89da3bb9c08e6556d4a4b58a4d079e","observation_id":"273fbb73-aaab-4285-baaa-7a44d337e720","resolution":{"observed_at":"2026-08-06T11:49:14.002056Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:49:16.963869Z","title":"Yolo-cbd: Classroom behavior detection method based on behavior feature extraction and aggregation,","venue":null,"work_id":"ce79d57a-0d3c-44ea-8a71-4bf9a23fb3ff","year":2025},"citing_paper":{"arxiv_id":"2507.22369","last_updated":"2025-09-02T02:23:20Z","snapshot_observed_at":"2026-08-10T02:09:40.417957Z","submitted_at":"2025-07-30T04:25:14Z","title":"Exploring the Application of Visual Question Answering (VQA) for Classroom Activity Monitoring","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T11:49:09.807729Z"},"links":{"citing_paper":"/paper/2507.22369"},"observation_digest":"sha256:8bdcfee32e7713ff5c697bf1b7a5e9bccd6b9bb5e7619895cb7a99aa52b644da","observation_id":"a9f4fcff-05d6-4575-8309-3e7b83321421","resolution":{"observed_at":"2026-08-06T11:49:17.132250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:49:16.651185Z","title":"Student behavior detection in the classroom based on improved yolov8,","venue":null,"work_id":"dce614a1-04b2-489a-a1e3-2cccfa3dfc72","year":2023},"citing_paper":{"arxiv_id":"2507.22369","last_updated":"2025-09-02T02:23:20Z","snapshot_observed_at":"2026-08-10T02:09:40.417957Z","submitted_at":"2025-07-30T04:25:14Z","title":"Exploring the Application of Visual Question Answering (VQA) for Classroom Activity Monitoring","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T11:49:09.884396Z"},"links":{"citing_paper":"/paper/2507.22369"},"observation_digest":"sha256:f1f7a63407600cb5947dd1a9b2c07e3132cd8bef4cc17cc1995f7d9045cae08b","observation_id":"18856815-c111-4a0b-911a-c3d26c60f975","resolution":{"observed_at":"2026-08-06T11:49:16.801435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02522","last_updated":"2024-09-09T11:01:25Z","snapshot_observed_at":"2026-08-10T07:29:56.372366Z","submitted_at":"2023-10-04T01:43:46Z","title":"SCB-Dataset3: A Benchmark for Detecting Student Classroom Behavior","version":2},"cited_work":{"arxiv_id":"2310.02522","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.02522","snapshot_observed_at":"2026-08-06T11:49:13.579370Z","title":"SCB-Dataset3: A Benchmark for Detecting Student Classroom Behavior","venue":"cs.CV","work_id":"54e659d5-c1ae-45ef-9fbb-d724265d57d4","year":2023},"citing_paper":{"arxiv_id":"2507.22369","last_updated":"2025-09-02T02:23:20Z","snapshot_observed_at":"2026-08-10T02:09:40.417957Z","submitted_at":"2025-07-30T04:25:14Z","title":"Exploring the Application of Visual Question Answering (VQA) for Classroom Activity Monitoring","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T11:49:09.963250Z"},"links":{"cited_paper":"/paper/2310.02522","citing_paper":"/paper/2507.22369"},"observation_digest":"sha256:56a11627348d189f0cf75241c509eef2d6a52cabd2c1b705cae3df266cbc1508","observation_id":"6253777b-d6e2-4dae-9d39-adb9a3c88c89","resolution":{"observed_at":"2026-08-06T11:49:13.710573Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.10364","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:49:13.441482Z","title":"Context understanding in computer vision: A survey,","venue":null,"work_id":"497d61d0-6508-4a90-a1f4-86b598ca0347","year":2023},"citing_paper":{"arxiv_id":"2507.22369","last_updated":"2025-09-02T02:23:20Z","snapshot_observed_at":"2026-08-10T02:09:40.417957Z","submitted_at":"2025-07-30T04:25:14Z","title":"Exploring the Application of Visual Question Answering (VQA) for Classroom Activity Monitoring","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T11:49:10.047632Z"},"links":{"citing_paper":"/paper/2507.22369"},"observation_digest":"sha256:ae067204f398a68264989af23423a4092ef0a588abc3b45feb0ab785932fcce4","observation_id":"7fd56365-1507-4e38-b698-06641cd28d59","resolution":{"observed_at":"2026-08-06T11:49:13.513388Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:49:16.355857Z","title":"Multimodal research in vision and language: A review of current and emerging trends,","venue":null,"work_id":"9f61a4c0-de01-46d1-8af5-51325ae4aafa","year":2022},"citing_paper":{"arxiv_id":"2507.22369","last_updated":"2025-09-02T02:23:20Z","snapshot_observed_at":"2026-08-10T02:09:40.417957Z","submitted_at":"2025-07-30T04:25:14Z","title":"Exploring the Application of Visual Question Answering (VQA) for Classroom Activity Monitoring","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T11:49:10.151833Z"},"links":{"citing_paper":"/paper/2507.22369"},"observation_digest":"sha256:bdc0602976e1e0c245ea03a0a26278bd6a03fe327e63f333ed77344c5890aeca","observation_id":"b7e1bfc1-f7b7-4bab-8144-fa2bd631730c","resolution":{"observed_at":"2026-08-06T11:49:16.508917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07476","last_updated":"2024-10-30T06:49:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-11T17:22:23Z","title":"VideoLLaMA 2: Advancing Spatial-Temporal Modeling and Audio Understanding in Video-LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07476","snapshot_observed_at":"2026-08-06T11:49:10.236114Z","title":"Videollama 2: Advancing spatial-temporal modeling and audio understanding in video-llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22369","last_updated":"2025-09-02T02:23:20Z","snapshot_observed_at":"2026-08-10T02:09:40.417957Z","submitted_at":"2025-07-30T04:25:14Z","title":"Exploring the Application of Visual Question Answering (VQA) for Classroom Activity Monitoring","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T11:49:10.236114Z"},"links":{"cited_paper":"/paper/2406.07476","citing_paper":"/paper/2507.22369"},"observation_digest":"sha256:b283f359864460f27826725ba85847be92572a7f586c579953e3f4f684b27ecb","observation_id":"87f07c28-b9ed-43be-9035-c76b07d3e1c6","resolution":{"observed_at":"2026-08-06T11:49:10.236114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13106","last_updated":"2025-06-03T03:33:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T18:59:46Z","title":"VideoLLaMA 3: Frontier Multimodal Foundation Models for Image and Video Understanding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.13106","snapshot_observed_at":"2026-08-06T11:49:10.330852Z","title":"Videollama 3: Frontier multimodal foundation models for image and video understanding,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22369","last_updated":"2025-09-02T02:23:20Z","snapshot_observed_at":"2026-08-10T02:09:40.417957Z","submitted_at":"2025-07-30T04:25:14Z","title":"Exploring the Application of Visual Question Answering (VQA) for Classroom Activity Monitoring","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T11:49:10.330852Z"},"links":{"cited_paper":"/paper/2501.13106","citing_paper":"/paper/2507.22369"},"observation_digest":"sha256:129c95c6117d6e69071a248b80399d81c649657d6508f4a9c353dcae1a7e2677","observation_id":"3f3bc963-f088-48a5-be70-96115c8b0a94","resolution":{"observed_at":"2026-08-06T11:49:10.330852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04468","last_updated":"2026-04-25T07:16:42Z","snapshot_observed_at":"2026-08-03T08:48:57.969106Z","submitted_at":"2024-12-05T18:59:55Z","title":"NVILA: Efficient Frontier Visual Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04468","snapshot_observed_at":"2026-08-06T11:49:10.455295Z","title":"Nvila: Efficient frontier visual language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22369","last_updated":"2025-09-02T02:23:20Z","snapshot_observed_at":"2026-08-10T02:09:40.417957Z","submitted_at":"2025-07-30T04:25:14Z","title":"Exploring the Application of Visual Question Answering (VQA) for Classroom Activity Monitoring","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T11:49:10.455295Z"},"links":{"cited_paper":"/paper/2412.04468","citing_paper":"/paper/2507.22369"},"observation_digest":"sha256:c617b6cec7e2a3cd2af9fb4b8e0532d13414c05837170a190ace741ee4afa999","observation_id":"94e994f1-c11d-493c-8020-9568fcb97295","resolution":{"observed_at":"2026-08-06T11:49:10.455295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-06T11:49:10.580707Z","title":"Qwen3 technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22369","last_updated":"2025-09-02T02:23:20Z","snapshot_observed_at":"2026-08-10T02:09:40.417957Z","submitted_at":"2025-07-30T04:25:14Z","title":"Exploring the Application of Visual Question Answering (VQA) for Classroom Activity Monitoring","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T11:49:10.580707Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2507.22369"},"observation_digest":"sha256:99808215b5c05249cf2ad0107a59239aeded1e1b7608ca26c06708de8ad1507d","observation_id":"a6e19850-b108-4317-85f5-398bf8fbb498","resolution":{"observed_at":"2026-08-06T11:49:10.580707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.11471","last_updated":"2024-02-18T08:00:19Z","snapshot_observed_at":"2026-08-06T23:46:22.347744Z","submitted_at":"2023-07-21T10:12:09Z","title":"Robust Visual Question Answering: Datasets, Methods, and Future Challenges","version":2},"cited_work":{"arxiv_id":"2307.11471","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.11471","snapshot_observed_at":"2026-08-06T11:49:13.140765Z","title":"Robust Visual Question Answering: Datasets, Methods, and Future Challenges","venue":"cs.CV","work_id":"c50937cf-2233-4bdd-a82f-c4ff3ed472be","year":2023},"citing_paper":{"arxiv_id":"2507.22369","last_updated":"2025-09-02T02:23:20Z","snapshot_observed_at":"2026-08-10T02:09:40.417957Z","submitted_at":"2025-07-30T04:25:14Z","title":"Exploring the Application of Visual Question Answering (VQA) for Classroom Activity Monitoring","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T11:49:10.673303Z"},"links":{"cited_paper":"/paper/2307.11471","citing_paper":"/paper/2507.22369"},"observation_digest":"sha256:6f785e9dc07ea81c8079db249ad950b7ac85eac550cd701a420bfc86c86f8189","observation_id":"8329c023-ad6f-44bb-9fb1-3eb3df8299c0","resolution":{"observed_at":"2026-08-06T11:49:13.185067Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.jcp.2018.08","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:49:12.621928Z","title":"Dgm: A deep learning algorithm for solving partial differential equations,","venue":null,"work_id":"4fc5209d-3428-4847-814f-39d26579b595","year":2018},"citing_paper":{"arxiv_id":"2507.22369","last_updated":"2025-09-02T02:23:20Z","snapshot_observed_at":"2026-08-10T02:09:40.417957Z","submitted_at":"2025-07-30T04:25:14Z","title":"Exploring the Application of Visual Question Answering (VQA) for Classroom Activity Monitoring","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T11:49:10.832725Z"},"links":{"citing_paper":"/paper/2507.22369"},"observation_digest":"sha256:294f6164c8c33e251fd8b760a01ed7403521700bb4a9af565487e129c633989f","observation_id":"c86e692d-789b-4f69-8ec7-09b5650146a0","resolution":{"observed_at":"2026-08-06T11:49:12.707648Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1704.04497","last_updated":"2017-12-03T04:46:42Z","snapshot_observed_at":"2026-08-10T02:09:16.680532Z","submitted_at":"2017-04-14T17:57:01Z","title":"TGIF-QA: Toward Spatio-Temporal Reasoning in Visual Question Answering","version":3},"cited_work":{"arxiv_id":"1704.04497","doi":null,"metadata_source":"pith","pith_arxiv_id":"1704.04497","snapshot_observed_at":"2026-08-06T11:49:12.980227Z","title":"TGIF-QA: Toward Spatio-Temporal Reasoning in Visual Question Answering","venue":"cs.CV","work_id":"e8112406-df32-4985-8857-513c40e05c58","year":2017},"citing_paper":{"arxiv_id":"2507.22369","last_updated":"2025-09-02T02:23:20Z","snapshot_observed_at":"2026-08-10T02:09:40.417957Z","submitted_at":"2025-07-30T04:25:14Z","title":"Exploring the Application of Visual Question Answering (VQA) for Classroom Activity Monitoring","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T11:49:10.964780Z"},"links":{"cited_paper":"/paper/1704.04497","citing_paper":"/paper/2507.22369"},"observation_digest":"sha256:6752058276d4e4f41ff32910c45dcf44853484a236cc4b434bbb69c4bc36ee20","observation_id":"ac41428a-5f73-4398-bab1-b3f81bd8aee1","resolution":{"observed_at":"2026-08-06T11:49:13.071161Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:49:15.997102Z","title":"Tgif-qa: Toward spatio-temporal reasoning in visual question answering,","venue":null,"work_id":"da4a9f39-63b3-4467-ae86-aabe472c45c4","year":2017},"citing_paper":{"arxiv_id":"2507.22369","last_updated":"2025-09-02T02:23:20Z","snapshot_observed_at":"2026-08-10T02:09:40.417957Z","submitted_at":"2025-07-30T04:25:14Z","title":"Exploring the Application of Visual Question Answering (VQA) for Classroom Activity Monitoring","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T11:49:11.139045Z"},"links":{"citing_paper":"/paper/2507.22369"},"observation_digest":"sha256:b088e7df63caddf166f398dfdb97e907853f5e65760203317207600df67d335a","observation_id":"a7c69714-6669-4023-91f3-41fc4f442d8c","resolution":{"observed_at":"2026-08-06T11:49:16.144755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.00451","last_updated":"2021-08-12T15:15:32Z","snapshot_observed_at":"2026-08-08T10:16:24.499212Z","submitted_at":"2020-12-01T12:59:20Z","title":"Just Ask: Learning to Answer Questions from Millions of Narrated Videos","version":3},"cited_work":{"arxiv_id":"2012.00451","doi":null,"metadata_source":"pith","pith_arxiv_id":"2012.00451","snapshot_observed_at":"2026-08-06T11:49:12.825093Z","title":"Just Ask: Learning to Answer Questions from Millions of Narrated Videos","venue":"cs.CV","work_id":"6255b820-2071-4508-9174-1be21a649125","year":2020},"citing_paper":{"arxiv_id":"2507.22369","last_updated":"2025-09-02T02:23:20Z","snapshot_observed_at":"2026-08-10T02:09:40.417957Z","submitted_at":"2025-07-30T04:25:14Z","title":"Exploring the Application of Visual Question Answering (VQA) for Classroom Activity Monitoring","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T11:49:11.284882Z"},"links":{"cited_paper":"/paper/2012.00451","citing_paper":"/paper/2507.22369"},"observation_digest":"sha256:9f4a3c6aa617b50b95fec31ce0c1214c92bdb0a2d43d2c13cb9190cf9a4e5cd3","observation_id":"3f55c5db-20d2-4e66-8dc5-c298322dab9b","resolution":{"observed_at":"2026-08-06T11:49:12.896967Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.02467","last_updated":"2019-06-06T08:08:14Z","snapshot_observed_at":"2026-07-06T07:58:24.206559Z","submitted_at":"2019-06-06T08:08:14Z","title":"ActivityNet-QA: A Dataset for Understanding Complex Web Videos via Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.02467","snapshot_observed_at":"2026-08-06T11:49:11.492167Z","title":"Activitynet-qa: A dataset for understanding complex web videos via question answering,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.22369","last_updated":"2025-09-02T02:23:20Z","snapshot_observed_at":"2026-08-10T02:09:40.417957Z","submitted_at":"2025-07-30T04:25:14Z","title":"Exploring the Application of Visual Question Answering (VQA) for Classroom Activity Monitoring","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T11:49:11.492167Z"},"links":{"cited_paper":"/paper/1906.02467","citing_paper":"/paper/2507.22369"},"observation_digest":"sha256:02bb0df501ebb956df699691fb67dd38be7996c83528627fa0a106a79bcd674b","observation_id":"0a665a11-5416-4657-9207-cc3c57325f73","resolution":{"observed_at":"2026-08-06T11:49:11.492167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.01225","last_updated":"2022-11-02T05:25:06Z","snapshot_observed_at":"2026-07-30T11:11:52.165985Z","submitted_at":"2022-03-02T16:34:09Z","title":"Video Question Answering: Datasets, Algorithms and Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.01225","snapshot_observed_at":"2026-08-06T11:49:11.706652Z","title":"Video question answering: Datasets, algorithms and challenges,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.22369","last_updated":"2025-09-02T02:23:20Z","snapshot_observed_at":"2026-08-10T02:09:40.417957Z","submitted_at":"2025-07-30T04:25:14Z","title":"Exploring the Application of Visual Question Answering (VQA) for Classroom Activity Monitoring","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T11:49:11.706652Z"},"links":{"cited_paper":"/paper/2203.01225","citing_paper":"/paper/2507.22369"},"observation_digest":"sha256:21356555034bf3d0f83542a7053dea9e4ceb37af0bf1b59fd684132ed9821b87","observation_id":"93e3928d-95fa-4a33-b987-0437019a3569","resolution":{"observed_at":"2026-08-06T11:49:11.706652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:49:15.686655Z","title":"Visual question answering: from early developments to recent advances – a survey,","venue":null,"work_id":"ebb57aae-79b4-47b4-b867-e9b510c65cde","year":null},"citing_paper":{"arxiv_id":"2507.22369","last_updated":"2025-09-02T02:23:20Z","snapshot_observed_at":"2026-08-10T02:09:40.417957Z","submitted_at":"2025-07-30T04:25:14Z","title":"Exploring the Application of Visual Question Answering (VQA) for Classroom Activity Monitoring","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T11:49:11.928261Z"},"links":{"citing_paper":"/paper/2507.22369"},"observation_digest":"sha256:15df1051afec51cf0683cb26b539b3980fd8dfbcc5479ee446beb7cd91c78b15","observation_id":"b8dcd05e-2c98-4c7c-b63a-b8e306497127","resolution":{"observed_at":"2026-08-06T11:49:15.831804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:49:15.365167Z","title":"ROUGE: A package for automatic evaluation of summaries,","venue":null,"work_id":"553ca0a0-049b-4d73-b680-14240f58118e","year":2004},"citing_paper":{"arxiv_id":"2507.22369","last_updated":"2025-09-02T02:23:20Z","snapshot_observed_at":"2026-08-10T02:09:40.417957Z","submitted_at":"2025-07-30T04:25:14Z","title":"Exploring the Application of Visual Question Answering (VQA) for Classroom Activity Monitoring","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T11:49:12.241279Z"},"links":{"citing_paper":"/paper/2507.22369"},"observation_digest":"sha256:847afd1f19fc4b26f1550a247f43e8adb2e420dd3bbb98d9bddfbb677cec2877","observation_id":"f3f5dfde-aa62-4a88-8622-969b2d7d29eb","resolution":{"observed_at":"2026-08-06T11:49:15.502193Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:49:15.001878Z","title":"A detailed comparative analysis of automatic neural metrics for machine translation: Bleurt & bertscore,","venue":null,"work_id":"fbf4d394-1061-4974-92f6-261bee0f5783","year":2025},"citing_paper":{"arxiv_id":"2507.22369","last_updated":"2025-09-02T02:23:20Z","snapshot_observed_at":"2026-08-10T02:09:40.417957Z","submitted_at":"2025-07-30T04:25:14Z","title":"Exploring the Application of Visual Question Answering (VQA) for Classroom Activity Monitoring","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T11:49:12.454087Z"},"links":{"citing_paper":"/paper/2507.22369"},"observation_digest":"sha256:9c136d0ed145cc0b980c6357fe52fd91065bbc6ab49770a193d1df1802c8c3a6","observation_id":"b577440f-c4a1-48ba-966a-dd1f5bfe33dc","resolution":{"observed_at":"2026-08-06T11:49:15.155360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03939","last_updated":"2025-01-11T14:21:37Z","snapshot_observed_at":"2026-07-06T20:17:43.203959Z","submitted_at":"2025-01-07T17:00:35Z","title":"Visual question answering: from early developments to recent advances -- a survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03939","snapshot_observed_at":"2026-08-06T11:49:12.091321Z","title":"Available: https://arxiv.org/abs/2501.03939","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22369","last_updated":"2025-09-02T02:23:20Z","snapshot_observed_at":"2026-08-10T02:09:40.417957Z","submitted_at":"2025-07-30T04:25:14Z","title":"Exploring the Application of Visual Question Answering (VQA) for Classroom Activity Monitoring","version":3},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T11:49:12.091321Z"},"links":{"cited_paper":"/paper/2501.03939","citing_paper":"/paper/2507.22369"},"observation_digest":"sha256:a7cf09b3e1dbfdda16193f03fc86b36818cc71819eb825809f327930c0214891","observation_id":"5edc97a2-1a59-45a9-97ed-5f2aef7440ad","resolution":{"observed_at":"2026-08-06T11:49:12.091321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.22369","last_updated":"2025-09-02T02:23:20Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T02:09:40.417957Z","submitted_at":"2025-07-30T04:25:14Z","title":"Exploring the Application of Visual Question Answering (VQA) for Classroom Activity Monitoring"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":0,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":7,"verified_exact":6,"verified_fuzzy":11},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 0 inbound Pith citation observations for arXiv:2507.22369."}