{"as_of":"2026-08-17T02:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ff50589352fd6e8f5f6f4c6369b30d94f4dccb25274b7173183d8290664ebf5d","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T08:21:33.672365Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T14:32:22.347212Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-15T18:16:14.067578Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"cited_work":{"arxiv_id":"2607.06618","doi":"10.48550/arxiv.2607.06618","metadata_source":"pith","pith_arxiv_id":"2607.06618","snapshot_observed_at":"2026-08-15T18:16:14.067578Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","venue":"cs.CV","work_id":"09584f13-f24d-4e63-90c3-fb1783b45b5c","year":2026},"citing_paper":{"arxiv_id":"2608.06869","last_updated":"2026-08-11T08:50:16Z","snapshot_observed_at":"2026-08-16T00:29:47.173165Z","submitted_at":"2026-08-07T06:49:55Z","title":"DAEP: Difficulty-Aware Evidence Planning for Medical Video Corpus Temporal Answer Grounding","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T14:32:22.347212Z"},"links":{"cited_paper":"/paper/2607.06618","citing_paper":"/paper/2608.06869"},"observation_digest":"sha256:d2d47d9a7de59d8941c7752f40792286e448e74e6422b2d65e82fa8b756e4a46","observation_id":"ac4ce9b3-8448-4268-ae44-455a20332776","resolution":{"observed_at":"2026-08-15T14:32:22.547966Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2607.06618/citation-record","integrity":"/paper/2607.06618/integrity","json":"/paper/2607.06618/citation-record.json","paper":"/paper/2607.06618"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:33.513472Z","title":"Transforming surgical training with ai techniques for training, assessment, and evaluation: Scoping review.Journal of Medical Internet Research, 27, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.513472Z"},"links":{"citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:5e8408b60641273a2efdca28f3dde4ffe32220790908afa271e33077dbd2f546","observation_id":"d86354ac-9a92-4078-ab6e-84a1f1ff52b8","resolution":{"observed_at":"2026-08-02T08:21:33.513472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:33.518055Z","title":"Riddle, Divya Kewalramani, Mayur Narayan, and Daniel B","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.518055Z"},"links":{"citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:daf7f8b708ad89f4b1d15e00d9cb3b6ccec2ad7090c4391047e273e846bbec74","observation_id":"920c659c-f819-4e7a-b213-4768c3072e26","resolution":{"observed_at":"2026-08-02T08:21:33.518055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:33.521804Z","title":"The impact of surgical simulation and training technologies on gen- eral surgery education.BMC Medical Education, 24(1):1297, Nov 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.521804Z"},"links":{"citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:aa31be0487da6b57b60668c77d409636d80246559ac9adbd127182d4461117d5","observation_id":"d36bcff7-b905-4b30-8803-6a682564b4b2","resolution":{"observed_at":"2026-08-02T08:21:33.521804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:33.526305Z","title":"The role of online videos in teaching procedural skills in postgraduate medical education: A scoping review.Journal of Surgical Education, 79(5):1295–1307, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.526305Z"},"links":{"citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:e0c81b54f984e994a1a2c154a0a1e200e545083bb7f2bb3e979e9da3854489e6","observation_id":"e31fa633-9f8c-490b-bcf8-ffde7301471b","resolution":{"observed_at":"2026-08-02T08:21:33.526305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:33.530858Z","title":"How to develop an online video for teaching health procedural skills: Tutorial for health educators new to video production.JMIR Medical Education, 10, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.530858Z"},"links":{"citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:212413313ab0b78f9457329f4bf5e360b2d551f194b8a3c98030efe3aad9d957","observation_id":"a5ea86de-8433-4b83-992a-7978414c1715","resolution":{"observed_at":"2026-08-02T08:21:33.530858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:33.535321Z","title":"Miles, Alison Clay, W","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.535321Z"},"links":{"citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:28995ab0450f82c249f13c15f0a22abb2171d679f4c6c88448d3d6ee3f123268","observation_id":"13081ae1-0fe5-4a6c-8f4c-6f7a1eacbed3","resolution":{"observed_at":"2026-08-02T08:21:33.535321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:33.539552Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.539552Z"},"links":{"citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:0133054ae91a19381abc2c37190b338f5b9c84815b7548ff3311885e28c043ec","observation_id":"dea89931-2c6b-42d4-95ad-007a4055b343","resolution":{"observed_at":"2026-08-02T08:21:33.539552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:33.543449Z","title":"Visual answer localization with cross-modal mutual knowledge transfer, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.543449Z"},"links":{"citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:2e0450269b74a3605c7edb246c78fafa2215eb2b8f117056f8fc3c7de59c4040","observation_id":"a6f5c70e-c050-4b47-a323-e6e1ed57488c","resolution":{"observed_at":"2026-08-02T08:21:33.543449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:33.547624Z","title":"Towards visual-prompt temporal answer grounding in instructional video.IEEE Transactions on Pattern Analysis and Machine Intelligence, 46(12):8836–8853, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.547624Z"},"links":{"citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:ca1038ae8e4e8564f11bdb82989cad467061a018dfc859ca0b0706af5482e037","observation_id":"f0605d5e-cf6d-4977-a613-9a661ae35d3f","resolution":{"observed_at":"2026-08-02T08:21:33.547624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:33.551614Z","title":"Overview of the nlpcc 2023 shared task: Chinese medical instructional video question answering","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.551614Z"},"links":{"citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:49627c97a334b77c205f64600143c2305437330908f8db18abb0d86ae4acdb21","observation_id":"786b35ca-a1aa-409c-b57c-e0a381e32547","resolution":{"observed_at":"2026-08-02T08:21:33.551614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:33.554687Z","title":"Overview of the nlpcc 2024 shared task 7: Multi-lingual medical instructional video question answering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.554687Z"},"links":{"citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:9a26154e2c417a02c8c86f0dffe569538094f936e1969ce5b6334562868a7218","observation_id":"de61f89e-7354-41e0-a8aa-3acb8443aa98","resolution":{"observed_at":"2026-08-02T08:21:33.554687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:33.561873Z","title":"Overview of the nlpcc 2025 shared task 4: Multi-modal, multilingual, and multi- hop medical instructional video question answering challenge","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.561873Z"},"links":{"citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:5ecc8005650853f2b45d0cbc90daad1c05187d76fae530e8f6b12a4ede9ba674","observation_id":"1c9842a5-1546-456c-9e87-bfcfb57c7e0f","resolution":{"observed_at":"2026-08-02T08:21:33.561873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:33.565247Z","title":"M3-med: A benchmark for multi-lingual, multi- modal, and multi-hop reasoning in medical instructional video understanding, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.565247Z"},"links":{"citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:1ba83a810490852325b2afeab82f503b2cdbd2ca26068f103f373e612cc73108","observation_id":"b33aa6ae-9b0e-4e92-8026-0d9e56278a3c","resolution":{"observed_at":"2026-08-02T08:21:33.565247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:33.569005Z","title":"A uni- fied framework for optimizing video corpus retrieval and temporal answer ground- ing: Fine-grained modality alignment and local-global optimization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.569005Z"},"links":{"citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:0f57508f3abd8f35be67a39ddbe8491120e138dd8828ac248d833648658672c5","observation_id":"9a2400c5-c9ed-4457-ab47-2f5663211437","resolution":{"observed_at":"2026-08-02T08:21:33.569005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:33.572501Z","title":"Videocorpusmomentretrievalwithcontrastivelearning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.572501Z"},"links":{"citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:f5d2b930eac5d1b2607fa01b23561256744c4ead6bf23ce256281e08ba39012e","observation_id":"44771e4f-6f22-4cc3-aa03-02cfa4e30308","resolution":{"observed_at":"2026-08-02T08:21:33.572501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:33.575967Z","title":"Assessing modality bias in video question answering benchmarks with multimodal large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.575967Z"},"links":{"citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:7f9270a4693db9aa23fd9f25da76c5e3c0ff7a5ba82e095fcbc11160cb23b125","observation_id":"ef9b74c2-e0df-4465-b425-232ae214b43c","resolution":{"observed_at":"2026-08-02T08:21:33.575967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:33.579515Z","title":"Video question answering: Datasets, algorithms and challenges, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.579515Z"},"links":{"citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:ceb48b9cc92a2a26f5c9aec9a2b9423d1d04506461ba1c2d1480fcccf4a336ba","observation_id":"e6c25894-cb8e-4499-9dd5-441b439fdc7e","resolution":{"observed_at":"2026-08-02T08:21:33.579515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:33.583148Z","title":"Tips for teaching procedural skills.BMC Medical Education, 20(2):458, Dec 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.583148Z"},"links":{"citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:a195f0ed9da31be91967e20757b0b3f35fc324f433ab7753d91f6e3ea5aca786","observation_id":"a9dcd328-f608-442d-a904-60719d6ced7d","resolution":{"observed_at":"2026-08-02T08:21:33.583148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:33.586249Z","title":"Use of videos by health care professionals for procedure support in acute cardiac care: A scoping review.Heart, Lung and Circulation, 32(2):143–155, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.586249Z"},"links":{"citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:b05e5809d0c85648617bbfb0a98ccbe289e3b876d75e2dceda382cc5408ec029","observation_id":"2a1d10a5-7340-462f-affa-d12ae2e179c7","resolution":{"observed_at":"2026-08-02T08:21:33.586249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:33.590895Z","title":"Time- craft:&nbsp;navigate weakly-supervised temporal grounded video question answer- ing via&nbsp;bi-directional reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.590895Z"},"links":{"citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:ed2e8aff4436fb92a7467ee56029e51774a29cf83e0b6703f8c13bbd7f6f0cc4","observation_id":"9f79058b-9005-4052-a774-95ca1c5732ba","resolution":{"observed_at":"2026-08-02T08:21:33.590895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:33.595266Z","title":"Gustafson, Nicholas A","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.595266Z"},"links":{"citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:45c1964ce1aa6dfebfb96b8c710d654f31dde839ef9c387f0aefcdea4b4e4250","observation_id":"38e47723-8ee9-4af9-a808-db0c5a46a151","resolution":{"observed_at":"2026-08-02T08:21:33.595266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12763","last_updated":"2024-12-19T19:37:44Z","snapshot_observed_at":"2026-08-16T13:24:27.681059Z","submitted_at":"2024-08-22T23:32:42Z","title":"Assessing Modality Bias in Video Question Answering Benchmarks with Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12763","snapshot_observed_at":"2026-08-02T08:21:33.599883Z","title":"Assessing modality bias in video question answering benchmarks with multimodal large language models.ArXiv, abs/2408.12763, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.599883Z"},"links":{"cited_paper":"/paper/2408.12763","citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:1f23ed133a2842bfaeffa3ecc3b852942ecdd5ebb755b28ff23450eba5872d63","observation_id":"6f42a2d9-c7ed-425c-b2d5-8516c60b9407","resolution":{"observed_at":"2026-08-02T08:21:33.599883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:33.604395Z","title":"TVQA+: Spatio-temporal grounding for video question answering","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.604395Z"},"links":{"citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:2d14de6fdf092948e241f5eee6af0e695192228a89f12486808e78a879e55ea8","observation_id":"c9089ed8-d729-47b6-a22f-d1e282c990b2","resolution":{"observed_at":"2026-08-02T08:21:33.604395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:33.608301Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.608301Z"},"links":{"citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:7043b20f7534ac086c0e2bb0ddd53740108f2cc53c6732ef87af57fbbdc1ab52","observation_id":"ca964e5f-cb0a-402e-848c-766e47c42145","resolution":{"observed_at":"2026-08-02T08:21:33.608301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:33.612150Z","title":"A dataset for medical in- structional video classification and question answering.Scientific Data, 10(1):158, Mar 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.612150Z"},"links":{"citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:897f0e7bde14fa7275889c9ccab772594ab03eebecef237f311aded5d2b46355","observation_id":"1e2af2bc-294b-4b6c-8894-c8245b67de5e","resolution":{"observed_at":"2026-08-02T08:21:33.612150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:33.616464Z","title":"Med- craft: Automated construction of interpretable and multi-hop video workloads via knowledge graph traversal, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.616464Z"},"links":{"citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:358c202bd74e8ecd93d12c0b6b7018df6e9bd53c10f5f0a6d3f32c88ea886709","observation_id":"205349b6-dbbc-49db-a6b5-d98f87fdc367","resolution":{"observed_at":"2026-08-02T08:21:33.616464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:33.627416Z","title":"Qwen3.5: Accelerating productivity with native multimodal agents, February 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.627416Z"},"links":{"citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:67e834ea9db594e6062bd1aee4b8652a12076a36af41fdd3cc1602244a29f9e7","observation_id":"446466bd-e7f4-4218-bac4-9844ce32f2d6","resolution":{"observed_at":"2026-08-02T08:21:33.627416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:33.631298Z","title":"Visual answer localization with cross-modal mutual knowledge transfer","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.631298Z"},"links":{"citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:a2ad4c54ffbf6628809ed6b24d8e038bdc83c705ee8b78c8dd42070cc18705fd","observation_id":"30839044-0677-4301-927b-6de889b3363a","resolution":{"observed_at":"2026-08-02T08:21:33.631298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:33.635276Z","title":"Improving multilingualtemporalansweringgroundinginsinglevideoviallm-basedtranslation and ocr enhancement","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.635276Z"},"links":{"citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:5d59a1993b7b10a616d6091680ce0cc8aefe2dc5e4d48a5c612e376b8f93957d","observation_id":"bfbb05d0-3e4e-46a2-9319-3ecadc7e3948","resolution":{"observed_at":"2026-08-02T08:21:33.635276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:33.638433Z","title":"Improv- ing cross-modal visual answer localization in chinese medical instructional video using language prompts","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.638433Z"},"links":{"citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:da49cdf74360032563436f8e900349df488b180d5f891f2f0394dd8066becc64","observation_id":"e054ca09-85e3-492a-ab3c-583c61cacb2e","resolution":{"observed_at":"2026-08-02T08:21:33.638433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:33.642033Z","title":"Overview of the nlpcc 2023 shared task:Chinesemedicalinstructionalvideoquestionanswering","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.642033Z"},"links":{"citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:cb8a9e4f4d94b3f63d1ad92aa6a6944f4e250df2599d9db0f23facac9c495e20","observation_id":"58c8e4a6-58ba-455d-a67c-be40375d8531","resolution":{"observed_at":"2026-08-02T08:21:33.642033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:33.646079Z","title":"Hierarchical indexing with knowledge en- richment for multilingual video corpus retrieval","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.646079Z"},"links":{"citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:4db421b8eb0a97a0c901636fe0555eed7215181a4db1dcff5e67a281f0123eb2","observation_id":"91ba161c-c8fb-4a3b-9674-d2cb67d421db","resolution":{"observed_at":"2026-08-02T08:21:33.646079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:33.650776Z","title":"Mqua: Multi-level query-video augmentation for multilingual video corpus retrieval","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.650776Z"},"links":{"citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:9f63c382a109c3a5da039bffcdedb6e683bce82559b07f6526ecbad91b499576","observation_id":"a8886300-6561-4963-8e3c-5f6f06f22f99","resolution":{"observed_at":"2026-08-02T08:21:33.650776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:33.655135Z","title":"A two-stage chinese medical video retrieval framework with llm","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.655135Z"},"links":{"citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:6fc21103ee0b206334090203a2e84e889eb316e8d9d0a66e30979636e9076b11","observation_id":"dcb540f4-7a06-46fd-bc01-d0fedfa413e8","resolution":{"observed_at":"2026-08-02T08:21:33.655135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:33.659963Z","title":"Mul- tilingual temporal answer grounding in video corpus with enhanced visual-textual integration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.659963Z"},"links":{"citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:0d916e2f8eac47ac2e145ee5205cce0e251029377e7b9faffa38cb85aaab5f20","observation_id":"4a5911ad-653e-41ab-b76b-a804de57416b","resolution":{"observed_at":"2026-08-02T08:21:33.659963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:33.668562Z","title":"Multi-hop knowledge-enhanced query reasoning for multi-modal medical video qa","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.668562Z"},"links":{"citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:2323d860fcdb1eabf37bbb0f33fc15f8ae03d4e82e572cb97ccf33c396b75561","observation_id":"28983947-7f18-4afc-8af4-9e8353ca4819","resolution":{"observed_at":"2026-08-02T08:21:33.668562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:33.672365Z","title":"A uni- fied framework for optimizing video corpus retrieval and temporal answer ground- ing: fine-grained modality alignment and local-global optimization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.672365Z"},"links":{"citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:cbaf3d4a8df950e269ad9035b8fb36617befedf99172632fc02ac7f77fc2f2c5","observation_id":"085bfacb-ef7c-4fdc-8e98-0886a9657509","resolution":{"observed_at":"2026-08-02T08:21:33.672365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:33.558510Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:33.558510Z"},"links":{"citing_paper":"/paper/2607.06618"},"observation_digest":"sha256:01f113f04262b8a0dff469cf79fa36126fb961934e2e376601b90d7b7705ad3b","observation_id":"bb67e973-78a2-4392-a929-010c334a3e50","resolution":{"observed_at":"2026-08-02T08:21:33.558510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.06618","last_updated":"2026-07-20T08:55:18Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-05T20:13:23.636137Z","submitted_at":"2026-07-07T09:24:48Z","title":"Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":38,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 1 inbound Pith citation observation for arXiv:2607.06618."}