{"as_of":"2026-08-13T10:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:197f2b8dc0734f03fcb0e48d30421229f3e8df3aa2288f40e836c14ae3d691a0","coverage":[{"denominator":60,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":60,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T23:51:14.742680Z","state":"measured"},{"denominator":63,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":63,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T16:55:35.743040Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T00:57:30.210583Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"cited_work":{"arxiv_id":"2412.02186","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.02186","snapshot_observed_at":"2026-07-03T00:57:30.210583Z","title":"VideoICL: Confidence-based iterative in-context learning for out-of-distribution video understanding","venue":null,"work_id":"5fc1c440-17b4-463e-986b-7fb83fc3443d","year":2024},"citing_paper":{"arxiv_id":"2605.02834","last_updated":"2026-05-05T09:59:53Z","snapshot_observed_at":"2026-08-07T22:39:16.868213Z","submitted_at":"2026-05-04T17:11:16Z","title":"VideoNet: A Large-Scale Dataset for Domain-Specific Action Recognition","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-08T18:35:48.379198Z"},"links":{"cited_paper":"/paper/2412.02186","citing_paper":"/paper/2605.02834"},"observation_digest":"sha256:a68749ebe9b3cd4d571c2e65cdec22d2ea4557b042824870d2ff730350449dbe","observation_id":"a7728b32-a7da-4a48-9291-08521a020d2d","resolution":{"observed_at":"2026-05-09T06:20:41.154852Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"cited_work":{"arxiv_id":"2412.02186","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.02186","snapshot_observed_at":"2026-07-03T00:57:30.210583Z","title":"VideoICL: Confidence-based iterative in-context learning for out-of-distribution video understanding","venue":null,"work_id":"5fc1c440-17b4-463e-986b-7fb83fc3443d","year":2024},"citing_paper":{"arxiv_id":"2605.10936","last_updated":"2026-05-11T17:59:17Z","snapshot_observed_at":"2026-08-11T01:45:29.741032Z","submitted_at":"2026-05-11T17:59:17Z","title":"Personal Visual Context Learning in Large Multimodal Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-12T03:42:15.402131Z"},"links":{"cited_paper":"/paper/2412.02186","citing_paper":"/paper/2605.10936"},"observation_digest":"sha256:7b2f5d11427e17579ec849482e20137e9339d21c61826caa184888e80e7fd3ea","observation_id":"90b8d5ec-f23a-4b42-bb89-f047dff6be94","resolution":{"observed_at":"2026-05-12T07:06:37.273682Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"cited_work":{"arxiv_id":"2412.02186","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.02186","snapshot_observed_at":"2026-07-03T00:57:30.210583Z","title":"VideoICL: Confidence-based iterative in-context learning for out-of-distribution video understanding","venue":null,"work_id":"5fc1c440-17b4-463e-986b-7fb83fc3443d","year":2024},"citing_paper":{"arxiv_id":"2606.09181","last_updated":"2026-06-08T08:20:42Z","snapshot_observed_at":"2026-07-06T23:48:35.190418Z","submitted_at":"2026-06-08T08:20:42Z","title":"Counterfactual Reasoning for Fine-Grained Evidence Disentanglement in VideoQA","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-27T16:55:35.743040Z"},"links":{"cited_paper":"/paper/2412.02186","citing_paper":"/paper/2606.09181"},"observation_digest":"sha256:36e6c21091af712c23516f9f9f262e378987e5e4987d967be41f7253de06a404","observation_id":"e2a0e597-70e2-429d-bb1d-f593f41581e0","resolution":{"observed_at":"2026-07-03T00:57:30.212175Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.02186/citation-record","integrity":"/paper/2412.02186/integrity","json":"/paper/2412.02186/citation-record.json","paper":"/paper/2412.02186"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.11018","last_updated":"2024-10-17T17:45:09Z","snapshot_observed_at":"2026-08-13T00:28:39.359814Z","submitted_at":"2024-04-17T02:49:26Z","title":"Many-Shot In-Context Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.11018","snapshot_observed_at":"2026-08-11T23:51:14.424206Z","title":"Many-shot in-context learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.424206Z"},"links":{"cited_paper":"/paper/2404.11018","citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:2f40c1e4ee8594be2e1e727af001588f8d9293c4e8d119897c9af880cbec1302","observation_id":"571d9ada-efa4-413d-aee3-db6433039085","resolution":{"observed_at":"2026-08-11T23:51:14.424206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:51:14.430263Z","title":"Flamingo: a visual language model for few-shot learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.430263Z"},"links":{"citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:c5242f433dc4489bdb505fce336b1337e3919e2ec4b116b29022cee4de5ce793","observation_id":"e47c8b24-a67f-4591-9381-d5f344352b46","resolution":{"observed_at":"2026-08-11T23:51:14.430263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:51:16.038235Z","title":"The Internal State of an LLM Knows When It’s Lying","venue":null,"work_id":"3aa2d28f-0803-45d0-875b-bcb9ff5bef10","year":2023},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.435374Z"},"links":{"citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:838b24fbc41a9c8d4ced86d0982c0db99efc76a287f98ac185da197fc6bf2633","observation_id":"33426ff5-1c28-4759-a1d7-684092f572f7","resolution":{"observed_at":"2026-08-11T23:51:16.043963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:51:16.018571Z","title":"What makes multimodal in-context learning work? In Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) Workshops, pages 1539–1550, 2024","venue":null,"work_id":"d7fc52a4-5470-4e35-91bb-b26ea4ffb59d","year":2024},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.440438Z"},"links":{"citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:33b7224155fea345e153ad85bf20b0ea634cc00aadf5cf87e847dfb76ca6a2b5","observation_id":"f31be695-0c92-41b1-a431-4a1cd0c933d5","resolution":{"observed_at":"2026-08-11T23:51:16.024541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:51:15.998370Z","title":"Capera: Captioning events in aerial videos","venue":null,"work_id":"23baa58b-4890-474b-96cd-6c0464a79b8a","year":2023},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.445729Z"},"links":{"citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:2df43157e0c7a35ef10906e7fe980611ccfcc70711b087bf6920a451cccf8a8c","observation_id":"3000c2ad-479f-4229-90cd-8e93ba1caf01","resolution":{"observed_at":"2026-08-11T23:51:16.005161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00200","last_updated":"2025-03-03T19:53:28Z","snapshot_observed_at":"2026-08-13T00:18:01.568235Z","submitted_at":"2024-04-30T21:06:52Z","title":"In-Context Learning with Long-Context Models: An In-Depth Exploration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00200","snapshot_observed_at":"2026-08-11T23:51:14.451019Z","title":"In-context learn- ing with long-context models: An in-depth exploration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.451019Z"},"links":{"cited_paper":"/paper/2405.00200","citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:253fb7427b3536b5de3576752e1714c61350b5c7b510ac5d8276cebca2b5e06e","observation_id":"8655438b-64f3-45f2-91b0-76a5803b0250","resolution":{"observed_at":"2026-08-11T23:51:14.451019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:51:14.456647Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.456647Z"},"links":{"citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:d7a70b590acecc34ba5b7c372292fb01e9c79327d95b14d018940f7559726d8e","observation_id":"ee3543f8-7fc9-4aa6-9745-3bbdb8eb4e3d","resolution":{"observed_at":"2026-08-11T23:51:14.456647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:51:15.967325Z","title":"Understanding and im- proving in-context learning on vision-language models","venue":null,"work_id":"86ce9d15-e2ad-4c56-a027-edf7c8c398b1","year":2024},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.462278Z"},"links":{"citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:2107caa5516ad1c07baf5a8901b23b905a4b463d41061c0ca6c1b419e7e7e2f3","observation_id":"82644989-1306-45ca-be67-c56ef8439b7d","resolution":{"observed_at":"2026-08-11T23:51:15.973461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:51:15.948955Z","title":"Mmict: Boosting multi- modal fine-tuning with in-context examples","venue":null,"work_id":"a9a12e49-6ddc-4a5e-966e-6ecbb17b4845","year":2024},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.466947Z"},"links":{"citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:f407e6d1a356e0a3c67490a7e53a1b47485f5479cefd6cd9d19daf895e6193e3","observation_id":"f1548042-8d3a-451f-9496-311d957d6ac3","resolution":{"observed_at":"2026-08-11T23:51:15.954702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:51:15.931687Z","title":"Learning to retrieve iteratively for in-context learning","venue":null,"work_id":"be127f8b-650b-4418-bbfb-ed58e459f37c","year":2024},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.471843Z"},"links":{"citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:0c9d156c86af8613636a3c30960eaad38a7a219632bb3eb02998599bd7e1f643","observation_id":"fa70ddb4-8f31-4b81-9b25-cc5f0a1962e0","resolution":{"observed_at":"2026-08-11T23:51:15.937127Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07476","last_updated":"2024-10-30T06:49:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-11T17:22:23Z","title":"VideoLLaMA 2: Advancing Spatial-Temporal Modeling and Audio Understanding in Video-LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07476","snapshot_observed_at":"2026-08-11T23:51:14.477210Z","title":"Videollama 2: Advancing spatial- temporal modeling and audio understanding in video-llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.477210Z"},"links":{"cited_paper":"/paper/2406.07476","citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:d3c8a7738428cdf3cce880e2a314bc63f975649053bedbfbbe758a2b42fc0601","observation_id":"a63fb2ee-c1c2-4ce4-a031-02c78c5757f2","resolution":{"observed_at":"2026-08-11T23:51:14.477210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00367","last_updated":"2024-07-01T01:34:09Z","snapshot_observed_at":"2026-08-13T04:29:31.110557Z","submitted_at":"2024-02-01T06:11:49Z","title":"Don't Hallucinate, Abstain: Identifying LLM Knowledge Gaps via Multi-LLM Collaboration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00367","snapshot_observed_at":"2026-08-11T23:51:14.482501Z","title":"Don’t hallucinate, abstain: Identifying llm knowledge gaps via multi-llm col- laboration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.482501Z"},"links":{"cited_paper":"/paper/2402.00367","citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:0065c9cab4fcc2048edffb08dba8e3435c8ee923cce7ff1bc740039e325c7a2e","observation_id":"7c8af262-f323-4d8c-8962-4287cfe170a1","resolution":{"observed_at":"2026-08-11T23:51:14.482501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.21075","last_updated":"2025-05-30T13:08:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-31T17:59:47Z","title":"Video-MME: The First-Ever Comprehensive Evaluation Benchmark of Multi-modal LLMs in Video Analysis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.21075","snapshot_observed_at":"2026-08-11T23:51:14.487621Z","title":"Video-mme: The first-ever comprehensive evaluation benchmark of multi-modal llms in video analysis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.487621Z"},"links":{"cited_paper":"/paper/2405.21075","citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:ae254ccb9c9f688e8d16e4a1a93f95bce7aee703efba33bea515e1466653c84b","observation_id":"dab4aa2f-36ba-4c70-83a7-ca3c7d0a3ec9","resolution":{"observed_at":"2026-08-11T23:51:14.487621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07588","last_updated":"2024-06-30T18:19:25Z","snapshot_observed_at":"2026-08-12T23:45:47.625317Z","submitted_at":"2024-06-11T08:12:43Z","title":"AIM: Let Any Multi-modal Large Language Models Embrace Efficient In-Context Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07588","snapshot_observed_at":"2026-08-11T23:51:14.493064Z","title":"Aim: Let any multi-modal large language mod- els embrace efficient in-context learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.493064Z"},"links":{"cited_paper":"/paper/2406.07588","citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:b5fe396c86b3d70980d4d827881f67818752bc5203aee5b6e49a6b8b79e6e287","observation_id":"2f78e198-0ccd-4c71-a409-8ae6baf53d97","resolution":{"observed_at":"2026-08-11T23:51:14.493064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:51:15.914625Z","title":"Weinberger","venue":null,"work_id":"f2849463-f295-4120-9edc-911a073224ad","year":2017},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.498535Z"},"links":{"citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:c4629f7bfd456b99ca7242f88a8f9c588c0859e907375796027887bc4d9bf3c0","observation_id":"bcf62a95-fa19-4264-965c-386a44b6ccae","resolution":{"observed_at":"2026-08-11T23:51:15.919967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:51:15.894944Z","title":"How well does GPT-4v(ision) adapt to distribution shifts? a preliminary investigation","venue":null,"work_id":"e5637d63-8be0-46fd-8bdf-26800a7c5e76","year":2024},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.503179Z"},"links":{"citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:575968ce4df9bbc928d2f62a61f2491965b5955a984a5ab6740a1cd3cb1c1c49","observation_id":"42a85aca-2d02-4db1-b09a-1cb6e1fa9c68","resolution":{"observed_at":"2026-08-11T23:51:15.901497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:51:15.876868Z","title":"Pitvqa: Image-grounded text embedding llm for visual question answering in pitu- itary surgery","venue":null,"work_id":"ad342819-7ce0-49c7-8085-389510338549","year":2024},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.509300Z"},"links":{"citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:791e666a05c335eb8c1827e36589ebc9558b23511e33f61f0eba44728f23fa14","observation_id":"db435614-fb1b-4f4e-8870-c915208545e7","resolution":{"observed_at":"2026-08-11T23:51:15.883044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:51:14.514432Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen- Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.514432Z"},"links":{"citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:6ca63cefabe3a7f7bedfd3ead722b7a2740a48c62a77dbab60ef90bc75af2dd6","observation_id":"504544ab-74df-4598-93d0-4d31396b693a","resolution":{"observed_at":"2026-08-11T23:51:14.514432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05232","last_updated":"2024-11-19T12:42:45Z","snapshot_observed_at":"2026-07-06T16:45:07.733095Z","submitted_at":"2023-11-09T09:25:37Z","title":"A Survey on Hallucination in Large Language Models: Principles, Taxonomy, Challenges, and Open Questions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05232","snapshot_observed_at":"2026-08-11T23:51:14.526422Z","title":"A survey on hallucination in large language models: Principles, tax- onomy, challenges, and open questions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.526422Z"},"links":{"cited_paper":"/paper/2311.05232","citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:e657ad30fc4bf64e35826b47bbc2781c42d20a3aadd4f78f21357d402d34268c","observation_id":"3970faac-4f6e-4c54-86b0-060254f2a212","resolution":{"observed_at":"2026-08-11T23:51:14.526422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.10236","last_updated":"2025-01-05T06:15:04Z","snapshot_observed_at":"2026-08-10T02:33:11.935041Z","submitted_at":"2023-07-16T08:28:04Z","title":"Look Before You Leap: An Exploratory Study of Uncertainty Measurement for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.10236","snapshot_observed_at":"2026-08-11T23:51:14.531598Z","title":"Look before you leap: An exploratory study of uncertainty measurement for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.531598Z"},"links":{"cited_paper":"/paper/2307.10236","citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:0d758bdd357976ecb8c7e148bca34b25df6952191e7255b9d6040bb0e17b9f3c","observation_id":"864c8ac3-f57e-4fd3-badf-2acae5754f66","resolution":{"observed_at":"2026-08-11T23:51:14.531598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:51:15.842693Z","title":null,"venue":null,"work_id":"9b3f7ea0-f7f9-47bc-8938-0a93ba089c27","year":2024},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.537478Z"},"links":{"citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:c8c131174ef6f05b2bc37b55da6fd741b007f8e66d5cad557d5960f9b616ac15","observation_id":"61478545-56a7-4cb3-8b02-75b7f09e2e4e","resolution":{"observed_at":"2026-08-11T23:51:15.848646Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05221","last_updated":"2022-11-21T16:38:35Z","snapshot_observed_at":"2026-08-12T15:27:25.451283Z","submitted_at":"2022-07-11T22:59:39Z","title":"Language Models (Mostly) Know What They Know","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.05221","snapshot_observed_at":"2026-08-11T23:51:14.542704Z","title":"Language models (mostly) know what they know","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.542704Z"},"links":{"cited_paper":"/paper/2207.05221","citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:b25016a4118b2814d936d9abb877eec23214518201b80bc8316584c8e6d9e7c3","observation_id":"e2aa7efa-c620-4152-9fd9-fa0620b8ca96","resolution":{"observed_at":"2026-08-11T23:51:14.542704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03690","last_updated":"2024-05-08T19:46:35Z","snapshot_observed_at":"2026-08-13T00:13:45.068101Z","submitted_at":"2024-05-06T17:59:45Z","title":"How Good is my Video LMM? Complex Video Reasoning and Robustness Evaluation Suite for Video-LMMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03690","snapshot_observed_at":"2026-08-11T23:51:14.548402Z","title":"Complex video rea- soning and robustness evaluation suite for video-lmms.arXiv preprint arXiv:2405.03690, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.548402Z"},"links":{"cited_paper":"/paper/2405.03690","citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:dbd47932d43a65d47481da610ae32050b76ba3349128b85de9cd10de83019232","observation_id":"375bf7bb-c4e3-4eba-9375-9a88f36604b4","resolution":{"observed_at":"2026-08-11T23:51:14.548402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:51:15.823923Z","title":"Confidence under the hood: An in- vestigation into the confidence-probability alignment in large language models","venue":null,"work_id":"e9bb5d07-d63c-448d-8c05-06685177c9f3","year":2024},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.553667Z"},"links":{"citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:fa163ff3f5adfa4ce65fa63c73d29a4c1478313d14accda3d5a8901491d6b80e","observation_id":"c1fdd8d8-a53b-4420-9e14-93c13df9f5f5","resolution":{"observed_at":"2026-08-11T23:51:15.829784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16125","last_updated":"2023-08-02T08:02:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-30T04:25:16Z","title":"SEED-Bench: Benchmarking Multimodal LLMs with Generative Comprehension","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.16125","snapshot_observed_at":"2026-08-11T23:51:14.559194Z","title":"Seed-bench: Benchmarking mul- timodal llms with generative comprehension","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.559194Z"},"links":{"cited_paper":"/paper/2307.16125","citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:03216c737240c6aa6f163432836089669c49cd94962c9836345c144681ac48f6","observation_id":"f80988a6-f330-4a3a-9922-fc1b8fdabbca","resolution":{"observed_at":"2026-08-11T23:51:14.559194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05425","last_updated":"2023-06-08T17:59:56Z","snapshot_observed_at":"2026-08-13T06:22:02.817676Z","submitted_at":"2023-06-08T17:59:56Z","title":"MIMIC-IT: Multi-Modal In-Context Instruction Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05425","snapshot_observed_at":"2026-08-11T23:51:14.564829Z","title":"Mimic- it: Multi-modal in-context instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.564829Z"},"links":{"cited_paper":"/paper/2306.05425","citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:2e6b9ca79ae906faa8dd7e4574f4471e25e9510fa2fc2b208811e711727f2d79","observation_id":"6495a6b6-7781-4c06-bf5e-08b541625e84","resolution":{"observed_at":"2026-08-11T23:51:14.564829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.03726","last_updated":"2025-07-28T05:33:36Z","snapshot_observed_at":"2026-07-06T15:23:52.761222Z","submitted_at":"2023-05-05T17:59:46Z","title":"Otter: A Multi-Modal Model with In-Context Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.03726","snapshot_observed_at":"2026-08-11T23:51:14.570356Z","title":"Otter: A Multi- Modal Model with In-Context Instruction Tuning, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.570356Z"},"links":{"cited_paper":"/paper/2305.03726","citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:b133cb35cc453524b36a2d4b9acffba825e1ebad7247a6788824a37cecd8d3f5","observation_id":"258063b0-5951-40f0-98f3-28390500df8f","resolution":{"observed_at":"2026-08-11T23:51:14.570356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:51:14.575466Z","title":"Sports-qa: A large-scale video question answering bench- mark for complex and professional sports","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.575466Z"},"links":{"citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:95261ce2ba7331ddcf54121dc6ec3ff7b6147ba7bf4bd4b7f226b5135ef97971","observation_id":"91b4ecd1-b7fb-462b-a482-d877b727e94d","resolution":{"observed_at":"2026-08-11T23:51:14.575466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:51:15.802112Z","title":"Inference-time intervention: Elic- iting truthful answers from a language model","venue":null,"work_id":"5c57e31c-e57d-4c96-a681-414ded114124","year":2023},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.580480Z"},"links":{"citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:414ea4e436e2665c4f7410487c4a7bab265f2554d0aac37f26b1c58180bfe156","observation_id":"60bb38e6-2b8d-449f-a3d6-ad47ab765ad8","resolution":{"observed_at":"2026-08-11T23:51:15.809890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:51:15.784895Z","title":"Mvbench: A comprehensive multi- modal video understanding benchmark","venue":null,"work_id":"8fa0d7bf-d4af-4ca1-b6ca-d8b873cfc385","year":2024},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.585269Z"},"links":{"citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:8f876fea1d2ab97918c3e79f7de8bb0d68bc8b1badebd313f5322a4ca893ba2f","observation_id":"06fa6ffc-64dd-40ed-b4fa-34ec3e5a0151","resolution":{"observed_at":"2026-08-11T23:51:15.790084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:51:15.768716Z","title":"How to configure good in-context sequence for vi- sual question answering","venue":null,"work_id":"cea2498b-436e-453c-af57-af583a7bbd07","year":2024},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.590480Z"},"links":{"citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:d5d943f7cfe4e5f8b46cff5d9b4ddf8ddb1d2eff0734365639d1d11436cb15c0","observation_id":"4a89e339-044f-4ab6-ade5-500e47ce825e","resolution":{"observed_at":"2026-08-11T23:51:15.773944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:51:15.752574Z","title":"Teaching Models to Express Their Uncertainty in Words.Transactions on Machine Learning Research, 2022","venue":null,"work_id":"c3d69e0d-8a7f-4e91-9285-50cf37eda6cf","year":2022},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.595521Z"},"links":{"citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:1abf1ee75f1b6094abd82e7cd4cdaac466689ee743f893c98e82d7c5f0365d43","observation_id":"767d76c1-ffb4-4d80-8dae-fab78d8f0b50","resolution":{"observed_at":"2026-08-11T23:51:15.758154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:51:15.735948Z","title":"se2: Se- quential example selection for in-context learning","venue":null,"work_id":"f276e552-6018-4f90-ad1c-00e9735ef9fb","year":2024},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.600669Z"},"links":{"citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:d79643d916c6cee8acc0076dccb6ce144276db50e440b472bc0c0bed55b339b1","observation_id":"bb12d7a7-39a1-4c44-8b6a-e77ffad36758","resolution":{"observed_at":"2026-08-11T23:51:15.741506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12961","last_updated":"2025-02-27T06:09:46Z","snapshot_observed_at":"2026-08-12T22:41:32.229292Z","submitted_at":"2024-09-19T17:59:51Z","title":"Oryx MLLM: On-Demand Spatial-Temporal Understanding at Arbitrary Resolution","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12961","snapshot_observed_at":"2026-08-11T23:51:14.607317Z","title":"Oryx mllm: On-demand spatial-temporal understanding at arbitrary resolution","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.607317Z"},"links":{"cited_paper":"/paper/2409.12961","citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:ac4993f44e70abc5cbf8475fafaf4250a33002ac8b724e794f2fcf3559090863","observation_id":"438170e9-4897-429d-99a3-811a3693fd8b","resolution":{"observed_at":"2026-08-11T23:51:14.607317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:51:15.717164Z","title":"Factual Con- fidence of LLMs: on Reliability and Robustness of Current Estimators","venue":null,"work_id":"29971126-af35-4338-baf0-b59594d38d0a","year":2024},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.613427Z"},"links":{"citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:669c36758de216b0db038ab6e8a9fc2a801ac83d942cb982052e9e0b4e0ebbe1","observation_id":"a7f95e16-6273-416c-8332-f42adac9c9c8","resolution":{"observed_at":"2026-08-11T23:51:15.724043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:51:15.698874Z","title":"Lingoqa: Visual question answering for autonomous driv- ing","venue":null,"work_id":"e9965e90-4cc9-4940-a8ce-38e7b378d7e1","year":2024},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.618912Z"},"links":{"citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:b01fdbf74b6405277df87ef0e8ffb8f29818b4fe4baa97491e31f38456738a1d","observation_id":"e1f1f03f-6b27-4f62-90f9-ac8275618929","resolution":{"observed_at":"2026-08-11T23:51:15.704720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:51:15.680003Z","title":"Drive&act: A multi-modal dataset for fine-grained driver be- havior recognition in autonomous vehicles","venue":null,"work_id":"ac93bef5-949b-4d94-9ffd-247578d72560","year":2019},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.623845Z"},"links":{"citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:826b6700eb3124bada0b21dca72f52a4b3ce60b6653f92921d630fd5cf0194f0","observation_id":"3575e72b-1000-41be-891d-b974fd6a9fc6","resolution":{"observed_at":"2026-08-11T23:51:15.685780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:51:15.661777Z","title":"Animal kingdom: A large and diverse dataset for animal behavior understanding","venue":null,"work_id":"d13d14d4-3ac8-4716-a4cd-d208cfdd76dc","year":2022},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.629925Z"},"links":{"citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:98a11b3860c01583a457af8244f405e5637af43d35eae4cf7ed3b19fc23b8534","observation_id":"c8ff2fc7-1db6-4411-9cbc-24528c0605cd","resolution":{"observed_at":"2026-08-11T23:51:15.667641Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02707","last_updated":"2025-05-18T11:18:56Z","snapshot_observed_at":"2026-08-13T04:53:43.321583Z","submitted_at":"2024-10-03T17:31:31Z","title":"LLMs Know More Than They Show: On the Intrinsic Representation of LLM Hallucinations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02707","snapshot_observed_at":"2026-08-11T23:51:14.635385Z","title":"Llms know more than they show: On the intrinsic representation of llm hallucinations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.635385Z"},"links":{"cited_paper":"/paper/2410.02707","citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:e841a60cda23158921cd94f36c610bc95e10bf2fb59d5838aaa86215c994eaca","observation_id":"087b1459-d397-449e-8f73-b5ec6697eb69","resolution":{"observed_at":"2026-08-11T23:51:14.635385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:51:15.644148Z","title":"Perception test: A diagnostic benchmark for multi- modal video models","venue":null,"work_id":"95ed0bc3-07de-4466-926d-6cc9a017b1b8","year":2023},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.641705Z"},"links":{"citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:c41b3fb4f886673e7c8105a3228cb6bfb859efde624b426e49d864d4924c58cd","observation_id":"a49c6b7b-75af-4b44-b808-9ca6a5d90e8c","resolution":{"observed_at":"2026-08-11T23:51:15.649825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09881","last_updated":"2024-12-30T04:27:05Z","snapshot_observed_at":"2026-08-13T05:49:02.020811Z","submitted_at":"2023-10-15T16:40:19Z","title":"In-Context Learning with Iterative Demonstration Selection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.09881","snapshot_observed_at":"2026-08-11T23:51:14.647222Z","title":"In-context learning with iterative demon- stration selection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.647222Z"},"links":{"cited_paper":"/paper/2310.09881","citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:99fc32f6b6813360e9158ba71b90aa3ca6de9000c87142cc2865e53a340fa197","observation_id":"2c35c90e-15bc-4919-a061-3be3835ff96f","resolution":{"observed_at":"2026-08-11T23:51:14.647222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:51:15.620277Z","title":"Sentence-BERT: Sen- tence embeddings using Siamese BERT-networks","venue":null,"work_id":"7eaddecf-3b46-4d8d-8d17-734a342f9111","year":2019},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.653373Z"},"links":{"citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:ce44d60a26e4b3db0a878f89a683c3a6b41ac4c4cccc87c5bb3706e70019908c","observation_id":"e20c2581-681c-4fa7-b21f-b5a83a25ef3b","resolution":{"observed_at":"2026-08-11T23:51:15.626230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11317","last_updated":"2024-03-17T19:44:05Z","snapshot_observed_at":"2026-08-13T00:52:24.917937Z","submitted_at":"2024-03-17T19:44:05Z","title":"Few-Shot VQA with Frozen LLMs: A Tale of Two Approaches","version":1},"cited_work":{"arxiv_id":"2403.11317","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.11317","snapshot_observed_at":"2026-08-11T23:51:14.958583Z","title":"Few-Shot VQA with Frozen LLMs: A Tale of Two Approaches","venue":"cs.CL","work_id":"74b9efbb-2ebc-4a57-8357-7a835aefa21b","year":2024},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.658083Z"},"links":{"cited_paper":"/paper/2403.11317","citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:cb9d21e40a06ae078d167ebe470129edaaaa3f981a0cc6a1221e074f4281cf05","observation_id":"9456c65a-abeb-453f-9fa3-3abb9d4f8dce","resolution":{"observed_at":"2026-08-11T23:51:14.966231Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:51:15.598119Z","title":"Real-world anomaly detection in surveillance videos","venue":null,"work_id":"33ae7db1-d315-4ac5-be4a-fb9d3182b098","year":2018},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.663210Z"},"links":{"citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:57e18d3607b804e4c7d5da1050073938a8fb04a4e33849b0760cc91745f5abb2","observation_id":"ef26cba9-22bb-486a-93c9-e966d44a68b3","resolution":{"observed_at":"2026-08-11T23:51:15.607434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:51:15.577757Z","title":"Gemini 1.5: Unlocking multimodal under- standing across millions of tokens of context, 2024","venue":null,"work_id":"8a06e91d-2433-4480-8a30-e6a36e72dba1","year":2024},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.668124Z"},"links":{"citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:834c64819b2154200660035aa5815317642d9a01e9c2ff87d51a0246c70e0e51","observation_id":"2d6afd20-42c2-4392-a48c-3defe167753e","resolution":{"observed_at":"2026-08-11T23:51:15.584029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-11T23:51:14.672870Z","title":"GPT-4o System Card, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.672870Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:17ea8a66b990d6bac5d80b03d6a2d0dc292fb68c6a904f90a784960e3a450ccc","observation_id":"10496ad8-4900-4dfe-8467-c58125151b09","resolution":{"observed_at":"2026-08-11T23:51:14.672870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-11T23:51:14.678177Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.678177Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:264585eb78801cb7770fb36b8a1c3b404483a68e477e776f245e66467133def1","observation_id":"bb241294-e3d6-40b9-8504-ad15d6b363e9","resolution":{"observed_at":"2026-08-11T23:51:14.678177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14716","last_updated":"2024-06-16T08:49:00Z","snapshot_observed_at":"2026-08-13T00:24:09.541855Z","submitted_at":"2024-04-23T03:42:48Z","title":"Bayesian Example Selection Improves In-Context Learning for Speech, Text, and Visual Modalities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14716","snapshot_observed_at":"2026-08-11T23:51:14.683313Z","title":"Bayesian example selection improves in-context learning for speech, text, and visual modalities","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.683313Z"},"links":{"cited_paper":"/paper/2404.14716","citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:3d80b94c9b39d04d835554115042fcf976ac39809332d1c7e337e36c2f6c65e0","observation_id":"95673d8d-49be-40ca-a667-b052887eba29","resolution":{"observed_at":"2026-08-11T23:51:14.683313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.15377","last_updated":"2024-08-14T14:31:50Z","snapshot_observed_at":"2026-08-13T00:47:41.087976Z","submitted_at":"2024-03-22T17:57:42Z","title":"InternVideo2: Scaling Foundation Models for Multimodal Video Understanding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.15377","snapshot_observed_at":"2026-08-11T23:51:14.688603Z","title":"Internvideo2: Scaling video foundation mod- els for multimodal video understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.688603Z"},"links":{"cited_paper":"/paper/2403.15377","citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:a533ff34d09f7d368505a846a283af355d9856e1e1a63ad6c4986ebad36971cc","observation_id":"a15826be-eb33-4850-ad1d-cc11be042225","resolution":{"observed_at":"2026-08-11T23:51:14.688603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:51:15.557741Z","title":"Next-qa: Next phase of question-answering to explaining temporal actions","venue":null,"work_id":"211e904f-8fa9-4c03-8d40-60ca2f9aa57c","year":2021},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.694586Z"},"links":{"citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:63f1ee0cbe0126c0c86fcf7611e60f5bdb8c37aa35edd2959c4fedee477ff334","observation_id":"08aec839-854c-44c3-9d1a-872afa2c601c","resolution":{"observed_at":"2026-08-11T23:51:15.563368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:51:15.534970Z","title":"Can LLMs express their un- certainty? an empirical evaluation of confidence elicitation in LLMs","venue":null,"work_id":"ed81cdb8-0107-4f07-9c92-cfa2e8e54cae","year":2024},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.699913Z"},"links":{"citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:398e3d3cddd98a3e34a401c7dcd21f9bc8fad2e89bf0becfafda14e9bd911291","observation_id":"a1ea448f-1d56-4f2d-8e69-5a5ae2f056a3","resolution":{"observed_at":"2026-08-11T23:51:15.542701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00902","last_updated":"2025-02-07T02:29:02Z","snapshot_observed_at":"2026-08-12T23:31:41.867719Z","submitted_at":"2024-07-01T01:57:21Z","title":"From Introspection to Best Practices: Principled Analysis of Demonstrations in Multimodal In-Context Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.00902","snapshot_observed_at":"2026-08-11T23:51:14.705316Z","title":"From introspection to best practices: Principled anal- ysis of demonstrations in multimodal in-context learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.705316Z"},"links":{"cited_paper":"/paper/2407.00902","citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:48d86a551a24f54682169c131a0936e70cd6a17f15e2fa1e1de56f557bc717f2","observation_id":"f66e0c66-f136-414e-805d-a286813a179c","resolution":{"observed_at":"2026-08-11T23:51:14.705316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04782","last_updated":"2023-10-07T12:06:53Z","snapshot_observed_at":"2026-08-13T05:54:56.269359Z","submitted_at":"2023-10-07T12:06:53Z","title":"Improving the Reliability of Large Language Models by Leveraging Uncertainty-Aware In-Context Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04782","snapshot_observed_at":"2026-08-11T23:51:14.710709Z","title":"Improving the reliability of large language models by lever- aging uncertainty-aware in-context learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.710709Z"},"links":{"cited_paper":"/paper/2310.04782","citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:ba8085c7334b1a10d61303b0d681309a3f9a8dbbae2ebb65b4e7ac33c8548e0b","observation_id":"711784b5-2852-4338-8b72-966363f59a0b","resolution":{"observed_at":"2026-08-11T23:51:14.710709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:51:15.512123Z","title":"Eliciting in-context learning in vision-language models for videos through curated data dis- tributional properties","venue":null,"work_id":"d0e0a8d4-0895-4018-9756-0db95e8d499b","year":2024},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.715803Z"},"links":{"citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:cbd934ce9dae1dc4fc83d0ff50681caaa9d4d905360e670a95e938ea26a1cd8d","observation_id":"79fdc45f-e651-48e5-a508-f5815a3f6404","resolution":{"observed_at":"2026-08-11T23:51:15.518885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:51:15.487913Z","title":"Revisiting out-of-distribution robustness in nlp: Benchmarks, analysis, and llms evaluations","venue":null,"work_id":"97f76a65-61ff-45fb-8192-5752cb006800","year":null},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.721435Z"},"links":{"citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:6d9918bfe61ef181ab5538ca78af7cbc1a911dca84d2df9261063c4dbcfd6d11","observation_id":"dd39e91c-1384-48ed-a5e7-166b2a24d26a","resolution":{"observed_at":"2026-08-11T23:51:15.497000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06599","last_updated":"2024-02-09T18:21:51Z","snapshot_observed_at":"2026-08-13T04:22:22.181055Z","submitted_at":"2024-02-09T18:21:51Z","title":"On the Out-Of-Distribution Generalization of Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06599","snapshot_observed_at":"2026-08-11T23:51:14.726744Z","title":"On the out-of-distribution generalization of multimodal large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.726744Z"},"links":{"cited_paper":"/paper/2402.06599","citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:dc24af89541e359e993ca03f1c8e0d68d92faf3640766f38d6d3bfbc9e077d40","observation_id":"61f5b66a-6e46-49c1-9da7-4c93b026bf5b","resolution":{"observed_at":"2026-08-11T23:51:14.726744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02713","last_updated":"2025-08-01T16:40:14Z","snapshot_observed_at":"2026-08-02T12:24:31.329178Z","submitted_at":"2024-10-03T17:36:49Z","title":"LLaVA-Video: Video Instruction Tuning With Synthetic Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02713","snapshot_observed_at":"2026-08-11T23:51:14.731849Z","title":"Video instruction tuning with 11 synthetic data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.731849Z"},"links":{"cited_paper":"/paper/2410.02713","citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:d05449ec35657648a9485c77acea4c6d36dc2b9f4ccf54840428bf2fdc459f71","observation_id":"cf85a32f-c478-4c30-b6fe-060d703cf856","resolution":{"observed_at":"2026-08-11T23:51:14.731849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:51:15.467672Z","title":"MMICL: Empowering vision- language model with multi-modal in-context learning","venue":null,"work_id":"5f12be79-12d6-44a8-9952-edf527b7b589","year":2024},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.737316Z"},"links":{"citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:d5f8add12e287737aec87c00e888d076f9a11093fc4246ace87bb50e26218547","observation_id":"431dd5b0-c683-4f39-84d9-27567ab21794","resolution":{"observed_at":"2026-08-11T23:51:15.473057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05629","last_updated":"2025-02-19T22:48:13Z","snapshot_observed_at":"2026-08-12T22:28:36.316438Z","submitted_at":"2024-10-08T02:25:38Z","title":"Vector-ICL: In-context Learning with Continuous Vector Representations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05629","snapshot_observed_at":"2026-08-11T23:51:14.742680Z","title":"Vector-icl: In-context learning with continuous vector representations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.742680Z"},"links":{"cited_paper":"/paper/2410.05629","citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:fbe994f9e4f561923e7ce1898c848d615ae41e66310a651a1c74d879431124ac","observation_id":"a3f20680-b46d-4f7d-b93d-a17efd63ba01","resolution":{"observed_at":"2026-08-11T23:51:14.742680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-11T08:20:29.798517Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-11T23:51:14.520095Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-11T23:51:14.520095Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2412.02186"},"observation_digest":"sha256:ae5bd7f37232bbd2faf4801b55abaf579ab52b066cc18ca6d44f2139b2cc528e","observation_id":"0d9cd69f-e966-445a-98e4-db5bdc4526fa","resolution":{"observed_at":"2026-08-11T23:51:14.520095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.02186","last_updated":"2024-12-03T05:54:43Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T11:31:11.940980Z","submitted_at":"2024-12-03T05:54:43Z","title":"VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding"},"reference_resolution":{"displayed":60,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":1,"verified_fuzzy":28},"total_outbound_references":60},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 60 of 60 outbound references and 3 inbound Pith citation observations for arXiv:2412.02186."}