{"as_of":"2026-08-15T18:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9681f1d5c8ca05932f39adf5f02b2a7bdb909836f96d0d5f506d113b690434c7","coverage":[{"denominator":88,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":88,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T11:18:36.313017Z","state":"measured"},{"denominator":88,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":88,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.15652/citation-record","integrity":"/paper/2412.15652/integrity","json":"/paper/2412.15652/citation-record.json","paper":"/paper/2412.15652"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-11T11:18:29.542848Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:29.542848Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:6a7d6f7acf20aef997a770033cb5ef6df05fb5a55b3b2fe5abf02c9a73d6e93a","observation_id":"59bd9bd6-65cd-4446-9081-f6f2ae5b8239","resolution":{"observed_at":"2026-08-11T11:18:29.542848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.08844","last_updated":"2023-07-11T18:29:12Z","snapshot_observed_at":"2026-08-15T05:43:31.861540Z","submitted_at":"2023-05-15T17:57:16Z","title":"RL4F: Generating Natural Language Feedback with Reinforcement Learning for Repairing Model Outputs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.08844","snapshot_observed_at":"2026-08-11T11:18:29.690792Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:29.690792Z"},"links":{"cited_paper":"/paper/2305.08844","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:5ca64928f2d748c100cd24652bca5bd6adaf55841c92df50815b527f4e0b9a7a","observation_id":"502c660b-9abc-472c-9b00-c8827d543e98","resolution":{"observed_at":"2026-08-11T11:18:29.690792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.20689","last_updated":"2024-03-29T07:17:39Z","snapshot_observed_at":"2026-08-15T10:24:07.801510Z","submitted_at":"2023-10-31T17:52:22Z","title":"Learning From Mistakes Makes LLM Better Reasoner","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.20689","snapshot_observed_at":"2026-08-11T11:18:29.751918Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:29.751918Z"},"links":{"cited_paper":"/paper/2310.20689","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:8405fcce39ab85d78b48fdbd86c2bf3bda570cc50dd4263df5fae7f41b023d41","observation_id":"96ead836-13cc-4f9e-b32a-2527001a4bcd","resolution":{"observed_at":"2026-08-11T11:18:29.751918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04120","last_updated":"2024-03-07T00:32:47Z","snapshot_observed_at":"2026-08-13T04:01:10.606571Z","submitted_at":"2024-03-07T00:32:47Z","title":"A data-centric approach to class-specific bias in image data augmentation","version":1},"cited_work":{"arxiv_id":"2403.04120","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.04120","snapshot_observed_at":"2026-08-11T11:18:37.580450Z","title":"A data-centric approach to class-specific bias in image data augmentation","venue":"cs.CV","work_id":"a4f8049c-3007-4026-bd34-a083a18e039f","year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:29.843914Z"},"links":{"cited_paper":"/paper/2403.04120","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:536c24ed381b89e9e8f5c2685a6ef8f33f4a939d795c1310f0381ffecdfd2d64","observation_id":"0751aa38-db9f-4b68-8ac1-fd6eed36c4a2","resolution":{"observed_at":"2026-08-11T11:18:37.657401Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-11T11:18:30.035097Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:30.035097Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:c8865a9dd37f0bbc306876c7953e95a31ed9fd903fcda449df93893d3f4421a6","observation_id":"a537fea8-3bcd-4c35-bb28-bc6793c00b75","resolution":{"observed_at":"2026-08-11T11:18:30.035097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:30.126725Z","title":null,"venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:30.126725Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:34771b5448e49d96be395e2769d594e20908c4ac02b6729de538e4b03e52bffc","observation_id":"83832f5c-672c-42d1-b762-99f1440b02fd","resolution":{"observed_at":"2026-08-11T11:18:30.126725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:30.194422Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:30.194422Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:018224c07274f0e1b207c7e41fa8897537fda950d88fce3386cb55e61726ae62","observation_id":"be5263dc-ade1-46bf-8b33-383cc1f09a26","resolution":{"observed_at":"2026-08-11T11:18:30.194422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-11T11:18:30.260883Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:30.260883Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:7642cb7b15c2414cfc98f2826a4545b771a04b36d3d663df376ab22148cda1bb","observation_id":"f87f42a2-bbc4-4aa5-832a-e658dacf63b7","resolution":{"observed_at":"2026-08-11T11:18:30.260883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:30.401004Z","title":null,"venue":null,"work_id":null,"year":1987},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:30.401004Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:0e7e4fb378cecf56db624ea3c81ed3a821ad22725000063c92583e39568e4542","observation_id":"7f4f4d10-6883-4859-a4f7-a641f1f87555","resolution":{"observed_at":"2026-08-11T11:18:30.401004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.18628","last_updated":"2024-01-26T10:02:57Z","snapshot_observed_at":"2026-08-15T06:34:35.730881Z","submitted_at":"2023-10-28T07:54:39Z","title":"Personalised Distillation: Empowering Open-Sourced LLMs with Adaptive Learning for Code Generation","version":2},"cited_work":{"arxiv_id":"2310.18628","doi":"10.48550/arxiv.2310.18628","metadata_source":"pith","pith_arxiv_id":"2310.18628","snapshot_observed_at":"2026-08-11T12:16:16.480190Z","title":"Personalised Distillation: Empowering Open-Sourced LLMs with Adaptive Learning for Code Generation","venue":"cs.CL","work_id":"e7678e4e-19d7-4e73-9eea-92906cbeb5d0","year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:30.538449Z"},"links":{"cited_paper":"/paper/2310.18628","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:69b042fcac7f01a64c329962bd0c7377979f17c25ad3600c11334f4a48166cf9","observation_id":"61ab7e39-3c4a-4dca-927c-98c837056d55","resolution":{"observed_at":"2026-08-11T11:18:36.602286Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08701","last_updated":"2024-02-13T18:37:25Z","snapshot_observed_at":"2026-08-13T10:54:00.274565Z","submitted_at":"2023-07-17T17:59:40Z","title":"AlpaGasus: Training A Better Alpaca with Fewer Data","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08701","snapshot_observed_at":"2026-08-11T11:18:30.647818Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:30.647818Z"},"links":{"cited_paper":"/paper/2307.08701","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:9dca628eb50397889491af3c2b963ba8b3dd2b2ab7b4295efe9fa0fce0c4b77d","observation_id":"b66a871e-6c68-424e-b3e8-f8c95c44b5c5","resolution":{"observed_at":"2026-08-11T11:18:30.647818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.14430","last_updated":"2023-07-26T18:01:49Z","snapshot_observed_at":"2026-08-13T10:47:20.944094Z","submitted_at":"2023-07-26T18:01:49Z","title":"Skill-it! A Data-Driven Skills Framework for Understanding and Training Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.14430","snapshot_observed_at":"2026-08-11T11:18:30.753092Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:30.753092Z"},"links":{"cited_paper":"/paper/2307.14430","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:f65153c13e89ec8a090fd3214f068ce8d43c0230693387b1833a7482295b3c03","observation_id":"7ef5cc08-1c9c-4864-ae67-de92eaa2b551","resolution":{"observed_at":"2026-08-11T11:18:30.753092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13007","last_updated":"2023-03-20T11:39:47Z","snapshot_observed_at":"2026-08-13T12:37:42.544416Z","submitted_at":"2023-02-25T06:58:16Z","title":"AugGPT: Leveraging ChatGPT for Text Data Augmentation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13007","snapshot_observed_at":"2026-08-11T11:18:30.866871Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:30.866871Z"},"links":{"cited_paper":"/paper/2302.13007","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:68cf68266911de1702aae2211b3a45611f139fba438252dc1067521f2616fdbb","observation_id":"498992c3-92bf-4017-a872-b752d3c0ae29","resolution":{"observed_at":"2026-08-11T11:18:30.866871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12736","last_updated":"2024-07-17T08:13:02Z","snapshot_observed_at":"2026-08-15T03:37:28.582142Z","submitted_at":"2024-03-19T13:53:37Z","title":"Towards Multimodal In-Context Learning for Vision & Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12736","snapshot_observed_at":"2026-08-11T11:18:30.950663Z","title":"Jehanzeb Mirza, Wei Lin, Amit Alfassy, Assaf Arbelle, Shimon Ullman, and Leonid Karlinsky","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:30.950663Z"},"links":{"cited_paper":"/paper/2403.12736","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:fc379be50530045e257be44b248c00dc10272fb613f19bb77173a02fa08143bb","observation_id":"47077c04-7d8b-41be-b03f-26ad4c5d2011","resolution":{"observed_at":"2026-08-11T11:18:30.950663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:31.061376Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:31.061376Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:f261f50bea2e619092cbaebbdbfea767b0c84de5ccd17066806bf43208868a78","observation_id":"33e1170a-a280-48c7-9f1f-fcc96bc684a9","resolution":{"observed_at":"2026-08-11T11:18:31.061376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:31.121160Z","title":"A tale of tails: Model collapse as a change of scaling laws","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:31.121160Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:509f4ae08f744dc2fa941e698d85d61ed3f03c544291eaa210e6607e6f7d8ff0","observation_id":"2d452891-5ae7-4c43-881e-2d47e1d6387b","resolution":{"observed_at":"2026-08-11T11:18:31.121160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:31.230845Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:31.230845Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:05006c8bfb02c31706fac66e8cc6c5cd9a79b4642c7cdabac0067dbcebc2ef2f","observation_id":"3611be02-f771-480b-b890-619ce7aa6d04","resolution":{"observed_at":"2026-08-11T11:18:31.230845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:31.265214Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:31.265214Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:0102449eb8080d7734a465a14c343c5e3c8e1934298a39070db92931464474a3","observation_id":"6437eeee-f8bc-4cfd-96a4-3fea8fbbbb42","resolution":{"observed_at":"2026-08-11T11:18:31.265214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.10964","last_updated":"2020-05-05T22:00:44Z","snapshot_observed_at":"2026-08-15T10:24:27.581301Z","submitted_at":"2020-04-23T04:21:19Z","title":"Don't Stop Pretraining: Adapt Language Models to Domains and Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.10964","snapshot_observed_at":"2026-08-11T11:18:31.287010Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:31.287010Z"},"links":{"cited_paper":"/paper/2004.10964","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:a80757a22b0f2f02a4bc7166c9046316972d9819824c52a257b91060b0b39b0f","observation_id":"7b7b0fb6-453b-4150-86e5-47d18e3c116d","resolution":{"observed_at":"2026-08-11T11:18:31.287010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:31.291669Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:31.291669Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:ecd1576893a96ae5cd5c1409f760b0029fdc14892576ca25ba4ef2e8d880e2c0","observation_id":"16dc6b49-b0b5-441d-9674-97f733be16a6","resolution":{"observed_at":"2026-08-11T11:18:31.291669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15091","last_updated":"2023-06-26T22:14:04Z","snapshot_observed_at":"2026-08-14T13:42:52.273644Z","submitted_at":"2023-06-26T22:14:04Z","title":"Understanding In-Context Learning via Supportive Pretraining Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15091","snapshot_observed_at":"2026-08-11T11:18:31.296716Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:31.296716Z"},"links":{"cited_paper":"/paper/2306.15091","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:543797808b1e1f328e6094ff53d06e33a80769f8fc896631ede23e50a8da53fc","observation_id":"00c74465-8c88-4db0-9a06-cd0e9bb178db","resolution":{"observed_at":"2026-08-11T11:18:31.296716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:31.301027Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:31.301027Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:259074ae26ac20f62dc3cee25e8215ff222e0a7f4743f82ae85e84c9b1e9a0d7","observation_id":"74419b3e-2fae-4afb-b04a-c1f1bdd93512","resolution":{"observed_at":"2026-08-11T11:18:31.301027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:38.577255Z","title":null,"venue":null,"work_id":"c73cda57-256a-4f3f-829d-88619f8efd24","year":2022},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:31.319732Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:cc024ba91ed984c7b98edba3757235a6a5cdb4b94e0e2410e3b0b6459b170309","observation_id":"4627a671-36ce-4381-9862-c03137eb95c3","resolution":{"observed_at":"2026-08-11T11:18:38.583025Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09798","last_updated":"2024-10-04T21:51:47Z","snapshot_observed_at":"2026-08-14T13:44:21.475363Z","submitted_at":"2024-05-16T04:02:43Z","title":"Many-Shot In-Context Learning in Multimodal Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09798","snapshot_observed_at":"2026-08-11T11:18:31.447699Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:31.447699Z"},"links":{"cited_paper":"/paper/2405.09798","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:4d56f8b4221550dbc7f935367f8247b6fcf0bc22ce2b299d5bc251b54516550d","observation_id":"5ab54576-f894-4307-a2c7-413cd260af69","resolution":{"observed_at":"2026-08-11T11:18:31.447699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00123","last_updated":"2021-06-11T22:08:29Z","snapshot_observed_at":"2026-08-14T13:44:26.162857Z","submitted_at":"2021-02-27T04:09:32Z","title":"GRAD-MATCH: Gradient Matching based Data Subset Selection for Efficient Deep Model Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00123","snapshot_observed_at":"2026-08-11T11:18:31.563340Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:31.563340Z"},"links":{"cited_paper":"/paper/2103.00123","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:501a6233e1978e47b98420b25c08d6a7504324d9b2c2456620fa001a3760aec4","observation_id":"57d0fb07-0774-4556-98a0-8a598d34227c","resolution":{"observed_at":"2026-08-11T11:18:31.563340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.00904","last_updated":"2018-06-06T06:46:02Z","snapshot_observed_at":"2026-08-14T19:58:23.751246Z","submitted_at":"2018-01-03T05:49:37Z","title":"ScreenerNet: Learning Self-Paced Curriculum for Deep Neural Networks","version":4},"cited_work":{"arxiv_id":"1801.00904","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.00904","snapshot_observed_at":"2026-08-11T11:18:37.226659Z","title":"ScreenerNet: Learning Self-Paced Curriculum for Deep Neural Networks","venue":"cs.CV","work_id":"ee7c2f94-a243-4115-b90d-e5077e95be00","year":2018},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:31.639194Z"},"links":{"cited_paper":"/paper/1801.00904","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:f4f5f643a4fc19d6068e774f687b16bbdb9aff2217671dc8720d5d945a65d0e1","observation_id":"c7ce0d31-5872-4009-8c5f-b14de9bdd018","resolution":{"observed_at":"2026-08-11T11:18:37.292004Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:38.557340Z","title":null,"venue":null,"work_id":"4ad01399-a8c1-40ef-80a1-7ed800723db4","year":2010},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:31.707056Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:23a4291ea04c67d5b1c8b9f81ed61cb2ad030598d71661a80c728f9f7c65e82e","observation_id":"d50475c8-da21-4411-a91b-59fc7130e643","resolution":{"observed_at":"2026-08-11T11:18:38.562295Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00288","last_updated":"2023-11-01T04:40:05Z","snapshot_observed_at":"2026-08-14T17:06:25.685964Z","submitted_at":"2023-11-01T04:40:05Z","title":"Active Instruction Tuning: Improving Cross-Task Generalization by Training on Prompt Sensitive Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.00288","snapshot_observed_at":"2026-08-11T11:18:31.770888Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:31.770888Z"},"links":{"cited_paper":"/paper/2311.00288","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:3be427dfdab7408ee04a125eb27ee7ce1eb932c18a708ce68682c7833064a05d","observation_id":"ad1bb8dd-a419-49d5-a052-79b6907e913d","resolution":{"observed_at":"2026-08-11T11:18:31.770888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16418","last_updated":"2024-10-17T01:57:27Z","snapshot_observed_at":"2026-08-14T13:43:07.006456Z","submitted_at":"2024-04-25T08:49:47Z","title":"Instruction Matters: A Simple yet Effective Task Selection for Optimized Instruction Tuning of Specific Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16418","snapshot_observed_at":"2026-08-11T11:18:31.820458Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:31.820458Z"},"links":{"cited_paper":"/paper/2404.16418","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:16d0fe61b85bacf065d107ee0c6a230c7a7ec4b63278ef2dd4245ba01505de39","observation_id":"674b7145-a253-4d67-ad88-29d0f103c647","resolution":{"observed_at":"2026-08-11T11:18:31.820458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.15042","last_updated":"2024-07-13T07:36:49Z","snapshot_observed_at":"2026-08-15T11:59:53.832368Z","submitted_at":"2024-03-22T08:57:07Z","title":"LLM2LLM: Boosting LLMs with Novel Iterative Data Enhancement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.15042","snapshot_observed_at":"2026-08-11T11:18:31.875753Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:31.875753Z"},"links":{"cited_paper":"/paper/2403.15042","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:eec145e95ec9212a853ef9a2ad239760b377e5b8536c23096ebefdc8eb4dbaee","observation_id":"54d4abf3-4a7f-4b46-a4b2-07ccf9c00379","resolution":{"observed_at":"2026-08-11T11:18:31.875753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:38.541064Z","title":null,"venue":null,"work_id":"81199510-bc42-47ca-aec2-d8e685741df6","year":2011},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:31.963976Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:3a7c9d6101a4c0988ecf8643f23028d7c46afcb913040df62ffe00940fba5ed2","observation_id":"bf8a7d50-caed-418a-89e5-0f66658d4704","resolution":{"observed_at":"2026-08-11T11:18:38.547263Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-11T11:18:32.014466Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:32.014466Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:0eba265e44ff1a55c8b85b794c6025ec771fc54c1083c1382ee60ae88f9f7e6b","observation_id":"9e03463c-dc7a-4dfc-9543-94655fca8ffc","resolution":{"observed_at":"2026-08-11T11:18:32.014466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:32.125233Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:32.125233Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:15f1ded5b1207baff1830bdb9b9fad3539326176eae287ec6f967ebe6717d83b","observation_id":"ea85da49-a6c1-461a-96fb-766bb839cd40","resolution":{"observed_at":"2026-08-11T11:18:32.125233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13064","last_updated":"2024-02-20T15:00:35Z","snapshot_observed_at":"2026-08-13T04:14:27.645630Z","submitted_at":"2024-02-20T15:00:35Z","title":"Synthetic Data (Almost) from Scratch: Generalized Instruction Tuning for Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13064","snapshot_observed_at":"2026-08-11T11:18:32.254372Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:32.254372Z"},"links":{"cited_paper":"/paper/2402.13064","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:42b515b93b2f6ab9ad403620cb8efad4f169fd5be0ccd7cedd707e5a34c47acd","observation_id":"65dee9d3-2a82-4d66-97b0-c95bde10bdf5","resolution":{"observed_at":"2026-08-11T11:18:32.254372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.03610","last_updated":"2024-02-02T15:46:42Z","snapshot_observed_at":"2026-08-14T13:42:53.311402Z","submitted_at":"2023-05-05T15:16:07Z","title":"The Role of Data Curation in Image Captioning","version":2},"cited_work":{"arxiv_id":"2305.03610","doi":"10.48550/arxiv.2305.03610","metadata_source":"pith","pith_arxiv_id":"2305.03610","snapshot_observed_at":"2026-08-11T12:16:16.480190Z","title":"The Role of Data Curation in Image Captioning","venue":"cs.CV","work_id":"6657d25c-8157-4dd1-9dd6-c1e37403c453","year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:32.378381Z"},"links":{"cited_paper":"/paper/2305.03610","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:d70e64be90386266c370bac79b161e1622ae16964cef2eb688f120eb1c86b1ac","observation_id":"4f503afc-a847-4058-a9a4-818126d23a1c","resolution":{"observed_at":"2026-08-11T11:18:36.475525Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.emnlp-main.889","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:36.447929Z","title":null,"venue":null,"work_id":"6b845fd4-e45c-48ea-9e9a-4d5ec1e9355b","year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:32.424353Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:f82d15525a90a926ee79d757692cc6948a1a9435efa9d4da31be894080ec1365","observation_id":"6f95edcf-8072-428a-945b-a44e34ee6e7a","resolution":{"observed_at":"2026-08-11T11:18:36.453831Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:38.424084Z","title":null,"venue":null,"work_id":"7f1d6090-e237-4224-8bac-bf809a9bc3d9","year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:32.429065Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:5951bce46e42da5fa3919b3e7da77d64a11258ae3e9a71abab61db57b1d3abf1","observation_id":"0ce65bbd-4d53-4002-8db4-da54b469b4fe","resolution":{"observed_at":"2026-08-11T11:18:38.507370Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:32.435145Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:32.435145Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:f475cd8d9979805f2572753e931f657eea66d43fb1653168dcacc6b64c85034f","observation_id":"6b5e5e7c-cd16-487b-a36c-edc45859f66a","resolution":{"observed_at":"2026-08-11T11:18:32.435145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:38.215868Z","title":null,"venue":null,"work_id":"901b1840-b1de-4ca8-8e06-89169a834d70","year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:32.588553Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:0bf8a93abad10e1a66d492d5154622a8953d240dee5f900fa2ee8970979afa8c","observation_id":"d662c3bc-46d6-4950-9c37-62ea3c205996","resolution":{"observed_at":"2026-08-11T11:18:38.309312Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16705","last_updated":"2025-01-15T08:20:19Z","snapshot_observed_at":"2026-08-13T04:09:55.899267Z","submitted_at":"2024-02-26T16:21:53Z","title":"SelectIT: Selective Instruction Tuning for LLMs via Uncertainty-Aware Self-Reflection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16705","snapshot_observed_at":"2026-08-11T11:18:32.818346Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:32.818346Z"},"links":{"cited_paper":"/paper/2402.16705","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:e6c458d70f32a241e28793d12dc4dd7c5409171dbfc89359626e0f184aa46587","observation_id":"2ce0241e-971f-40ff-93c8-87339c26f392","resolution":{"observed_at":"2026-08-11T11:18:32.818346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06281","last_updated":"2024-08-20T03:56:03Z","snapshot_observed_at":"2026-07-06T15:53:19.485466Z","submitted_at":"2023-07-12T16:23:09Z","title":"MMBench: Is Your Multi-modal Model an All-around Player?","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06281","snapshot_observed_at":"2026-08-11T11:18:32.955524Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:32.955524Z"},"links":{"cited_paper":"/paper/2307.06281","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:9c941796011f612cfa78e78eb9684fcd5f2ed03eaee73e2319c672aec8d11082","observation_id":"216ab578-24bf-42b6-95ce-3b6c81033c6e","resolution":{"observed_at":"2026-08-11T11:18:32.955524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09559","last_updated":"2024-10-10T14:16:13Z","snapshot_observed_at":"2026-08-14T13:44:42.439516Z","submitted_at":"2024-03-14T16:47:25Z","title":"Less is More: High-value Data Selection for Visual Instruction Tuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09559","snapshot_observed_at":"2026-08-11T11:18:33.040213Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:33.040213Z"},"links":{"cited_paper":"/paper/2403.09559","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:3488373be86096fd8e25afe6a81b21c461a9944e4785103542c3bbdd1b37391d","observation_id":"9fb622e7-b2d1-4e35-99ea-02a9b116020e","resolution":{"observed_at":"2026-08-11T11:18:33.040213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:33.130713Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:33.130713Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:fd162a1afbfbee1bace03e5793a6fb0e04c7eaeacd626235b135121dfea3ee4c","observation_id":"b09ded32-d979-4951-80d3-10af61a35e73","resolution":{"observed_at":"2026-08-11T11:18:33.130713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:33.222134Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:33.222134Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:3fef4c9b2b3dd03ef7fb4bd9e0a778487ac84e20125fc404151327c5915cbc2b","observation_id":"667dd2e7-2fb0-4e3d-90d6-b3d9f8b0d8e7","resolution":{"observed_at":"2026-08-11T11:18:33.222134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:38.183623Z","title":null,"venue":null,"work_id":"9ac9ffd4-5654-42b4-8438-b43fab30ee52","year":2017},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:33.321274Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:163d7ad5ebc45373a3d29f409da9a9d2e5b16c89d7af0863b02679e4e918ca39","observation_id":"15e65d40-99cb-4c92-a3e5-226078ac0763","resolution":{"observed_at":"2026-08-11T11:18:38.188161Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.00183","last_updated":"2017-11-29T20:57:09Z","snapshot_observed_at":"2026-08-14T20:50:19.396616Z","submitted_at":"2017-07-01T18:13:17Z","title":"Teacher-Student Curriculum Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.00183","snapshot_observed_at":"2026-08-11T11:18:33.449700Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:33.449700Z"},"links":{"cited_paper":"/paper/1707.00183","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:f42243ca5b3bae2ebc06f574872b7c78d2308e0079d17288e43337b299d45fe3","observation_id":"1b2cf0f5-bd7f-4514-bc62-085f04d82d14","resolution":{"observed_at":"2026-08-11T11:18:33.449700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:38.172316Z","title":null,"venue":null,"work_id":"ee483fe8-702a-48ea-9508-3f2f6d789887","year":2020},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:33.527172Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:9a89650f2d031402fe6cc2a5514d5baa4a1dc5732006903c5b94878139f9b915","observation_id":"afeae7be-cc70-4b9a-bd36-59c49d5e88aa","resolution":{"observed_at":"2026-08-11T11:18:38.175783Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18334","last_updated":"2024-09-11T16:28:29Z","snapshot_observed_at":"2026-08-14T13:42:27.877120Z","submitted_at":"2024-02-28T13:54:57Z","title":"Learning to Generate Instruction Tuning Datasets for Zero-Shot Task Adaptation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18334","snapshot_observed_at":"2026-08-11T11:18:33.595166Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:33.595166Z"},"links":{"cited_paper":"/paper/2402.18334","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:e17f5abd872df480d15406d05b1d7046be3966949cc6dcff878715af288b7bff","observation_id":"60719554-ca92-453e-9c60-d13603a36822","resolution":{"observed_at":"2026-08-11T11:18:33.595166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:38.155436Z","title":null,"venue":null,"work_id":"bfa55cff-5b64-4750-a023-4d1d7f2e4b1f","year":2009},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:33.648636Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:d2093a8c4660b789476aa5e7444852d4c82f95734e1a7578f6fa973198c5a492","observation_id":"c548d4c3-fae7-407a-b2c9-c55d68c1b059","resolution":{"observed_at":"2026-08-11T11:18:38.159969Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1601.00617","last_updated":"2016-06-12T20:09:06Z","snapshot_observed_at":"2026-08-14T22:16:00.945542Z","submitted_at":"2016-01-04T19:38:18Z","title":"Coresets and Sketches","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1601.00617","snapshot_observed_at":"2026-08-11T11:18:33.697699Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:33.697699Z"},"links":{"cited_paper":"/paper/1601.00617","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:433fbb6721873a89e3bad6a8ab3423c70c31021b5224a2faf62fe02d4a671b42","observation_id":"bc69375c-5a82-4067-9198-c21c2f917e67","resolution":{"observed_at":"2026-08-11T11:18:33.697699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14999","last_updated":"2023-11-02T02:40:48Z","snapshot_observed_at":"2026-08-14T13:46:43.673880Z","submitted_at":"2023-05-24T10:36:14Z","title":"The Art of SOCRATIC QUESTIONING: Recursive Thinking with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14999","snapshot_observed_at":"2026-08-11T11:18:33.773378Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:33.773378Z"},"links":{"cited_paper":"/paper/2305.14999","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:910bfdab67feb761ffbe95ee880a93e52c8c63afab060b07637a7fd0454894e1","observation_id":"6344f884-17ee-4a77-bd79-99baa3e92330","resolution":{"observed_at":"2026-08-11T11:18:33.773378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:33.816260Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:33.816260Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:cd6ebe8ff5eb0c48778de5b1fd22eac23bf6c0d229e392c01077b70bdd1abdcd","observation_id":"fc988ede-1ba8-458c-a6f8-59b10331de5b","resolution":{"observed_at":"2026-08-11T11:18:33.816260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:38.124777Z","title":null,"venue":null,"work_id":"fe13b180-5e7f-485f-9c73-450cf15e4a08","year":2022},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:33.991364Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:bd96cb6129c7ac165b9ee942798e28b2d602760146ba6c0ede39c2ae572a70ed","observation_id":"b4538710-a778-4376-95b3-5b86f4cf3338","resolution":{"observed_at":"2026-08-11T11:18:38.130890Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.10084","last_updated":"2019-08-27T08:50:17Z","snapshot_observed_at":"2026-08-14T05:02:11.716316Z","submitted_at":"2019-08-27T08:50:17Z","title":"Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.10084","snapshot_observed_at":"2026-08-11T11:18:34.078033Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:34.078033Z"},"links":{"cited_paper":"/paper/1908.10084","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:8d7bbfeaaf10791cc80ccd5c5b10e61c6de660f21b873ac8a1e30310966081af","observation_id":"2059d5aa-660a-4ec1-81e8-3a7aa4de4aa5","resolution":{"observed_at":"2026-08-11T11:18:34.078033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:34.251790Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:34.251790Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:52e1b25897ac33891f35abd835ef53821e310ac31297aebc37b1cd9f9c9f5031","observation_id":"f694ba2e-dbe8-49f4-8ca6-6613b0d14394","resolution":{"observed_at":"2026-08-11T11:18:34.251790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:34.379138Z","title":null,"venue":null,"work_id":null,"year":1986},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:34.379138Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:a974a630579fae1ec1ab66bbf43aaf0fd255c002d53630a076ac2bf9e6223663","observation_id":"aa3a9087-e05f-464e-9873-f54db7c09751","resolution":{"observed_at":"2026-08-11T11:18:34.379138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.00489","last_updated":"2018-06-01T10:17:23Z","snapshot_observed_at":"2026-08-14T20:43:50.669164Z","submitted_at":"2017-08-01T19:50:53Z","title":"Active Learning for Convolutional Neural Networks: A Core-Set Approach","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.00489","snapshot_observed_at":"2026-08-11T11:18:34.483548Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:34.483548Z"},"links":{"cited_paper":"/paper/1708.00489","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:cc7ed1aca7480c345fe1db7d244289219ec09737260de7fdfe4b395ff5587796","observation_id":"435ba5c0-0d0c-410f-a4d0-eb1cc2c08cdc","resolution":{"observed_at":"2026-08-11T11:18:34.483548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15896","last_updated":"2024-12-06T00:41:15Z","snapshot_observed_at":"2026-08-14T13:42:30.379173Z","submitted_at":"2024-02-24T20:15:31Z","title":"Multimodal Instruction Tuning with Conditional Mixture of LoRA","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15896","snapshot_observed_at":"2026-08-11T11:18:34.569431Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:34.569431Z"},"links":{"cited_paper":"/paper/2402.15896","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:4acdf4941764853c37bb008a22e903b37aab79196084f02f691c199a3fb78ca2","observation_id":"3a7c75a5-909e-4ade-9978-2d2220e070d3","resolution":{"observed_at":"2026-08-11T11:18:34.569431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17493","last_updated":"2024-04-14T05:20:10Z","snapshot_observed_at":"2026-08-05T16:03:40.517679Z","submitted_at":"2023-05-27T15:10:41Z","title":"The Curse of Recursion: Training on Generated Data Makes Models Forget","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17493","snapshot_observed_at":"2026-08-11T11:18:34.697632Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:34.697632Z"},"links":{"cited_paper":"/paper/2305.17493","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:afe8a65ad8b41f17dff66bd603beebd8116010d2f406032820038b8c890bc156","observation_id":"3bf44a97-f29c-4d18-aa5a-540dc383d378","resolution":{"observed_at":"2026-08-11T11:18:34.697632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:34.785450Z","title":"less is more","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:34.785450Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:26a12d81e90ba65b269ba1f64440db1584a456bfdd22363f2659c633ab9d7345","observation_id":"bcfe6a0c-0fd5-46e9-8af0-c428284e72f8","resolution":{"observed_at":"2026-08-11T11:18:34.785450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.05159","last_updated":"2019-11-15T17:08:30Z","snapshot_observed_at":"2026-08-14T17:44:31.188487Z","submitted_at":"2018-12-12T21:24:15Z","title":"An Empirical Study of Example Forgetting during Deep Neural Network Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.05159","snapshot_observed_at":"2026-08-11T11:18:34.885180Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:34.885180Z"},"links":{"cited_paper":"/paper/1812.05159","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:63caddcec63de18afd88f6b42be95b7b843094b402b6b2e913889354b3df72eb","observation_id":"f5c4d211-200e-4f3e-b219-436def517b71","resolution":{"observed_at":"2026-08-11T11:18:34.885180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:38.039187Z","title":null,"venue":null,"work_id":"f942eeed-d188-4fba-9f3a-140ddc01e04c","year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:34.971723Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:943f6d00ff1e172410356543519e50c6b04b90168e052491057341904f958d0b","observation_id":"2a25a334-7bcd-4438-a130-1635d1cd73f4","resolution":{"observed_at":"2026-08-11T11:18:38.083369Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:37.887015Z","title":null,"venue":null,"work_id":"ce479737-1a72-4375-bd68-c6f8211ea264","year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:35.048004Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:fb697a8d2b7312136d2a5cd7213cb5f3133bb2ad734d122a810c323268e7f45e","observation_id":"b5020b83-286b-467c-982c-236f76503507","resolution":{"observed_at":"2026-08-11T11:18:37.933640Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-11T11:18:35.125284Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:35.125284Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:aca916f0a057b75f6483841d6c839a35d7fc47e479e688f8018f3b6d0bb1afc3","observation_id":"a0d322c3-7ddf-488a-92d3-30cc829093b1","resolution":{"observed_at":"2026-08-11T11:18:35.125284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.08729","last_updated":"2024-05-14T16:15:31Z","snapshot_observed_at":"2026-08-14T13:44:44.554315Z","submitted_at":"2024-05-14T16:15:31Z","title":"Targeted Augmentation for Low-Resource Event Extraction","version":1},"cited_work":{"arxiv_id":"2405.08729","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.08729","snapshot_observed_at":"2026-08-11T11:18:36.831877Z","title":"Targeted Augmentation for Low-Resource Event Extraction","venue":"cs.CL","work_id":"4b38405e-e525-4d9a-a2e7-87ab5fa957da","year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:35.195201Z"},"links":{"cited_paper":"/paper/2405.08729","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:e453e6b413d4c790b562376f511ff0da8851f6060339768fe9335b1144e78714","observation_id":"dd4af343-80ad-429e-9290-ec39c01783b8","resolution":{"observed_at":"2026-08-11T11:18:36.875301Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:35.270768Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:35.270768Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:483fe8c7b9d2d23c41b2eeffe3853fd5a2ee9966fe124b65ffd16cd82eda4cf1","observation_id":"12a41e6b-f95f-4888-aab3-327106820520","resolution":{"observed_at":"2026-08-11T11:18:35.270768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07682","last_updated":"2022-10-26T05:06:24Z","snapshot_observed_at":"2026-08-02T15:56:35.249569Z","submitted_at":"2022-06-15T17:32:01Z","title":"Emergent Abilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.07682","snapshot_observed_at":"2026-08-11T11:18:35.357071Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:35.357071Z"},"links":{"cited_paper":"/paper/2206.07682","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:8bb296bed9ef76568ec1749c6f067c91d0fade6f23c9fef0e68be2ff6d9ca64a","observation_id":"ce47fc5a-8e0d-4388-a1f8-7ece4d3a7a3a","resolution":{"observed_at":"2026-08-11T11:18:35.357071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-08-13T07:04:41.220509Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-11T11:18:35.574328Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:35.574328Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:5ceb4dd27f141c2fafa34ef1f57679638146c9cdb802ef0936ed42f47cbd52bb","observation_id":"d907da62-6237-4122-bedf-aa6fbfd84cc7","resolution":{"observed_at":"2026-08-11T11:18:35.574328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:35.605471Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:35.605471Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:a5edaa7bb4b488f052899853c71758a89193853e1a26ec393a7833ace749b765","observation_id":"6534863e-8749-4266-9e39-a0c25fb2a161","resolution":{"observed_at":"2026-08-11T11:18:35.605471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-13T04:24:51.821062Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-11T11:18:35.618509Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:35.618509Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:951c4ef62872c02a459f4d1fd5cbaf8629577334c65b22cea5ad5c8a90938f03","observation_id":"c249a302-567d-49ea-a5f7-c1bb3654e406","resolution":{"observed_at":"2026-08-11T11:18:35.618509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:37.855489Z","title":null,"venue":null,"work_id":"7093218e-d94a-4400-9135-a46f3e19ec15","year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:35.623284Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:5b75f67cb3d5db9a86d88f59042a4089aaedad944f6452985a0bd84b01605dfa","observation_id":"5b5803ed-e612-4788-adc5-db6412a8fda5","resolution":{"observed_at":"2026-08-11T11:18:37.859840Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.09336","last_updated":"2024-10-25T04:28:06Z","snapshot_observed_at":"2026-08-14T13:42:51.254797Z","submitted_at":"2023-11-15T19:52:11Z","title":"LLMRefine: Pinpointing and Refining Large Language Models via Fine-Grained Actionable Feedback","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.09336","snapshot_observed_at":"2026-08-11T11:18:35.661984Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:35.661984Z"},"links":{"cited_paper":"/paper/2311.09336","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:6a9d2f13a3514778c91e0714b18f106d7487109b3122a695eef6fa9308c75fa4","observation_id":"00868247-cc74-4295-8907-727268ca5f79","resolution":{"observed_at":"2026-08-11T11:18:35.661984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11690","last_updated":"2024-02-18T19:38:44Z","snapshot_observed_at":"2026-08-14T13:59:48.966916Z","submitted_at":"2024-02-18T19:38:44Z","title":"Vision-Flan: Scaling Human-Labeled Tasks in Visual Instruction Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11690","snapshot_observed_at":"2026-08-11T11:18:35.752639Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:35.752639Z"},"links":{"cited_paper":"/paper/2402.11690","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:7d3e925084ec9b4bfb89d88c0a5ac50bd25c13d59a3e424245158160759aeb98","observation_id":"91456423-fd33-4212-b3bb-c03357759183","resolution":{"observed_at":"2026-08-11T11:18:35.752639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:37.839702Z","title":null,"venue":null,"work_id":"58179095-ebb5-4d98-a291-cc034d394d34","year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:35.814140Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:46f4145fd281602981ee28feabe1c55b652566808de08f562ace3ad62ad01358","observation_id":"4a576643-f4d7-4392-9e30-84e5d858675d","resolution":{"observed_at":"2026-08-11T11:18:37.844906Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10773","last_updated":"2023-06-10T18:33:21Z","snapshot_observed_at":"2026-08-15T13:23:30.882526Z","submitted_at":"2022-12-21T05:17:06Z","title":"MultiInstruct: Improving Multi-Modal Zero-Shot Learning via Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10773","snapshot_observed_at":"2026-08-11T11:18:35.819567Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:35.819567Z"},"links":{"cited_paper":"/paper/2212.10773","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:fddf329edccab340dd22e1fc9f4db3e35669629c03a6203999beb30e02fd4b86","observation_id":"b12bfbe8-7a8c-43a0-a180-5215ad5abdc9","resolution":{"observed_at":"2026-08-11T11:18:35.819567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.04684","last_updated":"2025-06-20T16:50:07Z","snapshot_observed_at":"2026-08-14T13:43:40.409458Z","submitted_at":"2023-12-07T20:36:10Z","title":"LaRS: Latent Reasoning Skills for Chain-of-Thought Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.04684","snapshot_observed_at":"2026-08-11T11:18:35.824564Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:35.824564Z"},"links":{"cited_paper":"/paper/2312.04684","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:77cc39ae7efc8d20cb560f810fae61d9791aebdd4aefadd7df49e8d6b2e0b398","observation_id":"79b86308-ce03-4b75-b3ec-1a751303a4e9","resolution":{"observed_at":"2026-08-11T11:18:35.824564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15746","last_updated":"2023-10-24T11:40:34Z","snapshot_observed_at":"2026-08-14T13:44:19.183464Z","submitted_at":"2023-10-24T11:40:34Z","title":"Failures Pave the Way: Enhancing Large Language Models through Tuning-free Rule Accumulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15746","snapshot_observed_at":"2026-08-11T11:18:35.830611Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:35.830611Z"},"links":{"cited_paper":"/paper/2310.15746","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:82ddf16362aaa4e07f3da029c07948eee818dfb191b9f14eaae58732d5f3ddad","observation_id":"53543478-6a96-4a27-bf01-ae481adfb4ab","resolution":{"observed_at":"2026-08-11T11:18:35.830611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14725","last_updated":"2025-06-10T23:03:39Z","snapshot_observed_at":"2026-08-14T13:44:00.145510Z","submitted_at":"2023-05-24T05:01:48Z","title":"AMELI: Enhancing Multimodal Entity Linking with Fine-Grained Attributes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14725","snapshot_observed_at":"2026-08-11T11:18:35.835904Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:35.835904Z"},"links":{"cited_paper":"/paper/2305.14725","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:c06d2a9f8212df029dd72f3fcba4d1c67dbb22ec61b42b583053cbc388d4d808","observation_id":"868fcbe3-7a17-4c72-bf83-bd406355b332","resolution":{"observed_at":"2026-08-11T11:18:35.835904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:35.911096Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:35.911096Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:46d454c09322bcff631a4cbda0d7276902823125f3c5ac522ce3fe9fd9b1da3e","observation_id":"3c5f6611-d028-4253-976f-2c6e394e6f0b","resolution":{"observed_at":"2026-08-11T11:18:35.911096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02490","last_updated":"2024-12-01T05:46:03Z","snapshot_observed_at":"2026-08-08T03:31:37.699253Z","submitted_at":"2023-08-04T17:59:47Z","title":"MM-Vet: Evaluating Large Multimodal Models for Integrated Capabilities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.02490","snapshot_observed_at":"2026-08-11T11:18:36.009995Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:36.009995Z"},"links":{"cited_paper":"/paper/2308.02490","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:22ae32482c143c0ebc45a0a095377b584afe52d1b25e385d572475cdb51a7d56","observation_id":"dfdf7c73-b0c0-4137-9256-02c6d12a1a47","resolution":{"observed_at":"2026-08-11T11:18:36.009995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16502","last_updated":"2024-06-13T15:02:39Z","snapshot_observed_at":"2026-08-13T09:07:54.479155Z","submitted_at":"2023-11-27T17:33:21Z","title":"MMMU: A Massive Multi-discipline Multimodal Understanding and Reasoning Benchmark for Expert AGI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16502","snapshot_observed_at":"2026-08-11T11:18:36.136897Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:36.136897Z"},"links":{"cited_paper":"/paper/2311.16502","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:4c2b3a59084a886c7ae1aa148d801365c271abae8889c81e6b1e9973ff222458","observation_id":"f4c5ccf7-664d-4e9d-b1c0-7496d4af746b","resolution":{"observed_at":"2026-08-11T11:18:36.136897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:37.816136Z","title":null,"venue":null,"work_id":"6ba4c2cf-2b3e-49e9-9329-65db656e11ab","year":2019},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:36.143521Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:acfa5a5c2208be52500b0f30780ea1d4eb2ebf04bd0bfdbbeadf04bfaf422eff","observation_id":"5d057f1d-9e55-4c6c-a8ee-f70cb651424e","resolution":{"observed_at":"2026-08-11T11:18:37.820821Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12874","last_updated":"2024-08-12T00:38:22Z","snapshot_observed_at":"2026-08-14T13:44:01.487311Z","submitted_at":"2024-07-16T04:41:58Z","title":"SELF-GUIDE: Better Task-Specific Instruction Following via Self-Synthetic Finetuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12874","snapshot_observed_at":"2026-08-11T11:18:36.149022Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:36.149022Z"},"links":{"cited_paper":"/paper/2407.12874","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:a9d62bc31b86eb64926d617dad1f27873c15276dd3a235257dbc09605eba7dbf","observation_id":"24c92789-2acb-4a7f-a46b-009bd64377b1","resolution":{"observed_at":"2026-08-11T11:18:36.149022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07915","last_updated":"2024-03-20T16:17:02Z","snapshot_observed_at":"2026-08-14T05:35:40.487992Z","submitted_at":"2023-09-14T17:59:17Z","title":"MMICL: Empowering Vision-language Model with Multi-Modal In-Context Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07915","snapshot_observed_at":"2026-08-11T11:18:36.156440Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:36.156440Z"},"links":{"cited_paper":"/paper/2309.07915","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:a02998988e07d2c7ce4d1c2e426ca4b5d1258c518d396d7e9e48d2fd07821b50","observation_id":"b0b96954-b851-409c-8d63-955f851ffe3e","resolution":{"observed_at":"2026-08-11T11:18:36.156440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:36.184245Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:36.184245Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:535b394006563691456fcab42bd60503e5f54f58c0de0777ef3ed1496d8ae960","observation_id":"701e0841-de9c-4727-9d8f-89b27a75bf17","resolution":{"observed_at":"2026-08-11T11:18:36.184245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:36.277215Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:36.277215Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:be7477953659808a6827d8154563255b460709b3ea2d25e7181b2664595cf48f","observation_id":"01cd7e82-280f-4a01-a65a-27d8ffd404a3","resolution":{"observed_at":"2026-08-11T11:18:36.277215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:36.307821Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:36.307821Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:4b4122a027da1aa1491735f5db75f4fac51255573051b8868a97f0a67898ea0e","observation_id":"52e73df0-8696-4416-bcbd-103a50a328c9","resolution":{"observed_at":"2026-08-11T11:18:36.307821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:36.313017Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:36.313017Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:218b0d025883bb4c98f7fcb268822d8c8fca6063fb5d3d1a7d74c597caf1c784","observation_id":"2785296a-3c9c-4646-986c-4d1da57a320d","resolution":{"observed_at":"2026-08-11T11:18:36.313017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning"},"reference_resolution":{"displayed":88,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":82,"verified_exact":6,"verified_fuzzy":0},"total_outbound_references":88},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 88 of 88 outbound references and 0 inbound Pith citation observations for arXiv:2412.15652."}