{"as_of":"2026-08-09T15:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:debe17098c6acfcf40e3a37055c8628904ec5c9148879b5bf3db22bd1c4ec0e5","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":16,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T15:53:24.202171Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T00:35:10.154544Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2211.09699","last_updated":"2023-08-17T21:43:24Z","snapshot_observed_at":"2026-08-05T17:48:17.937618Z","submitted_at":"2022-11-15T19:07:53Z","title":"PromptCap: Prompt-Guided Task-Aware Image Captioning","version":4},"cited_work":{"arxiv_id":"2211.09699","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.09699","snapshot_observed_at":"2026-07-01T00:35:10.154544Z","title":"A., and Luo, J","venue":null,"work_id":"0b312d17-4e70-4d0d-ae07-c4a07a338426","year":2022},"citing_paper":{"arxiv_id":"2301.12652","last_updated":"2023-05-24T05:08:07Z","snapshot_observed_at":"2026-08-02T02:08:12.414817Z","submitted_at":"2023-01-30T04:18:09Z","title":"REPLUG: Retrieval-Augmented Black-Box Language Models","version":4},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-05-17T12:41:53.833754Z"},"links":{"cited_paper":"/paper/2211.09699","citing_paper":"/paper/2301.12652"},"observation_digest":"sha256:69d515dde36d0f21d97168e7f0789fc95910eac3b5fb36c5356bb0760bb9e16b","observation_id":"9ecfa34d-365a-404f-b7ee-4bcbe5998cb7","resolution":{"observed_at":"2026-05-17T12:41:54.142073Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09699","last_updated":"2023-08-17T21:43:24Z","snapshot_observed_at":"2026-08-05T17:48:17.937618Z","submitted_at":"2022-11-15T19:07:53Z","title":"PromptCap: Prompt-Guided Task-Aware Image Captioning","version":4},"cited_work":{"arxiv_id":"2211.09699","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.09699","snapshot_observed_at":"2026-07-01T00:35:10.154544Z","title":"A., and Luo, J","venue":null,"work_id":"0b312d17-4e70-4d0d-ae07-c4a07a338426","year":2022},"citing_paper":{"arxiv_id":"2303.08128","last_updated":"2023-03-14T17:57:47Z","snapshot_observed_at":"2026-08-02T12:31:34.577778Z","submitted_at":"2023-03-14T17:57:47Z","title":"ViperGPT: Visual Inference via Python Execution for Reasoning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-17T18:15:14.382011Z"},"links":{"cited_paper":"/paper/2211.09699","citing_paper":"/paper/2303.08128"},"observation_digest":"sha256:bc0546c4708de204533d90e48c896255518dc8b11c3ce87c188cf26ac1d61176","observation_id":"f2a92179-2fc7-47e5-9ef9-d475416e8044","resolution":{"observed_at":"2026-05-17T18:15:14.634893Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09699","last_updated":"2023-08-17T21:43:24Z","snapshot_observed_at":"2026-08-05T17:48:17.937618Z","submitted_at":"2022-11-15T19:07:53Z","title":"PromptCap: Prompt-Guided Task-Aware Image Captioning","version":4},"cited_work":{"arxiv_id":"2211.09699","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.09699","snapshot_observed_at":"2026-07-01T00:35:10.154544Z","title":"A., and Luo, J","venue":null,"work_id":"0b312d17-4e70-4d0d-ae07-c4a07a338426","year":2022},"citing_paper":{"arxiv_id":"2303.11381","last_updated":"2023-03-20T18:31:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-20T18:31:47Z","title":"MM-REACT: Prompting ChatGPT for Multimodal Reasoning and Action","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-14T01:17:58.678036Z"},"links":{"cited_paper":"/paper/2211.09699","citing_paper":"/paper/2303.11381"},"observation_digest":"sha256:274c828df7376e395b3a0654bcb12c9abed40c8f03432fc6a3aae4df5cb9bafc","observation_id":"fd4f8231-d625-484e-aed9-a7820f8d7232","resolution":{"observed_at":"2026-05-14T01:17:58.759014Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09699","last_updated":"2023-08-17T21:43:24Z","snapshot_observed_at":"2026-08-05T17:48:17.937618Z","submitted_at":"2022-11-15T19:07:53Z","title":"PromptCap: Prompt-Guided Task-Aware Image Captioning","version":4},"cited_work":{"arxiv_id":"2211.09699","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.09699","snapshot_observed_at":"2026-07-01T00:35:10.154544Z","title":"A., and Luo, J","venue":null,"work_id":"0b312d17-4e70-4d0d-ae07-c4a07a338426","year":2022},"citing_paper":{"arxiv_id":"2404.12390","last_updated":"2024-07-03T08:44:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-04-18T17:59:54Z","title":"BLINK: Multimodal Large Language Models Can See but Not Perceive","version":4},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-15T20:18:15.439163Z"},"links":{"cited_paper":"/paper/2211.09699","citing_paper":"/paper/2404.12390"},"observation_digest":"sha256:ea86984d0a2c080c7285a16b1c9bac3b614fd8cfe6ae49d74bd3527ff14973f1","observation_id":"9a16ecd1-667b-4023-b391-602484d52b8b","resolution":{"observed_at":"2026-05-15T20:18:15.672292Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09699","last_updated":"2023-08-17T21:43:24Z","snapshot_observed_at":"2026-08-05T17:48:17.937618Z","submitted_at":"2022-11-15T19:07:53Z","title":"PromptCap: Prompt-Guided Task-Aware Image Captioning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09699","snapshot_observed_at":"2026-08-08T15:53:24.202171Z","title":"Promptcap: Prompt-guided task-aware image captioning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.06327","last_updated":"2025-02-10T10:28:11Z","snapshot_observed_at":"2026-08-08T15:45:52.523293Z","submitted_at":"2025-02-10T10:28:11Z","title":"Prompt-Driven Continual Graph Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T15:53:24.202171Z"},"links":{"cited_paper":"/paper/2211.09699","citing_paper":"/paper/2502.06327"},"observation_digest":"sha256:49a40e3c339d8cd0ea7ef74a092370bedf216e919d20657c23e3a58f4accdc7f","observation_id":"b7089b11-485d-499a-95c0-5986a3eb4d3e","resolution":{"observed_at":"2026-08-08T15:53:24.202171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09699","last_updated":"2023-08-17T21:43:24Z","snapshot_observed_at":"2026-08-05T17:48:17.937618Z","submitted_at":"2022-11-15T19:07:53Z","title":"PromptCap: Prompt-Guided Task-Aware Image Captioning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09699","snapshot_observed_at":"2026-08-07T14:21:43.951510Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19354","last_updated":"2025-05-25T23:00:30Z","snapshot_observed_at":"2026-08-08T01:50:46.330994Z","submitted_at":"2025-05-25T23:00:30Z","title":"GC-KBVQA: A New Four-Stage Framework for Enhancing Knowledge Based Visual Question Answering Performance","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T14:21:43.951510Z"},"links":{"cited_paper":"/paper/2211.09699","citing_paper":"/paper/2505.19354"},"observation_digest":"sha256:bae06b3421de010a807d1cb991900769053b78eb58a3ad252d4c7b8fc4d6ee5c","observation_id":"fd3227d4-e8d7-4861-9073-fe3ae9c5e2cf","resolution":{"observed_at":"2026-08-07T14:21:43.951510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09699","last_updated":"2023-08-17T21:43:24Z","snapshot_observed_at":"2026-08-05T17:48:17.937618Z","submitted_at":"2022-11-15T19:07:53Z","title":"PromptCap: Prompt-Guided Task-Aware Image Captioning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09699","snapshot_observed_at":"2026-08-07T14:17:33.369845Z","title":"Promptcap: Prompt-guided task-aware image captioning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19415","last_updated":"2025-05-27T20:10:09Z","snapshot_observed_at":"2026-08-07T14:12:18.054397Z","submitted_at":"2025-05-26T02:07:24Z","title":"MMIG-Bench: Towards Comprehensive and Explainable Evaluation of Multi-Modal Image Generation Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:33.369845Z"},"links":{"cited_paper":"/paper/2211.09699","citing_paper":"/paper/2505.19415"},"observation_digest":"sha256:67bb1106bd29537b950cb32075a367d5ea29d0d2ffd0a3bd620c8c6fa9d7861c","observation_id":"d55fa72d-bf2f-4a12-959e-5e0f50f827f7","resolution":{"observed_at":"2026-08-07T14:17:33.369845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09699","last_updated":"2023-08-17T21:43:24Z","snapshot_observed_at":"2026-08-05T17:48:17.937618Z","submitted_at":"2022-11-15T19:07:53Z","title":"PromptCap: Prompt-Guided Task-Aware Image Captioning","version":4},"cited_work":{"arxiv_id":"2211.09699","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.09699","snapshot_observed_at":"2026-07-01T00:35:10.154544Z","title":"A., and Luo, J","venue":null,"work_id":"0b312d17-4e70-4d0d-ae07-c4a07a338426","year":2022},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"cited_paper":"/paper/2211.09699","citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:e52aee9d23aa2f7fef0f7d8607c0dc7d0ba814541a1b352989a4325a229caf74","observation_id":"fc7e8496-8281-43bf-bcc8-769778750263","resolution":{"observed_at":"2026-05-13T17:23:02.401153Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09699","last_updated":"2023-08-17T21:43:24Z","snapshot_observed_at":"2026-08-05T17:48:17.937618Z","submitted_at":"2022-11-15T19:07:53Z","title":"PromptCap: Prompt-Guided Task-Aware Image Captioning","version":4},"cited_work":{"arxiv_id":"2211.09699","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.09699","snapshot_observed_at":"2026-07-01T00:35:10.154544Z","title":"A., and Luo, J","venue":null,"work_id":"0b312d17-4e70-4d0d-ae07-c4a07a338426","year":2022},"citing_paper":{"arxiv_id":"2604.10500","last_updated":"2026-05-12T11:20:49Z","snapshot_observed_at":"2026-07-06T22:59:05.519456Z","submitted_at":"2026-04-12T07:14:30Z","title":"Visual Enhanced Depth Scaling for Multimodal Latent Reasoning","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T16:46:36.010169Z"},"links":{"cited_paper":"/paper/2211.09699","citing_paper":"/paper/2604.10500"},"observation_digest":"sha256:411c9b7a5b899d11c8343842639c28601b5f3d7c706002a42a8d308dfd986f78","observation_id":"dbbb60ad-08af-4e87-9db6-b671c70de804","resolution":{"observed_at":"2026-05-11T08:11:04.452618Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09699","last_updated":"2023-08-17T21:43:24Z","snapshot_observed_at":"2026-08-05T17:48:17.937618Z","submitted_at":"2022-11-15T19:07:53Z","title":"PromptCap: Prompt-Guided Task-Aware Image Captioning","version":4},"cited_work":{"arxiv_id":"2211.09699","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.09699","snapshot_observed_at":"2026-07-01T00:35:10.154544Z","title":"A., and Luo, J","venue":null,"work_id":"0b312d17-4e70-4d0d-ae07-c4a07a338426","year":2022},"citing_paper":{"arxiv_id":"2604.10500","last_updated":"2026-05-12T11:20:49Z","snapshot_observed_at":"2026-07-06T22:59:05.519456Z","submitted_at":"2026-04-12T07:14:30Z","title":"Visual Enhanced Depth Scaling for Multimodal Latent Reasoning","version":4},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-12T04:38:06.774877Z"},"links":{"cited_paper":"/paper/2211.09699","citing_paper":"/paper/2604.10500"},"observation_digest":"sha256:aa3c16c314b4c0f8e914ffbc50f4d1bd88d56cad8d3fef66b8013693d16fde76","observation_id":"045090c8-b373-418c-87c2-d776aab5cb79","resolution":{"observed_at":"2026-05-12T06:01:26.873090Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09699","last_updated":"2023-08-17T21:43:24Z","snapshot_observed_at":"2026-08-05T17:48:17.937618Z","submitted_at":"2022-11-15T19:07:53Z","title":"PromptCap: Prompt-Guided Task-Aware Image Captioning","version":4},"cited_work":{"arxiv_id":"2211.09699","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.09699","snapshot_observed_at":"2026-07-01T00:35:10.154544Z","title":"A., and Luo, J","venue":null,"work_id":"0b312d17-4e70-4d0d-ae07-c4a07a338426","year":2022},"citing_paper":{"arxiv_id":"2604.10500","last_updated":"2026-05-12T11:20:49Z","snapshot_observed_at":"2026-07-06T22:59:05.519456Z","submitted_at":"2026-04-12T07:14:30Z","title":"Visual Enhanced Depth Scaling for Multimodal Latent Reasoning","version":5},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-13T07:26:59.917150Z"},"links":{"cited_paper":"/paper/2211.09699","citing_paper":"/paper/2604.10500"},"observation_digest":"sha256:7e3c3968083531329d31714013693b7ddfc35a6d80854835a04e43057f5b5d46","observation_id":"44b1e129-d23c-4b4a-adaf-399b9e26d85a","resolution":{"observed_at":"2026-05-13T07:27:29.401352Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09699","last_updated":"2023-08-17T21:43:24Z","snapshot_observed_at":"2026-08-05T17:48:17.937618Z","submitted_at":"2022-11-15T19:07:53Z","title":"PromptCap: Prompt-Guided Task-Aware Image Captioning","version":4},"cited_work":{"arxiv_id":"2211.09699","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.09699","snapshot_observed_at":"2026-07-01T00:35:10.154544Z","title":"A., and Luo, J","venue":null,"work_id":"0b312d17-4e70-4d0d-ae07-c4a07a338426","year":2022},"citing_paper":{"arxiv_id":"2605.01733","last_updated":"2026-06-11T12:49:38Z","snapshot_observed_at":"2026-08-01T11:41:15.711922Z","submitted_at":"2026-05-03T06:09:04Z","title":"GEASS: Gated Evidence-Adaptive Selective Caption Trust for Vision-Language Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-21T00:41:58.198403Z"},"links":{"cited_paper":"/paper/2211.09699","citing_paper":"/paper/2605.01733"},"observation_digest":"sha256:6011fe644eae6dbb16040f6abd2347d70c440a9c0c287a86489b4fc7131f6ec7","observation_id":"89982f76-0757-4fac-b735-22112e3c952e","resolution":{"observed_at":"2026-05-21T00:43:53.579809Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09699","last_updated":"2023-08-17T21:43:24Z","snapshot_observed_at":"2026-08-05T17:48:17.937618Z","submitted_at":"2022-11-15T19:07:53Z","title":"PromptCap: Prompt-Guided Task-Aware Image Captioning","version":4},"cited_work":{"arxiv_id":"2211.09699","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.09699","snapshot_observed_at":"2026-07-01T00:35:10.154544Z","title":"A., and Luo, J","venue":null,"work_id":"0b312d17-4e70-4d0d-ae07-c4a07a338426","year":2022},"citing_paper":{"arxiv_id":"2605.01733","last_updated":"2026-06-11T12:49:38Z","snapshot_observed_at":"2026-08-01T11:41:15.711922Z","submitted_at":"2026-05-03T06:09:04Z","title":"GEASS: Gated Evidence-Adaptive Selective Caption Trust for Vision-Language Models","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-01T00:32:49.666202Z"},"links":{"cited_paper":"/paper/2211.09699","citing_paper":"/paper/2605.01733"},"observation_digest":"sha256:45ea6ff9df898c0c2fc5c5956bd2c4ef5f50ef3c2bd34eab56b8146d66089e2e","observation_id":"b6103e5e-9a70-4702-bbf2-0ef7b5bd78bd","resolution":{"observed_at":"2026-07-01T00:35:10.156265Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09699","last_updated":"2023-08-17T21:43:24Z","snapshot_observed_at":"2026-08-05T17:48:17.937618Z","submitted_at":"2022-11-15T19:07:53Z","title":"PromptCap: Prompt-Guided Task-Aware Image Captioning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09699","snapshot_observed_at":"2026-08-01T02:33:36.014715Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25422","last_updated":"2026-07-28T08:20:40Z","snapshot_observed_at":"2026-08-01T02:33:34.521730Z","submitted_at":"2026-07-28T08:20:40Z","title":"Salient Knowledge Pathways: Sparse Cross-Modal Routing for Efficient Knowledge-Intensive Multimodal Question Answering","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T02:33:36.014715Z"},"links":{"cited_paper":"/paper/2211.09699","citing_paper":"/paper/2607.25422"},"observation_digest":"sha256:415a5b22e466cedff20dd0b206d10c7845271c472a5cb802bdf1a598e6aa0d29","observation_id":"4d739551-ebd8-4a51-b91b-f911deee577d","resolution":{"observed_at":"2026-08-01T02:33:36.014715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09699","last_updated":"2023-08-17T21:43:24Z","snapshot_observed_at":"2026-08-05T17:48:17.937618Z","submitted_at":"2022-11-15T19:07:53Z","title":"PromptCap: Prompt-Guided Task-Aware Image Captioning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09699","snapshot_observed_at":"2026-08-01T02:33:36.018539Z","title":"URL https://arxiv","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2607.25422","last_updated":"2026-07-28T08:20:40Z","snapshot_observed_at":"2026-08-01T02:33:34.521730Z","submitted_at":"2026-07-28T08:20:40Z","title":"Salient Knowledge Pathways: Sparse Cross-Modal Routing for Efficient Knowledge-Intensive Multimodal Question Answering","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-01T02:33:36.018539Z"},"links":{"cited_paper":"/paper/2211.09699","citing_paper":"/paper/2607.25422"},"observation_digest":"sha256:30a26fe281e6810a415384df2a9213cb35bae0e42eb1468d053cc6c4f8b92ba3","observation_id":"98f682b3-5e4a-4352-978e-dfc17d2b0022","resolution":{"observed_at":"2026-08-01T02:33:36.018539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09699","last_updated":"2023-08-17T21:43:24Z","snapshot_observed_at":"2026-08-05T17:48:17.937618Z","submitted_at":"2022-11-15T19:07:53Z","title":"PromptCap: Prompt-Guided Task-Aware Image Captioning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09699","snapshot_observed_at":"2026-08-08T12:16:44.671113Z","title":"Promptcap: Prompt-guided task- aware image captioning.arXiv preprint arXiv:2211.09699,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T14:10:36.494990Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.671113Z"},"links":{"cited_paper":"/paper/2211.09699","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:ae146b13b4f483d718aa08b82c2dc57589187a9871b1593a8f68954bf68bb3f3","observation_id":"1f83d1d8-d99a-4b81-a0da-95d0766194d8","resolution":{"observed_at":"2026-08-08T12:16:44.671113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2211.09699/citation-record","integrity":"/paper/2211.09699/integrity","json":"/paper/2211.09699/citation-record.json","paper":"/paper/2211.09699"},"outbound":[],"paper":{"arxiv_id":"2211.09699","last_updated":"2023-08-17T21:43:24Z","latest_version":4,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-05T17:48:17.937618Z","submitted_at":"2022-11-15T19:07:53Z","title":"PromptCap: Prompt-Guided Task-Aware Image Captioning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 16 inbound Pith citation observations for arXiv:2211.09699."}