{"as_of":"2026-08-18T23:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a4c26002675d3d3866d2d3778d9d5b59002407b8cbcf0577e0f228761483b997","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":18,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T04:43:11.242711Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T19:56:10.525466Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2211.11559","last_updated":"2022-11-18T18:50:09Z","snapshot_observed_at":"2026-08-18T17:26:02.275984Z","submitted_at":"2022-11-18T18:50:09Z","title":"Visual Programming: Compositional visual reasoning without training","version":1},"cited_work":{"arxiv_id":"2211.11559","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.11559","snapshot_observed_at":"2026-07-01T19:56:10.525466Z","title":"Visual programming: Compositional visual reason- ing without training","venue":null,"work_id":"bad08eed-22a6-47f3-99c5-522dedf1ce8c","year":2022},"citing_paper":{"arxiv_id":"2303.08128","last_updated":"2023-03-14T17:57:47Z","snapshot_observed_at":"2026-08-02T12:31:34.577778Z","submitted_at":"2023-03-14T17:57:47Z","title":"ViperGPT: Visual Inference via Python Execution for Reasoning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-17T18:15:14.382011Z"},"links":{"cited_paper":"/paper/2211.11559","citing_paper":"/paper/2303.08128"},"observation_digest":"sha256:a6c24387a69c59391a8bbcfed10800b5866dcd667357fc2d59015ca612d370c6","observation_id":"42e98bda-38d9-4163-a74f-459177b6fbbd","resolution":{"observed_at":"2026-05-17T18:15:14.565790Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.11559","last_updated":"2022-11-18T18:50:09Z","snapshot_observed_at":"2026-08-18T17:26:02.275984Z","submitted_at":"2022-11-18T18:50:09Z","title":"Visual Programming: Compositional visual reasoning without training","version":1},"cited_work":{"arxiv_id":"2211.11559","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.11559","snapshot_observed_at":"2026-07-01T19:56:10.525466Z","title":"Visual programming: Compositional visual reason- ing without training","venue":null,"work_id":"bad08eed-22a6-47f3-99c5-522dedf1ce8c","year":2022},"citing_paper":{"arxiv_id":"2303.17580","last_updated":"2023-12-03T18:17:21Z","snapshot_observed_at":"2026-08-12T12:50:51.005571Z","submitted_at":"2023-03-30T17:48:28Z","title":"HuggingGPT: Solving AI Tasks with ChatGPT and its Friends in Hugging Face","version":4},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-14T00:06:45.440071Z"},"links":{"cited_paper":"/paper/2211.11559","citing_paper":"/paper/2303.17580"},"observation_digest":"sha256:8b2a2d3c3e36f784ea53116e0e5f3f45718288efc3dba103c9ab31ad49c90357","observation_id":"8c83b403-160f-405f-9f48-0c91077ad0af","resolution":{"observed_at":"2026-05-14T00:06:45.617624Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.11559","last_updated":"2022-11-18T18:50:09Z","snapshot_observed_at":"2026-08-18T17:26:02.275984Z","submitted_at":"2022-11-18T18:50:09Z","title":"Visual Programming: Compositional visual reasoning without training","version":1},"cited_work":{"arxiv_id":"2211.11559","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.11559","snapshot_observed_at":"2026-07-01T19:56:10.525466Z","title":"Visual programming: Compositional visual reason- ing without training","venue":null,"work_id":"bad08eed-22a6-47f3-99c5-522dedf1ce8c","year":2022},"citing_paper":{"arxiv_id":"2304.08485","last_updated":"2023-12-11T17:46:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-17T17:59:25Z","title":"Visual Instruction Tuning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-11T08:22:03.403362Z"},"links":{"cited_paper":"/paper/2211.11559","citing_paper":"/paper/2304.08485"},"observation_digest":"sha256:45d6fd31f20ccdcf78386632b3cfb4cfbd37999ae7ed5ce4be824798174f5d3f","observation_id":"1f21bfbc-ee16-4bac-8f20-251339993da7","resolution":{"observed_at":"2026-05-11T08:22:03.757506Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.11559","last_updated":"2022-11-18T18:50:09Z","snapshot_observed_at":"2026-08-18T17:26:02.275984Z","submitted_at":"2022-11-18T18:50:09Z","title":"Visual Programming: Compositional visual reasoning without training","version":1},"cited_work":{"arxiv_id":"2211.11559","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.11559","snapshot_observed_at":"2026-07-01T19:56:10.525466Z","title":"Visual programming: Compositional visual reason- ing without training","venue":null,"work_id":"bad08eed-22a6-47f3-99c5-522dedf1ce8c","year":2022},"citing_paper":{"arxiv_id":"2304.15010","last_updated":"2023-04-28T17:59:25Z","snapshot_observed_at":"2026-08-12T23:40:42.885633Z","submitted_at":"2023-04-28T17:59:25Z","title":"LLaMA-Adapter V2: Parameter-Efficient Visual Instruction Model","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-15T08:41:04.743886Z"},"links":{"cited_paper":"/paper/2211.11559","citing_paper":"/paper/2304.15010"},"observation_digest":"sha256:a2731501772c56419edd4c1e24239ea8e2c151cdca638e8dd2571bd43e1ebeb8","observation_id":"f0a27056-2b7e-4fe8-b71c-96721284a634","resolution":{"observed_at":"2026-05-15T08:41:04.873384Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.11559","last_updated":"2022-11-18T18:50:09Z","snapshot_observed_at":"2026-08-18T17:26:02.275984Z","submitted_at":"2022-11-18T18:50:09Z","title":"Visual Programming: Compositional visual reasoning without training","version":1},"cited_work":{"arxiv_id":"2211.11559","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.11559","snapshot_observed_at":"2026-07-01T19:56:10.525466Z","title":"Visual programming: Compositional visual reason- ing without training","venue":null,"work_id":"bad08eed-22a6-47f3-99c5-522dedf1ce8c","year":2022},"citing_paper":{"arxiv_id":"2407.08101","last_updated":"2026-04-14T18:39:42Z","snapshot_observed_at":"2026-08-16T10:30:04.240504Z","submitted_at":"2024-07-11T00:10:45Z","title":"What to Say and When to Say it: Live Fitness Coaching as a Testbed for Situated Interaction","version":5},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-23T22:51:08.753650Z"},"links":{"cited_paper":"/paper/2211.11559","citing_paper":"/paper/2407.08101"},"observation_digest":"sha256:caea763e01c62808bf90d7353600121d05bab4f02e9bf616f22fbf6c7f2e61a2","observation_id":"f8603a51-e249-4eaa-9a65-c1ee18503d9a","resolution":{"observed_at":"2026-05-23T22:53:33.145856Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.11559","last_updated":"2022-11-18T18:50:09Z","snapshot_observed_at":"2026-08-18T17:26:02.275984Z","submitted_at":"2022-11-18T18:50:09Z","title":"Visual Programming: Compositional visual reasoning without training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.11559","snapshot_observed_at":"2026-08-11T20:07:35.037174Z","title":"Visual programming: Compositional visual reasoning without training","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.07802","last_updated":"2024-12-08T20:46:23Z","snapshot_observed_at":"2026-08-14T10:59:45.317112Z","submitted_at":"2024-12-08T20:46:23Z","title":"Language Model as Visual Explainer","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T20:07:35.037174Z"},"links":{"cited_paper":"/paper/2211.11559","citing_paper":"/paper/2412.07802"},"observation_digest":"sha256:443cc3d182c8d3d14dfed50ccb01b29746784bb6614cf6adc62433eccae91168","observation_id":"a467ee9f-2e36-41dd-b523-95bcc042a8fd","resolution":{"observed_at":"2026-08-11T20:07:35.037174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.11559","last_updated":"2022-11-18T18:50:09Z","snapshot_observed_at":"2026-08-18T17:26:02.275984Z","submitted_at":"2022-11-18T18:50:09Z","title":"Visual Programming: Compositional visual reasoning without training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.11559","snapshot_observed_at":"2026-08-11T12:13:21.402018Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.14515","last_updated":"2024-12-19T04:26:45Z","snapshot_observed_at":"2026-08-15T00:26:29.236475Z","submitted_at":"2024-12-19T04:26:45Z","title":"Relational Programming with Foundation Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T12:13:21.402018Z"},"links":{"cited_paper":"/paper/2211.11559","citing_paper":"/paper/2412.14515"},"observation_digest":"sha256:77c0ced68bd280a99026ed02b57918593e09c5e0e9696bd6dd41b2dd3454f29f","observation_id":"28e812d9-a7f9-409e-9fad-6f9edc821321","resolution":{"observed_at":"2026-08-11T12:13:21.402018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.11559","last_updated":"2022-11-18T18:50:09Z","snapshot_observed_at":"2026-08-18T17:26:02.275984Z","submitted_at":"2022-11-18T18:50:09Z","title":"Visual Programming: Compositional visual reasoning without training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.11559","snapshot_observed_at":"2026-08-11T14:59:01.771294Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.18619","last_updated":"2024-12-30T03:00:30Z","snapshot_observed_at":"2026-08-17T08:41:51.069276Z","submitted_at":"2024-12-16T05:02:25Z","title":"Next Token Prediction Towards Multimodal Intelligence: A Comprehensive Survey","version":2},"reference_index":145,"source":"pdf_text","source_observed_at":"2026-08-11T14:59:01.771294Z"},"links":{"cited_paper":"/paper/2211.11559","citing_paper":"/paper/2412.18619"},"observation_digest":"sha256:787e21cfb512ef6ece0cce262794044d28c09d16de0246c8793dbeb5283dd7f3","observation_id":"8e207c62-c1f2-4204-a0ec-8178ec26d481","resolution":{"observed_at":"2026-08-11T14:59:01.771294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.11559","last_updated":"2022-11-18T18:50:09Z","snapshot_observed_at":"2026-08-18T17:26:02.275984Z","submitted_at":"2022-11-18T18:50:09Z","title":"Visual Programming: Compositional visual reasoning without training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.11559","snapshot_observed_at":"2026-08-10T15:17:54.047245Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.14210","last_updated":"2025-01-24T03:28:37Z","snapshot_observed_at":"2026-08-15T19:00:23.522091Z","submitted_at":"2025-01-24T03:28:37Z","title":"PuzzleGPT: Emulating Human Puzzle-Solving Ability for Time and Location Prediction","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-10T15:17:54.047245Z"},"links":{"cited_paper":"/paper/2211.11559","citing_paper":"/paper/2501.14210"},"observation_digest":"sha256:17ff8f4f9e0e27c2a6891d4e500b6ad020965d6ec8d019d790e90645cbf588b0","observation_id":"e413db83-12a3-4a93-b623-a79f492e4b8f","resolution":{"observed_at":"2026-08-10T15:17:54.047245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.11559","last_updated":"2022-11-18T18:50:09Z","snapshot_observed_at":"2026-08-18T17:26:02.275984Z","submitted_at":"2022-11-18T18:50:09Z","title":"Visual Programming: Compositional visual reasoning without training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.11559","snapshot_observed_at":"2026-08-16T04:43:11.242711Z","title":"Visual programming: Compositional visual reasoning without training, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.00759","last_updated":"2025-05-12T20:46:35Z","snapshot_observed_at":"2026-08-16T09:38:06.751547Z","submitted_at":"2025-05-01T17:47:55Z","title":"Multi-Modal Language Models as Text-to-Image Model Evaluators","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-16T04:43:11.242711Z"},"links":{"cited_paper":"/paper/2211.11559","citing_paper":"/paper/2505.00759"},"observation_digest":"sha256:501acb839b9408cab5c5d4ad67e0a060c1a9ece6288a4c3a5a6d43b8e6de96de","observation_id":"ffe77042-955f-4f49-b8d4-e540e43edcf0","resolution":{"observed_at":"2026-08-16T04:43:11.242711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.11559","last_updated":"2022-11-18T18:50:09Z","snapshot_observed_at":"2026-08-18T17:26:02.275984Z","submitted_at":"2022-11-18T18:50:09Z","title":"Visual Programming: Compositional visual reasoning without training","version":1},"cited_work":{"arxiv_id":"2211.11559","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.11559","snapshot_observed_at":"2026-07-01T19:56:10.525466Z","title":"Visual programming: Compositional visual reason- ing without training","venue":null,"work_id":"bad08eed-22a6-47f3-99c5-522dedf1ce8c","year":2022},"citing_paper":{"arxiv_id":"2505.23678","last_updated":"2026-05-15T17:27:46Z","snapshot_observed_at":"2026-08-15T11:40:43.216223Z","submitted_at":"2025-05-29T17:20:26Z","title":"Grounded Reinforcement Learning for Visual Reasoning","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-22T01:05:18.801388Z"},"links":{"cited_paper":"/paper/2211.11559","citing_paper":"/paper/2505.23678"},"observation_digest":"sha256:160b38e05c30719b7b2d9c4d0e524a356e8ad5ebdd2af71d9dcabf4463c8d24a","observation_id":"212acf97-e428-47db-ad61-4957bd06036c","resolution":{"observed_at":"2026-05-22T01:05:52.237592Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.11559","last_updated":"2022-11-18T18:50:09Z","snapshot_observed_at":"2026-08-18T17:26:02.275984Z","submitted_at":"2022-11-18T18:50:09Z","title":"Visual Programming: Compositional visual reasoning without training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.11559","snapshot_observed_at":"2026-08-06T14:33:32.978926Z","title":"Visual programming: Compositional visual reasoning without training","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22933","last_updated":"2025-07-24T16:27:38Z","snapshot_observed_at":"2026-08-15T15:23:34.215982Z","submitted_at":"2025-07-24T16:27:38Z","title":"Augmented Vision-Language Models: A Systematic Review","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T14:33:32.978926Z"},"links":{"cited_paper":"/paper/2211.11559","citing_paper":"/paper/2507.22933"},"observation_digest":"sha256:3d58a8c2b9ee06b39aebfc9e0a4dc0458cec85c2eadb83915b7d5438e9c8f62e","observation_id":"d3a5bc0b-4cf7-4701-9138-2d6a1f413096","resolution":{"observed_at":"2026-08-06T14:33:32.978926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.11559","last_updated":"2022-11-18T18:50:09Z","snapshot_observed_at":"2026-08-18T17:26:02.275984Z","submitted_at":"2022-11-18T18:50:09Z","title":"Visual Programming: Compositional visual reasoning without training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.11559","snapshot_observed_at":"2026-08-06T12:18:30.875408Z","title":"Visual programming: Compositional visual reasoning without training.arXiv preprint arXiv:2211.11559, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.03722","last_updated":"2025-07-29T15:55:23Z","snapshot_observed_at":"2026-08-15T00:10:12.689212Z","submitted_at":"2025-07-29T15:55:23Z","title":"Multimodal Video Emotion Recognition with Reliable Reasoning Priors","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T12:18:30.875408Z"},"links":{"cited_paper":"/paper/2211.11559","citing_paper":"/paper/2508.03722"},"observation_digest":"sha256:d8936cf06095b586a8d7f2ea756670997902517ec11ed0c77ae57f7e827e8063","observation_id":"acbf79e9-a453-445c-81e2-2cf1ccce4be1","resolution":{"observed_at":"2026-08-06T12:18:30.875408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.11559","last_updated":"2022-11-18T18:50:09Z","snapshot_observed_at":"2026-08-18T17:26:02.275984Z","submitted_at":"2022-11-18T18:50:09Z","title":"Visual Programming: Compositional visual reasoning without training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.11559","snapshot_observed_at":"2026-08-05T12:27:04.935858Z","title":"Visual programming: Compositional visual reasoning without training","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.01656","last_updated":"2025-09-01T17:57:49Z","snapshot_observed_at":"2026-08-16T02:02:56.335890Z","submitted_at":"2025-09-01T17:57:49Z","title":"Reinforced Visual Perception with Tools","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T12:27:04.935858Z"},"links":{"cited_paper":"/paper/2211.11559","citing_paper":"/paper/2509.01656"},"observation_digest":"sha256:67d9fc0b07088133f8719b98fe8a79c8ae40a11620ab5338fa7a912c57f19c0f","observation_id":"843ab866-a909-45f7-825e-7ecfb8bfde60","resolution":{"observed_at":"2026-08-05T12:27:04.935858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.11559","last_updated":"2022-11-18T18:50:09Z","snapshot_observed_at":"2026-08-18T17:26:02.275984Z","submitted_at":"2022-11-18T18:50:09Z","title":"Visual Programming: Compositional visual reasoning without training","version":1},"cited_work":{"arxiv_id":"2211.11559","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.11559","snapshot_observed_at":"2026-07-01T19:56:10.525466Z","title":"Visual programming: Compositional visual reason- ing without training","venue":null,"work_id":"bad08eed-22a6-47f3-99c5-522dedf1ce8c","year":2022},"citing_paper":{"arxiv_id":"2512.10362","last_updated":"2026-04-27T05:32:18Z","snapshot_observed_at":"2026-08-11T17:18:31.926681Z","submitted_at":"2025-12-11T07:22:54Z","title":"Visual Funnel: Resolving Contextual Blindness in Multimodal Large Language Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T23:47:08.562575Z"},"links":{"cited_paper":"/paper/2211.11559","citing_paper":"/paper/2512.10362"},"observation_digest":"sha256:d6b444d5db911ff399d76d18d1f5bb1e4e394448eba6fc2724368521a4e3e07b","observation_id":"62e0ba91-b313-4084-988c-b66173ef2b45","resolution":{"observed_at":"2026-05-16T23:48:41.916710Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.11559","last_updated":"2022-11-18T18:50:09Z","snapshot_observed_at":"2026-08-18T17:26:02.275984Z","submitted_at":"2022-11-18T18:50:09Z","title":"Visual Programming: Compositional visual reasoning without training","version":1},"cited_work":{"arxiv_id":"2211.11559","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.11559","snapshot_observed_at":"2026-07-01T19:56:10.525466Z","title":"Visual programming: Compositional visual reason- ing without training","venue":null,"work_id":"bad08eed-22a6-47f3-99c5-522dedf1ce8c","year":2022},"citing_paper":{"arxiv_id":"2604.09167","last_updated":"2026-04-10T09:51:42Z","snapshot_observed_at":"2026-08-16T04:47:59.695653Z","submitted_at":"2026-04-10T09:51:42Z","title":"MAG-3D: Multi-Agent Grounded Reasoning for 3D Understanding","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T17:25:31.097385Z"},"links":{"cited_paper":"/paper/2211.11559","citing_paper":"/paper/2604.09167"},"observation_digest":"sha256:295b11a0193f0032092d87c535026e631ff7becf9006d9cbfa09620625decdbc","observation_id":"3f6da490-24b7-4415-b73c-b8595729239d","resolution":{"observed_at":"2026-05-11T06:51:23.156390Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.11559","last_updated":"2022-11-18T18:50:09Z","snapshot_observed_at":"2026-08-18T17:26:02.275984Z","submitted_at":"2022-11-18T18:50:09Z","title":"Visual Programming: Compositional visual reasoning without training","version":1},"cited_work":{"arxiv_id":"2211.11559","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.11559","snapshot_observed_at":"2026-07-01T19:56:10.525466Z","title":"Visual programming: Compositional visual reason- ing without training","venue":null,"work_id":"bad08eed-22a6-47f3-99c5-522dedf1ce8c","year":2022},"citing_paper":{"arxiv_id":"2606.00384","last_updated":"2026-06-07T19:48:24Z","snapshot_observed_at":"2026-08-17T05:09:30.055421Z","submitted_at":"2026-05-29T21:57:37Z","title":"VESTA: Visual Exploration with Statistical Tool Agents","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:11.339217Z"},"links":{"cited_paper":"/paper/2211.11559","citing_paper":"/paper/2606.00384"},"observation_digest":"sha256:437c6ede8920a67a9f75171f8321089a9d6131131345270b2e05d5c36ec3d14f","observation_id":"498614d5-cf49-4cb6-97b1-05fcf713af9b","resolution":{"observed_at":"2026-07-01T19:56:10.526893Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.11559","last_updated":"2022-11-18T18:50:09Z","snapshot_observed_at":"2026-08-18T17:26:02.275984Z","submitted_at":"2022-11-18T18:50:09Z","title":"Visual Programming: Compositional visual reasoning without training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.11559","snapshot_observed_at":"2026-07-11T15:24:53.016199Z","title":"Visual programming: Compositional visual reasoning without training.arXiv preprint arXiv:2211.11559, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.05465","last_updated":"2026-07-06T04:57:18Z","snapshot_observed_at":"2026-08-17T03:28:42.306650Z","submitted_at":"2026-07-06T04:57:18Z","title":"CanvasAgent: Enabling Complex Image Creation and Editing via Visual Tool Orchestration","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-11T15:24:53.016199Z"},"links":{"cited_paper":"/paper/2211.11559","citing_paper":"/paper/2607.05465"},"observation_digest":"sha256:b832c95908117403a34414d68c20bed762bc340b01c802c15812f4cf835aef87","observation_id":"0359ec15-96f7-433d-a80b-280fa4e0a837","resolution":{"observed_at":"2026-07-11T15:24:53.016199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2211.11559/citation-record","integrity":"/paper/2211.11559/integrity","json":"/paper/2211.11559/citation-record.json","paper":"/paper/2211.11559"},"outbound":[],"paper":{"arxiv_id":"2211.11559","last_updated":"2022-11-18T18:50:09Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T17:26:02.275984Z","submitted_at":"2022-11-18T18:50:09Z","title":"Visual Programming: Compositional visual reasoning without training"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 18 inbound Pith citation observations for arXiv:2211.11559."}