{"as_of":"2026-08-10T13:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:83308d8b12bba08ad9f8825e7bfdcba4f802addbe70749cf1e58e8bf3b4bbe2c","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:28:07.633755Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.21863/citation-record","integrity":"/paper/2505.21863/integrity","json":"/paper/2505.21863/citation-record.json","paper":"/paper/2505.21863"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.14210","last_updated":"2025-01-24T03:28:37Z","snapshot_observed_at":"2026-08-09T12:35:38.276498Z","submitted_at":"2025-01-24T03:28:37Z","title":"PuzzleGPT: Emulating Human Puzzle-Solving Ability for Time and Location Prediction","version":1},"cited_work":{"arxiv_id":"2501.14210","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.14210","snapshot_observed_at":"2026-08-07T13:28:09.181666Z","title":"PuzzleGPT: Emulating Human Puzzle-Solving Ability for Time and Location Prediction","venue":"cs.CV","work_id":"931c7de2-3744-4bc3-a3c4-c44e36a06c1e","year":2025},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:05.353433Z"},"links":{"cited_paper":"/paper/2501.14210","citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:5d5d85c6cd64a6d45bed79501ef0c84c45884237ae0e649832216c6de2430f7f","observation_id":"82156af2-590a-4ab0-a8f7-d80e7a48338d","resolution":{"observed_at":"2026-08-07T13:28:09.274276Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-07T13:28:05.421688Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:05.421688Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:f288445b1ab98e24a1926544ada30614ff69d527b141caae63409f7ae9d1a51a","observation_id":"0491d288-2226-4a16-89d9-901887236fee","resolution":{"observed_at":"2026-08-07T13:28:05.421688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:11.358774Z","title":null,"venue":null,"work_id":"6ca7bdea-7375-470f-89fd-f8716efc436a","year":2005},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:05.492389Z"},"links":{"citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:2532360d9e2f1dfd46c532314b32b79ae5e3375248b539ebf66254d78513f910","observation_id":"7d0a6c8c-559e-45b1-9ee9-c6ccb688a0ab","resolution":{"observed_at":"2026-08-07T13:28:11.439640Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11497","last_updated":"2024-12-17T14:11:19Z","snapshot_observed_at":"2026-08-08T23:48:19.954160Z","submitted_at":"2024-06-17T13:01:12Z","title":"CrAM: Credibility-Aware Attention Modification in LLMs for Combating Misinformation in RAG","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11497","snapshot_observed_at":"2026-08-07T13:28:05.582573Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:05.582573Z"},"links":{"cited_paper":"/paper/2406.11497","citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:33664324ee8d5bfe962b72bef7ded75b1decf1ccb12311e5dd386838f1e655c9","observation_id":"dae659b1-d793-457d-9c73-92ecde7989e7","resolution":{"observed_at":"2026-08-07T13:28:05.582573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:11.190054Z","title":null,"venue":null,"work_id":"6bfc1dda-601b-44d8-b18d-c48788a8c578","year":2025},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:05.705884Z"},"links":{"citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:88b38b21b264f9220bb5d02d23d9ff16d43201a0017a2d7abb456933aba1e708","observation_id":"849f6adf-91d1-42a0-9377-26c4768411f3","resolution":{"observed_at":"2026-08-07T13:28:11.278024Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19092","last_updated":"2024-07-07T17:06:59Z","snapshot_observed_at":"2026-07-06T18:22:01.301152Z","submitted_at":"2024-05-29T13:54:12Z","title":"Benchmarking and Improving Detail Image Caption","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19092","snapshot_observed_at":"2026-08-07T13:28:05.762074Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:05.762074Z"},"links":{"cited_paper":"/paper/2405.19092","citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:b915e3406c710e42978031092d6eb1e3d20bfd09e61578e7b5125ee568095db3","observation_id":"23690255-5bef-4f42-9c2d-01ee12a1f55b","resolution":{"observed_at":"2026-08-07T13:28:05.762074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18842","last_updated":"2023-05-30T08:34:13Z","snapshot_observed_at":"2026-08-06T04:47:40.842518Z","submitted_at":"2023-05-30T08:34:13Z","title":"Generate then Select: Open-ended Visual Question Answering Guided by World Knowledge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18842","snapshot_observed_at":"2026-08-07T13:28:05.813403Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:05.813403Z"},"links":{"cited_paper":"/paper/2305.18842","citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:60df1d6a9600bb39ea21d647a2520f03194f39e25d4a353181acebe7fc270472","observation_id":"4281694c-5adf-437c-a322-8e58927b65fb","resolution":{"observed_at":"2026-08-07T13:28:05.813403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:10.977091Z","title":null,"venue":null,"work_id":"f39aa686-7cc1-4c2b-9623-8b34d040e3a1","year":2022},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:05.884307Z"},"links":{"citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:4faf2d6333e25d6ebe6ac6e6d48fd8656e0c0672f52295819821f8afc1bdbb16","observation_id":"8ed4d412-f592-4224-92ce-57bae3f42187","resolution":{"observed_at":"2026-08-07T13:28:11.076342Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3689638","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Gao and Z","venue":"ACM Transactions on Multimedia Computing Communications and Applications","work_id":"3c367fc6-f291-4ebe-9d0c-81456e148387","year":2024},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:05.969485Z"},"links":{"citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:0803ce5a1995f757b2fccfde0e25c364460640d107ced837cd024532b1a0dc60","observation_id":"3f9c7caf-fbcc-4085-9243-0fda10f6f0c6","resolution":{"observed_at":"2026-08-07T13:28:07.852403Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:06.091937Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:06.091937Z"},"links":{"citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:643b3d67de9f11f326adab6a35d8f61857413ec05b2dcb90a25434bb1650102f","observation_id":"f995256a-da44-4d51-81bd-fadc6362f928","resolution":{"observed_at":"2026-08-07T13:28:06.091937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:10.747018Z","title":"19th Century","venue":null,"work_id":"7af0d07f-4eb9-4495-aa27-bfada07efade","year":null},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:06.153956Z"},"links":{"citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:c8c0f3f6e535bf54d74e8aaaeb3e42d9681353ebf8d0934235cb0820f195fa98","observation_id":"9cdf2d74-6fbe-447f-bae0-23f6d7770140","resolution":{"observed_at":"2026-08-07T13:28:10.843155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:10.563978Z","title":null,"venue":null,"work_id":"600dd9f2-6ef8-484b-bd08-ad9ac816244c","year":2022},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:06.211223Z"},"links":{"citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:c01469cf5c7059aa1ad6eb47d78d43ead52d59b71e39a1565f20e8a57f124ee9","observation_id":"0e3d8f56-cca8-45e1-a3ca-2b272abbc6c8","resolution":{"observed_at":"2026-08-07T13:28:10.652714Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:10.369970Z","title":null,"venue":null,"work_id":"820674bb-3fd0-4266-8880-3539bc9218db","year":2023},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:06.261834Z"},"links":{"citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:1e2477adb33ff8a49585f1e95ce2c763322ccd20d274eebed594f7e062a989a8","observation_id":"ea77315d-ed1b-46eb-839b-5aea0cbc8fcf","resolution":{"observed_at":"2026-08-07T13:28:10.458660Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:06.307540Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:06.307540Z"},"links":{"citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:2891c4a8bbb7c8b29946d2e5ba151f999603e90d9120b3cbb2f9734b8bcb713f","observation_id":"e54b4d7c-01c2-4595-91d2-3759056ff8c2","resolution":{"observed_at":"2026-08-07T13:28:06.307540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:06.355662Z","title":"u ttler, Mike Lewis, Wen-tau Yih, Tim Rockt \\","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:06.355662Z"},"links":{"citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:ddb2ed465caf5e1f07d7a5f9d718c0af62e15b32f0e6f03f2c9f236a122143e3","observation_id":"c8a32199-3f69-4c61-9e0e-16a8cc172cc2","resolution":{"observed_at":"2026-08-07T13:28:06.355662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12005","last_updated":"2022-05-25T05:49:30Z","snapshot_observed_at":"2026-08-06T06:00:24.094085Z","submitted_at":"2022-05-24T11:52:06Z","title":"mPLUG: Effective and Efficient Vision-Language Learning by Cross-modal Skip-connections","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12005","snapshot_observed_at":"2026-08-07T13:28:06.418154Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:06.418154Z"},"links":{"cited_paper":"/paper/2205.12005","citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:ae99e3c0ee75b0697adf43dd633b8b279bf65328dc45bf5ea1d189a58f4c5189","observation_id":"b0f23c11-628c-4107-8673-7a996920c4ab","resolution":{"observed_at":"2026-08-07T13:28:06.418154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:10.221432Z","title":null,"venue":null,"work_id":"ec70fa2d-579e-4e61-9320-d95d9e801414","year":2004},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:06.460467Z"},"links":{"citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:e5515642cef778d553bed06e8f11322f17ceeae7a94285bca964ebcf228bc220","observation_id":"ee3453f7-2828-4ec4-913e-fad38691484c","resolution":{"observed_at":"2026-08-07T13:28:10.281987Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"document/1012345","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:08.912011Z","title":null,"venue":null,"work_id":"a5acd447-ef2a-416f-9bf0-47c13f7ab3ce","year":2023},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:06.517934Z"},"links":{"citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:6c0abb62526c109cc5b09758d4082eb6f171d6af67cc76239e8d5d083ab83092","observation_id":"6068a1ed-e15d-4867-93ab-ed11a11612cd","resolution":{"observed_at":"2026-08-07T13:28:08.979699Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"document/1073016","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:08.703511Z","title":null,"venue":null,"work_id":"e39fc708-a810-4d21-9a92-dc4c9f311f5c","year":2024},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:06.561476Z"},"links":{"citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:9c1ef21802caa30eb0f4e82c6716c239ec10259c40bc69b1045c5e7a35b7106f","observation_id":"8549382b-bfb0-4b2e-a2e1-e10083981809","resolution":{"observed_at":"2026-08-07T13:28:08.773535Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:10.037400Z","title":null,"venue":null,"work_id":"ce19769c-6dfd-419b-9451-3406869b33f7","year":2002},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:06.606950Z"},"links":{"citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:71506a2810b974e0b7d253af598a94ea416600f03196dfdc4d45101b120ab2db","observation_id":"9a7ca225-020c-419a-b8d6-97edbc3b5d81","resolution":{"observed_at":"2026-08-07T13:28:10.129562Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.16061","last_updated":"2020-10-11T02:15:11Z","snapshot_observed_at":"2026-08-04T20:09:58.097029Z","submitted_at":"2020-10-11T02:15:11Z","title":"Evaluation: from precision, recall and F-measure to ROC, informedness, markedness and correlation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.16061","snapshot_observed_at":"2026-08-07T13:28:06.676872Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:06.676872Z"},"links":{"cited_paper":"/paper/2010.16061","citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:37376f92e286fe48285dd30c5a64fde97150e171d7da4a42f8fd4f715f4d8294","observation_id":"593bc03e-e34e-4845-bd65-8132e7cadd1e","resolution":{"observed_at":"2026-08-07T13:28:06.676872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/w17-2005","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"2ee3244a-9741-46cc-b2c6-af61a8829126","year":2017},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:06.730377Z"},"links":{"citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:3047c15d30818956762f2acbc374d0ca1973d3bc6df6731e1a9a60e88d0e033f","observation_id":"0ddb5df4-ceee-4665-a1bc-1d18916320d6","resolution":{"observed_at":"2026-08-07T13:28:07.774254Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:09.783319Z","title":"Singh, K","venue":null,"work_id":"65897355-b2bd-47a2-ac24-d6a4b6e3167d","year":2023},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:06.806115Z"},"links":{"citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:76bd61216517eb6b10b979c866367363d446d9eb774918c988f1da3424ce9e9c","observation_id":"66338db0-41dd-4ca4-afe9-6f59f81f7e9b","resolution":{"observed_at":"2026-08-07T13:28:09.908753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18409","last_updated":"2025-02-13T02:37:06Z","snapshot_observed_at":"2026-08-04T15:11:55.782077Z","submitted_at":"2024-02-28T15:28:36Z","title":"A Cognitive Evaluation Benchmark of Image Reasoning and Description for Large Vision-Language Models","version":4},"cited_work":{"arxiv_id":"2402.18409","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.18409","snapshot_observed_at":"2026-08-07T13:28:08.440977Z","title":"A Cognitive Evaluation Benchmark of Image Reasoning and Description for Large Vision-Language Models","venue":"cs.AI","work_id":"63cd44d2-d714-4c31-82fd-a5145b6be2c2","year":2024},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:06.869629Z"},"links":{"cited_paper":"/paper/2402.18409","citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:ad504729f46b4bcdfdb29d8ce8712721af15f35e1774ff0a9c7b1bc45d429d05","observation_id":"9fd29bc9-ae62-4b3e-a63b-0285ed7ebcfb","resolution":{"observed_at":"2026-08-07T13:28:08.527162Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:09.590461Z","title":null,"venue":null,"work_id":"983e2e8a-eef3-4ab9-b859-e60bf6808a5a","year":2025},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:06.891473Z"},"links":{"citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:fbf16d9f990d28315a4240f2f838b38e958687a87a035e461a77393aa2b00725","observation_id":"d8c18b6b-63d5-41ac-9868-a773ec01a784","resolution":{"observed_at":"2026-08-07T13:28:09.668282Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:09.395953Z","title":null,"venue":null,"work_id":"f290ad83-7cc5-4fb8-b21e-bc770877e3b3","year":2025},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:06.908439Z"},"links":{"citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:e0d0a607231a286e1c29693467b819892483c5a3546850682db3996878faa203","observation_id":"3faf6efd-7810-415f-882f-7573e6525818","resolution":{"observed_at":"2026-08-07T13:28:09.504609Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.09939","last_updated":"2024-08-20T08:59:22Z","snapshot_observed_at":"2026-08-04T16:20:27.708962Z","submitted_at":"2024-08-19T12:21:34Z","title":"\"Image, Tell me your story!\" Predicting the original meta-context of visual misinformation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.09939","snapshot_observed_at":"2026-08-07T13:28:06.950038Z","title":"image, tell me your story!","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:06.950038Z"},"links":{"cited_paper":"/paper/2408.09939","citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:56ba3186ef4fd3375e1df3600b8c7f6009987f1e6a59bb079c2a36398f36586a","observation_id":"c6fbba7b-b531-42b6-a4d8-9e5b98360c35","resolution":{"observed_at":"2026-08-07T13:28:06.950038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01194","last_updated":"2025-02-03T09:33:58Z","snapshot_observed_at":"2026-08-09T20:15:59.376430Z","submitted_at":"2025-02-03T09:33:58Z","title":"COVE: COntext and VEracity prediction for out-of-context images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01194","snapshot_observed_at":"2026-08-07T13:28:06.998839Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:06.998839Z"},"links":{"cited_paper":"/paper/2502.01194","citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:78d90cfff1b2f14c26781ec1a7c10af46034e10dfc52feac1b6393c1ef14fe85","observation_id":"a582df80-d641-47ee-b69b-1fc3b77f9e79","resolution":{"observed_at":"2026-08-07T13:28:06.998839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1411.5726","last_updated":"2015-06-03T01:42:20Z","snapshot_observed_at":"2026-08-07T17:52:59.562945Z","submitted_at":"2014-11-20T23:54:35Z","title":"CIDEr: Consensus-based Image Description Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1411.5726","snapshot_observed_at":"2026-08-07T13:28:07.066478Z","title":"Lawrence Zitnick, and Devi Parikh","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:07.066478Z"},"links":{"cited_paper":"/paper/1411.5726","citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:d14db7d6f1051fe3da4a4f12c45f69588ddffc9e0c032249b016cfca28a244ef","observation_id":"d6cf9c5e-8718-4d77-92cd-5bcb1ae5dc94","resolution":{"observed_at":"2026-08-07T13:28:07.066478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16661","last_updated":"2025-01-28T02:49:45Z","snapshot_observed_at":"2026-08-10T11:33:34.726288Z","submitted_at":"2025-01-28T02:49:45Z","title":"Jupybara: Operationalizing a Design Space for Actionable Data Analysis and Storytelling with LLMs","version":1},"cited_work":{"arxiv_id":"2501.16661","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.16661","snapshot_observed_at":"2026-08-07T13:28:08.216528Z","title":"Jupybara: Operationalizing a Design Space for Actionable Data Analysis and Storytelling with LLMs","venue":"cs.HC","work_id":"5d284ed0-d60b-4d89-bd3a-0c8c1c784bd4","year":2025},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:07.115556Z"},"links":{"cited_paper":"/paper/2501.16661","citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:fb0a37cd2fa38845c76641ee252919a175aada3235fc2751702ac4ff46145784","observation_id":"a11e59a5-2602-49ed-8843-2779ed0fec6d","resolution":{"observed_at":"2026-08-07T13:28:08.318155Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-07T13:28:07.231703Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:07.231703Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:759b1fdab8a23612b00d8e976d3d96b8188c369e7349b32ad7ad1dfe47ca2398","observation_id":"aa18ba64-39ee-4c1d-be78-40f17783ef17","resolution":{"observed_at":"2026-08-07T13:28:07.231703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:07.293124Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:07.293124Z"},"links":{"citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:8f24543a2ee0266b36b24845f1e9a45060437a9a46e5f9a5f3eccef6b50f0807","observation_id":"8a719382-16ac-4ccc-ae18-d62fed326e1f","resolution":{"observed_at":"2026-08-07T13:28:07.293124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.03771","last_updated":"2020-07-14T03:42:34Z","snapshot_observed_at":"2026-07-06T08:27:58.343233Z","submitted_at":"2019-10-09T03:23:22Z","title":"HuggingFace's Transformers: State-of-the-art Natural Language Processing","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.03771","snapshot_observed_at":"2026-08-07T13:28:07.329234Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:07.329234Z"},"links":{"cited_paper":"/paper/1910.03771","citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:516994d00b495c87255f51a5348a328e8c19be9a682098f0bfc99ab2389f0489","observation_id":"6ff6d928-4cc6-4d3d-8675-6c00515aad1b","resolution":{"observed_at":"2026-08-07T13:28:07.329234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.02577","last_updated":"2018-05-11T21:48:44Z","snapshot_observed_at":"2026-08-10T08:31:37.201743Z","submitted_at":"2018-03-07T09:59:19Z","title":"The Bronstein hypercube of quantum gravity","version":3},"cited_work":{"arxiv_id":"1803.02577","doi":null,"metadata_source":"pith","pith_arxiv_id":"1803.02577","snapshot_observed_at":"2026-08-07T13:28:07.989328Z","title":"The Bronstein hypercube of quantum gravity","venue":"physics.hist-ph","work_id":"f1c264b8-edd8-4824-9914-692abcc05a93","year":2018},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:07.382265Z"},"links":{"cited_paper":"/paper/1803.02577","citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:9e60ffdde73f4f1773187010131605306ecf5502e469887e9b01c03bf7279d22","observation_id":"a60f453a-87e3-4140-8dbc-45badadf4658","resolution":{"observed_at":"2026-08-07T13:28:08.090156Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:07.421291Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:07.421291Z"},"links":{"citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:7bc73278b178520ea4d5ed06d1936d011f8bff5f37d318f361251235c90c1f13","observation_id":"ecc7c58e-147a-4b0e-a850-bf578112a02f","resolution":{"observed_at":"2026-08-07T13:28:07.421291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07312","last_updated":"2024-07-16T19:04:45Z","snapshot_observed_at":"2026-07-06T17:58:30.961334Z","submitted_at":"2024-04-10T19:21:33Z","title":"An analysis of parameter compression and full-modeling techniques with Velocileptors for DESI 2024 and beyond","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07312","snapshot_observed_at":"2026-08-07T13:28:07.524482Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:07.524482Z"},"links":{"cited_paper":"/paper/2404.07312","citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:05573b1362a6745726ea6b1873705d848f09d67a576ade0297c1f190040c6fc0","observation_id":"6098d9da-79ab-466d-bfd8-15e450722665","resolution":{"observed_at":"2026-08-07T13:28:07.524482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:07.581084Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:07.581084Z"},"links":{"citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:3250a95ce672fa8c24227730e34c75f57159fccd1dc93afda25a0c308842ce10","observation_id":"7138e1a8-805e-485c-8368-f1347f5987ff","resolution":{"observed_at":"2026-08-07T13:28:07.581084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:07.633755Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:07.633755Z"},"links":{"citing_paper":"/paper/2505.21863"},"observation_digest":"sha256:019fd4c927b6fa4de0e521f6e6814d147cc1077766e63893bc8310220e70c318","observation_id":"98063ce1-4ce7-4e79-bc53-17235cb800f7","resolution":{"observed_at":"2026-08-07T13:28:07.633755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.21863","last_updated":"2025-06-02T21:33:47Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T23:48:27.766636Z","submitted_at":"2025-05-28T01:19:23Z","title":"GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":28,"verified_exact":8,"verified_fuzzy":2},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 0 inbound Pith citation observations for arXiv:2505.21863."}