{"as_of":"2026-08-18T07:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b52682e13fb00cc4509d034d74501a03d95608193c7fa31e4e874441a1f05943","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":15,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T18:22:42.176796Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-11T03:17:51.543739Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.07089","last_updated":"2025-06-02T09:38:26Z","snapshot_observed_at":"2026-08-16T12:42:37.317107Z","submitted_at":"2025-04-09T17:58:58Z","title":"OmniCaptioner: One Captioner to Rule Them All","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07089","snapshot_observed_at":"2026-08-11T20:13:47.621108Z","title":"Omnicaptioner: One captioner to rule them all","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2412.05983","last_updated":"2025-07-26T14:45:01Z","snapshot_observed_at":"2026-08-14T09:40:33.773143Z","submitted_at":"2024-12-08T16:10:42Z","title":"Chimera: Improving Generalist Model with Domain-Specific Experts","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T20:13:47.621108Z"},"links":{"cited_paper":"/paper/2504.07089","citing_paper":"/paper/2412.05983"},"observation_digest":"sha256:3bc33b6f1b998cd51c111633e95a6490e081193ab990bd023af8231e4ca4fb8f","observation_id":"cac583b4-7728-4211-be92-4a421430d8f9","resolution":{"observed_at":"2026-08-11T20:13:47.621108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07089","last_updated":"2025-06-02T09:38:26Z","snapshot_observed_at":"2026-08-16T12:42:37.317107Z","submitted_at":"2025-04-09T17:58:58Z","title":"OmniCaptioner: One Captioner to Rule Them All","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07089","snapshot_observed_at":"2026-08-07T13:35:58.716151Z","title":"Omnicaptioner: One captioner to rule them all","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21327","last_updated":"2025-05-27T15:23:23Z","snapshot_observed_at":"2026-08-08T22:42:35.699276Z","submitted_at":"2025-05-27T15:23:23Z","title":"MME-Reasoning: A Comprehensive Benchmark for Logical Reasoning in MLLMs","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T13:35:58.716151Z"},"links":{"cited_paper":"/paper/2504.07089","citing_paper":"/paper/2505.21327"},"observation_digest":"sha256:951d2be37682a8d8cb757e136364e0677670485e06b99f842891b83ddcd49b3e","observation_id":"e6661b07-756e-4a3a-9b42-92a283aab301","resolution":{"observed_at":"2026-08-07T13:35:58.716151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07089","last_updated":"2025-06-02T09:38:26Z","snapshot_observed_at":"2026-08-16T12:42:37.317107Z","submitted_at":"2025-04-09T17:58:58Z","title":"OmniCaptioner: One Captioner to Rule Them All","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07089","snapshot_observed_at":"2026-08-07T12:59:21.482694Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-16T08:04:58.307699Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:21.482694Z"},"links":{"cited_paper":"/paper/2504.07089","citing_paper":"/paper/2505.23091"},"observation_digest":"sha256:eeb708de321183db1347d588e7ce5c37dee1f0eb7878e6c0b74cebad1ecbbc06","observation_id":"dfb51c60-7593-4a3c-a539-9c0f8e795978","resolution":{"observed_at":"2026-08-07T12:59:21.482694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07089","last_updated":"2025-06-02T09:38:26Z","snapshot_observed_at":"2026-08-16T12:42:37.317107Z","submitted_at":"2025-04-09T17:58:58Z","title":"OmniCaptioner: One Captioner to Rule Them All","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07089","snapshot_observed_at":"2026-08-15T18:22:42.176796Z","title":"Omnicaptioner: One captioner to rule them all.arXiv preprint arXiv:2504.07089,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.17801","last_updated":"2025-07-23T17:42:13Z","snapshot_observed_at":"2026-08-15T21:47:43.254025Z","submitted_at":"2025-07-23T17:42:13Z","title":"Lumina-mGPT 2.0: Stand-Alone AutoRegressive Image Modeling","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-15T18:22:42.176796Z"},"links":{"cited_paper":"/paper/2504.07089","citing_paper":"/paper/2507.17801"},"observation_digest":"sha256:0427b0f24f8c3da452249d1898a2d510e6375cb78c891e32fd75632d112a1085","observation_id":"0f97bf16-8931-4f66-9981-b06ac3b36d9e","resolution":{"observed_at":"2026-08-15T18:22:42.176796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07089","last_updated":"2025-06-02T09:38:26Z","snapshot_observed_at":"2026-08-16T12:42:37.317107Z","submitted_at":"2025-04-09T17:58:58Z","title":"OmniCaptioner: One Captioner to Rule Them All","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07089","snapshot_observed_at":"2026-08-05T22:58:36.852405Z","title":"Omnicaptioner: One captioner to rule them all","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.06125","last_updated":"2025-08-08T08:45:52Z","snapshot_observed_at":"2026-08-14T15:33:30.690043Z","submitted_at":"2025-08-08T08:45:52Z","title":"SC-Captioner: Improving Image Captioning with Self-Correction by Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T22:58:36.852405Z"},"links":{"cited_paper":"/paper/2504.07089","citing_paper":"/paper/2508.06125"},"observation_digest":"sha256:433427b7f95a13a6b16851632d232e249a62a1e43c41c381a55b4bf5072b8b2e","observation_id":"e91735c6-df67-4819-b970-c7a0857b77f5","resolution":{"observed_at":"2026-08-05T22:58:36.852405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07089","last_updated":"2025-06-02T09:38:26Z","snapshot_observed_at":"2026-08-16T12:42:37.317107Z","submitted_at":"2025-04-09T17:58:58Z","title":"OmniCaptioner: One Captioner to Rule Them All","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07089","snapshot_observed_at":"2026-08-03T21:09:23.473947Z","title":"Omnicaptioner: One captioner to rule them all.ArXiv, abs/2504.07089, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.16672","last_updated":"2026-06-09T22:19:41Z","snapshot_observed_at":"2026-08-17T13:52:38.567720Z","submitted_at":"2025-11-20T18:59:54Z","title":"EvoLMM: Self-Evolving Large Multimodal Models with Continuous Rewards","version":4},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T21:09:23.473947Z"},"links":{"cited_paper":"/paper/2504.07089","citing_paper":"/paper/2511.16672"},"observation_digest":"sha256:c574de6ae15c5c2f578e62469b0f3602ff8d48e0d29205024ff2bb33bb022277","observation_id":"a7ed7b5c-c64b-4b29-89e0-41dc41e350d9","resolution":{"observed_at":"2026-08-03T21:09:23.473947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07089","last_updated":"2025-06-02T09:38:26Z","snapshot_observed_at":"2026-08-16T12:42:37.317107Z","submitted_at":"2025-04-09T17:58:58Z","title":"OmniCaptioner: One Captioner to Rule Them All","version":3},"cited_work":{"arxiv_id":"2504.07089","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.07089","snapshot_observed_at":"2026-07-11T03:17:51.543739Z","title":"Omnicaptioner: One captioner to rule them all","venue":"cs.CV","work_id":"97453bde-de3a-45c0-8f6b-5c08fe830211","year":2025},"citing_paper":{"arxiv_id":"2511.22699","last_updated":"2026-07-06T06:19:03Z","snapshot_observed_at":"2026-08-16T18:20:01.123890Z","submitted_at":"2025-11-27T18:52:07Z","title":"Z-Image: An Efficient Image Generation Foundation Model with Single-Stream Diffusion Transformer","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-11T14:08:36.801359Z"},"links":{"cited_paper":"/paper/2504.07089","citing_paper":"/paper/2511.22699"},"observation_digest":"sha256:65c730c843c23660ae031329dc98476f96560d6d427e8d43048161f70920fb75","observation_id":"c51d8ef9-8ad0-4d17-9ee5-a3d61fc27f41","resolution":{"observed_at":"2026-05-11T14:08:37.265735Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07089","last_updated":"2025-06-02T09:38:26Z","snapshot_observed_at":"2026-08-16T12:42:37.317107Z","submitted_at":"2025-04-09T17:58:58Z","title":"OmniCaptioner: One Captioner to Rule Them All","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07089","snapshot_observed_at":"2026-08-03T19:47:32.786122Z","title":"Omnicaptioner: One captioner to rule them all.arXiv preprint arXiv:2504.07089, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.22699","last_updated":"2026-07-06T06:19:03Z","snapshot_observed_at":"2026-08-16T18:20:01.123890Z","submitted_at":"2025-11-27T18:52:07Z","title":"Z-Image: An Efficient Image Generation Foundation Model with Single-Stream Diffusion Transformer","version":5},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-03T19:47:32.786122Z"},"links":{"cited_paper":"/paper/2504.07089","citing_paper":"/paper/2511.22699"},"observation_digest":"sha256:9c74e8356593f3e6e7f4f23336409f95e84be4caf554f6049e956eacd7d84480","observation_id":"c21bfeb1-2a69-48f2-8e4d-de3b6d031cfa","resolution":{"observed_at":"2026-08-03T19:47:32.786122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07089","last_updated":"2025-06-02T09:38:26Z","snapshot_observed_at":"2026-08-16T12:42:37.317107Z","submitted_at":"2025-04-09T17:58:58Z","title":"OmniCaptioner: One Captioner to Rule Them All","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07089","snapshot_observed_at":"2026-07-14T23:22:13.847876Z","title":"Omnicaptioner: One captioner to rule them all","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.10757","last_updated":"2026-06-20T10:12:15Z","snapshot_observed_at":"2026-08-13T21:01:04.544839Z","submitted_at":"2026-03-11T13:32:58Z","title":"CodePercept: Code-Grounded Visual STEM Perception for MLLMs","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-14T23:22:13.847876Z"},"links":{"cited_paper":"/paper/2504.07089","citing_paper":"/paper/2603.10757"},"observation_digest":"sha256:3ed59e0c42626b63a635df6465a2e4bde1a33d9ac6a61d5d888d4a80fb89d3fc","observation_id":"661e7ce4-ad9a-45d9-bd79-4b1ae5053281","resolution":{"observed_at":"2026-07-14T23:22:13.847876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07089","last_updated":"2025-06-02T09:38:26Z","snapshot_observed_at":"2026-08-16T12:42:37.317107Z","submitted_at":"2025-04-09T17:58:58Z","title":"OmniCaptioner: One Captioner to Rule Them All","version":3},"cited_work":{"arxiv_id":"2504.07089","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.07089","snapshot_observed_at":"2026-07-11T03:17:51.543739Z","title":"Omnicaptioner: One captioner to rule them all","venue":"cs.CV","work_id":"97453bde-de3a-45c0-8f6b-5c08fe830211","year":2025},"citing_paper":{"arxiv_id":"2604.05623","last_updated":"2026-04-07T09:27:01Z","snapshot_observed_at":"2026-07-06T22:54:16.913706Z","submitted_at":"2026-04-07T09:27:01Z","title":"DetailVerifyBench: A Benchmark for Dense Hallucination Localization in Long Image Captions","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-10T18:39:29.592129Z"},"links":{"cited_paper":"/paper/2504.07089","citing_paper":"/paper/2604.05623"},"observation_digest":"sha256:187774701563a50617b36ded5e091d0b71794d3b1af4d1cda2dd6bda120bd14e","observation_id":"30f33aa0-b206-4d6c-93c1-2d1309a7affe","resolution":{"observed_at":"2026-05-11T00:10:52.847901Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07089","last_updated":"2025-06-02T09:38:26Z","snapshot_observed_at":"2026-08-16T12:42:37.317107Z","submitted_at":"2025-04-09T17:58:58Z","title":"OmniCaptioner: One Captioner to Rule Them All","version":3},"cited_work":{"arxiv_id":"2504.07089","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.07089","snapshot_observed_at":"2026-07-11T03:17:51.543739Z","title":"Omnicaptioner: One captioner to rule them all","venue":"cs.CV","work_id":"97453bde-de3a-45c0-8f6b-5c08fe830211","year":2025},"citing_paper":{"arxiv_id":"2605.04503","last_updated":"2026-05-06T05:12:41Z","snapshot_observed_at":"2026-08-17T13:17:42.708078Z","submitted_at":"2026-05-06T05:12:41Z","title":"DiffCap-Bench: A Comprehensive, Challenging, Robust Benchmark for Image Difference Captioning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-08T17:56:47.621050Z"},"links":{"cited_paper":"/paper/2504.07089","citing_paper":"/paper/2605.04503"},"observation_digest":"sha256:d8187db04c123b9364143ebb7bcbdc5f56c842da9455e8b619eb581213f0ea25","observation_id":"7fbaec1f-7bdb-4f93-a552-67b33733d204","resolution":{"observed_at":"2026-05-09T06:55:44.238614Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07089","last_updated":"2025-06-02T09:38:26Z","snapshot_observed_at":"2026-08-16T12:42:37.317107Z","submitted_at":"2025-04-09T17:58:58Z","title":"OmniCaptioner: One Captioner to Rule Them All","version":3},"cited_work":{"arxiv_id":"2504.07089","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.07089","snapshot_observed_at":"2026-07-11T03:17:51.543739Z","title":"Omnicaptioner: One captioner to rule them all","venue":"cs.CV","work_id":"97453bde-de3a-45c0-8f6b-5c08fe830211","year":2025},"citing_paper":{"arxiv_id":"2606.07433","last_updated":"2026-06-05T16:29:13Z","snapshot_observed_at":"2026-08-01T21:05:06.439607Z","submitted_at":"2026-06-05T16:29:13Z","title":"Watch, Remember, Reason: Human-View Video Understanding with MLLMs","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-27T22:00:28.350003Z"},"links":{"cited_paper":"/paper/2504.07089","citing_paper":"/paper/2606.07433"},"observation_digest":"sha256:e2c033e94efe06164044fdfa21a16a7440b40988dabc2a17b33275e41d0f93e7","observation_id":"f4e8a51d-2404-4008-af5e-42bb65278d08","resolution":{"observed_at":"2026-07-02T17:27:15.021888Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07089","last_updated":"2025-06-02T09:38:26Z","snapshot_observed_at":"2026-08-16T12:42:37.317107Z","submitted_at":"2025-04-09T17:58:58Z","title":"OmniCaptioner: One Captioner to Rule Them All","version":3},"cited_work":{"arxiv_id":"2504.07089","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.07089","snapshot_observed_at":"2026-07-11T03:17:51.543739Z","title":"Omnicaptioner: One captioner to rule them all","venue":"cs.CV","work_id":"97453bde-de3a-45c0-8f6b-5c08fe830211","year":2025},"citing_paper":{"arxiv_id":"2607.05716","last_updated":"2026-07-13T06:34:36Z","snapshot_observed_at":"2026-08-13T20:08:28.874728Z","submitted_at":"2026-07-07T01:00:51Z","title":"Scene Graph Thinking: Reinforcing Structured Visual Reasoning for Multimodal Large Language Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-11T03:11:49.713677Z"},"links":{"cited_paper":"/paper/2504.07089","citing_paper":"/paper/2607.05716"},"observation_digest":"sha256:e7534b16e9061c953a0bb90ed44816dd383acc9887bdb843602fc88dc69b7c3e","observation_id":"2f302196-1973-4509-88fc-adeaf37cf13d","resolution":{"observed_at":"2026-07-11T03:17:51.572452Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07089","last_updated":"2025-06-02T09:38:26Z","snapshot_observed_at":"2026-08-16T12:42:37.317107Z","submitted_at":"2025-04-09T17:58:58Z","title":"OmniCaptioner: One Captioner to Rule Them All","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07089","snapshot_observed_at":"2026-07-14T16:12:58.882161Z","title":"Omnicaptioner: One cap- tioner to rule them all.arXiv preprint arXiv:2504.07089,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05716","last_updated":"2026-07-13T06:34:36Z","snapshot_observed_at":"2026-08-13T20:08:28.874728Z","submitted_at":"2026-07-07T01:00:51Z","title":"Scene Graph Thinking: Reinforcing Structured Visual Reasoning for Multimodal Large Language Models","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-14T16:12:58.882161Z"},"links":{"cited_paper":"/paper/2504.07089","citing_paper":"/paper/2607.05716"},"observation_digest":"sha256:1c25127ac8e6c50e203739bcff1a0859d5fdea5cf6a545f4c8b8aedc19cbce7c","observation_id":"28cde4be-7dcf-4d3d-893c-76029b9f4b60","resolution":{"observed_at":"2026-07-14T16:12:58.882161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07089","last_updated":"2025-06-02T09:38:26Z","snapshot_observed_at":"2026-08-16T12:42:37.317107Z","submitted_at":"2025-04-09T17:58:58Z","title":"OmniCaptioner: One Captioner to Rule Them All","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07089","snapshot_observed_at":"2026-08-10T18:13:44.157674Z","title":"Omnicaptioner: One captioner to rule them all.arXiv preprint arXiv:2504.07089, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06930","last_updated":"2026-08-07T08:03:51Z","snapshot_observed_at":"2026-08-15T05:53:27.648278Z","submitted_at":"2026-08-07T08:03:51Z","title":"AVCap: Reinforcing Audio-Video Joint Caption with Detail-Aware Reward","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T18:13:44.157674Z"},"links":{"cited_paper":"/paper/2504.07089","citing_paper":"/paper/2608.06930"},"observation_digest":"sha256:252f7810083edcee6f84cd2e0ef9cde3d03222640974409023b9529b11661ee4","observation_id":"ead60c4d-46c1-4950-977f-efa478de054f","resolution":{"observed_at":"2026-08-10T18:13:44.157674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2504.07089/citation-record","integrity":"/paper/2504.07089/integrity","json":"/paper/2504.07089/citation-record.json","paper":"/paper/2504.07089"},"outbound":[],"paper":{"arxiv_id":"2504.07089","last_updated":"2025-06-02T09:38:26Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T12:42:37.317107Z","submitted_at":"2025-04-09T17:58:58Z","title":"OmniCaptioner: One Captioner to Rule Them All"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 15 inbound Pith citation observations for arXiv:2504.07089."}