{"as_of":"2026-08-14T08:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c93f13cd993bb58fdffc7a6c3e05e77ba20d17e4a780bc4e092b19f0c7ee00f3","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":8,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":8,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T15:32:58.110977Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-19T03:02:00.198219Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2408.08093","last_updated":"2025-02-14T05:33:21Z","snapshot_observed_at":"2026-08-12T23:03:12.617790Z","submitted_at":"2024-08-15T11:36:18Z","title":"When Video Coding Meets Multimodal Large Language Models: A Unified Paradigm for Video Coding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08093","snapshot_observed_at":"2026-08-12T15:32:58.110977Z","title":"When video coding meets multimodal large language models: A unified paradigm for video coding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14135","last_updated":"2024-12-26T08:33:31Z","snapshot_observed_at":"2026-08-12T15:28:24.777157Z","submitted_at":"2024-11-21T14:01:33Z","title":"Compact Visual Data Representation for Green Multimedia -- A Human Visual System Perspective","version":2},"reference_index":120,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:58.110977Z"},"links":{"cited_paper":"/paper/2408.08093","citing_paper":"/paper/2411.14135"},"observation_digest":"sha256:42f0421bf1f4716a2cd7f690b7fc300aa56fce27455d758cad913b9ad6a7987b","observation_id":"c33d1ca7-5f87-4ad5-ae93-c3c31e366350","resolution":{"observed_at":"2026-08-12T15:32:58.110977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08093","last_updated":"2025-02-14T05:33:21Z","snapshot_observed_at":"2026-08-12T23:03:12.617790Z","submitted_at":"2024-08-15T11:36:18Z","title":"When Video Coding Meets Multimodal Large Language Models: A Unified Paradigm for Video Coding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08093","snapshot_observed_at":"2026-08-12T13:58:09.488940Z","title":"When Video Coding Meets Multimodal Large Language Models: A Unified Paradigm for Video Coding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15798","last_updated":"2024-12-25T09:01:45Z","snapshot_observed_at":"2026-08-13T07:15:23.971691Z","submitted_at":"2024-11-24T11:56:59Z","title":"M3-CVC: Controllable Video Compression with Multimodal Generative Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T13:58:09.488940Z"},"links":{"cited_paper":"/paper/2408.08093","citing_paper":"/paper/2411.15798"},"observation_digest":"sha256:6f2638541f04270c520515479b4374c9307ad5f10965d305018be4dcc6055ed8","observation_id":"a88a78f7-389d-4feb-af77-9688162ca6f2","resolution":{"observed_at":"2026-08-12T13:58:09.488940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08093","last_updated":"2025-02-14T05:33:21Z","snapshot_observed_at":"2026-08-12T23:03:12.617790Z","submitted_at":"2024-08-15T11:36:18Z","title":"When Video Coding Meets Multimodal Large Language Models: A Unified Paradigm for Video Coding","version":3},"cited_work":{"arxiv_id":"2408.08093","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.08093","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"When video coding meets multimodal large language models: A unified paradigm for video coding","venue":null,"work_id":"f4fca238-34f0-4f56-983a-27597ee0f7af","year":2024},"citing_paper":{"arxiv_id":"2507.21545","last_updated":"2026-04-20T08:38:38Z","snapshot_observed_at":"2026-07-06T22:04:26.078628Z","submitted_at":"2025-07-29T07:20:49Z","title":"UniDomain: Pretraining a Unified PDDL Domain from Real-World Demonstrations for Generalizable Robot Task Planning","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-19T03:00:28.619627Z"},"links":{"cited_paper":"/paper/2408.08093","citing_paper":"/paper/2507.21545"},"observation_digest":"sha256:40701c369f99a16c71685de9724e18cd35b29679d71f84e2f76dcfc3fa46d1bc","observation_id":"acbccf83-cedc-4ac7-8eb8-8e225ef68a5f","resolution":{"observed_at":"2026-05-19T03:02:00.202644Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08093","last_updated":"2025-02-14T05:33:21Z","snapshot_observed_at":"2026-08-12T23:03:12.617790Z","submitted_at":"2024-08-15T11:36:18Z","title":"When Video Coding Meets Multimodal Large Language Models: A Unified Paradigm for Video Coding","version":3},"cited_work":{"arxiv_id":"2408.08093","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.08093","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"When video coding meets multimodal large language models: A unified paradigm for video coding","venue":null,"work_id":"f4fca238-34f0-4f56-983a-27597ee0f7af","year":2024},"citing_paper":{"arxiv_id":"2508.01994","last_updated":"2026-05-07T19:07:41Z","snapshot_observed_at":"2026-08-07T19:23:36.844739Z","submitted_at":"2025-08-04T02:22:26Z","title":"Deeply Dual Supervised learning for melanoma recognition","version":2},"reference_index":151,"source":"pdf_text","source_observed_at":"2026-05-19T01:12:16.127423Z"},"links":{"cited_paper":"/paper/2408.08093","citing_paper":"/paper/2508.01994"},"observation_digest":"sha256:c0a24bf4cd2dadaa6b508b47aa7f052bc16bd8023ff751c25c878647a8aaf460","observation_id":"4693a5cb-60a0-4cb2-a9aa-9d47a272289a","resolution":{"observed_at":"2026-05-19T01:12:54.887251Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08093","last_updated":"2025-02-14T05:33:21Z","snapshot_observed_at":"2026-08-12T23:03:12.617790Z","submitted_at":"2024-08-15T11:36:18Z","title":"When Video Coding Meets Multimodal Large Language Models: A Unified Paradigm for Video Coding","version":3},"cited_work":{"arxiv_id":"2408.08093","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.08093","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"When video coding meets multimodal large language models: A unified paradigm for video coding","venue":null,"work_id":"f4fca238-34f0-4f56-983a-27597ee0f7af","year":2024},"citing_paper":{"arxiv_id":"2508.06805","last_updated":"2026-05-07T19:07:24Z","snapshot_observed_at":"2026-08-13T19:21:41.425828Z","submitted_at":"2025-08-09T03:28:12Z","title":"Edge Detection for Organ Boundaries via Top Down Refinement and SubPixel Upsampling","version":2},"reference_index":144,"source":"pdf_text","source_observed_at":"2026-05-19T00:46:49.811128Z"},"links":{"cited_paper":"/paper/2408.08093","citing_paper":"/paper/2508.06805"},"observation_digest":"sha256:d22a0bae211ccc3779cf702d9056b00ea81ea01ab3bdc2049406d40077b5e4b6","observation_id":"366b3d50-39a0-4fd1-a0d6-84b81e500b77","resolution":{"observed_at":"2026-05-19T00:46:55.984295Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08093","last_updated":"2025-02-14T05:33:21Z","snapshot_observed_at":"2026-08-12T23:03:12.617790Z","submitted_at":"2024-08-15T11:36:18Z","title":"When Video Coding Meets Multimodal Large Language Models: A Unified Paradigm for Video Coding","version":3},"cited_work":{"arxiv_id":"2408.08093","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.08093","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"When video coding meets multimodal large language models: A unified paradigm for video coding","venue":null,"work_id":"f4fca238-34f0-4f56-983a-27597ee0f7af","year":2024},"citing_paper":{"arxiv_id":"2508.06816","last_updated":"2026-05-07T19:07:10Z","snapshot_observed_at":"2026-07-06T22:10:21.506110Z","submitted_at":"2025-08-09T04:30:34Z","title":"DualResolution Residual Architecture with Artifact Suppression for Melanocytic Lesion Segmentation","version":3},"reference_index":146,"source":"pdf_text","source_observed_at":"2026-05-19T00:42:14.586310Z"},"links":{"cited_paper":"/paper/2408.08093","citing_paper":"/paper/2508.06816"},"observation_digest":"sha256:5665843b1069bab0189cd70b72f7b1a51606c497e53ee3adc323b0eee2987428","observation_id":"7f2bb10d-ee12-43ee-9350-d37dffc7479e","resolution":{"observed_at":"2026-05-19T00:42:54.466522Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08093","last_updated":"2025-02-14T05:33:21Z","snapshot_observed_at":"2026-08-12T23:03:12.617790Z","submitted_at":"2024-08-15T11:36:18Z","title":"When Video Coding Meets Multimodal Large Language Models: A Unified Paradigm for Video Coding","version":3},"cited_work":{"arxiv_id":"2408.08093","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.08093","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"When video coding meets multimodal large language models: A unified paradigm for video coding","venue":null,"work_id":"f4fca238-34f0-4f56-983a-27597ee0f7af","year":2024},"citing_paper":{"arxiv_id":"2508.06819","last_updated":"2026-05-07T19:06:48Z","snapshot_observed_at":"2026-07-06T22:10:21.506110Z","submitted_at":"2025-08-09T04:34:54Z","title":"VesselRW: Weakly Supervised Subcutaneous Vessel Segmentation via Learned Random Walk Propagation","version":3},"reference_index":142,"source":"pdf_text","source_observed_at":"2026-05-19T00:37:16.337914Z"},"links":{"cited_paper":"/paper/2408.08093","citing_paper":"/paper/2508.06819"},"observation_digest":"sha256:ba301bf8a5e07e7048e103635d281df6939b4a0bc236e70d369e51fcd95121e5","observation_id":"ba805d1d-136b-452b-ab54-603ccf5c26ca","resolution":{"observed_at":"2026-05-19T00:41:56.257730Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08093","last_updated":"2025-02-14T05:33:21Z","snapshot_observed_at":"2026-08-12T23:03:12.617790Z","submitted_at":"2024-08-15T11:36:18Z","title":"When Video Coding Meets Multimodal Large Language Models: A Unified Paradigm for Video Coding","version":3},"cited_work":{"arxiv_id":"2408.08093","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.08093","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"When video coding meets multimodal large language models: A unified paradigm for video coding","venue":null,"work_id":"f4fca238-34f0-4f56-983a-27597ee0f7af","year":2024},"citing_paper":{"arxiv_id":"2604.03353","last_updated":"2026-04-03T16:49:42Z","snapshot_observed_at":"2026-08-11T01:35:55.235753Z","submitted_at":"2026-04-03T16:49:42Z","title":"NeuralLVC: Neural Lossless Video Compression via Masked Diffusion with Temporal Conditioning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-13T18:36:46.358865Z"},"links":{"cited_paper":"/paper/2408.08093","citing_paper":"/paper/2604.03353"},"observation_digest":"sha256:8cf23cbf4427be23d05e2ea73091f5d1a7869d7eb1530c929722cb7dd03bba19","observation_id":"8fd32fef-d011-45fa-899d-a22ea82ae3ed","resolution":{"observed_at":"2026-05-13T18:38:07.141116Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2408.08093/citation-record","integrity":"/paper/2408.08093/integrity","json":"/paper/2408.08093/citation-record.json","paper":"/paper/2408.08093"},"outbound":[],"paper":{"arxiv_id":"2408.08093","last_updated":"2025-02-14T05:33:21Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T23:03:12.617790Z","submitted_at":"2024-08-15T11:36:18Z","title":"When Video Coding Meets Multimodal Large Language Models: A Unified Paradigm for Video Coding"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 8 inbound Pith citation observations for arXiv:2408.08093."}