{"as_of":"2026-08-18T05:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fbd9a8ab4da7c47bcec9ec0baf99d7b461b746b54e912a5f7bc53dcc967bb176","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T04:21:46.207000Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.01471/citation-record","integrity":"/paper/2412.01471/integrity","json":"/paper/2412.01471/citation-record.json","paper":"/paper/2412.01471"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:21:47.323565Z","title":null,"venue":null,"work_id":"6f5ecb03-8b28-43c4-8b10-55e28b97c9c2","year":2023},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:45.902630Z"},"links":{"citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:357b33a8fe0b845b3137d66363bcff34e3c9c049f6fa8c038883541d15032610","observation_id":"aef6d731-5cf5-4c14-ba73-a27a98c3cda4","resolution":{"observed_at":"2026-08-12T04:21:47.331463Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:21:47.304036Z","title":null,"venue":null,"work_id":"1e749c04-eb2b-4d89-9563-22e3defd6660","year":2023},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:45.909557Z"},"links":{"citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:72a6a092fdd02f27badd41c58ea51d7bb605d2d5613f6d0a9b8fd02cca19ea2c","observation_id":"47f08d9c-2cef-4909-ab65-9ea16e59d167","resolution":{"observed_at":"2026-08-12T04:21:47.310941Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.00269","last_updated":"2017-12-31T11:46:54Z","snapshot_observed_at":"2026-08-14T19:58:57.822039Z","submitted_at":"2017-12-31T11:46:54Z","title":"Interactive Video Object Segmentation in the Wild","version":1},"cited_work":{"arxiv_id":"1801.00269","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.00269","snapshot_observed_at":"2026-08-12T04:21:46.777179Z","title":"Interactive Video Object Segmentation in the Wild","venue":"cs.CV","work_id":"fd5aa64a-5ee5-4470-ba6d-6642e40afd9a","year":2017},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:45.915574Z"},"links":{"cited_paper":"/paper/1801.00269","citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:adc5dd8cbbb56f9c3bbe8550259eaefa94e5fb92d21042b4da2703ade6704648","observation_id":"caf849a9-4ecd-448c-8fe2-0c58274e2fd8","resolution":{"observed_at":"2026-08-12T04:21:46.784713Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:21:47.285833Z","title":null,"venue":null,"work_id":"d0a4965a-553e-496f-a055-f217fb971589","year":2017},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:45.922136Z"},"links":{"citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:a0dbab1b2e9304ddfde1914d91c7ec9f591a7a7f447a4ef7a43ba6eeb36d042d","observation_id":"519483be-5542-4bc8-91b4-f7b454bc8252","resolution":{"observed_at":"2026-08-12T04:21:47.291485Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:21:45.928509Z","title":"K.; Oh, S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:45.928509Z"},"links":{"citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:e4181e16f4be90c7614fa9b4fbfd9a09ca209171d759848ccae225c5de787b1c","observation_id":"1739a4e3-9b0d-4917-999c-5e3fb96d8cc3","resolution":{"observed_at":"2026-08-12T04:21:45.928509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:21:47.254232Z","title":"K.; and Schwing, A","venue":null,"work_id":"58431ce1-824d-4b60-b960-ff7d81f62c54","year":2022},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:45.935245Z"},"links":{"citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:a6387e99fe6215e124dfafbecfca25e102268b77c6cfcc9f5a0eb731619b366f","observation_id":"6ebab65c-95ca-48a0-a51f-3b6e9bf00c6f","resolution":{"observed_at":"2026-08-12T04:21:47.260488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:21:47.230699Z","title":"K.; Tai, Y.-W.; and Tang, C.-K","venue":null,"work_id":"d2295717-3905-4001-896b-edfddf7aa558","year":2021},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:45.942931Z"},"links":{"citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:33860a730ad8ca5f3968879740b5ea1c6ce36a182581a5cb1d763a5bfc2a7196","observation_id":"002c6daa-d22f-4763-a0e2-990a04574232","resolution":{"observed_at":"2026-08-12T04:21:47.240448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1259","last_updated":"2014-10-07T18:08:30Z","snapshot_observed_at":"2026-08-14T23:20:50.864190Z","submitted_at":"2014-09-03T21:03:41Z","title":"On the Properties of Neural Machine Translation: Encoder-Decoder Approaches","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1259","snapshot_observed_at":"2026-08-12T04:21:45.947969Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:45.947969Z"},"links":{"cited_paper":"/paper/1409.1259","citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:406541b22d582a2bac2c2012c8cb7d49f1a33d99a1feae7ad7f93f5f5d456f3a","observation_id":"0636cbe1-faaf-409d-b527-7eab99684525","resolution":{"observed_at":"2026-08-12T04:21:45.947969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:21:47.209633Z","title":null,"venue":null,"work_id":"9abe9e81-c174-4c94-ba01-be8e95ba141e","year":2021},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:45.954507Z"},"links":{"citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:c30081005d703fa12d321258b4d661a6342a6ba90b1b120034cb67f9c7fbb690","observation_id":"056f17c2-889b-4a3b-bafb-02da565bd374","resolution":{"observed_at":"2026-08-12T04:21:47.215016Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15261","last_updated":"2024-04-26T03:12:35Z","snapshot_observed_at":"2026-08-16T14:24:05.374882Z","submitted_at":"2024-01-27T01:01:58Z","title":"Vanishing-Point-Guided Video Semantic Segmentation of Driving Scenes","version":2},"cited_work":{"arxiv_id":"2401.15261","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.15261","snapshot_observed_at":"2026-08-12T04:21:46.682755Z","title":"Vanishing-Point-Guided Video Semantic Segmentation of Driving Scenes","venue":"cs.CV","work_id":"740f826c-13f1-409a-a518-d7314bc9efb2","year":2024},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:45.960956Z"},"links":{"cited_paper":"/paper/2401.15261","citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:d100cf0d693f6d9fd94f21f1117ba5829d2515be649e725cdbe5e87d66f7bbad","observation_id":"852b49c3-83ff-45ca-a250-34cb085eb1d1","resolution":{"observed_at":"2026-08-12T04:21:46.713631Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:21:45.971024Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:45.971024Z"},"links":{"citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:5d26a564228b8bd94b3d1bb515d66a775d3ec79396badf21777fee1212178a57","observation_id":"25232b02-6c78-435e-b750-6a72be076ae8","resolution":{"observed_at":"2026-08-12T04:21:45.971024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:21:47.176127Z","title":null,"venue":null,"work_id":"86745360-33eb-4c65-b5d6-0d2c0770b01a","year":2020},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:45.985422Z"},"links":{"citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:06a5602e7ac02e5102e7bc5df3892c2569451a25dab75ab6db47676eba1fc1ce","observation_id":"0f6df3ad-07b8-42f7-84d9-4ffb0f29e4c3","resolution":{"observed_at":"2026-08-12T04:21:47.183797Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.02643","last_updated":"2023-04-05T17:59:46Z","snapshot_observed_at":"2026-08-08T05:14:59.435033Z","submitted_at":"2023-04-05T17:59:46Z","title":"Segment Anything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.02643","snapshot_observed_at":"2026-08-12T04:21:45.993198Z","title":"C.; Lo, W.-Y.; et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:45.993198Z"},"links":{"cited_paper":"/paper/2304.02643","citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:64a06bbc4a6f043a52e2e75d9641384e89fbd2572f0483ade65411dff439e94e","observation_id":"a261059f-f247-4381-90ec-5b18d9e3de38","resolution":{"observed_at":"2026-08-12T04:21:45.993198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.14362","last_updated":"2023-02-28T07:30:36Z","snapshot_observed_at":"2026-08-16T15:52:11.116841Z","submitted_at":"2023-02-28T07:30:36Z","title":"One-Shot Video Inpainting","version":1},"cited_work":{"arxiv_id":"2302.14362","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.14362","snapshot_observed_at":"2026-08-12T04:21:46.561404Z","title":"One-Shot Video Inpainting","venue":"cs.CV","work_id":"0398fc91-b6bb-46ba-9dbb-e649d5d7a2a1","year":2023},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:46.007561Z"},"links":{"cited_paper":"/paper/2302.14362","citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:6cadaac333f8446b332d1893ef71dce128859851cc2b2c32447d286466f3efba","observation_id":"2bb6844c-7654-4ecd-bd0f-727169d4df49","resolution":{"observed_at":"2026-08-12T04:21:46.601319Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:21:47.155091Z","title":"G.; Chen, Y.-T.; Qiu, E.; and Huang, J.-B","venue":null,"work_id":"f85184e4-277e-4dd1-9100-dcbc4d509538","year":2023},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:46.013584Z"},"links":{"citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:87a822b61f55abcfc364861d24261842f4929c46cabb7b3eebf5b966c305b152","observation_id":"93f04f6d-ed8a-4749-b64b-9e847bc47afe","resolution":{"observed_at":"2026-08-12T04:21:47.161870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:21:47.129927Z","title":null,"venue":null,"work_id":"6e6f4e05-7bc0-4f37-aa5e-e317e651ecf0","year":2022},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:46.018822Z"},"links":{"citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:3bf95de2ad3459abf1eac6507a53b66d493e726ded71df147369f1bea2fbcf5e","observation_id":"428eb7e3-53a3-4a77-91f2-6f6461b13214","resolution":{"observed_at":"2026-08-12T04:21:47.138428Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:21:47.107977Z","title":null,"venue":null,"work_id":"e89d48b2-25be-4e89-850d-09619c4999b8","year":2020},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:46.025996Z"},"links":{"citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:86c9ac034fb0fc6031ed5140f4b00305d47fffed5bd96810277f672b97ccb8b5","observation_id":"4e86f839-9cbc-44bb-ba53-e1c693dae2a6","resolution":{"observed_at":"2026-08-12T04:21:47.114279Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:21:47.087018Z","title":"E.; Luiten, J.; Dave, A.; Ramanan, D.; Leibe, B.; O s ep, A.; and Leal-Taix \\'e , L","venue":null,"work_id":"f985efea-22b8-44c5-9db5-295ab79e62e6","year":2022},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:46.037592Z"},"links":{"citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:c6046260e34307eb9dd05dd35071b2c5dc2a0b95248d5c3f566dd7123898136a","observation_id":"333b9bf9-adca-4cfe-8a39-c7ca2d9189f4","resolution":{"observed_at":"2026-08-12T04:21:47.093314Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-12T04:21:46.047116Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:46.047116Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:81f6ec8ca5acbf786921c0dc8f3c674377618b795d097ecab03ff4bd08a88ff5","observation_id":"724e365d-2a88-46f6-87a8-507c71cf7664","resolution":{"observed_at":"2026-08-12T04:21:46.047116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.15266","last_updated":"2023-09-18T14:46:11Z","snapshot_observed_at":"2026-08-16T15:04:57.284383Z","submitted_at":"2023-08-29T12:51:04Z","title":"NOVIS: A Case for End-to-End Near-Online Video Instance Segmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.15266","snapshot_observed_at":"2026-08-12T04:21:46.054051Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:46.054051Z"},"links":{"cited_paper":"/paper/2308.15266","citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:3b2212db67e59d1b734a994f1a2feb5679d86e0eb5a919c72e45515f30f03f54","observation_id":"4a42f980-57e8-4259-ad32-2f114eea41a9","resolution":{"observed_at":"2026-08-12T04:21:46.054051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:21:47.066829Z","title":null,"venue":null,"work_id":"88e3765c-ad34-4d71-b66e-58c9c112094c","year":2022},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:46.060544Z"},"links":{"citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:e04cf2fc54ec8576effa29a8836e8753fa75cab4ccbc1e09f1194e21124e6b94","observation_id":"439bc444-2884-45c9-beb1-a9b1812af185","resolution":{"observed_at":"2026-08-12T04:21:47.072851Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:21:47.046783Z","title":null,"venue":null,"work_id":"e46fa730-189a-4db8-bf7b-16332fdf70f7","year":2022},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:46.066339Z"},"links":{"citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:eae90c40e58b81ef7684a78d7ac5fbc83fa9023d9455008e06c75afbd340039e","observation_id":"9410ac3f-d620-4971-b69b-5c984a569f2b","resolution":{"observed_at":"2026-08-12T04:21:47.051845Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:21:47.027157Z","title":"W.; Lee, J.-Y.; Xu, N.; and Kim, S","venue":null,"work_id":"c40426e9-a916-4521-9532-a84b8c66fce6","year":2019},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:46.071409Z"},"links":{"citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:515f1afb52eba09315404a1250c01e205050720aba4b968dc3c1ec74aca81efd","observation_id":"2e722013-e1de-4319-ad4e-3b32f206a9db","resolution":{"observed_at":"2026-08-12T04:21:47.033063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1704.00675","last_updated":"2018-03-01T17:50:08Z","snapshot_observed_at":"2026-08-02T10:51:13.194643Z","submitted_at":"2017-04-03T16:44:46Z","title":"The 2017 DAVIS Challenge on Video Object Segmentation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.00675","snapshot_observed_at":"2026-08-12T04:21:46.082200Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:46.082200Z"},"links":{"cited_paper":"/paper/1704.00675","citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:d10b28887de8bd3044971d5bd5958fba858c09721d596b19ac91d310d0bfd5fe","observation_id":"20be8c14-53a0-431a-a110-2629781293ec","resolution":{"observed_at":"2026-08-12T04:21:46.082200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:21:46.088045Z","title":"H.; and Bai, S","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:46.088045Z"},"links":{"citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:698a7169cdeda4b5a5a56e1e26afd64769389a78e813a1e8d6a91ef6cc1702ad","observation_id":"1953cf00-f35c-4d17-b055-efe49fc42239","resolution":{"observed_at":"2026-08-12T04:21:46.088045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.05258","last_updated":"2020-12-09T19:00:35Z","snapshot_observed_at":"2026-08-16T18:59:44.239532Z","submitted_at":"2020-12-09T19:00:35Z","title":"ViP-DeepLab: Learning Visual Perception with Depth-aware Video Panoptic Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.05258","snapshot_observed_at":"2026-08-12T04:21:46.093873Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:46.093873Z"},"links":{"cited_paper":"/paper/2012.05258","citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:07145b24fd4238fd1222e7fce0c6b1f3c0915f43240d60cfcd9946b2baa0b7e8","observation_id":"ac330315-6295-4efc-af79-0c7402baa9dd","resolution":{"observed_at":"2026-08-12T04:21:46.093873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01197","last_updated":"2023-12-03T23:57:43Z","snapshot_observed_at":"2026-08-16T15:19:04.611372Z","submitted_at":"2023-07-03T17:58:01Z","title":"Segment Anything Meets Point Tracking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01197","snapshot_observed_at":"2026-08-12T04:21:46.100993Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:46.100993Z"},"links":{"cited_paper":"/paper/2307.01197","citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:9c87db8f1d13fba00eea553b5675828d904ea248b68dd24bc629f3032f3ae01b","observation_id":"f675beb6-cd89-42fb-b6d5-308438fad889","resolution":{"observed_at":"2026-08-12T04:21:46.100993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:21:46.106984Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:46.106984Z"},"links":{"citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:38d5eef7eb22e0e21068b5b8ed44658695a387c823d97aaa232f015a4e96ad08","observation_id":"3ca7d315-ed1c-4a0a-a461-f6b67dc83302","resolution":{"observed_at":"2026-08-12T04:21:46.106984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:21:46.976378Z","title":null,"venue":null,"work_id":"5e13466b-e020-43bf-87e3-6e8b1acf5604","year":2023},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:46.112600Z"},"links":{"citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:3d7bb76b586e79f3dd64e52a539a024e7b91d9293ed1fb07c29e67f2509251c8","observation_id":"9e6317a0-ddac-4d4b-80ec-2d7493d24edf","resolution":{"observed_at":"2026-08-12T04:21:46.983651Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:21:46.957381Z","title":null,"venue":null,"work_id":"1adb7719-ef7d-4115-848f-3bd8da9b97aa","year":2021},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:46.117435Z"},"links":{"citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:984700b586c24fcf5b02317db6412e96a1648131b6d71d8c42fe8754aa0dab1c","observation_id":"c75df7bd-e01d-452c-b826-f7863c7e7250","resolution":{"observed_at":"2026-08-12T04:21:46.962594Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09158","last_updated":"2023-12-14T17:26:00Z","snapshot_observed_at":"2026-08-16T14:34:41.114249Z","submitted_at":"2023-12-14T17:26:00Z","title":"General Object Foundation Model for Images and Videos at Scale","version":1},"cited_work":{"arxiv_id":"2312.09158","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.09158","snapshot_observed_at":"2026-08-12T04:21:46.422999Z","title":"General Object Foundation Model for Images and Videos at Scale","venue":"cs.CV","work_id":"f73fd736-a70e-415e-a351-a8bead954045","year":2023},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:46.123796Z"},"links":{"cited_paper":"/paper/2312.09158","citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:b7e0640e6d1c369bb5cfc5b7656f4b14d3d44e79130c99457d8ce985f40cb03d","observation_id":"ec3e7466-51f3-420c-8b31-01b3c1ce1b23","resolution":{"observed_at":"2026-08-12T04:21:46.428446Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:21:46.936096Z","title":null,"venue":null,"work_id":"95756f0b-0908-45ac-8648-d80a9d264c0e","year":2023},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:46.129117Z"},"links":{"citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:cee9f38d68ec1f44f5fecacd5ff52b51030e8aff3e878436b01432b6b71e8800","observation_id":"01599b26-60b3-430d-9147-3271a982bcf7","resolution":{"observed_at":"2026-08-12T04:21:46.943095Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.03327","last_updated":"2018-09-06T04:19:45Z","snapshot_observed_at":"2026-08-14T18:32:23.594089Z","submitted_at":"2018-09-06T04:19:45Z","title":"YouTube-VOS: A Large-Scale Video Object Segmentation Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.03327","snapshot_observed_at":"2026-08-12T04:21:46.135817Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:46.135817Z"},"links":{"cited_paper":"/paper/1809.03327","citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:8545136fe505b2be474dbbb417c025fd89e2cda6f4b68090e8ae3ad7390ceb1e","observation_id":"d12304b5-c869-4dac-b0f5-d661eb988670","resolution":{"observed_at":"2026-08-12T04:21:46.135817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:21:46.916398Z","title":null,"venue":null,"work_id":"27e956da-1c60-40bc-9495-8864757cdb5d","year":2022},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:46.142910Z"},"links":{"citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:d4f6913097ed62a24ac4887e9a668ba3028705c6f7d97e97f99b17d1d8964fd8","observation_id":"3edbe518-041b-4748-abd6-a9b6a2eef7b5","resolution":{"observed_at":"2026-08-12T04:21:46.924549Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:21:46.149350Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:46.149350Z"},"links":{"citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:41d494537a51d0e64daab30efcb5b289527276dbfd9664f00f8b4c76911e1da8","observation_id":"06e0b463-98ad-458a-85c8-cf13d8221702","resolution":{"observed_at":"2026-08-12T04:21:46.149350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:21:46.865329Z","title":null,"venue":null,"work_id":"22e21718-898b-4a2b-9274-6b80d3507e2e","year":2021},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:46.156986Z"},"links":{"citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:05cd3771835edb5d089050a59b36f764a5ab0c0f2019934bb15043cb519d360f","observation_id":"b58946fa-7213-42a4-a5bb-7c4d6bf07d43","resolution":{"observed_at":"2026-08-12T04:21:46.872707Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.03048","last_updated":"2023-10-04T01:15:21Z","snapshot_observed_at":"2026-08-16T15:35:32.915462Z","submitted_at":"2023-05-04T17:59:36Z","title":"Personalize Segment Anything Model with One Shot","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.03048","snapshot_observed_at":"2026-08-12T04:21:46.163179Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:46.163179Z"},"links":{"cited_paper":"/paper/2305.03048","citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:eb10a920ff7ad4e2a255588c84b3d94d0db8b109839a6d25890f46aef4e10289","observation_id":"465ee7e3-2038-454b-b0fc-a0b8bf310e4a","resolution":{"observed_at":"2026-08-12T04:21:46.163179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.13305","last_updated":"2023-12-20T03:01:33Z","snapshot_observed_at":"2026-08-16T14:33:07.809682Z","submitted_at":"2023-12-20T03:01:33Z","title":"DVIS++: Improved Decoupled Framework for Universal Video Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.13305","snapshot_observed_at":"2026-08-12T04:21:46.168535Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:46.168535Z"},"links":{"cited_paper":"/paper/2312.13305","citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:03e2a0d406207b0c11ed6724fde949c006addbd86823f0307e442e86becaf291","observation_id":"631e87ac-e530-4c14-919c-29affa5dde9f","resolution":{"observed_at":"2026-08-12T04:21:46.168535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:21:46.834014Z","title":null,"venue":null,"work_id":"2b606b17-437d-41e1-b932-e00873414099","year":2024},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:46.174160Z"},"links":{"citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:9d5c6388dd891b6ede181f6a3b275c4d093a06c09e196881de03f90d9e529c8a","observation_id":"87d87ed9-88be-403c-bdad-749f8450e402","resolution":{"observed_at":"2026-08-12T04:21:46.843736Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04194","last_updated":"2024-03-07T03:52:59Z","snapshot_observed_at":"2026-08-16T14:12:06.186551Z","submitted_at":"2024-03-07T03:52:59Z","title":"SAM-PD: How Far Can SAM Take Us in Tracking and Segmenting Anything in Videos by Prompt Denoising","version":1},"cited_work":{"arxiv_id":"2403.04194","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.04194","snapshot_observed_at":"2026-08-12T04:21:46.329286Z","title":"SAM-PD: How Far Can SAM Take Us in Tracking and Segmenting Anything in Videos by Prompt Denoising","venue":"cs.CV","work_id":"bebf1b4d-9947-4ee4-a944-b5c01dbf21f2","year":2024},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:46.180497Z"},"links":{"cited_paper":"/paper/2403.04194","citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:76ba17806d543c79153b652c52b65adecdc4f7a1a24195b87d7d98ca6e34912d","observation_id":"1517256d-734a-475f-ab5d-172398b13afd","resolution":{"observed_at":"2026-08-12T04:21:46.339514Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13974","last_updated":"2023-07-26T06:19:46Z","snapshot_observed_at":"2026-08-16T15:13:13.928363Z","submitted_at":"2023-07-26T06:19:46Z","title":"Tracking Anything in High Quality","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13974","snapshot_observed_at":"2026-08-12T04:21:46.186233Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:46.186233Z"},"links":{"cited_paper":"/paper/2307.13974","citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:16964b0da01cc598c9aaf84ee0308eea2169cfa5c659818d0e9316c70437741f","observation_id":"7b8b6a65-206e-439f-892a-b328d4864793","resolution":{"observed_at":"2026-08-12T04:21:46.186233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05917","last_updated":"2024-06-10T17:58:56Z","snapshot_observed_at":"2026-08-16T14:20:07.266872Z","submitted_at":"2024-02-08T18:52:23Z","title":"Point-VOS: Pointing Up Video Object Segmentation","version":2},"cited_work":{"arxiv_id":"2402.05917","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.05917","snapshot_observed_at":"2026-08-12T04:21:46.267524Z","title":"Point-VOS: Pointing Up Video Object Segmentation","venue":"cs.CV","work_id":"644bcdcc-c6f5-487f-9f23-bb8697f654c8","year":2024},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:46.191379Z"},"links":{"cited_paper":"/paper/2402.05917","citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:3b2fcf7734d955036037a4de2bc2f8a19f235f7a1e3f2feb248f2092d48786db","observation_id":"20aa0005-6f7d-4e8c-982a-02c3916e0023","resolution":{"observed_at":"2026-08-12T04:21:46.277236Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:21:46.196133Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:46.196133Z"},"links":{"citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:2080419b2ffecaa3987b07dea6856c752386b8eb16f147b910fcd11eb882cb23","observation_id":"2d66fb02-29a5-4119-b85a-bfea83fde5f2","resolution":{"observed_at":"2026-08-12T04:21:46.196133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:21:46.207000Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-12T04:21:46.207000Z"},"links":{"citing_paper":"/paper/2412.01471"},"observation_digest":"sha256:77ebf296d402b174ec625cbba69bf58f39bd4dce7e081df3368a920fb70c43be","observation_id":"959e1bb4-b476-4a6e-8ce4-c427ac672b6d","resolution":{"observed_at":"2026-08-12T04:21:46.207000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.01471","last_updated":"2024-12-03T05:42:22Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T01:25:36.715396Z","submitted_at":"2024-12-02T13:17:41Z","title":"Multi-Granularity Video Object Segmentation"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":33,"verified_exact":5,"verified_fuzzy":5},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 0 inbound Pith citation observations for arXiv:2412.01471."}