{"as_of":"2026-08-19T05:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1324b81a12473e4695ac813f2d7c1dc439dee0a02c1858442698fafb27155af6","coverage":[{"denominator":69,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":69,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T00:23:45.181243Z","state":"measured"},{"denominator":69,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":69,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.08147/citation-record","integrity":"/paper/2608.08147/integrity","json":"/paper/2608.08147/citation-record.json","paper":"/paper/2608.08147"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:43.427909Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:43.427909Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:d717280f6d760962cf913ee9e299213c25bf6895c2f9a47c76661186cb64b3de","observation_id":"4c32549a-13cb-42c3-9c88-5c8533d6dc12","resolution":{"observed_at":"2026-08-12T00:23:43.427909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:47.343263Z","title":null,"venue":null,"work_id":"b0d55bd7-4464-43d7-9db9-95ea51cc29d1","year":null},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:43.444410Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:13ea1e2dbf2abffabfb143beec4c237570d2ff00fcd6f332f3cc62386ced4262","observation_id":"9fa9f973-6b3b-4e3e-a0a6-780cf5c14496","resolution":{"observed_at":"2026-08-12T00:23:47.348784Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10764","last_updated":"2021-12-20T18:59:59Z","snapshot_observed_at":"2026-08-18T18:30:41.010430Z","submitted_at":"2021-12-20T18:59:59Z","title":"Mask2Former for Video Instance Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10764","snapshot_observed_at":"2026-08-12T00:23:43.457322Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:43.457322Z"},"links":{"cited_paper":"/paper/2112.10764","citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:069a2a5fd92aee7f9376f8ce0356f91d8382b496f90ca20ca01f8c1c54577b32","observation_id":"ff261f16-f6ee-4523-bb13-442e9aadc9dc","resolution":{"observed_at":"2026-08-12T00:23:43.457322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:43.465354Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:43.465354Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:e0ba0a32d0596447cdf08df60e67aa3ab31a149c920fda89b7ccaba0a37e1066","observation_id":"f4a4a46f-468a-4235-a5ee-7a927b74a91d","resolution":{"observed_at":"2026-08-12T00:23:43.465354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:47.297225Z","title":null,"venue":null,"work_id":"613dae90-ba1f-4b23-8c91-02ca3ed3dcb3","year":2024},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:43.535199Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:f59935d29e616ea924da6bd8e6d7b23af471abc19a9a6fcc3b2a7294c8c965fe","observation_id":"763013db-866f-45d6-b1ea-b8d3e4ac1314","resolution":{"observed_at":"2026-08-12T00:23:47.302624Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:47.277212Z","title":null,"venue":null,"work_id":"54dde5ce-5be2-46b1-ab82-c96e4d0fea24","year":2018},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:43.570550Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:d6efcf86f3e5f2a8f660d716d80f563f9c598a8dab6e570633b986a1f6a1e730","observation_id":"3d1ecc63-f5ca-473e-a735-bc266d02228b","resolution":{"observed_at":"2026-08-12T00:23:47.283737Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:47.260483Z","title":null,"venue":null,"work_id":"008bdcea-c7bd-4bdc-aecf-30175a4fa61b","year":2024},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:43.649272Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:af3ce333a7ed8f61cd5235cc3735a322732fcc4d6d62c3a00608e4e50860090b","observation_id":"00af9993-906d-47ea-8925-c5a02ec86614","resolution":{"observed_at":"2026-08-12T00:23:47.265945Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:47.240631Z","title":null,"venue":null,"work_id":"5b87e562-5d76-40ef-9e79-6ac72414113c","year":2024},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:43.676331Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:f7b5459e8751e414e9e342ed857d2d14268406e9b9b1b7022df84f5878d4ac66","observation_id":"2ab89764-c1e7-43b6-8e0f-36b0445dc6ef","resolution":{"observed_at":"2026-08-12T00:23:47.246304Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:43.687375Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:43.687375Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:26913b031466527aae7cfad7e24d92b2cf22bf53977d7b243f76988cbf591bd5","observation_id":"081fb75f-f239-4410-b95a-1d9485476df4","resolution":{"observed_at":"2026-08-12T00:23:43.687375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:43.692883Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:43.692883Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:9ea532453cf7361a202b05d4da597e139226897caa5d39a599124f76732f8c78","observation_id":"a196497c-14a3-4d51-a63c-7548db47c40b","resolution":{"observed_at":"2026-08-12T00:23:43.692883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.11523","last_updated":"2026-07-13T13:09:45Z","snapshot_observed_at":"2026-08-15T01:01:51.688250Z","submitted_at":"2026-07-13T13:09:45Z","title":"Vinci2: Providing Proactive Assistance in Continuous Egocentric Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.11523","snapshot_observed_at":"2026-08-12T00:23:43.698528Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:43.698528Z"},"links":{"cited_paper":"/paper/2607.11523","citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:25a480954c25907f1a84826a0f5c4e0d50e33df5c2eb67c9989c9ff7538430c0","observation_id":"c3aa9a52-be5b-44d8-a0fa-d8d671e59fcd","resolution":{"observed_at":"2026-08-12T00:23:43.698528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:43.704862Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:43.704862Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:dacf92044adf0a03b61cef9e760583d49acb8f07a85da5c04e267014ffa4a56e","observation_id":"9c511824-9850-4f74-88fc-8825aaf76f52","resolution":{"observed_at":"2026-08-12T00:23:43.704862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:43.709412Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:43.709412Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:6a6e4421cbbfcfeb6193202087156867997d8b0440cd1a0a40b42eb3fbf06415","observation_id":"8b6c1ea2-784d-48d6-aac2-a6863f5d5044","resolution":{"observed_at":"2026-08-12T00:23:43.709412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:47.200149Z","title":null,"venue":null,"work_id":"95161a27-3706-484d-aa00-6fa0dfa45062","year":2026},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:43.815849Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:8e93646b54d8521250105ed3900f8c610e9c7bbee6e2fd0addc2be834c355a35","observation_id":"24ec047a-6e78-4c8f-90f7-e7933eb601d5","resolution":{"observed_at":"2026-08-12T00:23:47.206213Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:43.898118Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:43.898118Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:bf15b8fc2b03bec7550e316fd39ac09cf6c111d5bdccba1eca5cf54dcae2da37","observation_id":"758d153a-1770-4c9d-94ea-27468da1a89e","resolution":{"observed_at":"2026-08-12T00:23:43.898118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-08-17T20:47:46.242385Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-12T00:23:43.974152Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:43.974152Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:763d356e79f8129b9937b0a5a49949d228c270f9099b1fbfdc88ca51c0690e1e","observation_id":"7056d056-fa54-4d9c-a185-8535ffaf2cf6","resolution":{"observed_at":"2026-08-12T00:23:43.974152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:47.184214Z","title":null,"venue":null,"work_id":"0532f637-ed74-4791-b847-ed7b24fdec50","year":2022},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.003759Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:22730c31e478feda8d9a698e21c663c23dc8d2bf5a6cbecd372e855c328ad4dc","observation_id":"276f969e-1047-48a7-95d9-c286f3d0eaf6","resolution":{"observed_at":"2026-08-12T00:23:47.189249Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.039580Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.039580Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:be2cfaf8eea1e3ba61344bd63bf9d4c1d3e6bf83567c41b7f32e6582f5377fe8","observation_id":"a7359f0e-16d5-47a3-b11a-bd246c53ce90","resolution":{"observed_at":"2026-08-12T00:23:44.039580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.054593Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.054593Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:0b2810b8073d577ee8126d5aad0ea23b763d62150fd985bc741d7f6ddbd6f224","observation_id":"26b8e7fc-f26a-4ebe-8278-04ac5239fc4e","resolution":{"observed_at":"2026-08-12T00:23:44.054593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.060295Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.060295Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:ee6b2217d1009ec6032f2f5e4ed51645079be18c55dd93eb081f85afaa56777d","observation_id":"c8810991-a84b-42fc-a065-c6999532c7a5","resolution":{"observed_at":"2026-08-12T00:23:44.060295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.069809Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.069809Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:5db0a8ce3885701054136728ad1005268152b0d693e87bed3532bbaf7c628806","observation_id":"e8d7d534-588d-4320-a112-30abe0b4d2ab","resolution":{"observed_at":"2026-08-12T00:23:44.069809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.064924Z","title":"In Proceedings of the AAAI conference on artificial intelligence, Vol","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.064924Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:432edd6babc5d416a70227d3dde3446fb3ee992e14cf5b3be05bb964c55b82aa","observation_id":"e267506d-e2cd-474a-9e61-73f491c231af","resolution":{"observed_at":"2026-08-12T00:23:44.064924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.304337Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.304337Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:85f6b8d472ecaa575bd15a9e0c0480f1c7b079c9b31c174ac98c756398366440","observation_id":"c90fbe91-0a72-4de1-ba9a-587368e38094","resolution":{"observed_at":"2026-08-12T00:23:44.304337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.177223Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.177223Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:abebf9d842b620fc7c46f9799db61f9c137ffd930bcd54cd6f0cdcf42b8e5965","observation_id":"2518938b-4cb6-416d-98fd-0887df492bc8","resolution":{"observed_at":"2026-08-12T00:23:44.177223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:47.052269Z","title":null,"venue":null,"work_id":"af5d3639-8329-4b5e-bcb3-60c0f74cebb5","year":2024},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.321058Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:466aa2dfaca6d492ad02914994b1292be4175712d793a9eb94a2439c256d7019","observation_id":"af1daff2-2390-40d9-86ee-641237e978e7","resolution":{"observed_at":"2026-08-12T00:23:47.057470Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:47.036094Z","title":null,"venue":null,"work_id":"8a46fd02-b974-4353-95ae-fa112ab33767","year":2026},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.325406Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:db72483663f6797d9af53354a767ed4a989b684708e4bf27e221ddd625c72835","observation_id":"54e188d3-6498-495c-a7e9-1c182282a3f5","resolution":{"observed_at":"2026-08-12T00:23:47.041293Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:47.069713Z","title":null,"venue":null,"work_id":"16215c8a-ecbd-4b79-a1ef-1cbd6f743cdf","year":2025},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.315924Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:a33ea82fe6020e1746750e0e6f4d6228b7db36c3de87173f7e3c89837c989d0d","observation_id":"19df8336-978a-4d22-9403-e437b863b8e7","resolution":{"observed_at":"2026-08-12T00:23:47.074259Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:47.009274Z","title":null,"venue":null,"work_id":"ce7cbba3-251d-42b2-8241-a5a1ed38d72e","year":2023},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.457604Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:7e12c9d917177ec87f846c3594b0480ad53552aedeb377b6dbecbd9be5130fe6","observation_id":"99d37dc9-33df-4cbc-bbaa-eeaea44116a5","resolution":{"observed_at":"2026-08-12T00:23:47.014282Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.482466Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.482466Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:df31b977e590d3b90da35cadff2eb610bba0621759b3eea1e906d0a571425319","observation_id":"52f8ef2f-7084-4a73-943e-22c4c01b38d1","resolution":{"observed_at":"2026-08-12T00:23:44.482466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.386644Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.386644Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:b226c3dbfcd1ea0a5d706bd78a73b37e8546b27d02d8a1cf95157168baa65353","observation_id":"e02fc491-881d-4bcf-ae89-3f7426715817","resolution":{"observed_at":"2026-08-12T00:23:44.386644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.961621Z","title":null,"venue":null,"work_id":"1deeaef2-6b02-4869-8bdb-e5232ca43850","year":2026},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.509387Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:1fdcc8cbef23e908f3b3b433650540360b9344fde3c9961b78e0392b1758535b","observation_id":"248385f0-6fa3-4688-89d8-3b426bf79bd4","resolution":{"observed_at":"2026-08-12T00:23:46.967633Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.943390Z","title":null,"venue":null,"work_id":"965bb919-f0a7-4fa6-9848-c24f07d9ef84","year":2026},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.513839Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:3d6bc55718da78dc219ab764ec2770ad9c83d63f8373b0736e462834b2cd4e72","observation_id":"dd1954c7-dc47-4b49-bcd6-1c2249c1585a","resolution":{"observed_at":"2026-08-12T00:23:46.948297Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.497075Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.497075Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:4e2aabf76cc1a5ce5649e449052ef20e69071836cd3f064331593e8b9f3c4437","observation_id":"79fa4491-911b-4300-87eb-04016732d339","resolution":{"observed_at":"2026-08-12T00:23:44.497075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.674016Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.674016Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:3e63958e730c5a0e5e3f0c693e8577e75efa51dbde457617e6122912e5c9d536","observation_id":"9d1a9a82-9b3d-4673-9fca-16447be6741b","resolution":{"observed_at":"2026-08-12T00:23:44.674016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.679878Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.679878Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:87d32a50c7fa6d44faaa20282dc2f4de03fe7ad3a6c5fc3728b886e521730736","observation_id":"d8818518-a551-4396-ba00-e0fb277fda82","resolution":{"observed_at":"2026-08-12T00:23:44.679878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.894905Z","title":null,"venue":null,"work_id":"1b4ce655-e058-471e-a028-72ec8ea6af05","year":2026},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.684994Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:57fcd9e806b1902dcfd2afac8285ad9e55d5197530354ab0c8e9610cc142d683","observation_id":"df0f26c0-d27b-4555-8a67-6697869238d6","resolution":{"observed_at":"2026-08-12T00:23:46.900777Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.926213Z","title":null,"venue":null,"work_id":"deda90ce-7db9-40de-93af-41641493956a","year":2025},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.595147Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:749c08fccab02bc30eed8264a4f1d161a60b021be55d64ca0e9a7573a980c074","observation_id":"024c7347-44d6-4643-a5e2-158133d5200f","resolution":{"observed_at":"2026-08-12T00:23:46.931479Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v40i9.37673","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:45.360776Z","title":null,"venue":null,"work_id":"eb9889e4-e301-4ca3-abb3-f6e80a3b0581","year":2026},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.698742Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:59a6a3d0704640dfcbd0853b1dc706c0d6a1d127cb93995e052a9065a490774f","observation_id":"fdb2e965-204d-48bc-b119-a113ac355ac9","resolution":{"observed_at":"2026-08-12T00:23:45.365987Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-13T20:08:09.093835+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-13T20:08:09.093835+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.749572Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.749572Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:77ff12cff4a467ff5edb059abaf538df647b3903a20aaaf00dceb8e1a7167011","observation_id":"7d67049c-6762-42af-9fad-82cb8bb690db","resolution":{"observed_at":"2026-08-12T00:23:44.749572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.845009Z","title":null,"venue":null,"work_id":"62e520e5-8fa8-4a4b-b0f5-7f96a7d48d1b","year":2026},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.799413Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:b17c1fa24637590d74b7786f77f3fc21edda2b0ff20fcf8b0101d80bbca40ddf","observation_id":"80160fc7-5a3d-479b-880a-fde5a3a4538a","resolution":{"observed_at":"2026-08-12T00:23:46.850159Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.875607Z","title":null,"venue":null,"work_id":"5b13ac81-19aa-44c6-81c4-007e9185ddcc","year":2025},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.689762Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:17e5d1a8c9c78e82abe96947edcf465bf064aed06d01c544353fb5c685a180d4","observation_id":"479663d0-77a7-488c-84fb-eb68899a24e9","resolution":{"observed_at":"2026-08-12T00:23:46.881463Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.827446Z","title":null,"venue":null,"work_id":"71cb81f2-be8b-4fb6-9a22-95b203be1368","year":2024},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.811062Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:06389e5c0be9bcb719ae3e3b1bb9a67fca2e3b97e35bb78125a88f9afaaa4c62","observation_id":"77010a1f-961d-468d-91a6-dd919f91d51b","resolution":{"observed_at":"2026-08-12T00:23:46.832558Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.816530Z","title":null,"venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.816530Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:bf11c9e7a95e3ac8a704eca1adf7a2f25332738c2160bf401113136739ee8cb8","observation_id":"c8f8ee7c-6d86-428c-8671-28a3f176eeba","resolution":{"observed_at":"2026-08-12T00:23:44.816530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.795813Z","title":null,"venue":null,"work_id":"6490ba5c-0d4f-45b6-bcc3-0c6eb53e7ce1","year":2026},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.821406Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:ceaf1243011d30e94a05c9a0d6fb8ff93da050f8d8dfcc55993eb54da2c0b3dd","observation_id":"4f1d5d23-d20a-4512-b286-4ac9bfe333a2","resolution":{"observed_at":"2026-08-12T00:23:46.800723Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.780168Z","title":null,"venue":null,"work_id":"713911dc-c7e8-4242-8ed2-f857f45cb856","year":2026},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.850880Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:3be87de017560d5c4a0b9f2476304646c8d76f7a461e97d9dbbb4f2e72cc55fe","observation_id":"ae2d4cbc-18cc-49e8-bf82-d8f56ceea403","resolution":{"observed_at":"2026-08-12T00:23:46.784361Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.02005","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.021109Z","title":null,"venue":null,"work_id":"01d74a19-2a3c-4799-ab43-7ad91f0b9c35","year":2025},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.805064Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:9a758e6ed9f7909c0419513df42ea47d1c64e0f901531fe61200ac1ebf4779e2","observation_id":"3a5704d0-80e7-409c-9f7e-71f6f2929b1b","resolution":{"observed_at":"2026-08-12T00:23:46.029339Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2022.32215","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:45.847548Z","title":null,"venue":null,"work_id":"988766e2-f593-4baa-a3b6-038e08b376a7","year":2023},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.876817Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:83febb2cc77406dbe0732a30da4b6ee93c2b886fdd33408c5bb75ca3bc5b443f","observation_id":"ca1ba040-c522-46c8-ab13-fb859b1c5ebc","resolution":{"observed_at":"2026-08-12T00:23:45.855746Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.763624Z","title":null,"venue":null,"work_id":"b88d899f-e314-4c6f-90a1-0110a5062c76","year":2024},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.881907Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:c274cf48f5ae14f09961ee8b059b1ce245db1e86928fbe1abe372c503a1b7f25","observation_id":"5d2ee6a1-aa58-4de9-9058-6c20a2c17176","resolution":{"observed_at":"2026-08-12T00:23:46.769186Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.20501","last_updated":"2025-04-29T07:43:37Z","snapshot_observed_at":"2026-08-16T05:24:44.087183Z","submitted_at":"2025-04-29T07:43:37Z","title":"SAM-Guided Robust Representation Learning for One-Shot 3D Medical Image Segmentation","version":1},"cited_work":{"arxiv_id":"2504.20501","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.20501","snapshot_observed_at":"2026-08-12T00:23:45.727719Z","title":"SAM-Guided Robust Representation Learning for One-Shot 3D Medical Image Segmentation","venue":"eess.IV","work_id":"48947905-b279-4877-80c7-ad28e7bebb13","year":2025},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.887084Z"},"links":{"cited_paper":"/paper/2504.20501","citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:5ef174fb67f696fbd010949d42c3f796ee2e8cbb3f6196ba2213b083ec63fa86","observation_id":"a6ce9f21-d8bb-4473-bd41-05611b9a2d77","resolution":{"observed_at":"2026-08-12T00:23:45.734721Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.745971Z","title":null,"venue":null,"work_id":"838104e8-b753-42dc-8219-d661677c29a5","year":2025},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.892399Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:2d18956986a66026e78d1fc9803c73a32bab1506c1c41d09bddce814a10d3a88","observation_id":"d8a95c51-c02f-47f0-821b-17b5f3d4b9dd","resolution":{"observed_at":"2026-08-12T00:23:46.751538Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.871944Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.871944Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:a80925f62f0a5c364a7760b47b701c3c822b942a324e102a63ff79ff222040bb","observation_id":"7be6e76e-885a-42e3-b07a-b0df64074e0b","resolution":{"observed_at":"2026-08-12T00:23:44.871944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.902690Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.902690Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:8dea926a4d4c40b54485303ee489e1829b149c40d56ad722e0ecf3902d499d47","observation_id":"80719521-5b82-4ce4-8aef-bc333893a903","resolution":{"observed_at":"2026-08-12T00:23:44.902690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.944358Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.944358Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:2cec1b8292758f74d71ec544e6517d47ed64f6d781238d9dc88c3fe32fac1f59","observation_id":"0b58bdeb-ad49-4a5a-8c93-47db8d11da77","resolution":{"observed_at":"2026-08-12T00:23:44.944358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.718451Z","title":null,"venue":null,"work_id":"8501e66b-4ca9-4e1b-9460-0dd24d887b1d","year":2025},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.969437Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:e836c05da8268e00d9a6b09b73ff73e824a62bfa2132487c93cfafe0fb4de0ce","observation_id":"645969e3-c088-4343-96c9-5f0191daeb0e","resolution":{"observed_at":"2026-08-12T00:23:46.724184Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.975739Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.975739Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:b3b9b00c0aa6aa434c994c7a6ba023e8e39c74cbf96b925001623050f17c06b3","observation_id":"fe60e948-729c-4242-b97c-11cce0b4a2a9","resolution":{"observed_at":"2026-08-12T00:23:44.975739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.24963/ijcai.2022/320","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:45.239461Z","title":null,"venue":null,"work_id":"06bc65fa-4081-4688-87f0-270988f50b30","year":2022},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.896979Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:0469c8992a49e648349fd213652f0db6e10de61ca25aa31028a66a931b022006","observation_id":"98f9ef58-8bf7-4c45-b092-4312e535bbd8","resolution":{"observed_at":"2026-08-12T00:23:45.284765Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-13T20:08:09.206318+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-13T20:08:09.206318+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.988662Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.988662Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:19e23c13392433bcefc8da598a32a2a8e5fd00f9a11f5e8ce7f81da6b79dc3eb","observation_id":"e88d7688-bcb3-4633-bba3-198536129fad","resolution":{"observed_at":"2026-08-12T00:23:44.988662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.670924Z","title":null,"venue":null,"work_id":"1697997a-f0a8-42ec-b1a3-5742da1f65f2","year":2023},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:45.034131Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:566ee3a6d46396fae8f275eea5c4a9f08d7bbdd639e41481ad422c66736d5d04","observation_id":"44237009-dcb3-4b2e-b397-fde7d39ad087","resolution":{"observed_at":"2026-08-12T00:23:46.676098Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.652675Z","title":null,"venue":null,"work_id":"8e872c8b-cd39-4f19-9b4d-15dc945df737","year":2013},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:45.072839Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:fbb5795e288938a3ac34a1c208562814c11011d4c18bf819a1091adadeb3b1ea","observation_id":"9531a00d-cb52-4a6f-b204-b413d25ed878","resolution":{"observed_at":"2026-08-12T00:23:46.659042Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2607.16260","last_updated":"2026-06-28T11:36:31Z","snapshot_observed_at":"2026-08-18T10:17:14.598412Z","submitted_at":"2026-06-28T11:36:31Z","title":"AdaSurvMamba: Dynamic Fusion and Semantic Scanning for Multimodal Survival Analysis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.16260","snapshot_observed_at":"2026-08-12T00:23:45.081316Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:45.081316Z"},"links":{"cited_paper":"/paper/2607.16260","citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:fb4635299ea60884818399f49f50d624f32dddf0d10552ce0b4908909d4ee761","observation_id":"59a2a0b9-5a5f-45fb-8fac-b578100c9f1f","resolution":{"observed_at":"2026-08-12T00:23:45.081316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.688248Z","title":null,"venue":null,"work_id":"9f2c1658-a39c-41fc-a004-47ba19316227","year":2022},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.982956Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:ea42971e9caba1bc9c4e882e3795cf5e88f09e06df8463bab702bfe8b89dddf4","observation_id":"74900215-c9ee-4ec6-8fe2-5266755d4930","resolution":{"observed_at":"2026-08-12T00:23:46.695016Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.618900Z","title":null,"venue":null,"work_id":"4a5c2d90-4d48-4c74-9f4a-369a44fbe065","year":2022},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:45.095104Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:6588ccbd7bee5d325399c4f3fa251d61ca79257dae084296d1ebc12d02956c65","observation_id":"f034ec9b-4c60-4d51-91cc-54905dfa4a9f","resolution":{"observed_at":"2026-08-12T00:23:46.624002Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.602819Z","title":null,"venue":null,"work_id":"93e26ccd-6352-41ca-a53a-b2c82f93c10a","year":2021},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:45.129421Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:31ee2e9d503bb283188068a75f7c6c04d0022e1511a287c39fe13dc1066bf3fd","observation_id":"dd5f7f77-572b-46f1-a5eb-e600ab39bbe2","resolution":{"observed_at":"2026-08-12T00:23:46.607961Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2026.36894","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:45.539159Z","title":null,"venue":null,"work_id":"73978e43-28cb-4a40-9933-99c0f80a3883","year":2026},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:45.181243Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:f0724d80a582feede5479258308255b62131df070656bbb3138ec185822d1e9e","observation_id":"369d9352-1ad3-4559-bc91-9b94d4b88b02","resolution":{"observed_at":"2026-08-12T00:23:45.594849Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.635070Z","title":null,"venue":null,"work_id":"db2220f9-4f2e-4ca4-81ca-0bcdf82ca8b1","year":2025},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:45.088090Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:2168f2f8d287f51335fa34ec62d346fb21bb75473a5cf55437c03dcf59f836f0","observation_id":"54222d53-86b4-46bf-8b04-6363feb5e6e4","resolution":{"observed_at":"2026-08-12T00:23:46.639663Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.emnlp-main.98","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:45.376882Z","title":null,"venue":null,"work_id":"ed07172a-d561-4aea-9b80-49b299a31143","year":2025},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":1924,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.694096Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:1818373d9eb0bfe11bef8c721f3ccf0dbf4f57dbf3460b06fa2110a68de0dded","observation_id":"8841dcb8-f18f-4c7d-a09a-51800b010239","resolution":{"observed_at":"2026-08-12T00:23:45.382444Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-13T20:08:09.41793+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-13T20:08:09.41793+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:47.098989Z","title":null,"venue":null,"work_id":"b9ccce22-282b-42f0-b6d8-37f09cb7652c","year":2022},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.241817Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:c52ac284aa9364780c8b48a931956913c1d5e22e5a10bfd50f46ff79a3515a10","observation_id":"973321e2-725f-4f7b-a9eb-94702676a8d5","resolution":{"observed_at":"2026-08-12T00:23:47.104132Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:47.327175Z","title":"InEuropean Conference on Computer Vision","venue":null,"work_id":"4a9537fa-35b7-493d-a7e9-f7afadf3985c","year":null},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:43.450851Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:08ae62511911ee1fc0ada01d41414f80e9dfb4170ce43104cdbf07e380cde183","observation_id":"2ce8b3ae-3968-48ec-a1d3-9694010fefe8","resolution":{"observed_at":"2026-08-12T00:23:47.332546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.980538Z","title":"InProceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":"129aa59b-685b-4c17-a23b-ad0e9d1e0e23","year":null},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.502635Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:1db07dee730949aa770497b393b62a52e1653155ef2929b7fbd51d4e8e4acfc1","observation_id":"331a7f7a-aa96-43cf-8be7-741e98cecff4","resolution":{"observed_at":"2026-08-12T00:23:46.986116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","latest_version":1,"primary_category":"cs.MM","snapshot_observed_at":"2026-08-17T13:15:59.483345Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation"},"reference_resolution":{"displayed":69,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":60,"verified_exact":5,"verified_fuzzy":2},"total_outbound_references":69},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 69 of 69 outbound references and 0 inbound Pith citation observations for arXiv:2608.08147."}