{"as_of":"2026-08-13T16:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7eb64f2b06964b7eda035a3da1ec416e3803d7f71fc891d7af53931b94d901cf","coverage":[{"denominator":15,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:46:44.177017Z","state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T11:04:49.366127Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T02:16:26.752563Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.23625","last_updated":"2025-05-29T16:31:45Z","snapshot_observed_at":"2026-08-13T04:08:09.109376Z","submitted_at":"2025-05-29T16:31:45Z","title":"ZeroSep: Separate Anything in Audio with Zero Training","version":1},"cited_work":{"arxiv_id":"2505.23625","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23625","snapshot_observed_at":"2026-07-02T02:16:26.752563Z","title":null,"venue":null,"work_id":"3c318e65-04e9-49a3-86b6-0285fe82c99d","year":null},"citing_paper":{"arxiv_id":"2606.03168","last_updated":"2026-06-02T05:26:06Z","snapshot_observed_at":"2026-08-12T20:44:08.772285Z","submitted_at":"2026-06-02T05:26:06Z","title":"JAVEDIT: Joint Audio-Visual Instruction-Guided Video Editing with Agentic Data Curation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T11:04:49.366127Z"},"links":{"cited_paper":"/paper/2505.23625","citing_paper":"/paper/2606.03168"},"observation_digest":"sha256:b40083c83f42507e80ba9aa53248bbe635f41ad0f050dc40502d0816ebae6012","observation_id":"3a3124cf-28ce-4e0f-9763-d40762330633","resolution":{"observed_at":"2026-07-02T02:16:26.754001Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.23625/citation-record","integrity":"/paper/2505.23625/integrity","json":"/paper/2505.23625/citation-record.json","paper":"/paper/2505.23625"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:46:45.313995Z","title":"Weiss, Mohammad Norouzi, and William Chan","venue":null,"work_id":"f0c4db1c-6e63-4012-85aa-e2f0c2e5f84f","year":2021},"citing_paper":{"arxiv_id":"2505.23625","last_updated":"2025-05-29T16:31:45Z","snapshot_observed_at":"2026-08-13T04:08:09.109376Z","submitted_at":"2025-05-29T16:31:45Z","title":"ZeroSep: Separate Anything in Audio with Zero Training","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:46:43.368658Z"},"links":{"citing_paper":"/paper/2505.23625"},"observation_digest":"sha256:60c1614cb8b1677eefe9009749eae18510ed48b35f616f16fb3311c5a314bab8","observation_id":"ae3da6e8-be3a-4530-bf3a-ec5e415d225f","resolution":{"observed_at":"2026-08-07T12:46:45.377610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.21437/interspeech.2021-469","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Vadim Popov, Ivan V ovk, Vladimir Gogoryan, Tasnima Sadekova, and Mikhail Kudinov","venue":null,"work_id":"56d56842-5a71-4742-befd-56299d157135","year":2021},"citing_paper":{"arxiv_id":"2505.23625","last_updated":"2025-05-29T16:31:45Z","snapshot_observed_at":"2026-08-13T04:08:09.109376Z","submitted_at":"2025-05-29T16:31:45Z","title":"ZeroSep: Separate Anything in Audio with Zero Training","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:46:43.409843Z"},"links":{"citing_paper":"/paper/2505.23625"},"observation_digest":"sha256:1a1abfcb02f5b4d1d40790c006499190ddbf8a7883e546370c8cf437eb096ad0","observation_id":"5612190a-a276-4b0b-b0ba-1d9193160f6a","resolution":{"observed_at":"2026-08-07T12:46:44.538539Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.21437/interspeech.2021-36","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Haohe Liu, Zehua Chen, Yi Yuan, Xinhao Mei, Xubo Liu, Danilo Mandic, Wenwu Wang, and Mark D","venue":null,"work_id":"e81ca1af-5938-4f51-8f19-03c9efa387c6","year":2021},"citing_paper":{"arxiv_id":"2505.23625","last_updated":"2025-05-29T16:31:45Z","snapshot_observed_at":"2026-08-13T04:08:09.109376Z","submitted_at":"2025-05-29T16:31:45Z","title":"ZeroSep: Separate Anything in Audio with Zero Training","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:46:43.534404Z"},"links":{"citing_paper":"/paper/2505.23625"},"observation_digest":"sha256:dd95213d83bfeedc32877eaed149a661d054701c656fb90416689ffb409f344b","observation_id":"0fc037c0-3a3c-4344-b528-39a6e6763a4c","resolution":{"observed_at":"2026-08-07T12:46:44.354107Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:46:43.625535Z","title":"Deepanway Ghosal, Navonil Majumder, Ambuj Mehrish, and Soujanya Poria","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23625","last_updated":"2025-05-29T16:31:45Z","snapshot_observed_at":"2026-08-13T04:08:09.109376Z","submitted_at":"2025-05-29T16:31:45Z","title":"ZeroSep: Separate Anything in Audio with Zero Training","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:46:43.625535Z"},"links":{"citing_paper":"/paper/2505.23625"},"observation_digest":"sha256:27691832a831e97985c3aeee4ee1709c88ecc7e3b3b3d23debbcc3c12ca4a959","observation_id":"4ed23265-4483-481b-919a-c89da9bf53ef","resolution":{"observed_at":"2026-08-07T12:46:43.625535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-08-11T15:38:14.931716Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-07T12:46:43.761287Z","title":null,"venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.23625","last_updated":"2025-05-29T16:31:45Z","snapshot_observed_at":"2026-08-13T04:08:09.109376Z","submitted_at":"2025-05-29T16:31:45Z","title":"ZeroSep: Separate Anything in Audio with Zero Training","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:46:43.761287Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2505.23625"},"observation_digest":"sha256:08f013b62a3ca2b140b92819c396f19665a62102eed74df13a202d05746282ec","observation_id":"9eafdd2d-ab40-438c-951b-dbb32fea93b4","resolution":{"observed_at":"2026-08-07T12:46:43.761287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10790","last_updated":"2024-02-19T23:51:49Z","snapshot_observed_at":"2026-08-13T11:39:40.594833Z","submitted_at":"2023-05-18T08:03:37Z","title":"Listen, Think, and Understand","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10790","snapshot_observed_at":"2026-08-07T12:46:43.933695Z","title":"Listen, think, and understand","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23625","last_updated":"2025-05-29T16:31:45Z","snapshot_observed_at":"2026-08-13T04:08:09.109376Z","submitted_at":"2025-05-29T16:31:45Z","title":"ZeroSep: Separate Anything in Audio with Zero Training","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:46:43.933695Z"},"links":{"cited_paper":"/paper/2305.10790","citing_paper":"/paper/2505.23625"},"observation_digest":"sha256:8eb7352a15017af310dc6fb58c7eebf4cc7ec97bf91a2eb9c0549292c1d5fcf4","observation_id":"9f77e224-6bc4-4f47-9b94-1564d3bedd32","resolution":{"observed_at":"2026-08-07T12:46:43.933695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15977","last_updated":"2023-09-27T19:50:50Z","snapshot_observed_at":"2026-08-13T10:03:39.425868Z","submitted_at":"2023-09-27T19:50:50Z","title":"Neural Acoustic Context Field: Rendering Realistic Room Impulse Response With Neural Fields","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15977","snapshot_observed_at":"2026-08-07T12:46:44.096980Z","title":"Av-nerf: Learning neural fields for real-world audio-visual scene synthesis","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23625","last_updated":"2025-05-29T16:31:45Z","snapshot_observed_at":"2026-08-13T04:08:09.109376Z","submitted_at":"2025-05-29T16:31:45Z","title":"ZeroSep: Separate Anything in Audio with Zero Training","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:46:44.096980Z"},"links":{"cited_paper":"/paper/2309.15977","citing_paper":"/paper/2505.23625"},"observation_digest":"sha256:af8629a152bbb47dcaed5b61f22feeb0dce8d051514bc1e59ce6255cb09c3425","observation_id":"9660d9db-6d38-4385-b5bf-b680d944f51f","resolution":{"observed_at":"2026-08-07T12:46:44.096980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.08466","last_updated":"2019-01-17T16:12:43Z","snapshot_observed_at":"2026-08-08T16:07:44.435146Z","submitted_at":"2018-12-20T10:28:00Z","title":"Fr\\'echet Audio Distance: A Metric for Evaluating Music Enhancement Algorithms","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.08466","snapshot_observed_at":"2026-08-07T12:46:43.839869Z","title":"Fr\\’echet audio distance: A metric for evaluating music enhancement algorithms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23625","last_updated":"2025-05-29T16:31:45Z","snapshot_observed_at":"2026-08-13T04:08:09.109376Z","submitted_at":"2025-05-29T16:31:45Z","title":"ZeroSep: Separate Anything in Audio with Zero Training","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-07T12:46:43.839869Z"},"links":{"cited_paper":"/paper/1812.08466","citing_paper":"/paper/2505.23625"},"observation_digest":"sha256:995fbeb0960d6054a08eb17dd7a88a6650d1c187378db8cbe7cfe02d02ca95ce","observation_id":"6e43ece4-32a5-48ce-b847-e4e91a16fc41","resolution":{"observed_at":"2026-08-07T12:46:43.839869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:46:43.691258Z","title":"Chao Huang, Susan Liang, Yapeng Tian, Anurag Kumar, and Chenliang Xu","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.23625","last_updated":"2025-05-29T16:31:45Z","snapshot_observed_at":"2026-08-13T04:08:09.109376Z","submitted_at":"2025-05-29T16:31:45Z","title":"ZeroSep: Separate Anything in Audio with Zero Training","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-07T12:46:43.691258Z"},"links":{"citing_paper":"/paper/2505.23625"},"observation_digest":"sha256:0d52aa78d6598dd04a10a89edc157cb4c3cbab405389e7c8497bb3d6c76205ed","observation_id":"a1211c94-c403-41e2-a4f8-141178766418","resolution":{"observed_at":"2026-08-07T12:46:43.691258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2019.29151","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:46:45.035739Z","title":"Cem Subakan, Mirco Ravanelli, Samuele Cornell, Mirko Bronzi, and Jianyuan Zhong","venue":null,"work_id":"8b7dbbd5-3426-4b59-91ba-bd93bb8a6826","year":2019},"citing_paper":{"arxiv_id":"2505.23625","last_updated":"2025-05-29T16:31:45Z","snapshot_observed_at":"2026-08-13T04:08:09.109376Z","submitted_at":"2025-05-29T16:31:45Z","title":"ZeroSep: Separate Anything in Audio with Zero Training","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-07T12:46:43.111796Z"},"links":{"citing_paper":"/paper/2505.23625"},"observation_digest":"sha256:c870fe5779ea3feb765a9bc5eb5fc3fe8219576982f77a251f514923a0105453","observation_id":"32004a1c-9d10-479e-9cf4-6788433686b0","resolution":{"observed_at":"2026-08-07T12:46:45.079394Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05037","last_updated":"2024-12-01T15:17:03Z","snapshot_observed_at":"2026-08-13T10:37:49.645437Z","submitted_at":"2023-08-09T16:09:44Z","title":"Separate Anything You Describe","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05037","snapshot_observed_at":"2026-08-07T12:46:43.184878Z","title":"Plumbley, and Wenwu Wang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23625","last_updated":"2025-05-29T16:31:45Z","snapshot_observed_at":"2026-08-13T04:08:09.109376Z","submitted_at":"2025-05-29T16:31:45Z","title":"ZeroSep: Separate Anything in Audio with Zero Training","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T12:46:43.184878Z"},"links":{"cited_paper":"/paper/2308.05037","citing_paper":"/paper/2505.23625"},"observation_digest":"sha256:b44284a496f11b39f97611cbedd0102e8f530f4631c7174a0b1b6bf71dcd3c33","observation_id":"9df64849-d012-4c6f-9e7d-8dfbed5d46c9","resolution":{"observed_at":"2026-08-07T12:46:43.184878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:46:45.152153Z","title":"Diffsinger: Singing voice synthesis via shallow diffusion mechanism","venue":null,"work_id":"89a61873-85bf-4c4a-9c6d-d77367b90c98","year":2021},"citing_paper":{"arxiv_id":"2505.23625","last_updated":"2025-05-29T16:31:45Z","snapshot_observed_at":"2026-08-13T04:08:09.109376Z","submitted_at":"2025-05-29T16:31:45Z","title":"ZeroSep: Separate Anything in Audio with Zero Training","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T12:46:43.471041Z"},"links":{"citing_paper":"/paper/2505.23625"},"observation_digest":"sha256:7b593ac71fd8f35f67f2792483bd891cfae41a1ecec9964eaaedb42db6ba5d11","observation_id":"f6c2945a-a7ca-4a6d-9803-a53ac400e410","resolution":{"observed_at":"2026-08-07T12:46:45.232097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11768","last_updated":"2024-06-17T17:31:01Z","snapshot_observed_at":"2026-08-12T23:40:51.437627Z","submitted_at":"2024-06-17T17:31:01Z","title":"GAMA: A Large Audio-Language Model with Advanced Audio Understanding and Complex Reasoning Abilities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11768","snapshot_observed_at":"2026-08-07T12:46:44.029065Z","title":"Gama: A large audio-language model with advanced audio understanding and complex reasoning abilities","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23625","last_updated":"2025-05-29T16:31:45Z","snapshot_observed_at":"2026-08-13T04:08:09.109376Z","submitted_at":"2025-05-29T16:31:45Z","title":"ZeroSep: Separate Anything in Audio with Zero Training","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T12:46:44.029065Z"},"links":{"cited_paper":"/paper/2406.11768","citing_paper":"/paper/2505.23625"},"observation_digest":"sha256:3f5c60ff61037237ca3187d8caaafc3b746df38cae4936ae39e32eb3e8431d13","observation_id":"c0dd767a-54c1-4b52-bf78-eb6630114878","resolution":{"observed_at":"2026-08-07T12:46:44.029065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:46:43.285350Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2505.23625","last_updated":"2025-05-29T16:31:45Z","snapshot_observed_at":"2026-08-13T04:08:09.109376Z","submitted_at":"2025-05-29T16:31:45Z","title":"ZeroSep: Separate Anything in Audio with Zero Training","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T12:46:43.285350Z"},"links":{"citing_paper":"/paper/2505.23625"},"observation_digest":"sha256:9a4b336bcdb4337b5714744e53d7ba5d67a59a0eeafe78fb2806beb064dcf435","observation_id":"6837a2fa-d16b-40ac-b591-d0e0149ad48c","resolution":{"observed_at":"2026-08-07T12:46:43.285350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24151","last_updated":"2024-10-31T17:09:55Z","snapshot_observed_at":"2026-08-12T22:10:36.881877Z","submitted_at":"2024-10-31T17:09:55Z","title":"Scaling Concept With Text-Guided Diffusion Models","version":1},"cited_work":{"arxiv_id":"2410.24151","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.24151","snapshot_observed_at":"2026-08-07T12:46:44.597464Z","title":"Scaling Concept With Text-Guided Diffusion Models","venue":"cs.CV","work_id":"f5f83cb9-ef69-482c-a971-e981f1c402e1","year":2024},"citing_paper":{"arxiv_id":"2505.23625","last_updated":"2025-05-29T16:31:45Z","snapshot_observed_at":"2026-08-13T04:08:09.109376Z","submitted_at":"2025-05-29T16:31:45Z","title":"ZeroSep: Separate Anything in Audio with Zero Training","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T12:46:44.177017Z"},"links":{"cited_paper":"/paper/2410.24151","citing_paper":"/paper/2505.23625"},"observation_digest":"sha256:708bd91b5d7c70cb35d5dff54697122a30403bf7c036cbd79702256e0bc7e752","observation_id":"a2a5af23-ee12-4fc1-894b-3ee8b48398d6","resolution":{"observed_at":"2026-08-07T12:46:44.653810Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.23625","last_updated":"2025-05-29T16:31:45Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-13T04:08:09.109376Z","submitted_at":"2025-05-29T16:31:45Z","title":"ZeroSep: Separate Anything in Audio with Zero Training"},"reference_resolution":{"displayed":15,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":9,"verified_exact":3,"verified_fuzzy":2},"total_outbound_references":15},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 15 of 15 outbound references and 1 inbound Pith citation observation for arXiv:2505.23625."}