{"as_of":"2026-08-18T07:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d11c237358beb775ea78999fdd5161e56aa16735e7f110537a3dafe799a5bc71","coverage":[{"denominator":20,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T14:46:11.761268Z","state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.04142/citation-record","integrity":"/paper/2608.04142/integrity","json":"/paper/2608.04142/citation-record.json","paper":"/paper/2608.04142"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.05139","last_updated":"2025-02-07T18:15:57Z","snapshot_observed_at":"2026-08-17T16:15:29.907985Z","submitted_at":"2025-02-07T18:15:57Z","title":"Meta Audiobox Aesthetics: Unified Automatic Quality Assessment for Speech, Music, and Sound","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05139","snapshot_observed_at":"2026-08-15T14:46:11.677529Z","title":"Meta audiobox aesthetics: Unified automatic quality assessment for speech, music, and sound,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.677529Z"},"links":{"cited_paper":"/paper/2502.05139","citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:1c70294ace5d27578a60fc8a97e4802bbef4fa02847cd63c54605d1809eaba77","observation_id":"ddb0213a-39ef-4517-9a9d-cff081c52f83","resolution":{"observed_at":"2026-08-15T14:46:11.677529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.08466","last_updated":"2019-01-17T16:12:43Z","snapshot_observed_at":"2026-08-15T08:25:11.276003Z","submitted_at":"2018-12-20T10:28:00Z","title":"Fr\\'echet Audio Distance: A Metric for Evaluating Music Enhancement Algorithms","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.08466","snapshot_observed_at":"2026-08-15T14:46:11.682457Z","title":"Fréchet audio distance: A metric for evaluating music enhancement algorithms,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.682457Z"},"links":{"cited_paper":"/paper/1812.08466","citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:ab9a8edf4819be5602ad53c3d4061c0f10d9c9cf306c95b1c2496f0cb01afce8","observation_id":"b689e4a8-bdbd-4e0a-aac7-e57230deadbd","resolution":{"observed_at":"2026-08-15T14:46:11.682457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.09430","last_updated":"2017-01-10T18:06:51Z","snapshot_observed_at":"2026-08-14T21:37:30.204671Z","submitted_at":"2016-09-29T17:04:50Z","title":"CNN Architectures for Large-Scale Audio Classification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.09430","snapshot_observed_at":"2026-08-15T14:46:11.687441Z","title":"Cnn architectures for large-scale audio classification,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.687441Z"},"links":{"cited_paper":"/paper/1609.09430","citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:c9ddc4ba625cffba216b2d1cbc083708bf44024ba07292fcf1fae15f809218b6","observation_id":"5e960e02-b2ba-4c67-8ee9-6bf00624f856","resolution":{"observed_at":"2026-08-15T14:46:11.687441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.06687","last_updated":"2024-03-21T21:35:04Z","snapshot_observed_at":"2026-08-16T16:16:42.565130Z","submitted_at":"2022-11-12T15:25:20Z","title":"Large-scale Contrastive Language-Audio Pretraining with Feature Fusion and Keyword-to-Caption Augmentation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.06687","snapshot_observed_at":"2026-08-15T14:46:11.692068Z","title":"Large-scale contrastive language-audio pretraining with feature fusion and keyword-to-caption augmentation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.692068Z"},"links":{"cited_paper":"/paper/2211.06687","citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:e90571278e64fd0250f6ec1f8b4e9f34d9e9ce0896476e8971108f41051c500d","observation_id":"f60329f6-5bef-4b65-b095-19cb5481d048","resolution":{"observed_at":"2026-08-15T14:46:11.692068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:46:12.001621Z","title":"Flow matching for generative modeling,","venue":null,"work_id":"590cf1c7-4b5e-4e13-91ef-1eab632f8c5a","year":null},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.696967Z"},"links":{"citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:b16e05417daf16fee49a440373775efface49a85278b6cb341bbc5ad3d706e43","observation_id":"a978871c-2960-4c75-97fe-3aa4286669d9","resolution":{"observed_at":"2026-08-15T14:46:12.007083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:46:11.705263Z","title":"Musiclm: Generating music from text,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.705263Z"},"links":{"citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:de2bc6fb0359079b21f37f0a4e98d717461e590028905d1e37ce22834d935214","observation_id":"eba1935a-b982-421d-a1f2-ab33d093de81","resolution":{"observed_at":"2026-08-15T14:46:11.705263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-15T14:46:11.713429Z","title":"Simple and controllable music generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.713429Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:181e1f2679484d37baf128f02b6fd49ab94a10c2561fbc3fd79880ad6313b3e1","observation_id":"a30dda79-60c0-45ca-b789-f0d6c48f1f3a","resolution":{"observed_at":"2026-08-15T14:46:11.713429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:46:11.709352Z","title":"Available: https://arxiv.org/abs/2301","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.709352Z"},"links":{"citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:97110e450e434b69acfc80a51b8a2df7819200a6f4d31cbcce201ba8649c92e7","observation_id":"909fbc39-6af5-4a53-9ace-8a4d54847b2a","resolution":{"observed_at":"2026-08-15T14:46:11.709352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16669","last_updated":"2025-03-20T19:31:04Z","snapshot_observed_at":"2026-08-16T12:48:08.873711Z","submitted_at":"2025-03-20T19:31:04Z","title":"Aligning Text-to-Music Evaluation with Human Preferences","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16669","snapshot_observed_at":"2026-08-15T14:46:11.722546Z","title":"Aligning text-to-music evaluation with human preferences,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.722546Z"},"links":{"cited_paper":"/paper/2503.16669","citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:8c5fcb1757ad4eadffb6c31cd570d84b032bf52669b5378af91d21bbe5adc6c2","observation_id":"2074fbd0-2e7d-4229-a1f3-f8e24b944091","resolution":{"observed_at":"2026-08-15T14:46:11.722546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01616","last_updated":"2024-03-05T22:14:14Z","snapshot_observed_at":"2026-08-16T14:46:22.801988Z","submitted_at":"2023-11-02T21:58:55Z","title":"Adapting Frechet Audio Distance for Generative Music Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.01616","snapshot_observed_at":"2026-08-15T14:46:11.718188Z","title":"Adapting frechet audio distance for generative music evaluation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.718188Z"},"links":{"cited_paper":"/paper/2311.01616","citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:ccd2d1117b9d3f5fd68a3018f877bdca5b3a0b58ac6ad46c06c8be491eebe19d","observation_id":"ecd47795-b220-44a0-8ec9-90ec698163ff","resolution":{"observed_at":"2026-08-15T14:46:11.718188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.15602","last_updated":"2025-03-09T06:46:13Z","snapshot_observed_at":"2026-08-16T12:56:17.563466Z","submitted_at":"2025-02-21T17:19:15Z","title":"KAD: No More FAD! An Effective and Efficient Evaluation Metric for Audio Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.15602","snapshot_observed_at":"2026-08-15T14:46:11.731849Z","title":"Kad: No more fad! an effective and efficient evaluation metric for audio generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.731849Z"},"links":{"cited_paper":"/paper/2502.15602","citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:d5ad85b8422f3770cce725220b8b31c38d765188fb953cb731ea0c2cbc0be789","observation_id":"1e51b4b9-77e8-4184-b66b-ade221f10d6a","resolution":{"observed_at":"2026-08-15T14:46:11.731849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.01454","last_updated":"2021-11-23T06:12:36Z","snapshot_observed_at":"2026-08-16T18:48:19.016020Z","submitted_at":"2021-02-02T11:59:28Z","title":"MAUVE: Measuring the Gap Between Neural Text and Human Text using Divergence Frontiers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.01454","snapshot_observed_at":"2026-08-15T14:46:11.726757Z","title":"Mauve: Measuring the gap between neural text and human text using divergence frontiers,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.726757Z"},"links":{"cited_paper":"/paper/2102.01454","citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:3a65148758a5c7b237d36acba37e600e4d50a2d6594e3c1b936fdf050b9b24d2","observation_id":"97e7799e-7e9b-4b9f-81d9-36db8aa342a9","resolution":{"observed_at":"2026-08-15T14:46:11.726757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.13438","last_updated":"2022-10-24T17:52:02Z","snapshot_observed_at":"2026-08-15T04:43:16.361751Z","submitted_at":"2022-10-24T17:52:02Z","title":"High Fidelity Neural Audio Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.13438","snapshot_observed_at":"2026-08-15T14:46:11.740907Z","title":"High fidelity neural audio compression,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.740907Z"},"links":{"cited_paper":"/paper/2210.13438","citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:222bb9f7e21e1f44073703b5a15281cc35c44d93c9c30f202f3ffa098d6ae5b9","observation_id":"4012f6f6-6d1f-4d6c-a569-c5f0ae01a05e","resolution":{"observed_at":"2026-08-15T14:46:11.740907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10970","last_updated":"2024-06-16T15:06:06Z","snapshot_observed_at":"2026-08-16T13:42:32.647258Z","submitted_at":"2024-06-16T15:06:06Z","title":"Joint Audio and Symbolic Conditioning for Temporally Controlled Text-to-Music Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10970","snapshot_observed_at":"2026-08-15T14:46:11.736154Z","title":"Joint audio and symbolic conditioning for temporally controlled text-to-music generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.736154Z"},"links":{"cited_paper":"/paper/2406.10970","citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:58f7334b90248b62fadec88ad594c706734a7ff2625f726f58c94116be1aa893","observation_id":"79097689-adc6-47e1-9315-e3c9715c9ec1","resolution":{"observed_at":"2026-08-15T14:46:11.736154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1612.01840","last_updated":"2017-09-05T18:38:33Z","snapshot_observed_at":"2026-08-14T21:26:53.042056Z","submitted_at":"2016-12-06T14:58:59Z","title":"FMA: A Dataset For Music Analysis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1612.01840","snapshot_observed_at":"2026-08-15T14:46:11.748708Z","title":"Defferrard, K","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.748708Z"},"links":{"cited_paper":"/paper/1612.01840","citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:0f60c32c59098aa0a37257226a87143189f28b937b7a813825d0496715fd4c4d","observation_id":"91e6567f-f575-4ffb-b887-0865b1916e49","resolution":{"observed_at":"2026-08-15T14:46:11.748708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:46:11.961740Z","title":"The mtg-jamendo dataset for automatic music tagging,","venue":null,"work_id":"4efc3e02-fc82-4642-8ad9-e0ca4d4754d4","year":2019},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.745031Z"},"links":{"citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:c7913fa0023a53fa9b8748a46567fba8fd98af60b68a9202bbeaee6c62293fe3","observation_id":"b030ecc6-f002-4404-b967-c9c2720cedb3","resolution":{"observed_at":"2026-08-15T14:46:11.966355Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04577","last_updated":"2024-03-05T09:12:35Z","snapshot_observed_at":"2026-08-16T14:28:48.591931Z","submitted_at":"2024-01-09T14:29:39Z","title":"Masked Audio Generation using a Single Non-Autoregressive Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04577","snapshot_observed_at":"2026-08-15T14:46:11.757300Z","title":"Masked audio generation using a single non- autoregressive transformer,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.757300Z"},"links":{"cited_paper":"/paper/2401.04577","citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:aa5650f609a56eb02248222d24f548ec56727c815b73eadde7c45aef24b41ad1","observation_id":"4cbdf8c5-f55b-4e23-b556-88b818ec858d","resolution":{"observed_at":"2026-08-15T14:46:11.757300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.02569","last_updated":"2019-06-06T13:18:47Z","snapshot_observed_at":"2026-08-16T10:18:46.160993Z","submitted_at":"2019-06-06T13:18:47Z","title":"Gradio: Hassle-Free Sharing and Testing of ML Models in the Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.02569","snapshot_observed_at":"2026-08-15T14:46:11.752715Z","title":"Gradio: Hassle-free sharing and testing of ml models in the wild,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.752715Z"},"links":{"cited_paper":"/paper/1906.02569","citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:5f2004f21cc77ff9995bc7e4165d613132c5fd4f454ae60c2a6a9583ff63edda","observation_id":"631bbbe5-d721-4c37-89be-1ed6e568423e","resolution":{"observed_at":"2026-08-15T14:46:11.752715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:46:11.948331Z","title":null,"venue":null,"work_id":"b72ccb03-68bc-4dd7-b901-d1fcb333a9af","year":1959},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.761268Z"},"links":{"citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:85167caa72ee3f8464f395b60fb4b50f7ba34f1d2d9ac6ef4081a28b5235d193","observation_id":"313d7134-83bb-48d5-a8e6-4e3a4345f704","resolution":{"observed_at":"2026-08-15T14:46:11.953231Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:46:11.989703Z","title":"Available: https://arxiv.org/abs/2210","venue":null,"work_id":"02eee8b7-ebdc-4887-849f-c29bd0d8f5bf","year":null},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.701282Z"},"links":{"citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:3a809e0e8298817625af685f3dde0548afc99237bf7350c46895de574e8d458d","observation_id":"f36505db-cdca-4c98-98b9-4e850ad2d9a2","resolution":{"observed_at":"2026-08-15T14:46:11.993602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion"},"reference_resolution":{"displayed":20,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":0,"verified_fuzzy":3},"total_outbound_references":20},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 0 inbound Pith citation observations for arXiv:2608.04142."}