{"as_of":"2026-08-22T19:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:736ebef881869f1e74da035ac6ff36caaf78a8ce951725269f6754e20f76ed94","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T16:48:46.626775Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T14:53:15.718359Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T14:53:23.238659Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.09789","last_updated":"2024-12-13T02:07:21Z","snapshot_observed_at":"2026-08-18T22:46:24.721751Z","submitted_at":"2024-12-13T02:07:21Z","title":"SILA: Signal-to-Language Augmentation for Enhanced Control in Text-to-Audio Generation","version":1},"cited_work":{"arxiv_id":"2412.09789","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09789","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sila: Signal-to-language augmen- tation for enhanced control in text-to-audio generation","venue":null,"work_id":"af9bcdfc-7b79-4a19-ae32-b25e4632e1c6","year":2024},"citing_paper":{"arxiv_id":"2605.17085","last_updated":"2026-05-16T17:01:47Z","snapshot_observed_at":"2026-08-15T17:09:11.563055Z","submitted_at":"2026-05-16T17:01:47Z","title":"Taming Audio VAEs via Target-KL Regularization","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-20T14:53:15.718359Z"},"links":{"cited_paper":"/paper/2412.09789","citing_paper":"/paper/2605.17085"},"observation_digest":"sha256:6049b8165be39819d40abd072d52013b37f9a8c20785f7c7f04ec47647391618","observation_id":"3e4bfec1-d8dd-4d70-8845-cb42683db895","resolution":{"observed_at":"2026-05-20T14:53:23.240224Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.09789/citation-record","integrity":"/paper/2412.09789/integrity","json":"/paper/2412.09789/citation-record.json","paper":"/paper/2412.09789"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-16T13:32:41.679971Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-08-11T16:48:46.503987Z","title":"Stable audio open,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09789","last_updated":"2024-12-13T02:07:21Z","snapshot_observed_at":"2026-08-18T22:46:24.721751Z","submitted_at":"2024-12-13T02:07:21Z","title":"SILA: Signal-to-Language Augmentation for Enhanced Control in Text-to-Audio Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T16:48:46.503987Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2412.09789"},"observation_digest":"sha256:93251ca9c0cc088efbb7385b42bad463174532a3ef8fa6898e1e6654ded8e14a","observation_id":"95bad160-aa81-4f78-b5ff-c140d91d4d23","resolution":{"observed_at":"2026-08-11T16:48:46.503987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:48:46.953458Z","title":"AudioLDM: Text-to- audio generation with latent diffusion models,","venue":null,"work_id":"8ad75598-0207-40a0-9621-ebdc3662e1ce","year":2023},"citing_paper":{"arxiv_id":"2412.09789","last_updated":"2024-12-13T02:07:21Z","snapshot_observed_at":"2026-08-18T22:46:24.721751Z","submitted_at":"2024-12-13T02:07:21Z","title":"SILA: Signal-to-Language Augmentation for Enhanced Control in Text-to-Audio Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T16:48:46.509125Z"},"links":{"citing_paper":"/paper/2412.09789"},"observation_digest":"sha256:ab2d4509a45b30635c136055e149df51acdf6c7d1fe2a7a7dfbccc53b65b626a","observation_id":"541559a0-4b3b-41d3-a59b-ab3bed9e9af5","resolution":{"observed_at":"2026-08-11T16:48:46.957301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:48:46.514122Z","title":"Denoising diffusion prob- abilistic models,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.09789","last_updated":"2024-12-13T02:07:21Z","snapshot_observed_at":"2026-08-18T22:46:24.721751Z","submitted_at":"2024-12-13T02:07:21Z","title":"SILA: Signal-to-Language Augmentation for Enhanced Control in Text-to-Audio Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T16:48:46.514122Z"},"links":{"citing_paper":"/paper/2412.09789"},"observation_digest":"sha256:9f9379598dce1ef9a66b409ce800b4de35a4b996590aa49de3f01c9510329797","observation_id":"cd8b6482-9aa2-4ba4-bdb3-b51e71df9ff1","resolution":{"observed_at":"2026-08-11T16:48:46.514122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.02111","last_updated":"2023-01-05T15:37:15Z","snapshot_observed_at":"2026-08-07T10:11:17.796562Z","submitted_at":"2023-01-05T15:37:15Z","title":"Neural Codec Language Models are Zero-Shot Text to Speech Synthesizers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.02111","snapshot_observed_at":"2026-08-11T16:48:46.519045Z","title":"Neural codec language models are zero-shot text to speech synthesiz- ers,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09789","last_updated":"2024-12-13T02:07:21Z","snapshot_observed_at":"2026-08-18T22:46:24.721751Z","submitted_at":"2024-12-13T02:07:21Z","title":"SILA: Signal-to-Language Augmentation for Enhanced Control in Text-to-Audio Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T16:48:46.519045Z"},"links":{"cited_paper":"/paper/2301.02111","citing_paper":"/paper/2412.09789"},"observation_digest":"sha256:08c10da4268b8c13cdfca345f1df0ba55483303d666ac51e89aeef6cf1ceb6a4","observation_id":"9f7c8f5f-b1c0-46a9-8f02-bbc5532c1cf4","resolution":{"observed_at":"2026-08-11T16:48:46.519045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:48:46.524157Z","title":"Simple and controllable music generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09789","last_updated":"2024-12-13T02:07:21Z","snapshot_observed_at":"2026-08-18T22:46:24.721751Z","submitted_at":"2024-12-13T02:07:21Z","title":"SILA: Signal-to-Language Augmentation for Enhanced Control in Text-to-Audio Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T16:48:46.524157Z"},"links":{"citing_paper":"/paper/2412.09789"},"observation_digest":"sha256:5656ce567e8cc4240fe8886f83aa8395e07a9ae9d0a509fff434ed0560bf3fc5","observation_id":"3c66992e-5c2a-4837-b6c7-8a726636d3fd","resolution":{"observed_at":"2026-08-11T16:48:46.524157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:48:46.928320Z","title":"Compa: Addressing the gap in compositional reasoning in audio-language models,","venue":null,"work_id":"16e85699-c540-4ea4-bc39-28513fa7c614","year":2024},"citing_paper":{"arxiv_id":"2412.09789","last_updated":"2024-12-13T02:07:21Z","snapshot_observed_at":"2026-08-18T22:46:24.721751Z","submitted_at":"2024-12-13T02:07:21Z","title":"SILA: Signal-to-Language Augmentation for Enhanced Control in Text-to-Audio Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T16:48:46.529642Z"},"links":{"citing_paper":"/paper/2412.09789"},"observation_digest":"sha256:6057dfd46b9b301907b1cb6af0edd249fe9a497b9fa5bda194945050d8da4064","observation_id":"1027dca1-02c4-4226-af49-b809f9249866","resolution":{"observed_at":"2026-08-11T16:48:46.932511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04292","last_updated":"2023-07-10T00:58:28Z","snapshot_observed_at":"2026-08-19T23:09:42.339567Z","submitted_at":"2023-07-10T00:58:28Z","title":"A Demand-Driven Perspective on Generative Audio AI","version":1},"cited_work":{"arxiv_id":"2307.04292","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.04292","snapshot_observed_at":"2026-08-11T16:48:46.730441Z","title":"A Demand-Driven Perspective on Generative Audio AI","venue":"eess.AS","work_id":"53636893-da65-4a77-9acb-08e821094663","year":2023},"citing_paper":{"arxiv_id":"2412.09789","last_updated":"2024-12-13T02:07:21Z","snapshot_observed_at":"2026-08-18T22:46:24.721751Z","submitted_at":"2024-12-13T02:07:21Z","title":"SILA: Signal-to-Language Augmentation for Enhanced Control in Text-to-Audio Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T16:48:46.534399Z"},"links":{"cited_paper":"/paper/2307.04292","citing_paper":"/paper/2412.09789"},"observation_digest":"sha256:16a2c0e8b36e0e00674b1f80b2668e29f6326984d3f73048d55ec5f6dfcf9227","observation_id":"f45c1f0f-cdf5-4754-bc36-44144c16a673","resolution":{"observed_at":"2026-08-11T16:48:46.737002Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:48:46.916984Z","title":"Large-scale contrastive language- audio pretraining with feature fusion and keyword-to-caption augmen- tation,","venue":null,"work_id":"0a9d9fc4-dd13-45f0-ba7e-b68a8ce7007f","year":2023},"citing_paper":{"arxiv_id":"2412.09789","last_updated":"2024-12-13T02:07:21Z","snapshot_observed_at":"2026-08-18T22:46:24.721751Z","submitted_at":"2024-12-13T02:07:21Z","title":"SILA: Signal-to-Language Augmentation for Enhanced Control in Text-to-Audio Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T16:48:46.538457Z"},"links":{"citing_paper":"/paper/2412.09789"},"observation_digest":"sha256:1b8bc45c873241ec48068d878dbf9677bd9eae6ffa3dd65797172d246e1789a5","observation_id":"eb686d45-1596-45c6-bdde-87fa5cdca707","resolution":{"observed_at":"2026-08-11T16:48:46.921005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.08466","last_updated":"2019-01-17T16:12:43Z","snapshot_observed_at":"2026-08-15T08:25:11.276003Z","submitted_at":"2018-12-20T10:28:00Z","title":"Fr\\'echet Audio Distance: A Metric for Evaluating Music Enhancement Algorithms","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.08466","snapshot_observed_at":"2026-08-11T16:48:46.542856Z","title":"Fr \\’echet audio distance: A metric for evaluating music enhance- ment algorithms,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.09789","last_updated":"2024-12-13T02:07:21Z","snapshot_observed_at":"2026-08-18T22:46:24.721751Z","submitted_at":"2024-12-13T02:07:21Z","title":"SILA: Signal-to-Language Augmentation for Enhanced Control in Text-to-Audio Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T16:48:46.542856Z"},"links":{"cited_paper":"/paper/1812.08466","citing_paper":"/paper/2412.09789"},"observation_digest":"sha256:ad4552a7d809911b69a605876b219021786bfb277a037902104c1a3f0e3c16e9","observation_id":"241993d4-bac1-4f8f-b8e1-547179c129fd","resolution":{"observed_at":"2026-08-11T16:48:46.542856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:48:46.906279Z","title":"Generative adversarial nets,","venue":null,"work_id":"27305b43-998a-4e3d-bbee-fe9aeb040fc9","year":2014},"citing_paper":{"arxiv_id":"2412.09789","last_updated":"2024-12-13T02:07:21Z","snapshot_observed_at":"2026-08-18T22:46:24.721751Z","submitted_at":"2024-12-13T02:07:21Z","title":"SILA: Signal-to-Language Augmentation for Enhanced Control in Text-to-Audio Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T16:48:46.547589Z"},"links":{"citing_paper":"/paper/2412.09789"},"observation_digest":"sha256:9e6f652b65ef7014974d9fa7aed883e4d7964686363ab10bd8d08b06c7500bd4","observation_id":"ceaa1dff-4284-444d-a15a-1b22d0a23815","resolution":{"observed_at":"2026-08-11T16:48:46.909759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1703.10135","last_updated":"2017-04-06T21:20:34Z","snapshot_observed_at":"2026-08-17T12:01:30.659594Z","submitted_at":"2017-03-29T16:55:13Z","title":"Tacotron: Towards End-to-End Speech Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.10135","snapshot_observed_at":"2026-08-11T16:48:46.551986Z","title":"Tacotron: Towards end-to-end speech synthesis,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.09789","last_updated":"2024-12-13T02:07:21Z","snapshot_observed_at":"2026-08-18T22:46:24.721751Z","submitted_at":"2024-12-13T02:07:21Z","title":"SILA: Signal-to-Language Augmentation for Enhanced Control in Text-to-Audio Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T16:48:46.551986Z"},"links":{"cited_paper":"/paper/1703.10135","citing_paper":"/paper/2412.09789"},"observation_digest":"sha256:bc30e905df54b72332cdbd2bc8e732a55bbf514784143d6ab2511e2244dec2af","observation_id":"b0e16031-dc20-45c9-8d62-7e7a487310bf","resolution":{"observed_at":"2026-08-11T16:48:46.551986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-08-14T23:50:45.029465Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-11T16:48:46.557063Z","title":"Auto-encoding variational bayes,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.09789","last_updated":"2024-12-13T02:07:21Z","snapshot_observed_at":"2026-08-18T22:46:24.721751Z","submitted_at":"2024-12-13T02:07:21Z","title":"SILA: Signal-to-Language Augmentation for Enhanced Control in Text-to-Audio Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T16:48:46.557063Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2412.09789"},"observation_digest":"sha256:c64385f8f4ad12deccceaad40c00cb4cf854a8a1d888d83ff8da16d877040419","observation_id":"ee3b2b77-d107-430e-95b4-d859b455c981","resolution":{"observed_at":"2026-08-11T16:48:46.557063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15352","last_updated":"2023-03-05T09:14:16Z","snapshot_observed_at":"2026-08-16T16:27:53.560021Z","submitted_at":"2022-09-30T10:17:05Z","title":"AudioGen: Textually Guided Audio Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15352","snapshot_observed_at":"2026-08-11T16:48:46.561780Z","title":"Audiogen: Textually guided audio generation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09789","last_updated":"2024-12-13T02:07:21Z","snapshot_observed_at":"2026-08-18T22:46:24.721751Z","submitted_at":"2024-12-13T02:07:21Z","title":"SILA: Signal-to-Language Augmentation for Enhanced Control in Text-to-Audio Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T16:48:46.561780Z"},"links":{"cited_paper":"/paper/2209.15352","citing_paper":"/paper/2412.09789"},"observation_digest":"sha256:0e860c1c1eff1d53c0df28eea04f2f3c28e75346e4f91c469145aca64f5604d6","observation_id":"0a677f8b-f682-4499-a7d2-9425e63bd858","resolution":{"observed_at":"2026-08-11T16:48:46.561780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05551","last_updated":"2024-06-08T18:57:13Z","snapshot_observed_at":"2026-08-19T01:24:41.802615Z","submitted_at":"2024-06-08T18:57:13Z","title":"Autoregressive Diffusion Transformer for Text-to-Speech Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05551","snapshot_observed_at":"2026-08-11T16:48:46.566564Z","title":"Au- toregressive diffusion transformer for text-to-speech synthesis,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09789","last_updated":"2024-12-13T02:07:21Z","snapshot_observed_at":"2026-08-18T22:46:24.721751Z","submitted_at":"2024-12-13T02:07:21Z","title":"SILA: Signal-to-Language Augmentation for Enhanced Control in Text-to-Audio Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T16:48:46.566564Z"},"links":{"cited_paper":"/paper/2406.05551","citing_paper":"/paper/2412.09789"},"observation_digest":"sha256:fb292fd4a68596e311813bca2a0da31316c99d9da119569e5ba3dff7282ad2ac","observation_id":"b1135e13-7d02-4d6c-aed9-4297887c124d","resolution":{"observed_at":"2026-08-11T16:48:46.566564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:48:46.894508Z","title":"Diffwave: A versatile diffusion model for audio synthesis,","venue":null,"work_id":"d96e6b0b-01ae-4e0f-a301-069d358bb97c","year":2021},"citing_paper":{"arxiv_id":"2412.09789","last_updated":"2024-12-13T02:07:21Z","snapshot_observed_at":"2026-08-18T22:46:24.721751Z","submitted_at":"2024-12-13T02:07:21Z","title":"SILA: Signal-to-Language Augmentation for Enhanced Control in Text-to-Audio Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T16:48:46.570830Z"},"links":{"citing_paper":"/paper/2412.09789"},"observation_digest":"sha256:c896fca9626ee6a6ba5858fdb35a1a5f7eb86c9edc9deb135a3664628eebec10","observation_id":"e0ff1037-5128-491d-b90c-23cad86a6c68","resolution":{"observed_at":"2026-08-11T16:48:46.898682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:48:46.574553Z","title":"Music controlnet: Multiple time-varying controls for music generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09789","last_updated":"2024-12-13T02:07:21Z","snapshot_observed_at":"2026-08-18T22:46:24.721751Z","submitted_at":"2024-12-13T02:07:21Z","title":"SILA: Signal-to-Language Augmentation for Enhanced Control in Text-to-Audio Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T16:48:46.574553Z"},"links":{"citing_paper":"/paper/2412.09789"},"observation_digest":"sha256:9dde9394d9f3f8b4dbc0b5a9ce765417ce2c65c44772d6ef232cda1b27bb8ee3","observation_id":"c68c40c9-a15c-4e56-bbfd-8a1fbd1f1769","resolution":{"observed_at":"2026-08-11T16:48:46.574553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.07217","last_updated":"2018-12-27T06:50:41Z","snapshot_observed_at":"2026-08-14T18:13:38.548293Z","submitted_at":"2018-10-16T18:20:02Z","title":"Hierarchical Generative Modeling for Controllable Speech Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.07217","snapshot_observed_at":"2026-08-11T16:48:46.579511Z","title":"Hierarchical generative modeling for controllable speech synthesis,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.09789","last_updated":"2024-12-13T02:07:21Z","snapshot_observed_at":"2026-08-18T22:46:24.721751Z","submitted_at":"2024-12-13T02:07:21Z","title":"SILA: Signal-to-Language Augmentation for Enhanced Control in Text-to-Audio Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T16:48:46.579511Z"},"links":{"cited_paper":"/paper/1810.07217","citing_paper":"/paper/2412.09789"},"observation_digest":"sha256:e0b4671f34fbc9e7e9a5f4b4eb99ea88f35b8adea3e2872e352369b89450a1ba","observation_id":"f9effb47-a044-4fbd-aea7-e2b9298c6750","resolution":{"observed_at":"2026-08-11T16:48:46.579511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:48:46.874356Z","title":"Deep voice: Real-time neural text-to-speech,","venue":null,"work_id":"61b8e95b-43c4-4184-bdf8-c56dad5bbce5","year":2017},"citing_paper":{"arxiv_id":"2412.09789","last_updated":"2024-12-13T02:07:21Z","snapshot_observed_at":"2026-08-18T22:46:24.721751Z","submitted_at":"2024-12-13T02:07:21Z","title":"SILA: Signal-to-Language Augmentation for Enhanced Control in Text-to-Audio Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T16:48:46.584847Z"},"links":{"citing_paper":"/paper/2412.09789"},"observation_digest":"sha256:f1bcf44da7dcc1f0c3d96c2eb5105ccf4f5759ea51fbb3ecb7e02b95378d241e","observation_id":"9c4c451b-9dc2-4e8d-bfc3-967a60d57551","resolution":{"observed_at":"2026-08-11T16:48:46.878616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:48:46.861311Z","title":"GAMA: A large audio-language model with advanced audio understanding and complex reasoning abilities,","venue":null,"work_id":"74fb2590-7f00-4b18-9fe3-6489c13523dc","year":2024},"citing_paper":{"arxiv_id":"2412.09789","last_updated":"2024-12-13T02:07:21Z","snapshot_observed_at":"2026-08-18T22:46:24.721751Z","submitted_at":"2024-12-13T02:07:21Z","title":"SILA: Signal-to-Language Augmentation for Enhanced Control in Text-to-Audio Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T16:48:46.588821Z"},"links":{"citing_paper":"/paper/2412.09789"},"observation_digest":"sha256:834fa85dcdb89897c0759c7f2edc4e680cf9f6ca7b1ca0b751b976614e45b67e","observation_id":"daa8b8fe-2100-419d-b792-eec6dbe7f438","resolution":{"observed_at":"2026-08-11T16:48:46.865812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-08-17T20:30:34.016254Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-11T16:48:46.593367Z","title":"Mistral 7b,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.09789","last_updated":"2024-12-13T02:07:21Z","snapshot_observed_at":"2026-08-18T22:46:24.721751Z","submitted_at":"2024-12-13T02:07:21Z","title":"SILA: Signal-to-Language Augmentation for Enhanced Control in Text-to-Audio Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T16:48:46.593367Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2412.09789"},"observation_digest":"sha256:b85d06b472e20a19927691bfdc0140944f2bca751cf50277f1c7cbde4c8f13c4","observation_id":"1e336f2c-2986-4316-a703-4f19b1ece08f","resolution":{"observed_at":"2026-08-11T16:48:46.593367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:48:46.848615Z","title":null,"venue":null,"work_id":"f8df2c93-ea77-458f-ab19-428361e8a85a","year":2012},"citing_paper":{"arxiv_id":"2412.09789","last_updated":"2024-12-13T02:07:21Z","snapshot_observed_at":"2026-08-18T22:46:24.721751Z","submitted_at":"2024-12-13T02:07:21Z","title":"SILA: Signal-to-Language Augmentation for Enhanced Control in Text-to-Audio Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T16:48:46.598103Z"},"links":{"citing_paper":"/paper/2412.09789"},"observation_digest":"sha256:7adc74210c3a96111289ab409dafbb75b2672b03938c7aaf06a761d584dff6c3","observation_id":"995a5bcf-71d9-437f-804a-6fd8080ad16f","resolution":{"observed_at":"2026-08-11T16:48:46.852713Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:48:46.836834Z","title":"Crepe: A convolutional representation for pitch estimation,","venue":null,"work_id":"43f32ebf-3ee7-4947-ab4d-228c210d4f8d","year":2018},"citing_paper":{"arxiv_id":"2412.09789","last_updated":"2024-12-13T02:07:21Z","snapshot_observed_at":"2026-08-18T22:46:24.721751Z","submitted_at":"2024-12-13T02:07:21Z","title":"SILA: Signal-to-Language Augmentation for Enhanced Control in Text-to-Audio Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T16:48:46.601685Z"},"links":{"citing_paper":"/paper/2412.09789"},"observation_digest":"sha256:8823d9970f6a771ecb6095cd17e1eb086c914a137f09f26467b3ff47c7b0be52","observation_id":"ee1ac531-ddcc-4e94-8068-b0df41594ee5","resolution":{"observed_at":"2026-08-11T16:48:46.840699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:48:46.825812Z","title":"Suppression of acoustic noise in speech using spectral subtraction,","venue":null,"work_id":"00c22cbb-cb34-4024-8668-4683fae02f8d","year":1979},"citing_paper":{"arxiv_id":"2412.09789","last_updated":"2024-12-13T02:07:21Z","snapshot_observed_at":"2026-08-18T22:46:24.721751Z","submitted_at":"2024-12-13T02:07:21Z","title":"SILA: Signal-to-Language Augmentation for Enhanced Control in Text-to-Audio Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T16:48:46.605399Z"},"links":{"citing_paper":"/paper/2412.09789"},"observation_digest":"sha256:902c1175659f1401f10d748b8069f7f5fbfcbe50ecb74dc2e5117989a5be284e","observation_id":"8a25975b-8b2d-401a-9183-ac18f509fab8","resolution":{"observed_at":"2026-08-11T16:48:46.829660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:48:46.814277Z","title":"Fsd50k: an open dataset of human-labeled sound events,","venue":null,"work_id":"18e0e13c-1d61-43b6-baae-a082234d9a41","year":2021},"citing_paper":{"arxiv_id":"2412.09789","last_updated":"2024-12-13T02:07:21Z","snapshot_observed_at":"2026-08-18T22:46:24.721751Z","submitted_at":"2024-12-13T02:07:21Z","title":"SILA: Signal-to-Language Augmentation for Enhanced Control in Text-to-Audio Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T16:48:46.609249Z"},"links":{"citing_paper":"/paper/2412.09789"},"observation_digest":"sha256:c37130b99c0af70c159fa90f18c25994df82c720028395d0e6e703db64dfd1b3","observation_id":"27dcc94c-79c3-4d67-9e03-5f6f398fa878","resolution":{"observed_at":"2026-08-11T16:48:46.818296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:48:46.804049Z","title":"Make- an-audio: Text-to-audio generation with prompt-enhanced diffusion mod- els,","venue":null,"work_id":"688b535b-0830-4c42-9ce0-5abc88a58b3f","year":2023},"citing_paper":{"arxiv_id":"2412.09789","last_updated":"2024-12-13T02:07:21Z","snapshot_observed_at":"2026-08-18T22:46:24.721751Z","submitted_at":"2024-12-13T02:07:21Z","title":"SILA: Signal-to-Language Augmentation for Enhanced Control in Text-to-Audio Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T16:48:46.612562Z"},"links":{"citing_paper":"/paper/2412.09789"},"observation_digest":"sha256:89c76c02c723ae4722b6925131b439ba53563e89aee6c584bb9d01e2938574ac","observation_id":"10696c29-daa1-4fca-9a8a-aafbfc793e38","resolution":{"observed_at":"2026-08-11T16:48:46.807508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:48:46.793829Z","title":"Scalable diffusion models with transformers,","venue":null,"work_id":"a4791195-d33c-4795-8361-5c6393159fcc","year":2023},"citing_paper":{"arxiv_id":"2412.09789","last_updated":"2024-12-13T02:07:21Z","snapshot_observed_at":"2026-08-18T22:46:24.721751Z","submitted_at":"2024-12-13T02:07:21Z","title":"SILA: Signal-to-Language Augmentation for Enhanced Control in Text-to-Audio Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T16:48:46.615943Z"},"links":{"citing_paper":"/paper/2412.09789"},"observation_digest":"sha256:70d457c09b3530cae2591f60d57c0f59de74d7f584996b42c5ea4e8b47263c27","observation_id":"ffe3740a-9c03-453d-b962-963732da51d3","resolution":{"observed_at":"2026-08-11T16:48:46.797395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:48:46.619020Z","title":"Scaling instruction-finetuned language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09789","last_updated":"2024-12-13T02:07:21Z","snapshot_observed_at":"2026-08-18T22:46:24.721751Z","submitted_at":"2024-12-13T02:07:21Z","title":"SILA: Signal-to-Language Augmentation for Enhanced Control in Text-to-Audio Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T16:48:46.619020Z"},"links":{"citing_paper":"/paper/2412.09789"},"observation_digest":"sha256:c3a11f9aafbdc59b28f2c2915db48727a863719168be8ce9b388b61a357521a2","observation_id":"672f74b3-78c4-459a-9ac3-164023fe7173","resolution":{"observed_at":"2026-08-11T16:48:46.619020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:48:46.775270Z","title":"High-fidelity audio compression with improved rvqgan,","venue":null,"work_id":"85c697ec-4f1a-44dc-884d-5002b76b2460","year":2024},"citing_paper":{"arxiv_id":"2412.09789","last_updated":"2024-12-13T02:07:21Z","snapshot_observed_at":"2026-08-18T22:46:24.721751Z","submitted_at":"2024-12-13T02:07:21Z","title":"SILA: Signal-to-Language Augmentation for Enhanced Control in Text-to-Audio Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T16:48:46.622710Z"},"links":{"citing_paper":"/paper/2412.09789"},"observation_digest":"sha256:db455c79ee126a5e42265e2477cab4b03259d3cb1690209dce63cc56118a661d","observation_id":"ffd59caa-dbe8-4432-b86c-877f2b71d670","resolution":{"observed_at":"2026-08-11T16:48:46.779106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:48:46.626775Z","title":"Tango 2: Aligning diffusion-based text-to-audio generations through direct preference optimization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09789","last_updated":"2024-12-13T02:07:21Z","snapshot_observed_at":"2026-08-18T22:46:24.721751Z","submitted_at":"2024-12-13T02:07:21Z","title":"SILA: Signal-to-Language Augmentation for Enhanced Control in Text-to-Audio Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T16:48:46.626775Z"},"links":{"citing_paper":"/paper/2412.09789"},"observation_digest":"sha256:1367672226ed84022313657c3de625344ce7ae68bbbe439b025d48fea144a308","observation_id":"beb07327-682b-48f2-9c6b-b7122c355d1a","resolution":{"observed_at":"2026-08-11T16:48:46.626775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.09789","last_updated":"2024-12-13T02:07:21Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-18T22:46:24.721751Z","submitted_at":"2024-12-13T02:07:21Z","title":"SILA: Signal-to-Language Augmentation for Enhanced Control in Text-to-Audio Generation"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":1,"verified_fuzzy":13},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 1 inbound Pith citation observation for arXiv:2412.09789."}