{"as_of":"2026-08-10T04:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:559d5e0720b6832c3a7889950b72f42f02c17950f51c0b572759c1855eb98a7e","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T05:32:41.533152Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.13330/citation-record","integrity":"/paper/2607.13330/integrity","json":"/paper/2607.13330/citation-record.json","paper":"/paper/2607.13330"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:32:39.495691Z","title":"Make-an-audio: Text-to-audio generation with prompt- enhanced diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13330","last_updated":"2026-07-14T23:22:27Z","snapshot_observed_at":"2026-08-06T15:04:41.562961Z","submitted_at":"2026-07-14T23:22:27Z","title":"Efficient Text-to-Audio Generation via Pruning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T05:32:39.495691Z"},"links":{"citing_paper":"/paper/2607.13330"},"observation_digest":"sha256:cc221295d443dbcfdf1e92f1feff1a99da0d4bf82bdab1cde67d246e05da36a2","observation_id":"9c68a6f8-c8be-4846-a8d3-3b109e712250","resolution":{"observed_at":"2026-08-02T05:32:39.495691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:32:39.595704Z","title":"AudioLDM: Text-to-audio generation with latent diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13330","last_updated":"2026-07-14T23:22:27Z","snapshot_observed_at":"2026-08-06T15:04:41.562961Z","submitted_at":"2026-07-14T23:22:27Z","title":"Efficient Text-to-Audio Generation via Pruning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T05:32:39.595704Z"},"links":{"citing_paper":"/paper/2607.13330"},"observation_digest":"sha256:9e935120a6152d0750c587d037539ec5b86b8a0ecb6944eadfaa15cdbecdb967","observation_id":"6b131067-16fe-43bd-bf57-a5c1f074cde1","resolution":{"observed_at":"2026-08-02T05:32:39.595704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:32:39.712640Z","title":"DreamAudio: Customized text-to-audio generation with diffusion models,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13330","last_updated":"2026-07-14T23:22:27Z","snapshot_observed_at":"2026-08-06T15:04:41.562961Z","submitted_at":"2026-07-14T23:22:27Z","title":"Efficient Text-to-Audio Generation via Pruning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T05:32:39.712640Z"},"links":{"citing_paper":"/paper/2607.13330"},"observation_digest":"sha256:5cd33cc5683db1c1fc7b00930221a4f3eb49157b5a4439a9297b16b4d394e7aa","observation_id":"a812b58f-21fb-4e41-9679-ca5a9d1e6e3e","resolution":{"observed_at":"2026-08-02T05:32:39.712640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:32:39.824498Z","title":"Efficient diffusion models: A comprehensive survey from principles to practices,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13330","last_updated":"2026-07-14T23:22:27Z","snapshot_observed_at":"2026-08-06T15:04:41.562961Z","submitted_at":"2026-07-14T23:22:27Z","title":"Efficient Text-to-Audio Generation via Pruning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T05:32:39.824498Z"},"links":{"citing_paper":"/paper/2607.13330"},"observation_digest":"sha256:06e78eff1ce17d69755fd7b5eae9606a7fff9080072ec619c1f7a8561eed80a0","observation_id":"d2a51c39-e09a-436c-afca-081942a9df1b","resolution":{"observed_at":"2026-08-02T05:32:39.824498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:32:39.932090Z","title":"Diffsound: Discrete diffusion model for text-to-sound generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13330","last_updated":"2026-07-14T23:22:27Z","snapshot_observed_at":"2026-08-06T15:04:41.562961Z","submitted_at":"2026-07-14T23:22:27Z","title":"Efficient Text-to-Audio Generation via Pruning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T05:32:39.932090Z"},"links":{"citing_paper":"/paper/2607.13330"},"observation_digest":"sha256:ef9a1521841207f4557d688507de38c4346907ea2c461e2cdfd86a1010de5539","observation_id":"e9426c50-c5fe-476a-ad49-9623f29106bb","resolution":{"observed_at":"2026-08-02T05:32:39.932090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:32:40.041007Z","title":"Come-closer-diffuse-faster: Accelerating conditional diffusion models for inverse problems through stochastic contraction,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.13330","last_updated":"2026-07-14T23:22:27Z","snapshot_observed_at":"2026-08-06T15:04:41.562961Z","submitted_at":"2026-07-14T23:22:27Z","title":"Efficient Text-to-Audio Generation via Pruning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T05:32:40.041007Z"},"links":{"citing_paper":"/paper/2607.13330"},"observation_digest":"sha256:ad014d9fd9c547a28b40bd42728718b58d0a91f76cc54503ff62cc0cd161d6bd","observation_id":"c373037a-3b8d-4182-a507-af97aa91867a","resolution":{"observed_at":"2026-08-02T05:32:40.041007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:32:40.155730Z","title":"Diffwave: A versatile diffusion model for audio synthesis,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.13330","last_updated":"2026-07-14T23:22:27Z","snapshot_observed_at":"2026-08-06T15:04:41.562961Z","submitted_at":"2026-07-14T23:22:27Z","title":"Efficient Text-to-Audio Generation via Pruning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T05:32:40.155730Z"},"links":{"citing_paper":"/paper/2607.13330"},"observation_digest":"sha256:fa8d1e7e7a3d62d09cd6ee8341ff2b039a47cb3e3b44eda8df3221eac9f00c3e","observation_id":"00d4664a-bdbb-42cf-99b7-eb8ff9663e69","resolution":{"observed_at":"2026-08-02T05:32:40.155730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-02T05:32:40.265579Z","title":"Distilling the knowledge in a neural network,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.13330","last_updated":"2026-07-14T23:22:27Z","snapshot_observed_at":"2026-08-06T15:04:41.562961Z","submitted_at":"2026-07-14T23:22:27Z","title":"Efficient Text-to-Audio Generation via Pruning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T05:32:40.265579Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2607.13330"},"observation_digest":"sha256:cbc6e94d1d17786f6959b4f32586bb45a7c7238ab5e94721e02ce53b52332787","observation_id":"f0d7262a-b665-4119-87f2-b525aaa79faf","resolution":{"observed_at":"2026-08-02T05:32:40.265579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:32:40.341842Z","title":"Progressive distillation for fast sampling of diffu- sion models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.13330","last_updated":"2026-07-14T23:22:27Z","snapshot_observed_at":"2026-08-06T15:04:41.562961Z","submitted_at":"2026-07-14T23:22:27Z","title":"Efficient Text-to-Audio Generation via Pruning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T05:32:40.341842Z"},"links":{"citing_paper":"/paper/2607.13330"},"observation_digest":"sha256:8441c8a86c7ba30997d4e62c94e31647de17a0cacb358cc47ccd4dfaab278feb","observation_id":"21d5cf5a-a7b6-4037-be04-b1e3cb4f158d","resolution":{"observed_at":"2026-08-02T05:32:40.341842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:32:40.411074Z","title":"SoundLoCD: An efficient conditional discrete contrastive latent diffusion model for text-to-sound generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13330","last_updated":"2026-07-14T23:22:27Z","snapshot_observed_at":"2026-08-06T15:04:41.562961Z","submitted_at":"2026-07-14T23:22:27Z","title":"Efficient Text-to-Audio Generation via Pruning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T05:32:40.411074Z"},"links":{"citing_paper":"/paper/2607.13330"},"observation_digest":"sha256:9d9e7346528fd5b3b66158f017001c9043af01f04a329d7168b34252689d4323","observation_id":"3aa8b987-678e-4953-80f9-ea59ac84eb85","resolution":{"observed_at":"2026-08-02T05:32:40.411074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:32:40.476534Z","title":"Structured pruning for deep convolutional neural networks: A survey,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13330","last_updated":"2026-07-14T23:22:27Z","snapshot_observed_at":"2026-08-06T15:04:41.562961Z","submitted_at":"2026-07-14T23:22:27Z","title":"Efficient Text-to-Audio Generation via Pruning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T05:32:40.476534Z"},"links":{"citing_paper":"/paper/2607.13330"},"observation_digest":"sha256:f8a7dd313d6bba5cd2809147f35a3c773d51866f2659cf2aac383681bedbdca1","observation_id":"92ba6a72-3a45-4dad-9eb8-2105fe62ca7c","resolution":{"observed_at":"2026-08-02T05:32:40.476534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:32:40.554824Z","title":"Efficient CNNs via passive filter pruning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13330","last_updated":"2026-07-14T23:22:27Z","snapshot_observed_at":"2026-08-06T15:04:41.562961Z","submitted_at":"2026-07-14T23:22:27Z","title":"Efficient Text-to-Audio Generation via Pruning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T05:32:40.554824Z"},"links":{"citing_paper":"/paper/2607.13330"},"observation_digest":"sha256:506b418be7782d920b3a9d67e4eb26912c61af027592daab6a47cc3709124565","observation_id":"a215ec4c-d234-4243-a49d-4fec537f07f6","resolution":{"observed_at":"2026-08-02T05:32:40.554824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:32:40.635940Z","title":"Ld-pruner: Efficient pruning of latent diffusion models using task-agnostic insights,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13330","last_updated":"2026-07-14T23:22:27Z","snapshot_observed_at":"2026-08-06T15:04:41.562961Z","submitted_at":"2026-07-14T23:22:27Z","title":"Efficient Text-to-Audio Generation via Pruning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T05:32:40.635940Z"},"links":{"citing_paper":"/paper/2607.13330"},"observation_digest":"sha256:8757888ec938b16c81274d665ffa0aba0a7f3b8bf31f80d1135c3c976ddf5ca2","observation_id":"7040d16a-9e5f-40c1-9b67-1c91fc6c66ae","resolution":{"observed_at":"2026-08-02T05:32:40.635940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.11098","last_updated":"2025-03-05T13:28:29Z","snapshot_observed_at":"2026-07-06T18:01:23.297512Z","submitted_at":"2024-04-17T06:32:42Z","title":"LAPTOP-Diff: Layer Pruning and Normalized Distillation for Compressing Diffusion Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.11098","snapshot_observed_at":"2026-08-02T05:32:40.752139Z","title":"Laptop-diff: Layer pruning and normalized distillation for compressing diffusion models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13330","last_updated":"2026-07-14T23:22:27Z","snapshot_observed_at":"2026-08-06T15:04:41.562961Z","submitted_at":"2026-07-14T23:22:27Z","title":"Efficient Text-to-Audio Generation via Pruning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T05:32:40.752139Z"},"links":{"cited_paper":"/paper/2404.11098","citing_paper":"/paper/2607.13330"},"observation_digest":"sha256:b151b547578cc8c8859df9a830bef41875bef3f354ccf7baedc8873a833c351b","observation_id":"26b8a9fc-2bb6-4689-8ee3-ad6a6b30dc5d","resolution":{"observed_at":"2026-08-02T05:32:40.752139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:32:40.817718Z","title":"Layermerge: Neural network depth compression through layer pruning and merging,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13330","last_updated":"2026-07-14T23:22:27Z","snapshot_observed_at":"2026-08-06T15:04:41.562961Z","submitted_at":"2026-07-14T23:22:27Z","title":"Efficient Text-to-Audio Generation via Pruning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T05:32:40.817718Z"},"links":{"citing_paper":"/paper/2607.13330"},"observation_digest":"sha256:fef48bedab55f402735b0aabe1027cc9a8ccd99540a030d4edc5f6abeaf482bf","observation_id":"9b899b96-3d38-49a3-bcfc-eac333d11230","resolution":{"observed_at":"2026-08-02T05:32:40.817718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:32:40.868725Z","title":"Structural pruning for diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13330","last_updated":"2026-07-14T23:22:27Z","snapshot_observed_at":"2026-08-06T15:04:41.562961Z","submitted_at":"2026-07-14T23:22:27Z","title":"Efficient Text-to-Audio Generation via Pruning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T05:32:40.868725Z"},"links":{"citing_paper":"/paper/2607.13330"},"observation_digest":"sha256:bd970a5b6eab290b3da6ff7fc5ce7bb3c46a2f7d107c78f7eea66b2d50960ff3","observation_id":"ff7b44b9-6412-4f15-a3c9-3a67d9b7e655","resolution":{"observed_at":"2026-08-02T05:32:40.868725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:32:40.928546Z","title":"Using feature entropy to guide filter pruning for efficient convolutional networks,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.13330","last_updated":"2026-07-14T23:22:27Z","snapshot_observed_at":"2026-08-06T15:04:41.562961Z","submitted_at":"2026-07-14T23:22:27Z","title":"Efficient Text-to-Audio Generation via Pruning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T05:32:40.928546Z"},"links":{"citing_paper":"/paper/2607.13330"},"observation_digest":"sha256:084e1cc8019540677f8bd6b13a586372feaf89a13d684bd1a33a3da463fc1837","observation_id":"dbebb7f6-f257-4f61-b2e6-4ebd28cd30ad","resolution":{"observed_at":"2026-08-02T05:32:40.928546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:32:41.015504Z","title":"HRank: Filter pruning using high-rank feature map,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.13330","last_updated":"2026-07-14T23:22:27Z","snapshot_observed_at":"2026-08-06T15:04:41.562961Z","submitted_at":"2026-07-14T23:22:27Z","title":"Efficient Text-to-Audio Generation via Pruning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T05:32:41.015504Z"},"links":{"citing_paper":"/paper/2607.13330"},"observation_digest":"sha256:b28fa7e2c3a7c7c1422ebf0009be5f26ff5c1dfa8733335f8037bc2c78868163","observation_id":"1d57ec41-53ee-49c2-b26f-771310c57141","resolution":{"observed_at":"2026-08-02T05:32:41.015504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:32:41.081163Z","title":"EZCrop: Energy- zoned channels for robust output pruning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.13330","last_updated":"2026-07-14T23:22:27Z","snapshot_observed_at":"2026-08-06T15:04:41.562961Z","submitted_at":"2026-07-14T23:22:27Z","title":"Efficient Text-to-Audio Generation via Pruning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T05:32:41.081163Z"},"links":{"citing_paper":"/paper/2607.13330"},"observation_digest":"sha256:734e95ef0a1e6ec64f08c32ebeefa2c7b441958963ccd96f4fa507bb4ec3b6a4","observation_id":"998db8c8-2221-4255-bb77-7fd0857c2aad","resolution":{"observed_at":"2026-08-02T05:32:41.081163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:32:41.134997Z","title":"Pruning filters for efficient ConvNets,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.13330","last_updated":"2026-07-14T23:22:27Z","snapshot_observed_at":"2026-08-06T15:04:41.562961Z","submitted_at":"2026-07-14T23:22:27Z","title":"Efficient Text-to-Audio Generation via Pruning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T05:32:41.134997Z"},"links":{"citing_paper":"/paper/2607.13330"},"observation_digest":"sha256:2d7bd42bc086d841cbe0fcd527aef07efb38f13d14271b0adb9a21783bc7d946","observation_id":"b714e89c-e69a-470a-8a45-b2af39dbdc8b","resolution":{"observed_at":"2026-08-02T05:32:41.134997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:32:41.192139Z","title":"Compressing audio cnns with graph centrality based filter pruning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13330","last_updated":"2026-07-14T23:22:27Z","snapshot_observed_at":"2026-08-06T15:04:41.562961Z","submitted_at":"2026-07-14T23:22:27Z","title":"Efficient Text-to-Audio Generation via Pruning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T05:32:41.192139Z"},"links":{"citing_paper":"/paper/2607.13330"},"observation_digest":"sha256:abc57b80f4337b05962a3ca73aa862874c9d1ff142850a62752d51a965640ba5","observation_id":"4599b153-5169-43b1-ae97-61f59afc398c","resolution":{"observed_at":"2026-08-02T05:32:41.192139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:32:41.256975Z","title":"Audiocaps: Generating captions for audios in the wild,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.13330","last_updated":"2026-07-14T23:22:27Z","snapshot_observed_at":"2026-08-06T15:04:41.562961Z","submitted_at":"2026-07-14T23:22:27Z","title":"Efficient Text-to-Audio Generation via Pruning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T05:32:41.256975Z"},"links":{"citing_paper":"/paper/2607.13330"},"observation_digest":"sha256:9b7259d4c65bd408edef4157815db7df1739a7d45cb8bf7a78c162ca1b440412","observation_id":"fd6766a3-a2b0-4e44-8377-353b0436b56d","resolution":{"observed_at":"2026-08-02T05:32:41.256975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:32:41.337238Z","title":"Audio set: An ontology and human- labeled dataset for audio events,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.13330","last_updated":"2026-07-14T23:22:27Z","snapshot_observed_at":"2026-08-06T15:04:41.562961Z","submitted_at":"2026-07-14T23:22:27Z","title":"Efficient Text-to-Audio Generation via Pruning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T05:32:41.337238Z"},"links":{"citing_paper":"/paper/2607.13330"},"observation_digest":"sha256:e9a33bff37f8945409b722815c699c4b1569d7cca6bb33048e0ff879fa205f81","observation_id":"3a7e686b-f4e3-41cd-96e5-c2a3d89770ad","resolution":{"observed_at":"2026-08-02T05:32:41.337238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15352","last_updated":"2023-03-05T09:14:16Z","snapshot_observed_at":"2026-08-07T16:54:38.689558Z","submitted_at":"2022-09-30T10:17:05Z","title":"AudioGen: Textually Guided Audio Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15352","snapshot_observed_at":"2026-08-02T05:32:41.406290Z","title":"Audiogen: Textually guided audio generation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.13330","last_updated":"2026-07-14T23:22:27Z","snapshot_observed_at":"2026-08-06T15:04:41.562961Z","submitted_at":"2026-07-14T23:22:27Z","title":"Efficient Text-to-Audio Generation via Pruning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T05:32:41.406290Z"},"links":{"cited_paper":"/paper/2209.15352","citing_paper":"/paper/2607.13330"},"observation_digest":"sha256:ea6ba1e47f4fc13eb3bf8533c36866c3810bff67c88e541706dde7bf34e1ea2c","observation_id":"6c63dd82-4e28-4882-8ed9-21601106bb7b","resolution":{"observed_at":"2026-08-02T05:32:41.406290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:32:41.473667Z","title":"Audioldm 2: Learning holistic audio generation with self-supervised pretraining,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13330","last_updated":"2026-07-14T23:22:27Z","snapshot_observed_at":"2026-08-06T15:04:41.562961Z","submitted_at":"2026-07-14T23:22:27Z","title":"Efficient Text-to-Audio Generation via Pruning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T05:32:41.473667Z"},"links":{"citing_paper":"/paper/2607.13330"},"observation_digest":"sha256:1b316d2f194a69e48c9618971583117a5f70505976393d620545a0212386ccd9","observation_id":"9431b0c7-8d3a-4319-a451-5cc31c9e30d8","resolution":{"observed_at":"2026-08-02T05:32:41.473667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:32:41.533152Z","title":"PANNs: Large-scale pretrained audio neural networks for audio pattern recognition,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.13330","last_updated":"2026-07-14T23:22:27Z","snapshot_observed_at":"2026-08-06T15:04:41.562961Z","submitted_at":"2026-07-14T23:22:27Z","title":"Efficient Text-to-Audio Generation via Pruning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T05:32:41.533152Z"},"links":{"citing_paper":"/paper/2607.13330"},"observation_digest":"sha256:68990232a4d84d61231a0b277dcb89d122c46adf5cfa6dc4b3d0f199bfdf18de","observation_id":"f8b9d57c-f772-4929-a2fc-955a96b2a16c","resolution":{"observed_at":"2026-08-02T05:32:41.533152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.13330","last_updated":"2026-07-14T23:22:27Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-06T15:04:41.562961Z","submitted_at":"2026-07-14T23:22:27Z","title":"Efficient Text-to-Audio Generation via Pruning"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":26,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 0 inbound Pith citation observations for arXiv:2607.13330."}