{"as_of":"2026-08-16T12:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0856a88484e00b5409622942c2a0eb38d8e8025359284e8066e83df2d56b7984","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T22:16:09.713863Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-09T19:17:09.247932Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T15:46:42.146108Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"cited_work":{"arxiv_id":"2505.07615","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.07615","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffused responsibility: Analyzing the energy consumption of generative text-to-audio diffusion models.arXiv preprint arXiv:2505.07615","venue":null,"work_id":"b5393c4b-8daa-4882-a3c8-d1619f4335ab","year":null},"citing_paper":{"arxiv_id":"2605.00329","last_updated":"2026-05-01T01:13:50Z","snapshot_observed_at":"2026-08-11T06:31:47.003544Z","submitted_at":"2026-05-01T01:13:50Z","title":"Fast Text-to-Audio Generation with One-Step Sampling via Energy-Scoring and Auxiliary Contextual Representation Distillation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-09T19:17:09.247932Z"},"links":{"cited_paper":"/paper/2505.07615","citing_paper":"/paper/2605.00329"},"observation_digest":"sha256:89b16a357406b880419cde905be17cf04477e419ecf8cc130e93fa9514563dad","observation_id":"359e4848-4225-4bdd-bacc-5d6ac371349e","resolution":{"observed_at":"2026-05-11T15:46:42.234377Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.07615/citation-record","integrity":"/paper/2505.07615/integrity","json":"/paper/2505.07615/citation-record.json","paper":"/paper/2505.07615"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:16:10.436571Z","title":"Deep learning for audio signal processing,","venue":null,"work_id":"ac4c0a64-fd75-405f-8528-167e5406ff1c","year":2019},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.553104Z"},"links":{"citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:d5398e9b93a09abec7e77cf08896ece3059971a57439a445f159d77923d0d625","observation_id":"413dd2b5-cc28-4cb8-901b-2db78ff1f062","resolution":{"observed_at":"2026-08-15T22:16:10.440833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:16:10.424998Z","title":"Dong, Generative AI for Music and Audio","venue":null,"work_id":"bafdf4ed-cd44-4580-8edf-aad503886c2e","year":2024},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.557954Z"},"links":{"citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:3aaddfc7e527cfd48edb9efeaddf79863c48cf6b4ab388bf668883e74ce3eefa","observation_id":"8337fe48-e9ae-41cc-971d-2e0a4c7710de","resolution":{"observed_at":"2026-08-15T22:16:10.428964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14340","last_updated":"2024-09-03T14:53:34Z","snapshot_observed_at":"2026-08-12T22:57:19.681507Z","submitted_at":"2024-08-26T15:13:14Z","title":"Foundation Models for Music: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14340","snapshot_observed_at":"2026-08-15T22:16:09.562425Z","title":"Foundation models for music: A survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.562425Z"},"links":{"cited_paper":"/paper/2408.14340","citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:734056de4b780af7b909b392eaca3837944f658d7dc1604c0b5cd81b5ac1258d","observation_id":"1116232f-c27e-4ad3-8a5b-6fe30c146e7d","resolution":{"observed_at":"2026-08-15T22:16:09.562425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.02621","last_updated":"2021-10-13T08:19:08Z","snapshot_observed_at":"2026-08-07T12:14:49.375943Z","submitted_at":"2021-07-06T13:52:27Z","title":"Energy Consumption of Deep Generative Audio Models","version":2},"cited_work":{"arxiv_id":"2107.02621","doi":null,"metadata_source":"pith","pith_arxiv_id":"2107.02621","snapshot_observed_at":"2026-08-15T22:16:10.069156Z","title":"Energy Consumption of Deep Generative Audio Models","venue":"cs.LG","work_id":"dd160643-dd46-4add-930e-352bad39a7e2","year":2021},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.567274Z"},"links":{"cited_paper":"/paper/2107.02621","citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:0b2ca4bfa0cd119a75dd4eab4709a5e39521f94a8e3de0b136540aab6d591b40","observation_id":"46bbd156-29c9-47d1-95b6-f4802c403513","resolution":{"observed_at":"2026-08-15T22:16:10.073471Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:16:10.412870Z","title":"Energy consumption trends in sound event detection systems,","venue":null,"work_id":"e910d68d-1cc1-4bd3-9470-3760fbb154ea","year":2025},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.571983Z"},"links":{"citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:af2cf943c9e417e50c3968cc6d592e3de2d05c92aa2e68975826171b1dc4feb2","observation_id":"33b25ae4-dc66-4752-82d8-48bfe0c9b059","resolution":{"observed_at":"2026-08-15T22:16:10.417138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.05558","last_updated":"2022-07-27T17:26:18Z","snapshot_observed_at":"2026-08-14T20:40:27.981488Z","submitted_at":"2020-07-10T18:26:17Z","title":"The Computational Limits of Deep Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.05558","snapshot_observed_at":"2026-08-15T22:16:09.575726Z","title":"The computational limits of deep learning,","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.575726Z"},"links":{"cited_paper":"/paper/2007.05558","citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:6d0408471a9f73a9d19ecf9f9f224f38d3202cbef6ed7f98b3aeebb87dcd8fb2","observation_id":"f980df40-5b46-4f89-ab5d-aed5157f20d1","resolution":{"observed_at":"2026-08-15T22:16:09.575726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:16:10.401344Z","title":"Green ai,","venue":null,"work_id":"549a1a91-7022-42b8-b914-da89d879ec04","year":2020},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.580198Z"},"links":{"citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:809cde60af07c97cc96cc306ea48dfc6945cad8ef3649224027c4531208985bf","observation_id":"e6f624a6-ed8e-4f77-bb45-4ff474f2a307","resolution":{"observed_at":"2026-08-15T22:16:10.405275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:16:10.390145Z","title":"Green mir?: Investigating computational cost of recent music-ai research in ismir,","venue":null,"work_id":"e0ff8bc1-688a-477b-aa66-352cc376e967","year":2024},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.583831Z"},"links":{"citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:cd8248c9a592c0b9e7151eb3e98d8b0777633a402af7632d55f6e78740de93d7","observation_id":"b8901c9e-124b-4f1e-b441-e020a0324f77","resolution":{"observed_at":"2026-08-15T22:16:10.394214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:16:10.379286Z","title":"Is quality enoughƒ integrating energy consumption in a large-scale evaluation of neural audio synthesis models,","venue":null,"work_id":"750c7507-3a5c-4721-af05-ae1f5773bf8c","year":2023},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.587837Z"},"links":{"citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:82a33601240f66202e056f6e3ac7418024b2e752779c333470155ab9e421f7fe","observation_id":"e845fb6c-1071-4d3f-aa06-ca04184f8cf8","resolution":{"observed_at":"2026-08-15T22:16:10.383205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:16:10.367680Z","title":"Performance above all? energy consumption vs. performance for machine listening, a study on dcase task 4 baseline,","venue":null,"work_id":"a72934b2-837c-4222-a1d9-3fb48ba09213","year":2023},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.591540Z"},"links":{"citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:16e32d89f2ac29c109d9456842d09c50ff4378b06200bec229c250b5fdd798d4","observation_id":"81b3bc8a-53f0-4139-a286-4656a7b09e15","resolution":{"observed_at":"2026-08-15T22:16:10.371699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:16:10.356338Z","title":"The energy and carbon footprint of training end-to-end speech recognizers,","venue":null,"work_id":"07c78ff9-b955-43ba-942f-420bbbc73c31","year":2021},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.595105Z"},"links":{"citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:0bf34cb9d456cdba8b2d63a933c4e7417a5fa0862ba1589b09cf32536494d237","observation_id":"e4865fd8-a9fb-4873-b60e-5539e2785de1","resolution":{"observed_at":"2026-08-15T22:16:10.360379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:16:10.345840Z","title":"Sustainability and the internet of sounds: Case studies,","venue":null,"work_id":"80a9741d-94ba-4d3a-a74d-a64a7b546214","year":2024},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.598898Z"},"links":{"citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:a093ae7d8d5e1df8e2ccae0bdd4624b908cb1e758c46334ee554d8110e3386f8","observation_id":"8482609e-d9e4-44c3-a9ed-068e8d226cca","resolution":{"observed_at":"2026-08-15T22:16:10.349346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:16:10.334808Z","title":"Monitoring environmental impact of dcase systems: Why and how?","venue":null,"work_id":"89557281-e987-4362-bdc5-a88cb78d5d90","year":2023},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.602682Z"},"links":{"citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:d63ba66da882b32717128f59b10077c8fa84ee70b75ecfb3bfe24b4a8013334c","observation_id":"74cf7e7d-0ee6-44f7-8a0a-109340559813","resolution":{"observed_at":"2026-08-15T22:16:10.338522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:16:10.322659Z","title":"Performance and energy balance: A comprehensive study of state-of-the-art sound event detection systems,","venue":null,"work_id":"80cd2572-7d91-4ccb-8f85-cd21e83265f2","year":2024},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.606189Z"},"links":{"citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:e285d4f6c8391992352ce4f219bc0680999e2306b27744ad5f6371d70423fa02","observation_id":"218bef91-6443-4f89-b2c6-32c6983f38d5","resolution":{"observed_at":"2026-08-15T22:16:10.327134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:16:10.310066Z","title":"Power hungry processing: Watts driving the cost of ai deployment?","venue":null,"work_id":"cf320ae6-a017-42c0-8ceb-dd9268dff6af","year":2024},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.609701Z"},"links":{"citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:f6a680b6f0732c9f49ab58cb07eb2de25d3bc7d5b04191a3c028bf50160357ab","observation_id":"a86bf122-030b-404d-b114-516dd5e78511","resolution":{"observed_at":"2026-08-15T22:16:10.314924Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:16:10.298558Z","title":"Diffusion models: A comprehensive survey of methods and applications,","venue":null,"work_id":"1c6ba83e-290d-4e84-958e-b28cfd887d02","year":2023},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.613736Z"},"links":{"citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:1786b2b448ba2c752aa821f1ba4533e8833911fdd2646cd5751056dbe59b09a8","observation_id":"3f1b210c-d1aa-42d3-9750-e76678652ce2","resolution":{"observed_at":"2026-08-15T22:16:10.302697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:16:10.286701Z","title":"The environmental impact of deep learning for audio,","venue":null,"work_id":"051c6253-1635-4701-ab8f-6e56ff74d6d4","year":2023},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.617082Z"},"links":{"citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:4e2b83c1c97eebe9ba48299ddd3838c361be7af1d5d3f6874f01a6a7ba617886","observation_id":"fb8c6376-645e-4807-b492-c0eb4d1cf77a","resolution":{"observed_at":"2026-08-15T22:16:10.291269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:16:10.274794Z","title":"AudioLDM: Text-to-audio generation with latent diffusion models,","venue":null,"work_id":"88eeccf1-8216-4433-933c-824b71d9d030","year":2023},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.620771Z"},"links":{"citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:b604bad0b8359662db9b9db828ac6b6b026c04dff8af7fef8bf26b7161bb0c77","observation_id":"125beb0e-23d8-4ec7-b11c-21b8cc1b361f","resolution":{"observed_at":"2026-08-15T22:16:10.279401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:16:10.263689Z","title":"Clap learning audio concepts from natural language supervision,","venue":null,"work_id":"70f7fe39-7405-4722-a284-c7bc55f32d65","year":2023},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.624881Z"},"links":{"citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:28624ba73ff4d33f6e35eb7a8b4b3bdb3c2d6ec9c43a084e0746832919095565","observation_id":"f4223a52-364a-4170-babb-84127d02e18e","resolution":{"observed_at":"2026-08-15T22:16:10.267831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:16:09.628487Z","title":"Audioldm 2: Learning holistic audio generation with self-supervised pretraining,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.628487Z"},"links":{"citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:27ac705c26b41689a83bb0f8795834725db88ef13835c80df1c72c587f5fbfec","observation_id":"8578b6b5-b7e5-4fd4-98d0-78acf407fe87","resolution":{"observed_at":"2026-08-15T22:16:09.628487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:16:10.250027Z","title":"Make-an-audio: text-to-audio generation with prompt- enhanced diffusion models,","venue":null,"work_id":"0dda98f0-59b3-47b0-b5e4-7cba975c702a","year":2023},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.632122Z"},"links":{"citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:d89944eb5eaf2e53b5119b77e7cc144a4c77fe6edfe11e453216184351f20ffb","observation_id":"76fd1a83-736a-4d92-9f8f-da1b7d46385a","resolution":{"observed_at":"2026-08-15T22:16:10.254958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18474","last_updated":"2023-05-29T10:41:28Z","snapshot_observed_at":"2026-08-13T11:30:24.178620Z","submitted_at":"2023-05-29T10:41:28Z","title":"Make-An-Audio 2: Temporal-Enhanced Text-to-Audio Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18474","snapshot_observed_at":"2026-08-15T22:16:09.635982Z","title":"Make-an-audio 2: Temporal-enhanced text-to-audio generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.635982Z"},"links":{"cited_paper":"/paper/2305.18474","citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:296b25f854636403acd768b668524188570b7fb20f1903113a6ea22674df277c","observation_id":"fd5c10e5-5a70-43b4-b176-ceb49a95b449","resolution":{"observed_at":"2026-08-15T22:16:09.635982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:16:09.640203Z","title":"Text-to- audio generation using instruction guided latent diffusion model,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.640203Z"},"links":{"citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:8e1efe5eeaaadbc4dec8316396d63c178ae4c66d2fa2cb69452a46966cc8b101","observation_id":"e5cfdbcd-87c0-4208-8883-4e9fab79eff2","resolution":{"observed_at":"2026-08-15T22:16:09.640203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:16:10.238884Z","title":"The flan collection: Designing data and methods for effective instruction tuning,","venue":null,"work_id":"4869ad5b-deb6-4fac-a2a8-16fea45c51c0","year":2023},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.643995Z"},"links":{"citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:5804cf483f03fd10174fbf106d018c198fee5d7137a5fc189d63e940e4cb3fb9","observation_id":"a723fe7c-45a8-4765-a4ed-e1e33ddff358","resolution":{"observed_at":"2026-08-15T22:16:10.242737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:16:10.227891Z","title":"Stable audio open,","venue":null,"work_id":"9cffd45d-a624-40ad-a740-cbb3fd749e2c","year":2025},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.647705Z"},"links":{"citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:70baf42b78116d83fa06e30ab3c4f528c6845765a2d4a84c7eb836678d69f5ba","observation_id":"48a1d4ba-62b3-413b-8705-16399f47793b","resolution":{"observed_at":"2026-08-15T22:16:10.231736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.03051","last_updated":"2020-07-06T20:24:31Z","snapshot_observed_at":"2026-08-14T13:11:27.922295Z","submitted_at":"2020-07-06T20:24:31Z","title":"Carbontracker: Tracking and Predicting the Carbon Footprint of Training Deep Learning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.03051","snapshot_observed_at":"2026-08-15T22:16:09.651674Z","title":"Carbontracker: Tracking and predicting the carbon footprint of training deep learning models,","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.651674Z"},"links":{"cited_paper":"/paper/2007.03051","citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:0c36cbb8e8af1c96cea93367e31f7fbda661f098e728c88bf6bbb46457cf38c1","observation_id":"a0eb88be-afc9-458f-955e-4d2c5bf49262","resolution":{"observed_at":"2026-08-15T22:16:09.651674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:16:10.215683Z","title":"Deepspeed: System optimizations enable training deep learning models with over 100 billion parameters,","venue":null,"work_id":"ac3f1aa1-e86f-4602-88fb-86514e2cf6cd","year":2020},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.655736Z"},"links":{"citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:53db3ceb716064d3b1b2574cd217587a767925b72d712fb13bff153dd4142061","observation_id":"5a1b06de-9683-43fd-8f3e-6581a17cf621","resolution":{"observed_at":"2026-08-15T22:16:10.220486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:16:10.203654Z","title":"Codecarbon: estimate and track carbon emissions from machine learning computing,","venue":null,"work_id":"0cc5c29a-1ac2-41fd-a778-615263a9a5a4","year":2021},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.660051Z"},"links":{"citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:5f88fb5cda829ef287c1ccf09e43e48060dd6686cca554c24498d5d2dc070e2f","observation_id":"324be616-4ab1-4a36-821d-7f3cbd103f43","resolution":{"observed_at":"2026-08-15T22:16:10.207645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:16:10.192102Z","title":"Thop: Pytorch-opcounter,","venue":null,"work_id":"50ce9361-7d49-4cd0-ae94-b77fab3236d8","year":2019},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.663836Z"},"links":{"citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:60614d3db7bb5ff41df737760a2cf68d0d07bd23ac8254c862a6d3a0537c3a0f","observation_id":"4bd33e05-060a-488c-ac28-9f6d030d6d99","resolution":{"observed_at":"2026-08-15T22:16:10.196068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:16:09.667622Z","title":"mlco2/codecarbon: v2.4.1,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.667622Z"},"links":{"citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:787dd050033b84a59c428ed854056d6b4752f501c496eba1f7d1552c6919238d","observation_id":"758f37ab-30a8-4010-af32-2c76c82b6c2b","resolution":{"observed_at":"2026-08-15T22:16:09.667622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05080","last_updated":"2024-09-08T12:51:34Z","snapshot_observed_at":"2026-08-12T22:49:11.783139Z","submitted_at":"2024-09-08T12:51:34Z","title":"From Computation to Consumption: Exploring the Compute-Energy Link for Training and Testing Neural Networks for SED Systems","version":1},"cited_work":{"arxiv_id":"2409.05080","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.05080","snapshot_observed_at":"2026-08-15T22:16:09.904648Z","title":"From Computation to Consumption: Exploring the Compute-Energy Link for Training and Testing Neural Networks for SED Systems","venue":"cs.LG","work_id":"05a93f40-6fe1-41e0-b367-c316a02cd597","year":2024},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.671503Z"},"links":{"cited_paper":"/paper/2409.05080","citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:92463aa8233fe21f719746b29f35c25c4b8b1c717725784396b29ebe3c076a24","observation_id":"77b29389-29c4-4867-b0a5-9248d138132f","resolution":{"observed_at":"2026-08-15T22:16:09.910916Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.08466","last_updated":"2019-01-17T16:12:43Z","snapshot_observed_at":"2026-08-15T08:25:11.276003Z","submitted_at":"2018-12-20T10:28:00Z","title":"Fr\\'echet Audio Distance: A Metric for Evaluating Music Enhancement Algorithms","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.08466","snapshot_observed_at":"2026-08-15T22:16:09.675241Z","title":"Fr \\’echet audio distance: A metric for evaluating music enhancement algorithms,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.675241Z"},"links":{"cited_paper":"/paper/1812.08466","citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:67ba97906fb47f4dc5207baf01ee77f7c7f7ab90601b634bd6a75e84cff06cc3","observation_id":"a8646e04-4d0b-4650-9f45-7559c1ee3342","resolution":{"observed_at":"2026-08-15T22:16:09.675241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:16:10.180112Z","title":"Audiocaps: Generating captions for audios in the wild,","venue":null,"work_id":"37c747d9-0495-46c2-8d54-005a7b8f4f34","year":2019},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.679117Z"},"links":{"citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:4cea15d4df5f7fa74a4199690fe796498dfd8b7f0a40efc90d4196c9d43032ff","observation_id":"0b3a28a3-98a8-4cff-8897-dd7480f9f565","resolution":{"observed_at":"2026-08-15T22:16:10.184030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:16:10.168488Z","title":"Clotho: An audio captioning dataset,","venue":null,"work_id":"695fcc63-4f45-46ec-a445-3856f4736abb","year":2020},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.682780Z"},"links":{"citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:72820f18cc2f3aca9e141082b162b8b5b2cdf401355b880980b6ec98d87afb4d","observation_id":"98ed7657-0942-4c03-89c7-383fbc1ae2d6","resolution":{"observed_at":"2026-08-15T22:16:10.172487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:16:10.156488Z","title":"Audio set: An ontology and human- labeled dataset for audio events,","venue":null,"work_id":"0bff551b-b05d-4e69-8da6-00762d62140c","year":2017},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.686259Z"},"links":{"citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:b2ea331c722084fea6eda91cd598d55dfb746ecbab4c37819e7dd2b2bbe3d387","observation_id":"043c48a4-511f-4fe8-9292-ff1fd8fce3f2","resolution":{"observed_at":"2026-08-15T22:16:10.160642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:16:10.143155Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium,","venue":null,"work_id":"51b6f99e-c13c-4c21-847f-507e84171ab5","year":2017},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.690046Z"},"links":{"citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:3d77bfbe48a13021426e00c423e704e2a4c7235a42e92f400f3684634f123b0c","observation_id":"b18fe42d-d41d-4784-8813-815ce248c421","resolution":{"observed_at":"2026-08-15T22:16:10.147720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:16:10.131634Z","title":"Fr \\’echet audio distance: A reference-free metric for evaluating music enhancement algorithms,","venue":null,"work_id":"9418456a-77fa-4627-874e-b51a01bf1320","year":2019},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.694347Z"},"links":{"citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:bec6ca2618a65e028c5bc6640e95292704d3f83edb3e8e534897422512239a9a","observation_id":"72c0b2c6-a7a0-4baf-b4b3-5189522f2113","resolution":{"observed_at":"2026-08-15T22:16:10.135891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01616","last_updated":"2024-03-05T22:14:14Z","snapshot_observed_at":"2026-08-13T05:33:48.213366Z","submitted_at":"2023-11-02T21:58:55Z","title":"Adapting Frechet Audio Distance for Generative Music Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.01616","snapshot_observed_at":"2026-08-15T22:16:09.698545Z","title":"Adapting frechet audio distance for generative music evaluation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.698545Z"},"links":{"cited_paper":"/paper/2311.01616","citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:1c1fce33b4889799d2f03cd19761b1689c488857c9f967357071182ec7e155a4","observation_id":"29a61848-82e1-4963-bd31-f2584e3dec79","resolution":{"observed_at":"2026-08-15T22:16:09.698545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:16:10.119517Z","title":"Stable audio metrics toolkit,","venue":null,"work_id":"525e568a-f067-461b-89fa-27d724d5f642","year":2024},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.702172Z"},"links":{"citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:3e1ba996a5af3b209ba53359d3fd10f26621e8a1bcff5abba92314c539b1c647","observation_id":"90e31b2c-88e0-481f-a972-5370b26d16d4","resolution":{"observed_at":"2026-08-15T22:16:10.123765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:16:09.705441Z","title":"Paguri: a user experience study of creative interaction with text-to-music models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.705441Z"},"links":{"citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:7d1c49d8417c8ac343d77e6feabe6c0ca3977a8b56f8cbcb5b4c0c85e2bc3170","observation_id":"d4c4684d-a7dc-4367-9f48-8d6bb578f9d5","resolution":{"observed_at":"2026-08-15T22:16:09.705441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:16:10.106779Z","title":"Sound designer-generative ai interactions: Towards designing creative support tools for professional sound designers,","venue":null,"work_id":"a95ab874-0317-4097-a43c-cf591d8628ab","year":2024},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.709578Z"},"links":{"citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:4d59be378175086f5ab0d71f5b02c36cdf3ab3a6887b5bce744ffcb68900ca93","observation_id":"08dc588a-4210-40a7-9234-e80e431a5ce2","resolution":{"observed_at":"2026-08-15T22:16:10.111405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:16:10.094908Z","title":"Freesound datasets: A platform for the creation of open audio datasets","venue":null,"work_id":"6a32e56d-3029-48c0-9951-2d67f216643e","year":2017},"citing_paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T22:16:09.713863Z"},"links":{"citing_paper":"/paper/2505.07615"},"observation_digest":"sha256:fe6e9c0be4da1991e89b67066284c88aa5f2c03f04fe34f8238f7443be2c00b2","observation_id":"af9f40e7-a5d3-4774-b463-53e3999a3688","resolution":{"observed_at":"2026-08-15T22:16:10.099000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.07615","last_updated":"2025-07-16T17:59:28Z","latest_version":2,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-15T22:09:49.479566Z","submitted_at":"2025-05-12T14:36:47Z","title":"Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":2,"verified_fuzzy":30},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 1 inbound Pith citation observation for arXiv:2505.07615."}