{"as_of":"2026-08-21T01:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7c0020c39bef3fd3482652c9e956f5742965902d2878f7bffc95ff9c96f3d6b6","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T13:16:08.858565Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.00813/citation-record","integrity":"/paper/2509.00813/integrity","json":"/paper/2509.00813/citation-record.json","paper":"/paper/2509.00813"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1609.03499","last_updated":"2016-09-19T18:04:35Z","snapshot_observed_at":"2026-08-16T05:39:41.727705Z","submitted_at":"2016-09-12T17:29:40Z","title":"WaveNet: A Generative Model for Raw Audio","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.03499","snapshot_observed_at":"2026-08-05T13:16:07.662863Z","title":"van den Oord, S","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:07.662863Z"},"links":{"cited_paper":"/paper/1609.03499","citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:fde5402bd801f88ce41735ab01fb33f6a2754be65d30d7a63e90d6e45b0aeb2e","observation_id":"dce7a801-4223-499f-8457-887babd9e6c8","resolution":{"observed_at":"2026-08-05T13:16:07.662863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.04281","last_updated":"2018-12-12T07:42:08Z","snapshot_observed_at":"2026-08-14T18:29:37.094691Z","submitted_at":"2018-09-12T07:15:26Z","title":"Music Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.04281","snapshot_observed_at":"2026-08-05T13:16:07.749366Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:07.749366Z"},"links":{"cited_paper":"/paper/1809.04281","citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:032541d9cf5bf5e3d214e03d87dfe59e3a1493687c759523b322c2310bde7ea6","observation_id":"66025463-71e7-4db2-93c2-a3e1326619b1","resolution":{"observed_at":"2026-08-05T13:16:07.749366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.221694Z","title":"Huang, Y.-H","venue":null,"work_id":"c2d4edf5-aa01-4db5-a160-f177d0d6f80c","year":2020},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:07.786965Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:2c1895e6a387919bfb311b546cb9d6bf3bddb9e8e68b4f7b9850a7f35c0369f7","observation_id":"5d32332a-18e1-4461-bf36-0c3b71fd8ffb","resolution":{"observed_at":"2026-08-05T13:16:09.223961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.214478Z","title":"Roberts, J","venue":null,"work_id":"0ef1cf09-fc2f-4c6c-86bb-ee75c0394ff3","year":2018},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:07.820137Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:1fd379b7062c41f66b9060a1b222e56af7a36b01555c8e40ccbb2feec8a457b6","observation_id":"84ae5698-c2f1-400a-a152-d84192c7dc54","resolution":{"observed_at":"2026-08-05T13:16:09.217109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.207121Z","title":"Payne, Musenet, https://openai.com/blog/musenet, 2019","venue":null,"work_id":"d6bc4f24-9686-48c0-84db-198a41b84935","year":2019},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:07.924616Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:abfb151b5f67848eba06a58209889527c05cf9e090d27b7386e9a1f349a35cc5","observation_id":"a74899b1-797e-4c60-b04d-c4620e0497d6","resolution":{"observed_at":"2026-08-05T13:16:09.209829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.00341","last_updated":"2020-04-30T09:02:45Z","snapshot_observed_at":"2026-08-16T07:26:47.621702Z","submitted_at":"2020-04-30T09:02:45Z","title":"Jukebox: A Generative Model for Music","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.00341","snapshot_observed_at":"2026-08-05T13:16:08.021311Z","title":"Dhariwal, H","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.021311Z"},"links":{"cited_paper":"/paper/2005.00341","citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:4651cc587a43f7070ad2580088934db3b7f300ab96d6f54bbb2906a9c09300b9","observation_id":"dfdf4b5e-4822-46f8-a8a3-161b5d05ddd1","resolution":{"observed_at":"2026-08-05T13:16:08.021311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.11325","last_updated":"2023-01-26T18:58:53Z","snapshot_observed_at":"2026-08-20T13:40:28.954978Z","submitted_at":"2023-01-26T18:58:53Z","title":"MusicLM: Generating Music From Text","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.11325","snapshot_observed_at":"2026-08-05T13:16:08.078687Z","title":"Agostinelli, T","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.078687Z"},"links":{"cited_paper":"/paper/2301.11325","citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:e874e4c087bb041afb63424e8bb2241d289e69207a195706f9d862933392abf9","observation_id":"b301ec21-0bcd-4b2b-8bf8-7fd26685ef31","resolution":{"observed_at":"2026-08-05T13:16:08.078687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.199264Z","title":"Grötschla, A","venue":null,"work_id":"172cb6c1-0bff-4503-85a7-fe8fcb760caa","year":2025},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.126387Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:2fdf366c9577ffad4a94ba0055ae1b9b36e128e9135749955df5f8b626003fa5","observation_id":"9d653753-1f83-4025-a96a-f7277427a59b","resolution":{"observed_at":"2026-08-05T13:16:09.201941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.191734Z","title":null,"venue":null,"work_id":"920b0fef-8a52-486b-a338-85a0467e949b","year":2025},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.216294Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:3f9f3aeea58d37fe55273af28412127565a13c83e73a29b1654d6d1fce023095","observation_id":"9cb4a3b5-4131-4f37-b156-910305ccc14e","resolution":{"observed_at":"2026-08-05T13:16:09.194279Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16669","last_updated":"2025-03-20T19:31:04Z","snapshot_observed_at":"2026-08-18T12:36:37.103529Z","submitted_at":"2025-03-20T19:31:04Z","title":"Aligning Text-to-Music Evaluation with Human Preferences","version":1},"cited_work":{"arxiv_id":"2503.16669","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.16669","snapshot_observed_at":"2026-08-05T13:16:08.968653Z","title":"Aligning Text-to-Music Evaluation with Human Preferences","venue":"cs.SD","work_id":"8c1696e4-4754-4fdb-8fd1-8c83c32768b3","year":2025},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.259508Z"},"links":{"cited_paper":"/paper/2503.16669","citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:fddf8b76e500d452e1f69e566dd00d37bbaaba16a35636e7fbeec89d98890dd7","observation_id":"0737ab32-876b-4bb6-9049-3c1c7d0db3b0","resolution":{"observed_at":"2026-08-05T13:16:08.972483Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.01374","last_updated":"2021-08-03T08:59:26Z","snapshot_observed_at":"2026-08-16T18:05:37.392596Z","submitted_at":"2021-08-03T08:59:26Z","title":"EMOPIA: A Multi-Modal Pop Piano Dataset For Emotion Recognition and Emotion-based Music Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.01374","snapshot_observed_at":"2026-08-05T13:16:08.364068Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.364068Z"},"links":{"cited_paper":"/paper/2108.01374","citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:79e782a9326d2a60f62ab56097129303d2b80f39105b2403c3c95871fe5a4104","observation_id":"e056615a-1185-4b68-ba76-55803c85e0ec","resolution":{"observed_at":"2026-08-05T13:16:08.364068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.183788Z","title":null,"venue":null,"work_id":"33e7a0ab-ac57-4b5c-870f-dbc8129ebb6f","year":2019},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.425536Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:e28b98c4598483b045647857e0f0f46da60e08fd5005ebdc1be5f5a7045b6938","observation_id":"b7e52106-b9b5-45c8-8c64-5426ab69d5e2","resolution":{"observed_at":"2026-08-05T13:16:09.186613Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.176617Z","title":"Grekow, T","venue":null,"work_id":"f9a0ffc3-744e-471f-98e7-83796e431065","year":2021},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.553123Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:2e28fe3fd8420d1088cf3d15886f33e9759bbd5625ab0e49902fc4e61b4ddabd","observation_id":"270adc86-de4e-4202-9782-deeb0d2b2e7c","resolution":{"observed_at":"2026-08-05T13:16:09.179014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.169323Z","title":"Sulun, M","venue":null,"work_id":"f8b3e4ce-f1fc-4603-9a2c-15c9e1f6b3c5","year":2022},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.623991Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:a06c9e921c8f01b8fb06bff7118185987e868860f2eb4f83be6d1de145bb6753","observation_id":"30bbace2-6c48-4ad2-b24e-5677355dd27d","resolution":{"observed_at":"2026-08-05T13:16:09.172091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.162244Z","title":"Huang, K","venue":null,"work_id":"09074494-a365-41e7-b3e5-550e7ebea9d6","year":2024},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.713555Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:09cf379cb0fa8a6a781ee2cb2056ddcd089f4f69ae4712d1211c6f10ef65fc19","observation_id":"e70d3262-baa5-484b-8d1b-7ea2d1b1cb5e","resolution":{"observed_at":"2026-08-05T13:16:09.164631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.155005Z","title":"Turnbull, L","venue":null,"work_id":"92b7946c-0d08-4c3a-a2b4-1e0717c83a6d","year":2007},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.757141Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:d7a76731d57cc54632ef6f8d45d9389200ad60f22bb4ea30833c0f1a25855eb8","observation_id":"83c8525f-0dc8-4b74-8d3e-a5f276e48b61","resolution":{"observed_at":"2026-08-05T13:16:09.157417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.147898Z","title":"Wang, J.-C","venue":null,"work_id":"7c4983b3-c93e-42b2-b164-2388fdb6e6c1","year":2014},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.807734Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:8bfeb4a3fcad510820676cdf86a1c7b25d26b83d9a2b9f6498585306101b6e41","observation_id":"3b9916d1-a240-4103-a597-d8ddcb538166","resolution":{"observed_at":"2026-08-05T13:16:09.150589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.140942Z","title":null,"venue":null,"work_id":"1ccaac17-68c5-417a-bde7-22464144436b","year":2022},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.810737Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:bf86f59c91dc2d357e13bb642f2f760ca507b563d5eeda57961c57556165eb8b","observation_id":"c06411c7-ffea-4191-a4a8-b56c9f169d50","resolution":{"observed_at":"2026-08-05T13:16:09.143282Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.133177Z","title":"Soleymani, M","venue":null,"work_id":"9567d192-95ad-42c9-9fc8-784d2b03eaae","year":2013},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.813455Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:0dbcf8d74a4d86249c1fb1bbf7735201ba384c290895090d81c41965b90cdb47","observation_id":"1dc75f50-1efc-4ee7-bc91-e1ca8f18d7c0","resolution":{"observed_at":"2026-08-05T13:16:09.135728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.124887Z","title":"Aljanaki, Y.-H","venue":null,"work_id":"1e9f48f1-1dee-4474-a7e2-2be309683cc0","year":2017},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.816318Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:f21130bffdf41ec18baa8c44a45d003cae86d5b5be7cfaed4b8c3866b14be32d","observation_id":"6c249976-eb64-4417-bed8-dfdf1e86fd5b","resolution":{"observed_at":"2026-08-05T13:16:09.127649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.117634Z","title":null,"venue":null,"work_id":"06b7021f-7b0f-4fc4-89b5-430361461c6d","year":2011},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.818842Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:c6dd45d1a3368972440562f1112f0b4cade3bf29c320a5efd5e4b23d2b1631f6","observation_id":"da07a324-6c7a-422f-94bc-ff3d84dae403","resolution":{"observed_at":"2026-08-05T13:16:09.120306Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.09539","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:08.947011Z","title":null,"venue":null,"work_id":"279f5347-04e4-407e-a587-8c412c06cde4","year":2025},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.821221Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:69afb7bd6ec8e9a8b5acfae8538532fe7a50ed354192bcd26f2d8a45b8e74caa","observation_id":"03ed0fba-a768-4f20-8201-d4d01fca0255","resolution":{"observed_at":"2026-08-05T13:16:08.951935Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.109707Z","title":null,"venue":null,"work_id":"c9b49de2-5502-46b3-8f03-610a28a28d89","year":2024},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.823701Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:d6187787f8b97eaedd5aec092700deec55f71d5fd2c37305d45755f51116b9fd","observation_id":"e381a360-5c7a-4a1b-af75-7dc2ac668da2","resolution":{"observed_at":"2026-08-05T13:16:09.112343Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.101902Z","title":null,"venue":null,"work_id":"3b98c487-40e0-429c-8473-b11542465802","year":1980},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.826118Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:7916771471385d8c732041e9180d4f886d73b46f11e18b909d96f78d0bb01e8f","observation_id":"951b0df7-f6e1-44fa-9709-ed1e19133a4f","resolution":{"observed_at":"2026-08-05T13:16:09.104439Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.094021Z","title":null,"venue":null,"work_id":"a6310ca5-a124-4a7c-82fd-2d2a944291f7","year":2011},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.828592Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:8f2805c153032107111f4edfaeb24c7e8377d722ecf4da3b00b78f9a4762fc89","observation_id":"20261feb-7d76-47e2-89e6-613ea2439dae","resolution":{"observed_at":"2026-08-05T13:16:09.096510Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.085949Z","title":null,"venue":null,"work_id":"1fa875bd-cb35-4001-99ee-09bbeaf95d10","year":2013},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.831316Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:ea87bf07494918a2f08285978d8ca2970c7a6a6f62adf5ed3494357e675704f2","observation_id":"286416a5-e8de-434a-a3a2-d868f109e49f","resolution":{"observed_at":"2026-08-05T13:16:09.088596Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.077786Z","title":null,"venue":null,"work_id":"418216e9-b1f6-4d96-b659-e4cc9ce234c5","year":1999},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.833619Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:a7fa51874394ded8094a0a1471b664217ddf651e9b10130db5a9f58ede32c61d","observation_id":"9cb1704d-0205-452a-953f-4ac30d56fb62","resolution":{"observed_at":"2026-08-05T13:16:09.080712Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.069516Z","title":null,"venue":null,"work_id":"e52922d5-b347-4063-9e05-7205d04c393e","year":2024},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.835995Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:6e653bc263e9150b9b28b18ccba31bfc6a8eaaf109b0f8b8ec928f1e57fd8f14","observation_id":"21770780-f01b-4927-8881-3c8317e9b653","resolution":{"observed_at":"2026-08-05T13:16:09.072360Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.061371Z","title":"Copet, F","venue":null,"work_id":"e9c5e1c8-54c5-44d7-96d1-6506be783d3b","year":2023},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.838708Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:c9a553948932f7146a5a1d1f8acfd8a8d43dc2eb6c8f2dff195a74f18727fdcf","observation_id":"d51ae088-b847-4f39-b858-c03e5d29b593","resolution":{"observed_at":"2026-08-05T13:16:09.064089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08355","last_updated":"2024-06-03T07:56:23Z","snapshot_observed_at":"2026-08-16T14:43:20.569125Z","submitted_at":"2023-11-14T17:54:38Z","title":"Mustango: Toward Controllable Text-to-Music Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.08355","snapshot_observed_at":"2026-08-05T13:16:08.841052Z","title":"Melechovsky, Z","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.841052Z"},"links":{"cited_paper":"/paper/2311.08355","citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:c3f1e6d3d78453aa1d5923ff87d357740db01479c9da05ff9dbd0c21c9d489ea","observation_id":"afb0178d-35fc-47ae-b92f-6849f77c9448","resolution":{"observed_at":"2026-08-05T13:16:08.841052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.052753Z","title":"Evans, J","venue":null,"work_id":"7104d944-c660-42b7-b70f-c595cfb2eec0","year":2025},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.843649Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:39514e638c1a04375b5902afa976a412fa20200bb87ce1128373afdbedcbe230","observation_id":"2b320efe-4c96-410f-b6b5-52c9a214f87c","resolution":{"observed_at":"2026-08-05T13:16:09.055641Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.044519Z","title":"Accessed: May-June, 2025","venue":null,"work_id":"3ede7117-df04-4ff4-98ca-c4162fee3fde","year":2024},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.846119Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:36335508dd3951de8a9d2084623f6fbb314114e9961f10136b9ae1cb45cd54f9","observation_id":"09912939-9ffe-430e-9714-e30650dec180","resolution":{"observed_at":"2026-08-05T13:16:09.047376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.036123Z","title":"Accessed: May-June, 2025","venue":null,"work_id":"e2d55e8e-4a06-45e5-91c3-0facde64aca1","year":2024},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.848563Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:55f52aaadd9685e9dcaa0e07f32b8d7f33b4f2ef1c5df20e5c77aafb036f821e","observation_id":"a5064977-f3df-4845-a37d-3a68586e259e","resolution":{"observed_at":"2026-08-05T13:16:09.039052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:08.851290Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.851290Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:0d421e78165941fe0dd53b7498965d0d2211bfe3b97b52cf929f2b71b0151894","observation_id":"76b5642a-c6ab-4367-a7b3-76472c74ae5f","resolution":{"observed_at":"2026-08-05T13:16:08.851290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:08.853568Z","title":"Vaswani, N","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.853568Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:7a02fa682c4087b5da3c276afa1af0ba844c3f08da88f4f9e72a146db4ca434b","observation_id":"e42063d0-f024-4d67-9b1d-c7d281b09464","resolution":{"observed_at":"2026-08-05T13:16:08.853568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.017896Z","title":null,"venue":null,"work_id":"8e1a8d8e-8b41-4bc3-bf3f-d19e02916c7b","year":2024},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.856088Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:f09c8651bd8bc6e0410b90d27a7814cc5ad14892964f22c31d7595493ea7ae19","observation_id":"804a7458-b9d5-4c23-8da7-c3c4b3ecd1f0","resolution":{"observed_at":"2026-08-05T13:16:09.020451Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.009216Z","title":null,"venue":null,"work_id":"4bd46546-3e87-413b-9316-7271a4acbf9a","year":2023},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.858565Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:a1b6a617ac2dcf184c0d42fc59c172058eb4f4bab10244c31ac8ebc28f9da750","observation_id":"ca7958ef-85a5-4050-a16f-4998245fa4f5","resolution":{"observed_at":"2026-08-05T13:16:09.011878Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","latest_version":2,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-19T05:52:11.975411Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":20,"verified_exact":2,"verified_fuzzy":15},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 0 inbound Pith citation observations for arXiv:2509.00813."}