{"as_of":"2026-08-16T06:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1ba75b23912903d5aabc885d55571f9cf0305e0486c58735cb350704f4ef1dc8","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T04:29:55.471193Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T04:29:54.869853Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-14T04:29:56.530380Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"cited_work":{"arxiv_id":"2608.08757","doi":null,"metadata_source":"pith","pith_arxiv_id":"2608.08757","snapshot_observed_at":"2026-08-14T04:29:56.530380Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","venue":"cs.SD","work_id":"8b8475c7-b217-4d26-adbb-962c76c43dc4","year":2026},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:54.869853Z"},"links":{"cited_paper":"/paper/2608.08757","citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:69e9240f69f5751228db46172c5a6ac19120ebf7efdb290daae796d03475d907","observation_id":"43e98c51-84ce-445b-90a6-2187d66a315a","resolution":{"observed_at":"2026-08-14T04:29:56.545267Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2608.08757/citation-record","integrity":"/paper/2608.08757/integrity","json":"/paper/2608.08757/citation-record.json","paper":"/paper/2608.08757"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"cited_work":{"arxiv_id":"2608.08757","doi":null,"metadata_source":"pith","pith_arxiv_id":"2608.08757","snapshot_observed_at":"2026-08-14T04:29:56.530380Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","venue":"cs.SD","work_id":"8b8475c7-b217-4d26-adbb-962c76c43dc4","year":2026},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:54.869853Z"},"links":{"cited_paper":"/paper/2608.08757","citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:69e9240f69f5751228db46172c5a6ac19120ebf7efdb290daae796d03475d907","observation_id":"43e98c51-84ce-445b-90a6-2187d66a315a","resolution":{"observed_at":"2026-08-14T04:29:56.545267Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:58.136593Z","title":null,"venue":null,"work_id":"1729a65b-9040-4af8-8420-bb8cfa18b6c1","year":null},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:54.881972Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:7d6cc75ce5106e20f66b9522db7f7077776463b55fa124c62ecb6be34b9f883a","observation_id":"3d82224f-d404-4d9d-b143-619ab3218138","resolution":{"observed_at":"2026-08-14T04:29:58.148620Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:58.113727Z","title":"Audio clips are encoded with the audio towers fA of CLAP [28] and MuQ [33]; from each 10-second frame we extract an embeddingz a ∈R 512","venue":null,"work_id":"d8ba96f5-3d0e-44a7-bd58-4113800a9ee1","year":null},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:54.888625Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:9f48dbc6352397ac733b45e8c1e922e3d48ef6309d4549ba6f28a34d8ef8e286","observation_id":"2d4fc4f5-3b0e-49bf-8ed8-4bee2ceee47b","resolution":{"observed_at":"2026-08-14T04:29:58.119590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:58.087016Z","title":"piano”.Starting from an audio embeddingz, we navigate on the hypersphere by amplifying the concept “piano","venue":null,"work_id":"80f1d5bc-e45a-47a3-9678-221c8ffddac3","year":null},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:54.898864Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:9be1f5ef886ae46b74b6da7af18eed6260d504eac2fb0def9334519d7f0384f1","observation_id":"0374edb9-3e0b-41d1-bf85-6e6ae0bba63f","resolution":{"observed_at":"2026-08-14T04:29:58.093485Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:58.069372Z","title":"I want similar songs without the guitar","venue":null,"work_id":"dcb8c155-d04d-438f-b4c6-c00de560e499","year":null},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:54.905285Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:de335f4c0f3bbda03244c1ec34665f0c6d8e7daf243be4841b7b41783d75802c","observation_id":"0c330b2d-9fdf-4bb1-8a04-0ea64771a433","resolution":{"observed_at":"2026-08-14T04:29:58.075916Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:58.048684Z","title":null,"venue":null,"work_id":"985a3ae2-bed6-4598-8f03-3d1d168ab564","year":null},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:54.940449Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:1a3dcf3bee4bdacfc7acb7f81768d43299c0ce501b91ce9f41e98ca6be4592a7","observation_id":"6b419c32-56fb-4de1-ba56-c689f7de66f9","resolution":{"observed_at":"2026-08-14T04:29:58.056825Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:58.012552Z","title":null,"venue":null,"work_id":"b63bf47c-e01f-4649-b3ab-8f0b7fc92ddd","year":null},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:54.956887Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:a1fdfa5143cdb5438e2a9e56265ee8920ecbd96945c4ead183e4139745681d07","observation_id":"b8d86907-d1ab-4633-9679-1d2b6eee2074","resolution":{"observed_at":"2026-08-14T04:29:58.019397Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:57.988453Z","title":"AI assistance was also used sparingly in writing this paper to tighten phrasing, reword for conci- sion, and smooth out mathematical notation consistency","venue":null,"work_id":"14ed0404-98e1-45b4-94a9-0344582dc45c","year":null},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:54.963187Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:f924c3815049c23dde202aabad5d6aece97fea754459247ec19ee6ceffe4e75b","observation_id":"4ea433af-ca36-4b7c-ab77-a98d9f88076c","resolution":{"observed_at":"2026-08-14T04:29:57.995059Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14435","last_updated":"2024-08-01T17:42:04Z","snapshot_observed_at":"2026-08-08T18:10:15.134088Z","submitted_at":"2024-07-19T16:07:19Z","title":"Jumping Ahead: Improving Reconstruction Fidelity with JumpReLU Sparse Autoencoders","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14435","snapshot_observed_at":"2026-08-14T04:29:54.968718Z","title":"Jumping ahead: Improving reconstruction fidelity with jumprelu sparse autoencoders,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:54.968718Z"},"links":{"cited_paper":"/paper/2407.14435","citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:4376bbcef872fe1fb4566d91fc5d9a3a8e12d54472bb98ac1e847bc424cd7ad8","observation_id":"fb6daf74-d417-4f72-b507-475b6ae0b98b","resolution":{"observed_at":"2026-08-14T04:29:54.968718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:57.963461Z","title":"Batchtopk sparse autoencoders,","venue":null,"work_id":"848be45b-3ba2-46bb-9cfc-dcf88c4913c2","year":2024},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:54.973585Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:77915015dafde41d86c40d22acd9a982210d6eb5e23871175896b88746a94c4c","observation_id":"ede3c7ac-c22b-4506-a03a-9a08f92965df","resolution":{"observed_at":"2026-08-14T04:29:57.973879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:57.899669Z","title":"Learning multi-level features with ma- tryoshka sparse autoencoders,","venue":null,"work_id":"e512f714-ee73-42eb-bcd7-e0cd1dc46017","year":2025},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:54.978773Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:0054b8de8912128308d1da1c4c5cc43d7b3361bab9b125fa7d626558eba71f7c","observation_id":"91e0ef97-772f-48d1-b173-6993f62e3d3a","resolution":{"observed_at":"2026-08-14T04:29:57.924437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:57.827339Z","title":"From flat to hierarchical: Extracting sparse representations with matching pursuit,","venue":null,"work_id":"ff4d40ea-7fec-45fd-a35a-bf3f5c5a9876","year":2025},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:54.986395Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:9245f69c8f3900894f6ce728c18a615bb6cc0686485373aea5810d468cf17e58","observation_id":"2837e108-d8e9-4387-a783-f7aa8a254f32","resolution":{"observed_at":"2026-08-14T04:29:57.845378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:57.794438Z","title":"Scal- ing and evaluating sparse autoencoders,","venue":null,"work_id":"0fa9647c-3f0b-4b8e-822d-3b4e569654eb","year":2024},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:54.994808Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:e584daa8b273c041cfc68c509eafdd3de2d9b4f3df4938c6a5385fdcf8e42454","observation_id":"fbae0c3c-d0f6-49a2-aeef-fbbd30918f69","resolution":{"observed_at":"2026-08-14T04:29:57.811516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:57.770686Z","title":"Gemma scope: Open sparse autoen- coders everywhere all at once on gemma 2,","venue":null,"work_id":"8c03a7e2-f675-4d86-a8c5-86178c9bced8","year":2024},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:55.009210Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:daf60018f610bd1ebe3b29f27e26d75dd75034b861957b395d8a30ac1e055e04","observation_id":"7923a380-b829-4a1a-8f66-98e6cd99bed2","resolution":{"observed_at":"2026-08-14T04:29:57.778546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:55.020537Z","title":"Sparse autoencoders learn monosemantic features in vision-language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:55.020537Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:b02476471811027579f6b46e6b44ac2db22427c0ee8f07261eedd33d37ac620f","observation_id":"73e33e3c-f325-466f-8cf5-7f9e2eed8608","resolution":{"observed_at":"2026-08-14T04:29:55.020537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:57.727470Z","title":"Interpreting clip with hierarchical sparse autoencoders,","venue":null,"work_id":"b8c338b3-6acd-4bf4-8d78-52f1814ac46d","year":2025},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:55.026680Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:ca0afa702843fb72477aa96f1eda4e24e37ddc0ec65df03f4493c2bc5d49ec8a","observation_id":"f4836c59-a028-439d-bc0c-9736ae4d75ef","resolution":{"observed_at":"2026-08-14T04:29:57.746076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:57.701265Z","title":"Eval- uating sparse autoencoders for controlling open-ended text generation,","venue":null,"work_id":"87b08153-02a8-4c7c-ac12-1a4caaaac8f0","year":2024},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:55.034450Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:3829e1a5a005308bbbf36366ba7df6423bbe94b68aa65562f921eb12a7c79faa","observation_id":"dc995cbb-4082-4e91-b3eb-7c839894ae7c","resolution":{"observed_at":"2026-08-14T04:29:57.705793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02193","last_updated":"2024-11-21T12:10:54Z","snapshot_observed_at":"2026-08-15T06:33:07.395443Z","submitted_at":"2024-11-04T15:46:20Z","title":"Improving Steering Vectors by Targeting Sparse Autoencoder Features","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02193","snapshot_observed_at":"2026-08-14T04:29:55.042128Z","title":"Improving steer- ing vectors by targeting sparse autoencoder features,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:55.042128Z"},"links":{"cited_paper":"/paper/2411.02193","citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:182b8d22b5a69ff2dfa616ea71a748915dd0e6a702b824b3ccd82158ff6b3af6","observation_id":"43ba2f96-a5c6-4735-86fe-6cae3d525ce5","resolution":{"observed_at":"2026-08-14T04:29:55.042128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:57.675223Z","title":"Denoising concept vectors with sparse autoencoders for improved language model steering,","venue":null,"work_id":"1f489d5e-495b-40e1-9fac-dea2285f5646","year":2026},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:55.056564Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:72e42f26a81e589062d635d050866cb9dea631d86799139f1727e39d596fa109","observation_id":"4544b7d5-68c6-40e0-aea1-e0f0ef2ee445","resolution":{"observed_at":"2026-08-14T04:29:57.681103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:57.641336Z","title":"In- terpreting and steering llms with mutual information- based explanations on sparse autoencoders,","venue":null,"work_id":"5c32bacb-48dd-44a1-aeeb-e48328af96c6","year":2025},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:55.067208Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:7070930b08edd5a0048f8e31cacbe01111fbb5d941d632df94d136336b0ef65f","observation_id":"5ea960f9-ec0c-41d5-814c-e36f8cb977f0","resolution":{"observed_at":"2026-08-14T04:29:57.649570Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:55.082168Z","title":"Concept steerers: Lever- aging k-sparse autoencoders for test-time controllable generations,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:55.082168Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:4283bea1fe9780ae0c7ebb94679ac13d553917a715f4ed4d770efd22478afd3f","observation_id":"d641a75b-0779-4001-8e32-6f339d22205c","resolution":{"observed_at":"2026-08-14T04:29:55.082168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:57.618803Z","title":"Interpret and control dense retrieval with sparse latent features,","venue":null,"work_id":"25033f73-6db0-4b39-80e9-87124f8ca730","year":2025},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:55.100913Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:d6c8bcad084c636ceab583bf4dc7b260ac6949743140742ff6f664bcd92a7e4f","observation_id":"c06be5fb-c643-4ee7-a999-64e552100fc6","resolution":{"observed_at":"2026-08-14T04:29:57.628501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:57.583858Z","title":"Decoding dense embed- dings: Sparse autoencoders for interpreting and dis- cretizing dense retrieval,","venue":null,"work_id":"511081fd-afa9-4828-8fa7-b1332b309131","year":2025},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:55.110752Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:79ca0f308138ac3e0e266b97222802bc9c1ba3a52fcc3f32c926987bb7182edb","observation_id":"c96e8ab7-3c8b-4f80-926c-f1ad43d6a265","resolution":{"observed_at":"2026-08-14T04:29:57.597024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:57.552289Z","title":"Discovering and steering interpretable concepts in large generative mu- sic models,","venue":null,"work_id":"5860e9bf-6437-4dd7-877e-76e4a3b9708e","year":2025},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:55.116328Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:e0902f4e5b3c3eecabe070cb7bfcef069f28ff154ad65071364dbf29c90c870b","observation_id":"2294b1e4-9b33-4c05-952c-9b86f88dde06","resolution":{"observed_at":"2026-08-14T04:29:57.565394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:57.493935Z","title":"Universal sparse autoencoders: In- terpretable cross-model concept alignment,","venue":null,"work_id":"cbdc4a38-bc91-47ec-bcfc-c3aa53479696","year":2025},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:55.129657Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:fb4467ad7c8363b2fb1ae4c5fcd0401935a2d3575bab96d459cd311597ab3e2d","observation_id":"d2b2cb65-261b-44d9-9397-ec22bd89b24b","resolution":{"observed_at":"2026-08-14T04:29:57.512085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:57.447173Z","title":"Interpreting the linear structure of vision- language model embedding spaces,","venue":null,"work_id":"1b6d3736-43c6-4b04-b3fc-528341232f85","year":2025},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:55.143013Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:5fbe3069a31981aeea2f7c7d9b98da2c23632faf640460b79427eb6bce8d99d4","observation_id":"7c247b99-aaba-49ef-862c-a01539d2c385","resolution":{"observed_at":"2026-08-14T04:29:57.469110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00657","last_updated":"2024-08-05T03:25:01Z","snapshot_observed_at":"2026-08-12T23:10:09.454892Z","submitted_at":"2024-08-01T15:46:22Z","title":"Disentangling Dense Embeddings with Sparse Autoencoders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00657","snapshot_observed_at":"2026-08-14T04:29:55.165739Z","title":"Disentangling dense embeddings with sparse autoencoders,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:55.165739Z"},"links":{"cited_paper":"/paper/2408.00657","citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:19cb3adc9d558c618579684e694841766df4b1e6e195b6e53ead64415c50b33a","observation_id":"898a35f0-46f8-461d-814f-d5e035e19c7d","resolution":{"observed_at":"2026-08-14T04:29:55.165739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.20028","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:56.241147Z","title":"Decomposing multimodal embedding spaces with group-sparse au- toencoders,","venue":null,"work_id":"b47da53a-24d3-45e2-b99d-76fe1d7b752b","year":2026},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:55.184886Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:0bbb0abfe2b0f4c1368870416d04928f20710c63e6e82af0881bfc9829783c81","observation_id":"a52028c4-0f77-4e6a-a434-c627aba1bda0","resolution":{"observed_at":"2026-08-14T04:29:56.290818Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:57.294286Z","title":"Discover-then-name: Task-agnostic concept bottle- necks via automated concept discovery,","venue":null,"work_id":"7fb8f920-ff4c-4446-b9fe-bd3c3e74310d","year":2024},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:55.190845Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:a0bfa0db30f9050b9599c01346967704a3a45d4c8845e9cdbfc44c79a3bd03ab","observation_id":"e39bb8c9-e27f-43f4-b91d-ca2df74e18bc","resolution":{"observed_at":"2026-08-14T04:29:57.384751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20229","last_updated":"2025-05-26T17:08:02Z","snapshot_observed_at":"2026-08-10T10:01:13.636578Z","submitted_at":"2025-05-26T17:08:02Z","title":"From What to How: Attributing CLIP's Latent Components Reveals Unexpected Semantic Reliance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.20229","snapshot_observed_at":"2026-08-14T04:29:55.199436Z","title":"From what to how: At- tributing clip’s latent components reveals unexpected semantic reliance,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:55.199436Z"},"links":{"cited_paper":"/paper/2505.20229","citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:811c54bf988c2402d51903eb58816f9fe6f492f1686860071259566cc5a8ab7d","observation_id":"15f55d79-b291-4f12-a9b7-78341542406b","resolution":{"observed_at":"2026-08-14T04:29:55.199436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:57.249549Z","title":"Sparse autoencoders do not find canonical units of analysis,","venue":null,"work_id":"22bfa6d8-5bea-4933-846d-2b20447eee0e","year":2025},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:55.215902Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:e760ce30bf17c4f428ef5e68ae09ee46fb7b6c539f2deaaec9f1fedde26f088d","observation_id":"2a9b0c30-a994-4e9e-8fd4-e1aabb55ee5a","resolution":{"observed_at":"2026-08-14T04:29:57.261525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:57.092219Z","title":"A is for absorption: Studying feature splitting and absorption in sparse au- toencoders,","venue":null,"work_id":"8891bfea-776d-4f9c-bcd7-cdd089b68874","year":2024},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:55.224701Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:13ee5eff141f1f4cb24347514505417d581429e863351d534b00b00edd796116","observation_id":"7f22e999-5795-440b-b5a8-c773795aa833","resolution":{"observed_at":"2026-08-14T04:29:57.148084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:55.242831Z","title":"Ortsae: Orthogonal sparse autoencoders uncover atomic features,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:55.242831Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:08160b2695e75e46ba2a3217a8a273d1fb39ffbd9d4d70f618b0d87bffb34d3a","observation_id":"c269ef18-454c-43b5-8892-305ffafdb1bc","resolution":{"observed_at":"2026-08-14T04:29:55.242831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:57.072820Z","title":"Mind the gap: Understanding the modality gap in multi-modal contrastive representation learning,","venue":null,"work_id":"17b749d9-f90b-4239-ab1a-e6c8eff3a4b0","year":2022},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:55.273876Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:75c92858170fdf946590639df24173641cde4b6cdf5c26e7ee5c5bcf006f8453","observation_id":"de9e7b63-7153-42e3-a27f-bf9e09b0d104","resolution":{"observed_at":"2026-08-14T04:29:57.078945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08600","last_updated":"2023-10-04T13:17:38Z","snapshot_observed_at":"2026-08-11T07:21:14.568175Z","submitted_at":"2023-09-15T17:56:55Z","title":"Sparse Autoencoders Find Highly Interpretable Features in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08600","snapshot_observed_at":"2026-08-14T04:29:55.293274Z","title":"Sparse autoencoders find highly inter- pretable features in language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:55.293274Z"},"links":{"cited_paper":"/paper/2309.08600","citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:970592faa9b639b2a0e2a2877892e3c6937c7361206ebe3f5b87e081231a87ae","observation_id":"2e3c9e91-a73f-493b-9546-52f26b4a7917","resolution":{"observed_at":"2026-08-14T04:29:55.293274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:57.013466Z","title":"Large-scale contrastive language- audio pretraining with feature fusion and keyword-to- caption augmentation,","venue":null,"work_id":"fcdb1bf5-4041-43aa-a8e9-997f9e58183a","year":2023},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:55.327136Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:b2d219890a7760ffb17ef09153c54508c3492c20bc59a99179be822f93c45555","observation_id":"5d25a6d7-cf54-4914-ad69-7b5d1f565293","resolution":{"observed_at":"2026-08-14T04:29:57.045604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:56.945073Z","title":"Un- derstanding the modality gap in clip,","venue":null,"work_id":"32a51153-a996-49cf-8bd8-4b1b216d6ab7","year":2023},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:55.341159Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:bd38297471fb988d9dc3bd515a10a659889bd14e739d7b3f27539d05ee3e3689","observation_id":"0f3304b9-0583-4f31-9807-820fb890700f","resolution":{"observed_at":"2026-08-14T04:29:56.959803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:56.902077Z","title":"Slap: Siamese language-audio pretraining without negative samples for music understanding,","venue":null,"work_id":"e4c59e4e-9385-4650-85e3-8208995abc2c","year":2025},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:55.345426Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:48dd4d7fbf6e9ec70e1ae66d59719e4beeb56d9cd435d94c734df582c829bba5","observation_id":"e5356885-ea53-43eb-aafc-14731cd796dd","resolution":{"observed_at":"2026-08-14T04:29:56.908603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:56.847678Z","title":"An analysis of variance test for normality (complete samples),","venue":null,"work_id":"e9abe7f0-3f98-40af-8443-a84e1691ad80","year":1965},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:55.385033Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:22df3a91f7a7252888061c01177971c05bee2b5b350099b4baea898290dfe584","observation_id":"08c969bb-ef80-4460-a1e2-69cc94ef509e","resolution":{"observed_at":"2026-08-14T04:29:56.879095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:56.812764Z","title":"Jamendo- maxcaps: A large scale music-caption dataset with im- puted metadata,","venue":null,"work_id":"f72d5e5f-a126-4d6d-9ec8-31d5ee9fdbc2","year":2025},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:55.405371Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:b39a58dc5cd593f80fcae23537b7ec8be738dc98efdf8899c89f73829c0ded9b","observation_id":"5552fedc-b90e-4f00-8697-130d54e8e7fd","resolution":{"observed_at":"2026-08-14T04:29:56.827896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:56.737107Z","title":"Muq: Self-supervised music representation learning with mel residual vector quan- tization,","venue":null,"work_id":"02cfb975-f77f-4fb7-93b0-a40e6b7af8f2","year":2025},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:55.418488Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:5f6855b7218663a85287c4eb991247f89d726543a23fa28182565c8770c3247b","observation_id":"7a6c7b2f-d8f1-4156-b1db-87f5ad84c7c7","resolution":{"observed_at":"2026-08-14T04:29:56.764755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:56.634853Z","title":"Cross the gap: Exposing the intra- modal misalignment in clip via modality inversion,","venue":null,"work_id":"2ea4a195-a631-421c-a9c4-6d6ab70ccfbc","year":2025},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:55.440546Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:597457df832120c24abc342283c9c6ba124a46d8dbe9bcd8199b148d9c44f97d","observation_id":"ab0e1531-36bc-4876-9d64-08ef86e104cf","resolution":{"observed_at":"2026-08-14T04:29:56.664754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.20821","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:55.720424Z","title":"Training-free diffusion priors for text-to-image generation via optimization-based visual inversion,","venue":null,"work_id":"48645016-a49f-4c1c-92ad-3ca170efc810","year":2025},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:55.446631Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:4c4b720c4b9d1820a4e01f8ec38d5cebe3b7b21e24a88de7c21a1cf419263648","observation_id":"accd8073-ed80-456b-b1ed-e722bff4bd9e","resolution":{"observed_at":"2026-08-14T04:29:55.766200Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-14T18:51:16.666127Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-14T04:29:55.456363Z","title":"Adam: A method for stochastic optimization,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:55.456363Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:def4063f0debe762d54dccaab426676e099aad043a2c20e57d3de370a694165c","observation_id":"de85275b-c809-4a00-918e-5600c1c0c849","resolution":{"observed_at":"2026-08-14T04:29:55.456363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:29:56.584930Z","title":"A fast iterative shrinkage- thresholding algorithm for linear inverse problems,","venue":null,"work_id":"9e3bd192-ebe8-4dda-90f4-e3ebacb9572d","year":2009},"citing_paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-14T04:29:55.471193Z"},"links":{"citing_paper":"/paper/2608.08757"},"observation_digest":"sha256:e3a0351bb5c703f3deb6fef6b5944146a8cd95c3de9e60fe29b48d06f9da3e10","observation_id":"1af6e4e1-d0b2-4755-8174-0cb89aedbef9","resolution":{"observed_at":"2026-08-14T04:29:56.598581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.08757","last_updated":"2026-08-09T15:16:58Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-14T04:22:50.085714Z","submitted_at":"2026-08-09T15:16:58Z","title":"Steering dense music retrieval with open-vocabulary concept discovery"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":12,"verified_exact":2,"verified_fuzzy":30},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 1 inbound Pith citation observation for arXiv:2608.08757."}