{"as_of":"2026-08-14T16:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b597dbd8cba3ac3b9d6bbf49512354e3d600bbd289d61c247146d7aefc46dbdf","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T19:55:19.304016Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.09608/citation-record","integrity":"/paper/2501.09608/integrity","json":"/paper/2501.09608/citation-record.json","paper":"/paper/2501.09608"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:20.375375Z","title":"Deep canonical correlation analysis","venue":null,"work_id":"44079610-880c-454e-9c5f-d11cdd9ca4b8","year":2013},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:18.988911Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:51fd3b94a218a3625231b9cad54861e54ab083fbc1065e941cae4bcbabfea217","observation_id":"e2c537a4-9ef8-483d-b0cc-f245265115f6","resolution":{"observed_at":"2026-08-10T19:55:20.385563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:20.349936Z","title":"Canonical correlation analysis: An overview with application to learning methods","venue":null,"work_id":"1cd99a4c-bf75-48e6-a691-4c7159888205","year":2004},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:18.998679Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:de3372d5bb517a4ce6ac53fb4967f4e818a75a1f97acbe06c258b1124cf06d8e","observation_id":"63fda567-e534-443c-83e1-07ec892dbc10","resolution":{"observed_at":"2026-08-10T19:55:20.359224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:20.325651Z","title":"Born again neural networks","venue":null,"work_id":"d72c986e-eb13-4a74-8943-777404e24aa1","year":2018},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.008248Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:8971b3920b1aa306e7e6921106d6e4272f83592d412aa5d83a6a27f8ee278068","observation_id":"97223f59-16ad-4fde-9d0e-e9beb8423096","resolution":{"observed_at":"2026-08-10T19:55:20.335707Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:19.018563Z","title":"Knowledge distillation: A survey","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.018563Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:4aac5d2a86ce15585ab380272b231a65cdc42a89ece71f6da2fad9cb0abbfe77","observation_id":"4e18c006-c89d-4fc8-94fe-249e194ffa92","resolution":{"observed_at":"2026-08-10T19:55:19.018563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.01851","last_updated":"2019-08-02T15:17:27Z","snapshot_observed_at":"2026-08-14T15:26:13.826711Z","submitted_at":"2019-08-02T15:17:27Z","title":"Self-Knowledge Distillation in Natural Language Processing","version":1},"cited_work":{"arxiv_id":"1908.01851","doi":null,"metadata_source":"pith","pith_arxiv_id":"1908.01851","snapshot_observed_at":"2026-08-10T19:55:19.662938Z","title":"Self-Knowledge Distillation in Natural Language Processing","venue":"cs.CL","work_id":"b914fadd-9f99-4cb9-8da2-5e7fda51f9bb","year":2019},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.029364Z"},"links":{"cited_paper":"/paper/1908.01851","citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:d7544110a56551735706db790dc316c55833d2b3709e44fc1bcc8eee94217f40","observation_id":"bb92b290-8b76-48c0-ae93-33978bd4e03f","resolution":{"observed_at":"2026-08-10T19:55:19.672289Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1703.07737","last_updated":"2017-11-21T15:35:07Z","snapshot_observed_at":"2026-08-14T08:32:52.286202Z","submitted_at":"2017-03-22T16:34:29Z","title":"In Defense of the Triplet Loss for Person Re-Identification","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.07737","snapshot_observed_at":"2026-08-10T19:55:19.038011Z","title":"In defense of the triplet loss for person re-identification","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.038011Z"},"links":{"cited_paper":"/paper/1703.07737","citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:49fad1c9a7fa18ce6272bc392374c8bebbd7718fc0ca2a05b3e8bceb4bff5c35","observation_id":"220e4117-ef21-47fa-b32b-d0431c8312ec","resolution":{"observed_at":"2026-08-10T19:55:19.038011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-10T19:55:19.048097Z","title":"Distilling the knowledge in a neural network","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.048097Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:502acb3fde1ad116a96aa489fedb3e270d0f3921314e12444857124a67745617","observation_id":"7db9b5ad-5413-4d34-b8c3-e7d2ed785da4","resolution":{"observed_at":"2026-08-10T19:55:19.048097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:20.267774Z","title":"Deep metric learning using triplet network","venue":null,"work_id":"fc6ccf45-8f59-4153-9a89-2c0c609feb8d","year":2015},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.057231Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:9daddc9ee9c713625afa2d62fdcd92e3ea9944d98700064e99eb94715d08f8f7","observation_id":"468dabb6-deb1-487a-989c-c0c96450da81","resolution":{"observed_at":"2026-08-10T19:55:20.282369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-14T16:05:47.225037Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-10T19:55:19.064803Z","title":"Adam: A method for stochastic optimization","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.064803Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:8bc34c0371935681c8a4337f50b116e3868ab9c332c2f33169c3773743d1b9e8","observation_id":"a4e3138b-eaf4-43ff-8bbf-52ae4c0fab9a","resolution":{"observed_at":"2026-08-10T19:55:19.064803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:20.241635Z","title":"Metric learning: A survey","venue":null,"work_id":"c3c94ba0-680e-466e-bbcd-ba43e6eb92ad","year":2013},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.072529Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:031b2c717d87eb2202604b0ad20dcba58d5c8ec46d4ec7f023bd57bb1ac3fc03","observation_id":"52405364-b5c6-43c3-8c13-7b78587c04d7","resolution":{"observed_at":"2026-08-10T19:55:20.248251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:20.219727Z","title":"Kernel and nonlinear canonical correlation analysis","venue":null,"work_id":"8cafbb12-2be6-42ba-adc6-8b78d3db33db","year":2000},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.085139Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:3b178b3f1f3149b97112a4f9c748d6f495333ce07612b4df8ff94aa921d82d81","observation_id":"dd5dcdd7-19ec-460c-9491-8b9a13926610","resolution":{"observed_at":"2026-08-10T19:55:20.226687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:20.192749Z","title":"Rank-based distance metric learning: An application to image retrieval","venue":null,"work_id":"b281b072-bcad-4a4c-ae70-a40e7887e806","year":2008},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.094147Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:b0a6ddb78e9f6a2de234f23cfa8be75f0a80963e4f805ed2f93ae32cfad82f73","observation_id":"97de3a4a-9b15-4cc0-90cc-44143d935278","resolution":{"observed_at":"2026-08-10T19:55:20.200639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:20.170260Z","title":"Neighborhood- adaptive structure augmented metric learning","venue":null,"work_id":"d8bc9784-7347-450b-82c5-603188c07d1e","year":2022},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.108742Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:78f160ca895758a5461f804c05fe9f8d3535053252f72dd6c3299eacb6a4cf6f","observation_id":"a1bcabfd-d784-495b-a25d-36e7f3f6cacf","resolution":{"observed_at":"2026-08-10T19:55:20.177174Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:20.151686Z","title":"Few sample knowledge distillation for efficient network compression","venue":null,"work_id":"f85db3da-b126-42a9-b551-e9477b9c02f8","year":2020},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.118752Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:b061933ab980861fc55ba7aee9cb168f52fd39b217354a7036d1848cb81734cf","observation_id":"1f205c67-6e5e-49e4-b9eb-6840497ba280","resolution":{"observed_at":"2026-08-10T19:55:20.157700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:20.125715Z","title":"Similarity metric learning for a variable-kernel classifier","venue":null,"work_id":"f6a04310-3d5b-4726-901f-bd0a2f7c91ae","year":1995},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.129339Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:f4ee2e7fb23a5d8c8763bb38405240b033bc5c60c7729cad0ab85739b59c0d46","observation_id":"1ecd7202-b29b-4fb3-b0ee-271c70267282","resolution":{"observed_at":"2026-08-10T19:55:20.135946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:20.103084Z","title":"Cluster canonical correlation analysis","venue":null,"work_id":"8e5606ac-e0fe-4371-a964-6ffb9a2acbb3","year":2014},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.138234Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:ffbbdb8ae36dab4c479d7de011710e4937c98d447ffc857cdd83c7c245b05940","observation_id":"8cfef9fa-7a77-4a6c-8ed5-3df583224125","resolution":{"observed_at":"2026-08-10T19:55:20.109416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1609.04747","last_updated":"2017-06-15T13:21:04Z","snapshot_observed_at":"2026-08-04T02:05:40.539691Z","submitted_at":"2016-09-15T17:32:34Z","title":"An overview of gradient descent optimization algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.04747","snapshot_observed_at":"2026-08-10T19:55:19.153546Z","title":"An overview of gradient descent optimization algo- rithms","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.153546Z"},"links":{"cited_paper":"/paper/1609.04747","citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:9f42239a99ee817bd7333c5e1dffc9ffe7c7381fba5b206157a0f8555bb20756","observation_id":"a524e6c8-1f54-483a-afb9-4711bb84588f","resolution":{"observed_at":"2026-08-10T19:55:19.153546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:20.070039Z","title":"Audio-visual event localization in unconstrained videos","venue":null,"work_id":"c44461ca-5346-43cb-9945-4b17e6790505","year":2018},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.163899Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:b8987ca5397339202a8b0d495c10aa5ef89bdca27e6b22f4da7c74d2191d5f31","observation_id":"67b4981d-474e-4c00-b7c3-f3c345474d59","resolution":{"observed_at":"2026-08-10T19:55:20.080242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.04990","last_updated":"2022-02-28T08:23:57Z","snapshot_observed_at":"2026-08-14T04:38:09.105634Z","submitted_at":"2021-06-09T11:20:03Z","title":"It Takes Two to Tango: Mixup for Deep Metric Learning","version":2},"cited_work":{"arxiv_id":"2106.04990","doi":null,"metadata_source":"pith","pith_arxiv_id":"2106.04990","snapshot_observed_at":"2026-08-10T19:55:19.469629Z","title":"It Takes Two to Tango: Mixup for Deep Metric Learning","venue":"cs.LG","work_id":"fba7d2ae-abf6-4152-95cd-627e91ee1fa8","year":2021},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.172972Z"},"links":{"cited_paper":"/paper/2106.04990","citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:52ea49429a8aa9051aa11c1f4fc846dcf5d2e9b9cc700ae538bb7d67a2440483","observation_id":"931e2501-a918-40cb-8470-17c5315a5c7c","resolution":{"observed_at":"2026-08-10T19:55:19.480687Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:20.042396Z","title":"Hyperml: A boosting metric learning approach in hyperbolic space for recommender systems","venue":null,"work_id":"7754d4ea-2333-4d1f-bd8e-993e44e77467","year":2020},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.186273Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:2199e293159d2e5144945c7a7ce18fcc08bf663a67e0eea437e5ee5bd119e975","observation_id":"c3f74c22-8b68-4b29-b7ca-fffbe200f037","resolution":{"observed_at":"2026-08-10T19:55:20.050267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:20.015554Z","title":"Videoadviser: Video knowledge distillation for multimodal transfer learning","venue":null,"work_id":"7f7a1e4b-cd99-4b17-ac21-0c246f290105","year":2023},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.196768Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:bb1b22d029da5cf6a51ec8558d25ec36ee7c0b7ffaedbdb903902b3c7942c2cf","observation_id":"2153e4e9-cc07-4f73-8c77-5d6a5311c1ce","resolution":{"observed_at":"2026-08-10T19:55:20.024152Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:19.982534Z","title":"Distance metric learning for large margin nearest neighbor classification","venue":null,"work_id":"262bb9db-4b26-400c-b567-196a226fadb1","year":2005},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.206931Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:5c7fbae4e74e1f1111026cca3f7215014e6adcd281c912eede2ced727a9e4ccf","observation_id":"071e1327-fccb-4660-8e22-42b9643789c3","resolution":{"observed_at":"2026-08-10T19:55:19.990651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:19.957462Z","title":"Distance metric learning with application to clustering with side-information","venue":null,"work_id":"bdc9f22a-277a-43ce-a4ef-be7875dea996","year":2002},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.218482Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:7859b04b3085448fe5c59a3b0bc2de91428c118e607e94a82d20e57d7308ddd9","observation_id":"b7396da3-3a67-4f16-9d0e-0eca9fcad1ad","resolution":{"observed_at":"2026-08-10T19:55:19.964764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:19.934796Z","title":"Category- based deep cca for fine-grained venue discovery from multimodal data","venue":null,"work_id":"c6a8de63-dd13-42d6-a2b5-cf3f4d09bff6","year":2019},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.227384Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:d153c58e98cd9847c7205258d00db237bdbe55c0687325205c8736428b7d43ab","observation_id":"59654b1a-bf45-410c-af80-2b14a22b378e","resolution":{"observed_at":"2026-08-10T19:55:19.942559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13451","last_updated":"2023-10-20T12:35:54Z","snapshot_observed_at":"2026-08-13T05:44:41.736461Z","submitted_at":"2023-10-20T12:35:54Z","title":"Two-Stage Triplet Loss Training with Curriculum Augmentation for Audio-Visual Retrieval","version":1},"cited_work":{"arxiv_id":"2310.13451","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.13451","snapshot_observed_at":"2026-08-10T19:55:19.417492Z","title":"Two-Stage Triplet Loss Training with Curriculum Augmentation for Audio-Visual Retrieval","venue":"cs.SD","work_id":"1ea2fe47-0200-457a-9479-d749ef43ae8b","year":2023},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.235378Z"},"links":{"cited_paper":"/paper/2310.13451","citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:8ab0eca990cb50533410546fddb584fbb7db1bf88ef73d3ac07d9690b1d9c554","observation_id":"69343916-7c7b-4853-af57-c96e97d56012","resolution":{"observed_at":"2026-08-10T19:55:19.430873Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:19.900816Z","title":"Learning joint embedding for cross- modal retrieval","venue":null,"work_id":"af3b9be8-f8bd-4259-8ad2-f9f0b117dfe0","year":2019},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.248061Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:5e08c1a693dbd028fd9d0a8df95d2f59c0f6f4f1c5db63b233810ba2045aad2c","observation_id":"4303dd6c-2831-44c2-afbd-7236e953592e","resolution":{"observed_at":"2026-08-10T19:55:19.916795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:19.874009Z","title":"Anchor-aware deep metric learning for audio-visual retrieval","venue":null,"work_id":"abb132a3-2a65-403d-803c-670076f2bc75","year":2024},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.254015Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:ed83aea7ff58436ab42e72ec2c12c7af32bfce96f20c5e5effa65f4be4b6b3a6","observation_id":"658652fd-4a10-47e7-bc35-16b9a1280e1c","resolution":{"observed_at":"2026-08-10T19:55:19.882985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:19.841567Z","title":"Com- plete cross-triplet loss in label space for audio-visual cross-modal retrieval","venue":null,"work_id":"d23c3d2d-579e-4010-9f23-11a838e660e4","year":2022},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.262167Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:d147a9eea2d88f7bc2cca10cf5bf59955a59b309f99644e3bf10859b4ba34a88","observation_id":"a1b34f4f-a4cd-40f3-af97-317b46214b77","resolution":{"observed_at":"2026-08-10T19:55:19.850295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:19.814618Z","title":"Learning explicit and implicit dual common subspaces for audio-visual cross-modal retrieval","venue":null,"work_id":"f37026ae-6388-48b6-8473-4efb69468d39","year":2023},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.276450Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:0f82afd9e0f494d145a3fb3091810177285a4ad3757f95b018c339e9c7a62301","observation_id":"133978f8-9ebb-4acd-9229-d8a4587e3b68","resolution":{"observed_at":"2026-08-10T19:55:19.824376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:19.785500Z","title":"Deep triplet neural networks with cluster-cca for audio-visual cross-modal retrieval","venue":null,"work_id":"433fc633-7ba7-4a2e-95e6-d824bab3392d","year":2020},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.286959Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:6b3b7fb73a4ec01e3a0291262ec8512556b1957b382a0e0b83852df5314702ca","observation_id":"24425459-3384-4e2a-a149-56d489706d1a","resolution":{"observed_at":"2026-08-10T19:55:19.795762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:19.738154Z","title":"Hardness- aware deep metric learning","venue":null,"work_id":"93b208d0-a887-4081-9758-f1545c353e48","year":2019},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.293704Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:9d1cc9b4e856c21bec1dd91e57c24a65889c4d221aed9bad37dbcf20c110689c","observation_id":"b2f7348d-2483-4311-9ec0-c150a7774176","resolution":{"observed_at":"2026-08-10T19:55:19.747768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:19.700788Z","title":null,"venue":null,"work_id":"a39839da-13d0-412a-978c-299e45f4024e","year":2018},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.304016Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:75610f07b672b2f9587f561c77a3bbe7eba806911109550f633ce7dbc1da5595","observation_id":"2dcb09a9-9e1b-4e92-bc63-a56b207dda88","resolution":{"observed_at":"2026-08-10T19:55:19.712948Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":3,"verified_fuzzy":23},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 0 inbound Pith citation observations for arXiv:2501.09608."}