{"as_of":"2026-08-18T03:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d76b4e46633dc71a62b36c3d2c7d6d6b1f68992059274645943181480fead9b8","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T04:41:55.073891Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.01195/citation-record","integrity":"/paper/2412.01195/integrity","json":"/paper/2412.01195/citation-record.json","paper":"/paper/2412.01195"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.987446Z","title":"Front- end factor analysis for speaker verification,","venue":null,"work_id":"4c7d8e5d-6595-46e7-93f8-65455072bf53","year":2011},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.819169Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:2c83cdc07868b8fb5de2b615d841d8ee490baadf43f205879bb405d59facfab7","observation_id":"9830a03b-2cd7-4905-a7f9-ec3ca4095c02","resolution":{"observed_at":"2026-08-12T04:41:55.992691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.971222Z","title":"Probabilistic linear discriminant analysis,","venue":null,"work_id":"56c725a6-2c0d-4afc-85e3-da035b7dd9b1","year":2006},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.826917Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:41912fe5c2ec5f6b7e29a462b426ab3f72a42772346ea8b68936016255c093db","observation_id":"bdd23eed-625a-4190-99e2-953a9b3621f7","resolution":{"observed_at":"2026-08-12T04:41:55.976753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.955578Z","title":"Deep feature for text-dependent speaker verification,","venue":null,"work_id":"5b49e94a-ebf6-4fba-815d-58209ab93565","year":2015},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.832435Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:cf6dc821b743573d08501bd4731ed4e6ee1a0a62c3e307bf16a379c29200a200","observation_id":"2066fc5b-1ed3-465f-a74a-c1ce55350c66","resolution":{"observed_at":"2026-08-12T04:41:55.960554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.939977Z","title":"X-vectors: Robust dnn embeddings for speaker recognition,","venue":null,"work_id":"9f98d5be-a003-4772-b0ab-e24a65dfff85","year":2018},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.838917Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:482d8a1385231077cb6796fa5e00ddea6c36f85237047bf0d68d4b0d91f57d61","observation_id":"2c291556-f8a3-429f-b8d1-3e7e473efa95","resolution":{"observed_at":"2026-08-12T04:41:55.944823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.924020Z","title":"Deep neural network embeddings for text-independent speaker verification,","venue":null,"work_id":"31246cb6-9011-4498-888a-8ccd179789c9","year":2017},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.843827Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:9bc4a14bcf9a06ef09b7cbe13b491b6ac87e158a52b455d68a7420f4db170d36","observation_id":"8b170c2e-eab2-4a92-8eab-be1df5098478","resolution":{"observed_at":"2026-08-12T04:41:55.929221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.908171Z","title":"Speaker recognition for multi-speaker conversations using x-vectors,","venue":null,"work_id":"56b4b674-3733-4e41-bacf-eb30319a43b8","year":2019},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.848597Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:8e7bf9f425f1f1903c8acf42bcb9710d96d81db04c8fe74f3d4a02067d02a101","observation_id":"b2ad5785-88bb-46a2-aebd-eee8bd55c36d","resolution":{"observed_at":"2026-08-12T04:41:55.913120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.12592","last_updated":"2019-10-16T11:27:27Z","snapshot_observed_at":"2026-08-09T06:19:25.884792Z","submitted_at":"2019-10-16T11:27:27Z","title":"BUT System Description to VoxCeleb Speaker Recognition Challenge 2019","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.12592","snapshot_observed_at":"2026-08-12T04:41:54.853672Z","title":"But system description to voxceleb speaker recognition challenge 2019,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.853672Z"},"links":{"cited_paper":"/paper/1910.12592","citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:9f0e407d5774f91babb8c604454423916e94ac8fd77928009f60057ed74be972","observation_id":"892bb1d6-af85-4127-ab05-1a08e58b0671","resolution":{"observed_at":"2026-08-12T04:41:54.853672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.891792Z","title":"Densely connected time delay neural network for speaker verification,","venue":null,"work_id":"26c8801c-75a2-44c8-9924-f3f2a2aa8948","year":2020},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.858547Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:12557fe3281dc355ec437a161cb2301ebcfcc4fd242461b312d839489e2263ba","observation_id":"f87a2402-a7c0-44bf-bf30-90f192c35a86","resolution":{"observed_at":"2026-08-12T04:41:55.896715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.874169Z","title":"Ecapa-tdnn: Em- phasized channel attention, propagation and aggregation in tdnn based speaker verification,","venue":null,"work_id":"c4559570-b492-4047-b284-776b39c34207","year":2020},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.863388Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:6f323482e49365320419da9d9c4eec056df2f3ff3cf9b0a1c79255e1d2347f8e","observation_id":"f98e5e8a-fd98-4f6d-91ab-430a27f519ef","resolution":{"observed_at":"2026-08-12T04:41:55.879751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.858544Z","title":"Ecapa++: Fine-grained deep embedding learning for tdnn based speaker verification,","venue":null,"work_id":"a366f949-2e73-4c89-a6d4-5d01665658f8","year":2023},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.867745Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:2a2f0d9e0d5e37625fa7382b086ba8440f11245a08cc72d08bc18ef01945571f","observation_id":"9b3e72ad-0623-4a63-8977-d972844c7d2d","resolution":{"observed_at":"2026-08-12T04:41:55.863692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.842208Z","title":"An effective deep embedding learning method based on dense-residual networks for speaker verification,","venue":null,"work_id":"66567a67-3d2a-4909-a814-9e47dc6acb3c","year":2021},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.872289Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:6e972d057ee0cf37128f61a13d6cad61c05c1aff0f257bb752b9d9aab6db40d8","observation_id":"b0f69242-b943-4bc0-b29a-4d09ea75bd35","resolution":{"observed_at":"2026-08-12T04:41:55.847906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.825543Z","title":"Self-knowledge distillation via feature enhancement for speaker verification,","venue":null,"work_id":"05568571-29bc-44c2-9a53-3e33522400af","year":2022},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.876982Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:004f05b59351021d9d5a36cb669d19f915cfadf5faf480c23ddd4a982fd19e29","observation_id":"76c52fd9-2a62-4827-844c-c28cb580e5fd","resolution":{"observed_at":"2026-08-12T04:41:55.830509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.809916Z","title":"Adaptive convolutional neural network for text-independent speaker recognition,","venue":null,"work_id":"9471689f-b141-49f1-8ca6-e49bb9e52fe8","year":2021},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.881610Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:f549bff0f1627e1b996c325254b6a86162be0fe1009329a40d7a93511b56dfdf","observation_id":"809b695c-9a99-4952-8855-13a2190b6959","resolution":{"observed_at":"2026-08-12T04:41:55.814833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.793917Z","title":"Df-resnet: Boosting speaker verification performance with depth-first design,","venue":null,"work_id":"74986381-8e36-4f11-8d51-ede75f859d3d","year":2022},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.886213Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:2c566a00bd7728630d7ec2a07de2ff37de26cfa1e2e2d8942cdae4419bc18d7c","observation_id":"bafb2a08-21a3-4282-91f9-308c6fe344f5","resolution":{"observed_at":"2026-08-12T04:41:55.799033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.778134Z","title":"Depth-first neural architecture with atten- tive feature fusion for efficient speaker verification,","venue":null,"work_id":"dc2410c7-f367-417a-a88c-5ed3a6c86d7a","year":2023},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.890832Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:7fe25ea74495527f90fc7499b68c1a8883068bf602925e20b622218f061c458f","observation_id":"8b7b9866-a03d-40c9-b2bc-bcb6bf0d5860","resolution":{"observed_at":"2026-08-12T04:41:55.783204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.761799Z","title":"Mlp-svnet: A multi-layer per- ceptrons based network for speaker verification,","venue":null,"work_id":"3da0900e-b82a-487a-a74d-dd3feb6f473a","year":2022},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.895275Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:e3ce28ecbab55ed167457c0ba23df86651f47d2001596c9eda1db09808640246","observation_id":"cfc59ab2-964e-427c-ae83-9a368ca8038d","resolution":{"observed_at":"2026-08-12T04:41:55.767105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:54.899773Z","title":"Attentive statistics pooling for deep speaker embedding,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.899773Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:b63503bd25dc6377d5ea92bf9300f62834172b584a5500aaf9a88ba73fca2c2c","observation_id":"6c233823-5819-4848-bb29-42777875a23d","resolution":{"observed_at":"2026-08-12T04:41:54.899773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.735430Z","title":"Self-attentive speaker embeddings for text-independent speaker verification,","venue":null,"work_id":"af0c6aed-9b79-4edb-b7d7-0e4fa89fe49c","year":2018},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.905468Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:f696398d7b0093d007b5469df79085ec347ee56743e28521d5d5b95cb397e650","observation_id":"fcb50a5c-6cab-4b93-a4ad-cbcd691bf234","resolution":{"observed_at":"2026-08-12T04:41:55.740710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.719793Z","title":"Self multi-head attention for speaker recognition,","venue":null,"work_id":"9a1b4a83-d48e-46ec-8403-01113645432b","year":2019},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.910362Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:28768964ca134c356e6b201fdffb15bff473f1b5236cf1fa6f295443d2757e3f","observation_id":"9c7ae27d-f2e5-419b-8de2-85b00cdfa776","resolution":{"observed_at":"2026-08-12T04:41:55.724885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.702837Z","title":"Improving aggregation and loss function for better embedding learning in end-to- end speaker verification system,","venue":null,"work_id":"81a061ca-99aa-4d4b-995f-3b440b01909c","year":2019},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.916593Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:ed53b567556349aaa90ede3facf09acf01521b6638f86599172997f88a73c926","observation_id":"7879d606-6713-4423-84ca-531dacb7e285","resolution":{"observed_at":"2026-08-12T04:41:55.708038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.687018Z","title":"Revisiting the statistics pooling layer in deep speaker embedding learning,","venue":null,"work_id":"672b2625-9c65-4ed7-a257-ce2c10cfc547","year":2021},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.922469Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:751a144c87811efb24b2387cb012214e7d3555e5185c63aefdf518893cdeff5d","observation_id":"e6485b1d-5578-40b6-9985-8f1fb588817d","resolution":{"observed_at":"2026-08-12T04:41:55.692046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.669468Z","title":"End-to-end text-independent speaker verifi- cation with triplet loss on short utterances","venue":null,"work_id":"f1e2eb2a-bb8c-4c6a-a41e-ff876314f015","year":2017},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.927396Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:37cdd93bc00d58ea15366cff87e984a14bcd2d136cff5be3c6169e0b2b0c5142","observation_id":"296d3e3a-c5af-4745-8459-b6d167fe6494","resolution":{"observed_at":"2026-08-12T04:41:55.675579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.07317","last_updated":"2019-06-18T00:31:04Z","snapshot_observed_at":"2026-08-14T16:14:14.888502Z","submitted_at":"2019-06-18T00:31:04Z","title":"Margin Matters: Towards More Discriminative Deep Neural Network Embeddings for Speaker Recognition","version":1},"cited_work":{"arxiv_id":"1906.07317","doi":null,"metadata_source":"pith","pith_arxiv_id":"1906.07317","snapshot_observed_at":"2026-08-12T04:41:55.255358Z","title":"Margin Matters: Towards More Discriminative Deep Neural Network Embeddings for Speaker Recognition","venue":"eess.AS","work_id":"1efab370-b053-4da0-81a2-d9fcbfe8d589","year":2019},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.937215Z"},"links":{"cited_paper":"/paper/1906.07317","citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:d0832c15008f3175ef82ac525b7f3d9883bc7107670d96d0911dac84770412d5","observation_id":"4d363351-edae-4b83-814a-1bf2fe31cf08","resolution":{"observed_at":"2026-08-12T04:41:55.261239Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.635271Z","title":"Real additive margin softmax for speaker verification,","venue":null,"work_id":"9496a13c-18ce-4d7c-8540-fe4b9ddef6cc","year":2022},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.942392Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:c40898bf1f37e4febea71fae35713bd0ec74c3c5bb64f0c7893d3fdc7e9c5e1f","observation_id":"a4a3fdb8-ebda-48a4-8ed7-79fd52fd9611","resolution":{"observed_at":"2026-08-12T04:41:55.642186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:54.947040Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.947040Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:79317832b6696c80548930a196aef2a8ce2bc6cbf91cd28388d0b1a9387fbcc9","observation_id":"7a4b9269-565d-4ac6-b21a-621866b430a0","resolution":{"observed_at":"2026-08-12T04:41:54.947040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.608219Z","title":"Attentive feature fusion for robust speaker verification,","venue":null,"work_id":"1edc2738-6043-4f25-95d5-423edad5f835","year":2022},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.951908Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:f3a3b867a9a1b286401b360bb7b10907e371c14635cea515430bc1f566edd0e5","observation_id":"e8755960-cd58-4575-93dd-8cd9f5b138f0","resolution":{"observed_at":"2026-08-12T04:41:55.613615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.592271Z","title":"Simple attention module based speaker verification with iterative noisy label detection,","venue":null,"work_id":"41edccb9-ec3b-4d03-a1e8-4418121f4e2d","year":2022},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.956675Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:1dc5741db92e33ac8044ce2d21fd0e27e5030d0f02f89d0ebf5de2533dc11443","observation_id":"8fff76fe-4c10-48d3-ac41-785a5b2b767e","resolution":{"observed_at":"2026-08-12T04:41:55.597429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.576313Z","title":"Dual path embedding learning for speaker verification with triplet attention,","venue":null,"work_id":"dd87c485-71f1-44d9-9bee-551920550c71","year":2022},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.961040Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:690b159f46974dfd4d700aa9edeac2e1b48210fabcd29afe7fe0539dfa9648e0","observation_id":"96b7a525-d2ac-4b4d-a7ad-8004b11e280f","resolution":{"observed_at":"2026-08-12T04:41:55.581549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.560075Z","title":"Repvgg: Making vgg-style convnets great again,","venue":null,"work_id":"ed4bea3a-3f6e-4118-a69f-0d67bb63ea05","year":2021},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.965258Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:7a390f7b7e163131f24482905f4cdb5065514f3de4b65d7e1f9cd17c8d2518e4","observation_id":"ddcb79e6-aeed-47d5-85da-481884ec37da","resolution":{"observed_at":"2026-08-12T04:41:55.565209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.11699","last_updated":"2023-05-14T07:25:54Z","snapshot_observed_at":"2026-08-16T16:50:53.103998Z","submitted_at":"2022-06-23T13:40:59Z","title":"The SJTU X-LANCE Lab System for CNSRC 2022","version":5},"cited_work":{"arxiv_id":"2206.11699","doi":null,"metadata_source":"pith","pith_arxiv_id":"2206.11699","snapshot_observed_at":"2026-08-12T04:41:55.230555Z","title":"The SJTU X-LANCE Lab System for CNSRC 2022","venue":"cs.SD","work_id":"57c37eaf-c913-44bd-9df6-73b7dc3d814b","year":2022},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.969875Z"},"links":{"cited_paper":"/paper/2206.11699","citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:c29ba2469dd28e865f87d48fc8322496877312bdc64ff9228bbc45f60cce99ac","observation_id":"dc8dc349-124a-45c5-8038-4b312a527ce0","resolution":{"observed_at":"2026-08-12T04:41:55.236990Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.09076","last_updated":"2022-09-20T15:33:18Z","snapshot_observed_at":"2026-08-16T16:31:28.412355Z","submitted_at":"2022-09-19T15:06:42Z","title":"SJTU-AISPEECH System for VoxCeleb Speaker Recognition Challenge 2022","version":2},"cited_work":{"arxiv_id":"2209.09076","doi":null,"metadata_source":"pith","pith_arxiv_id":"2209.09076","snapshot_observed_at":"2026-08-12T04:41:55.200116Z","title":"SJTU-AISPEECH System for VoxCeleb Speaker Recognition Challenge 2022","venue":"cs.SD","work_id":"792c1170-1334-4cb8-891b-9fa78031d302","year":2022},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.974714Z"},"links":{"cited_paper":"/paper/2209.09076","citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:9cdb8623508ebe55a7ecca17eb9c78ee0c5a71d62cff37489f9484fd6ac08ed2","observation_id":"3df81298-dee6-4ad6-9b95-5c87a027a645","resolution":{"observed_at":"2026-08-12T04:41:55.205503Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12526","last_updated":"2023-08-24T03:30:38Z","snapshot_observed_at":"2026-08-17T07:18:21.053932Z","submitted_at":"2023-08-24T03:30:38Z","title":"UNISOUND System for VoxCeleb Speaker Recognition Challenge 2023","version":1},"cited_work":{"arxiv_id":"2308.12526","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.12526","snapshot_observed_at":"2026-08-12T04:41:55.177349Z","title":"UNISOUND System for VoxCeleb Speaker Recognition Challenge 2023","venue":"eess.AS","work_id":"2df52920-2819-4024-a5ad-4b0e03659d2d","year":2023},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.979489Z"},"links":{"cited_paper":"/paper/2308.12526","citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:e69b809387189a5a2675af58e0c8322ccc2e5bc4763ee2ad13c4bd0896f093d8","observation_id":"0c879338-9f80-4eed-b228-8abaa291feee","resolution":{"observed_at":"2026-08-12T04:41:55.182609Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.543154Z","title":"Learning representations by back-propagating errors,","venue":null,"work_id":"a5c376bf-8be5-4fa9-a466-7d47ff4ff138","year":1986},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.984329Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:dd17517d8a12bfc0c2b35843407222db03013e65acf37b35fc5ec9667722156b","observation_id":"6372ced0-43d4-47b2-b548-c814c5e3429d","resolution":{"observed_at":"2026-08-12T04:41:55.548429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:54.988884Z","title":"On the momentum term in gradient descent learning algo- rithms,","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.988884Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:e5ac038c5866e4d2a37bfea0acf08ac5135b9aaa3ff1ba4483b45a92e1f29a0f","observation_id":"e364951b-986b-4c57-be7f-407cfebda429","resolution":{"observed_at":"2026-08-12T04:41:54.988884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.516664Z","title":"Adam: A method for stochastic optimization,","venue":null,"work_id":"758a0dca-7101-4778-a3c1-86a7faf5f015","year":2015},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.993885Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:e77ea78017eb82ca4d4ccd1236c9809fa584746eb65426b439757d1614565e6b","observation_id":"5a6221c9-77d3-4b26-84ca-331fe3d3da25","resolution":{"observed_at":"2026-08-12T04:41:55.521703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:54.998407Z","title":"Decoupled weight decay regularization,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.998407Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:6e1bd0c4ebfce18edcb0795deb7852a80f9def565af12c402a2818eaada9080b","observation_id":"02a3fa18-65f5-4094-b03c-69fe135ac293","resolution":{"observed_at":"2026-08-12T04:41:54.998407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.486854Z","title":"Tensorflow: A system for large-scale machine learning,","venue":null,"work_id":"c203036d-ae22-467d-b518-981cb4548ebd","year":2016},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:55.003042Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:c8ea7f5c737447bc89a2ee97632434fcab01e73d59a9df4dae834a161b7dfd2e","observation_id":"a00a94a5-ccbc-4f55-8a11-773a64130e6c","resolution":{"observed_at":"2026-08-12T04:41:55.492264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.469322Z","title":"Automatic differentiation in pytorch,","venue":null,"work_id":"3d7930bd-b452-4f2c-93d1-54bbcb149524","year":2017},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:55.007750Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:1d151213096d412ace3ee10b72ce26065c693c17f45e6070b88c1d1f2f45e2fb","observation_id":"135cc4e9-4694-48d6-b29d-e1559a4b7752","resolution":{"observed_at":"2026-08-12T04:41:55.475179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14123","last_updated":"2024-03-21T04:31:59Z","snapshot_observed_at":"2026-08-16T14:07:48.850317Z","submitted_at":"2024-03-21T04:31:59Z","title":"AI and Memory Wall","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14123","snapshot_observed_at":"2026-08-12T04:41:55.012279Z","title":"Ai and memory wall,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:55.012279Z"},"links":{"cited_paper":"/paper/2403.14123","citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:8a358df6cfbff444067a47d988d021109d2669561327bccf8d683455e147b157","observation_id":"2b22e623-2e3c-4738-ba77-8103054275d0","resolution":{"observed_at":"2026-08-12T04:41:55.012279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.450581Z","title":"Reversible neural networks for memory-efficient speaker verification,","venue":null,"work_id":"49a7f875-5e61-4167-9234-c7d373840087","year":2023},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:55.017151Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:e63170130466bc458189d5aca61d5fbac269d663df56c5bb648ef967d281b9de","observation_id":"d9fa9a0e-03de-4911-9628-e419d8695d1a","resolution":{"observed_at":"2026-08-12T04:41:55.456483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.432039Z","title":"Compiling machine learning programs via high-level tracing,","venue":null,"work_id":"0cf0e4f3-0b07-4205-a668-f2e43543f850","year":2018},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:55.021702Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:d4ecea2461a4da5afdab87da0ad3616199bf1c63e2ff36db930aa34760eef171","observation_id":"0178f7ae-3369-49fb-83f3-def8dc791c77","resolution":{"observed_at":"2026-08-12T04:41:55.438237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.411342Z","title":"The reversible residual network: Backpropagation without storing activations,","venue":null,"work_id":"c65d8333-5a9f-444f-8143-188fd2430331","year":2017},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:55.026116Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:78897f3ad54d34466ae28999a067a7bd6a19895911a4baa286b76a367fafde57","observation_id":"a9e7a823-55b9-4116-8c1d-33efa86a986a","resolution":{"observed_at":"2026-08-12T04:41:55.418227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.383315Z","title":"8-bit approximations for parallelism in deep learning,","venue":null,"work_id":"a38a7fb6-f127-4b2c-8024-6b1c4a38fb01","year":2016},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:55.030757Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:270eb2ea5d90edd7791273810502198ed57e02feb6c605e60059a5d32e8fb532","observation_id":"e8c35e1f-5faa-4422-b7f9-f218d7c5a806","resolution":{"observed_at":"2026-08-12T04:41:55.391960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.364984Z","title":"V oxceleb: A large-scale speaker identification dataset,","venue":null,"work_id":"7bcc280c-5f1f-4437-a98c-8c428d36113a","year":2017},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:55.035506Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:abed3a6e2ede23055680e4244166866a87a38cf6365f2d23772be1866200875f","observation_id":"e030be80-92f0-48a6-bd41-4760eec92251","resolution":{"observed_at":"2026-08-12T04:41:55.370605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.040151Z","title":"V oxceleb2: Deep speaker recognition,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:55.040151Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:a0907ffea28ec2e3998912db1b994f3131be20c820fe969eaeb36a4468bc7f64","observation_id":"258b9362-4d32-4153-966e-65795490d930","resolution":{"observed_at":"2026-08-12T04:41:55.040151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.12731","last_updated":"2020-10-24T01:16:59Z","snapshot_observed_at":"2026-08-16T19:11:00.463640Z","submitted_at":"2020-10-24T01:16:59Z","title":"The DKU-DukeECE Systems for VoxCeleb Speaker Recognition Challenge 2020","version":1},"cited_work":{"arxiv_id":"2010.12731","doi":null,"metadata_source":"pith","pith_arxiv_id":"2010.12731","snapshot_observed_at":"2026-08-12T04:41:55.135042Z","title":"The DKU-DukeECE Systems for VoxCeleb Speaker Recognition Challenge 2020","venue":"eess.AS","work_id":"a5f246df-109c-4911-bcd2-6b9f11621eed","year":2020},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:55.044931Z"},"links":{"cited_paper":"/paper/2010.12731","citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:c743076dd2396e8ece8e7da390d50c4ab3f0986839c1451424db5064756c4945","observation_id":"edd01b68-c139-49b9-bd5f-eae4ca28f959","resolution":{"observed_at":"2026-08-12T04:41:55.142767Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.330066Z","title":"On-the-fly data loader and utterance-level aggregation for speaker and language recognition,","venue":null,"work_id":"11edc9b4-b61c-4383-a487-47e0353c272a","year":2020},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:55.050416Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:675dd33725811f83ca0b425e13e21efbf2c51eff3ade73c4dff9ef63119cb30e","observation_id":"e888337e-4355-44ad-9794-afeebdfddf1a","resolution":{"observed_at":"2026-08-12T04:41:55.336714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1510.08484","last_updated":"2015-10-28T20:59:04Z","snapshot_observed_at":"2026-08-14T22:25:51.884597Z","submitted_at":"2015-10-28T20:59:04Z","title":"MUSAN: A Music, Speech, and Noise Corpus","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1510.08484","snapshot_observed_at":"2026-08-12T04:41:55.057047Z","title":"Musan: a music, speech, and noise corpus,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:55.057047Z"},"links":{"cited_paper":"/paper/1510.08484","citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:1fc8d0fd031a44263656de9bdbe389e71aca4e1925f2d551598b699b15900eb2","observation_id":"313b3e6d-bac0-40a0-a6fc-af2672c8b84a","resolution":{"observed_at":"2026-08-12T04:41:55.057047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.312815Z","title":"A study on data augmentation of reverberant speech for robust speech recognition,","venue":null,"work_id":"425ad7e4-2720-4064-9d7e-87bbd1f6cbd9","year":2017},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:55.062305Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:a687bf394d6953ef055844004cc5871f62ffb204c339d5f5735a422b1bafe1ea","observation_id":"e57c9195-4fb7-4890-9b68-a68a43ac7dff","resolution":{"observed_at":"2026-08-12T04:41:55.318318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.652995Z","title":"Large margin softmax loss for speaker verification,","venue":null,"work_id":"502fb074-119f-4f64-a8d9-31d608d008e3","year":2019},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:55.067281Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:0629ea3c7272993a6dcac1707bb6540fe82ffcf3c56d822d52cb73ebcfa8f486","observation_id":"796f8a97-a271-4577-9385-a9793818b9ff","resolution":{"observed_at":"2026-08-12T04:41:55.658088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.293473Z","title":"Towards reduced false- alarms using cohorts,","venue":null,"work_id":"e8d1c2a5-0265-44f4-b294-050d1b80f0e3","year":2011},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:55.073891Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:6e4ebcf97f1dff5edd9e0427813945741586a8d8d69c661809c0e9ff7307ab71","observation_id":"106fc526-60a1-43a8-91ea-003a1ee94b85","resolution":{"observed_at":"2026-08-12T04:41:55.299240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-15T15:35:15.809978Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":5,"verified_fuzzy":38},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 0 inbound Pith citation observations for arXiv:2412.01195."}