{"as_of":"2026-08-22T00:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:734397d0d9e21e182089a34ce694148e6e0e3599b5e5d06afc23ca9dcb7e02da","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T15:37:59.256646Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.14100/citation-record","integrity":"/paper/2411.14100/integrity","json":"/paper/2411.14100/citation-record.json","paper":"/paper/2411.14100"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:38:00.083399Z","title":"”An audio indexing system for election video material.” In 2009 IEEE International Confer- ence on Acoustics, Speech and Signal Processing, pp","venue":null,"work_id":"8eca4dfc-37d6-4a89-8b00-8344f86ecdbb","year":2009},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.057204Z"},"links":{"citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:8bb6c6f694129718fd39f46fe84e233e0691be7a8cf5505a757fa5497a609199","observation_id":"f66fdc1b-ffcf-437e-9a6c-bc7d316998d8","resolution":{"observed_at":"2026-08-12T15:38:00.090552Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:38:00.061271Z","title":"and Goto, M., 2009","venue":null,"work_id":"bcfe1882-a8c4-4e1c-b916-5ea92f161e8f","year":2009},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.062933Z"},"links":{"citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:b3346df5a2f4a1f5e1330a7d5f887335ad563434c1a9256bfdef897bd6406ced","observation_id":"c73fc971-c223-4268-8821-b1fe7189f97e","resolution":{"observed_at":"2026-08-12T15:38:00.070074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:38:00.034761Z","title":"and Acero, A., 2008","venue":null,"work_id":"d0aa0eca-c523-4d02-9ecf-4a6387b20e12","year":2008},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.067914Z"},"links":{"citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:0a0a1eefd548e2de33278d8a8c25a9678e16395c61c5aef05169d1aa14338a75","observation_id":"22d3df90-42e4-4c15-81a3-0f425d62369f","resolution":{"observed_at":"2026-08-12T15:38:00.041587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:37:59.895339Z","title":"and Siohan, O., 2007, July","venue":null,"work_id":"f5f279e4-f21d-4d91-a308-708e546d9101","year":2007},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.073045Z"},"links":{"citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:a61712ae1891553d1d3eb02a2bdef37e09b2ff615dfcf8d1affa5b5df5d5abb7","observation_id":"f32b06cd-9df1-4374-ae5b-b375195a2600","resolution":{"observed_at":"2026-08-12T15:38:00.019889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:37:59.880593Z","title":"and Gish, H., 2007, August","venue":null,"work_id":"38468508-03f0-40cb-8bb3-b164be58a270","year":2007},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.077790Z"},"links":{"citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:abb9945c8577ac1d1fae3d3f17069c075750a3804d6f8d0358a38685b49a21a0","observation_id":"7596b2d2-2543-43f5-89b2-381082ed2331","resolution":{"observed_at":"2026-08-12T15:37:59.885305Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:37:59.866372Z","title":"and King, S., 2008, March","venue":null,"work_id":"94261cc5-524f-400d-b7fe-61749d59e255","year":2008},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.082555Z"},"links":{"citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:04059c9771be636e8159eb4e2d88e8eea3858fd47aea2fc5107c3608fd6530ca","observation_id":"b177921f-6e6f-4f49-ba8b-3bb7b491e944","resolution":{"observed_at":"2026-08-12T15:37:59.871125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:37:59.850801Z","title":"and Sproat, R., 2004","venue":null,"work_id":"b6f98e93-43af-4b61-87fe-650e107cd7fe","year":2004},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.088225Z"},"links":{"citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:1738332fd6d1a2872afe418e75de32d0e78d3242fa3fe98159d35d1820c1387f","observation_id":"5f238fc4-72f3-491f-b274-dee0a4e86c1e","resolution":{"observed_at":"2026-08-12T15:37:59.855631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:37:59.834686Z","title":"and Saraclar, M., 2011","venue":null,"work_id":"22061b1a-2dfe-48b4-a80a-1c3254840087","year":2011},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.093261Z"},"links":{"citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:767e9741e1e00671208aa5716991553ed62c213c2cf2e7026d67a28bcd5727c2","observation_id":"6517875d-3ed8-4d99-9936-5e1e52a6b9b9","resolution":{"observed_at":"2026-08-12T15:37:59.840025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:37:59.819430Z","title":"and Bourlard, H., 2020","venue":null,"work_id":"10e9e312-c629-4f99-979c-198da13589ac","year":2020},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.097708Z"},"links":{"citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:a50510349ea50bb16ec624209fb1b27a54eb09fc2c3b480e661a124d28ee3618","observation_id":"6b4407e0-4c6f-411e-ae1c-ceffd5eedc31","resolution":{"observed_at":"2026-08-12T15:37:59.824151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:37:59.804853Z","title":"and Bourlard, H., 2018, September","venue":null,"work_id":"29d67877-3665-4265-8c25-fd6fa6edae11","year":2018},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.102168Z"},"links":{"citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:289e2af51e359cb082e227ab43c461367099d343faa3723c4df94212edd4de33","observation_id":"be9fc98b-58bf-4445-9220-5eeeca744d64","resolution":{"observed_at":"2026-08-12T15:37:59.809345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:37:59.790497Z","title":"Segmental DTW: A parallelizable alternative to dynamic time warping","venue":null,"work_id":"b7ae53c3-864c-4ed2-9ca2-f8793052729b","year":2021},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.106821Z"},"links":{"citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:c288e5b53b54e3d92129abe99f305be0071dca7f3916f212d95b63fb4c9d5b12","observation_id":"4a8dec1d-6d3d-4b15-b1bf-e2047e5b1044","resolution":{"observed_at":"2026-08-12T15:37:59.795038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:37:59.775937Z","title":"and Lee, L.S., 2016","venue":null,"work_id":"90141272-9163-4bcc-a007-74cec552b306","year":2016},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.112853Z"},"links":{"citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:e088d8b11b9fb1c48a0e16548d36897cd584c70e7759629b4588947b8614ed18","observation_id":"5f1f2fd4-aed7-40b8-8e0d-eb62e35afad0","resolution":{"observed_at":"2026-08-12T15:37:59.780809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.04496","last_updated":"2017-03-10T23:57:57Z","snapshot_observed_at":"2026-08-20T03:35:02.998971Z","submitted_at":"2016-11-14T17:47:03Z","title":"Multi-view Recurrent Neural Acoustic Word Embeddings","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.04496","snapshot_observed_at":"2026-08-12T15:37:59.117518Z","title":"and Livescu, K., 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.117518Z"},"links":{"cited_paper":"/paper/1611.04496","citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:bd114c699ce7fb97fa02f87898322f4000b6d40f10caa41b3a2e91c828bf48a6","observation_id":"a48f4441-b620-436b-a8f0-0117844de30d","resolution":{"observed_at":"2026-08-12T15:37:59.117518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:37:59.760872Z","title":"and Lee, L.S., 2018, December","venue":null,"work_id":"2a2679d9-feac-4e3b-97e1-10eb8683a9ae","year":2018},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.122641Z"},"links":{"citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:6672e24d6b633be0fe2566e534a8244abe5799fd3c87ae1bcd901ed7ba683dbc","observation_id":"e8c5ffd3-76ec-42a3-af09-e65ae6bc141f","resolution":{"observed_at":"2026-08-12T15:37:59.765141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:37:59.746130Z","title":"and Livescu, K., 2016, March","venue":null,"work_id":"f904c697-1f47-4c7b-978f-de2437e70787","year":2016},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.127434Z"},"links":{"citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:76c2d6add701014629bdba28eeece9bc865e1e285cbf6f33f89fb28e76519fbb","observation_id":"aa7de2a6-4b66-4003-a639-362a79d312bd","resolution":{"observed_at":"2026-08-12T15:37:59.750631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:37:59.730759Z","title":"Acoustic span embeddings for multilingual query-by-example search","venue":null,"work_id":"c982f4c9-1b21-4fd3-b371-b526efe6c040","year":2021},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.132186Z"},"links":{"citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:05ea50e6c0fdd367ce7d256954bfe4f10c3ee14315f87f01633ab3b4a26fade6","observation_id":"0f82dbf2-8940-4b6f-954f-65d80ad26890","resolution":{"observed_at":"2026-08-12T15:37:59.735620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:37:59.715913Z","title":"and Arora, V ., 2022","venue":null,"work_id":"3a62ce32-d253-45ff-ac97-0399265cb0f8","year":2022},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.136795Z"},"links":{"citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:8d5991dfb94c8428983e597fcdfdecddd2cc909926a17114363ff3cb49628d0b","observation_id":"b6a270da-dd7d-43d6-b839-99911841d32c","resolution":{"observed_at":"2026-08-12T15:37:59.720726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:37:59.699844Z","title":"FlowHash: Accelerating Audio Search with Balanced Hashing via Normalizing Flow","venue":null,"work_id":"2232af9d-99a4-416a-86d8-a1071373ee18","year":2024},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.141644Z"},"links":{"citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:ea42bd35f1acf8ed685a1ba084d9e80d594a4dbe052f2d02c49be99b72c7a04d","observation_id":"ecb99440-c5a7-4150-81f7-1c494fbab2be","resolution":{"observed_at":"2026-08-12T15:37:59.704772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:37:59.684239Z","title":"Simultaneously learning robust audio embeddings and balanced hash codes for query-by-example","venue":null,"work_id":"48316bce-3245-4b33-972c-63cf4f91bd92","year":2023},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.146123Z"},"links":{"citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:419621f840643e50499f6545332d713202d441464cdc75a418f2d7e6f9243f2c","observation_id":"247505ac-642a-45d3-a531-02a21b7c3ec9","resolution":{"observed_at":"2026-08-12T15:37:59.689437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:37:59.669411Z","title":"and Khudanpur, S., 2015, April","venue":null,"work_id":"d5f84301-ff6c-444d-933f-581dca7c48a3","year":2015},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.150891Z"},"links":{"citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:79476ab214b8efea210659268069d39883c3ce6df2568614401ccd7301fadeb6","observation_id":"1263a7fc-dacf-4365-9cc0-5768aa5577e8","resolution":{"observed_at":"2026-08-12T15:37:59.674317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:37:59.653102Z","title":"and Pallett, D.S.,","venue":null,"work_id":"7913103b-e72d-47d4-8410-f33e1e061a81","year":null},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.156212Z"},"links":{"citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:bca029640e4754164e749d3aacb48985796852b77fefba314b1aa3acbe88bc9b","observation_id":"75f3475b-344a-49a5-9703-2691c117c58b","resolution":{"observed_at":"2026-08-12T15:37:59.658229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:37:59.622040Z","title":"and Mohamed, A., 2021","venue":null,"work_id":"7805c036-2c16-498c-9f43-92ba2696a945","year":2021},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.167142Z"},"links":{"citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:465a1524a09d665e3e54d8d589891df5a055acda4e55cd0dfe4b1d58991945b9","observation_id":"0ea68d95-3e5c-45d2-acc5-fcb5dadf713e","resolution":{"observed_at":"2026-08-12T15:37:59.626785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:37:59.607162Z","title":"and Wu, J., 2022","venue":null,"work_id":"63275f47-1bc4-4f5e-985b-436da045e9af","year":2022},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.171844Z"},"links":{"citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:91c84e0be38b7f5a16a192b04a93d6e11a2443a9fad5a5e9034f6c35fec5069f","observation_id":"78355941-8cbd-4a73-830a-766120d222e9","resolution":{"observed_at":"2026-08-12T15:37:59.611838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16692","last_updated":"2024-01-23T01:56:57Z","snapshot_observed_at":"2026-08-16T15:04:18.834535Z","submitted_at":"2023-08-31T12:53:09Z","title":"SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16692","snapshot_observed_at":"2026-08-12T15:37:59.176561Z","title":"and Qiu, X., 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.176561Z"},"links":{"cited_paper":"/paper/2308.16692","citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:6dc55b0a9b387d422671c3cda6e19e8093009b4131d2cf724b2dcd148db06f69","observation_id":"41e21113-acdc-4fcf-90ba-6e005f305a26","resolution":{"observed_at":"2026-08-12T15:37:59.176561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.13438","last_updated":"2022-10-24T17:52:02Z","snapshot_observed_at":"2026-08-15T04:43:16.361751Z","submitted_at":"2022-10-24T17:52:02Z","title":"High Fidelity Neural Audio Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.13438","snapshot_observed_at":"2026-08-12T15:37:59.181343Z","title":"and Adi, Y ., 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.181343Z"},"links":{"cited_paper":"/paper/2210.13438","citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:116ebdf32437d8127cd18abd999e09c986669d15485429ac6cea5080e8d0a01a","observation_id":"c1640f87-cd61-4433-8adc-a5d80da4cafc","resolution":{"observed_at":"2026-08-12T15:37:59.181343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.00396","last_updated":"2022-08-05T17:54:38Z","snapshot_observed_at":"2026-08-14T01:02:41.198730Z","submitted_at":"2021-10-31T03:32:18Z","title":"Efficiently Modeling Long Sequences with Structured State Spaces","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.00396","snapshot_observed_at":"2026-08-12T15:37:59.186136Z","title":"and R ´e, C., 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.186136Z"},"links":{"cited_paper":"/paper/2111.00396","citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:efe114db2429f3203c60015c096f214b5ed4a33e6af73d24e1d1347a3416a139","observation_id":"c510c0a4-112c-411c-85b7-433f7ec6c7d0","resolution":{"observed_at":"2026-08-12T15:37:59.186136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:37:59.592252Z","title":"and R ´e, C., 2020","venue":null,"work_id":"579ea24f-9305-4622-9e04-388cf6f15d90","year":2020},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.191098Z"},"links":{"citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:e246a421dab185b9146455df7525ce6129f16347403163591ef122b7b3f3729d","observation_id":"63eed54d-7fe2-4560-82c8-b59af0282df2","resolution":{"observed_at":"2026-08-12T15:37:59.596997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:37:59.576504Z","title":"and Berant, J., 2022","venue":null,"work_id":"5823b1fa-40d5-44ee-825f-16381c4e572f","year":2022},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.195693Z"},"links":{"citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:7892abe67f5ce7e20c5f69a564a3b5f077eaf3bd215aedbdd3f4187aa1250fb6","observation_id":"fbfe3d71-7643-448a-b020-de6363c7f297","resolution":{"observed_at":"2026-08-12T15:37:59.581501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.21060","last_updated":"2024-05-31T17:50:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-31T17:50:01Z","title":"Transformers are SSMs: Generalized Models and Efficient Algorithms Through Structured State Space Duality","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.21060","snapshot_observed_at":"2026-08-12T15:37:59.200402Z","title":"and Gu, A., 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.200402Z"},"links":{"cited_paper":"/paper/2405.21060","citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:7ea3febb83eb809571e9dd37548c10d2b9b6e8089ee26e13dcd33c8153158811","observation_id":"8f140de3-1e26-49e2-9315-d4533b8fbfa0","resolution":{"observed_at":"2026-08-12T15:37:59.200402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:37:59.559101Z","title":"and Vinyals, O., 2017","venue":null,"work_id":"450166d1-22e2-40ce-8a76-e31cb5f0aa66","year":2017},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.205199Z"},"links":{"citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:080fa61ec37aacbc8be27f208a138788a63273c0170b76ec6528e6ee59e3ba77","observation_id":"646f4f1b-2511-4f8c-bdb8-51a7e8e56f68","resolution":{"observed_at":"2026-08-12T15:37:59.564478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.04627","last_updated":"2022-06-05T01:57:58Z","snapshot_observed_at":"2026-08-21T12:42:02.651994Z","submitted_at":"2021-10-09T18:36:00Z","title":"Vector-quantized Image Modeling with Improved VQGAN","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.04627","snapshot_observed_at":"2026-08-12T15:37:59.209677Z","title":"and Wu, Y ., 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.209677Z"},"links":{"cited_paper":"/paper/2110.04627","citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:cc956908bdb52ea18e98b53fb32aa4a73f92a01b7e6a73690f1da67ea52ae0fc","observation_id":"e19e353c-7af3-4522-9632-1fd54e4a25e6","resolution":{"observed_at":"2026-08-12T15:37:59.209677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:37:59.542139Z","title":"The Finley affair: A signal event in the history of forecast verification","venue":null,"work_id":"2263df2c-3ea5-4a7f-82ff-2d5919fe7797","year":1996},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.214580Z"},"links":{"citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:1af19429b3f4a7e55a7e6421de2f946bbf7a505485bf65e310284155a0835112","observation_id":"6c7feee7-f5ef-4168-956b-44c568aed4a5","resolution":{"observed_at":"2026-08-12T15:37:59.547182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:37:59.524810Z","title":"Learning to rank for information retrieval","venue":null,"work_id":"b1b44bc6-c2a6-4b80-8acf-ae75c0460388","year":2009},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.219189Z"},"links":{"citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:a02780e6332746337bffb3d67d72dae164fe9de40ac1ab078748da3add4f9761","observation_id":"3f806bee-8443-4bb9-990e-699ab585b6f0","resolution":{"observed_at":"2026-08-12T15:37:59.530947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:37:59.507620Z","title":"and Penagarikano, M., 2013","venue":null,"work_id":"11f2a907-e93d-4be2-a145-182381daef62","year":2013},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.223587Z"},"links":{"citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:ec0b84c7a68baf2e71e956a62267ca3d0a04edd2977761626a16ed672c31d061","observation_id":"a670de57-8a49-48b0-a2d1-531dc35f44e0","resolution":{"observed_at":"2026-08-12T15:37:59.513337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:37:59.490913Z","title":"and Cernock ´y, J., 2018, June","venue":null,"work_id":"d0966ccf-9dc1-45fa-9abc-cfe3e76a319d","year":2018},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.228430Z"},"links":{"citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:8a46a84359a8b662aac8ee47b367797e4d281278c95f307b6abc3035dc5bc322","observation_id":"fe613997-a57a-4867-9aed-ea69b9661c5d","resolution":{"observed_at":"2026-08-12T15:37:59.495734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:37:59.472829Z","title":"and Trancoso, I., 2016, September","venue":null,"work_id":"3192ff44-989a-4057-b635-3fd105096cc1","year":2016},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.232866Z"},"links":{"citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:9278c2c95d88ff1426cf949d4b195e9c25c1bda4ee0c3a97846f38fe065563e7","observation_id":"769d3ebd-fb7d-41cb-bd3c-c907e82b4e25","resolution":{"observed_at":"2026-08-12T15:37:59.478834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.04624","last_updated":"2021-06-08T18:22:56Z","snapshot_observed_at":"2026-08-18T17:51:41.801692Z","submitted_at":"2021-06-08T18:22:56Z","title":"SpeechBrain: A General-Purpose Speech Toolkit","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.04624","snapshot_observed_at":"2026-08-12T15:37:59.237383Z","title":"and Chou, J.C., 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.237383Z"},"links":{"cited_paper":"/paper/2106.04624","citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:419a850d95ada93dd84e4cfe5deed9f71a220a0f2e635378dd961e491cbdd444","observation_id":"b49e0fbc-dccf-41cc-af8f-dc28c837611c","resolution":{"observed_at":"2026-08-12T15:37:59.237383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00916","last_updated":"2024-05-28T14:26:28Z","snapshot_observed_at":"2026-08-19T03:28:57.113432Z","submitted_at":"2023-09-02T11:46:05Z","title":"BLSP: Bootstrapping Language-Speech Pre-training via Behavior Alignment of Continuation Writing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00916","snapshot_observed_at":"2026-08-12T15:37:59.242058Z","title":"and Zhang, J., 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.242058Z"},"links":{"cited_paper":"/paper/2309.00916","citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:849915209a2c283a449783241634a2848a5bd30b31e79b32f587e8a10dddbaf4","observation_id":"1d12c827-76c3-4c8b-9126-44e2f987acae","resolution":{"observed_at":"2026-08-12T15:37:59.242058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13289","last_updated":"2024-04-08T06:12:52Z","snapshot_observed_at":"2026-08-21T12:15:18.108504Z","submitted_at":"2023-10-20T05:41:57Z","title":"SALMONN: Towards Generic Hearing Abilities for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.13289","snapshot_observed_at":"2026-08-12T15:37:59.246770Z","title":"and Zhang, C., 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.246770Z"},"links":{"cited_paper":"/paper/2310.13289","citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:5be8ab4fbb15136f965c974ae7ded46b027ca56156d37e2e322f40fb8a6e28e8","observation_id":"32e82412-347f-47cc-8a9f-9a97ccc1eb3d","resolution":{"observed_at":"2026-08-12T15:37:59.246770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07919","last_updated":"2023-12-21T10:20:42Z","snapshot_observed_at":"2026-08-07T10:17:55.688598Z","submitted_at":"2023-11-14T05:34:50Z","title":"Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07919","snapshot_observed_at":"2026-08-12T15:37:59.251752Z","title":"and Zhou, J., 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.251752Z"},"links":{"cited_paper":"/paper/2311.07919","citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:df5f27680d0fcbd1bbaaa7a0a561961eeac148d2744241b408772af2cc6890ea","observation_id":"a94698eb-c3ff-4d7a-bf46-fbff8e8e8095","resolution":{"observed_at":"2026-08-12T15:37:59.251752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00656","last_updated":"2024-09-21T15:27:30Z","snapshot_observed_at":"2026-08-19T23:59:29.658982Z","submitted_at":"2024-03-31T12:01:32Z","title":"WavLLM: Towards Robust and Adaptive Speech Large Language Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00656","snapshot_observed_at":"2026-08-12T15:37:59.256646Z","title":"and Wei, F., 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.256646Z"},"links":{"cited_paper":"/paper/2404.00656","citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:ebd770f4d0d1ec4714aefed0fadec31f1c99e38ac62510c6a206f5c64c59058d","observation_id":"0111d5a5-52f0-4b14-b57a-99782459c5a0","resolution":{"observed_at":"2026-08-12T15:37:59.256646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:37:59.636824Z","title":"NIST speech disc 1-1.1","venue":null,"work_id":"ebf5464d-3d74-4bec-a813-637550e1c086","year":null},"citing_paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection","version":2},"reference_index":1993,"source":"pdf_text","source_observed_at":"2026-08-12T15:37:59.161585Z"},"links":{"citing_paper":"/paper/2411.14100"},"observation_digest":"sha256:9bc709cc8eea28415fd78eae4c2d04f81eb190a2995293d9c69d63e7a95ce265","observation_id":"d35fc60f-0339-4e93-b3f3-a05f80443694","resolution":{"observed_at":"2026-08-12T15:37:59.641640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.14100","last_updated":"2024-12-21T19:15:27Z","latest_version":2,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-18T17:09:06.182618Z","submitted_at":"2024-11-21T13:05:18Z","title":"BEST-STD: Bidirectional Mamba-Enhanced Speech Tokenization for Spoken Term Detection"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":0,"verified_fuzzy":31},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:2411.14100."}