{"as_of":"2026-08-10T02:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:79481e443525429cd0f34a573fb43817f78f02be4fa91101031d3c61a616255a","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:53:46.177712Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:53:41.686588Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T05:53:46.575085Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"cited_work":{"arxiv_id":"2506.06756","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.06756","snapshot_observed_at":"2026-08-07T05:53:46.575085Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","venue":"cs.SD","work_id":"d901e548-6e6e-4ae4-92c2-ec73af94fe4b","year":2025},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:41.686588Z"},"links":{"cited_paper":"/paper/2506.06756","citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:6b22f06bb58eaa53b5b30747148bbb384024d9d3e6381bd399221e0189da905b","observation_id":"619034f8-a4d3-4385-a877-97c322ddd4f0","resolution":{"observed_at":"2026-08-07T05:53:46.714939Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.06756/citation-record","integrity":"/paper/2506.06756/integrity","json":"/paper/2506.06756/citation-record.json","paper":"/paper/2506.06756"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"cited_work":{"arxiv_id":"2506.06756","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.06756","snapshot_observed_at":"2026-08-07T05:53:46.575085Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","venue":"cs.SD","work_id":"d901e548-6e6e-4ae4-92c2-ec73af94fe4b","year":2025},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:41.686588Z"},"links":{"cited_paper":"/paper/2506.06756","citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:6b22f06bb58eaa53b5b30747148bbb384024d9d3e6381bd399221e0189da905b","observation_id":"619034f8-a4d3-4385-a877-97c322ddd4f0","resolution":{"observed_at":"2026-08-07T05:53:46.714939Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:53.608093Z","title":", xT }, where each frame xi ∈ Rd, T is the total number of frames, and d is the dimensionality of each frame","venue":null,"work_id":"6d6e1392-700a-4ae7-a965-20f92294cfe5","year":null},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:41.820304Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:033faa2602c0d6a33e91e83c6a0998812e7cc490445ffd1b7c3c7478cd631302","observation_id":"befc544c-3856-4c93-8b2d-e616bde42fcd","resolution":{"observed_at":"2026-08-07T05:53:53.775356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:53.231320Z","title":null,"venue":null,"work_id":"bfc4c56c-72a8-40e7-afc4-cd403c45ac4b","year":null},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:42.053609Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:eca49020604b5b714562b5376e667d998aebdfe28a37268e773b618adb745830","observation_id":"ab3d14b1-325e-4ec9-b4c0-631604418605","resolution":{"observed_at":"2026-08-07T05:53:53.408576Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:52.878326Z","title":null,"venue":null,"work_id":"5753f778-2e66-4830-8fb2-4c0872cfd40d","year":null},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:42.206192Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:d4d00e920826d6d511ceb38ceac1f3e766ec5d2d5693b606c33494e22079d431","observation_id":"5ac88124-4318-47b6-8e23-b59ffe1412ee","resolution":{"observed_at":"2026-08-07T05:53:53.024690Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:52.608072Z","title":"The authors also gratefully acknowledge the support of IndiaAI and Meta through Srijan: Centre of Excellence for Generative AI","venue":null,"work_id":"4a16e701-4e8d-48e6-a7e3-cbf328da62a0","year":null},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:42.392482Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:8c45c5db8205dc077874bd948be66a579c682b9abbfd907650deecb0986d11b5","observation_id":"598dadb5-7ded-4ab6-9dd9-e34a8290dd8d","resolution":{"observed_at":"2026-08-07T05:53:52.775425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:42.552426Z","title":"A survey on speech large language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:42.552426Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:940668ed6dec66d1ac5e0ad261d67fb663dd0cab15f8e12d3754d9cf55c4831a","observation_id":"65ed964c-16db-4e40-97dc-e2ca37f0cd04","resolution":{"observed_at":"2026-08-07T05:53:42.552426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:52.264416Z","title":"Pengi: An audio language model for audio tasks,","venue":null,"work_id":"59a8ff79-19f8-4319-af75-120ac32ececa","year":2023},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:42.756657Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:ab674e7688939fb0e79a1949e7d72f105dcf582cc2b0f0dfbf50c3f5bb657ec8","observation_id":"77671e89-220a-4470-ba43-3449a82916bd","resolution":{"observed_at":"2026-08-07T05:53:52.399755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:42.917701Z","title":"Listen, think, and understand,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:42.917701Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:bd0e033c62b3b387b0fe080aeedd2d6c44efa5b817424257368065a2145e2614","observation_id":"ca7920ca-83cc-4357-9eeb-7638162454d6","resolution":{"observed_at":"2026-08-07T05:53:42.917701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:51.832152Z","title":"Neural codec language models are zero-shot text to speech synthesizers,","venue":null,"work_id":"7436168b-1596-4b6b-929b-bf4bce666221","year":2025},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:43.059579Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:44f4153d0befe54b5b94247133e5fed640cb751d5398cd9b2dc0a6fcac473b2d","observation_id":"1ccf13a9-e7fd-4aab-a400-2f012904c747","resolution":{"observed_at":"2026-08-07T05:53:52.046837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:51.515336Z","title":"Mobilespeech: A fast and high-fidelity framework for mobile zero-shot text-to- speech,","venue":null,"work_id":"2f6cc713-1cea-4a5e-a16b-86814c60de9a","year":2024},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:43.197717Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:c62d2d74f12128095a4abaa4266edfdc783b7ee85dd9b11d795f504098ad46ae","observation_id":"a70db387-9f55-42b0-9d19-982eb978689a","resolution":{"observed_at":"2026-08-07T05:53:51.657404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:51.140312Z","title":"Can rag- driven enhancements amplify audio llms for low-resource lan- guages?","venue":null,"work_id":"807d630b-eaec-4968-9612-e49a9b473af8","year":2025},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:43.338242Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:2be9313afb9acad745649b243ce624513352f8c5f1c645285df3af5a88fcdba5","observation_id":"32c170c8-4a14-4e84-bbe3-78709ccb905f","resolution":{"observed_at":"2026-08-07T05:53:51.306554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.08295","last_updated":"2021-06-15T17:12:42Z","snapshot_observed_at":"2026-08-02T11:19:40.664702Z","submitted_at":"2021-06-15T17:12:42Z","title":"A White Paper on Neural Network Quantization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.08295","snapshot_observed_at":"2026-08-07T05:53:43.538083Z","title":"A white paper on neural network quantization,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:43.538083Z"},"links":{"cited_paper":"/paper/2106.08295","citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:4a4596da61d64f79227e4317381a1b6327dfa224468f087234e0c0d47e43b760","observation_id":"6dc123cf-8fa7-46cc-94c1-c9d7f1a98db5","resolution":{"observed_at":"2026-08-07T05:53:43.538083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:50.754717Z","title":"Sv-deit: Speaker verifica- tion with deitcap spoofing detection,","venue":null,"work_id":"85a1f9af-b2fd-47f1-aba1-cee772983521","year":2023},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:43.692101Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:54ef7a47e88c6a9149e87251f1bbe1cf1c41bb8e66f50396ecec590daf10f1b5","observation_id":"d24e1cdc-a9a6-476b-9ce6-ddc7c8faee7f","resolution":{"observed_at":"2026-08-07T05:53:50.922281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:50.343651Z","title":"Faking fluent: Un- veiling the achilles’ heel of multilingual deepfake detection,","venue":null,"work_id":"50b86930-f9ab-49e0-ac20-a75a922998a5","year":2024},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:43.839750Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:4b9de1e4a1b361fa496fadbeb45432f20bbde78d743ebdfa1be23e30c60ad945","observation_id":"c17f2288-a9ee-4e5d-ba25-0e9aee2b4d45","resolution":{"observed_at":"2026-08-07T05:53:50.535046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:50.055463Z","title":"Context encoded multi-modal attention network for detecting audio spoofing,","venue":null,"work_id":"0f2b9dd0-926e-4afd-84b9-8c66465d0952","year":2024},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:44.011055Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:33c2cc98ff601b2a237918f839f0c90983efc9191922064a0553cff153944baf","observation_id":"0e6ed026-db15-44d2-8ac6-c656b1418ab9","resolution":{"observed_at":"2026-08-07T05:53:50.192227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:49.702859Z","title":"GAMA: A large audio-language model with advanced audio understanding and complex reasoning abilities,","venue":null,"work_id":"01ea95d8-8b56-4e46-9831-3397f08bea2a","year":2024},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:44.215530Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:1fe2598aa168f808a29298d835eee30a03d5cb17b00b02d010702b66bbb27b16","observation_id":"a26f2131-a477-4e15-84f1-3345db629dac","resolution":{"observed_at":"2026-08-07T05:53:49.886715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T05:53:44.376678Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:44.376678Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:f6bc4944e7f9da79e73a043979d48a825574faa067ed8705d0c760ac9e30ed8a","observation_id":"973e30d4-adff-4e7b-8470-f14e4fe45fb9","resolution":{"observed_at":"2026-08-07T05:53:44.376678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:49.356714Z","title":"Joint audio and speech understanding,","venue":null,"work_id":"a1e32f10-9a07-42f6-b561-4fd4a851dc64","year":2023},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:44.580432Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:f32d1656e898013d5b3bc036f25188a509c9dc97f61af81c7d7f843b15e14d99","observation_id":"96c5930e-a4f0-4934-a6ad-19a6570dcaad","resolution":{"observed_at":"2026-08-07T05:53:49.537664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:49.011497Z","title":"Robust speech recognition via large-scale weak su- pervision,","venue":null,"work_id":"b0a38c9e-dbe3-496e-8686-c6345328ff28","year":2023},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:44.729191Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:a6aefffc7c1c3eb2d447a1d14b9473f7743bcedde38edb88a70b7fd96ea2f6a0","observation_id":"62632fbf-3ca5-48e1-9c5c-321b350e58a4","resolution":{"observed_at":"2026-08-07T05:53:49.189022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09818","last_updated":"2025-01-16T03:29:23Z","snapshot_observed_at":"2026-07-06T20:06:17.706151Z","submitted_at":"2024-12-13T03:15:05Z","title":"MERaLiON-AudioLLM: Bridging Audio and Language with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09818","snapshot_observed_at":"2026-08-07T05:53:44.932527Z","title":"Meralion-audiollm: Bridging audio and language with large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:44.932527Z"},"links":{"cited_paper":"/paper/2412.09818","citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:cc7ad9570ea063e98298bfd61e527219fe73f563d4a3dfe478168f7d889e05bc","observation_id":"ea9b714b-767a-4334-ba29-1bd3b7e6cb14","resolution":{"observed_at":"2026-08-07T05:53:44.932527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:48.712723Z","title":"Sea-lion (southeast asian languages in one net- work): A family of large language models for southeast asia,","venue":null,"work_id":"2d09b829-474d-4949-8561-df0fb66734a8","year":2024},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:45.065096Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:8b4eba858831465c04ca009684bf9cf56189c28f6691cffc40b53587ce492056","observation_id":"ba26a92e-fbcc-4d97-8043-21e6e3f0c0eb","resolution":{"observed_at":"2026-08-07T05:53:48.885947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07919","last_updated":"2023-12-21T10:20:42Z","snapshot_observed_at":"2026-08-07T10:17:55.688598Z","submitted_at":"2023-11-14T05:34:50Z","title":"Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07919","snapshot_observed_at":"2026-08-07T05:53:45.230382Z","title":"Qwen-audio: Advancing universal audio under- standing via unified large-scale audio-language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:45.230382Z"},"links":{"cited_paper":"/paper/2311.07919","citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:a4b55aa464b5e4be4a61af5337a6d0f6401a142fa404e9a5b8c67335105184d4","observation_id":"a047bf3c-cd4e-4e5d-a4f9-7df2d0718f40","resolution":{"observed_at":"2026-08-07T05:53:45.230382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:48.289909Z","title":"SALMONN: towards generic hearing abilities for large language models,","venue":null,"work_id":"ada44cf1-6f88-4f2d-813a-e3eefb580192","year":2024},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:45.391416Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:ebbda6b28d938b34ae5174f036c5dccafb3e2c6c9f829e4fe6a9a34d0b4788da","observation_id":"c2e97566-4099-4ab9-8ebe-24ca57a30d7d","resolution":{"observed_at":"2026-08-07T05:53:48.506318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:47.909777Z","title":"Vicuna: An open-source chatbot impress- ing gpt-4 with 90%* chatgpt quality,","venue":null,"work_id":"dde3add9-2d26-4da2-9ed1-636c84ca6692","year":2023},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:45.595885Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:b64165b0208af9034f1f2d2ce3b663955a38574765b6677d78596b5ff838c1a2","observation_id":"67d529dc-35b7-4f9d-a12c-fae02b9b6bd9","resolution":{"observed_at":"2026-08-07T05:53:48.105285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:47.615465Z","title":"Asvspoof 2019: Spoofing countermeasures for the detection of synthesized, converted and replayed speech,","venue":null,"work_id":"7528f672-cba5-4a32-8867-0a23dae3991f","year":2019},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:45.744556Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:722b61d51e44b1cb9c79cdb6f85436b1f41c1fd1637fc04dceb7fba25b686762","observation_id":"9cee30bb-7b37-41d0-ab5e-78f52075e62d","resolution":{"observed_at":"2026-08-07T05:53:47.756321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:47.329851Z","title":"Does audio deepfake detection generalize?","venue":null,"work_id":"fc50123c-d42b-4300-a50e-f269b8357497","year":2022},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:45.943188Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:e309a3d5169f6005e5a3c51f8f9f3adb1d907a0dab9d146a8acabc9bdd415ee4","observation_id":"5d189bd7-4b2e-4152-9824-c8b07c066f67","resolution":{"observed_at":"2026-08-07T05:53:47.455935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:46.833349Z","title":"Wavefake: A data set to facilitate audio deepfake detection,","venue":null,"work_id":"47d0f56d-68dc-4dbd-9b02-7fb4df5a3a9c","year":2021},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:46.177712Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:a5d77372720e8b87fc4d481e417d95ffeba4f9d59488537f9aa5fcf7c294a448","observation_id":"845c7959-fd43-4df2-bc3f-1b4adb6d35b7","resolution":{"observed_at":"2026-08-07T05:53:47.164985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":1,"verified_fuzzy":18},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 1 inbound Pith citation observation for arXiv:2506.06756."}