{"as_of":"2026-08-21T13:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e0b9d16c8d43a24648e6dcdc5a6bd4ed2bd5843c8100f37dbdff05fe6617a694","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T22:26:48.639321Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.04038/citation-record","integrity":"/paper/2501.04038/integrity","json":"/paper/2501.04038/citation-record.json","paper":"/paper/2501.04038"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:48.473283Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.473283Z"},"links":{"citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:d8290c1d4402bb4e58daf1c0547fec4c277abf810c60fd87f7a301ce0c41b65b","observation_id":"0948a95d-ef99-4613-9740-85324cc0caf1","resolution":{"observed_at":"2026-08-10T22:26:48.473283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:48.478966Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.478966Z"},"links":{"citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:79add2456a723ef1dd9a4196b3d836809da8b07be1a658651383850a8e1c4e58","observation_id":"72634278-c22e-4040-9595-45c636c85d7b","resolution":{"observed_at":"2026-08-10T22:26:48.478966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.00496","last_updated":"2018-10-28T14:29:46Z","snapshot_observed_at":"2026-08-16T06:08:36.265981Z","submitted_at":"2018-09-03T08:38:34Z","title":"LRS3-TED: a large-scale dataset for visual speech recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.00496","snapshot_observed_at":"2026-08-10T22:26:48.483748Z","title":"S.; and Zisserman, A","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.483748Z"},"links":{"cited_paper":"/paper/1809.00496","citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:067e52141a08ef86779978e810cab7ae842d3925b2c282449eb03100adb95e65","observation_id":"b16bfd61-0f4d-42e1-8d86-a87c644b4f27","resolution":{"observed_at":"2026-08-10T22:26:48.483748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:49.180444Z","title":null,"venue":null,"work_id":"6f4d972e-f664-4b0c-9e9d-c10b7c7181e4","year":2022},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.488936Z"},"links":{"citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:5bfaf35570f924e2707af34cb996d5ccea80b4d8ae40c90ac643a3e5078fa799","observation_id":"45cbd953-7169-4fd5-a7a0-8b3517124335","resolution":{"observed_at":"2026-08-10T22:26:49.184383Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:49.167116Z","title":"H.; Siniscalchi, S","venue":null,"work_id":"29e1d6d3-a1b7-4c24-8b9b-67cfff073755","year":2023},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.493198Z"},"links":{"citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:5688848d14404d6e7a281c4f31d61e5d1629365c33057d8869702ed740e8be53","observation_id":"a57a8baf-378f-44f6-af7b-0b038e087bab","resolution":{"observed_at":"2026-08-10T22:26:49.171472Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:49.152293Z","title":null,"venue":null,"work_id":"ad880acf-b2b6-471d-bc8f-b1d37dcc6747","year":2023},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.497311Z"},"links":{"citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:093c91bf1ae313fb91d06cfae8d54fc585b59d86151fca1dd418ce48073be2b7","observation_id":"fab4544b-0778-4143-9298-19f8f6b30b87","resolution":{"observed_at":"2026-08-10T22:26:49.157003Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:49.137491Z","title":"M.; Chen, P.; Chng, E.; and Yang, C","venue":null,"work_id":"7dfe5d12-513e-406f-b58c-996c37690e54","year":2024},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.501606Z"},"links":{"citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:a5a9706779bd84ad023f54301e49ae7d3fe5647c6a61713dd56e40e01960fddc","observation_id":"caeba493-5761-452b-b9e7-a2848d281c70","resolution":{"observed_at":"2026-08-10T22:26:49.141655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:49.123687Z","title":null,"venue":null,"work_id":"edd36d6e-0318-4074-b0c5-7be75cd65646","year":1980},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.505705Z"},"links":{"citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:053b435fcb51438ace61b36a6520d476b139f6f1fb57069b17d62d8d7541d561","observation_id":"76990f2a-5fe2-48aa-a741-f4dfb48a894b","resolution":{"observed_at":"2026-08-10T22:26:49.127832Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:49.109028Z","title":null,"venue":null,"work_id":"5e2c95aa-7e53-4744-9f06-65acb6cb524d","year":2024},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.510519Z"},"links":{"citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:67d9e1b023f313bfdee27f2d968a57170519ea83fc96d36ea157b81381c1e7a9","observation_id":"08227805-a755-4032-8a0e-e83fd7b2da7e","resolution":{"observed_at":"2026-08-10T22:26:49.113509Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:49.093879Z","title":"V.; Joulin, A.; and Misra, I","venue":null,"work_id":"9df94275-0bcc-48a0-a068-56e0b74f38b9","year":2023},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.514523Z"},"links":{"citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:dd2df74dc4d4133e3b18f165d4397dfce70d29e6a7b15b1f4f2a598ddadaceaa","observation_id":"1d4d57aa-370e-426f-ab38-63feefa22351","resolution":{"observed_at":"2026-08-10T22:26:49.098076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:49.079180Z","title":null,"venue":null,"work_id":"f7f6002c-7d2f-43aa-b983-63c808bf59e8","year":2020},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.518680Z"},"links":{"citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:18e3aca988191cd8c20e15b6c102ed40c291ff25c3034fa87f3f2c8d5edf57db","observation_id":"0a27f557-dd31-410a-8736-0c8e599e935f","resolution":{"observed_at":"2026-08-10T22:26:49.083833Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:48.522746Z","title":"H.; Lakhotia, K.; Salakhutdinov, R.; and Mohamed, A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.522746Z"},"links":{"citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:aa25ec955c0dc6217f29ebdeaadd4966fafe717630a9c48fe309369eab6f6e8f","observation_id":"c36f7e13-2abd-4cc3-b7a3-f5fc4c1c3bfd","resolution":{"observed_at":"2026-08-10T22:26:48.522746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:49.054637Z","title":"J.; Shen, Y.; Wallis, P.; et al","venue":null,"work_id":"f1cf31d8-e36d-4081-b6d0-13d13cdc3ad7","year":2022},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.526805Z"},"links":{"citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:31e555aed1f1c9cfa2df3bd655ae4d32941b074fb506c3ee06409e4d6e83254c","observation_id":"f59e5fbf-b3c5-4e61-89d9-95a424325dcd","resolution":{"observed_at":"2026-08-10T22:26:49.059585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10025","last_updated":"2024-05-16T12:05:45Z","snapshot_observed_at":"2026-08-16T13:52:12.547831Z","submitted_at":"2024-05-16T12:05:45Z","title":"Listen Again and Choose the Right Answer: A New Paradigm for Automatic Speech Recognition with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.10025","snapshot_observed_at":"2026-08-10T22:26:48.530826Z","title":"S.; and Li, R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.530826Z"},"links":{"cited_paper":"/paper/2405.10025","citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:85d8ce7eeb08aa57821e782f6bfd450c24c9da9d7972ca30709230aab1d7fd14","observation_id":"20b519a7-2a68-4387-a768-4486aabbc06e","resolution":{"observed_at":"2026-08-10T22:26:48.530826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:49.039622Z","title":"H.; Li, R.; Zhang, C.; Chen, P.; and Chng, E","venue":null,"work_id":"84ffae58-428e-4045-be23-0751ee39cfb8","year":2024},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.535755Z"},"links":{"citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:5d27debae9b8fbe8c7426e30fee5f39b7b859c606301d3b89b40c07fa8fe1231","observation_id":"b6b0daf9-619c-4ab6-8f85-629c7590a605","resolution":{"observed_at":"2026-08-10T22:26:49.044513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:49.025205Z","title":null,"venue":null,"work_id":"b4909404-f85f-4b60-9584-ae8e17720daf","year":2009},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.540138Z"},"links":{"citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:6f7cb666aa6b52e684fc26c3c7d382a52c7a23e4b13973b02681c4ea26729563","observation_id":"9af6d4b1-6457-4fdd-ad9c-e43960ae32f8","resolution":{"observed_at":"2026-08-10T22:26:49.029615Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:49.010734Z","title":null,"venue":null,"work_id":"9259fb1c-8292-4302-bab3-e169f69609ff","year":2021},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.544511Z"},"links":{"citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:2bd13f4c1c45654bdb1b8a359bb85a0d7f459ae8ad557c04c8e34c57e3f1e04e","observation_id":"07318304-1591-478c-9f97-de8822927cb9","resolution":{"observed_at":"2026-08-10T22:26:49.015258Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:48.997114Z","title":null,"venue":null,"work_id":"4b294641-d548-4be6-94c3-64cbfab80d18","year":2023},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.548838Z"},"links":{"citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:721862de4aa1d31c206159176cb599b3d172c42dd4a884350ba2ccff1279c322","observation_id":"91689af4-60e5-4ad3-8cb4-c95113d6ab72","resolution":{"observed_at":"2026-08-10T22:26:49.001572Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-10T22:26:48.553054Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.553054Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:8bfc6925c2c14289fae9418829113b6c7147bdb9de468c2206e678ac0963cc2d","observation_id":"eb294242-38d4-4155-a66f-efcf30202f8b","resolution":{"observed_at":"2026-08-10T22:26:48.553054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:48.983261Z","title":null,"venue":null,"work_id":"c89b1db9-5613-439d-9a6a-c7b8b257ddeb","year":2023},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.557644Z"},"links":{"citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:3b0b31dd9ca284c1a9a8e14825c2f374b07faf5bec78cad24916c36e0460bc64","observation_id":"be5252da-ed50-4823-8fa9-e0c26d789ff2","resolution":{"observed_at":"2026-08-10T22:26:48.987679Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:48.968448Z","title":null,"venue":null,"work_id":"0ee5677b-03ab-41c4-b9fb-7905c88357c5","year":2021},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.561993Z"},"links":{"citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:a45731897bf123dc20be0910834361d5d02da010952a6e6208149462efdb301a","observation_id":"c068e348-5da4-4fa7-998f-73e2dbebb098","resolution":{"observed_at":"2026-08-10T22:26:48.973261Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:48.566235Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.566235Z"},"links":{"citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:bb0517824db7a2b8e01791afb1d15bf91bfd3bc5ebfc3583751ac60b38c4cee5","observation_id":"c4ea0cad-f00e-453b-b3aa-1482688fd1db","resolution":{"observed_at":"2026-08-10T22:26:48.566235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:48.946326Z","title":null,"venue":null,"work_id":"10cda736-a382-4bfa-bdc2-c3f78a1a58cd","year":2010},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.570425Z"},"links":{"citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:cc84b6ba8369b5f57bbc00e9333e13debb60d78343f45d77d9e35b09321b0110","observation_id":"db8f0fc4-ebbc-48a7-b296-3315fbbd7900","resolution":{"observed_at":"2026-08-10T22:26:48.950450Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:48.932726Z","title":null,"venue":null,"work_id":"d30001f7-3b27-4033-b460-10062f6b04bd","year":2024},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.574870Z"},"links":{"citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:a5192f879b6bd3d17406eafdc6408753cc65c9489f32717e4695560af00909a9","observation_id":"051b88e8-372c-4625-9b19-d1171513f63b","resolution":{"observed_at":"2026-08-10T22:26:48.936868Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-10T22:26:48.578967Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.578967Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:b12dd22bc90b12f5c0a32c5cf28fa20cefc0c1fca52aa2c9ce9e4d0d0a9d909b","observation_id":"857db12b-7f09-490a-ba45-9d48198e078c","resolution":{"observed_at":"2026-08-10T22:26:48.578967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:48.919333Z","title":"W.; Xu, T.; Brockman, G.; McLeavey, C.; and Sutskever, I","venue":null,"work_id":"b804b256-9d97-4c50-8652-0192c2c1617b","year":2023},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.583490Z"},"links":{"citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:48ffe3d532883ae018c439d0ea7916bb9329814c49b89760a573f2a007dd90dd","observation_id":"5393b4ec-d8f9-47e5-b5ee-8f857d505269","resolution":{"observed_at":"2026-08-10T22:26:48.923961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:48.904444Z","title":"H.; Khan, S","venue":null,"work_id":"3d2ab7a3-ec59-49b5-a83a-7bfa64bed22e","year":2023},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.587726Z"},"links":{"citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:0150ae44e778cdd9739545caf373035ed3f1b9d0149cab6c10ed7d951f5c008c","observation_id":"b0de67b7-af6d-4919-a25f-72edb97fa2f8","resolution":{"observed_at":"2026-08-10T22:26:48.909012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:48.592192Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.592192Z"},"links":{"citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:001177309d89a2f44f5b1d616ef854876b2cf1cf69a9bb57133e799759184c28","observation_id":"3017b61e-73c2-43f3-ae84-c8f1b64d3b4c","resolution":{"observed_at":"2026-08-10T22:26:48.592192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:48.880810Z","title":null,"venue":null,"work_id":"1eb9cae9-63a4-451d-a9ea-30a4d07fb47e","year":2022},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.596531Z"},"links":{"citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:ab79f96708b7403846a103abd0938af0d5f555b6aca792106790bcaf9d2ee10b","observation_id":"a04ccae1-870d-44ae-abc8-82001c7e035e","resolution":{"observed_at":"2026-08-10T22:26:48.885518Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:48.865608Z","title":null,"venue":null,"work_id":"58a2fdc6-1a25-4442-bfed-a3dacde66a64","year":2022},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.600638Z"},"links":{"citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:a51f012e3076b68103bb951b5fefbf50c0aeca882638a35239452edc45e56c48","observation_id":"85ee4bc7-2c55-46f3-ba5b-ae61f0136ff2","resolution":{"observed_at":"2026-08-10T22:26:48.870436Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1510.08484","last_updated":"2015-10-28T20:59:04Z","snapshot_observed_at":"2026-08-18T07:31:38.105834Z","submitted_at":"2015-10-28T20:59:04Z","title":"MUSAN: A Music, Speech, and Noise Corpus","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1510.08484","snapshot_observed_at":"2026-08-10T22:26:48.604967Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.604967Z"},"links":{"cited_paper":"/paper/1510.08484","citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:0cf5f5c52fd362ec940858471831edb851952a1d3e21799eb4071436b4d2a554","observation_id":"911b95ca-64a5-44e9-9ad8-4b2e6e2dabd5","resolution":{"observed_at":"2026-08-10T22:26:48.604967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:48.848526Z","title":null,"venue":null,"work_id":"ae6cb715-1efd-411b-b1a5-cfb056b616e0","year":2024},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.609579Z"},"links":{"citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:6cd91343ae62d99ba8bbcc7608001532d60ae17c8e22801766114f994b0e75ae","observation_id":"44734024-3b81-47ed-a13a-d9339b607e40","resolution":{"observed_at":"2026-08-10T22:26:48.854356Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:48.613438Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.613438Z"},"links":{"citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:9254a62283eef7f193df0339c0162c500259fc81b7ea7ebfb7427a2869df59ef","observation_id":"5ccbc978-bdbf-46db-b01e-4c94ab13a9e9","resolution":{"observed_at":"2026-08-10T22:26:48.613438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-10T22:26:48.617098Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.617098Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:1e68d430d2ccf0978fa52cac4e5a53daf895850500d1a102d8e760add410843f","observation_id":"12bb926b-799c-4020-b21e-b7619bec5d56","resolution":{"observed_at":"2026-08-10T22:26:48.617098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-10T22:26:48.621203Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.621203Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:de93714fa8696b33d2be93643a99eab76fec11ab6dbd0dfb3ce2b953909f0424","observation_id":"7fcbc81d-182a-410b-b9ba-7faad4b1daa5","resolution":{"observed_at":"2026-08-10T22:26:48.621203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:48.625093Z","title":"N.; Kaiser, L.; and Polosukhin, I","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.625093Z"},"links":{"citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:c2818766d33ec9ff6e6f85a69aea4bed828cfd39241a74a43ada6a645eb7c7fe","observation_id":"cec15c7b-c27c-4c91-9cdc-7681c25cfc38","resolution":{"observed_at":"2026-08-10T22:26:48.625093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:48.814840Z","title":null,"venue":null,"work_id":"30e11f83-6b52-4650-a3d1-8d7ffcc87d9b","year":2024},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.628485Z"},"links":{"citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:12860937ddc7e74020dcb42e18ebea3ff4ffdab6c62d314474efbbcd95f7cf78","observation_id":"d6e504f2-dc76-4354-ad75-e6ea66b9abac","resolution":{"observed_at":"2026-08-10T22:26:48.819555Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:48.800083Z","title":null,"venue":null,"work_id":"20d1209b-cdc7-486e-970e-4baf5f9b8510","year":2024},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.631983Z"},"links":{"citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:4a0acbc93f6ce1b9e2404aed6e50888d0b34cebdbc785824f3b8479a12da9539","observation_id":"63818724-5e6f-42cf-a9ca-0049f2a4e571","resolution":{"observed_at":"2026-08-10T22:26:48.804353Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:48.786331Z","title":null,"venue":null,"work_id":"0e0c2ed6-0516-426f-844d-acd4daccddd2","year":2017},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.635534Z"},"links":{"citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:9bc637109f28e76225d839fbc3530c3f8cdff018fee5dcf24d7ec2c5e19319d7","observation_id":"48269275-b93f-4445-9e47-e3d7c960e4c4","resolution":{"observed_at":"2026-08-10T22:26:48.790367Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:48.771150Z","title":null,"venue":null,"work_id":"4e256a71-b351-4820-9bc9-d2cf6a79eb3a","year":2023},"citing_paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-10T22:26:48.639321Z"},"links":{"citing_paper":"/paper/2501.04038"},"observation_digest":"sha256:18dc0d8a9c3922f383eb2fc810bdccfb0178bc5ec6924bc09148895b4d913578","observation_id":"8869cdde-64b1-4bd1-bdb1-a2c6ad4b654a","resolution":{"observed_at":"2026-08-10T22:26:48.776301Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.04038","last_updated":"2025-01-03T10:51:14Z","latest_version":1,"primary_category":"cs.MM","snapshot_observed_at":"2026-08-18T12:58:32.832037Z","submitted_at":"2025-01-03T10:51:14Z","title":"Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":33,"verified_exact":0,"verified_fuzzy":7},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 0 inbound Pith citation observations for arXiv:2501.04038."}