{"as_of":"2026-08-09T15:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f1e8e463010f864e8047aaa92f83cb2aede54398815d82496a9618f6e7ec227f","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:35:57.326726Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.07572/citation-record","integrity":"/paper/2506.07572/integrity","json":"/paper/2506.07572/citation-record.json","paper":"/paper/2506.07572"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.574274Z","title":null,"venue":null,"work_id":"ff0adebe-6a4b-4974-a0bc-e8ee86e19592","year":2019},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:56.960283Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:cfdf41e1e89e336c245c05cc88e832e565fc7a6fa9585981515716446cfefe2a","observation_id":"0b3ef035-a2a0-4a9a-ba76-5bd9af8c5264","resolution":{"observed_at":"2026-08-07T05:35:58.580868Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.550035Z","title":null,"venue":null,"work_id":"3c878251-c540-4f3e-b875-09309cbf46f0","year":2023},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:56.969435Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:26d38458c1a711988258339ae96318f04bb54fdfe5cdd00941446fb11d737b1e","observation_id":"b80dcea8-853a-4e6d-b407-fc75b7d3bd52","resolution":{"observed_at":"2026-08-07T05:35:58.556732Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.528863Z","title":null,"venue":null,"work_id":"110b127a-a201-4db2-8b1a-ee8bcd9b7b0f","year":2018},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:56.975377Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:907f62ae7ba9c4467b164fe568e9a896965911f2022cd3dbe43aacb1efff3f55","observation_id":"0cd3e3e5-62ef-4f2d-ab26-b5b34cc04185","resolution":{"observed_at":"2026-08-07T05:35:58.534401Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.01599","last_updated":"2016-12-16T16:09:34Z","snapshot_observed_at":"2026-07-06T05:17:29.499249Z","submitted_at":"2016-11-05T04:05:18Z","title":"LipNet: End-to-End Sentence-level Lipreading","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.01599","snapshot_observed_at":"2026-08-07T05:35:56.980880Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:56.980880Z"},"links":{"cited_paper":"/paper/1611.01599","citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:d4d1de50128e1a6c9babbc60b3cd695327562b4a7ef182c23bd29abdd3cc107f","observation_id":"c9bb44bd-82c2-4f27-96e4-046cb96642a6","resolution":{"observed_at":"2026-08-07T05:35:56.980880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.508290Z","title":null,"venue":null,"work_id":"6ac8be7b-2463-485b-b10e-b06a3a18dc7f","year":2020},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:56.988541Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:bf9e3c870e614635d5f1adafecf0e11200a44c43d7d138ee17e96cb871a0cf88","observation_id":"e7789c80-4848-4c27-acd6-9db5755cba9e","resolution":{"observed_at":"2026-08-07T05:35:58.514300Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.484268Z","title":null,"venue":null,"work_id":"853b29d9-5c8f-4cee-8b6c-5488cb7f4dfa","year":2023},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:56.996463Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:17417269a728b447fabf35d15bb1bc27eaa55303f9a4a5eec8956469e8481346","observation_id":"c85442e2-91dd-4ac4-a58c-c42e9b959f56","resolution":{"observed_at":"2026-08-07T05:35:58.489812Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.467496Z","title":null,"venue":null,"work_id":"232ea013-9b12-4236-a0fc-6b33f022d552","year":2024},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.003255Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:4d099d069f9bcaa4ef0a5724d52732074bb9cf13cd9faf666b7503ef97ca362c","observation_id":"abc88cec-3986-4956-9208-ace52b7ee11b","resolution":{"observed_at":"2026-08-07T05:35:58.472335Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.449860Z","title":null,"venue":null,"work_id":"4fe53e48-b808-4bd7-b2ef-ecaa22113995","year":2020},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.009711Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:5b6d7ab924fb12eaf49bbd86f17c254edd0da604bbafe64179569e910f6d3c2d","observation_id":"9e397b37-f5f6-4500-b45f-b6f7a6e8d71e","resolution":{"observed_at":"2026-08-07T05:35:58.454996Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.014580Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.014580Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:20028be3ee29d958ec650ac39d1c965f87f842250f92650e0c82ad209deffa59","observation_id":"b2da07c0-a828-4440-828f-77d2dc606f47","resolution":{"observed_at":"2026-08-07T05:35:57.014580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.410768Z","title":null,"venue":null,"work_id":"08c7bbfc-7fdb-43ad-8e26-53dd19e98164","year":2017},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.027180Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:652e9ac8e207a7bf9fc543ae4fa15120aab96fc9aba3f5b0fd6b425d53c393a8","observation_id":"8e78830e-ef28-4e1b-9ee0-7fd7f6933fba","resolution":{"observed_at":"2026-08-07T05:35:58.416223Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.387383Z","title":null,"venue":null,"work_id":"580dee86-fb0f-4826-a148-c0249c44826e","year":2006},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.034570Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:29fdd10970f6bcbe67b6cc781775ba5607d43d38b016540a9e2586c6b8015859","observation_id":"31d8d772-5183-481f-9067-37e786f5fb95","resolution":{"observed_at":"2026-08-07T05:35:58.394156Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.369654Z","title":null,"venue":null,"work_id":"202909b7-6460-4ee0-885f-d0d6d1e40d82","year":2021},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.041246Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:29201f5fea7f03c7ef0ca49139bbb270c86bf18c0a14401cb5ac9ed1bf0b7875","observation_id":"65603e4e-06a2-4da2-a34a-0676af7a8efc","resolution":{"observed_at":"2026-08-07T05:35:58.375177Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.11097","last_updated":"2021-06-21T13:30:33Z","snapshot_observed_at":"2026-08-04T10:19:49.212509Z","submitted_at":"2021-06-21T13:30:33Z","title":"CLIP2Video: Mastering Video-Text Retrieval via Image CLIP","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.11097","snapshot_observed_at":"2026-08-07T05:35:57.052410Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.052410Z"},"links":{"cited_paper":"/paper/2106.11097","citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:87c175171ccb0cac4777bcbc57a4f96dcbc7cb3b82ea3a47e3f2d3e53540a03d","observation_id":"ddea426d-f18b-44c0-99df-70fe5494a31e","resolution":{"observed_at":"2026-08-07T05:35:57.052410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.062052Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.062052Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:69e94de7728a29cca4bd8f3bd25335e3b636ce22123f2e629ed88de985683489","observation_id":"7e9c7e05-9f8b-4055-99cd-18c7ef5f6d0f","resolution":{"observed_at":"2026-08-07T05:35:57.062052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.341428Z","title":null,"venue":null,"work_id":"a4fa16a9-d8f8-4763-b394-9420070bd6e3","year":2024},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.067105Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:747ecff7c45761e11e6abdc7c46ea62430dfff29dd4be2776b2d42cd83316a2e","observation_id":"fabbdd1c-2fb6-44f4-a3fc-330f544fee72","resolution":{"observed_at":"2026-08-07T05:35:58.346521Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.324041Z","title":null,"venue":null,"work_id":"b28879e4-0f2a-4391-8a36-c201f3af4868","year":2021},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.074813Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:33be2441eedf67f3a2080b5cf3c0adf29b8f6503bc052485b25e68719e559ccf","observation_id":"5b64ae1d-d4fa-425b-9fd6-67dc28535db9","resolution":{"observed_at":"2026-08-07T05:35:58.329440Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.302621Z","title":null,"venue":null,"work_id":"4eebfe26-22b7-445c-8e33-d20ab60080c1","year":2022},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.080027Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:800195a5d73e86934e6c1decc1ec1da1c896a2205d9f80d8f6a82696d32c5acd","observation_id":"fa5bfc9e-ee28-4797-a65e-cce01337923a","resolution":{"observed_at":"2026-08-07T05:35:58.309187Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.156476Z","title":null,"venue":null,"work_id":"611410b3-9b0c-4f20-a06e-bca5450de324","year":2023},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.088265Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:9c3d72d500e979c4183149d3116a90f7690e1749e8d46438294487c690e72d3b","observation_id":"53b664c2-62ca-435d-9da8-69db3c71243c","resolution":{"observed_at":"2026-08-07T05:35:58.161373Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.140391Z","title":null,"venue":null,"work_id":"fa9db0a4-d00f-4be7-995b-096b47dbcb24","year":2019},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.095984Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:12c46f12001bf282922f875117148b2045ad2630409093ab0bbade2186cb330f","observation_id":"bf648cfb-dacd-402a-a849-e20e7654c246","resolution":{"observed_at":"2026-08-07T05:35:58.145668Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.123076Z","title":null,"venue":null,"work_id":"6f71bcae-84fb-47db-a559-ea129b375fb0","year":2023},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.103348Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:94413f9a4ce1fde5c29ae50f66517e52cf06210fd3a69808ad1aedab4cd76d5d","observation_id":"a4251c64-03ba-4e4a-91af-03f5ed8a92fe","resolution":{"observed_at":"2026-08-07T05:35:58.128848Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.103200Z","title":null,"venue":null,"work_id":"8c7c0f6d-9294-4fe6-a1ea-156431299105","year":2023},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.113932Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:d07e2246b6781d8d19541174329b2c62cb1d6f950d446e27665eae3620984be4","observation_id":"4da2dbbb-bc38-42d3-ac50-aa998010b9c4","resolution":{"observed_at":"2026-08-07T05:35:58.111984Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.085013Z","title":null,"venue":null,"work_id":"8f068b8e-bf28-417f-870a-13347d6330e7","year":2022},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.120182Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:1311ccb37e29ac9dca9f7c86b1d28d89607f4ede83191a0f4684e1544ec793b5","observation_id":"f9b4c42e-f2c1-42c8-8bdc-1196f03ac982","resolution":{"observed_at":"2026-08-07T05:35:58.092139Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.126826Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.126826Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:d7da1f98f1a68a242aec6f45933ea51d0fb970ba9587233f104a02b0b7dd2c06","observation_id":"354074a8-8b33-4d52-8d9c-a61dbf87c34e","resolution":{"observed_at":"2026-08-07T05:35:57.126826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.030988Z","title":null,"venue":null,"work_id":"30848d60-87e7-4a8c-b6c5-12a5d7f563a3","year":2023},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.132725Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:fb741f08cdbf252aa9bbf5d624bcc9f44ede8a61e0ca97ce66892b78f3882a20","observation_id":"26f32afd-70d9-4b81-a80b-5971775465af","resolution":{"observed_at":"2026-08-07T05:35:58.035865Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.010593Z","title":null,"venue":null,"work_id":"a0a36eaf-ddc1-4840-9330-d04f62fda219","year":2021},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.137783Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:8a2a908c7f527b702235970c4ea92ea66c65c207df0535724f8eb5fa2b407292","observation_id":"fbde422b-b935-4902-896c-062ddf7c6141","resolution":{"observed_at":"2026-08-07T05:35:58.017813Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.992127Z","title":null,"venue":null,"work_id":"8bdd8e43-6d9b-4fe8-9289-e597a876134e","year":2022},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.144032Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:7ea9af5964db64d80daea658204761911daf1c83df1154f407bce01e90ed3c6d","observation_id":"470d7524-a7df-4035-9519-f202c9e2d9e6","resolution":{"observed_at":"2026-08-07T05:35:57.997224Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.150222Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.150222Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:b288b5750184a3d27c3c26496af0cdbf28a1474cf1f4cbeb6adb60a058e4bf59","observation_id":"dea5fec2-ace0-4fb2-8d48-b8b1ce230063","resolution":{"observed_at":"2026-08-07T05:35:57.150222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.961096Z","title":null,"venue":null,"work_id":"62c2c3d9-9863-4266-a46b-da3cbed34f9a","year":2020},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.160237Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:4648c129e65aeef3b0a560a967884f7dc48bd2bd7fa0fa4441eef98c80fb8777","observation_id":"1590cc6e-bee8-4c78-acd3-b7ef5947cf43","resolution":{"observed_at":"2026-08-07T05:35:57.966223Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.943309Z","title":null,"venue":null,"work_id":"86d668b7-6275-4768-a5be-36df505d8132","year":null},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.166985Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:b76c1df7131f61aecf1e6db1871ddb2543bbba9128fb6a89db9152c81b331b66","observation_id":"f101179c-c06e-4d35-8e72-19cb76eefe9c","resolution":{"observed_at":"2026-08-07T05:35:57.948515Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.908778Z","title":null,"venue":null,"work_id":"13aed5e8-daed-45dd-92ab-31a68ced6952","year":2018},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.179138Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:1f0509fa1c98fec1d07a0026b8b1750ab591b49de7e2f359537dc9594287aea6","observation_id":"d4eae0de-f472-420a-b300-8d3a18106131","resolution":{"observed_at":"2026-08-07T05:35:57.914080Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.890151Z","title":null,"venue":null,"work_id":"b783e0df-5f11-4306-8d42-eb92b069b3fe","year":2022},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.184406Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:28e3f47b4158daedf0280fb49866fa643a1fcb4fe990ab54a43e7aa6b4c6f1ac","observation_id":"1121a258-68b8-4379-aa67-9667fe426e95","resolution":{"observed_at":"2026-08-07T05:35:57.895640Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.870692Z","title":null,"venue":null,"work_id":"f15809d4-2adc-42f7-abb7-3647c1676291","year":2022},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.191716Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:c25c884f9b94e7a82019b69ef19cb664cef260aba165ec4cd512287c75f2b60c","observation_id":"a427b2e4-1dbc-4b90-bfaf-0f81da41ddb1","resolution":{"observed_at":"2026-08-07T05:35:57.877689Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.197083Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.197083Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:cf898958d9289d5ea45e4b8c706f1800962fdc1f4f05d9e25cd8d6a2449e166e","observation_id":"bc88e370-ae07-4c56-b150-052dc579e460","resolution":{"observed_at":"2026-08-07T05:35:57.197083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.206670Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.206670Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:f8a309034a1f9fa7ab510638a23776a32a4d126708256f947f3f51e106135340","observation_id":"2f00fa71-bf0a-40e1-a958-44b21f792384","resolution":{"observed_at":"2026-08-07T05:35:57.206670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.813339Z","title":null,"venue":null,"work_id":"059f8da1-b3ca-4fcb-9aea-962dcb8286af","year":2021},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.215069Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:f0d6cad74bc5444935120bc7c4ef204548e25dcd00ab8314c25c59d5ebe1b9a1","observation_id":"788fa52f-9162-4cff-b176-f60d626a90e5","resolution":{"observed_at":"2026-08-07T05:35:57.820128Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.220366Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.220366Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:cf19ea9083c43ef33302bf48b3f5e6cff408098be0ba4e07b9d356f68b9e3446","observation_id":"90ea609c-e7db-445b-95e1-9e6921c11286","resolution":{"observed_at":"2026-08-07T05:35:57.220366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.225611Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.225611Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:06da21006e0555155f79f84037c66abf7862d010ed925f31547b50a0951654be","observation_id":"dc1ffd32-9edc-4a41-9024-22be2e53a4e1","resolution":{"observed_at":"2026-08-07T05:35:57.225611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.230588Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.230588Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:f9f6881d2f0d69230d4862c781150bfcc95a9c7b7a71331e6fa9f451d1224a2e","observation_id":"70918cf4-e3e9-4637-8ffa-0d87187c536b","resolution":{"observed_at":"2026-08-07T05:35:57.230588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.712534Z","title":null,"venue":null,"work_id":"8e6b4027-cc15-4cb5-9c54-909ed23f229b","year":2022},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.235321Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:76a5bde8c17976d37bdea83472839964bf444ce8382987b3fde54dade4140106","observation_id":"5d9ee621-5a46-44e1-8d09-c277063db70c","resolution":{"observed_at":"2026-08-07T05:35:57.725394Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.692580Z","title":null,"venue":null,"work_id":"c3151e91-92c9-4196-a395-7292bf0634e3","year":2020},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.242431Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:086b3647f7da182d3127fc8ec4c284ed22739ecbb49186ffab46654d52124304","observation_id":"c322f1d2-07ee-4fde-a948-149938f1d50a","resolution":{"observed_at":"2026-08-07T05:35:57.698413Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.674854Z","title":null,"venue":null,"work_id":"b108bcf8-551f-4dd2-9022-4a0d25f44bf8","year":null},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.249202Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:105a26404206b1802e85ad48ff8732ca0b3c6eef274ad378b46dc392f8ae3e8f","observation_id":"1169788e-b549-4365-b5ba-34f8f7ec2c89","resolution":{"observed_at":"2026-08-07T05:35:57.680512Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.622397Z","title":null,"venue":null,"work_id":"e878d638-6b77-4a89-a2ad-a39caca6edf8","year":2018},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.260282Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:ce4f60ee2045eadbd9d358942cbebed02f4e66e06dc35a6402b9f3ee4f630fff","observation_id":"89820a97-ee12-410d-9b46-9821a2bda3ce","resolution":{"observed_at":"2026-08-07T05:35:57.631626Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.599839Z","title":null,"venue":null,"work_id":"81aa04e8-7c53-4fa1-b115-1d6a55620daf","year":2023},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.266797Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:44fd3579e78e79a6a6c95ab1d5ced5044d4b10039cbd3c0a30b6ddcf4b26d304","observation_id":"715009ab-048d-48f2-baa6-6c8494bdc026","resolution":{"observed_at":"2026-08-07T05:35:57.606362Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.565632Z","title":null,"venue":null,"work_id":"b125a1f3-dc36-4050-ad40-c69826f9537e","year":2023},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.274968Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:001a555ca677c5a77f23a63b279b5369b7a75ae12ea7083f4388b1f09a0aec60","observation_id":"e7875f2b-c96e-4309-afb2-e7f681e95ea4","resolution":{"observed_at":"2026-08-07T05:35:57.580080Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.545816Z","title":null,"venue":null,"work_id":"e0e48e9c-7a44-438a-8063-711c8532e841","year":null},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.280993Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:b3e25ead2180e4e2e355da0d60a4260b16f28da9c1ad19b058fcf73a81ec96eb","observation_id":"66c76283-e477-46eb-a299-217b0738fed5","resolution":{"observed_at":"2026-08-07T05:35:57.552253Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.525387Z","title":null,"venue":null,"work_id":"3e6ad2d0-ae5a-4958-99c4-0b56814ff14f","year":2024},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.300082Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:685ae7d7339fadef417e7a71cf4caf2d118021ac4a3107a9cf711973728469ae","observation_id":"4862a76f-6345-4997-82e5-77eb5a6ebb4f","resolution":{"observed_at":"2026-08-07T05:35:57.531427Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.495086Z","title":null,"venue":null,"work_id":"c8fa9fc8-f49e-41d0-905e-ad5c52bddc9e","year":2019},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.307772Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:091819381f3a94f76eca00039e0f6edcd201d5af7c78f7e9bf22d7c1721518a9","observation_id":"08a41abf-da37-4fcc-aaa3-ea388fa2ae5b","resolution":{"observed_at":"2026-08-07T05:35:57.504716Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.472094Z","title":null,"venue":null,"work_id":"b2f38df0-3377-490a-860e-23e5a9114b39","year":2019},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.316431Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:86a25d52fdf495e0f876bb75f55bf58ba791bfe1779efcfbe20a8fde4a7b296d","observation_id":"2f895f5b-1aa1-4b15-8599-77b26ff499b0","resolution":{"observed_at":"2026-08-07T05:35:57.478434Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.326726Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.326726Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:d017ff9c9959ec33e2b475c5651ab162d95b46726c636557d58ccd65a6b68fc8","observation_id":"8b76feed-3495-4390-ab03-ba5b351b4b50","resolution":{"observed_at":"2026-08-07T05:35:57.326726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v33i01.33019211","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.381143Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence 33, 01 (Jul","venue":null,"work_id":"86652c4b-b4e0-47ff-9ff2-50d9cf456a9f","year":2019},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.289490Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:f2c49b334f3eecd720ca51e871f6c932a656362b5d57313b3c7413696253dd03","observation_id":"7ac54ca7-8f25-4f03-a85b-b8a5d06388f7","resolution":{"observed_at":"2026-08-07T05:35:57.389052Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.927318Z","title":"In Computer Vision–ECCV 2020: 16th European Conference, Glasgow, UK, August 23–28, 2020, Proceedings, Part II 16","venue":null,"work_id":"3fb0d236-e9bc-4096-af62-92a546e45b2a","year":2020},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.174169Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:45cde6f048982f9a0d156d8c5dde623c9d40a958a0d1a54d9006a49842ca8057","observation_id":"1a5aad98-d0ee-4af2-9923-9b6387c2fd41","resolution":{"observed_at":"2026-08-07T05:35:57.932506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.655799Z","title":"In Proceedings of the IEEE/CVF international conference on computer vision","venue":null,"work_id":"9736c518-d492-4b22-8b8d-a0b9a097d02d","year":null},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.254754Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:5ea5f22d544cd216c705fa919a59db5f6f902e72725eb60f5b256c4232d05d66","observation_id":"56706786-c0ea-45a4-b220-c1fef049b257","resolution":{"observed_at":"2026-08-07T05:35:57.661819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.019896Z","title":"In Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.019896Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:02573bcffae31b014e3db05ecd47bee1722ca5e80a8429145969f9483861872d","observation_id":"91e59231-572b-4ca6-997d-06fbffa0973c","resolution":{"observed_at":"2026-08-07T05:35:57.019896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T11:28:11.758236Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":50,"verified_exact":1,"verified_fuzzy":2},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 0 inbound Pith citation observations for arXiv:2506.07572."}