{"as_of":"2026-08-09T23:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bf862d2836f79e7eaf70b2989bdc7e146f55d717673a56c6e38524b03e120151","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T22:51:31.056461Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T13:34:41.197838Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2308.13382","last_updated":"2024-11-26T16:37:36Z","snapshot_observed_at":"2026-08-09T12:56:13.219816Z","submitted_at":"2023-08-25T13:52:05Z","title":"Prompting Visual-Language Models for Dynamic Facial Expression Recognition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.13382","snapshot_observed_at":"2026-08-09T22:51:31.056461Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18698","last_updated":"2025-01-30T19:00:40Z","snapshot_observed_at":"2026-08-09T22:45:32.063219Z","submitted_at":"2025-01-30T19:00:40Z","title":"Human Re-ID Meets LVLMs: What can we expect?","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T22:51:31.056461Z"},"links":{"cited_paper":"/paper/2308.13382","citing_paper":"/paper/2501.18698"},"observation_digest":"sha256:a5875f302e27f350941cf2d96bcaf2074573150b71043c630abcd9b21791ef38","observation_id":"aa6d9425-d244-43c2-a2a8-5c22aa3d676b","resolution":{"observed_at":"2026-08-09T22:51:31.056461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.13382","last_updated":"2024-11-26T16:37:36Z","snapshot_observed_at":"2026-08-09T12:56:13.219816Z","submitted_at":"2023-08-25T13:52:05Z","title":"Prompting Visual-Language Models for Dynamic Facial Expression Recognition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.13382","snapshot_observed_at":"2026-08-09T18:23:41.166617Z","title":"Prompting visual-language models for dynamic facial expression recognition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06803","last_updated":"2025-02-02T00:11:19Z","snapshot_observed_at":"2026-08-09T18:19:06.768922Z","submitted_at":"2025-02-02T00:11:19Z","title":"Emotion Recognition and Generation: A Comprehensive Review of Face, Speech, and Text Modalities","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-09T18:23:41.166617Z"},"links":{"cited_paper":"/paper/2308.13382","citing_paper":"/paper/2502.06803"},"observation_digest":"sha256:c70a074467da7dff02d073e5a257e527c87bed50b33a68bfafeb776a12a3444d","observation_id":"01de7f38-3907-49f1-b182-c983e09764a2","resolution":{"observed_at":"2026-08-09T18:23:41.166617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.13382","last_updated":"2024-11-26T16:37:36Z","snapshot_observed_at":"2026-08-09T12:56:13.219816Z","submitted_at":"2023-08-25T13:52:05Z","title":"Prompting Visual-Language Models for Dynamic Facial Expression Recognition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.13382","snapshot_observed_at":"2026-08-06T22:40:35.570153Z","title":"Prompting visual- language models for dynamic facial expression recognition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.21017","last_updated":"2025-06-26T05:28:57Z","snapshot_observed_at":"2026-08-09T12:56:31.068560Z","submitted_at":"2025-06-26T05:28:57Z","title":"Multimodal Prompt Alignment for Facial Expression Recognition","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T22:40:35.570153Z"},"links":{"cited_paper":"/paper/2308.13382","citing_paper":"/paper/2506.21017"},"observation_digest":"sha256:39a10dde85d93e5c67d33a37c5298851883520dc781bd5f296de33f51c373160","observation_id":"677e79e5-8e6a-406b-b553-ebddedc8522d","resolution":{"observed_at":"2026-08-06T22:40:35.570153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.13382","last_updated":"2024-11-26T16:37:36Z","snapshot_observed_at":"2026-08-09T12:56:13.219816Z","submitted_at":"2023-08-25T13:52:05Z","title":"Prompting Visual-Language Models for Dynamic Facial Expression Recognition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.13382","snapshot_observed_at":"2026-08-06T17:08:52.937811Z","title":"Prompting visual-language models for dynamic facial expression recognition,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11892","last_updated":"2025-07-16T04:15:06Z","snapshot_observed_at":"2026-08-08T13:08:04.289398Z","submitted_at":"2025-07-16T04:15:06Z","title":"From Coarse to Nuanced: Cross-Modal Alignment of Fine-Grained Linguistic Cues and Visual Salient Regions for Dynamic Emotion Recognition","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T17:08:52.937811Z"},"links":{"cited_paper":"/paper/2308.13382","citing_paper":"/paper/2507.11892"},"observation_digest":"sha256:c521b2db6c8204780b7042a605d8518ef28e7424ec0bacdc1f0ef83206fb227b","observation_id":"0e0c819f-6ba6-426b-852d-26ab597a8c06","resolution":{"observed_at":"2026-08-06T17:08:52.937811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.13382","last_updated":"2024-11-26T16:37:36Z","snapshot_observed_at":"2026-08-09T12:56:13.219816Z","submitted_at":"2023-08-25T13:52:05Z","title":"Prompting Visual-Language Models for Dynamic Facial Expression Recognition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.13382","snapshot_observed_at":"2026-08-06T12:08:01.865910Z","title":"Prompting visual-language models for dynamic facial expression recognition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.22100","last_updated":"2025-07-29T17:59:16Z","snapshot_observed_at":"2026-08-09T12:56:56.544287Z","submitted_at":"2025-07-29T17:59:16Z","title":"Trade-offs in Image Generation: How Do Different Dimensions Interact?","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T12:08:01.865910Z"},"links":{"cited_paper":"/paper/2308.13382","citing_paper":"/paper/2507.22100"},"observation_digest":"sha256:53a397145c9df91fb0fd9305ea0fbbc39f4343bd7b7cf8896559a93373d02282","observation_id":"03fdbb8e-3fae-4115-a3c0-29851d8e9adc","resolution":{"observed_at":"2026-08-06T12:08:01.865910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.13382","last_updated":"2024-11-26T16:37:36Z","snapshot_observed_at":"2026-08-09T12:56:13.219816Z","submitted_at":"2023-08-25T13:52:05Z","title":"Prompting Visual-Language Models for Dynamic Facial Expression Recognition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.13382","snapshot_observed_at":"2026-08-05T23:49:21.013487Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-09T12:56:30.460982Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:21.013487Z"},"links":{"cited_paper":"/paper/2308.13382","citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:f6783d95067fb379b6a98f9b127fa374a0e5196e6a7e89b27cd21bc72678b154","observation_id":"324ea9f0-0661-4602-b9a0-308fc3716c49","resolution":{"observed_at":"2026-08-05T23:49:21.013487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.13382","last_updated":"2024-11-26T16:37:36Z","snapshot_observed_at":"2026-08-09T12:56:13.219816Z","submitted_at":"2023-08-25T13:52:05Z","title":"Prompting Visual-Language Models for Dynamic Facial Expression Recognition","version":3},"cited_work":{"arxiv_id":"2308.13382","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.13382","snapshot_observed_at":"2026-06-30T13:34:41.197838Z","title":"Prompting visual-language models for dynamic facial expression recognition","venue":null,"work_id":"8e5187bb-dc8b-494b-a958-3c5c650ed315","year":2023},"citing_paper":{"arxiv_id":"2604.25255","last_updated":"2026-04-28T06:02:23Z","snapshot_observed_at":"2026-07-06T23:11:07.254460Z","submitted_at":"2026-04-28T06:02:23Z","title":"Personalized Cross-Modal Emotional Correlation Learning for Speech-Preserving Facial Expression Manipulation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-07T17:02:44.776943Z"},"links":{"cited_paper":"/paper/2308.13382","citing_paper":"/paper/2604.25255"},"observation_digest":"sha256:f804e604d6b80dbe179b53ef68f5abd67a860feffa5539e5765b49d5fe0cf204","observation_id":"0e75ba74-84c4-484b-8b67-4884e117d416","resolution":{"observed_at":"2026-05-11T23:26:13.729503Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.13382","last_updated":"2024-11-26T16:37:36Z","snapshot_observed_at":"2026-08-09T12:56:13.219816Z","submitted_at":"2023-08-25T13:52:05Z","title":"Prompting Visual-Language Models for Dynamic Facial Expression Recognition","version":3},"cited_work":{"arxiv_id":"2308.13382","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.13382","snapshot_observed_at":"2026-06-30T13:34:41.197838Z","title":"Prompting visual-language models for dynamic facial expression recognition","venue":null,"work_id":"8e5187bb-dc8b-494b-a958-3c5c650ed315","year":2023},"citing_paper":{"arxiv_id":"2606.30611","last_updated":"2026-07-07T11:48:54Z","snapshot_observed_at":"2026-07-12T10:31:48.561551Z","submitted_at":"2026-06-29T17:46:10Z","title":"Reweighting Framewise Attention in Video Transformers for Facial Expression Understanding","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-06-30T05:54:24.767848Z"},"links":{"cited_paper":"/paper/2308.13382","citing_paper":"/paper/2606.30611"},"observation_digest":"sha256:1760a3896d3e6aaffb8918517f201e8fb18b47940be457d5650b824a362aa424","observation_id":"2bc64476-ceaa-4956-81c6-df660dfc54b1","resolution":{"observed_at":"2026-06-30T13:34:41.199336Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.13382","last_updated":"2024-11-26T16:37:36Z","snapshot_observed_at":"2026-08-09T12:56:13.219816Z","submitted_at":"2023-08-25T13:52:05Z","title":"Prompting Visual-Language Models for Dynamic Facial Expression Recognition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.13382","snapshot_observed_at":"2026-07-12T10:31:49.351169Z","title":"arXiv preprint arXiv:2308.13382 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.30611","last_updated":"2026-07-07T11:48:54Z","snapshot_observed_at":"2026-07-12T10:31:48.561551Z","submitted_at":"2026-06-29T17:46:10Z","title":"Reweighting Framewise Attention in Video Transformers for Facial Expression Understanding","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-07-12T10:31:49.351169Z"},"links":{"cited_paper":"/paper/2308.13382","citing_paper":"/paper/2606.30611"},"observation_digest":"sha256:f2679ebd15adf714f606117fd11a5b1362d34bc933d0f58e217d76d59ed36698","observation_id":"ffbbb82c-3ad8-4c7d-88bf-fcbddd551468","resolution":{"observed_at":"2026-07-12T10:31:49.351169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2308.13382/citation-record","integrity":"/paper/2308.13382/integrity","json":"/paper/2308.13382/citation-record.json","paper":"/paper/2308.13382"},"outbound":[],"paper":{"arxiv_id":"2308.13382","last_updated":"2024-11-26T16:37:36Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T12:56:13.219816Z","submitted_at":"2023-08-25T13:52:05Z","title":"Prompting Visual-Language Models for Dynamic Facial Expression Recognition"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 9 inbound Pith citation observations for arXiv:2308.13382."}