{"as_of":"2026-08-10T08:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bcfee05af4aa692950e491049fea281e898688c07da9f6a7c8977b0b27f677d9","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T03:10:38.745341Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.09417/citation-record","integrity":"/paper/2607.09417/integrity","json":"/paper/2607.09417/citation-record.json","paper":"/paper/2607.09417"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.11730","last_updated":"2026-07-05T12:30:14Z","snapshot_observed_at":"2026-08-01T01:32:02.953108Z","submitted_at":"2026-04-13T17:05:38Z","title":"Multimodal Ambivalence/Hesitancy Recognition in Videos for Personalized Digital Health Interventions","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.11730","snapshot_observed_at":"2026-07-13T03:10:38.745341Z","title":"Multimodal ambivalence/hesitancy recognition in videos for personalized digital health interventions.arXiv preprint arXiv:2604.11730, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.09417","last_updated":"2026-07-10T13:48:35Z","snapshot_observed_at":"2026-08-08T08:38:40.209574Z","submitted_at":"2026-07-10T13:48:35Z","title":"SVF-CR: Synchronized Visual-Facial Cross-Refinement for Multimodal Ambivalence and Hesitancy Recognition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-13T03:10:38.745341Z"},"links":{"cited_paper":"/paper/2604.11730","citing_paper":"/paper/2607.09417"},"observation_digest":"sha256:43756b9559603391958df623d943861ae14a998812c8d3f0db95a49acfbfd7a7","observation_id":"667f7e2c-ed4f-4fb7-aaad-5ed1598c46b4","resolution":{"observed_at":"2026-07-13T03:10:38.745341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:10:38.745341Z","title":"Nonverbal behavior in clinician—patient interaction","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2607.09417","last_updated":"2026-07-10T13:48:35Z","snapshot_observed_at":"2026-08-08T08:38:40.209574Z","submitted_at":"2026-07-10T13:48:35Z","title":"SVF-CR: Synchronized Visual-Facial Cross-Refinement for Multimodal Ambivalence and Hesitancy Recognition","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-13T03:10:38.745341Z"},"links":{"citing_paper":"/paper/2607.09417"},"observation_digest":"sha256:f0a43195754e5d813caa1bc312ed450aec7abd0c00e5dcd9f855cb3fe28e237c","observation_id":"8d43a031-0a57-4ec4-991a-1e1ca42b84a6","resolution":{"observed_at":"2026-07-13T03:10:38.745341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:10:38.745341Z","title":"Methods to assess ambivalence towards food and diet: a scoping review.Journal of Human Nutrition and Dietetics, 36(5): 2010–2025, 2023","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.09417","last_updated":"2026-07-10T13:48:35Z","snapshot_observed_at":"2026-08-08T08:38:40.209574Z","submitted_at":"2026-07-10T13:48:35Z","title":"SVF-CR: Synchronized Visual-Facial Cross-Refinement for Multimodal Ambivalence and Hesitancy Recognition","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-13T03:10:38.745341Z"},"links":{"citing_paper":"/paper/2607.09417"},"observation_digest":"sha256:43c3fdf48abd7c1160fa5f287077c4c797764870767b4a2ca978b8286dd41a4f","observation_id":"049c35d1-401e-43e0-bc98-1d6c7f14ae20","resolution":{"observed_at":"2026-07-13T03:10:38.745341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:10:38.745341Z","title":"Understanding and predicting health behaviour change: a contemporary view through the lenses of meta-reviews.Health psychology review, 14(1):1–5, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.09417","last_updated":"2026-07-10T13:48:35Z","snapshot_observed_at":"2026-08-08T08:38:40.209574Z","submitted_at":"2026-07-10T13:48:35Z","title":"SVF-CR: Synchronized Visual-Facial Cross-Refinement for Multimodal Ambivalence and Hesitancy Recognition","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-13T03:10:38.745341Z"},"links":{"citing_paper":"/paper/2607.09417"},"observation_digest":"sha256:fb180e8596e96b2ddf35f4aac8ec2c75d63a58a0a58123c98cce32866680f311","observation_id":"f39461fc-12d2-43ec-8664-fada5fcc43e9","resolution":{"observed_at":"2026-07-13T03:10:38.745341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:10:38.745341Z","title":"Multi-label compound expression recognition: C-expr database & network","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09417","last_updated":"2026-07-10T13:48:35Z","snapshot_observed_at":"2026-08-08T08:38:40.209574Z","submitted_at":"2026-07-10T13:48:35Z","title":"SVF-CR: Synchronized Visual-Facial Cross-Refinement for Multimodal Ambivalence and Hesitancy Recognition","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-13T03:10:38.745341Z"},"links":{"citing_paper":"/paper/2607.09417"},"observation_digest":"sha256:0b84e5693a1420e9501d87f4b02f4a2ed4e3b97b43ef2f1248a64f119e6013da","observation_id":"e7878cd9-2bec-447e-9612-f28fe3c792af","resolution":{"observed_at":"2026-07-13T03:10:38.745341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19328","last_updated":"2026-04-14T11:07:41Z","snapshot_observed_at":"2026-07-06T21:30:14.357703Z","submitted_at":"2025-05-25T21:29:00Z","title":"BAH Dataset for Ambivalence/Hesitancy Recognition in Videos for Digital Behavioural Change","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19328","snapshot_observed_at":"2026-07-13T03:10:38.745341Z","title":"Bah dataset for ambivalence/hesitancy recognition in videos for behavioural change.arXiv preprint arXiv:2505.19328, 3(9), 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09417","last_updated":"2026-07-10T13:48:35Z","snapshot_observed_at":"2026-08-08T08:38:40.209574Z","submitted_at":"2026-07-10T13:48:35Z","title":"SVF-CR: Synchronized Visual-Facial Cross-Refinement for Multimodal Ambivalence and Hesitancy Recognition","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-13T03:10:38.745341Z"},"links":{"cited_paper":"/paper/2505.19328","citing_paper":"/paper/2607.09417"},"observation_digest":"sha256:2dd1845dd43d21c7f8d3e897635b196b3e634cc8bad17ca7c3358b2cfd7b32bf","observation_id":"30536d54-2016-41ee-88a6-852268e18e5b","resolution":{"observed_at":"2026-07-13T03:10:38.745341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:10:38.745341Z","title":"How children and adults produce and perceive uncertainty in audiovisual speech","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.09417","last_updated":"2026-07-10T13:48:35Z","snapshot_observed_at":"2026-08-08T08:38:40.209574Z","submitted_at":"2026-07-10T13:48:35Z","title":"SVF-CR: Synchronized Visual-Facial Cross-Refinement for Multimodal Ambivalence and Hesitancy Recognition","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-13T03:10:38.745341Z"},"links":{"citing_paper":"/paper/2607.09417"},"observation_digest":"sha256:e83d2e15232ef178fd8c5b30efe2f9beae671a888555b7780eb45c8a899622c5","observation_id":"a80de8b0-ab01-4ccb-84c4-ee8f1fe08715","resolution":{"observed_at":"2026-07-13T03:10:38.745341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:10:38.745341Z","title":"Toward an affect-sensitive multimodal human-computer interaction","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2607.09417","last_updated":"2026-07-10T13:48:35Z","snapshot_observed_at":"2026-08-08T08:38:40.209574Z","submitted_at":"2026-07-10T13:48:35Z","title":"SVF-CR: Synchronized Visual-Facial Cross-Refinement for Multimodal Ambivalence and Hesitancy Recognition","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-13T03:10:38.745341Z"},"links":{"citing_paper":"/paper/2607.09417"},"observation_digest":"sha256:a19daa09bf0046091ece511de9181a866866ff029087eb044da518d70a879f7c","observation_id":"5b7a7558-75b7-47bd-a4d1-2af60a276ef3","resolution":{"observed_at":"2026-07-13T03:10:38.745341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:10:38.745341Z","title":"Emotion recognition from multiple modalities: Fundamentals and methodologies.IEEE Signal Processing Magazine, 38(6):59–73, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.09417","last_updated":"2026-07-10T13:48:35Z","snapshot_observed_at":"2026-08-08T08:38:40.209574Z","submitted_at":"2026-07-10T13:48:35Z","title":"SVF-CR: Synchronized Visual-Facial Cross-Refinement for Multimodal Ambivalence and Hesitancy Recognition","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-13T03:10:38.745341Z"},"links":{"citing_paper":"/paper/2607.09417"},"observation_digest":"sha256:d33cbe898ad1e4f3ed81a0f8215ef8c2b8d38e4b2608dbc1dd2b2e663ed22691","observation_id":"85984eca-9327-403e-8f10-fe87018a19ca","resolution":{"observed_at":"2026-07-13T03:10:38.745341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:10:38.745341Z","title":"Aligning multimodal data for fine-grained video understanding via cross- attentive recurrent fusion","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09417","last_updated":"2026-07-10T13:48:35Z","snapshot_observed_at":"2026-08-08T08:38:40.209574Z","submitted_at":"2026-07-10T13:48:35Z","title":"SVF-CR: Synchronized Visual-Facial Cross-Refinement for Multimodal Ambivalence and Hesitancy Recognition","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-13T03:10:38.745341Z"},"links":{"citing_paper":"/paper/2607.09417"},"observation_digest":"sha256:f08a1d8d07978d7a026cafd60a2860be249de2999528ed6391c74565843cf3dd","observation_id":"25715ef6-4d53-430a-8020-a58fab1c8cbf","resolution":{"observed_at":"2026-07-13T03:10:38.745341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:10:38.745341Z","title":"Multimodal spontaneous emotion corpus for human behavior analysis","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.09417","last_updated":"2026-07-10T13:48:35Z","snapshot_observed_at":"2026-08-08T08:38:40.209574Z","submitted_at":"2026-07-10T13:48:35Z","title":"SVF-CR: Synchronized Visual-Facial Cross-Refinement for Multimodal Ambivalence and Hesitancy Recognition","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-13T03:10:38.745341Z"},"links":{"citing_paper":"/paper/2607.09417"},"observation_digest":"sha256:9a88fa3a07cc990ca7b9109507756a8ac675083223199da7e72496979a8726db","observation_id":"b71a8aed-ff28-429e-93ef-8b557d4163d8","resolution":{"observed_at":"2026-07-13T03:10:38.745341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:10:38.745341Z","title":"Are multimodal transformers robust to missing modality? InProceedings of the IEEE/CVF conference on computer vision and pattern recognition, pages 18177–18186, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.09417","last_updated":"2026-07-10T13:48:35Z","snapshot_observed_at":"2026-08-08T08:38:40.209574Z","submitted_at":"2026-07-10T13:48:35Z","title":"SVF-CR: Synchronized Visual-Facial Cross-Refinement for Multimodal Ambivalence and Hesitancy Recognition","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-13T03:10:38.745341Z"},"links":{"citing_paper":"/paper/2607.09417"},"observation_digest":"sha256:0b244194c5fcaed72330e35576a9a4f17f953eeb0d114aafae416aa952434ee8","observation_id":"6381f075-6015-4bfe-b150-e1beba57f4d2","resolution":{"observed_at":"2026-07-13T03:10:38.745341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:10:38.745341Z","title":"Hidden emotion detection using multi-modal signals","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.09417","last_updated":"2026-07-10T13:48:35Z","snapshot_observed_at":"2026-08-08T08:38:40.209574Z","submitted_at":"2026-07-10T13:48:35Z","title":"SVF-CR: Synchronized Visual-Facial Cross-Refinement for Multimodal Ambivalence and Hesitancy Recognition","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-13T03:10:38.745341Z"},"links":{"citing_paper":"/paper/2607.09417"},"observation_digest":"sha256:2dc1b7704d1cdd8de9cae23f61f2c06986e0d12d46253f101de65ac3bed5ec1c","observation_id":"3f9aa0e4-4e7c-4594-8659-657749348971","resolution":{"observed_at":"2026-07-13T03:10:38.745341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:10:38.745341Z","title":"Triagedmsa: Triaging sentimental disagreement in multimodal sentiment analysis.IEEE transactions on affective computing, 16(3): 1557–1569, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09417","last_updated":"2026-07-10T13:48:35Z","snapshot_observed_at":"2026-08-08T08:38:40.209574Z","submitted_at":"2026-07-10T13:48:35Z","title":"SVF-CR: Synchronized Visual-Facial Cross-Refinement for Multimodal Ambivalence and Hesitancy Recognition","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-13T03:10:38.745341Z"},"links":{"citing_paper":"/paper/2607.09417"},"observation_digest":"sha256:52f2f5dcc3cb60d656b8abe4727b04647c6ed704afcd357f0519410c3372e829","observation_id":"59aacab1-54de-401a-8203-c51ce914126c","resolution":{"observed_at":"2026-07-13T03:10:38.745341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:10:38.745341Z","title":"General facial representation learning in a visual-linguistic manner","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.09417","last_updated":"2026-07-10T13:48:35Z","snapshot_observed_at":"2026-08-08T08:38:40.209574Z","submitted_at":"2026-07-10T13:48:35Z","title":"SVF-CR: Synchronized Visual-Facial Cross-Refinement for Multimodal Ambivalence and Hesitancy Recognition","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-13T03:10:38.745341Z"},"links":{"citing_paper":"/paper/2607.09417"},"observation_digest":"sha256:c6a3a733f2d5b25c0ee3580eabb5ae8234f3bd57432533f76e6f97390385f7d0","observation_id":"fb0802ec-e603-4c2d-9b34-0713d5b93495","resolution":{"observed_at":"2026-07-13T03:10:38.745341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:10:38.745341Z","title":"Crossvit: Cross-attention multi-scale vision trans- former for image classification","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.09417","last_updated":"2026-07-10T13:48:35Z","snapshot_observed_at":"2026-08-08T08:38:40.209574Z","submitted_at":"2026-07-10T13:48:35Z","title":"SVF-CR: Synchronized Visual-Facial Cross-Refinement for Multimodal Ambivalence and Hesitancy Recognition","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-13T03:10:38.745341Z"},"links":{"citing_paper":"/paper/2607.09417"},"observation_digest":"sha256:88c86b7249078f3f9992367e96b46bfee9581882a089c664d4464826aa84d07a","observation_id":"60ea1ad6-2772-49da-8cea-ede39cfabe23","resolution":{"observed_at":"2026-07-13T03:10:38.745341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:10:38.745341Z","title":"Affective behavior analysis in-the-wild challenge, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.09417","last_updated":"2026-07-10T13:48:35Z","snapshot_observed_at":"2026-08-08T08:38:40.209574Z","submitted_at":"2026-07-10T13:48:35Z","title":"SVF-CR: Synchronized Visual-Facial Cross-Refinement for Multimodal Ambivalence and Hesitancy Recognition","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-13T03:10:38.745341Z"},"links":{"citing_paper":"/paper/2607.09417"},"observation_digest":"sha256:f42f8a0599e11c0b501c736aa19586e7914c496811c88bdf9f597fb0ac04543b","observation_id":"18fe05f9-cb0e-4c6c-88e6-d19bf99ada4f","resolution":{"observed_at":"2026-07-13T03:10:38.745341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:10:38.745341Z","title":"Enhanced lstm for natural language inference","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.09417","last_updated":"2026-07-10T13:48:35Z","snapshot_observed_at":"2026-08-08T08:38:40.209574Z","submitted_at":"2026-07-10T13:48:35Z","title":"SVF-CR: Synchronized Visual-Facial Cross-Refinement for Multimodal Ambivalence and Hesitancy Recognition","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-13T03:10:38.745341Z"},"links":{"citing_paper":"/paper/2607.09417"},"observation_digest":"sha256:a3a01d940ef8a491d6b2c5019d306a9e04ecdcc6c0824bacd7eeeace508bac95","observation_id":"d467f90a-7a15-4aa6-8063-4bf9782cc323","resolution":{"observed_at":"2026-07-13T03:10:38.745341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:10:38.745341Z","title":"Qwen technical report, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09417","last_updated":"2026-07-10T13:48:35Z","snapshot_observed_at":"2026-08-08T08:38:40.209574Z","submitted_at":"2026-07-10T13:48:35Z","title":"SVF-CR: Synchronized Visual-Facial Cross-Refinement for Multimodal Ambivalence and Hesitancy Recognition","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-13T03:10:38.745341Z"},"links":{"citing_paper":"/paper/2607.09417"},"observation_digest":"sha256:b7f7ea9507a7b10af991a7df0cdaeea85fde5c2bc18e1c122211aabc201009bd","observation_id":"8c3272ea-10e5-43d5-95f9-503efacaed69","resolution":{"observed_at":"2026-07-13T03:10:38.745341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:10:38.745341Z","title":"Videomae: Masked autoencoders are data-efficient learners for self-supervised video pre-training.Advances in Neural Information Processing Systems, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.09417","last_updated":"2026-07-10T13:48:35Z","snapshot_observed_at":"2026-08-08T08:38:40.209574Z","submitted_at":"2026-07-10T13:48:35Z","title":"SVF-CR: Synchronized Visual-Facial Cross-Refinement for Multimodal Ambivalence and Hesitancy Recognition","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-13T03:10:38.745341Z"},"links":{"citing_paper":"/paper/2607.09417"},"observation_digest":"sha256:78fad3ce2b2c03d1df24d6ed78159905febb8f68084000a9e020dd09e4bbb2e9","observation_id":"8e2ea022-1d43-4ef2-b26d-7fadfa0f8178","resolution":{"observed_at":"2026-07-13T03:10:38.745341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:10:38.745341Z","title":"Robust speech recognition via large-scale weak supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09417","last_updated":"2026-07-10T13:48:35Z","snapshot_observed_at":"2026-08-08T08:38:40.209574Z","submitted_at":"2026-07-10T13:48:35Z","title":"SVF-CR: Synchronized Visual-Facial Cross-Refinement for Multimodal Ambivalence and Hesitancy Recognition","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-13T03:10:38.745341Z"},"links":{"citing_paper":"/paper/2607.09417"},"observation_digest":"sha256:ec30819e39b3c702a447550a902838e8dd94155dbd1fd1d3c592e1911bb4560b","observation_id":"dad2d7f1-33ee-4a44-bdd7-395f3ff6db84","resolution":{"observed_at":"2026-07-13T03:10:38.745341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.09417","last_updated":"2026-07-10T13:48:35Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T08:38:40.209574Z","submitted_at":"2026-07-10T13:48:35Z","title":"SVF-CR: Synchronized Visual-Facial Cross-Refinement for Multimodal Ambivalence and Hesitancy Recognition"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 0 inbound Pith citation observations for arXiv:2607.09417."}