{"as_of":"2026-08-17T16:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:720a79f28f274a272758cf1b341fcbb150783f5d05ba8f9b8364605db0378952","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-15T12:40:55.565397Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T04:39:23.724508Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T15:58:32.630043Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"cited_work":{"arxiv_id":"2603.08387","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2603.08387","snapshot_observed_at":"2026-07-07T03:18:12.985685Z","title":null,"venue":null,"work_id":"73cecf63-c6f6-4764-82a6-101b4c617b99","year":2026},"citing_paper":{"arxiv_id":"2604.12735","last_updated":"2026-08-05T08:52:46Z","snapshot_observed_at":"2026-08-13T01:48:08.167925Z","submitted_at":"2026-04-14T13:49:19Z","title":"AffectAgent: Collaborative Multi-Agent Reasoning for Retrieval-Augmented Multimodal Emotion Recognition","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-10T15:21:42.285340Z"},"links":{"cited_paper":"/paper/2603.08387","citing_paper":"/paper/2604.12735"},"observation_digest":"sha256:9e339b009126c367c5c6469dd233852109a7c5a4929d2342e1f4f94b3b847f8e","observation_id":"61d2d9b6-93f5-4dac-ad03-844cc572b781","resolution":{"observed_at":"2026-07-07T03:18:12.985685Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"cited_work":{"arxiv_id":"2603.08387","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2603.08387","snapshot_observed_at":"2026-07-07T03:18:12.985685Z","title":null,"venue":null,"work_id":"73cecf63-c6f6-4764-82a6-101b4c617b99","year":2026},"citing_paper":{"arxiv_id":"2605.18884","last_updated":"2026-05-16T10:04:48Z","snapshot_observed_at":"2026-08-14T07:37:18.354971Z","submitted_at":"2026-05-16T10:04:48Z","title":"Navigating the Emotion Tree: Hierarchical Hyperbolic RAG for Multimodal Emotion Recognition","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-20T15:55:57.330888Z"},"links":{"cited_paper":"/paper/2603.08387","citing_paper":"/paper/2605.18884"},"observation_digest":"sha256:c815e86fe6852579c62ef6fb25c6a92f11a7c871cba004fbfc86fb7f11535e38","observation_id":"a7544ce5-2cf8-4e85-a5f5-2ca94b018d4a","resolution":{"observed_at":"2026-07-07T03:18:12.985685Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.08387","snapshot_observed_at":"2026-08-02T04:39:23.724508Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-14T19:19:51.691582Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:23.724508Z"},"links":{"cited_paper":"/paper/2603.08387","citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:f2489922254b51df63729a842bce60ce73c8fd0a6fc61e813922722f09a615be","observation_id":"c44a8cd3-d081-4464-900a-70761b175275","resolution":{"observed_at":"2026-08-02T04:39:23.724508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2603.08387/citation-record","integrity":"/paper/2603.08387/integrity","json":"/paper/2603.08387/citation-record.json","paper":"/paper/2603.08387"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Facial action coding system: a technique for the measurement of facial movement,","venue":null,"work_id":null,"year":1978},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:6daa5e3a22b597037b8743f44b0bb1ac02838a629709e0f8ebe089550b608962","observation_id":"ea9d8116-a45c-45f1-8711-d29758a1b92b","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Auformer: Vision transformers are parameter-efficient facial action unit detectors,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:5dee6add78c6d0300c9afd4ba0a5985bba747527df2da1a1b2f66f71bf5d2705","observation_id":"7188e2c1-b9e5-4ca3-b23b-809678cefb28","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Automatic analysis of facial actions: A survey,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:4cc3db0625d2e383bc429d8bfdf5b096599a91b3d95874f7dccbb6b024f47470","observation_id":"e185a94b-0fa3-4d36-8fe9-6647e8b9a4e9","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Representation flow for action recognition,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:10ef17255e7798ff8a568d5275200d05cc3bbdf594606a2102c1a45d5eb741a8","observation_id":"008d251f-1109-48d0-b1b0-9a349d99b749","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Dynamic texture recognition using local binary patterns with an application to facial expressions,","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:49f89f712c4680c802b59fb5199052eb895185bc4ad9925885a0891a0c7b03c7","observation_id":"95855af4-f588-4a40-bfb4-baa092f1e725","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Learning spatiotemporal features with 3d convolutional networks,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:c6be17da07dd1c78fb589a827725659e5e34807e92313fe4421e25cf8d5a2179","observation_id":"293441b8-b885-4b1a-89c9-53873ccb2a07","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.0767","last_updated":"2015-10-07T01:29:12Z","snapshot_observed_at":"2026-08-14T23:09:23.492133Z","submitted_at":"2014-12-02T03:05:54Z","title":"Learning Spatiotemporal Features with 3D Convolutional Networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.0767","snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Available: https://arxiv.org/abs/1412.0767","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"cited_paper":"/paper/1412.0767","citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:236e7a576bd1b96f470ae082946a6272d25a71ae75361b49a5bcf14c0c6df2f2","observation_id":"aead3c0a-8490-4ae1-8921-95b1e9daf1a8","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Spon- taneous facial micro-expression recognition using 3d spatiotemporal convolutional neural networks,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:56be826d98d9358ea593a12daae3b8283f58ea2cabaefddb6fb527ce1b966868","observation_id":"48a77e2d-0719-4b0e-aa97-4c90b49206db","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"A main directional mean optical flow feature for spontaneous micro- expression recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:21d2911d68109d7e0e3efb6d24a10aca85d9792818dc11c32d9019458d0b1571","observation_id":"e59dd77d-4127-4fc3-8abf-d435b3ae5027","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Facial action unit detection with local key facial sub-region based multi-label classification for micro-expression analysis,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:7e2fb8f7041f8afb5fd235ee39810fee569167d3e5f0f504ea35450a38ea7ddf","observation_id":"46927c77-2456-40a1-bd9c-ff814bfef1a6","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Semantic relationships guided representation learning for facial action unit recognition,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:93ecc249fcbcd49338d5f8e2cb16d342dc3dfdccdd81713f5e4687ffb09dd01a","observation_id":"0cc741c2-3d6e-4620-a3a8-57f8cbbe95d9","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Au-assisted graph attention convolutional network for micro-expression recognition,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:112224c536065c619d876d0265e23b785d9ccf74b09bfacce31d6b0952cde0f2","observation_id":"65b06554-0da3-4693-88ce-3d305a82ab6e","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06196","last_updated":"2025-03-23T14:51:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-09T05:37:09Z","title":"Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06196","snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Large language models: A survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"cited_paper":"/paper/2402.06196","citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:b663624868df0be25de0e08606021f03c2526aa5fed9acc47fbde732af20fc06","observation_id":"f38a63da-d4ee-43bf-b7a9-2f7676486267","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12597","last_updated":"2023-06-15T07:57:29Z","snapshot_observed_at":"2026-08-12T12:01:54.105712Z","submitted_at":"2023-01-30T00:56:51Z","title":"BLIP-2: Bootstrapping Language-Image Pre-training with Frozen Image Encoders and Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12597","snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Blip-2: Bootstrapping language- image pre-training with frozen image encoders and large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"cited_paper":"/paper/2301.12597","citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:2b7791eae60e328da8c5f8ad9d08b7003d10b8161fdb8a908070155500409317","observation_id":"a86a8432-332c-4717-a58d-6a493823b710","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Coun- terfactual vqa: A cause-effect look at language bias,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:188bf4faf5ef7e2d35e203ad746db0b7cd70b3238c1c8db85f963c821513462f","observation_id":"b05ca819-d3a8-44ec-aa6b-8c9ab3f391d8","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Au-llm: Micro-expression action unit detection via enhanced llm-based feature fusion,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:17b177015a5eb3ceeb06e1bc1d463648b026a6fbeac139f6b87466dc6718865b","observation_id":"de6229a3-6c6e-40d0-abb3-0fa952a14cd2","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"4dme: A spontaneous 4d micro-expression dataset with multimodalities,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:03145e456d9364e6537368d79bcc4286ed8bf4e019b6244c68c4a6d9850d6644","observation_id":"07f902b6-fab7-4048-ae3b-c14af910bba7","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Micro-expression action unit detection with spatial and channel attention,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:f49f860709dc0cd6a546eefdfd8c0a377fd713292acdcb7b66c5ec2219d607e3","observation_id":"5e11f742-fba3-4526-86ae-d99af2b0cd64","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Micro-expression action unit detection with dual-view attentive similarity-preserving knowledge distillation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:fae6b4b2c935a9eaf11c166486ed7ac0323d24e755a014753312c134d243c57b","observation_id":"8f3ee260-72e4-4e74-9197-c33c2150b663","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Learnable eulerian dynamics for micro-expression action unit detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:c41f2371ef8af71953f8388677a87a1b61b58a59df9685e9b480104d51ad78c1","observation_id":"f77049d7-052a-4ddf-97cf-0b51c8d5bbb9","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Infused suppression of magnification artefacts for micro-au detection,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:3a45ff697a14bb3a15eff8cf27b88b7a8fbbb2fd09c6dde4db05f67121cc2e1b","observation_id":"98b7a3d5-6a49-4e5a-bd2d-7528c0e5044a","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:0a27bbabf267abd0ce4d15ebf313754d3a53d0151a2631b59aec21599ae9d818","observation_id":"7676b2a2-fad7-4927-91ed-f1d2a75457b6","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-14T08:29:40.209724Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23372","snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Uniemo: Unifying emotional understanding and generation with learnable expert queries,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"cited_paper":"/paper/2507.23372","citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:f7b2d55ffdb4991a7fd8ebb8e00915a90991b3d1ad992fc2a578373d80a32427","observation_id":"6b4c9a17-4a4e-4222-84c6-41415419ad08","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Joint patch and multi-label learning for facial action unit detection,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:0b5aadeaceaa40b41060f1dddf51dd03994ccf46eededebfc78a5a68eefa0212","observation_id":"9d3e1b00-5555-4076-94d3-bc0a600f2961","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Visual instruction tuning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:c5d69d8a4683c5eee3c51c956aeb9502c8595afa8ee91636f45319c8bac111e6","observation_id":"7653ea86-1457-466e-a5f9-17ba9b8162f4","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Emosym: A symbiotic framework for unified emotional understanding and generation via latent reasoning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:6202c6aeb61e9e60bfb6bca5e488ebcb17a621cbcea10ab8dc9c689e4788ed21","observation_id":"f4bd54b6-06a0-42bd-bf91-49b1bb053644","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.03924","last_updated":"2022-03-18T06:19:28Z","snapshot_observed_at":"2026-08-16T18:47:09.963109Z","submitted_at":"2021-02-07T21:33:41Z","title":"Domain Adversarial Neural Networks for Domain Generalization: When It Works and How to Improve","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.03924","snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Domain adversarial neural networks for domain generalization: When it works and how to improve,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"cited_paper":"/paper/2102.03924","citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:df75919436b69c071247a35af54fc19cf555d2fa8830214f4ee044ed126851f2","observation_id":"205a25e7-3fb1-453c-9fe0-03baf0181e34","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"The graph neural network model,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:8e7e2ff1bdaf66bb72ac6d96b0920c147df27f737679f4684000f37849f01f86","observation_id":"d71b6f52-2c94-42a8-bc62-c6d6d6a5a9ae","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.10596","last_updated":"2022-11-15T20:57:53Z","snapshot_observed_at":"2026-08-16T19:11:58.989442Z","submitted_at":"2020-10-20T20:08:42Z","title":"Counterfactual Explanations and Algorithmic Recourses for Machine Learning: A Review","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.10596","snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Counterfactual explanations and algorithmic recourses for machine learning: A review,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"cited_paper":"/paper/2010.10596","citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:fb0c8657ece33498a73c87ae16c8f8736d76c301d48eba82d287376b9341d09c","observation_id":"64fa17d7-10f9-4bdb-b5ca-6b7bb07a27ae","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Squeeze-and-excitation networks,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:f642a863d04a9b83bbfc2aeb09b8b1e98bd311c6034c69dc6e638993cd842e9c","observation_id":"138ce622-4a69-49e2-b856-57268b165768","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16372","last_updated":"2025-05-22T08:26:19Z","snapshot_observed_at":"2026-08-17T16:13:59.699204Z","submitted_at":"2025-05-22T08:26:19Z","title":"Temporal and Spatial Feature Fusion Framework for Dynamic Micro Expression Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16372","snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Temporal and spatial feature fusion framework for dynamic micro expression recognition,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"cited_paper":"/paper/2505.16372","citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:44af97c5d7a2b32b7f030ff377256cf2efcc6cddb1a3c0cbf15db7bc2f5664d4","observation_id":"44769cf5-0375-4141-a69f-447489c5a28e","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Constrained and directional ensemble attention for facial action unit detection,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:77f1fa9207fbd5b1ae81be10510bfdb4785959a391f3e119b72fc9bda5b9a8f4","observation_id":"1cf2ad7a-e838-4953-a3b6-3a8a29cb0c05","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Micro-expression classification based on landmark relations with graph attention convolutional net- work,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:901bbe31be07c3de779474dd975bd49e2cf4ab55907ef49dd2e74e5c7da2d57b","observation_id":"ad34bd1e-cae2-41dd-97f6-35c33a1d4ecc","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Visual prompt tuning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:8046a49e5863dda783d63cfb4462cbea66d5edf30cf822d7c11f9280e01008dd","observation_id":"7070f0ba-4138-4a5c-8a86-c4fed976d3f0","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Learning to prompt for vision- language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:c0c271368f062b660155c7049b2bd2ef1a8f658ba09391a46d385d0cc6c03d76","observation_id":"39eafaa0-0749-4778-bbd9-40624f6a3563","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Lora: Low-rank adaptation of large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:16ad4314f3786e6f58ae4b8b9558a7610b0c146cfb64d18ff57c2d3e9ee2ab10","observation_id":"53c9c5ae-20c3-4a6d-8905-09bc4fe432b7","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6550","last_updated":"2015-03-27T11:52:28Z","snapshot_observed_at":"2026-08-16T09:41:50.297439Z","submitted_at":"2014-12-19T22:40:51Z","title":"FitNets: Hints for Thin Deep Nets","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6550","snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Fitnets: Hints for thin deep nets,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"cited_paper":"/paper/1412.6550","citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:e7f3f30925ed17f27805f10b5cd0d5dc4c4ecd9a95d07792c485b28441c845cc","observation_id":"2f13125c-642e-498c-9d6f-b405a0fa9840","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Similarity-preserving knowledge distillation,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:014fee7385bf7b065aa1de2325ea6b015f928e01a62886908e84069c0e76ccab","observation_id":"e6423081-ecc2-46fa-b53b-eb740667fb40","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1612.03928","last_updated":"2017-02-12T22:05:47Z","snapshot_observed_at":"2026-08-14T21:25:52.327796Z","submitted_at":"2016-12-12T21:15:57Z","title":"Paying More Attention to Attention: Improving the Performance of Convolutional Neural Networks via Attention Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1612.03928","snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Paying more attention to attention: Improving the performance of convolutional neural networks via atten- tion transfer,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"cited_paper":"/paper/1612.03928","citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:fc25ebd9a406fbafb963efe8f01c81549baa3c59b3936698b62f70865b982129","observation_id":"f731b087-6a3e-4cdc-9448-8d95b2d26b61","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Casme ii: An improved spontaneous micro-expression database and the baseline evaluation,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:e7852092484bd368c08776784e077ca3250ab7a572d93eeff76e1327f1579882","observation_id":"2870e809-e3e7-4820-ba57-4f82a009d4dd","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Samm: A spontaneous micro-facial movement dataset,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:dfb05d5c513ddeca68b114900b7639ae0cc52e34281cd38595c4f5757158a7e9","observation_id":"8115671c-0174-47a7-b4fa-46fccad22576","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Data leakage and evaluation issues in micro-expression analysis,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:26e1493b3061b5f47e779d7acf0a0a46ad4255094a6e207f4c4c758e16cf6121","observation_id":"738b98b6-c4f5-413b-aceb-9a2bd7c196f7","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:8549264a11f98ff68b7189fb73b0fac2ceb12efb7f426bb3818c4a4632a402c7","observation_id":"1cf411e1-8c01-4a1a-889c-93c87eeb6c1c","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Dire: Enhancing facial expression recognition through domain-invariant representation learning for robust generalization,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:597c543a3e914b427fd2ec41780e1f74ff3f38331605d82a9e007c1d0dcd40a8","observation_id":"e2ca29ec-4ca9-4a67-9399-2d4c76d22f27","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Micro-expression recognition with super- vised contrastive learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:079b397f7acd6e0cb999b40ae0895a063e29c34755faa4e5af526b9ba2a1ac0d","observation_id":"924e91ec-ab2b-4d65-9141-825f3f7da729","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":45,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 3 inbound Pith citation observations for arXiv:2603.08387."}