{"as_of":"2026-08-15T04:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9485c84fd83c4bcf450e3c305b475d6cf41f873ee393fb702d0401d40c6b691c","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:43:01.355059Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:42:57.929686Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T19:06:03.340800Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-14T22:17:15.522449Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21196","snapshot_observed_at":"2026-08-07T13:42:57.929686Z","title":"Effective ER is critical in fields such as human-robot interaction (HRI), healthcare, and virtual agents, where understanding and responding to human emotions are essential","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-14T22:17:15.522449Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:42:57.929686Z"},"links":{"cited_paper":"/paper/2505.21196","citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:d36825540a53a5ab7a20d96ade3157eb8df449a7da2eed8a32164adace069009","observation_id":"2486b714-fb00-4a45-aae6-f009202cc48b","resolution":{"observed_at":"2026-08-07T13:42:57.929686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-14T22:17:15.522449Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"cited_work":{"arxiv_id":"2505.21196","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21196","snapshot_observed_at":"2026-07-01T19:06:03.340800Z","title":"Learning annotation consensus for con- tinuous emotion recognition,","venue":null,"work_id":"75363152-9ddd-4a77-b832-05c40d5a2624","year":2025},"citing_paper":{"arxiv_id":"2605.27479","last_updated":"2026-05-26T12:05:13Z","snapshot_observed_at":"2026-08-12T17:24:44.863949Z","submitted_at":"2026-05-26T12:05:13Z","title":"Resource-Constrained Affect Modelling via Variance Regularisation Pruning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-29T19:54:06.216112Z"},"links":{"cited_paper":"/paper/2505.21196","citing_paper":"/paper/2605.27479"},"observation_digest":"sha256:8182d9894395a6f0a46598174db75e4066b05b09152f813ff260cbf1060c4724","observation_id":"8c614024-cd3c-42da-9906-ad66c862cefc","resolution":{"observed_at":"2026-06-29T20:03:56.422719Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-14T22:17:15.522449Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"cited_work":{"arxiv_id":"2505.21196","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21196","snapshot_observed_at":"2026-07-01T19:06:03.340800Z","title":"Learning annotation consensus for con- tinuous emotion recognition,","venue":null,"work_id":"75363152-9ddd-4a77-b832-05c40d5a2624","year":2025},"citing_paper":{"arxiv_id":"2606.27536","last_updated":"2026-06-25T20:35:17Z","snapshot_observed_at":"2026-07-07T00:01:44.678954Z","submitted_at":"2026-06-25T20:35:17Z","title":"Learning from Annotation Uncertainty: Entropy-Aware Curriculum for Speech Emotion Recognition","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-29T00:53:21.116337Z"},"links":{"cited_paper":"/paper/2505.21196","citing_paper":"/paper/2606.27536"},"observation_digest":"sha256:c094b0107efc2c8fb541dac5f7b647b60756b4dea2c32729a0d790ba7d55208c","observation_id":"d011a3b5-41c9-4ad2-9dfc-c91b4ab492a9","resolution":{"observed_at":"2026-07-01T19:06:03.342440Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.21196/citation-record","integrity":"/paper/2505.21196/integrity","json":"/paper/2505.21196/citation-record.json","paper":"/paper/2505.21196"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-14T22:17:15.522449Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21196","snapshot_observed_at":"2026-08-07T13:42:57.929686Z","title":"Effective ER is critical in fields such as human-robot interaction (HRI), healthcare, and virtual agents, where understanding and responding to human emotions are essential","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-14T22:17:15.522449Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:42:57.929686Z"},"links":{"cited_paper":"/paper/2505.21196","citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:d36825540a53a5ab7a20d96ade3157eb8df449a7da2eed8a32164adace069009","observation_id":"2486b714-fb00-4a45-aae6-f009202cc48b","resolution":{"observed_at":"2026-08-07T13:42:57.929686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:05.820134Z","title":"gold standard","venue":null,"work_id":"627f167d-39cc-4c23-b13c-b9bd8500f1f3","year":2023},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-14T22:17:15.522449Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:42:58.075633Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:bf0b9270743b6e1962e0d186ad2d695049e4e908c2330d711741e92dd929bacb","observation_id":"aa2b730c-7c71-46de-85d2-b822fd28daf7","resolution":{"observed_at":"2026-08-07T13:43:05.840384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:05.680548Z","title":"Following recommendations in [17], we freeze the convolutional feature encoder layers while fine-tuning the higher-level transformer blocks","venue":null,"work_id":"07af2aac-ab96-474f-9d3c-54699cf56560","year":null},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-14T22:17:15.522449Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:42:58.288406Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:78f170ca83c0b2b81e23f504249815bc3da77ab9255d084fc137c8e37b6723a7","observation_id":"e2ca1b6a-e820-489f-bc7f-823a9dc0eb33","resolution":{"observed_at":"2026-08-07T13:43:05.748338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:05.484433Z","title":null,"venue":null,"work_id":"3e340ef1-9b10-4fbd-9cd6-7c9dee67da4e","year":2016},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-14T22:17:15.522449Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:42:58.423780Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:717a9de24ed74a10be41fc3964fcb39c217c6ee74a3ae7b2be2102bfa43b6fc1","observation_id":"45ef3cb6-953c-4742-8354-8660ff94b330","resolution":{"observed_at":"2026-08-07T13:43:05.583315Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:05.299912Z","title":"These capa- bilities could significantly impact interactive technologies and empathy computing, facilitating more nuanced and responsive interactions","venue":null,"work_id":"c06907de-bb21-4cdc-8fa1-9fe54a95048e","year":null},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-14T22:17:15.522449Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:42:58.587391Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:2ca6b8c7fd50af215d6ff2bc99bee72dc6cdc2a0a174adb8cc2ad9742fca016e","observation_id":"7ed1a066-da65-43ed-9792-a1b79283b475","resolution":{"observed_at":"2026-08-07T13:43:05.389453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:05.099582Z","title":"Speech emotion recognition: Two decades in a nutshell, benchmarks, and ongoing trends,","venue":null,"work_id":"abef6479-27a4-4475-956b-8ca469e5f715","year":2018},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-14T22:17:15.522449Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:42:58.759137Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:11a0437d522453ddc61fa106a297e682ad11e47b1c5e3cbac07c48a09a9be8de","observation_id":"ccd37d8b-fa16-47fe-8f9e-a51234021fe2","resolution":{"observed_at":"2026-08-07T13:43:05.191726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:04.981206Z","title":"Universals and cultural differences in the judg- ments of facial expressions of emotion","venue":null,"work_id":"ccb1aa7b-2a2c-44a8-a58c-49358f501ad6","year":1987},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-14T22:17:15.522449Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:42:58.929631Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:eb83353f01ab1d9af244147614567558c825f9a99899888e559153a44dbd947b","observation_id":"d483b37d-69a0-4601-b2a2-f874ae48695e","resolution":{"observed_at":"2026-08-07T13:43:05.013240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:04.888525Z","title":"Evidence for a three-factor the- ory of emotions,","venue":null,"work_id":"f7420a89-b750-4839-9a45-f808d72f8658","year":1977},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-14T22:17:15.522449Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:42:59.076982Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:56ba1478592670b59ba311b1adb262edf31b40b3a785e720d37e200e9caff3c8","observation_id":"5e010ed8-2d8d-41cb-97fe-2b19f8229b44","resolution":{"observed_at":"2026-08-07T13:43:04.942053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:04.713525Z","title":"Multi- modal learning for speech emotion recognition: An analysis and comparison of asr outputs with ground truth transcription","venue":null,"work_id":"548b6f04-72b2-4d57-9857-30976f9263bb","year":2019},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-14T22:17:15.522449Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:42:59.173947Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:a150ebe9f8168dd36305ba8bb6a9c00eb8e19b45a8d3d9ca0daee620633d58a3","observation_id":"92787b42-cd5b-4f14-a169-a0e090ff85d3","resolution":{"observed_at":"2026-08-07T13:43:04.814281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:04.542193Z","title":"Affect detection: An interdisci- plinary review of models, methods, and their applications,","venue":null,"work_id":"02a899a0-0f00-4880-8e19-25a1c7ecc4c5","year":2010},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-14T22:17:15.522449Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:42:59.238010Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:c2c2c495b8d9b70271132557a758b201801992ca970c2d5b581991ccb727362b","observation_id":"5e9933d6-d6aa-42a1-8b61-193662772dc8","resolution":{"observed_at":"2026-08-07T13:43:04.630724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:04.327397Z","title":"Multistage linguistic conditioning of convolu- tional layers for speech emotion recognition,","venue":null,"work_id":"a5a9b4f8-ef79-4cef-8e57-27e3a16322f1","year":2023},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-14T22:17:15.522449Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:42:59.353262Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:7472825987a2608857d2bcfe840164387c6cd2380bc3bee41c0d5d5477a6ef1e","observation_id":"c5b39a36-8018-426d-8969-d45ff8d41b8b","resolution":{"observed_at":"2026-08-07T13:43:04.407264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:04.150771Z","title":"Ro- bust speech emotion recognition under different encoding condi- tions,","venue":null,"work_id":"da3d0d20-b8ec-4b49-9df2-6c64c3af621f","year":2019},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-14T22:17:15.522449Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:42:59.492398Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:8703841eeffab318af09fd576b3179022b0a532782431767afe2fb869858a2de","observation_id":"d7c2b453-9495-47a3-9408-25e97d6343b6","resolution":{"observed_at":"2026-08-07T13:43:04.258784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:03.915314Z","title":"Affective robotics: Current research and future direc- tions,","venue":null,"work_id":"18bd81cb-88c2-4fac-bd10-bc87551d56e9","year":2017},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-14T22:17:15.522449Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:42:59.648063Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:17a0630c680d6205ae884395444fa86e8957d22641aa2841946e1da4501e6be5","observation_id":"b6e9b2d5-deb1-40e4-9089-246163ecd796","resolution":{"observed_at":"2026-08-07T13:43:04.017803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:03.789675Z","title":"A review of affective computing: From unimodal analysis to multimodal fu- sion,","venue":null,"work_id":"fc5a552b-cef1-4a50-9bd5-b496de4a99e7","year":2017},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-14T22:17:15.522449Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:42:59.712788Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:e3131bdbb77945c92d4809eb1dfaea4f68c234fed7b87c85e2296c8ba620966c","observation_id":"7d7f57a5-24ba-4479-ac30-7f166e3c1d57","resolution":{"observed_at":"2026-08-07T13:43:03.842179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:03.533071Z","title":"Use of affective visual information for summarization of human-centric videos,","venue":null,"work_id":"b813ee6a-1868-426d-a077-9ada89eb32a5","year":2023},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-14T22:17:15.522449Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:42:59.879313Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:e3135b19e74839e318f7b13f759c5b0fb3af502751e985dde92525331624d007","observation_id":"85bec195-0c86-4920-9e76-aef4c7dc7b5d","resolution":{"observed_at":"2026-08-07T13:43:03.668128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:03.267956Z","title":"Introduc- ing the recola multimodal corpus of remote collaborative and af- fective interactions,","venue":null,"work_id":"6afba50a-b735-4f42-8abf-07a6d2ba8c68","year":2013},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-14T22:17:15.522449Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:43:00.008366Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:336ef381327f95fdae57398d4bf747cce8325fe0a7627fd1456a5b9da14ee472","observation_id":"4d962ade-1042-44cd-bd42-5e01cb2dd1e7","resolution":{"observed_at":"2026-08-07T13:43:03.387469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:02.940446Z","title":"Cognimuse: A multimodal video database an- notated with saliency, events, semantics and emotion with appli- cation to summarization,","venue":null,"work_id":"54b1276e-6cbd-4867-a6ed-ee385d0c09b3","year":2017},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-14T22:17:15.522449Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:43:00.230996Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:76fca68ed147976386695987727e17cbd0beaa0bcabdedea0656711600a9e570","observation_id":"accc8130-3168-4566-9081-912cf60cf9d7","resolution":{"observed_at":"2026-08-07T13:43:03.077289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:02.747466Z","title":null,"venue":null,"work_id":"671e684c-e635-4ebf-838f-6617032deb63","year":1997},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-14T22:17:15.522449Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:43:00.432216Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:2a828229d5ff67d92809d866cad578a0623fd2d7dec9fee9d5003ca39764a7e1","observation_id":"18860c9d-c37d-4f20-a9a9-ca36da252de3","resolution":{"observed_at":"2026-08-07T13:43:02.781482Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:02.570746Z","title":"Prediction of asynchronous dimensional emotion ratings from audiovisual and physiological data,","venue":null,"work_id":"9f989f1b-4de6-42ea-ab3d-1c58ea92914c","year":2015},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-14T22:17:15.522449Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:43:00.597675Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:b88cd24542828eca66593308cdcb3132f752134be138732a4702152ad2283448","observation_id":"e469e655-e0f7-418a-9f5d-7a466e9a7798","resolution":{"observed_at":"2026-08-07T13:43:02.687726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:02.245401Z","title":"End-to-end multimodal emotion recognition using deep neural networks,","venue":null,"work_id":"f8cf4b95-b4ee-4c23-b511-d461e401728b","year":2017},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-14T22:17:15.522449Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:43:00.735729Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:dfbbb7847152bbd071fcb6fc68da9ada16696f42ba135cec24207ab2de90d695","observation_id":"37d2ca17-0df1-4971-98ca-65b125c96fef","resolution":{"observed_at":"2026-08-07T13:43:02.406769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.04107","last_updated":"2020-09-09T05:06:44Z","snapshot_observed_at":"2026-08-12T02:41:17.543622Z","submitted_at":"2020-09-09T05:06:44Z","title":"Multi-modal Attention for Speech Emotion Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.04107","snapshot_observed_at":"2026-08-07T13:43:00.880411Z","title":"Multi-modal attention for speech emotion recognition,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-14T22:17:15.522449Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:43:00.880411Z"},"links":{"cited_paper":"/paper/2009.04107","citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:c1221077b2404b6375528e797c69ce14d196eebd748660f6546686f5df8cacca","observation_id":"d99b507b-246d-4ca3-ba17-1fc6b982fe04","resolution":{"observed_at":"2026-08-07T13:43:00.880411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:01.083158Z","title":"Dawn of the trans- former era in speech emotion recognition: closing the valence gap,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-14T22:17:15.522449Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:43:01.083158Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:5d2028496e08e34ced866704f3b389bb125accce5bd9370ad5b48951de872905","observation_id":"1dba6740-a37b-4f71-bf0f-dab28327bc02","resolution":{"observed_at":"2026-08-07T13:43:01.083158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:01.978216Z","title":"Recognizing emotions evoked by movies using multitask learning,","venue":null,"work_id":"9bf67086-4f51-41f5-badb-9bd102e30aec","year":2021},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-14T22:17:15.522449Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:43:01.279329Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:2ea9393305e149780f809dc555d5eaf2bc39133b5d6c13e278adbeb26667c11c","observation_id":"5f102836-2f05-4106-8095-52672fba331d","resolution":{"observed_at":"2026-08-07T13:43:02.121256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:01.706905Z","title":"The ox- ford handbook of affective computing,","venue":null,"work_id":"de684ccc-0b5a-44fd-8b98-eff94a90905f","year":2015},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-14T22:17:15.522449Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:43:01.351222Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:7c92737d42b172f87b97c94727df003b833619298fdfd3f90c7b78df5b324d63","observation_id":"1e799cf9-e0b0-483c-8350-5822a40b03da","resolution":{"observed_at":"2026-08-07T13:43:01.850404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:01.463975Z","title":"Primitives-based evaluation and estimation of emotions in speech,","venue":null,"work_id":"5c8d285d-0a17-48d4-9ab5-1d121f70f0d7","year":2007},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-14T22:17:15.522449Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:43:01.355059Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:367efa451c65c481241e9192b323321a7735f7fb561fa5be5a0fb3a4411cf61b","observation_id":"78557e42-7a1b-4a36-9aba-45fe6ddb96d6","resolution":{"observed_at":"2026-08-07T13:43:01.534602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","latest_version":1,"primary_category":"cs.HC","snapshot_observed_at":"2026-08-14T22:17:15.522449Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":0,"verified_fuzzy":20},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 3 inbound Pith citation observations for arXiv:2505.21196."}