{"as_of":"2026-08-15T10:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bf60701c0345e39b2977e844d6b899125a4bfa14791a6459fda4d2eca6e04e03","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T05:41:47.761955Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.17295/citation-record","integrity":"/paper/2412.17295/integrity","json":"/paper/2412.17295/citation-record.json","paper":"/paper/2412.17295"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:47.413662Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.413662Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:6c285e1ee6ecd747079ef7d44847e55619df257e185215b67c56f5d13f373c89","observation_id":"f1acbea2-0520-4ddb-820a-4bcc7fae1433","resolution":{"observed_at":"2026-08-11T05:41:47.413662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:47.425367Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.425367Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:14566ab28e2b3caf0dd159e9444ef4afc509d0f61d98b0f8e2a9fa1fb00ba3d4","observation_id":"767e761b-6ff8-4097-aa7c-5849be5a8ad0","resolution":{"observed_at":"2026-08-11T05:41:47.425367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.872162Z","title":"K.; and Hori, C","venue":null,"work_id":"b5669410-4623-40bb-8c2d-58cb7a368887","year":2019},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.435013Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:e3b0b56c0b6309137c7a512e1e2e0c4bc5b1d5d4ea45ee9862ef136efcfb1ba7","observation_id":"a9762f84-a9a0-4fe7-a3e4-e2d9c0d5f829","resolution":{"observed_at":"2026-08-11T05:41:48.880153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.849991Z","title":"M.; and Zisserman, A","venue":null,"work_id":"fae84c7d-a6ed-4486-b96c-5695e16a3142","year":2017},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.445288Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:d4b00365f235f1db5188777f2ce9ab28b167ce06321b977873a80fe64e1a8a65","observation_id":"4091deac-cf3f-4983-a914-7adb5a9cb993","resolution":{"observed_at":"2026-08-11T05:41:48.855827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.823950Z","title":null,"venue":null,"work_id":"1cfb494b-413e-49a4-889a-a3d317f4146d","year":2016},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.451482Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:b7395b65207a5b66a0a08b22736a31e7feb8a4f0dd3b36acd01409c43192cb50","observation_id":"940a4941-3cc1-49fb-8e86-47bad5a1281b","resolution":{"observed_at":"2026-08-11T05:41:48.833981Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:47.459887Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.459887Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:33319e9a43419afb24e2e008cee6fdbfb23514412946ad3f9ef210cff96bbff3","observation_id":"5ede7a9f-d090-41c2-948e-39a582ffd0a8","resolution":{"observed_at":"2026-08-11T05:41:47.459887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.776452Z","title":null,"venue":null,"work_id":"2ea09b10-0c16-4bd1-9ada-68179aeef07b","year":2023},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.467532Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:a78da35a22b61ef887ab6e4037ddbcdaa3978bb0600647f9fb08935a62f3e283","observation_id":"b4ea5344-3897-4ff2-a22d-175eab859613","resolution":{"observed_at":"2026-08-11T05:41:48.784345Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.12681","last_updated":"2022-04-16T04:21:26Z","snapshot_observed_at":"2026-08-13T17:28:14.250211Z","submitted_at":"2021-11-24T18:31:20Z","title":"VIOLET : End-to-End Video-Language Transformers with Masked Visual-token Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.12681","snapshot_observed_at":"2026-08-11T05:41:47.477395Z","title":"Y.; Wang, L.; and Liu, Z","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.477395Z"},"links":{"cited_paper":"/paper/2111.12681","citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:1e5f1e58f45f280801917c2da006b2ffc586bc5e45ae4836d59abf0d3835d0aa","observation_id":"1bd85624-c249-4b27-8427-e28e210e2719","resolution":{"observed_at":"2026-08-11T05:41:47.477395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.751752Z","title":null,"venue":null,"work_id":"94c61904-a66b-45a7-932e-0f0c5afa8d0d","year":2023},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.489121Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:9830c2754177d04a3fc907967c22b0b4143bcb40c0e5165573e00d0398e91bcb","observation_id":"c035db82-97db-4c63-b402-373139947a4e","resolution":{"observed_at":"2026-08-11T05:41:48.758564Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.729616Z","title":null,"venue":null,"work_id":"1078e138-78f5-4bf5-a45e-a947c4a8f2a2","year":2023},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.496010Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:ee5f596f4999c58886dadb90d0e6b2ba67622cbf724ae9eb8d8caa4e778a7de9","observation_id":"ae10006e-de55-4993-973f-e24bf4a86164","resolution":{"observed_at":"2026-08-11T05:41:48.736156Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.684204Z","title":null,"venue":null,"work_id":"b116efc7-9b38-4739-afad-1059c04324ed","year":2022},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.502549Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:66b0b105c66ec4372cb922b7798f90eb0bd1b300011c556879285a063f3415de","observation_id":"c113fac9-17f2-49bb-8637-148a123c2b42","resolution":{"observed_at":"2026-08-11T05:41:48.695540Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.656716Z","title":null,"venue":null,"work_id":"56d41ba3-47b7-42b3-af7d-d3f2f8a421e5","year":2021},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.510979Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:1b350ccc6a367da4e945052e291010c47a45de3698880a3d75e33baf84ddd553","observation_id":"59f4dc76-6657-4c52-a88f-463d93c91a9c","resolution":{"observed_at":"2026-08-11T05:41:48.663725Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:47.516856Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.516856Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:5fc880a8a0a402791a99efd7fb23dbbb7be27282fb435766d808e850c94330fd","observation_id":"6d0ce594-d9a5-4600-b5ee-271a0471be35","resolution":{"observed_at":"2026-08-11T05:41:47.516856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.09543","last_updated":"2023-03-24T09:17:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-11-18T06:48:00Z","title":"DeBERTaV3: Improving DeBERTa using ELECTRA-Style Pre-Training with Gradient-Disentangled Embedding Sharing","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.09543","snapshot_observed_at":"2026-08-11T05:41:47.522646Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.522646Z"},"links":{"cited_paper":"/paper/2111.09543","citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:74c678950db2da29bb4db63ef87f890f3aba737aea2769fb8045905449b5c330","observation_id":"66bbeca8-1d10-4059-9cdd-fa3ee608e42c","resolution":{"observed_at":"2026-08-11T05:41:47.522646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:47.528485Z","title":"J.; Shen, Y.; Wallis, P.; Allen - Zhu, Z.; Li, Y.; Wang, S.; Wang, L.; and Chen, W","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.528485Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:64d81289f05e6bf84bb88fca49f9895980fa7c53ac579e804f1196eaf85887d1","observation_id":"b147973a-2e47-468a-bc6d-ccb9884314ba","resolution":{"observed_at":"2026-08-11T05:41:47.528485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.602009Z","title":null,"venue":null,"work_id":"7a6e9eaf-00d2-430c-b361-92f55d8b033b","year":2019},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.535256Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:ccf9bcb2438d9c4cf1da6c286f8caecc5b1e6052b4ffe172933c399f1ef87cc2","observation_id":"89c55b27-c0bf-47c0-81e6-e9e2af4016d4","resolution":{"observed_at":"2026-08-11T05:41:48.608935Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.581236Z","title":"S.; and Zisserman, A","venue":null,"work_id":"f27aa173-fbae-4b56-8c0a-4d5cd0edcff0","year":2020},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.541905Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:ac346a2fb3dc3f4e6d357aa218eebb285dcdeaf2dad0edd34207ea7b792b6530","observation_id":"3a5e1dfe-9742-4c61-b3ce-a4f50fe9f002","resolution":{"observed_at":"2026-08-11T05:41:48.587514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06355","last_updated":"2024-01-04T02:06:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-10T17:59:04Z","title":"VideoChat: Chat-Centric Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06355","snapshot_observed_at":"2026-08-11T05:41:47.548723Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.548723Z"},"links":{"cited_paper":"/paper/2305.06355","citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:0975a4ed84f0b9fc89c488e2304d04016c6992f0efc9fb8f9df8174f396d4469","observation_id":"729ca95e-ca18-4b1a-b029-2b6b82e69251","resolution":{"observed_at":"2026-08-11T05:41:47.548723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17005","last_updated":"2024-05-23T14:49:29Z","snapshot_observed_at":"2026-08-14T11:10:08.135537Z","submitted_at":"2023-11-28T17:59:04Z","title":"MVBench: A Comprehensive Multi-modal Video Understanding Benchmark","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17005","snapshot_observed_at":"2026-08-11T05:41:47.557078Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.557078Z"},"links":{"cited_paper":"/paper/2311.17005","citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:b4bfd95824db887a08305bfdf59f7e3de919624900f932a2f64d94518c8d681d","observation_id":"05de5a87-1bcb-4955-bec0-463ccbc8413c","resolution":{"observed_at":"2026-08-11T05:41:47.557078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08485","last_updated":"2023-12-11T17:46:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-17T17:59:25Z","title":"Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08485","snapshot_observed_at":"2026-08-11T05:41:47.568018Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.568018Z"},"links":{"cited_paper":"/paper/2304.08485","citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:5bb06b8d4f675a83e48eeae0d266551682737e68ff9b20c0b83c218b52845bcb","observation_id":"b47e595c-042a-492a-a9a6-4b8722a1de94","resolution":{"observed_at":"2026-08-11T05:41:47.568018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.551909Z","title":null,"venue":null,"work_id":"5142b8f2-3e59-4e07-af22-6c3b73a65642","year":2015},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.574224Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:5b82eb921c46876a5a792e75dca32de99408b7074ae80027985907629caae7e7","observation_id":"f71373ab-c9f5-4604-8a63-a7f75437d800","resolution":{"observed_at":"2026-08-11T05:41:48.558090Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05424","last_updated":"2024-06-10T01:36:53Z","snapshot_observed_at":"2026-07-06T15:40:24.127663Z","submitted_at":"2023-06-08T17:59:56Z","title":"Video-ChatGPT: Towards Detailed Video Understanding via Large Vision and Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05424","snapshot_observed_at":"2026-08-11T05:41:47.581309Z","title":"A.; Khan, S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.581309Z"},"links":{"cited_paper":"/paper/2306.05424","citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:dd41ac4214b9f0d6adbe0606c7c0bdf5d9808358223c0276feebce84ff0f3b14","observation_id":"43f865cc-af2f-46b9-8d66-5ea8db82878d","resolution":{"observed_at":"2026-08-11T05:41:47.581309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.15015","last_updated":"2021-05-29T13:15:07Z","snapshot_observed_at":"2026-07-06T10:28:41.157385Z","submitted_at":"2020-12-30T03:02:50Z","title":"OpenViDial: A Large-Scale, Open-Domain Dialogue Dataset with Visual Contexts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.15015","snapshot_observed_at":"2026-08-11T05:41:47.591948Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.591948Z"},"links":{"cited_paper":"/paper/2012.15015","citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:c73d5091b240505486300915fc33a44d188315d139720ff853f4a93edb699e2b","observation_id":"288f1716-9dfe-45a8-a127-ff47275b0dbc","resolution":{"observed_at":"2026-08-11T05:41:47.591948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.527674Z","title":null,"venue":null,"work_id":"969f222b-145d-4c17-8ef9-3a4b84309665","year":2018},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.598006Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:61c94e9a04be5a66c814472bf8e7e2d141490869c372117c8331ae31f2317b2e","observation_id":"56d5cbfe-a166-426e-a98a-8cb7ee5122ca","resolution":{"observed_at":"2026-08-11T05:41:48.534108Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1701.08251","last_updated":"2017-04-20T00:36:35Z","snapshot_observed_at":"2026-08-14T21:19:07.130326Z","submitted_at":"2017-01-28T05:06:11Z","title":"Image-Grounded Conversations: Multimodal Context for Natural Question and Response Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.08251","snapshot_observed_at":"2026-08-11T05:41:47.603359Z","title":"B.; Galley, M.; Gao, J.; Spithourakis, G","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.603359Z"},"links":{"cited_paper":"/paper/1701.08251","citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:8568ed46bc322a20f1a96b5a4baeb475f485396eb95b23454926df1e3448074b","observation_id":"73a0ec7f-05d0-4c2c-bc07-f931eb3fb1e3","resolution":{"observed_at":"2026-08-11T05:41:47.603359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.505698Z","title":null,"venue":null,"work_id":"ebe07af0-73ee-4d0f-a6c5-6995bf1f8c72","year":2024},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.610782Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:ace61269a78cd27570d0a619421ce3b1189b4551ed3c35e357723b92adadc292","observation_id":"01bbe700-5dd2-4fde-a904-6189f3a64528","resolution":{"observed_at":"2026-08-11T05:41:48.515044Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.479364Z","title":null,"venue":null,"work_id":"53273e89-0df1-45f8-8458-784738bbe113","year":2016},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.622847Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:42b7f5d522402bc8f35b745533cdc8c8467cbbcfc51b215ac782e28f45aac931","observation_id":"901b5fb8-c347-401b-a785-a36977211aa2","resolution":{"observed_at":"2026-08-11T05:41:48.486157Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-14T18:19:10.821318Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-11T05:41:47.636044Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.636044Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:2268c6e1a08e0a9a3d459e8b08260c00874bf1ff5ea6d234979842926b46ec7d","observation_id":"d1902ffc-96f6-4347-9c70-b11f8d60bded","resolution":{"observed_at":"2026-08-11T05:41:47.636044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.452060Z","title":null,"venue":null,"work_id":"9b443a1c-b76a-4722-8427-4f4b720c0e53","year":2015},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.641719Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:d3858de4a674a952799184317afed04e86cd9fece8423cf3817f5c4f17cd1597","observation_id":"4a9ae869-502e-4277-853a-9c7d58401766","resolution":{"observed_at":"2026-08-11T05:41:48.458877Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.427740Z","title":null,"venue":null,"work_id":"9b700dc2-466f-4419-8df3-af4c332b5730","year":2020},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.651234Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:c482df206ccfa2ae06a2091ae3572449dcb3e006223bfbab6ce7a3314714686b","observation_id":"60425850-0b2d-41f2-8717-5ab6779e053d","resolution":{"observed_at":"2026-08-11T05:41:48.433951Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.401837Z","title":null,"venue":null,"work_id":"b14005f5-1a15-4598-8c20-f1b086cb88c4","year":2022},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.659011Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:f9f4e7c5c58742870c762fc03a0c91bd01a88746b1725892f7aee130a4f0da97","observation_id":"018c623c-699d-4ca9-8583-a5a949594ce8","resolution":{"observed_at":"2026-08-11T05:41:48.409368Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.05222","last_updated":"2024-05-08T02:46:43Z","snapshot_observed_at":"2026-08-06T07:46:37.713769Z","submitted_at":"2023-07-11T12:45:39Z","title":"Emu: Generative Pretraining in Multimodality","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.05222","snapshot_observed_at":"2026-08-11T05:41:47.666258Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.666258Z"},"links":{"cited_paper":"/paper/2307.05222","citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:d5bc72a25de77b39a3ee18cfdbe5db41800979ac056c46769fd71b74bf58dd42","observation_id":"3a00f7af-da35-480d-88c6-51e21842a2d9","resolution":{"observed_at":"2026-08-11T05:41:47.666258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.377856Z","title":"E.; Anguelov, D.; Erhan, D.; Vanhoucke, V.; and Rabinovich, A","venue":null,"work_id":"ee6f765e-5ab4-4586-ad95-ed8fc6000fc5","year":2014},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.673830Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:9dd91a995e6664995b10aa55e851a38c12ae5a33b3b80bc335ca2179374183b7","observation_id":"64a8ff6f-3ec2-442b-8560-9b787e7e5e9c","resolution":{"observed_at":"2026-08-11T05:41:48.386006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.355856Z","title":"K.; Qian, X.; Shou, M","venue":null,"work_id":"fa7a0149-4c3b-4963-b764-9ce8704734df","year":2021},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.685256Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:9744d013907ae55820eced52dae2085276f6cc1f8b1a50708e30a888e221f7b9","observation_id":"d6351b54-6715-44b8-9825-be9aa67e29e9","resolution":{"observed_at":"2026-08-11T05:41:48.362739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.12761","last_updated":"2021-09-28T15:15:57Z","snapshot_observed_at":"2026-08-13T18:04:34.573752Z","submitted_at":"2021-09-27T02:10:29Z","title":"OpenViDial 2.0: A Larger-Scale, Open-Domain Dialogue Generation Dataset with Visual Contexts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.12761","snapshot_observed_at":"2026-08-11T05:41:47.694800Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.694800Z"},"links":{"cited_paper":"/paper/2109.12761","citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:08319717c4bc2eea338be33bdf0c61a2ac01dc45c3d31e854d5f7a635fa9a4d8","observation_id":"a886c044-e071-41fa-a401-beb2664b14e1","resolution":{"observed_at":"2026-08-11T05:41:47.694800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.315733Z","title":null,"venue":null,"work_id":"56ddf4c9-184c-44da-ae94-3dacb11c4e14","year":2023},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.705866Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:61a510cb7a3aeb113a8ab6ca967353f75663a654e5e49dadcaf3427288f15b6d","observation_id":"16e0dd4b-b052-4971-b6dc-27ff87ee78ee","resolution":{"observed_at":"2026-08-11T05:41:48.323878Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.282960Z","title":null,"venue":null,"work_id":"26be4383-e4c3-4ec2-9436-f2467a3514ea","year":2023},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.712699Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:1bc8589bcf9a2fc1794bf20da49a5424e362160f18b48697ea22945bb985794b","observation_id":"1e06c222-beac-46b3-b126-1f4399e90b1f","resolution":{"observed_at":"2026-08-11T05:41:48.292185Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04658","last_updated":"2024-05-11T07:08:16Z","snapshot_observed_at":"2026-08-13T10:17:34.745714Z","submitted_at":"2023-09-09T01:56:40Z","title":"Exploring Large Language Models for Communication Games: An Empirical Study on Werewolf","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.04658","snapshot_observed_at":"2026-08-11T05:41:47.718599Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.718599Z"},"links":{"cited_paper":"/paper/2309.04658","citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:fe27c37f0cde6a3ce77e80e489d21e290528c390908243119cf438f4febe1fe8","observation_id":"6c96e174-e4f6-4a10-a0d7-94f824dc7c88","resolution":{"observed_at":"2026-08-11T05:41:47.718599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.01453","last_updated":"2021-07-06T14:03:04Z","snapshot_observed_at":"2026-08-13T18:50:42.654831Z","submitted_at":"2021-07-06T14:03:04Z","title":"PhotoChat: A Human-Human Dialogue Dataset with Photo Sharing Behavior for Joint Image-Text Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.01453","snapshot_observed_at":"2026-08-11T05:41:47.725770Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.725770Z"},"links":{"cited_paper":"/paper/2108.01453","citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:6e5016ea1153f572133e54dd0e3dff7f2e32f93538bb1262ee5071b779529ad5","observation_id":"a2db3e8b-3e81-4b11-ada2-78d6aed53f2e","resolution":{"observed_at":"2026-08-11T05:41:47.725770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02485","last_updated":"2024-02-17T05:27:56Z","snapshot_observed_at":"2026-08-14T18:48:00.029173Z","submitted_at":"2023-07-05T17:59:27Z","title":"Building Cooperative Embodied Agents Modularly with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.02485","snapshot_observed_at":"2026-08-11T05:41:47.732821Z","title":"B.; Shu, T.; and Gan, C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.732821Z"},"links":{"cited_paper":"/paper/2307.02485","citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:3b16a1e552456be1f63d571939a5f000d2e97d47a6be0e81e1b323ee32c40d5d","observation_id":"7dcee085-fc3c-4dca-be90-08353bab027d","resolution":{"observed_at":"2026-08-11T05:41:47.732821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.254975Z","title":null,"venue":null,"work_id":"f9982502-3e61-436a-88e6-d1c28bfaa3ba","year":2017},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.740055Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:ea5a94e0c9210d831ff414bc3626186ff2ec32059269120a0b34dc84c00944d1","observation_id":"1dcaf3b4-a0d9-4cd9-826a-12eb63e456da","resolution":{"observed_at":"2026-08-11T05:41:48.263912Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07154","last_updated":"2022-05-01T09:51:17Z","snapshot_observed_at":"2026-08-13T18:28:02.867193Z","submitted_at":"2021-08-16T15:27:49Z","title":"MMChat: Multi-Modal Chat Dataset on Social Media","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07154","snapshot_observed_at":"2026-08-11T05:41:47.746531Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.746531Z"},"links":{"cited_paper":"/paper/2108.07154","citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:ff0a6a5c0d9bd544a0d4730316347d2e399cf44d6e9d515ad0247c044b02b3fe","observation_id":"96f74744-ce67-4072-922b-00e49210bda5","resolution":{"observed_at":"2026-08-11T05:41:47.746531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03051","last_updated":"2023-10-04T06:47:58Z","snapshot_observed_at":"2026-08-14T21:12:11.833644Z","submitted_at":"2023-10-04T06:47:58Z","title":"How FaR Are Large Language Models From Agents with Theory-of-Mind?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03051","snapshot_observed_at":"2026-08-11T05:41:47.755625Z","title":"P.; Gupta, A.; McKee, K","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.755625Z"},"links":{"cited_paper":"/paper/2310.03051","citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:0e58e9169f0f519c2ceff04de202460ba226b44305bc2c270078709f09bb77b7","observation_id":"2f6e8187-87b8-45ae-b822-ac35d278b408","resolution":{"observed_at":"2026-08-11T05:41:47.755625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-11T05:41:47.761955Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.761955Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:f2cbf45bcb7103cb1e404bdec0ad137f85bfe7a6901ed5eb4354e61b0d450ae6","observation_id":"0e02625f-031a-4bdf-998f-29947d16de37","resolution":{"observed_at":"2026-08-11T05:41:47.761955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-12T16:51:44.047492Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":39,"verified_exact":0,"verified_fuzzy":5},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 0 inbound Pith citation observations for arXiv:2412.17295."}