{"as_of":"2026-08-10T06:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:07cc25b66840f628e57292ead4c55da006587a8557a1b93c7b147affe1164667","coverage":[{"denominator":83,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":83,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T06:07:34.594968Z","state":"measured"},{"denominator":83,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":83,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.05070/citation-record","integrity":"/paper/2608.05070/integrity","json":"/paper/2608.05070/citation-record.json","paper":"/paper/2608.05070"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.02800","last_updated":"2026-06-23T17:33:32Z","snapshot_observed_at":"2026-07-06T23:43:07.940839Z","submitted_at":"2026-06-01T19:12:30Z","title":"Cosmos 3: Omnimodal World Models for Physical AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.02800","snapshot_observed_at":"2026-08-06T06:07:34.380165Z","title":"Cosmos 3: Omnimodal world models for physical ai.arXiv preprint arXiv:2606.02800, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.380165Z"},"links":{"cited_paper":"/paper/2606.02800","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:86f8f0f7baffbb5e0c3f16a7cafd9cec19648628a1537f071963785d323ae5c8","observation_id":"49e6124c-77a7-49d7-acd3-efdae777dd89","resolution":{"observed_at":"2026-08-06T06:07:34.380165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.20668","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:21.918315Z","title":"From masks to worlds: A hitchhiker’s guide to world models.arXiv preprint arXiv:2510.20668, 2025","venue":null,"work_id":"9acb8de7-fc96-4137-8ebd-b4afe60e3311","year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.384085Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:c199442c91122ea849aa298fecd6b6466f5f61da1cc5165340dc844a8b46d9af","observation_id":"94c360ca-f68d-4952-8506-972c4c41e27a","resolution":{"observed_at":"2026-08-06T06:08:22.348534Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-06T06:07:34.386997Z","title":"Qwen3-vl technical report.arXiv preprint arXiv:2511.21631, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.386997Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:6b1e19308a5dcc9f87883f39680e6e4d00c254a7d447a04b0f81183cd673ab29","observation_id":"938e707a-b866-43c4-a692-5ce40ec0f7d5","resolution":{"observed_at":"2026-08-06T06:07:34.386997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.390188Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.390188Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:2705a7efaf1cb82148c2ab0f58749d3f6f7fd75a8a18a45f3481175dd261656d","observation_id":"62216367-401e-4033-a47b-b4905ae1a015","resolution":{"observed_at":"2026-08-06T06:07:34.390188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.393029Z","title":"Ambigest: A dataset of social gestures with inter-class similarity and intra-class variability","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.393029Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:3222880986576fae0da8a8726bdbebe9e8be650c590deaa3656c23f5d921eebf","observation_id":"f6b1d309-374f-4d4c-9c78-f8a84d9b8b6e","resolution":{"observed_at":"2026-08-06T06:07:34.393029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.395911Z","title":"Video generation models as world simulators","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.395911Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:0aaa6c895ef9a0a619f1d5704968306fa9413cf1a1bb3aab7b8e9b8ada7b55d3","observation_id":"fcd8d50c-e834-4681-bc5f-0e4d31f7232b","resolution":{"observed_at":"2026-08-06T06:07:34.395911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.399002Z","title":"Genie: Generative interactive environments","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.399002Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:f82853f9107de545ddb41fe13aeac823345cfded1b054a16bf27c2bc34d5cbd0","observation_id":"6b0f2089-2724-4012-8061-9bf6e070ada4","resolution":{"observed_at":"2026-08-06T06:07:34.399002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.401487Z","title":"Socialgesture: Delving into multi-person gesture understanding","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.401487Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:2cef41500e0b12874f39b7c5a17256b28b2517f797eb4c8edf1a32948bce5841","observation_id":"78225e38-a359-4e78-93b9-a3ce07305cb7","resolution":{"observed_at":"2026-08-06T06:07:34.401487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:31.814250Z","title":"Gamegen-x: Interactive open- world game video generation","venue":null,"work_id":"0dfca0a7-ec87-4456-a66a-d31441eab873","year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.404095Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:f360b82075baa9e01e40547de64e1d85742f26c224191aef2041d0e1bef7c8a0","observation_id":"e36edbca-8bf9-4479-8c0d-90010906e44c","resolution":{"observed_at":"2026-08-06T06:08:31.949076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:31.654215Z","title":"Unils: End-to-end audio-driven avatars for unified listening and speaking","venue":null,"work_id":"2a98d613-3ec7-4c05-9e00-d1e2e3430bcf","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.406801Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:4369fe0af33eee4473869d9e3f8db3ac3aafdec73ea76c65a01c081da195429a","observation_id":"4bf46882-81ca-4504-a02f-dc0cf813bd42","resolution":{"observed_at":"2026-08-06T06:08:31.756907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.409421Z","title":"Oasis: A universe in a transformer.URL: https://oasis-model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.409421Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:effc2449948a071317be4dc2947c5a75c790d65196ae26720c1cc55d8676b12d","observation_id":"5d846b82-3287-45b6-9fcd-5e511aea2bd2","resolution":{"observed_at":"2026-08-06T06:07:34.409421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.412122Z","title":"Worldscore: A unified evaluation benchmark for world generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.412122Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:3bbb6417e62e852e71ccbd8659b3ecd5398dcbebb3e75f6f493e022cc7bc94ba","observation_id":"70c1c402-76f8-4d31-a264-61c4d2bf33af","resolution":{"observed_at":"2026-08-06T06:07:34.412122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:31.455365Z","title":"The matrix: Infinite-horizon world generation with real-time moving control.Advances in Neural Information Processing Systems, 38:87318–87344, 2026","venue":null,"work_id":"894cb39b-a654-4876-923a-59b4f3061e83","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.414991Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:18136b1dc91f63d64c8e2efa3aec1aa61f7144a94272b6774b4fdb2ae1f6e049","observation_id":"d2c52cf2-0f07-4ea2-b81d-d9deced9d262","resolution":{"observed_at":"2026-08-06T06:08:31.562991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.417402Z","title":"Longvie 2: Multimodal controllable ultra-long video world model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.417402Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:1806b16d8b0585acdc75faaea7f25831471088b22fe4a378aba503e4f4d1d4a7","observation_id":"c258aff9-ad34-4c42-aa61-3e45aa9aa387","resolution":{"observed_at":"2026-08-06T06:07:34.417402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08388","last_updated":"2025-04-11T09:41:04Z","snapshot_observed_at":"2026-08-07T16:06:34.954758Z","submitted_at":"2025-04-11T09:41:04Z","title":"MineWorld: a Real-Time and Open-Source Interactive World Model on Minecraft","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08388","snapshot_observed_at":"2026-08-06T06:07:34.419786Z","title":"Mineworld: a real-time and open-source interactive world model on minecraft.arXiv preprint arXiv:2504.08388, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.419786Z"},"links":{"cited_paper":"/paper/2504.08388","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:6408437cc3ef6cdc388714e868c641b82005122630705c1876a16cf68f0cafa7","observation_id":"0f8eacfb-ad78-4035-8bb8-4993efafaa89","resolution":{"observed_at":"2026-08-06T06:07:34.419786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.03233","last_updated":"2026-01-06T18:24:41Z","snapshot_observed_at":"2026-07-06T22:40:51.136169Z","submitted_at":"2026-01-06T18:24:41Z","title":"LTX-2: Efficient Joint Audio-Visual Foundation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.03233","snapshot_observed_at":"2026-08-06T06:07:34.422791Z","title":"Ltx-2: Efficient joint audio-visual foundation model.arXiv preprint arXiv:2601.03233, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.422791Z"},"links":{"cited_paper":"/paper/2601.03233","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:d3bfe76cc59fe7f676e5f883c4a9d916e64dff5b51e1f0504ae930043e3f7679","observation_id":"f98d0a25-82ee-4045-9fe4-6874ad15e693","resolution":{"observed_at":"2026-08-06T06:07:34.422791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:31.265236Z","title":"Voyager: Long-range and world-consistent video diffusion for explorable 3d scene generation.ACM Transactions on Graphics (TOG), 44(6):1–15, 2025","venue":null,"work_id":"85224604-bfef-4c5c-83c2-47080c8eb7f2","year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.425711Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:ed9a07f6f08a14cbe873aa8b96852e764f5991d644a9c6b57d892570733869d7","observation_id":"c294d5fa-4f9d-446b-99ff-45fab41619d8","resolution":{"observed_at":"2026-08-06T06:08:31.363548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:31.082897Z","title":"Bind-your-avatar: Multi- character-talking video generation with dynamic 3d-mask-based embedding router","venue":null,"work_id":"50f6fca2-8ab1-4621-a16c-2174d2ec568a","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.428485Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:7c7e28f27472122b3dd0c7c4227a7feccffadf9269d36c878e206e1541b0d647","observation_id":"6673ac12-bbc0-46d0-b822-ad6f66cda458","resolution":{"observed_at":"2026-08-06T06:08:31.125282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.430983Z","title":"Can mllms read the room? a multimodal benchmark for assessing deception in multi-party social interactions.arXiv preprint arXiv:2511.16221, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.430983Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:122a587b14349b00681737c888db0160160c74000a28128bd4d09a6c315c94eb","observation_id":"34cda8f6-18bd-4085-9b82-815ea5c07e0c","resolution":{"observed_at":"2026-08-06T06:07:34.430983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.15764","last_updated":"2026-05-15T09:24:41Z","snapshot_observed_at":"2026-07-06T23:27:01.213106Z","submitted_at":"2026-05-15T09:24:41Z","title":"GRASP: Learning to Ground Social Reasoning in Multi-Person Non-Verbal Interactions","version":1},"cited_work":{"arxiv_id":"2605.15764","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.15764","snapshot_observed_at":"2026-08-06T06:08:21.650683Z","title":"GRASP: Learning to Ground Social Reasoning in Multi-Person Non-Verbal Interactions","venue":"cs.CV","work_id":"f1a78571-e2a4-4143-b760-1cb8474dda84","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.433367Z"},"links":{"cited_paper":"/paper/2605.15764","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:6dd9ef585687fb0640ecaa79b3a991a8871a84f98cd2f69daa5ef591b4299198","observation_id":"610f178b-cfba-4332-9cb6-591cfccf2fb3","resolution":{"observed_at":"2026-08-06T06:08:21.667996Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:30.885361Z","title":"Let them talk: Audio-driven multi-person conversational video generation.Advances in Neural Information Processing Systems, 38:70990–71013, 2026","venue":null,"work_id":"f6e6b807-0ecf-4e57-bded-84c113f6e21d","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.436396Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:bbe2442819b5b5920a5b48bc4faf182d329b10e904f20ab62326bba1ada7a60c","observation_id":"2c928ef5-900b-4af8-b419-3260bce49e8a","resolution":{"observed_at":"2026-08-06T06:08:30.981789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.439047Z","title":"Modeling multimodal social interactions: new challenges and baselines with densely aligned representations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.439047Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:20bf5cd7b51aec739bbba3629085b6d136b6b00c92df1a2a8b5ea925ee61033b","observation_id":"db7fbc3f-a25b-4a1c-a7ce-e7566cc6db8a","resolution":{"observed_at":"2026-08-06T06:07:34.439047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:30.714912Z","title":"Worldmodelbench: Judging video generation models as world models.Advances in Neural Information Processing Systems, 38, 2026","venue":null,"work_id":"a411be38-a80e-4e45-b566-4883f310f1b7","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.441410Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:8612b75b7525561200706dd088af0ec2972a04bb8f528d5f4e09f9ab107aee39","observation_id":"1f097e2e-73dc-4608-8b7b-6657338952bd","resolution":{"observed_at":"2026-08-06T06:08:30.811623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17201","last_updated":"2025-06-20T17:50:37Z","snapshot_observed_at":"2026-08-06T23:28:21.347321Z","submitted_at":"2025-06-20T17:50:37Z","title":"Hunyuan-GameCraft: High-dynamic Interactive Game Video Generation with Hybrid History Condition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.17201","snapshot_observed_at":"2026-08-06T06:07:34.444046Z","title":"Hunyuan-gamecraft: High-dynamic interactive game video generation with hybrid history condition.arXiv preprint arXiv:2506.17201, 2(3):6, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.444046Z"},"links":{"cited_paper":"/paper/2506.17201","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:ec2ac87761e00a419babcf5034890ef083a7de9bfb0262e09ea8cdc764fffcca","observation_id":"7630085e-2c01-4e65-a034-20e628b3473a","resolution":{"observed_at":"2026-08-06T06:07:34.444046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:30.540054Z","title":"Towards online multi-modal social interaction understanding.Transactions on Machine Learning Research (TMLR), 2026","venue":null,"work_id":"57cd5f7d-0d1f-4c85-a547-2c1b171e6efa","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.446905Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:01b1055a035493684bd0420a0805ee4631eb07500a5b6b782ee36d6922ded9dc","observation_id":"aebb0533-2a6e-49db-8b3e-33e8fe5ef4e6","resolution":{"observed_at":"2026-08-06T06:08:30.654128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:30.358469Z","title":"Omni-mmsi: Toward identity-attributed social interaction understanding","venue":null,"work_id":"6d4746ef-bbed-4861-888c-51635886a3f3","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.449823Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:4824d98cd9c224a609759d4486a249370ef7818b615f69eca4079dc91b1a84d5","observation_id":"b61c4584-fdfe-4b9b-b723-e8344f09a412","resolution":{"observed_at":"2026-08-06T06:08:30.449487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:30.094912Z","title":"Sekai: A video dataset towards world exploration","venue":null,"work_id":"9e1cc14c-f06b-44e6-86e2-a6e2edb64744","year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.452465Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:bc59cbe5a2045f9feed3bff98031bf990b51d3bcd82713aee2f3e27d1c9319b5","observation_id":"2a36068d-0354-49be-97a0-833ced67d20a","resolution":{"observed_at":"2026-08-06T06:08:30.270423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.454896Z","title":"Wildworld: A large-scale dataset for dynamic world modeling with actions and explicit state toward generative arpg.arXiv preprint arXiv:2603.23497, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.454896Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:75c85ff655db2cbeae2fe9cc1efad547bda4a26b90a25a716cecedfab6cb74c2","observation_id":"057c0d93-6a6b-4357-beb5-de094200b9e7","resolution":{"observed_at":"2026-08-06T06:07:34.454896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:29.837430Z","title":"Intergen: Diffusion-based multi- human motion generation under complex interactions.International Journal of Computer Vision, 132(9): 3463–3483, 2024","venue":null,"work_id":"a2e0ddc9-614c-4fc9-8030-781289695543","year":2024},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.457389Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:aa49cab39671ba14590f5ca9cac7e99b26d72d178469741d57a713e7d8a952ca","observation_id":"ed273198-06ff-417e-824e-d77223bda03a","resolution":{"observed_at":"2026-08-06T06:08:29.985229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:29.570380Z","title":"Polyslgen: Online multimodal speaking-listening reaction generation in polyadic interaction","venue":null,"work_id":"11e68f32-9a22-41bc-93a9-7aae9ee8ad93","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.459711Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:c88315bf8f8b908945ea71849f63256c663a191006c2353b377566f8b7738699","observation_id":"575ff1b3-2819-40b5-983b-48842070529e","resolution":{"observed_at":"2026-08-06T06:08:29.679216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.461925Z","title":"Dl3dv-10k: A large-scale scene dataset for deep learning-based 3d vision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.461925Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:43fbb1753b5525a899b74ee4b1750ff567c260908f82b0d8595e07b7319e74ef","observation_id":"73afcc6f-6715-450e-9923-521886e2d2d8","resolution":{"observed_at":"2026-08-06T06:07:34.461925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:29.146181Z","title":"Uvagaze: Unsupervised 1-to-2 views adaptation for gaze estimation","venue":null,"work_id":"e09af479-a37d-46e6-9ce8-15c027bfea0f","year":2024},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.464520Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:6d950ad7e7bffc4ec3a794fe4beba49dddb62b2248d1c41c976cd108bfd5f3da","observation_id":"b9d0db5c-ffbf-42f2-81b0-0e1bb3d06d29","resolution":{"observed_at":"2026-08-06T06:08:29.322043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:28.839002Z","title":"Pnp-ga+: Plug-and-play domain adaptation for gaze estimation using model variants.IEEE Transactions on Pattern Analysis and Machine Intelligence, 46 (5):3707–3721, 2024","venue":null,"work_id":"ce8b9b1d-e354-4a66-8a49-fbaa1f76123d","year":2024},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.466870Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:bcd7e9ef29962391b2a5d797b181eee4cb252940bbb2a8124abd8e63ab62ac1c","observation_id":"a5afb45d-6680-4a0a-8db2-79d2d17efdaa","resolution":{"observed_at":"2026-08-06T06:08:29.015741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:28.295543Z","title":"Single-to-dual-view adaptation for egocentric 3d hand pose estimation","venue":null,"work_id":"fc883e35-cd86-4ee3-afa1-20386438115e","year":2024},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.469297Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:83a72e434c6b56fb13f9370020d8d736ca3cfb0c8181155e6a6e265cd7b58a24","observation_id":"53af6114-5c1e-420f-9d13-7af024036908","resolution":{"observed_at":"2026-08-06T06:08:28.547480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:27.974142Z","title":"Sfhand: A streaming framework for language-guided 3d hand forecasting and embodied manipulation.arXiv e-prints, pages arXiv–2511, 2025","venue":null,"work_id":"82e09845-ab11-487b-bab3-e01604261c27","year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.471792Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:e27787d938d069079b9e740ebadc13e216354b52aaf62130ef53f8e24f0b0627","observation_id":"afdde464-4467-49bb-b317-90bcf560cfe9","resolution":{"observed_at":"2026-08-06T06:08:28.047755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:27.687782Z","title":"Generalizing gaze estimation with outlier-guided collaborative adaptation","venue":null,"work_id":"4ecbd797-8277-42b6-8eec-b8f1c2de3452","year":2021},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.474102Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:1b50f858c3fdef77869fa61a6fb03639cd2770d688e9ff85bc8fba1e3851ede7","observation_id":"4bedeffd-b3c4-43de-9ee9-e50f0d05fa27","resolution":{"observed_at":"2026-08-06T06:08:27.856661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.476931Z","title":"Playmate2: Training-free multi-character audio-driven animation via diffusion transformer with reward feedback.arXiv preprint arXiv:2510.12089, 2025","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.476931Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:076beca5272dfc1f9e5a3cc765b3db6dc03c3a2362e0e18ccfbe6b0fae530a59","observation_id":"f03c0bd7-9337-4c68-b1c6-c5545a59d7d1","resolution":{"observed_at":"2026-08-06T06:07:34.476931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:27.362870Z","title":null,"venue":null,"work_id":"52514ac6-6c4c-4d6c-a5d1-a663cea66c54","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.479780Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:f6e0c4463535698e564011e32d2dd4daa81e31f7939f7d041b33f17d0ef19e28","observation_id":"51f7b8c5-957a-478b-96f7-fb567fbbdee8","resolution":{"observed_at":"2026-08-06T06:08:27.536899Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.482069Z","title":"Multimediate: Multi-modal group behaviour analysis for artificial mediation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.482069Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:4d2bfc09bafc837ecd0c526c04d046f045fa17fe96139ae720e40b78a703487b","observation_id":"ab0bca83-0938-4e3f-9061-be7e67ce6c82","resolution":{"observed_at":"2026-08-06T06:07:34.482069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24389","last_updated":"2025-08-28T04:31:31Z","snapshot_observed_at":"2026-08-07T20:43:34.710285Z","submitted_at":"2025-05-30T09:19:33Z","title":"Leadership Assessment in Pediatric Intensive Care Unit Team Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.24389","snapshot_observed_at":"2026-08-06T06:07:34.484477Z","title":"Leadership assessment in pediatric intensive care unit team training.arXiv preprint arXiv:2505.24389, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.484477Z"},"links":{"cited_paper":"/paper/2505.24389","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:5c3d33b5baff319d06f08f21d9c561d502a153d19877f713ef3086cea09aab71","observation_id":"28eecf18-749d-4350-8f12-88306a01cf77","resolution":{"observed_at":"2026-08-06T06:07:34.484477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:27.087064Z","title":"Multi-speaker attention alignment for multimodal social interaction","venue":null,"work_id":"2ed0c98b-3f0e-4eab-9416-cd3fab475a2b","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.487236Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:bca9145db41e21389bd769006ee42557fd2e93276e5c3aa6711b2da1a6993fd1","observation_id":"56da9984-efd2-429a-85ef-5c8e6d8a661b","resolution":{"observed_at":"2026-08-06T06:08:27.246735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.10079","last_updated":"2026-05-11T07:01:38Z","snapshot_observed_at":"2026-07-06T23:22:03.830881Z","submitted_at":"2026-05-11T07:01:38Z","title":"SocialDirector: Training-Free Social Interaction Control for Multi-Person Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.10079","snapshot_observed_at":"2026-08-06T06:07:34.489797Z","title":"Socialdirector: Training- free social interaction control for multi-person video generation.arXiv preprint arXiv:2605.10079, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.489797Z"},"links":{"cited_paper":"/paper/2605.10079","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:c5fe7417fb31a5703d201cead68a85e75652763c8023237890532b34366ad88e","observation_id":"09e4b57b-fb1b-49a5-b7ad-f1f584301a5b","resolution":{"observed_at":"2026-08-06T06:07:34.489797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:26.799668Z","title":"Svbench: Evaluation of video generation models on social reasoning","venue":null,"work_id":"03c17be2-1733-41c7-b013-ae08272bd77a","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.492399Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:023389d0c8be87ee9ba877370923161a59fffc65d917c803a077d390301f55f0","observation_id":"54b80bc5-7685-441c-a194-1da91a10a243","resolution":{"observed_at":"2026-08-06T06:08:26.958346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.494676Z","title":"Dyadit: A multi-modal diffusion transformer for socially favorable dyadic gesture generation.arXiv preprint arXiv:2602.23165, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.494676Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:49e09741f06c1ae2658a7d3eff60b0561c5565a44af7c556dd65c82c2753bb67","observation_id":"2c4cc2e6-04b1-4af2-b5c3-4841dc08fe6f","resolution":{"observed_at":"2026-08-06T06:07:34.494676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:26.555938Z","title":"Actavatar: Temporally-aware precise action control for talking avatars","venue":null,"work_id":"60eca9e5-e936-427e-9e5a-8d4634aba6c3","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.497175Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:c556fcc3eba75d486bb354bf1436021b96ef62f7d2662b6d56d06ee5dd3bfa27","observation_id":"ed5d2ac6-3f3a-460a-9c32-b8c7a3faebaf","resolution":{"observed_at":"2026-08-06T06:08:26.681830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:26.278627Z","title":"Unigaze: Towards universal gaze estimation via large-scale pre-training","venue":null,"work_id":"9e3e0845-822b-4efe-8e4a-16493e522f47","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.499592Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:bd53238f4ba446cf65f38ddf32c927d4c308ed79d74705ace0e2e8bd891f7101","observation_id":"a2119661-dafa-4216-b499-755943d9c688","resolution":{"observed_at":"2026-08-06T06:08:26.449440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:26.003199Z","title":"Qwen3.6-35B-A3B: Agentic coding power, now open to all, April 2026","venue":null,"work_id":"7f8119d0-24cf-4eae-872c-ad7ba7f7daec","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.501958Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:ac6eea0ad8b3d0924542ce1e495034db8e2d3e3621ad71307062dc1f0d7212a9","observation_id":"95c00974-5d9a-461a-96a6-e649b0876cba","resolution":{"observed_at":"2026-08-06T06:08:26.121057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.504273Z","title":"Robust speech recognition via large-scale weak supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.504273Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:b70b1015b04f44bf8dcc1eff6590f2785ba03633bdd01d658487ae00e306a600","observation_id":"06a1696e-db0a-46e9-9907-20b71c9b8925","resolution":{"observed_at":"2026-08-06T06:07:34.504273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:25.710507Z","title":"Interact2ar: Full-body human-human interaction generation via autoregressive diffusion models","venue":null,"work_id":"77705563-7349-45ad-80a9-10d716026156","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.506755Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:a1414c1235e85c636634887fd39891acd874ebff858f8a511a33ee26881d49dc","observation_id":"ad039aea-ffa3-4ab5-b489-379fe19b425c","resolution":{"observed_at":"2026-08-06T06:08:25.845367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.509351Z","title":"Solaris: Building a multiplayer video world model in minecraft.arXiv preprint arXiv:2602.22208, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.509351Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:4567ae186d7fe73912eaa337c15ccefb08a3d406b76cac6e79ae7564de473f91","observation_id":"5007943b-813a-4db0-8dd6-80a6073b4745","resolution":{"observed_at":"2026-08-06T06:07:34.509351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.09507","last_updated":"2026-06-08T13:59:50Z","snapshot_observed_at":"2026-08-08T11:30:26.231274Z","submitted_at":"2026-06-08T13:59:50Z","title":"Prisma-World: Camera-Controllable Multi-Agent Video World Model","version":1},"cited_work":{"arxiv_id":"2606.09507","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.09507","snapshot_observed_at":"2026-08-06T06:08:15.475977Z","title":"Prisma-World: Camera-Controllable Multi-Agent Video World Model","venue":"cs.CV","work_id":"fce57766-586c-4ba8-8638-556872ba5fba","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.511899Z"},"links":{"cited_paper":"/paper/2606.09507","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:7267ca8e3a3bee4ca3214c176f6b9540c69ec4bef0a72cbcc014fb338028dd6c","observation_id":"125b0109-3651-48f3-9988-e644215be762","resolution":{"observed_at":"2026-08-06T06:08:15.480286Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.14614","last_updated":"2026-06-09T16:18:08Z","snapshot_observed_at":"2026-08-03T16:11:09.055651Z","submitted_at":"2025-12-16T17:22:46Z","title":"WorldPlay: Towards Long-Term Geometric Consistency for Real-Time Interactive World Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.14614","snapshot_observed_at":"2026-08-06T06:07:34.514739Z","title":"Worldplay: Towards long-term geometric consistency for real-time interactive world modeling.arXiv preprint arXiv:2512.14614, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.514739Z"},"links":{"cited_paper":"/paper/2512.14614","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:d792967943d0bafacb363dc165834f59779be51c3d466ca1bcc3769722776f93","observation_id":"f3423114-24b6-48f7-a867-222740934380","resolution":{"observed_at":"2026-08-06T06:07:34.514739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:25.429938Z","title":"Alayaworld: Long-horizon and playable video world generation,","venue":null,"work_id":"16fff6d4-5bac-471a-b134-7872df289adf","year":null},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.517331Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:5036a2543d4edcdb34c0c6b534f2bf57a0993f1351b8fc9585baa1d2c8d82226","observation_id":"bffb5131-ad05-429a-9561-02849b84fa23","resolution":{"observed_at":"2026-08-06T06:08:25.560758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.20540","last_updated":"2026-01-28T12:37:01Z","snapshot_observed_at":"2026-08-03T01:29:14.204066Z","submitted_at":"2026-01-28T12:37:01Z","title":"Advancing Open-source World Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.20540","snapshot_observed_at":"2026-08-06T06:07:34.522917Z","title":"Advancing open-source world models.arXiv preprint arXiv:2601.20540, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.522917Z"},"links":{"cited_paper":"/paper/2601.20540","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:3c4d6886960bccd41d8c523931dcf6abb7b4b5793674c1bd12459d7277c43889","observation_id":"f6e156b0-8489-4a55-bb46-0caab6daa0e0","resolution":{"observed_at":"2026-08-06T06:07:34.522917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:25.110402Z","title":"Unsplash: Beautiful, free images and photos","venue":null,"work_id":"8059e63b-24da-4a71-b209-bae2c5b26c1c","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.525582Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:30577b97b83af6b8e766b3c6ee508391802eea8dc91b58c2ef91b3c0862f4e52","observation_id":"1659a042-dd0a-469c-b2fe-cbf0bf785ddf","resolution":{"observed_at":"2026-08-06T06:08:25.226534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:24.806612Z","title":"Diffusion models are real-time game engines","venue":null,"work_id":"35324fcc-dd8a-4f22-b705-3c0a18f5bf40","year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.528046Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:c0d4b0e8ecb53230fe8978f688a654b89760d938bce9c865008bf029f8c74edb","observation_id":"90f2aff6-0307-4365-ac1b-eea74489bfd1","resolution":{"observed_at":"2026-08-06T06:08:24.992842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-06T06:07:34.530682Z","title":"Wan: Open and advanced large-scale video generative models.arXiv preprint arXiv:2503.20314, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.530682Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:a932aa7667a99d52612a2c5ca11efbfbf198eb68751716ef7c58c6d5801dcda4","observation_id":"ebe59fa0-9908-4285-9692-16d84fa6c058","resolution":{"observed_at":"2026-08-06T06:07:34.530682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:24.398254Z","title":"Spatialvid: A large-scale video dataset with spatial annotations","venue":null,"work_id":"ced3ae01-7e61-4321-b982-a71db183618e","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.533404Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:9cee4b839daf637db06e2ef7b7aa687a6fba5698403d6ecacfda675e377ed31a","observation_id":"4902d716-9eac-4ebc-847a-7707271eda9c","resolution":{"observed_at":"2026-08-06T06:08:24.618595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12956","last_updated":"2025-07-17T09:50:43Z","snapshot_observed_at":"2026-08-10T05:19:16.514953Z","submitted_at":"2025-07-17T09:50:43Z","title":"FantasyPortrait: Enhancing Multi-Character Portrait Animation with Expression-Augmented Diffusion Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.12956","snapshot_observed_at":"2026-08-06T06:07:34.535804Z","title":"Fantasyportrait: Enhancing multi-character portrait animation with expression-augmented diffusion transformers","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.535804Z"},"links":{"cited_paper":"/paper/2507.12956","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:8b9ae2ffcb70238d77c89232156d8008474b6bb658f61d1d0949229ce879571f","observation_id":"979f5c4d-4e40-4956-80a5-d8195902148a","resolution":{"observed_at":"2026-08-06T06:07:34.535804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.15182","last_updated":"2026-05-14T17:58:26Z","snapshot_observed_at":"2026-08-03T09:29:25.949113Z","submitted_at":"2026-05-14T17:58:26Z","title":"Warp-as-History: Generalizable Camera-Controlled Video Generation from One Training Video","version":1},"cited_work":{"arxiv_id":"2605.15182","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.15182","snapshot_observed_at":"2026-08-06T06:08:15.407122Z","title":"Warp-as-History: Generalizable Camera-Controlled Video Generation from One Training Video","venue":"cs.CV","work_id":"975faf80-d4f0-4ed0-a7b3-4a62f5020b17","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.538368Z"},"links":{"cited_paper":"/paper/2605.15182","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:bbd7b5bcc829ed7d95683f9a0599b1c4eabf85ec4b5355f954c0ee9ec17c4969","observation_id":"fbda0884-5445-49d9-b99b-b2ed0ab267f1","resolution":{"observed_at":"2026-08-06T06:08:15.410532Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.13347","last_updated":"2026-03-07T07:01:59Z","snapshot_observed_at":"2026-08-02T12:12:15.465550Z","submitted_at":"2025-07-17T17:59:53Z","title":"$\\pi^3$: Permutation-Equivariant Visual Geometry Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.13347","snapshot_observed_at":"2026-08-06T06:07:34.541085Z","title":"π3: Permutation-equivariant visual geometry learning.arXiv preprint arXiv:2507.13347, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.541085Z"},"links":{"cited_paper":"/paper/2507.13347","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:b27b1ddc2d42cbb02114b87653d7ea41ad3aebd5ab0e27b42baefd41fd207cb9","observation_id":"649f3d57-9a58-4f5c-8299-b46944a53720","resolution":{"observed_at":"2026-08-06T06:07:34.541085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.15256","last_updated":"2026-05-14T17:52:03Z","snapshot_observed_at":"2026-08-06T12:51:31.154504Z","submitted_at":"2026-05-14T17:52:03Z","title":"ReactiveGWM: Steering NPC in Reactive Game World Models","version":1},"cited_work":{"arxiv_id":"2605.15256","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.15256","snapshot_observed_at":"2026-08-06T06:08:15.386653Z","title":"ReactiveGWM: Steering NPC in Reactive Game World Models","venue":"cs.CV","work_id":"f255a4ec-c263-45ad-b8ff-beeff8e5c282","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.543800Z"},"links":{"cited_paper":"/paper/2605.15256","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:939428020be707a983e159e53cde1ff6b2ec25f83b1da171aa9e698262b23882","observation_id":"bb9bcdba-8d52-40bb-90dc-9bd16a9ab5fd","resolution":{"observed_at":"2026-08-06T06:08:15.390530Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.546337Z","title":"Interacthuman: Multi-concept human animation with layout-aligned audio conditions.arXiv preprint arXiv:2506.09984, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.546337Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:7af90c89ca46fe84ec30ce87e406a7084eac90b5c9a0a95d65b00dd8214d65b1","observation_id":"f648ecf4-8ddd-4b1e-9a87-ef74b7035c6f","resolution":{"observed_at":"2026-08-06T06:07:34.546337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.08995","last_updated":"2026-04-13T03:48:38Z","snapshot_observed_at":"2026-07-06T22:57:59.555972Z","submitted_at":"2026-04-10T06:00:09Z","title":"Matrix-Game 3.0: Real-Time and Streaming Interactive World Model with Long-Horizon Memory","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.08995","snapshot_observed_at":"2026-08-06T06:07:34.548712Z","title":"Matrix-game 3.0: Real-time and streaming interactive world model with long-horizon memory.arXiv preprint arXiv:2604.08995, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.548712Z"},"links":{"cited_paper":"/paper/2604.08995","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:7249cf12e45c529b346c06570933541ede04e479e576c2d15431cadd53d1b863","observation_id":"cb1392e2-a5ef-41b8-b0fc-61e237d22556","resolution":{"observed_at":"2026-08-06T06:07:34.548712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.17730","last_updated":"2026-06-16T09:47:32Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-16T09:47:32Z","title":"ActWorld: From Explorable to Interactive World Model via Action-Aware Memory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.17730","snapshot_observed_at":"2026-08-06T06:07:34.551706Z","title":"Actworld: From explorable to interactive world model via action-aware memory.arXiv preprint arXiv:2606.17730, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.551706Z"},"links":{"cited_paper":"/paper/2606.17730","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:abee8d846fea0fde94e3843f84c29d671b9bec82b05f48a036dfd02c32450cec","observation_id":"0c510ae0-fff4-4e5d-b069-901d1dae7ea7","resolution":{"observed_at":"2026-08-06T06:07:34.551706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:23.867225Z","title":"Inter-x: Towards versatile human-human interaction analysis","venue":null,"work_id":"b4e7ebb3-5c18-4066-bb52-54ffa23983e4","year":2024},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.554503Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:8d701989ae3d64afff6b1a811766a736c90553caaf6d3c9d03e4cc637b694dc8","observation_id":"1904aa81-a8e3-438c-9b92-c395c6fbcb09","resolution":{"observed_at":"2026-08-06T06:08:24.088232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.21686","last_updated":"2026-04-23T13:50:47Z","snapshot_observed_at":"2026-07-06T23:08:14.631453Z","submitted_at":"2026-04-23T13:50:47Z","title":"WorldMark: A Unified Benchmark Suite for Interactive Video World Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.21686","snapshot_observed_at":"2026-08-06T06:07:34.556983Z","title":"Worldmark: A unified benchmark suite for interactive video world models.arXiv preprint arXiv:2604.21686, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.556983Z"},"links":{"cited_paper":"/paper/2604.21686","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:8a70788797f27f51629b97b678cb8b498cbbd22b48ac00c78df57e961a0cbbeb","observation_id":"bca0e2d3-1191-41c7-95f9-d232d90974fd","resolution":{"observed_at":"2026-08-06T06:07:34.556983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.20083","last_updated":"2026-07-01T14:45:31Z","snapshot_observed_at":"2026-08-03T13:07:32.043979Z","submitted_at":"2026-06-18T11:01:34Z","title":"Holo-World: Unified Camera, Object and Weather Control for Video World Model","version":3},"cited_work":{"arxiv_id":"2606.20083","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.20083","snapshot_observed_at":"2026-08-06T06:08:14.569797Z","title":"Holo-World: Unified Camera, Object and Weather Control for Video World Model","venue":"cs.CV","work_id":"df8d16c5-1ed1-4694-a4cf-45d3c87bc8a2","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.559497Z"},"links":{"cited_paper":"/paper/2606.20083","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:e0aaf224c3ce1f007a6be341ca36d1938d202e81ea286b1b4da821a2f58eba13","observation_id":"f909dfae-a9d1-4dfb-b04d-bd0c75d24d02","resolution":{"observed_at":"2026-08-06T06:08:14.574031Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.25874","last_updated":"2026-05-25T14:01:31Z","snapshot_observed_at":"2026-07-06T23:35:46.157653Z","submitted_at":"2026-05-25T14:01:31Z","title":"WBench: A Comprehensive Multi-turn Benchmark for Interactive Video World Model Evaluation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.25874","snapshot_observed_at":"2026-08-06T06:07:34.562197Z","title":"Wbench: A comprehensive multi-turn benchmark for interactive video world model evaluation.arXiv preprint arXiv:2605.25874, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.562197Z"},"links":{"cited_paper":"/paper/2605.25874","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:633a299022f2311efa5d5363193b1423b544d8bcdc92189b72b30349bf42a671","observation_id":"6c0a5bf3-0efb-467f-8391-4afb5f8fcd94","resolution":{"observed_at":"2026-08-06T06:07:34.562197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.11482","last_updated":"2026-06-09T22:15:51Z","snapshot_observed_at":"2026-07-06T23:50:35.052764Z","submitted_at":"2026-06-09T22:15:51Z","title":"Building Social World Models with Large Language Models","version":1},"cited_work":{"arxiv_id":"2606.11482","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.11482","snapshot_observed_at":"2026-08-06T06:08:14.541435Z","title":"Building Social World Models with Large Language Models","venue":"cs.SI","work_id":"c4bf331c-993d-447a-8550-801812478372","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.564854Z"},"links":{"cited_paper":"/paper/2606.11482","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:186b6ebee3b40004646571359f1b885dae958c76537419dab2701ac16fb1117d","observation_id":"364864f5-b195-44d7-9af8-e434629a14da","resolution":{"observed_at":"2026-08-06T06:08:14.547597Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:23.639920Z","title":"Socialgen: Modeling multi-human social interaction with language models","venue":null,"work_id":"0acb0b75-1bcf-45d1-bf81-545671c27f7b","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.567371Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:03d3a07fdb7fa6380ef58c942d95ad6be760654fa28a7ca0406fa8b8448fff45","observation_id":"f1d809de-5872-47f5-a9f3-f94bbfc2f85a","resolution":{"observed_at":"2026-08-06T06:08:23.733481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.569605Z","title":"Gamefactory: Creating new games with generative interactive videos","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.569605Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:f693d1a174e8d060000c01d3f40a9a50bbd5bdc019cb25cfcf4629466d87f054","observation_id":"59dbd000-e60f-477e-ae05-4143d99a2d48","resolution":{"observed_at":"2026-08-06T06:07:34.569605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.572287Z","title":"Helios: Real real-time long video generation model.arXiv preprint arXiv:2603.04379, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.572287Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:829cc6b36159cf8d6188e43185ea54d4e589b9708bccb052220fd39a46d1492e","observation_id":"b31979b7-63a0-4169-a4a6-b10170ba7cc1","resolution":{"observed_at":"2026-08-06T06:07:34.572287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.575022Z","title":"Social-iq: A question answering benchmark for artificial social intelligence","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.575022Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:1dfa7998ef0471ae9bbbbeee63198bac96b3171bbe3ec334127b8372b56acbb6","observation_id":"d0d1824d-488a-4d2c-8c86-1b981cc19c54","resolution":{"observed_at":"2026-08-06T06:07:34.575022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10157","last_updated":"2025-07-15T11:14:36Z","snapshot_observed_at":"2026-08-07T16:05:55.074747Z","submitted_at":"2025-04-14T12:12:52Z","title":"SocioVerse: A World Model for Social Simulation Powered by LLM Agents and A Pool of 10 Million Real-World Users","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10157","snapshot_observed_at":"2026-08-06T06:07:34.577651Z","title":"Socioverse: A world model for social simulation powered by llm agents and a pool of 10 million real-world users.arXiv preprint arXiv:2504.10157, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.577651Z"},"links":{"cited_paper":"/paper/2504.10157","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:329a4f2bcfbcef75cb9e5a7f681f5d6c09f2d4c8eac61b6c6b6b5ba7127251fa","observation_id":"6e750754-9ef8-40a4-9327-bb02619b3ce6","resolution":{"observed_at":"2026-08-06T06:07:34.577651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.580143Z","title":"Anytalker: Scaling multi-person talking video generation with interactivity refinement.arXiv preprint arXiv:2511.23475, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.580143Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:06889ad6d6705e84875a205d86f493ab627cdfbe7dc6a8a5dd204437ffc5632a","observation_id":"926a1039-1805-4198-af3d-b0d7c1881f13","resolution":{"observed_at":"2026-08-06T06:07:34.580143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.582548Z","title":"Stereo magnification: learning view synthesis using multiplane images.ACM Transactions on Graphics (TOG), 37(4):1–12, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.582548Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:76e06012bfa4276f6951c7fdfd4b15813cec9a3ffab84d4ea8dd34f2b95cb3c3","observation_id":"9a7c5d12-e861-4f3d-9b3b-c6c3f735965b","resolution":{"observed_at":"2026-08-06T06:07:34.582548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.584860Z","title":"Social world models.arXiv preprint arXiv:2509.00559, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.584860Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:35f44a1e8569bf818311ca66d62b3e85d6de4700a52ef607377f2fc61b23e376","observation_id":"832c8a36-4073-43dc-9dfa-3ddc0ce28c65","resolution":{"observed_at":"2026-08-06T06:07:34.584860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.587199Z","title":"Omniworld: A multi-domain and multi-modal dataset for 4d world modeling.arXiv preprint arXiv:2509.12201, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.587199Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:b0626a2d2dc66816bf454cf6935292e30dd9bf235d3e6af5704335b89c013974","observation_id":"3b8034f1-3efe-4167-8720-11ecde6203dc","resolution":{"observed_at":"2026-08-06T06:07:34.587199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.589448Z","title":"Evaltalker: Learning to evaluate real-portrait-driven multi-subject talking humans.arXiv preprint arXiv:2512.01340, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.589448Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:bab464beb44ae7892fdcbb79c829fcff25a9603caf32ebe4c3cba7de8e2ac022","observation_id":"62e2cdc1-bed8-4db9-a7d9-a22a812bbd39","resolution":{"observed_at":"2026-08-06T06:07:34.589448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.15178","last_updated":"2026-05-14T17:58:03Z","snapshot_observed_at":"2026-08-06T16:58:37.665408Z","submitted_at":"2026-05-14T17:58:03Z","title":"SANA-WM: Efficient Minute-Scale World Modeling with Hybrid Linear Diffusion Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.15178","snapshot_observed_at":"2026-08-06T06:07:34.592251Z","title":"Sana-wm: Efficient minute-scale world modeling with hybrid linear diffusion transformer","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.592251Z"},"links":{"cited_paper":"/paper/2605.15178","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:3ef929a20ac51e3590729085961edd13b0141e63b23921b21e9d6a269d5c6884","observation_id":"0b2272af-3298-4037-b147-b56508cce071","resolution":{"observed_at":"2026-08-06T06:07:34.592251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.594968Z","title":"Astra: General interactive world model with autoregressive denoising.arXiv preprint arXiv:2512.08931, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.594968Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:799bdd3d64aee73df2996d2e68f849689e5159a5e88f8395064fa3e59ebe4265","observation_id":"07045935-0a78-4e73-b9bd-27a3912f3b9a","resolution":{"observed_at":"2026-08-06T06:07:34.594968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.06291","last_updated":"2026-07-07T13:59:57Z","snapshot_observed_at":"2026-08-07T13:27:54.852993Z","submitted_at":"2026-07-07T13:59:57Z","title":"AlayaWorld: Long-Horizon and Playable Video World Generation","version":1},"cited_work":{"arxiv_id":"2607.06291","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.06291","snapshot_observed_at":"2026-08-06T06:08:15.445957Z","title":"AlayaWorld: Long-Horizon and Playable Video World Generation","venue":"cs.CV","work_id":"e5533d59-45ae-4293-918e-fa51589754b1","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.519966Z"},"links":{"cited_paper":"/paper/2607.06291","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:4162726822af61b7daa0c0e6c152eaa0b18cc7c8baf61c5b7f533adb723848f5","observation_id":"d58b23ff-c187-47ce-b1ba-d80288623957","resolution":{"observed_at":"2026-08-06T06:08:15.450348Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T15:54:55.505623Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models"},"reference_resolution":{"displayed":83,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":46,"verified_exact":8,"verified_fuzzy":29},"total_outbound_references":83},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 83 of 83 outbound references and 0 inbound Pith citation observations for arXiv:2608.05070."}