{"as_of":"2026-08-14T07:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:62d4295d51f67759b6bcb4ebadefd01ad979290e55b5f7983962bd0338090be0","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:35:36.773332Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.14505/citation-record","integrity":"/paper/2505.14505/integrity","json":"/paper/2505.14505/citation-record.json","paper":"/paper/2505.14505"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T15:35:34.126173Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14505","last_updated":"2025-05-20T15:34:36Z","snapshot_observed_at":"2026-08-10T18:25:34.594517Z","submitted_at":"2025-05-20T15:34:36Z","title":"ModRWKV: Transformer Multimodality in Linear Time","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:34.126173Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.14505"},"observation_digest":"sha256:32ecbcdd57e48bf1aba04ad8081ad22e598864fd20df0e27d6ffc13def3ce923","observation_id":"b546717e-ca45-4bcd-aad1-ab69ef9020d6","resolution":{"observed_at":"2026-08-07T15:35:34.126173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10393","last_updated":"2024-11-11T04:48:24Z","snapshot_observed_at":"2026-08-12T22:23:53.248965Z","submitted_at":"2024-10-14T11:29:38Z","title":"GIFT-Eval: A Benchmark For General Time Series Forecasting Model Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10393","snapshot_observed_at":"2026-08-07T15:35:34.216986Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14505","last_updated":"2025-05-20T15:34:36Z","snapshot_observed_at":"2026-08-10T18:25:34.594517Z","submitted_at":"2025-05-20T15:34:36Z","title":"ModRWKV: Transformer Multimodality in Linear Time","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:34.216986Z"},"links":{"cited_paper":"/paper/2410.10393","citing_paper":"/paper/2505.14505"},"observation_digest":"sha256:2cfa6e7d013ba899e5772d99b366ed603c712551c7ec9a7302920a059414cc8e","observation_id":"66fbd247-4f4a-4426-9aa7-f660f41a03fd","resolution":{"observed_at":"2026-08-07T15:35:34.216986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1709.05522","last_updated":"2017-09-16T14:33:27Z","snapshot_observed_at":"2026-08-10T15:56:30.507640Z","submitted_at":"2017-09-16T14:33:27Z","title":"AISHELL-1: An Open-Source Mandarin Speech Corpus and A Speech Recognition Baseline","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1709.05522","snapshot_observed_at":"2026-08-07T15:35:34.287638Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14505","last_updated":"2025-05-20T15:34:36Z","snapshot_observed_at":"2026-08-10T18:25:34.594517Z","submitted_at":"2025-05-20T15:34:36Z","title":"ModRWKV: Transformer Multimodality in Linear Time","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:34.287638Z"},"links":{"cited_paper":"/paper/1709.05522","citing_paper":"/paper/2505.14505"},"observation_digest":"sha256:cc844a90d445e50368f59a81b122577497f440cf940981e7daa5dbf29ab26143","observation_id":"aaf3b6e6-43e1-4be0-b3cf-23b4959b8af4","resolution":{"observed_at":"2026-08-07T15:35:34.287638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:34.359274Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14505","last_updated":"2025-05-20T15:34:36Z","snapshot_observed_at":"2026-08-10T18:25:34.594517Z","submitted_at":"2025-05-20T15:34:36Z","title":"ModRWKV: Transformer Multimodality in Linear Time","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:34.359274Z"},"links":{"citing_paper":"/paper/2505.14505"},"observation_digest":"sha256:151314664ea3046bc71b513be14a80ab315bcdf8818da64d970aa3dd7b574919","observation_id":"a56d8b10-f90f-478d-af02-3109d9e3aeda","resolution":{"observed_at":"2026-08-07T15:35:34.359274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.14135","last_updated":"2022-06-23T17:53:32Z","snapshot_observed_at":"2026-07-06T13:14:48.753329Z","submitted_at":"2022-05-27T17:53:09Z","title":"FlashAttention: Fast and Memory-Efficient Exact Attention with IO-Awareness","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.14135","snapshot_observed_at":"2026-08-07T15:35:34.436672Z","title":"Fu, Stefano Ermon, Atri Rudra, and Christopher Ré","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14505","last_updated":"2025-05-20T15:34:36Z","snapshot_observed_at":"2026-08-10T18:25:34.594517Z","submitted_at":"2025-05-20T15:34:36Z","title":"ModRWKV: Transformer Multimodality in Linear Time","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:34.436672Z"},"links":{"cited_paper":"/paper/2205.14135","citing_paper":"/paper/2505.14505"},"observation_digest":"sha256:d2807552aa16217592c8646181b8a5867fc2b59d5c18289dc1adbd230ff03e80","observation_id":"68a292bd-7419-452b-bf2c-153bb6cd0355","resolution":{"observed_at":"2026-08-07T15:35:34.436672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00037","last_updated":"2024-10-02T09:11:45Z","snapshot_observed_at":"2026-07-30T10:21:14.474746Z","submitted_at":"2024-09-17T17:55:39Z","title":"Moshi: a speech-text foundation model for real-time dialogue","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00037","snapshot_observed_at":"2026-08-07T15:35:34.547184Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14505","last_updated":"2025-05-20T15:34:36Z","snapshot_observed_at":"2026-08-10T18:25:34.594517Z","submitted_at":"2025-05-20T15:34:36Z","title":"ModRWKV: Transformer Multimodality in Linear Time","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:34.547184Z"},"links":{"cited_paper":"/paper/2410.00037","citing_paper":"/paper/2505.14505"},"observation_digest":"sha256:d12958df9ccb315c14ec191a5d981c68d5dbd7ac3d80f80f86948e2746bd6917","observation_id":"026308a5-89d4-4120-a288-666b60c7ada6","resolution":{"observed_at":"2026-08-07T15:35:34.547184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.06666","last_updated":"2025-03-01T12:59:49Z","snapshot_observed_at":"2026-08-12T22:47:34.452271Z","submitted_at":"2024-09-10T17:34:34Z","title":"LLaMA-Omni: Seamless Speech Interaction with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.06666","snapshot_observed_at":"2026-08-07T15:35:34.644120Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14505","last_updated":"2025-05-20T15:34:36Z","snapshot_observed_at":"2026-08-10T18:25:34.594517Z","submitted_at":"2025-05-20T15:34:36Z","title":"ModRWKV: Transformer Multimodality in Linear Time","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:34.644120Z"},"links":{"cited_paper":"/paper/2409.06666","citing_paper":"/paper/2505.14505"},"observation_digest":"sha256:8191cd56d4b5c05b0043b6e0362b1e415b40e7a78587ce2350ac939d4af2e9ae","observation_id":"180b0dc2-a501-411a-aaf2-b27ae8112244","resolution":{"observed_at":"2026-08-07T15:35:34.644120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:37.883243Z","title":null,"venue":null,"work_id":"5eeb6182-938b-410a-a9e0-32b8d37e50fb","year":2017},"citing_paper":{"arxiv_id":"2505.14505","last_updated":"2025-05-20T15:34:36Z","snapshot_observed_at":"2026-08-10T18:25:34.594517Z","submitted_at":"2025-05-20T15:34:36Z","title":"ModRWKV: Transformer Multimodality in Linear Time","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:34.682440Z"},"links":{"citing_paper":"/paper/2505.14505"},"observation_digest":"sha256:ea76438b487a890b56accab707a75a66e0e370df5c5b2baccaf3aba02427b1d8","observation_id":"86587d0c-b4a8-469a-8ce9-f18d85ca108f","resolution":{"observed_at":"2026-08-07T15:35:37.910028Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-07T15:35:34.824926Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14505","last_updated":"2025-05-20T15:34:36Z","snapshot_observed_at":"2026-08-10T18:25:34.594517Z","submitted_at":"2025-05-20T15:34:36Z","title":"ModRWKV: Transformer Multimodality in Linear Time","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:34.824926Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2505.14505"},"observation_digest":"sha256:213f975d3fa7bc5a9ecbe36fb225607d1a100d9209a7134015b9b48e25edb527","observation_id":"95732f85-aeac-46e7-89c7-635d81b40959","resolution":{"observed_at":"2026-08-07T15:35:34.824926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:37.731021Z","title":"Hudson and Christopher D","venue":null,"work_id":"fa182e2d-442c-41f7-8c69-afa5b5d6421b","year":2019},"citing_paper":{"arxiv_id":"2505.14505","last_updated":"2025-05-20T15:34:36Z","snapshot_observed_at":"2026-08-10T18:25:34.594517Z","submitted_at":"2025-05-20T15:34:36Z","title":"ModRWKV: Transformer Multimodality in Linear Time","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:34.901043Z"},"links":{"citing_paper":"/paper/2505.14505"},"observation_digest":"sha256:b149be9f09a04b39fb9c9a1e3302554ac129ea3cf0d7e1c0022c5d02e3ef52ec","observation_id":"e5727c08-58ed-4622-97b9-84fe7113640f","resolution":{"observed_at":"2026-08-07T15:35:37.813500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:37.656776Z","title":null,"venue":null,"work_id":"96606afe-9f99-4ec0-9b3f-de1795df02d0","year":2023},"citing_paper":{"arxiv_id":"2505.14505","last_updated":"2025-05-20T15:34:36Z","snapshot_observed_at":"2026-08-10T18:25:34.594517Z","submitted_at":"2025-05-20T15:34:36Z","title":"ModRWKV: Transformer Multimodality in Linear Time","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:34.952880Z"},"links":{"citing_paper":"/paper/2505.14505"},"observation_digest":"sha256:3f0bc0577ce9c2f3966d673bf8b295b524870edcbfd650293187453d69759c59","observation_id":"b988c5e1-457a-475b-9319-7ed9de739c1e","resolution":{"observed_at":"2026-08-07T15:35:37.688259Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03744","last_updated":"2024-05-15T19:22:44Z","snapshot_observed_at":"2026-08-13T06:40:28.574929Z","submitted_at":"2023-10-05T17:59:56Z","title":"Improved Baselines with Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03744","snapshot_observed_at":"2026-08-07T15:35:35.001638Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14505","last_updated":"2025-05-20T15:34:36Z","snapshot_observed_at":"2026-08-10T18:25:34.594517Z","submitted_at":"2025-05-20T15:34:36Z","title":"ModRWKV: Transformer Multimodality in Linear Time","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:35.001638Z"},"links":{"cited_paper":"/paper/2310.03744","citing_paper":"/paper/2505.14505"},"observation_digest":"sha256:acd5a4eade0ed0c27019216e33d593e20b88bafad851dc7e5adca09d2e705dce","observation_id":"68e29713-22c3-4a41-ae97-812550c7d3bb","resolution":{"observed_at":"2026-08-07T15:35:35.001638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08485","last_updated":"2023-12-11T17:46:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-17T17:59:25Z","title":"Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08485","snapshot_observed_at":"2026-08-07T15:35:35.068537Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14505","last_updated":"2025-05-20T15:34:36Z","snapshot_observed_at":"2026-08-10T18:25:34.594517Z","submitted_at":"2025-05-20T15:34:36Z","title":"ModRWKV: Transformer Multimodality in Linear Time","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:35.068537Z"},"links":{"cited_paper":"/paper/2304.08485","citing_paper":"/paper/2505.14505"},"observation_digest":"sha256:1d253a1e775baf54865f7da88eb1d34e3d598b7ce7da1b6911775e8b2bd09863","observation_id":"66f5a789-2b62-4282-a8dc-d9ed01b62343","resolution":{"observed_at":"2026-08-07T15:35:35.068537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02368","last_updated":"2024-10-18T03:19:55Z","snapshot_observed_at":"2026-08-13T04:27:31.511456Z","submitted_at":"2024-02-04T06:55:55Z","title":"Timer: Generative Pre-trained Transformers Are Large Time Series Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02368","snapshot_observed_at":"2026-08-07T15:35:35.102882Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14505","last_updated":"2025-05-20T15:34:36Z","snapshot_observed_at":"2026-08-10T18:25:34.594517Z","submitted_at":"2025-05-20T15:34:36Z","title":"ModRWKV: Transformer Multimodality in Linear Time","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:35.102882Z"},"links":{"cited_paper":"/paper/2402.02368","citing_paper":"/paper/2505.14505"},"observation_digest":"sha256:27a695ab5fc548a9ef649cbd92181d1d847fa42673f153e678968f09b7f637f5","observation_id":"ff220dcf-3e84-4379-b56a-e4d24a4a7a77","resolution":{"observed_at":"2026-08-07T15:35:35.102882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06281","last_updated":"2024-08-20T03:56:03Z","snapshot_observed_at":"2026-07-06T15:53:19.485466Z","submitted_at":"2023-07-12T16:23:09Z","title":"MMBench: Is Your Multi-modal Model an All-around Player?","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06281","snapshot_observed_at":"2026-08-07T15:35:35.218235Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14505","last_updated":"2025-05-20T15:34:36Z","snapshot_observed_at":"2026-08-10T18:25:34.594517Z","submitted_at":"2025-05-20T15:34:36Z","title":"ModRWKV: Transformer Multimodality in Linear Time","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:35.218235Z"},"links":{"cited_paper":"/paper/2307.06281","citing_paper":"/paper/2505.14505"},"observation_digest":"sha256:878983c82f637332241b1ddb99fdfae182c7bad78fa52d2761a20d36b565656f","observation_id":"45b8986b-d5e7-411d-aefe-7caad2c70782","resolution":{"observed_at":"2026-08-07T15:35:35.218235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.09513","last_updated":"2022-10-17T07:46:47Z","snapshot_observed_at":"2026-08-13T14:23:21.183005Z","submitted_at":"2022-09-20T07:04:24Z","title":"Learn to Explain: Multimodal Reasoning via Thought Chains for Science Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.09513","snapshot_observed_at":"2026-08-07T15:35:35.273568Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14505","last_updated":"2025-05-20T15:34:36Z","snapshot_observed_at":"2026-08-10T18:25:34.594517Z","submitted_at":"2025-05-20T15:34:36Z","title":"ModRWKV: Transformer Multimodality in Linear Time","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:35.273568Z"},"links":{"cited_paper":"/paper/2209.09513","citing_paper":"/paper/2505.14505"},"observation_digest":"sha256:3f4add6a6b77791012f18d376964dfb6be51f6ec3b9a3a3585a43276e892f135","observation_id":"dad9cf08-4adc-4f1c-bbdd-c7d0208045e7","resolution":{"observed_at":"2026-08-07T15:35:35.273568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08846","last_updated":"2024-02-13T23:25:04Z","snapshot_observed_at":"2026-08-13T04:19:27.486516Z","submitted_at":"2024-02-13T23:25:04Z","title":"An Embarrassingly Simple Approach for LLM with Strong ASR Capacity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08846","snapshot_observed_at":"2026-08-07T15:35:35.359733Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14505","last_updated":"2025-05-20T15:34:36Z","snapshot_observed_at":"2026-08-10T18:25:34.594517Z","submitted_at":"2025-05-20T15:34:36Z","title":"ModRWKV: Transformer Multimodality in Linear Time","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:35.359733Z"},"links":{"cited_paper":"/paper/2402.08846","citing_paper":"/paper/2505.14505"},"observation_digest":"sha256:3c0a95ee263b779edb11c3cc5a2d971ef9d6c54cd60d0e91b9870361dbb3aa2c","observation_id":"e8b66aed-7666-4ed9-9aa0-81844d3afe77","resolution":{"observed_at":"2026-08-07T15:35:35.359733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:35.407445Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.14505","last_updated":"2025-05-20T15:34:36Z","snapshot_observed_at":"2026-08-10T18:25:34.594517Z","submitted_at":"2025-05-20T15:34:36Z","title":"ModRWKV: Transformer Multimodality in Linear Time","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:35.407445Z"},"links":{"citing_paper":"/paper/2505.14505"},"observation_digest":"sha256:f9cee4469918242f8d8b95605b4deb2dca884d01d7252c1417ef987ff26cb146","observation_id":"5acbf1af-5252-4cb4-b22b-84b7c0dd8907","resolution":{"observed_at":"2026-08-07T15:35:35.407445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14456","last_updated":"2025-03-30T13:46:44Z","snapshot_observed_at":"2026-08-07T16:54:15.957609Z","submitted_at":"2025-03-18T17:31:05Z","title":"RWKV-7 \"Goose\" with Expressive Dynamic State Evolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14456","snapshot_observed_at":"2026-08-07T15:35:35.454816Z","title":"Wind, Tianyi Wu, Daniel Wuttke, and Christian Zhou-Zheng","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14505","last_updated":"2025-05-20T15:34:36Z","snapshot_observed_at":"2026-08-10T18:25:34.594517Z","submitted_at":"2025-05-20T15:34:36Z","title":"ModRWKV: Transformer Multimodality in Linear Time","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:35.454816Z"},"links":{"cited_paper":"/paper/2503.14456","citing_paper":"/paper/2505.14505"},"observation_digest":"sha256:65fd900281bab2b75afdcb282b07ccf9b0d4d5c87a60e22bab1a6758517dab1d","observation_id":"c385da79-6aec-4424-a7ce-7bd55bfc5b77","resolution":{"observed_at":"2026-08-07T15:35:35.454816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13600","last_updated":"2024-03-20T13:48:50Z","snapshot_observed_at":"2026-08-13T00:49:29.156817Z","submitted_at":"2024-03-20T13:48:50Z","title":"VL-Mamba: Exploring State Space Models for Multimodal Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13600","snapshot_observed_at":"2026-08-07T15:35:35.516406Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14505","last_updated":"2025-05-20T15:34:36Z","snapshot_observed_at":"2026-08-10T18:25:34.594517Z","submitted_at":"2025-05-20T15:34:36Z","title":"ModRWKV: Transformer Multimodality in Linear Time","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:35.516406Z"},"links":{"cited_paper":"/paper/2403.13600","citing_paper":"/paper/2505.14505"},"observation_digest":"sha256:fcbe0b5e18e093a8dc41cc128cfb3c3ed294fa21f8da4b8c1271aff7276817a5","observation_id":"fcd07736-4447-44c9-a2d1-1e776e13e048","resolution":{"observed_at":"2026-08-07T15:35:35.516406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.20150","last_updated":"2025-08-18T05:01:29Z","snapshot_observed_at":"2026-08-13T18:02:48.732949Z","submitted_at":"2024-03-29T12:37:57Z","title":"TFB: Towards Comprehensive and Fair Benchmarking of Time Series Forecasting Methods","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.20150","snapshot_observed_at":"2026-08-07T15:35:35.607876Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14505","last_updated":"2025-05-20T15:34:36Z","snapshot_observed_at":"2026-08-10T18:25:34.594517Z","submitted_at":"2025-05-20T15:34:36Z","title":"ModRWKV: Transformer Multimodality in Linear Time","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:35.607876Z"},"links":{"cited_paper":"/paper/2403.20150","citing_paper":"/paper/2505.14505"},"observation_digest":"sha256:881142290585a4811de2eed122ba0ddd049d1f65b6bdb93a25dc8418c7b1dfee","observation_id":"435ba784-5698-40cc-83aa-244e67889b97","resolution":{"observed_at":"2026-08-07T15:35:35.607876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-07T15:35:35.651289Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14505","last_updated":"2025-05-20T15:34:36Z","snapshot_observed_at":"2026-08-10T18:25:34.594517Z","submitted_at":"2025-05-20T15:34:36Z","title":"ModRWKV: Transformer Multimodality in Linear Time","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:35.651289Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2505.14505"},"observation_digest":"sha256:8c2395f8f15f0b821184612279b2f08e1f31d67202319e046acb56fe681edf14","observation_id":"a8055a95-4747-40b5-aa74-3395dde6e504","resolution":{"observed_at":"2026-08-07T15:35:35.651289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04356","last_updated":"2022-12-06T18:46:04Z","snapshot_observed_at":"2026-07-06T14:28:21.844826Z","submitted_at":"2022-12-06T18:46:04Z","title":"Robust Speech Recognition via Large-Scale Weak Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.04356","snapshot_observed_at":"2026-08-07T15:35:35.723258Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14505","last_updated":"2025-05-20T15:34:36Z","snapshot_observed_at":"2026-08-10T18:25:34.594517Z","submitted_at":"2025-05-20T15:34:36Z","title":"ModRWKV: Transformer Multimodality in Linear Time","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:35.723258Z"},"links":{"cited_paper":"/paper/2212.04356","citing_paper":"/paper/2505.14505"},"observation_digest":"sha256:1f21c899374501bc91f0fe126db3270be091ed06f0c6a649c30d7231f0aa077a","observation_id":"cf7e1600-435f-49ed-9a59-da803e35217e","resolution":{"observed_at":"2026-08-07T15:35:35.723258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:37.492082Z","title":null,"venue":null,"work_id":"674ea17f-935f-4877-8d25-3d74ea4bee01","year":2020},"citing_paper":{"arxiv_id":"2505.14505","last_updated":"2025-05-20T15:34:36Z","snapshot_observed_at":"2026-08-10T18:25:34.594517Z","submitted_at":"2025-05-20T15:34:36Z","title":"ModRWKV: Transformer Multimodality in Linear Time","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:35.778808Z"},"links":{"citing_paper":"/paper/2505.14505"},"observation_digest":"sha256:0a73edf423f6d98a34b6a1c82e28ade18b70df39a3e02e6b30ab0ad22cc96a04","observation_id":"4c1dd459-c6c3-4cf6-8903-cfb0dd1c477c","resolution":{"observed_at":"2026-08-07T15:35:37.539494Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:37.340403Z","title":null,"venue":null,"work_id":"2e78038f-4b68-4201-a080-731467cf206b","year":2019},"citing_paper":{"arxiv_id":"2505.14505","last_updated":"2025-05-20T15:34:36Z","snapshot_observed_at":"2026-08-10T18:25:34.594517Z","submitted_at":"2025-05-20T15:34:36Z","title":"ModRWKV: Transformer Multimodality in Linear Time","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:35.813739Z"},"links":{"citing_paper":"/paper/2505.14505"},"observation_digest":"sha256:465aadb236936635d75b0b16ade6ae7a3238c7a08589e0905bee1fd82270c570","observation_id":"a1b88adf-195c-48af-a715-b2060f449af2","resolution":{"observed_at":"2026-08-07T15:35:37.428196Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T15:35:35.930937Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14505","last_updated":"2025-05-20T15:34:36Z","snapshot_observed_at":"2026-08-10T18:25:34.594517Z","submitted_at":"2025-05-20T15:34:36Z","title":"ModRWKV: Transformer Multimodality in Linear Time","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:35.930937Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2505.14505"},"observation_digest":"sha256:34db169787f9ff1da5680108740c92b720a59fed5fa3a027e422ed8506f4ea92","observation_id":"c9d84ef3-4007-4177-a1ea-59000541265d","resolution":{"observed_at":"2026-08-07T15:35:35.930937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14786","last_updated":"2025-02-20T18:08:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-20T18:08:29Z","title":"SigLIP 2: Multilingual Vision-Language Encoders with Improved Semantic Understanding, Localization, and Dense Features","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14786","snapshot_observed_at":"2026-08-07T15:35:36.086113Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14505","last_updated":"2025-05-20T15:34:36Z","snapshot_observed_at":"2026-08-10T18:25:34.594517Z","submitted_at":"2025-05-20T15:34:36Z","title":"ModRWKV: Transformer Multimodality in Linear Time","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:36.086113Z"},"links":{"cited_paper":"/paper/2502.14786","citing_paper":"/paper/2505.14505"},"observation_digest":"sha256:f37ba1b81d0cdcb4518674f35c495e43ea85f8dabee7155f9fc943c9de15b768","observation_id":"cf5cd08a-3d53-4918-a8d4-7d0a897fd5dd","resolution":{"observed_at":"2026-08-07T15:35:36.086113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.03499","last_updated":"2016-09-19T18:04:35Z","snapshot_observed_at":"2026-08-13T01:24:25.628327Z","submitted_at":"2016-09-12T17:29:40Z","title":"WaveNet: A Generative Model for Raw Audio","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.03499","snapshot_observed_at":"2026-08-07T15:35:36.141592Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.14505","last_updated":"2025-05-20T15:34:36Z","snapshot_observed_at":"2026-08-10T18:25:34.594517Z","submitted_at":"2025-05-20T15:34:36Z","title":"ModRWKV: Transformer Multimodality in Linear Time","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:36.141592Z"},"links":{"cited_paper":"/paper/1609.03499","citing_paper":"/paper/2505.14505"},"observation_digest":"sha256:3afb82f8c59752548ac66ef7cedb7111b88800accbb709844dddd30d90dddfb2","observation_id":"b631993f-1a1e-4a52-b85e-ca91850650a3","resolution":{"observed_at":"2026-08-07T15:35:36.141592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03762","last_updated":"2023-08-02T00:41:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-06-12T17:57:34Z","title":"Attention Is All You Need","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03762","snapshot_observed_at":"2026-08-07T15:35:36.181136Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14505","last_updated":"2025-05-20T15:34:36Z","snapshot_observed_at":"2026-08-10T18:25:34.594517Z","submitted_at":"2025-05-20T15:34:36Z","title":"ModRWKV: Transformer Multimodality in Linear Time","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:36.181136Z"},"links":{"cited_paper":"/paper/1706.03762","citing_paper":"/paper/2505.14505"},"observation_digest":"sha256:a25453d6817350a9241542ad123981565b9ed621b969c4a0367bd3ed6f00c004","observation_id":"e8b704b2-7307-4d79-a53b-a6c2869b8dac","resolution":{"observed_at":"2026-08-07T15:35:36.181136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06635","last_updated":"2024-08-27T01:27:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-11T18:51:59Z","title":"Gated Linear Attention Transformers with Hardware-Efficient Training","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06635","snapshot_observed_at":"2026-08-07T15:35:36.276021Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14505","last_updated":"2025-05-20T15:34:36Z","snapshot_observed_at":"2026-08-10T18:25:34.594517Z","submitted_at":"2025-05-20T15:34:36Z","title":"ModRWKV: Transformer Multimodality in Linear Time","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:36.276021Z"},"links":{"cited_paper":"/paper/2312.06635","citing_paper":"/paper/2505.14505"},"observation_digest":"sha256:f02c71080294204ee1a0bb6a6ef32bf920f4e7dc4bf9f2f783f894a0a1ce9ebb","observation_id":"dd249c0d-5472-4044-b85e-3abf2164512f","resolution":{"observed_at":"2026-08-07T15:35:36.276021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06484","last_updated":"2025-01-15T10:41:40Z","snapshot_observed_at":"2026-08-12T23:46:14.417356Z","submitted_at":"2024-06-10T17:24:42Z","title":"Parallelizing Linear Transformers with the Delta Rule over Sequence Length","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06484","snapshot_observed_at":"2026-08-07T15:35:36.402647Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14505","last_updated":"2025-05-20T15:34:36Z","snapshot_observed_at":"2026-08-10T18:25:34.594517Z","submitted_at":"2025-05-20T15:34:36Z","title":"ModRWKV: Transformer Multimodality in Linear Time","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:36.402647Z"},"links":{"cited_paper":"/paper/2406.06484","citing_paper":"/paper/2505.14505"},"observation_digest":"sha256:fcfd6f8b45d3f0793238a7d1c14566b8a896efefdfb3c100bcf6d6ac02a7c066","observation_id":"18f01554-4540-4ce8-be3f-b9fbe424a5b2","resolution":{"observed_at":"2026-08-07T15:35:36.402647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04779","last_updated":"2024-02-07T12:01:02Z","snapshot_observed_at":"2026-08-13T04:24:21.961077Z","submitted_at":"2024-02-07T12:01:02Z","title":"StableMask: Refining Causal Masking in Decoder-only Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04779","snapshot_observed_at":"2026-08-07T15:35:36.506938Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14505","last_updated":"2025-05-20T15:34:36Z","snapshot_observed_at":"2026-08-10T18:25:34.594517Z","submitted_at":"2025-05-20T15:34:36Z","title":"ModRWKV: Transformer Multimodality in Linear Time","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:36.506938Z"},"links":{"cited_paper":"/paper/2402.04779","citing_paper":"/paper/2505.14505"},"observation_digest":"sha256:80e6e6feb39157c179dd1cf025561df26dadcfabc675f9fada2f6a334300f408","observation_id":"4ea73cad-5d08-4c8d-8e82-edd91e5c2160","resolution":{"observed_at":"2026-08-07T15:35:36.506938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16502","last_updated":"2024-06-13T15:02:39Z","snapshot_observed_at":"2026-08-13T09:07:54.479155Z","submitted_at":"2023-11-27T17:33:21Z","title":"MMMU: A Massive Multi-discipline Multimodal Understanding and Reasoning Benchmark for Expert AGI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16502","snapshot_observed_at":"2026-08-07T15:35:36.589234Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14505","last_updated":"2025-05-20T15:34:36Z","snapshot_observed_at":"2026-08-10T18:25:34.594517Z","submitted_at":"2025-05-20T15:34:36Z","title":"ModRWKV: Transformer Multimodality in Linear Time","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:36.589234Z"},"links":{"cited_paper":"/paper/2311.16502","citing_paper":"/paper/2505.14505"},"observation_digest":"sha256:36bad60bf98528760d6e8435f8c9b2d916de9babf3f94af02298b00b93f6e432","observation_id":"3b34e047-9039-40f4-8926-623e91f137d6","resolution":{"observed_at":"2026-08-07T15:35:36.589234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:36.624042Z","title":"URL: \" 'urlintro :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14505","last_updated":"2025-05-20T15:34:36Z","snapshot_observed_at":"2026-08-10T18:25:34.594517Z","submitted_at":"2025-05-20T15:34:36Z","title":"ModRWKV: Transformer Multimodality in Linear Time","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:36.624042Z"},"links":{"citing_paper":"/paper/2505.14505"},"observation_digest":"sha256:58f8130ad70973734ca9f1d4ffde0fe4a8736e381aea803d8787f638f924a939","observation_id":"cd5e4df2-1903-40a5-8390-1f4227da5100","resolution":{"observed_at":"2026-08-07T15:35:36.624042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:36.773332Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14505","last_updated":"2025-05-20T15:34:36Z","snapshot_observed_at":"2026-08-10T18:25:34.594517Z","submitted_at":"2025-05-20T15:34:36Z","title":"ModRWKV: Transformer Multimodality in Linear Time","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:36.773332Z"},"links":{"citing_paper":"/paper/2505.14505"},"observation_digest":"sha256:2b5a23292df3ca7179661f597b50ab98d550821927fef2a92d7a8924a8c3839a","observation_id":"4620b2ad-f0f8-4949-82dd-7dd0621115f8","resolution":{"observed_at":"2026-08-07T15:35:36.773332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.14505","last_updated":"2025-05-20T15:34:36Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-10T18:25:34.594517Z","submitted_at":"2025-05-20T15:34:36Z","title":"ModRWKV: Transformer Multimodality in Linear Time"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 0 inbound Pith citation observations for arXiv:2505.14505."}