{"as_of":"2026-08-08T22:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1b748ff7a5be653f1c20f4e756431504eb8a1ff9579642cce6507c2b16f01459","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T17:44:46.910348Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2603.22372/citation-record","integrity":"/paper/2603.22372/integrity","json":"/paper/2603.22372/citation-record.json","paper":"/paper/2603.22372"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:44:44.043580Z","title":"Multivariate time series dataset for space weather data analytics.Scientific data, 7(1):227, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:44.043580Z"},"links":{"citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:c933f8decfe06a9641944411ade48f5f37ea44b8d5b492443fe589904599ded4","observation_id":"4153252d-f06c-4e79-bbff-d2979e194412","resolution":{"observed_at":"2026-08-02T17:44:44.043580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12672","last_updated":"2025-01-13T20:42:06Z","snapshot_observed_at":"2026-08-08T14:24:28.332140Z","submitted_at":"2024-10-16T15:36:13Z","title":"Context Matters: Leveraging Contextual Features for Time Series Forecasting","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12672","snapshot_observed_at":"2026-08-02T17:44:44.118361Z","title":"Context matters: Leveraging contextual features for time series forecasting","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:44.118361Z"},"links":{"cited_paper":"/paper/2410.12672","citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:7f8122f9a03ad553804455bacc738c4efe173d7a13841e4ec26eaba43047e9aa","observation_id":"4b74100d-c858-41e5-937c-7a0ea80184fa","resolution":{"observed_at":"2026-08-02T17:44:44.118361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:44:44.230406Z","title":"Tsmixer: An all-mlp architecture for time series forecasting.TMLR, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:44.230406Z"},"links":{"citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:9142c7832926a636cc6117f1846cc99701e2264af5112daa6ef938dba35aaeb9","observation_id":"5cef0a7d-fffb-498a-a1bf-fd0f59ad3ebc","resolution":{"observed_at":"2026-08-02T17:44:44.230406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.04251","last_updated":"2025-08-06T09:31:44Z","snapshot_observed_at":"2026-08-08T04:33:29.814738Z","submitted_at":"2025-08-06T09:31:44Z","title":"T3Time: Tri-Modal Time Series Forecasting via Adaptive Multi-Head Alignment and Residual Fusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.04251","snapshot_observed_at":"2026-08-02T17:44:44.382549Z","title":"T3time: Tri-modal time series forecasting via adaptive multi-head alignment and residual fusion.arXiv preprint arXiv:2508.04251, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:44.382549Z"},"links":{"cited_paper":"/paper/2508.04251","citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:3f14756a4994cdfb0f5ba590027c3b524e1bf92057647a35c07565ffb07c6245","observation_id":"07a75f87-5fe4-49c4-a765-38f7daaef1af","resolution":{"observed_at":"2026-08-02T17:44:44.382549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:44:44.499848Z","title":"Towards spatio- temporal aware traffic time series forecasting","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:44.499848Z"},"links":{"citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:4a41082e7730b1050054a47c6073f2598014f3f6fcc1ec2fe4b91b10bfb0330f","observation_id":"55842f6b-6b46-4f50-983f-b04314196afb","resolution":{"observed_at":"2026-08-02T17:44:44.499848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08424","last_updated":"2024-04-04T16:24:19Z","snapshot_observed_at":"2026-08-06T08:23:57.165934Z","submitted_at":"2023-04-17T16:46:48Z","title":"Long-term Forecasting with TiDE: Time-series Dense Encoder","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08424","snapshot_observed_at":"2026-08-02T17:44:44.621866Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:44.621866Z"},"links":{"cited_paper":"/paper/2304.08424","citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:e87fbe3df1ed61cc858a9f19ef4e9c00d949768cb07645ff6b827e221249eaae","observation_id":"e18e79a9-8e87-4ec5-bf3f-fef565c73d63","resolution":{"observed_at":"2026-08-02T17:44:44.621866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:44:44.728508Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:44.728508Z"},"links":{"citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:b1ad8cef419810f3c835ad8b616f8eb52d14d4cea1c5a1a8f027dc9758d9d894","observation_id":"8b0d217d-50eb-4f7c-8a87-7c41a7ae6620","resolution":{"observed_at":"2026-08-02T17:44:44.728508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:44:44.780827Z","title":"Attention based multi-modal new product sales time-series forecasting","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:44.780827Z"},"links":{"citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:be4241bd92560f0c146725ff43d17b4243628da688ae8afe5d8e2ed2372df698","observation_id":"7046d12f-322c-444e-86b1-db978554de22","resolution":{"observed_at":"2026-08-02T17:44:44.780827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:44:44.835002Z","title":"Lora: Low-rank adaptation of large language models.ICLR, 1(2):3, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:44.835002Z"},"links":{"citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:ee614f1a7f78ebda6cce9a918cc1c77f76e6e8897f0197a5b9d6201cd888cc73","observation_id":"8595f910-781e-48f3-8385-14b778628ccd","resolution":{"observed_at":"2026-08-02T17:44:44.835002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:44:44.911661Z","title":"Gpt4mts: Prompt-based large language model for multimodal time-series forecasting","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:44.911661Z"},"links":{"citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:30313308bfc10eac052a8118852cd5a8a3dd7fa42b017c824f873764b7230a7d","observation_id":"44774301-9402-470a-bbb0-0dc80a3af93e","resolution":{"observed_at":"2026-08-02T17:44:44.911661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:44:45.001206Z","title":"Multi-modal time series analysis: A tutorial and survey","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:45.001206Z"},"links":{"citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:5c073a40734e7e7fa43598a2c7c37d0fd40e94dedaf82c65b6cd4d1bc93fe135","observation_id":"e62978b6-abe4-4b41-9544-ea7073018144","resolution":{"observed_at":"2026-08-02T17:44:45.001206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:44:45.075444Z","title":"Time-llm: Time series forecasting by reprogramming large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:45.075444Z"},"links":{"citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:8d3d80310f8999bd1ae274a89e7547ebd28f19eeb927ecb5fca93b12998b86ad","observation_id":"b9401d0e-d0e7-4884-ac44-e59e1213a092","resolution":{"observed_at":"2026-08-02T17:44:45.075444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.06735","last_updated":"2024-11-21T00:52:53Z","snapshot_observed_at":"2026-07-06T19:48:15.021550Z","submitted_at":"2024-11-11T06:04:15Z","title":"Multi-Modal Forecaster: Jointly Predicting Time Series and Textual Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.06735","snapshot_observed_at":"2026-08-02T17:44:45.113402Z","title":"Multi-modal forecaster: Jointly predicting time series and textual data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:45.113402Z"},"links":{"cited_paper":"/paper/2411.06735","citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:c8e7ba76a940787990489dfad61b50af5e35c737b5a3b7b5be28a355e8e79a49","observation_id":"848cf7aa-aac4-4fe8-8484-2c5d116d1cdc","resolution":{"observed_at":"2026-08-02T17:44:45.113402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-02T17:44:45.204296Z","title":"Adam: A method for stochastic optimization.arXiv preprint arXiv:1412.6980, 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:45.204296Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:ddb2526d1a03b83d7689ea432d18eb1008e9604559b0c4f07aab2d699b42017c","observation_id":"8d5c69ad-b85a-4669-a79d-775a498b1d86","resolution":{"observed_at":"2026-08-02T17:44:45.204296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.04451","last_updated":"2020-02-18T16:01:18Z","snapshot_observed_at":"2026-07-06T08:50:12.690900Z","submitted_at":"2020-01-13T18:38:28Z","title":"Reformer: The Efficient Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.04451","snapshot_observed_at":"2026-08-02T17:44:45.242905Z","title":"Reformer: The efficient transformer","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:45.242905Z"},"links":{"cited_paper":"/paper/2001.04451","citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:30bacc8207875629ba82ca261972357982411378fa612ec8bd55b173706ae472","observation_id":"96ee9383-a689-4ae0-8789-0dac3578fca5","resolution":{"observed_at":"2026-08-02T17:44:45.242905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:44:45.318898Z","title":"Le and Tomas Mikolov","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:45.318898Z"},"links":{"citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:5e75fcb742b02f969e1d832df5d25943746840587bb52a69c2d4be3597e9b522","observation_id":"7b1af85d-d2c0-4708-a3c0-1bc27be03243","resolution":{"observed_at":"2026-08-02T17:44:45.318898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:44:45.380571Z","title":"Language in the flow of time: Time-series-paired texts weaved into a unified temporal narrative.arXiv preprint arXiv:2502.08942, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:45.380571Z"},"links":{"citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:33597332c8b5793e257ff96b7aa55db3675573e37a9bfeed4b3ed7e0f3149866","observation_id":"d567c5bc-f539-42a7-8006-6317263f114c","resolution":{"observed_at":"2026-08-02T17:44:45.380571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:44:45.425845Z","title":"Timi: Empower time series transformers with multimodal mixture of experts.arXiv preprint arXiv:2602.21693, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:45.425845Z"},"links":{"citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:dd6b05d70102f776215fe94c5847d07acba00b11dc4be2f2d42f9d67c86bca32","observation_id":"856cd21e-c21d-4384-afeb-aad68777cc84","resolution":{"observed_at":"2026-08-02T17:44:45.425845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.04750","last_updated":"2026-05-10T10:07:11Z","snapshot_observed_at":"2026-08-07T10:17:21.791651Z","submitted_at":"2025-08-06T09:26:52Z","title":"PA-RNet: Perturbation-Aware Residual Network for Robust Multimodal Time Series Forecasting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.04750","snapshot_observed_at":"2026-08-02T17:44:45.490714Z","title":"Pa-rnet: Perturbation-aware reasoning network for multimodal time series forecasting.arXiv preprint arXiv:2508.04750, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:45.490714Z"},"links":{"cited_paper":"/paper/2508.04750","citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:dd20fec22f6ddf2ebb653d91685d5dd2a737e82752ca7cc281483f6486e19ddd","observation_id":"1095eea7-97bd-4c36-aeed-be956da004cd","resolution":{"observed_at":"2026-08-02T17:44:45.490714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:44:45.544976Z","title":"Timecma: Towards llm-empowered time series forecasting via cross-modality alignment.AAAI, pages arXiv–2406, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:45.544976Z"},"links":{"citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:2a56946cf8331dee12411ff1c89c420ea9a129dd7c0b90063d1a6c42696f176c","observation_id":"3b3dc18d-aef1-4c0f-80d7-f65ee65cbead","resolution":{"observed_at":"2026-08-02T17:44:45.544976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:44:45.607884Z","title":"Time-mmd: Multi-domain multimodal dataset for time series analysis.Advances in Neural Information Processing Systems, 37:77888–77933, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:45.607884Z"},"links":{"citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:abb324ba4bf40651b7154834bf9c2f4866558328dca64a0ebdfce9a8770ce5b6","observation_id":"d71cf2a6-f424-498d-a817-748dcb3ce66c","resolution":{"observed_at":"2026-08-02T17:44:45.607884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:44:45.665381Z","title":"Liu et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:45.665381Z"},"links":{"citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:75a683556d480a66dd7dceca6f7d770468dec8b76f0d2bd69a1077d0903958d8","observation_id":"eefc499f-20e4-4cec-b887-a1d442e40bfc","resolution":{"observed_at":"2026-08-02T17:44:45.665381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:44:45.814793Z","title":"itransformer: Inverted transformers are effective for time series forecasting","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:45.814793Z"},"links":{"citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:9d8f6007bd4ebedf2a2688e6bb74fa08e6a90fe0a3cc1499e9db43f6f363bf6e","observation_id":"6bb6eb23-3c5c-41f5-a508-5090d85b5fa9","resolution":{"observed_at":"2026-08-02T17:44:45.814793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:44:45.937360Z","title":"Koopa: Learning non-stationary time series dynamics with koopman predictors.Advances in neural information processing systems, 36:12271–12290, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:45.937360Z"},"links":{"citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:eec07dd77ab86f724a00115a73f04302c514e573b37f9fa1d1173af06cb82e7f","observation_id":"8d2051b1-8aec-4fe1-b90f-4df671151c7a","resolution":{"observed_at":"2026-08-02T17:44:45.937360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01588","last_updated":"2026-06-26T12:41:08Z","snapshot_observed_at":"2026-08-03T05:41:24.325355Z","submitted_at":"2026-02-02T03:28:21Z","title":"Spectral Text Fusion: A Frequency-Aware Approach to Multimodal Time-Series Forecasting","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.01588","snapshot_observed_at":"2026-08-02T17:44:45.983171Z","title":"Spectral text fusion: A frequency-aware approach to multimodal time-series forecasting","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:45.983171Z"},"links":{"cited_paper":"/paper/2602.01588","citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:d6a5080100e14c0dd5ee9f70537c5a5e23aca68131701cec45ead6d31039471d","observation_id":"e209e27b-f255-4db8-88ba-549d4cc03d8b","resolution":{"observed_at":"2026-08-02T17:44:45.983171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.14730","last_updated":"2023-03-05T22:11:56Z","snapshot_observed_at":"2026-07-31T22:45:35.561492Z","submitted_at":"2022-11-27T05:15:42Z","title":"A Time Series is Worth 64 Words: Long-term Forecasting with Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.14730","snapshot_observed_at":"2026-08-02T17:44:46.039179Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:46.039179Z"},"links":{"cited_paper":"/paper/2211.14730","citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:3d99781e6099338a82a96205d6a4c32841ae4658c4f1d87c45f1a8897c9ae9c3","observation_id":"2c60db92-c6cd-4867-8582-732554ccc758","resolution":{"observed_at":"2026-08-02T17:44:46.039179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:44:46.170430Z","title":"Unicast: A unified multimodal prompting framework for time series forecasting","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:46.170430Z"},"links":{"citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:98bce49412fb6ff39d2cf214e66a5ffe5742cc0dd5768aaa144493d54d693c95","observation_id":"84060bb5-113e-46e0-8172-3438e0b991a6","resolution":{"observed_at":"2026-08-02T17:44:46.170430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:44:46.233774Z","title":"Film: Visual reasoning with a general conditioning layer","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:46.233774Z"},"links":{"citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:879afe97574a38bb497ba58b1d1a468303cf66c2e257a418cfa533375791dcfc","observation_id":"139a449d-f96e-4a07-a295-544c9e702754","resolution":{"observed_at":"2026-08-02T17:44:46.233774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:44:46.284366Z","title":"Language models are unsupervised multitask learners.OpenAI, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:46.284366Z"},"links":{"citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:1f5a59f97d21c92078f5d864aa8180d28dd341542c7b3fe0b2996584d2a239a0","observation_id":"8988ef39-51c7-42c0-9a6b-57327d46cdee","resolution":{"observed_at":"2026-08-02T17:44:46.284366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:44:46.340930Z","title":"Stock price prediction using deep learning and frequency decomposition.Expert Systems with Applications, 169:114332, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:46.340930Z"},"links":{"citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:f1ad8a85b9f369b55807ac83646fc61d90a5c8de8d526842df3ec8020e722f03","observation_id":"adb78789-e89c-4491-bd5c-5f8643129f98","resolution":{"observed_at":"2026-08-02T17:44:46.340930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19669","last_updated":"2025-04-28T10:56:23Z","snapshot_observed_at":"2026-08-07T15:58:38.909019Z","submitted_at":"2025-04-28T10:56:23Z","title":"Multimodal Conditioned Diffusive Time Series Forecasting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.19669","snapshot_observed_at":"2026-08-02T17:44:46.420485Z","title":"Multimodal conditioned diffusive time series forecasting","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:46.420485Z"},"links":{"cited_paper":"/paper/2504.19669","citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:ed91c4a93d3aac7586a55fc31f512fe88fddad6f169617afd3b4d17afdf1d236","observation_id":"979e6862-03a1-4ae6-8153-3eac3a3395ed","resolution":{"observed_at":"2026-08-02T17:44:46.420485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-02T17:44:46.455181Z","title":"Llama: Open and efficient foundation language models.arXiv preprint arXiv:2302.13971, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:46.455181Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:c9965bc767259c5d6d81db78df99c572ca813d487fc3911e77324d125d6dd3f3","observation_id":"2ef8a460-4d6d-413c-a385-80b10edcf8aa","resolution":{"observed_at":"2026-08-02T17:44:46.455181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:44:46.486442Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:46.486442Z"},"links":{"citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:90d418dee411fc1112debf532218cddc2e4cdefed6abddb3c0a4bf06285e9a9d","observation_id":"755fd080-a82d-476c-a513-49bc13ed0acb","resolution":{"observed_at":"2026-08-02T17:44:46.486442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:44:46.520505Z","title":"Chattime: A unified multimodal time series foundation model bridging numerical and textual data","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:46.520505Z"},"links":{"citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:9d06eade78fb6878b6fde1d3a25438d083ba61990f0a816840aa7d5adc3d0bc7","observation_id":"bcdd4992-4a6f-4f90-aa5d-b50e9912f940","resolution":{"observed_at":"2026-08-02T17:44:46.520505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:44:46.555729Z","title":"Timexer: Empowering transformers for time series forecasting with exogenous variables.Advances in Neural Information Processing Systems, 37:469–498, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:46.555729Z"},"links":{"citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:148de056299a02673f0471371f7c877da32222d88b112a9d76a595415563c428","observation_id":"2492554e-859d-4d74-815b-3202c30727f1","resolution":{"observed_at":"2026-08-02T17:44:46.555729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:44:46.567056Z","title":"Autoformer: Decomposition transformers with auto-correlation for long-term series forecasting","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:46.567056Z"},"links":{"citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:a7d821c6dcd9072075d51b587d3e632b59f480554c71d5f60a80af2539fa4c71","observation_id":"b65b7704-978e-4280-9118-15242b18a175","resolution":{"observed_at":"2026-08-02T17:44:46.567056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:44:46.599163Z","title":"Promptcast: A new prompt-based learning paradigm for time series forecasting.IEEE Transactions on Knowledge and Data Engineering, 36(11):6851–6864, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:46.599163Z"},"links":{"citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:948de8ba8915303520460fc8e197622c7b3c5d8df43fc20f96b2ace27f1e87c7","observation_id":"dede540d-4001-45ef-96f7-1c8eff545c10","resolution":{"observed_at":"2026-08-02T17:44:46.599163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.10774","last_updated":"2025-07-29T14:43:48Z","snapshot_observed_at":"2026-08-07T21:27:56.444134Z","submitted_at":"2025-05-16T01:23:53Z","title":"Context-Aware Probabilistic Modeling with LLM for Multimodal Time Series Forecasting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.10774","snapshot_observed_at":"2026-08-02T17:44:46.616740Z","title":"Context-aware probabilistic modeling with llm for multimodal time series forecasting","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:46.616740Z"},"links":{"cited_paper":"/paper/2505.10774","citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:fe911879e406261d809935ca7b0b5e1ffcba96a978d4a556eac4a49da40c567f","observation_id":"7e85b331-508d-4020-93ad-e308dff6df63","resolution":{"observed_at":"2026-08-02T17:44:46.616740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:44:46.660687Z","title":"Frequency-domain mlps are more effective learners in time series forecasting.Advances in Neural Information Processing Systems, 36:76656–76679, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:46.660687Z"},"links":{"citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:b9d444bd3dfa27872828fc7ea97086b6c419831db0b8a7f27ab857eb008fe6b6","observation_id":"81385aed-97b7-4666-b8f6-51a412e07416","resolution":{"observed_at":"2026-08-02T17:44:46.660687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.13504","last_updated":"2022-08-17T17:09:38Z","snapshot_observed_at":"2026-08-06T21:54:51.018912Z","submitted_at":"2022-05-26T17:17:08Z","title":"Are Transformers Effective for Time Series Forecasting?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.13504","snapshot_observed_at":"2026-08-02T17:44:46.691396Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:46.691396Z"},"links":{"cited_paper":"/paper/2205.13504","citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:edd15f9f55229d5a6634fc9fe265ac71fd68b969803376a266aea68f967c683c","observation_id":"5dcffab2-e682-452d-8367-b07364cb75f2","resolution":{"observed_at":"2026-08-02T17:44:46.691396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:44:46.720632Z","title":"Crossformer: Transformer utilizing cross-dimension dependency for multivariate time series forecasting","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:46.720632Z"},"links":{"citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:d8958a27c8c656731640628675fdd81d148e596d848a5a694cbfe238d641f2bb","observation_id":"9eca8a52-c602-4216-bada-548ce4d34f1a","resolution":{"observed_at":"2026-08-02T17:44:46.720632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:44:46.729699Z","title":"Time- vlm: Exploring multimodal vision-language models for augmented time series forecasting","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:46.729699Z"},"links":{"citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:4ac56053c69928ac95acac3045859c7453c6ecdaf8ac9dceb51a1cbc107c6a8d","observation_id":"7af13a14-15e5-44df-931c-0f0372e58800","resolution":{"observed_at":"2026-08-02T17:44:46.729699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:44:46.756758Z","title":"Informer: Beyond efficient transformer for long sequence time-series forecasting","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:46.756758Z"},"links":{"citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:976b6fb6541372560b8037e3fa2c13cf3f6c12bf43615f4b01e603e065ab452f","observation_id":"a0fcbca2-1355-4457-80fe-702a99d03345","resolution":{"observed_at":"2026-08-02T17:44:46.756758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00622","last_updated":"2025-08-30T22:31:55Z","snapshot_observed_at":"2026-08-08T02:31:50.485848Z","submitted_at":"2025-08-30T22:31:55Z","title":"BALM-TSF: Balanced Multimodal Alignment for LLM-Based Time Series Forecasting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.00622","snapshot_observed_at":"2026-08-02T17:44:46.822585Z","title":"Balm-tsf: Balanced multimodal alignment for llm-based time series forecasting","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:46.822585Z"},"links":{"cited_paper":"/paper/2509.00622","citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:25ae79cd5614dfbab606dbf0248438cfc5852eb3bc50204b67b1c96d51e9ad99","observation_id":"a6f9b190-f406-471c-aa60-49701830424b","resolution":{"observed_at":"2026-08-02T17:44:46.822585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:44:46.872063Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:46.872063Z"},"links":{"citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:aa9145bd3e22ff507221fdcfbe92d8b6944cc5c83dd2b293a9a455622db515dc","observation_id":"cd27fe7e-6d2c-4c0a-914f-40858382f297","resolution":{"observed_at":"2026-08-02T17:44:46.872063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:44:46.910348Z","title":"The value is rising steadily","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:46.910348Z"},"links":{"citing_paper":"/paper/2603.22372"},"observation_digest":"sha256:f3f73c4cdcf270faeeddc61f5edec361466dce279bb2bee74ae8194a4173c4b3","observation_id":"5bbc6040-a87b-40ff-bb19-171c73241a5e","resolution":{"observed_at":"2026-08-02T17:44:46.910348Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2603.22372","last_updated":"2026-07-15T04:24:43Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T14:17:11.515892Z","submitted_at":"2026-03-23T07:44:46Z","title":"Rethinking Multimodal Fusion for Time Series: Text Modalities Need Constrained Fusion"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":45,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 0 inbound Pith citation observations for arXiv:2603.22372."}