{"as_of":"2026-08-20T18:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:76e54786daf1f61e6c6ec1de5eddb190a176b85cd03b8451c89618deeb56651c","coverage":[{"denominator":92,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":92,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:56:04.079028Z","state":"measured"},{"denominator":113,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":113,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":21,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T14:18:54.738157Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":1,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.20633","snapshot_observed_at":"2026-08-05T20:21:07.016294Z","title":"Test-time learning for large language models.CoRR, abs/2505.20633, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.10751","last_updated":"2025-08-14T15:34:47Z","snapshot_observed_at":"2026-08-18T20:12:03.334534Z","submitted_at":"2025-08-14T15:34:47Z","title":"Pass@k Training for Adaptively Balancing Exploration and Exploitation of Large Reasoning Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T20:21:07.016294Z"},"links":{"cited_paper":"/paper/2505.20633","citing_paper":"/paper/2508.10751"},"observation_digest":"sha256:70b1e288dec18857fb555f6a528ab8daf749bceef05f5cb84fbabb56232e9399","observation_id":"6ee29c13-b5f9-431d-a2c7-d3841c64ad5f","resolution":{"observed_at":"2026-08-05T20:21:07.016294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.20633","doi":"10.48550/arxiv.2505.20633","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.20633","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Test-time learning for large language models","venue":"ArXiv.org","work_id":"70f2ec46-5ef6-47ed-a3a6-7bb1de9b7ed6","year":2025},"citing_paper":{"arxiv_id":"2604.06169","last_updated":"2026-04-07T17:59:44Z","snapshot_observed_at":"2026-08-03T02:43:13.230039Z","submitted_at":"2026-04-07T17:59:44Z","title":"In-Place Test-Time Training","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-10T19:07:47.174513Z"},"links":{"cited_paper":"/paper/2505.20633","citing_paper":"/paper/2604.06169"},"observation_digest":"sha256:0c31e5c94e5bd7916e7b56ad8da976e66c060c4559631b5d5d732b37d807f431","observation_id":"6b83dc77-2aaf-4bb1-b9c2-3646dde9fc08","resolution":{"observed_at":"2026-05-10T23:30:49.212913Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.20633","doi":"10.48550/arxiv.2505.20633","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.20633","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Test-time learning for large language models","venue":"ArXiv.org","work_id":"70f2ec46-5ef6-47ed-a3a6-7bb1de9b7ed6","year":2025},"citing_paper":{"arxiv_id":"2604.14142","last_updated":"2026-04-15T17:59:01Z","snapshot_observed_at":"2026-08-11T21:11:54.456177Z","submitted_at":"2026-04-15T17:59:01Z","title":"From $P(y|x)$ to $P(y)$: Investigating Reinforcement Learning in Pre-train Space","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-10T12:50:57.603403Z"},"links":{"cited_paper":"/paper/2505.20633","citing_paper":"/paper/2604.14142"},"observation_digest":"sha256:9201a28fa5bac9057028fbb2b195830e0248d2a968868a27cce6438545c1a4cc","observation_id":"4f2036eb-f376-43e2-9b88-3ffa262d18ef","resolution":{"observed_at":"2026-05-11T11:41:04.140340Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.20633","doi":"10.48550/arxiv.2505.20633","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.20633","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Test-time learning for large language models","venue":"ArXiv.org","work_id":"70f2ec46-5ef6-47ed-a3a6-7bb1de9b7ed6","year":2025},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-08-14T06:23:01.737989Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2505.20633","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:5280120576914b488fc6b1095e3395e9bb35cd13d954c0ca43772a6f0e0fd404","observation_id":"60c42b99-93bb-4f17-9b2a-f1923f7ff9c3","resolution":{"observed_at":"2026-05-10T12:10:23.437950Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.20633","doi":"10.48550/arxiv.2505.20633","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.20633","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Test-time learning for large language models","venue":"ArXiv.org","work_id":"70f2ec46-5ef6-47ed-a3a6-7bb1de9b7ed6","year":2025},"citing_paper":{"arxiv_id":"2605.00405","last_updated":"2026-05-01T04:53:50Z","snapshot_observed_at":"2026-08-12T15:50:32.567562Z","submitted_at":"2026-05-01T04:53:50Z","title":"BOLT: Online Lightweight Adaptation for Preparation-Free Heterogeneous Cooperative Perception","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-09T19:39:52.951884Z"},"links":{"cited_paper":"/paper/2505.20633","citing_paper":"/paper/2605.00405"},"observation_digest":"sha256:83f7b726c2ec4e33c4d2fede1aec9e3a91c205a972237a8094274ecb9430c611","observation_id":"1513d37f-c17e-4ef0-bdb4-916566fb5e85","resolution":{"observed_at":"2026-05-11T15:36:06.168581Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.20633","doi":"10.48550/arxiv.2505.20633","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.20633","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Test-time learning for large language models","venue":"ArXiv.org","work_id":"70f2ec46-5ef6-47ed-a3a6-7bb1de9b7ed6","year":2025},"citing_paper":{"arxiv_id":"2605.00405","last_updated":"2026-05-01T04:53:50Z","snapshot_observed_at":"2026-08-12T15:50:32.567562Z","submitted_at":"2026-05-01T04:53:50Z","title":"BOLT: Online Lightweight Adaptation for Preparation-Free Heterogeneous Cooperative Perception","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-09T19:39:52.951884Z"},"links":{"cited_paper":"/paper/2505.20633","citing_paper":"/paper/2605.00405"},"observation_digest":"sha256:23c5deb9d3e690865266e5d0586d9ff6526719b69be8b51e68c6fb59f1054314","observation_id":"b3a524ed-1f32-4db0-84a9-d5fba8a19180","resolution":{"observed_at":"2026-05-09T19:40:38.955395Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.20633","doi":"10.48550/arxiv.2505.20633","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.20633","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Test-time learning for large language models","venue":"ArXiv.org","work_id":"70f2ec46-5ef6-47ed-a3a6-7bb1de9b7ed6","year":2025},"citing_paper":{"arxiv_id":"2605.11328","last_updated":"2026-05-11T23:26:30Z","snapshot_observed_at":"2026-08-11T08:46:33.961285Z","submitted_at":"2026-05-11T23:26:30Z","title":"Epistemic Uncertainty for Test-Time Discovery","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-13T01:52:41.192353Z"},"links":{"cited_paper":"/paper/2505.20633","citing_paper":"/paper/2605.11328"},"observation_digest":"sha256:feee28252c876e54fb8ab65598b693aadcda03a2d54accb666d04538e8157ccf","observation_id":"4f82e9ff-1e2d-42b3-93f7-4f9d9b47066c","resolution":{"observed_at":"2026-05-13T01:57:06.066892Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.20633","doi":"10.48550/arxiv.2505.20633","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.20633","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Test-time learning for large language models","venue":"ArXiv.org","work_id":"70f2ec46-5ef6-47ed-a3a6-7bb1de9b7ed6","year":2025},"citing_paper":{"arxiv_id":"2605.13369","last_updated":"2026-05-14T02:40:02Z","snapshot_observed_at":"2026-08-15T02:09:04.244467Z","submitted_at":"2026-05-13T11:27:40Z","title":"Query-Conditioned Test-Time Self-Training for Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-14T20:04:51.248797Z"},"links":{"cited_paper":"/paper/2505.20633","citing_paper":"/paper/2605.13369"},"observation_digest":"sha256:8efe335ab1fc0a80eaf0a8c704c7e47a56e379e2a0019e066456ced2f0dbb321","observation_id":"cdcc4d84-bf6a-47b9-a459-416989341271","resolution":{"observed_at":"2026-05-14T20:07:54.184232Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.20633","doi":"10.48550/arxiv.2505.20633","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.20633","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Test-time learning for large language models","venue":"ArXiv.org","work_id":"70f2ec46-5ef6-47ed-a3a6-7bb1de9b7ed6","year":2025},"citing_paper":{"arxiv_id":"2605.13369","last_updated":"2026-05-14T02:40:02Z","snapshot_observed_at":"2026-08-15T02:09:04.244467Z","submitted_at":"2026-05-13T11:27:40Z","title":"Query-Conditioned Test-Time Self-Training for Large Language Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-15T05:53:42.235498Z"},"links":{"cited_paper":"/paper/2505.20633","citing_paper":"/paper/2605.13369"},"observation_digest":"sha256:bfb43775a0eb0137db0e8be2af984acb733307a53e3faee3b85b5866b785f66d","observation_id":"0a74ef89-d45a-42a8-ab8c-37cd211d9b5b","resolution":{"observed_at":"2026-05-15T05:55:04.900424Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.20633","doi":"10.48550/arxiv.2505.20633","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.20633","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Test-time learning for large language models","venue":"ArXiv.org","work_id":"70f2ec46-5ef6-47ed-a3a6-7bb1de9b7ed6","year":2025},"citing_paper":{"arxiv_id":"2605.20189","last_updated":"2026-03-23T07:18:02Z","snapshot_observed_at":"2026-08-16T16:24:07.331889Z","submitted_at":"2026-03-23T07:18:02Z","title":"SOLAR: A Self-Optimizing Open-Ended Autonomous Agent for Lifelong Learning and Continual Adaptation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-21T11:21:30.867480Z"},"links":{"cited_paper":"/paper/2505.20633","citing_paper":"/paper/2605.20189"},"observation_digest":"sha256:ea51b0c9441f73c5e76f24d784c94a859dc4428a4012d1241b1cd717f4d0c0c5","observation_id":"4114c0b1-0570-4ac7-a380-509fb91c120b","resolution":{"observed_at":"2026-05-21T11:24:08.657644Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.20633","doi":"10.48550/arxiv.2505.20633","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.20633","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Test-time learning for large language models","venue":"ArXiv.org","work_id":"70f2ec46-5ef6-47ed-a3a6-7bb1de9b7ed6","year":2025},"citing_paper":{"arxiv_id":"2605.22478","last_updated":"2026-07-18T11:55:12Z","snapshot_observed_at":"2026-08-18T10:51:34.261614Z","submitted_at":"2026-05-21T13:36:38Z","title":"DeliCIR: Memory-Guided Test-Time Deliberation via Multi-Agent Collaboration for Composed Image Retrieval","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-22T06:40:58.445504Z"},"links":{"cited_paper":"/paper/2505.20633","citing_paper":"/paper/2605.22478"},"observation_digest":"sha256:3f0dbc2d7897497be8ea6eb7f4e09e62979ae8f30d11eacd7c80a624618ccdb3","observation_id":"54ef5ba2-67d7-418c-a85e-e2203367bb93","resolution":{"observed_at":"2026-05-22T06:41:10.212675Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.20633","doi":"10.48550/arxiv.2505.20633","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.20633","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Test-time learning for large language models","venue":"ArXiv.org","work_id":"70f2ec46-5ef6-47ed-a3a6-7bb1de9b7ed6","year":2025},"citing_paper":{"arxiv_id":"2605.22478","last_updated":"2026-07-18T11:55:12Z","snapshot_observed_at":"2026-08-18T10:51:34.261614Z","submitted_at":"2026-05-21T13:36:38Z","title":"DeliCIR: Memory-Guided Test-Time Deliberation via Multi-Agent Collaboration for Composed Image Retrieval","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-06-30T17:10:54.790735Z"},"links":{"cited_paper":"/paper/2505.20633","citing_paper":"/paper/2605.22478"},"observation_digest":"sha256:899c005a98f6696a0f59a6b742e16ab1f0972df9ab015dc02c33f42db28fd654","observation_id":"6a077f31-132d-48e3-82c7-1e6955f02449","resolution":{"observed_at":"2026-06-30T17:14:56.865480Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.20633","snapshot_observed_at":"2026-08-02T13:28:24.933330Z","title":"Test-time learning for large language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.22478","last_updated":"2026-07-18T11:55:12Z","snapshot_observed_at":"2026-08-18T10:51:34.261614Z","submitted_at":"2026-05-21T13:36:38Z","title":"DeliCIR: Memory-Guided Test-Time Deliberation via Multi-Agent Collaboration for Composed Image Retrieval","version":4},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-02T13:28:24.933330Z"},"links":{"cited_paper":"/paper/2505.20633","citing_paper":"/paper/2605.22478"},"observation_digest":"sha256:a1acaa1a845fe3a2ca621362cdd2b3d43d251b7314cbde48597ad6d8dca94c48","observation_id":"2fc67f7f-2f90-4579-9dd3-a9d44be2cabc","resolution":{"observed_at":"2026-08-02T13:28:24.933330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.20633","doi":"10.48550/arxiv.2505.20633","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.20633","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Test-time learning for large language models","venue":"ArXiv.org","work_id":"70f2ec46-5ef6-47ed-a3a6-7bb1de9b7ed6","year":2025},"citing_paper":{"arxiv_id":"2606.04536","last_updated":"2026-06-03T07:18:31Z","snapshot_observed_at":"2026-08-14T01:27:32.045812Z","submitted_at":"2026-06-03T07:18:31Z","title":"Scaling Self-Evolving Agents via Parametric Memory","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T06:45:04.236649Z"},"links":{"cited_paper":"/paper/2505.20633","citing_paper":"/paper/2606.04536"},"observation_digest":"sha256:3d2dd2ab5d7f6df026eae6c8257d8362f8fce08860c9173f489d387a6f0c4a1f","observation_id":"65d8b5d1-d1f4-49ee-9bb2-ba2cab8dd968","resolution":{"observed_at":"2026-07-02T07:46:45.852198Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.20633","doi":"10.48550/arxiv.2505.20633","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.20633","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Test-time learning for large language models","venue":"ArXiv.org","work_id":"70f2ec46-5ef6-47ed-a3a6-7bb1de9b7ed6","year":2025},"citing_paper":{"arxiv_id":"2606.05513","last_updated":"2026-06-03T23:40:30Z","snapshot_observed_at":"2026-08-15T16:49:45.099520Z","submitted_at":"2026-06-03T23:40:30Z","title":"EpiEvolve: Self-Evolving Agents for Streaming Pandemic Forecasting under Regime Shifts","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-06-28T05:40:18.458584Z"},"links":{"cited_paper":"/paper/2505.20633","citing_paper":"/paper/2606.05513"},"observation_digest":"sha256:359e0dd15b557957c871bc84afbde7af6519b3c51e07a4cdf2621cefdcf77d60","observation_id":"35387f4a-903d-4a0a-8b71-4c166ea5b1ca","resolution":{"observed_at":"2026-07-02T09:06:49.156382Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.20633","doi":"10.48550/arxiv.2505.20633","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.20633","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Test-time learning for large language models","venue":"ArXiv.org","work_id":"70f2ec46-5ef6-47ed-a3a6-7bb1de9b7ed6","year":2025},"citing_paper":{"arxiv_id":"2606.06906","last_updated":"2026-06-05T04:49:37Z","snapshot_observed_at":"2026-08-02T10:42:01.638389Z","submitted_at":"2026-06-05T04:49:37Z","title":"EASE-TTT: Evidence-Aligned Selective Test-Time Training for Long-Context Question Answering","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-06-27T22:05:00.537690Z"},"links":{"cited_paper":"/paper/2505.20633","citing_paper":"/paper/2606.06906"},"observation_digest":"sha256:697b8da8beed0dea75ae2229d11d280beceaa4725475e0a80d33364e2002967e","observation_id":"302c22af-d361-4446-902b-f736a2bc5de2","resolution":{"observed_at":"2026-07-02T17:17:15.088033Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.20633","doi":"10.48550/arxiv.2505.20633","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.20633","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Test-time learning for large language models","venue":"ArXiv.org","work_id":"70f2ec46-5ef6-47ed-a3a6-7bb1de9b7ed6","year":2025},"citing_paper":{"arxiv_id":"2606.11437","last_updated":"2026-06-09T20:48:48Z","snapshot_observed_at":"2026-08-13T04:27:41.134413Z","submitted_at":"2026-06-09T20:48:48Z","title":"The Power of Test-Time Training for Approximate Sampling","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-27T11:07:47.543592Z"},"links":{"cited_paper":"/paper/2505.20633","citing_paper":"/paper/2606.11437"},"observation_digest":"sha256:13935f7bd59fe4652273135564c8e23cd341d4809b2c1aa02f15846ef6b2b373","observation_id":"9b718476-e051-4829-9b08-bf9c113f20a9","resolution":{"observed_at":"2026-07-03T08:07:45.316691Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.20633","doi":"10.48550/arxiv.2505.20633","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.20633","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Test-time learning for large language models","venue":"ArXiv.org","work_id":"70f2ec46-5ef6-47ed-a3a6-7bb1de9b7ed6","year":2025},"citing_paper":{"arxiv_id":"2606.28349","last_updated":"2026-06-03T07:15:11Z","snapshot_observed_at":"2026-08-18T16:03:52.014313Z","submitted_at":"2026-06-03T07:15:11Z","title":"HMARS: A Hierarchical Multi-Agent Memory System for Long-Context Reasoning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-06-30T11:30:52.871762Z"},"links":{"cited_paper":"/paper/2505.20633","citing_paper":"/paper/2606.28349"},"observation_digest":"sha256:619ac0ec150879f362ac9ab2ee4321cf4b06c264073f6e6772c3d9a8b9345bd7","observation_id":"893a3336-a9d2-40b2-9924-f2cbb45fa9de","resolution":{"observed_at":"2026-06-30T11:34:37.867511Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.20633","doi":"10.48550/arxiv.2505.20633","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.20633","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Test-time learning for large language models","venue":"ArXiv.org","work_id":"70f2ec46-5ef6-47ed-a3a6-7bb1de9b7ed6","year":2025},"citing_paper":{"arxiv_id":"2606.29182","last_updated":"2026-06-28T04:06:12Z","snapshot_observed_at":"2026-08-15T18:28:47.832392Z","submitted_at":"2026-06-28T04:06:12Z","title":"Evidence-Informed LLM Beliefs for Continual Scientific Discovery","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-06-30T07:58:16.860761Z"},"links":{"cited_paper":"/paper/2505.20633","citing_paper":"/paper/2606.29182"},"observation_digest":"sha256:0a2ead9740c5f0235c9dba3ecaa6c3d6c568fcb4106ebd4ab11108ba6daa3916","observation_id":"cf661b88-916f-4158-bc44-d9fafdf2a5ca","resolution":{"observed_at":"2026-06-30T08:04:28.242245Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.20633","snapshot_observed_at":"2026-08-02T08:23:08.093421Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21624","last_updated":"2026-07-07T10:18:25Z","snapshot_observed_at":"2026-08-19T07:13:56.272887Z","submitted_at":"2026-07-07T10:18:25Z","title":"FBLayout: Optimizing Memory Layout for Efficient LLM Finetuning on Mobile GPUs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T08:23:08.093421Z"},"links":{"cited_paper":"/paper/2505.20633","citing_paper":"/paper/2607.21624"},"observation_digest":"sha256:baa485d3daa32c69ee8a63db06991d0fa6957f713c666b0f048f8350364e18c6","observation_id":"1063eb92-8b88-4abc-9b9a-b4c8778be3b0","resolution":{"observed_at":"2026-08-02T08:23:08.093421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.20633","snapshot_observed_at":"2026-08-15T14:18:54.738157Z","title":"arXiv preprint arXiv:2505.20633 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.11342","last_updated":"2026-08-11T18:49:03Z","snapshot_observed_at":"2026-08-19T20:13:01.941122Z","submitted_at":"2026-08-11T18:49:03Z","title":"Weightless Fine-Tuning: Personalizing LLMs via Logit-Space Transport","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T14:18:54.738157Z"},"links":{"cited_paper":"/paper/2505.20633","citing_paper":"/paper/2608.11342"},"observation_digest":"sha256:a865a300ebf03b862211626c21f3960297eb2965ca8dec56d104be3178a60183","observation_id":"3b6feb35-eba8-4ddc-b9da-15a8f0310cd8","resolution":{"observed_at":"2026-08-15T14:18:54.738157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.20633/citation-record","integrity":"/paper/2505.20633/integrity","json":"/paper/2505.20633/citation-record.json","paper":"/paper/2505.20633"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:56.601551Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T13:55:56.601551Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:c008b6b03a977080001c638e49dd71f5ae8c39e89facc57ca56fe9befeceec69","observation_id":"af88d296-d62f-4a24-b2de-818ffe65ca88","resolution":{"observed_at":"2026-08-07T13:55:56.601551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T13:55:56.658664Z","title":"L., Almeida, D., Altenschmidt, J., Altman, S., Anadkat, S., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T13:55:56.658664Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:1dbe243b28c02e4ec21087db3b96c3b5280a107f9d93411527e3bd23bb485350","observation_id":"1c868ab3-4f6f-4b5c-90dc-963e9e6f8885","resolution":{"observed_at":"2026-08-07T13:55:56.658664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07279","last_updated":"2025-03-25T03:36:21Z","snapshot_observed_at":"2026-08-18T12:49:11.537713Z","submitted_at":"2024-11-11T18:59:45Z","title":"The Surprising Effectiveness of Test-Time Training for Few-Shot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.07279","snapshot_observed_at":"2026-08-07T13:55:56.740512Z","title":"The surprising effectiveness of test-time training for abstract reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T13:55:56.740512Z"},"links":{"cited_paper":"/paper/2411.07279","citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:b31647f90d5a0d5cd59cb1932e1b866f17b137c3303d7a699c8c8aeb4cdb7ab8","observation_id":"147d9025-08f4-4eb2-b4a0-1554ebb730a9","resolution":{"observed_at":"2026-08-07T13:55:56.740512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10403","last_updated":"2023-09-13T20:35:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:46:53Z","title":"PaLM 2 Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10403","snapshot_observed_at":"2026-08-07T13:55:56.836634Z","title":"M., Firat, O., Johnson, M., Lepikhin, D., Passos, A., Shakeri, S., Taropa, E., Bailey, P., Chen, Z., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T13:55:56.836634Z"},"links":{"cited_paper":"/paper/2305.10403","citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:3cfb53782fd6d3af4bda928ef0b74c3b5e75a4d36b340ef248f1d089d35d999d","observation_id":"dba82deb-b4e5-4c49-99e8-93c388b3684c","resolution":{"observed_at":"2026-08-07T13:55:56.836634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:56.898083Z","title":"Self-rag: Learning to retrieve, generate, and critique through self-reflection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T13:55:56.898083Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:cb5600ff95bd53d1e87a6f06c03a9ac45bc4c32cc8cff181e57b135877a5369f","observation_id":"6abfa50c-8f06-41c5-aee3-ca9a41c2507f","resolution":{"observed_at":"2026-08-07T13:55:56.898083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-20T15:31:01.041088Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-07T13:55:56.959365Z","title":"Qwen technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T13:55:56.959365Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:7ac54654d63b0e28c30f687de9ca881c88c0a292d5ea5ba31634b026fc3077a3","observation_id":"70972196-abbd-4f60-8c74-796b655401ad","resolution":{"observed_at":"2026-08-07T13:55:56.959365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:57.016619Z","title":"u hler, A., Wiewel, F., D \\","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T13:55:57.016619Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:2431932dc2947a4ecba18f10da6bf100c5d1c525575ecb70d954bc2adb66a43d","observation_id":"a0d55257-f8b8-44a1-802d-1bbde90a6bb7","resolution":{"observed_at":"2026-08-07T13:55:57.016619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:57.098268Z","title":"Tackling language modelling bias in support of linguistic diversity","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T13:55:57.098268Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:dd19e075c8ed3a53801d8ec32b08b4317475e822db045670ece0677ad49722ef","observation_id":"bc13d168-62c7-4447-8b39-c357b58f5487","resolution":{"observed_at":"2026-08-07T13:55:57.098268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:57.163660Z","title":"A neural probabilistic language model","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T13:55:57.163660Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:1cd0c42c6ba6affb85d4a28a56f70732cfb0ae8fc5aed620175ef0fa9cebf0e0","observation_id":"a54851e0-fe09-444f-858e-04c364325b0d","resolution":{"observed_at":"2026-08-07T13:55:57.163660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:57.281403Z","title":"Parameter-free online test-time adaptation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T13:55:57.281403Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:0640a96eb0b280c21cced628efd2e2e79dec7c9ace8754bbc6fd5e7518d0017e","observation_id":"f849b0af-a99c-4364-baa1-c083a8255bf8","resolution":{"observed_at":"2026-08-07T13:55:57.281403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:57.380822Z","title":"D., Dhariwal, P., Neelakantan, A., Shyam, P., Sastry, G., Askell, A., et al","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T13:55:57.380822Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:1d5266554225f6bdb6737e2db8e58ff1365ba3294759f0dc43a0ee7c776ebb25","observation_id":"3b1180af-30f3-4ea8-a742-082cc8329ef2","resolution":{"observed_at":"2026-08-07T13:55:57.380822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:57.476346Z","title":"A survey on evaluation of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T13:55:57.476346Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:ea2e938e111f78c66352f406d662369db50637a1245318caf77e0535884ae74a","observation_id":"6381e90e-8c96-43de-bd63-437c0d0ee06d","resolution":{"observed_at":"2026-08-07T13:55:57.476346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:57.544138Z","title":"Cross-device collaborative test-time adaptation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T13:55:57.544138Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:ce6153c3c837c35bc8b223210dece964b4f2eec07a65ae43b29a5f39f818d483","observation_id":"cbaf85e9-b3b6-4b2b-8ea4-5244666c7d11","resolution":{"observed_at":"2026-08-07T13:55:57.544138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-07T13:55:57.651021Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T13:55:57.651021Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:c86ff2bfe4de94e222f59e438381615b59de182918e27e5a3ee24bdd728d5fb8","observation_id":"ccb38835-c7e2-4959-8714-2ac76dea2a80","resolution":{"observed_at":"2026-08-07T13:55:57.651021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:57.726569Z","title":"Towards robust and efficient cloud-edge elastic model adaptation via selective entropy distillation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T13:55:57.726569Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:769b2d2006f0244d826fb94d2756e479bfd4455d1a3e46ff02f74e3732e39581","observation_id":"fa08a4c1-d9bf-4bed-8ea5-d2bc3ff7ff2c","resolution":{"observed_at":"2026-08-07T13:55:57.726569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:57.815559Z","title":"Longlora: Efficient fine-tuning of long-context large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T13:55:57.815559Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:29f613c5306db4e063a05d7bd5d4e308433b97d0140f1cb1e8cef6e02ed9cbbf","observation_id":"302adbc9-4872-4355-81c4-ad6c23e37af7","resolution":{"observed_at":"2026-08-07T13:55:57.815559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:57.961429Z","title":"W., Sutton, C., Gehrmann, S., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T13:55:57.961429Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:2ca8c9eb1119714cbb21acbf2205910973364998889e6377ff9163b8371b5d30","observation_id":"0368849a-f1c6-4a2e-ab7d-18315702b15a","resolution":{"observed_at":"2026-08-07T13:55:57.961429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:58.074952Z","title":"W., Hou, L., Longpre, S., Zoph, B., Tay, Y., Fedus, W., Li, Y., Wang, X., Dehghani, M., Brahma, S., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T13:55:58.074952Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:5b5af084a0153f2da9be5da24c063381719e07868a455e3e26d71cd273cf43ba","observation_id":"197eaf32-059a-46e7-8814-79261d2cfca6","resolution":{"observed_at":"2026-08-07T13:55:58.074952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T13:55:58.184898Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T13:55:58.184898Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:85a2eba50c6657d3c96dd51cca61b5b98a8c7fb9a6cd061738cc2ff8d35e85e1","observation_id":"b5d1f3f1-a279-469a-b9bd-4c36a44677c1","resolution":{"observed_at":"2026-08-07T13:55:58.184898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:58.304330Z","title":"Qlora: Efficient finetuning of quantized llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T13:55:58.304330Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:f296f454e15258b5412f0f7e35bbe4ee4fd085d2136bfa553dfbf21a05476617","observation_id":"c940b327-4946-4e34-abe2-16e0b588b184","resolution":{"observed_at":"2026-08-07T13:55:58.304330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-08-14T18:16:28.847993Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-07T13:55:58.423640Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T13:55:58.423640Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:2d02d875e8d14dd6007d7c4b3aa7db6506e3b7928182bdf16f8ed6bf06d78bbb","observation_id":"1aa193e1-19e2-49be-baa3-b3e6ed68efce","resolution":{"observed_at":"2026-08-07T13:55:58.423640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:58.547957Z","title":"GLM : General language model pretraining with autoregressive blank infilling","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T13:55:58.547957Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:568d69f9f3dec2f1b83d9f2c0c3e3b625a9c9a5d50ce59d084e90b1c1eb32f2c","observation_id":"f76d7e0f-5234-4459-ab0e-f9061822c5fc","resolution":{"observed_at":"2026-08-07T13:55:58.547957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T13:55:58.629427Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T13:55:58.629427Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:f931c0a49bd80786b268c45ba49871c6d84a05231170c08f4ba91680c8bedc0d","observation_id":"467ac83b-ca20-49bf-9f2a-3849008a5611","resolution":{"observed_at":"2026-08-07T13:55:58.629427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:58.719199Z","title":"A survey on rag meeting llms: Towards retrieval-augmented large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T13:55:58.719199Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:d9c159e4f4887cb1fd431d48890cd7740fb54c4c9a04251881036d1f6f2069da","observation_id":"4fcf8ed0-18a2-4d94-bf07-b990547ba989","resolution":{"observed_at":"2026-08-07T13:55:58.719199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:10.195563Z","title":null,"venue":null,"work_id":"94757f27-ecf0-4464-9a3c-3b5542000397","year":2021},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T13:55:58.835706Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:924fd0e50eb6cdf3b4a3327bb4ef6aaf8e59a1f2b9b959b946e28bf6a24aaf40","observation_id":"86cab038-f50d-4f3a-b58d-b47871096384","resolution":{"observed_at":"2026-08-07T13:56:10.237895Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:10.064516Z","title":"Test-time training with masked autoencoders","venue":null,"work_id":"27467132-75ab-48e2-9c0c-4e80b138d9b2","year":2022},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T13:55:58.929902Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:6996572a63ebdfb570e80b3ef6ee50142d14fa8a35513999a01cb6e035aabfa8","observation_id":"613b8715-6d30-4e9a-82d3-b887a1797706","resolution":{"observed_at":"2026-08-07T13:56:10.128576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:09.931000Z","title":"Back to the source: Diffusion-driven adaptation to test-time corruption","venue":null,"work_id":"96777cd2-39a6-445f-bad8-8de2e3e9e45b","year":2023},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T13:55:59.077701Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:c0f51e4bff7a837fcd1231bcc653e62ef2aa779b364647bcd86b376ff33a2546","observation_id":"dfb3e7f7-800d-4269-9181-2242154e59f4","resolution":{"observed_at":"2026-08-07T13:56:10.000605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:09.731785Z","title":"Domain-specific language model pretraining for biomedical natural language processing","venue":null,"work_id":"3faf7e86-08c6-4db5-908e-13f4917a0b27","year":2021},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T13:55:59.202395Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:e1b6caab54763aa517a382fa47b2d47034a8d60ad50935a732ae35906ac65e56","observation_id":"890904cc-c54c-4a45-911d-40cd6109778d","resolution":{"observed_at":"2026-08-07T13:56:09.813881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:09.568652Z","title":"and Sun, Y","venue":null,"work_id":"0cb3a19b-af27-480c-893d-41e8042593f0","year":2024},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T13:55:59.328336Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:ba2cfcb21e82eefdcb869394987c6152c8782278a542b2dcb884f75e4bc7f099","observation_id":"11cc34a6-b2a4-41e9-8b07-6a8feac6b5bc","resolution":{"observed_at":"2026-08-07T13:56:09.660595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:09.361556Z","title":"Deberta: Decoding-enhanced bert with disentangled attention","venue":null,"work_id":"ebb1fef2-ae2c-4f41-8dae-8e591dff8270","year":2021},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T13:55:59.451530Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:41daa283480e3e5b69355f3ef7773c156a69d450cbe213badb1a4a980c3a4f21","observation_id":"24caac2f-0b50-4e99-85b8-beffc32f6e80","resolution":{"observed_at":"2026-08-07T13:56:09.482631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:09.230386Z","title":"Mecta: Memory-economic continual test-time model adaptation","venue":null,"work_id":"4f3000b4-2477-4c6e-bc9e-f86f3d3d68b7","year":2023},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T13:55:59.597377Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:40944b422f690095f1f50c7bccd76c9c34e88f99167c225faeb45a84e708b616","observation_id":"a780d59b-20a0-40af-bf6e-3f627161d0a5","resolution":{"observed_at":"2026-08-07T13:56:09.308064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:59.735780Z","title":"J., Wallis, P., Allen-Zhu, Z., Li, Y., Wang, S., Wang, L., Chen, W., et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T13:55:59.735780Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:9eeb4d4169bfd2c5c69a2f1997563e75a27b6d2b5e24b9924258523e3e9710c9","observation_id":"72e24a8a-c865-4565-a2c9-9d8f9b97cd24","resolution":{"observed_at":"2026-08-07T13:55:59.735780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:09.084880Z","title":"Dynamic ensemble reasoning for llm experts","venue":null,"work_id":"9d7471c3-f7af-420e-b2ce-6c19387404f0","year":2025},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T13:55:59.861710Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:a7983ebb59edc23dc1d4035908335749ad7552de0fce34a7a3a965078f8afcff","observation_id":"3921a7e9-f752-405a-a359-df330e22ee77","resolution":{"observed_at":"2026-08-07T13:56:09.142150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11004","last_updated":"2025-04-15T09:20:45Z","snapshot_observed_at":"2026-08-18T00:17:21.005142Z","submitted_at":"2025-04-15T09:20:45Z","title":"Dynamic Compressing Prompts for Efficient Inference of Large Language Models","version":1},"cited_work":{"arxiv_id":"2504.11004","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.11004","snapshot_observed_at":"2026-08-07T13:56:04.298735Z","title":"Dynamic Compressing Prompts for Efficient Inference of Large Language Models","venue":"cs.CL","work_id":"9d788d15-9c4b-4feb-bda1-c015ab365342","year":2025},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T13:55:59.940853Z"},"links":{"cited_paper":"/paper/2504.11004","citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:52286cd7bb1f0d30b365e0b9b4d88a07297aad54f012076bf4ff896662b564c4","observation_id":"af4445be-d3f8-4dcd-9753-01370a8f0a00","resolution":{"observed_at":"2026-08-07T13:56:04.372583Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:08.924510Z","title":"Efficiently learning at test-time: Active fine-tuning of llms","venue":null,"work_id":"8b92670c-7ef2-4f69-8a49-1a604a27af8c","year":2024},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:00.063629Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:0cc46f01acc5e05123b4bf26286dd917d07fed0ceaa00db6bba15654ec20445d","observation_id":"eba4457f-4a29-4f35-8ec8-86ec300ed0f1","resolution":{"observed_at":"2026-08-07T13:56:09.002719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:08.751930Z","title":"and Matsuo, Y","venue":null,"work_id":"5a6fc11d-7c84-4ad6-9a67-45fbe8360785","year":2021},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:00.156076Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:d99784597421303b912abbe8f9d6535a71cfed44f4d1470a61710b4b2406c6d1","observation_id":"a1be47ba-1b46-4bfa-84fe-d77e78d1d979","resolution":{"observed_at":"2026-08-07T13:56:08.810448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:00.250394Z","title":"Active retrieval augmented generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:00.250394Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:c76dfcc7ffcd3fc59115f6563133786cafbfd55c25af56385d769ad2335d0c9d","observation_id":"e5f77fef-08e6-47ef-b932-be8e62b5e095","resolution":{"observed_at":"2026-08-07T13:56:00.250394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15319","last_updated":"2024-09-01T17:21:18Z","snapshot_observed_at":"2026-08-20T07:09:28.392204Z","submitted_at":"2024-06-21T17:23:21Z","title":"LongRAG: Enhancing Retrieval-Augmented Generation with Long-context LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15319","snapshot_observed_at":"2026-08-07T13:56:00.331611Z","title":"Longrag: Enhancing retrieval-augmented generation with long-context llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:00.331611Z"},"links":{"cited_paper":"/paper/2406.15319","citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:8337cef907f7351365e8ec43930dd609b491eee014c989cc80ba435863e47eff","observation_id":"540c0e92-343c-45fd-a382-2349232b4bd0","resolution":{"observed_at":"2026-08-07T13:56:00.331611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:08.613602Z","title":"and Zuidema, W","venue":null,"work_id":"7456f725-2fa5-4532-86b2-b0e8bb397d96","year":2023},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:00.411189Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:11d3a9a53fddc39a85971fe89805b707fe9afa20c9aeea1a49be3653391ab623","observation_id":"b32d619b-2cc3-474a-8038-62abab98f8b7","resolution":{"observed_at":"2026-08-07T13:56:08.684355Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:00.500426Z","title":"Dense passage retrieval for open-domain question answering","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:00.500426Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:d8d22c4699c7e16ba7bd0fb942fe5212e1c48a3e411e49e9de823327803e73ce","observation_id":"7831e6f0-b77c-432d-a5f9-5be3ba593247","resolution":{"observed_at":"2026-08-07T13:56:00.500426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:08.491407Z","title":"Tree of clarifications: Answering ambiguous questions with retrieval-augmented large language models","venue":null,"work_id":"2e9b21af-ed4b-4fad-9f70-ade70ec147c5","year":2023},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:00.637003Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:d664d26d4f85da11179ea16edfe70d1883c39f375b18389df808f9a5f56a307e","observation_id":"bd4197dd-3730-4c1d-9d03-e7f482cde5fd","resolution":{"observed_at":"2026-08-07T13:56:08.541700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:08.377447Z","title":"S., Yvon, F., Gall \\'e , M., et al","venue":null,"work_id":"118bf51e-cd85-45ac-9590-569a5f85619f","year":2023},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:00.771420Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:8c3ac096dca7b7861a3ec68589bf96341197b6c432f3ef5207595dcd2a39c258","observation_id":"ac8c0240-adc6-462c-a374-a14fd59f619b","resolution":{"observed_at":"2026-08-07T13:56:08.438064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:08.248099Z","title":"Entropy is not enough for test-time adaptation: From the perspective of disentangled factors","venue":null,"work_id":"0f0099c0-365c-43b5-8983-963ab75015ac","year":2024},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:00.860610Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:ba7b9565da7e6eb73b38e484d8d5265cd7b77a185d26e9a48ce4dde0ce9f9bac","observation_id":"e8dee53d-46bf-42fc-9813-06bef5218087","resolution":{"observed_at":"2026-08-07T13:56:08.299151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:07.984848Z","title":"Bart: Denoising sequence-to-sequence pre-training for natural language generation, translation, and comprehension","venue":null,"work_id":"1d7ca973-b47e-4ccb-83a9-5f8db241edb4","year":2020},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:00.948332Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:0bd994b91c0ea093e79711cce304cbdfd2c1ec85e4eb2472842d566b1949c53a","observation_id":"f3df1711-e4a2-4896-81f4-6a574ca541fd","resolution":{"observed_at":"2026-08-07T13:56:08.120759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:07.686422Z","title":"u ttler, H., Lewis, M., Yih, W.-t., Rockt \\","venue":null,"work_id":"17777fc0-417d-414b-ae39-5b54b3e54937","year":2020},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:01.061180Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:d20a84051c19d7d914b1bc79e7a5fd9ba86fcdb4219428e1c9cd7dbc5ecf90b7","observation_id":"c25bca12-a839-475a-bb6f-260ca8103ba1","resolution":{"observed_at":"2026-08-07T13:56:07.842384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:07.398172Z","title":"From classification to generation: Insights into crosslingual retrieval augmented ICL","venue":null,"work_id":"dada3ce8-b1a9-4772-8061-905c8f177cfc","year":2023},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:01.172465Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:ae146cc8fc9e185615ddad678918b5ee39330ba09a0934d106358eaeda81e22f","observation_id":"ae0b2e3e-8c4d-445f-a943-340245bbb9a1","resolution":{"observed_at":"2026-08-07T13:56:07.549961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:07.176717Z","title":"A comprehensive survey on test-time adaptation under distribution shifts","venue":null,"work_id":"7fe1a22e-aa10-4358-a48b-0cc4fa08a56d","year":2024},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:01.283588Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:4a3ed605ae834e6c281df84d2fa1f3a8b1858580bc2d9e126acbac053e5b7fa9","observation_id":"aa5d9566-8d1e-4034-aab3-a95828a8c789","resolution":{"observed_at":"2026-08-07T13:56:07.262895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:01.319130Z","title":"Rouge: A package for automatic evaluation of summaries","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:01.319130Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:94ebf1e7e366bacaae215700e85cab4d38c189274eebc4900332e6a232a19160","observation_id":"2ac01dbd-113e-45ad-8d54-259ab2b60243","resolution":{"observed_at":"2026-08-07T13:56:01.319130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:07.034673Z","title":"V., Chen, X., Chen, M., Shi, W., Lomeli, M., James, R., Rodriguez, P., Kahn, J., Szilvasy, G., Lewis, M., Zettlemoyer, L., and tau Yih, W","venue":null,"work_id":"a85d3cb7-d319-49bf-a334-c87b3edf9821","year":2024},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:01.362278Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:3685779f7b5fa2903e6048954a2b789a475feecb5f682a3cc39e13bd38bda40c","observation_id":"68bd5c8e-f8eb-4404-8ba5-1ae849f6238c","resolution":{"observed_at":"2026-08-07T13:56:07.092209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-08-16T14:33:50.657682Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-07T13:56:01.411558Z","title":"Roberta: A robustly optimized bert pretraining approach","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:01.411558Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:454f03cf3eaea81b2ccd70e59919f960ef47d6bb144fff2fe15345ae8f542c4b","observation_id":"9f3b2a6c-3eec-465c-873f-38edbdc5588f","resolution":{"observed_at":"2026-08-07T13:56:01.411558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:06.915709Z","title":"Ttt++: When does self-supervised test-time training fail or thrive? Advances in Neural Information Processing Systems, 34: 0 21808--21820, 2021","venue":null,"work_id":"f63cd4d9-d426-4570-870b-9900f4154766","year":2021},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:01.474823Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:0bfe759d754df8ac11baa1ee25238776c3cdf847d24835ecb23c081b58a49245","observation_id":"c2de53ad-dbd4-48a8-9652-78daddc1adbd","resolution":{"observed_at":"2026-08-07T13:56:06.973169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:06.768771Z","title":"J., Soneira, P","venue":null,"work_id":"d9bcd3d4-7fbc-47a3-b80c-0cd0fd9a7add","year":2023},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:01.523190Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:500608c50602fe0376c3e4347071e8600e7a2477c6f37f9caac7abcfe3a82097","observation_id":"1837e481-dc96-4197-975a-97def6f61f2e","resolution":{"observed_at":"2026-08-07T13:56:06.844381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.10963","last_updated":"2021-01-14T21:11:06Z","snapshot_observed_at":"2026-08-19T09:01:42.968993Z","submitted_at":"2020-06-19T05:08:43Z","title":"Evaluating Prediction-Time Batch Normalization for Robustness under Covariate Shift","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.10963","snapshot_observed_at":"2026-08-07T13:56:01.590736Z","title":"Evaluating prediction-time batch normalization for robustness under covariate shift","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:01.590736Z"},"links":{"cited_paper":"/paper/2006.10963","citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:319fd43e67e1bedfe45b4db31c2d7fd49d804dc1a5c0ee8f71b61f3285ed6dd5","observation_id":"1946b67f-0f00-4619-aa8d-5983a8ba7afe","resolution":{"observed_at":"2026-08-07T13:56:01.590736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:06.604675Z","title":"Efficient test-time model adaptation without forgetting","venue":null,"work_id":"f4c8faec-b0fa-4f5a-9285-503ce9f2faa8","year":2022},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:01.667001Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:897fb26f9614634cc79f5a466944c8db154c70e44948cc37065586fcc2790a12","observation_id":"c10f7acc-2d9d-4ac4-99ef-19b282674b3f","resolution":{"observed_at":"2026-08-07T13:56:06.680545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.10853","last_updated":"2022-03-26T12:10:32Z","snapshot_observed_at":"2026-08-16T17:13:04.032324Z","submitted_at":"2022-03-21T10:20:21Z","title":"Boost Test-Time Performance with Closed-Loop Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.10853","snapshot_observed_at":"2026-08-07T13:56:01.710319Z","title":"Boost test-time performance with closed-loop inference","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:01.710319Z"},"links":{"cited_paper":"/paper/2203.10853","citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:d8e796f0cc36d347769c6d46a1c9abd29a8e83a7e4455005afea881eeffaf6ed","observation_id":"344888a3-91ed-41a6-8438-1a5a9936afb7","resolution":{"observed_at":"2026-08-07T13:56:01.710319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:06.468424Z","title":"Towards stable test-time adaptation in dynamic wild world","venue":null,"work_id":"cf0157cd-999b-45b8-8d80-6fe902a494e3","year":2023},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:01.753366Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:dc4172fc3234e7b99c9bfb801310a5b9bfd1c53bae7fa72f952c4c14861b2cc4","observation_id":"c2d73975-8766-49ce-a20b-a34ac6438802","resolution":{"observed_at":"2026-08-07T13:56:06.529646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:06.319211Z","title":"Test-time model adaptation with only forward passes","venue":null,"work_id":"9a18855f-39a4-4ab1-9ba1-231098c0b10d","year":2024},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:01.809277Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:f7c544e3b2e3af1bd8daf2d72e75c68ccdf3c6445afd389093e1e59c35a56585","observation_id":"63cd2aaf-aa4f-4559-86cf-db2f4a7dd157","resolution":{"observed_at":"2026-08-07T13:56:06.392203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:06.177328Z","title":"Efficient diffusion-driven corruption editor for test-time adaptation","venue":null,"work_id":"0152a6e5-875e-4ae9-ac6c-b50ee276a220","year":2025},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:01.867034Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:0a738751dbc377afbc5178c851a074d418c9ee92ecfd9c5e31eb0c4f20762342","observation_id":"d4bc03f5-0a59-4ba1-89c7-18c3000ff4bf","resolution":{"observed_at":"2026-08-07T13:56:06.228020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:01.939322Z","title":"Bleu: a method for automatic evaluation of machine translation","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:01.939322Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:cb2305affe9a5d127095d957617132ecbe6014948bb188b268a1f465eefca52b","observation_id":"813355ed-f098-4525-bb55-90b63a99e014","resolution":{"observed_at":"2026-08-07T13:56:01.939322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12813","last_updated":"2023-03-08T23:41:49Z","snapshot_observed_at":"2026-08-16T13:28:02.541688Z","submitted_at":"2023-02-24T18:48:43Z","title":"Check Your Facts and Try Again: Improving Large Language Models with External Knowledge and Automated Feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12813","snapshot_observed_at":"2026-08-07T13:56:02.024409Z","title":"Check your facts and try again: Improving large language models with external knowledge and automated feedback","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:02.024409Z"},"links":{"cited_paper":"/paper/2302.12813","citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:465fb9d58c12fcc2828ab13e25dfcb5df9c061257fb9653959719a714fcd35af","observation_id":"63a3e136-b368-4b80-965a-0f34af10f5d6","resolution":{"observed_at":"2026-08-07T13:56:02.024409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05591","last_updated":"2025-04-09T09:09:37Z","snapshot_observed_at":"2026-08-20T04:54:19.948670Z","submitted_at":"2024-09-09T13:20:31Z","title":"MemoRAG: Boosting Long Context Processing with Global Memory-Enhanced Retrieval Augmentation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05591","snapshot_observed_at":"2026-08-07T13:56:02.111429Z","title":"Memorag: Moving towards next-gen rag via memory-inspired knowledge discovery","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:02.111429Z"},"links":{"cited_paper":"/paper/2409.05591","citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:67d196855a6c5f1b542d6b8b5cd5d44ea66221aa33566d8a061ef099dc1f4bb4","observation_id":"ba32f2dd-b530-47c8-9cd1-a041442099c4","resolution":{"observed_at":"2026-08-07T13:56:02.111429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:02.175238Z","title":"Improving language understanding by generative pre-training","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:02.175238Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:8f5263acd296eb4f745b61c9704846a076e108fd575c249d1da747d014a015f9","observation_id":"cb3c7ee7-3912-4e48-b032-8750ff9e8391","resolution":{"observed_at":"2026-08-07T13:56:02.175238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:02.233567Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:02.233567Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:44d5d53115d14645c0e9df84105bc0167912675c36d25c6f30704d3565f738e6","observation_id":"ef604794-fc6a-4d9b-8807-f7403590cb18","resolution":{"observed_at":"2026-08-07T13:56:02.233567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:02.283675Z","title":"In-context retrieval-augmented language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:02.283675Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:6ba97bc2356c96c3db32b61097bb35da3c1ff18e5fd6d6eb589a833d31a60986","observation_id":"8746a09f-80c2-41dd-887c-84088c38d20b","resolution":{"observed_at":"2026-08-07T13:56:02.283675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:02.367682Z","title":"and Gurevych, I","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:02.367682Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:f89a2c9ce3182bccf25623f4ec4a86240b5fe4869656bdfb233086b5d75d25e1","observation_id":"fdd1b39b-1ca3-44f0-96c6-d7cbb741b64a","resolution":{"observed_at":"2026-08-07T13:56:02.367682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:02.452965Z","title":"Retrieve-and-sample: Document-level event argument extraction via hybrid retrieval augmentation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:02.452965Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:cb04c32ca903d9a49e05b93d6c1f6d2d1868bd2f4e39133cf64ea68c87f90d80","observation_id":"0b1e2ae2-a333-481a-b6fd-959604f9da46","resolution":{"observed_at":"2026-08-07T13:56:02.452965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:06.042276Z","title":"Improving robustness against common corruptions by covariate shift adaptation","venue":null,"work_id":"9e525644-6e0b-442a-8495-3286049d3ad5","year":2020},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:02.493423Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:80019d06e4b43f2c9dfb3bfaa133d1a47c9e615475097dfefd0276a18606293e","observation_id":"7896218a-418b-436d-8586-4cfb5225e073","resolution":{"observed_at":"2026-08-07T13:56:06.079266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:05.884231Z","title":"Prompting large language models with answer heuristics for knowledge-based visual question answering","venue":null,"work_id":"9c3b813c-b37a-4b38-ac9d-80538852f86a","year":2023},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:02.545410Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:cef2f46aaf3580ed56c9fd481068fab7d7812c31f1fc233bcd3cd236adba1c7d","observation_id":"46bc4377-41f0-4662-bdc8-6b7510451c22","resolution":{"observed_at":"2026-08-07T13:56:05.940521Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:05.815707Z","title":"Test-time prompt tuning for zero-shot generalization in vision-language models","venue":null,"work_id":"6635612b-c193-49eb-aad8-050e6a33a9b6","year":2022},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:02.600347Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:e2d5f78f4b828a737b55576e61ce1f51d0f45186714daadd1cd271c57da2c456","observation_id":"b224ea89-c5b2-4b08-8007-a04ffb120eea","resolution":{"observed_at":"2026-08-07T13:56:05.845083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:05.746600Z","title":"S., and Choi, S","venue":null,"work_id":"69e68a76-cfe7-4167-aec6-ee8e852a1626","year":2023},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:02.663441Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:da40b513a3a3070153e4a45f827e4934bff5ffefed404d557a68a3ad8f0386f4","observation_id":"32b19eec-ca81-4a26-b119-a9fa0bd4c6bc","resolution":{"observed_at":"2026-08-07T13:56:05.776976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:05.633856Z","title":"Test-time training with self-supervision for generalization under distribution shifts","venue":null,"work_id":"36c37ff7-7268-46df-bd78-51a507d84d0b","year":2020},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:02.728572Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:0ec1e7fd1c945c2c9ca23b846f6fef21f7af230ecc72c8f4c627d08fd0f378e5","observation_id":"01b3be37-2d5f-4ad1-8511-eb66766f1c98","resolution":{"observed_at":"2026-08-07T13:56:05.689220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:02.785199Z","title":"Q., Garcia, X., Wei, J., Wang, X., Chung, H","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:02.785199Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:d2773c46b511f9dbe2815d58289fc9b90a9f867d720c02bdaba5c71bcaaf7cd0","observation_id":"d1b19d54-1f03-430f-b219-16119b5f6257","resolution":{"observed_at":"2026-08-07T13:56:02.785199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:02.842047Z","title":"J., Ting, D","venue":null,"work_id":null,"year":1930},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:02.842047Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:9bdbbf15b6f9c5c026d44b8e24c299a63f8d63a84cfcf181a2e80cd323625bde","observation_id":"7538a482-509d-49a8-afee-958f5d9fe648","resolution":{"observed_at":"2026-08-07T13:56:02.842047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T13:56:02.889302Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:02.889302Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:30c5b8882f3561d7dcc0af465c40d629b5ab0332d4a1eb69cff2d54913a4765f","observation_id":"0034b76f-ed41-4d00-b567-5905c2f9a08f","resolution":{"observed_at":"2026-08-07T13:56:02.889302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T13:56:02.946176Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:02.946176Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:c9eea1eda98f6b99346d08da05c4b6248c0781990e26b8ef53bf578ae792af32","observation_id":"245790cd-adac-424d-87d4-a391d6206c78","resolution":{"observed_at":"2026-08-07T13:56:02.946176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:03.009185Z","title":"Interleaving retrieval with chain-of-thought reasoning for knowledge-intensive multi-step questions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:03.009185Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:e79ae5e74324bcbc78afb365b31ea598ca435ba48b143cfa4b29e4cf836b83b1","observation_id":"97248ea6-639d-41d7-b12e-969969cc1d8c","resolution":{"observed_at":"2026-08-07T13:56:03.009185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:03.046384Z","title":"N., Kaiser, ., and Polosukhin, I","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:03.046384Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:be4ba44302e9c6df6a8edd19f9a1f268f61be4c8225a2222c6736525ccad1983","observation_id":"61e3f581-e396-4607-9e6a-19ddcd74cea3","resolution":{"observed_at":"2026-08-07T13:56:03.046384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:05.526721Z","title":"Tent: Fully test-time adaptation by entropy minimization","venue":null,"work_id":"dd0db516-0aa7-4142-9e37-bec3c4c8be79","year":2021},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:03.111682Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:2ab4217dcccef0733c05a88bbed3c49254e88dbbed4b380b7d5742122a9114d4","observation_id":"6672eecf-a448-49f4-9250-2ac03a553f85","resolution":{"observed_at":"2026-08-07T13:56:05.567271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:05.434273Z","title":"Generating long-form story using dynamic hierarchical outlining with memory-enhancement","venue":null,"work_id":"d1b392ed-e548-48ab-98ac-dcdfdadcae37","year":2025},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:03.158458Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:219c2325dc7a6e24e00b68280783cd232ff9631aff89a0d3bf2daa650fedf843","observation_id":"a0477aff-ac65-42e8-afcc-605606afcd34","resolution":{"observed_at":"2026-08-07T13:56:05.496853Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:05.321291Z","title":"Self-knowledge guided retrieval augmentation for large language models","venue":null,"work_id":"220379db-f140-4b75-a72e-13f64d12ca0a","year":2023},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:03.213300Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:7c4ee35f6496f695245bf4855ea7caf57d19bcbc1c27fcab6f208a9b6700dd2c","observation_id":"41e8e111-a652-4f3c-9122-156205aed719","resolution":{"observed_at":"2026-08-07T13:56:05.378660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:05.244480Z","title":"Enhancing user-oriented proactivity in open-domain dialogues with critic guidance","venue":null,"work_id":"09184129-ab1f-42a5-8454-598770e0c5da","year":2025},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:03.257128Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:b156a3d8efb6b92b1d6f1365988170ee5253bfaa8fde0c10ff25173e9193b4c5","observation_id":"8177346a-8ff7-4299-aa40-89c28e81d205","resolution":{"observed_at":"2026-08-07T13:56:05.289029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:03.344227Z","title":"H., Hashimoto, T., Vinyals, O., Liang, P., Dean, J., and Fedus, W","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:03.344227Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:6633a0f0cdce27bb69eeec02c1515f907a1b7252c1af4e7bc601c56dd92e7b73","observation_id":"7f8ed086-f1fc-4cd9-9c06-f79474f41b65","resolution":{"observed_at":"2026-08-07T13:56:03.344227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:03.454330Z","title":"V., Zhou, D., et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:03.454330Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:0d5d09d6e2b46208e0722337cbdc0095cf7f803b9266807a9a891f9f81d10ba4","observation_id":"f093c621-1cce-4f28-a56c-57a448bc1d77","resolution":{"observed_at":"2026-08-07T13:56:03.454330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T13:56:03.541119Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:03.541119Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:087067fe6dae928eb89f286bd85ba1ed16a0532dd7a57f175a62473caac5058d","observation_id":"518a7839-7321-4244-b529-44278745df78","resolution":{"observed_at":"2026-08-07T13:56:03.541119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:05.113168Z","title":null,"venue":null,"work_id":"7c91f7c0-ab68-427f-ad62-580bceab0dc3","year":2024},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:03.615244Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:919128ebb9fbd90087d58319499c13be021d897b650601f36495f5cbe0eaf2ef","observation_id":"97aaf24e-68be-49f4-aba4-9bd537b93f55","resolution":{"observed_at":"2026-08-07T13:56:05.174786Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:05.004171Z","title":"Memo: Test time robustness via adaptation and augmentation","venue":null,"work_id":"6f731de7-de3e-46ce-b2f6-8cc5ff9d4d17","year":2022},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:03.729178Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:bf05d1e8f8ce7f1ecf8eaf0ddbf023af325cf41a9a01c639e3a72330cdf27b89","observation_id":"72f41b6d-bf23-4572-9bfc-1c2673e4419a","resolution":{"observed_at":"2026-08-07T13:56:05.034681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:04.915644Z","title":"Come: Test-time adaption by conservatively minimizing entropy","venue":null,"work_id":"53d08ae8-e68e-444a-8d35-d53c756f63ea","year":2025},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:03.796644Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:7849d24b4de013da22bca82d26f903fb9390584384c857600698d95c869cddee","observation_id":"2129b3a6-3b48-427e-bb07-06cb1b5b5a1e","resolution":{"observed_at":"2026-08-07T13:56:04.957988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-07T13:56:03.832778Z","title":"V., et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:03.832778Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:b62a59ec2d1ca98ed2c80ec230e0597717c8b780ace8bb2864f2366c9157fb2f","observation_id":"677c9970-4192-4a1b-9ecf-7f794f4cefcf","resolution":{"observed_at":"2026-08-07T13:56:03.832778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09675","last_updated":"2020-02-24T18:59:28Z","snapshot_observed_at":"2026-07-29T15:42:51.774083Z","submitted_at":"2019-04-21T23:08:53Z","title":"BERTScore: Evaluating Text Generation with BERT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09675","snapshot_observed_at":"2026-08-07T13:56:03.888886Z","title":"Q., and Artzi, Y","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:03.888886Z"},"links":{"cited_paper":"/paper/1904.09675","citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:0cad506dcf9ec12296b4367a7a8148893ce6b818cce13f1d48b427fbf849b6cf","observation_id":"5abc4f7f-ba8e-48c5-b295-9c66be0b123f","resolution":{"observed_at":"2026-08-07T13:56:03.888886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-14T10:40:26.323157Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-08-07T13:56:03.960987Z","title":"X., Zhou, K., Li, J., Tang, T., Wang, X., Hou, Y., Min, Y., Zhang, B., Zhang, J., Dong, Z., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:03.960987Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:9d8b1f1037ec2f9c1d9503cad8350f0fad02790ca66a243fa2895c99f63252a4","observation_id":"0711bf7c-6c01-4683-acf1-038406a617b5","resolution":{"observed_at":"2026-08-07T13:56:03.960987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:04.805296Z","title":"Memorybank: Enhancing large language models with long-term memory","venue":null,"work_id":"1708ca9d-08f4-4801-b3ea-98c74cf3d34f","year":2024},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:04.013826Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:617b195940ddf925e1f010ff03235aac5a873b2a1c12e3da17169dc9314e9cad","observation_id":"1f4fbd40-ce2e-47fc-a1d9-c6ccfc65bb43","resolution":{"observed_at":"2026-08-07T13:56:04.868522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:56:04.663303Z","title":"Aligning books and movies: Towards story-like visual explanations by watching movies and reading books","venue":null,"work_id":"de1dcbeb-6e6c-427d-8406-2bdd8f91bd2d","year":2015},"citing_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:04.079028Z"},"links":{"citing_paper":"/paper/2505.20633"},"observation_digest":"sha256:2abe045d241cd6b7ea67b41c190f09369eee12873e581d4c6ed2c479db52b14e","observation_id":"d2ba0ae0-68d7-4d59-879c-e0765db3361f","resolution":{"observed_at":"2026-08-07T13:56:04.722702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-20T14:46:57.845264Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models"},"reference_resolution":{"displayed":92,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":54,"verified_exact":1,"verified_fuzzy":37},"total_outbound_references":92},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 92 of 92 outbound references and 21 inbound Pith citation observations for arXiv:2505.20633."}