{"as_of":"2026-08-04T19:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:80d0c4f147e02201487e99a305dcee5afbad062ae0018ba41725ce580dc7c46d","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T10:41:51.251736Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T10:42:36.967839Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.04229","last_updated":"2026-04-05T19:08:51Z","snapshot_observed_at":"2026-08-04T06:41:40.344211Z","submitted_at":"2026-04-05T19:08:51Z","title":"Hierarchical Semantic Correlation-Aware Masked Autoencoder for Unsupervised Audio-Visual Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.04229","snapshot_observed_at":"2026-07-13T10:42:36.967839Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2604.04226","last_updated":"2026-06-05T12:24:24Z","snapshot_observed_at":"2026-08-04T06:09:31.719531Z","submitted_at":"2026-04-05T19:01:27Z","title":"SW-$A^2$-Bench: Benchmarking Autonomous Software Agent Generation for Agentic Web","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-13T10:42:36.967839Z"},"links":{"cited_paper":"/paper/2604.04229","citing_paper":"/paper/2604.04226"},"observation_digest":"sha256:635be70a736ef342382de7f520d6d50a659dff40f9b2586e205ed27102138306","observation_id":"0b7ea3f1-8fb5-4385-b6dc-a68ca79d7622","resolution":{"observed_at":"2026-07-13T10:42:36.967839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2604.04229/citation-record","integrity":"/paper/2604.04229/integrity","json":"/paper/2604.04229/citation-record.json","paper":"/paper/2604.04229"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2409.20325","last_updated":"2024-12-06T14:09:22Z","snapshot_observed_at":"2026-08-03T03:18:47.425243Z","submitted_at":"2024-09-30T14:26:12Z","title":"Old Optimizer, New Norm: An Anthology","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.20325","snapshot_observed_at":"2026-07-13T10:41:51.251736Z","title":"Old optimizer, new norm: An anthology.arXiv preprint arXiv:2409.20325,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.04229","last_updated":"2026-04-05T19:08:51Z","snapshot_observed_at":"2026-08-04T06:41:40.344211Z","submitted_at":"2026-04-05T19:08:51Z","title":"Hierarchical Semantic Correlation-Aware Masked Autoencoder for Unsupervised Audio-Visual Representation Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-13T10:41:51.251736Z"},"links":{"cited_paper":"/paper/2409.20325","citing_paper":"/paper/2604.04229"},"observation_digest":"sha256:ccbdcf3765638e134cb0d2851f9b3fe8f9d91236b219cdc389d8f904d763735e","observation_id":"a5a1d30c-04cf-42f4-9d5f-f7e84ab95ad0","resolution":{"observed_at":"2026-07-13T10:41:51.251736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:41:51.251736Z","title":"Muon optimizes under spectral norm constraints.arXiv preprint arXiv:2506.15054,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.04229","last_updated":"2026-04-05T19:08:51Z","snapshot_observed_at":"2026-08-04T06:41:40.344211Z","submitted_at":"2026-04-05T19:08:51Z","title":"Hierarchical Semantic Correlation-Aware Masked Autoencoder for Unsupervised Audio-Visual Representation Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-13T10:41:51.251736Z"},"links":{"citing_paper":"/paper/2604.04229"},"observation_digest":"sha256:75ec514cacbd91ff19973a3006709febbe3d11f47c0d25f4279b3b754049caa8","observation_id":"7daf3b1e-22ad-4151-af5f-845d867c4534","resolution":{"observed_at":"2026-07-13T10:41:51.251736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17196","last_updated":"2024-12-11T15:45:21Z","snapshot_observed_at":"2026-07-06T19:37:56.214143Z","submitted_at":"2024-10-22T17:15:20Z","title":"VoiceBench: Benchmarking LLM-Based Voice Assistants","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.17196","snapshot_observed_at":"2026-07-13T10:41:51.251736Z","title":"V oicebench: Benchmarking llm-based voice assistants.arXiv preprint arXiv:2410.17196,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.04229","last_updated":"2026-04-05T19:08:51Z","snapshot_observed_at":"2026-08-04T06:41:40.344211Z","submitted_at":"2026-04-05T19:08:51Z","title":"Hierarchical Semantic Correlation-Aware Masked Autoencoder for Unsupervised Audio-Visual Representation Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-13T10:41:51.251736Z"},"links":{"cited_paper":"/paper/2410.17196","citing_paper":"/paper/2604.04229"},"observation_digest":"sha256:be1f3508ee905476acb133a848ac2cce29b333b8db4a52bc522a2ec58608c269","observation_id":"c1c178d2-1333-435e-b5e6-0b831ce7b4df","resolution":{"observed_at":"2026-07-13T10:41:51.251736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-04T15:46:25.710484Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-13T10:41:51.251736Z","title":"Training verifiers to solve math word problems.arXiv preprint arXiv:2110.14168,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.04229","last_updated":"2026-04-05T19:08:51Z","snapshot_observed_at":"2026-08-04T06:41:40.344211Z","submitted_at":"2026-04-05T19:08:51Z","title":"Hierarchical Semantic Correlation-Aware Masked Autoencoder for Unsupervised Audio-Visual Representation Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-13T10:41:51.251736Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2604.04229"},"observation_digest":"sha256:66df3c19032d36b64af0f480d7f660721c0df4964c3bb702d91ab5bf32e7fe84","observation_id":"4e701451-8a0c-454b-8c77-acc524137453","resolution":{"observed_at":"2026-07-13T10:41:51.251736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:41:51.251736Z","title":"Closing the gap between text and speech understanding in llms.arXiv preprint arXiv:2510.13632,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.04229","last_updated":"2026-04-05T19:08:51Z","snapshot_observed_at":"2026-08-04T06:41:40.344211Z","submitted_at":"2026-04-05T19:08:51Z","title":"Hierarchical Semantic Correlation-Aware Masked Autoencoder for Unsupervised Audio-Visual Representation Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-13T10:41:51.251736Z"},"links":{"citing_paper":"/paper/2604.04229"},"observation_digest":"sha256:16b7dd2734038ea8d5c09213993e1aaf50b27efe8656651eba9988ce56d55128","observation_id":"30f763ac-c475-400c-9084-a03a5a7a28fb","resolution":{"observed_at":"2026-07-13T10:41:51.251736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:41:51.251736Z","title":"Computer software","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.04229","last_updated":"2026-04-05T19:08:51Z","snapshot_observed_at":"2026-08-04T06:41:40.344211Z","submitted_at":"2026-04-05T19:08:51Z","title":"Hierarchical Semantic Correlation-Aware Masked Autoencoder for Unsupervised Audio-Visual Representation Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-13T10:41:51.251736Z"},"links":{"citing_paper":"/paper/2604.04229"},"observation_digest":"sha256:7f248e79d13562f714789b4c7936b8d38501450491950c7c46cc0bd745136aae","observation_id":"a079c6d7-9a04-4d19-af91-1a9c3d0c23f9","resolution":{"observed_at":"2026-07-13T10:41:51.251736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14608","last_updated":"2024-09-16T02:54:50Z","snapshot_observed_at":"2026-08-04T09:07:42.158421Z","submitted_at":"2024-03-21T17:55:50Z","title":"Parameter-Efficient Fine-Tuning for Large Models: A Comprehensive Survey","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14608","snapshot_observed_at":"2026-07-13T10:41:51.251736Z","title":"Parameter-efficient fine-tuning for large models: A comprehensive survey.arXiv preprint arXiv:2403.14608,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.04229","last_updated":"2026-04-05T19:08:51Z","snapshot_observed_at":"2026-08-04T06:41:40.344211Z","submitted_at":"2026-04-05T19:08:51Z","title":"Hierarchical Semantic Correlation-Aware Masked Autoencoder for Unsupervised Audio-Visual Representation Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-13T10:41:51.251736Z"},"links":{"cited_paper":"/paper/2403.14608","citing_paper":"/paper/2604.04229"},"observation_digest":"sha256:5a717cb7b587760351554f7657961c57099fe3a980db1dff0cb731affad02dfa","observation_id":"b0032eb0-6e8f-4325-afd3-cb19427e5f9e","resolution":{"observed_at":"2026-07-13T10:41:51.251736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.11983","last_updated":"2026-04-19T16:56:37Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-15T14:28:53Z","title":"Low-rank Orthogonalization for Large-scale Matrix Optimization with Applications to Foundation Model Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.11983","snapshot_observed_at":"2026-07-13T10:41:51.251736Z","title":"Low-rank orthogonalization for large-scale matrix optimization with applications to foundation model training.arXiv preprint arXiv:2509.11983,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.04229","last_updated":"2026-04-05T19:08:51Z","snapshot_observed_at":"2026-08-04T06:41:40.344211Z","submitted_at":"2026-04-05T19:08:51Z","title":"Hierarchical Semantic Correlation-Aware Masked Autoencoder for Unsupervised Audio-Visual Representation Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-13T10:41:51.251736Z"},"links":{"cited_paper":"/paper/2509.11983","citing_paper":"/paper/2604.04229"},"observation_digest":"sha256:6f297268c5981f2f71a1588c5c7fc3199f8014b7142738af9bbeb0156314758f","observation_id":"2bd2d158-42cf-4b08-ace0-d1447cd11752","resolution":{"observed_at":"2026-07-13T10:41:51.251736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00555","last_updated":"2025-06-05T03:20:54Z","snapshot_observed_at":"2026-08-01T20:19:04.242454Z","submitted_at":"2025-03-01T16:42:01Z","title":"Safety Tax: Safety Alignment Makes Your Large Reasoning Models Less Reasonable","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00555","snapshot_observed_at":"2026-07-13T10:41:51.251736Z","title":"Safety tax: Safety alignment makes your large reasoning models less reasonable, 2025.URL https://arxiv","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04229","last_updated":"2026-04-05T19:08:51Z","snapshot_observed_at":"2026-08-04T06:41:40.344211Z","submitted_at":"2026-04-05T19:08:51Z","title":"Hierarchical Semantic Correlation-Aware Masked Autoencoder for Unsupervised Audio-Visual Representation Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-13T10:41:51.251736Z"},"links":{"cited_paper":"/paper/2503.00555","citing_paper":"/paper/2604.04229"},"observation_digest":"sha256:4b5803d3193921fdfb5008103b846e05418e539cf4cb6e34b6e805a81860e380","observation_id":"faf95e35-bdf7-4818-b930-bcf8ac862067","resolution":{"observed_at":"2026-07-13T10:41:51.251736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15513","last_updated":"2025-06-14T16:04:31Z","snapshot_observed_at":"2026-08-03T06:34:42.243765Z","submitted_at":"2024-06-20T18:37:36Z","title":"PKU-SafeRLHF: Towards Multi-Level Safety Alignment for LLMs with Human Preference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15513","snapshot_observed_at":"2026-07-13T10:41:51.251736Z","title":"Pku-saferlhf: Towards multi-level safety alignment for llms with human preference.arXiv preprint arXiv:2406.15513,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.04229","last_updated":"2026-04-05T19:08:51Z","snapshot_observed_at":"2026-08-04T06:41:40.344211Z","submitted_at":"2026-04-05T19:08:51Z","title":"Hierarchical Semantic Correlation-Aware Masked Autoencoder for Unsupervised Audio-Visual Representation Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-13T10:41:51.251736Z"},"links":{"cited_paper":"/paper/2406.15513","citing_paper":"/paper/2604.04229"},"observation_digest":"sha256:554bcc8e55a1df7715bcd1cc93682590e3ddea08d457afd3232395adc22df392","observation_id":"be7a05a0-4339-4a04-b476-d341a4c317a7","resolution":{"observed_at":"2026-07-13T10:41:51.251736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:41:51.251736Z","title":"Beyond sft: Reinforcement learning for safer large reasoning models with better reasoning ability.arXiv preprint arXiv:2512.01848,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.04229","last_updated":"2026-04-05T19:08:51Z","snapshot_observed_at":"2026-08-04T06:41:40.344211Z","submitted_at":"2026-04-05T19:08:51Z","title":"Hierarchical Semantic Correlation-Aware Masked Autoencoder for Unsupervised Audio-Visual Representation Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-13T10:41:51.251736Z"},"links":{"citing_paper":"/paper/2604.04229"},"observation_digest":"sha256:cd74a52639bdfe084bfb044b6153a107cdab7630b59e6b93b2f0d7f8a386a829","observation_id":"aba4227f-8510-44c2-9cf7-8f306becb413","resolution":{"observed_at":"2026-07-13T10:41:51.251736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12645","last_updated":"2025-04-08T16:47:42Z","snapshot_observed_at":"2026-07-06T20:53:31.919637Z","submitted_at":"2025-03-16T20:49:34Z","title":"Understanding Gradient Orthogonalization for Deep Learning via Non-Euclidean Trust-Region Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.12645","snapshot_observed_at":"2026-07-13T10:41:51.251736Z","title":"Dmitry Kovalev","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.04229","last_updated":"2026-04-05T19:08:51Z","snapshot_observed_at":"2026-08-04T06:41:40.344211Z","submitted_at":"2026-04-05T19:08:51Z","title":"Hierarchical Semantic Correlation-Aware Masked Autoencoder for Unsupervised Audio-Visual Representation Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-13T10:41:51.251736Z"},"links":{"cited_paper":"/paper/2503.12645","citing_paper":"/paper/2604.04229"},"observation_digest":"sha256:0d80a3557f7cf1e744634670d0fc6a76dfc6ba5a423f669c00ad0830bf65c0b5","observation_id":"5644bc27-0c90-4460-8b7f-13fdffb925a8","resolution":{"observed_at":"2026-07-13T10:41:51.251736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03218","last_updated":"2024-05-15T19:16:09Z","snapshot_observed_at":"2026-07-06T17:40:01.975792Z","submitted_at":"2024-03-05T18:59:35Z","title":"The WMDP Benchmark: Measuring and Reducing Malicious Use With Unlearning","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03218","snapshot_observed_at":"2026-07-13T10:41:51.251736Z","title":"The wmdp benchmark: Measuring and reducing malicious use with unlearning.arXiv preprint arXiv:2403.03218,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.04229","last_updated":"2026-04-05T19:08:51Z","snapshot_observed_at":"2026-08-04T06:41:40.344211Z","submitted_at":"2026-04-05T19:08:51Z","title":"Hierarchical Semantic Correlation-Aware Masked Autoencoder for Unsupervised Audio-Visual Representation Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-13T10:41:51.251736Z"},"links":{"cited_paper":"/paper/2403.03218","citing_paper":"/paper/2604.04229"},"observation_digest":"sha256:1463a73716752664a6e631a2b103e40bec8ab58421adaa3d710e5f7e6ccd7d29","observation_id":"55521aad-c8ef-4217-8da4-4e1e1b466a5d","resolution":{"observed_at":"2026-07-13T10:41:51.251736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:41:51.251736Z","title":"Mitigating the alignment tax of rlhf","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.04229","last_updated":"2026-04-05T19:08:51Z","snapshot_observed_at":"2026-08-04T06:41:40.344211Z","submitted_at":"2026-04-05T19:08:51Z","title":"Hierarchical Semantic Correlation-Aware Masked Autoencoder for Unsupervised Audio-Visual Representation Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-13T10:41:51.251736Z"},"links":{"citing_paper":"/paper/2604.04229"},"observation_digest":"sha256:5350d7952899ed571dcd59d9c5dddfc8d17871ca1131c9b8ddda5547d4b273e3","observation_id":"76b4385d-80b2-41e1-8289-d15010078576","resolution":{"observed_at":"2026-07-13T10:41:51.251736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.16982","last_updated":"2025-02-24T09:12:29Z","snapshot_observed_at":"2026-08-02T00:32:51.000665Z","submitted_at":"2025-02-24T09:12:29Z","title":"Muon is Scalable for LLM Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.16982","snapshot_observed_at":"2026-07-13T10:41:51.251736Z","title":"Muon is scalable for llm training.arXiv preprint arXiv:2502.16982, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.04229","last_updated":"2026-04-05T19:08:51Z","snapshot_observed_at":"2026-08-04T06:41:40.344211Z","submitted_at":"2026-04-05T19:08:51Z","title":"Hierarchical Semantic Correlation-Aware Masked Autoencoder for Unsupervised Audio-Visual Representation Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-13T10:41:51.251736Z"},"links":{"cited_paper":"/paper/2502.16982","citing_paper":"/paper/2604.04229"},"observation_digest":"sha256:fd7d4a54fbf87de81ff91efbe8ec91413bc4dbca4f9547b2561310c3a8a3dafd","observation_id":"40a15ea3-c03a-4718-9a26-b2a4e97e996c","resolution":{"observed_at":"2026-07-13T10:41:51.251736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13148","last_updated":"2025-02-21T18:59:37Z","snapshot_observed_at":"2026-07-06T20:08:43.596697Z","submitted_at":"2024-12-17T18:13:18Z","title":"SWAN: SGD with Normalization and Whitening Enables Stateless LLM Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13148","snapshot_observed_at":"2026-07-13T10:41:51.251736Z","title":"Swan: Sgd with normalization and whitening enables stateless llm training.arXiv preprint arXiv:2412.13148,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.04229","last_updated":"2026-04-05T19:08:51Z","snapshot_observed_at":"2026-08-04T06:41:40.344211Z","submitted_at":"2026-04-05T19:08:51Z","title":"Hierarchical Semantic Correlation-Aware Masked Autoencoder for Unsupervised Audio-Visual Representation Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-13T10:41:51.251736Z"},"links":{"cited_paper":"/paper/2412.13148","citing_paper":"/paper/2604.04229"},"observation_digest":"sha256:fd9ef7a915fd4608d57bb22cc87aeb1e70b3eb5f8a1a681a1553dbbc4a430d7b","observation_id":"7736c809-eda6-4a2d-846a-f5e47244863e","resolution":{"observed_at":"2026-07-13T10:41:51.251736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:41:51.251736Z","title":"Preconditioning benefits of spectral orthogonalization in muon","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.04229","last_updated":"2026-04-05T19:08:51Z","snapshot_observed_at":"2026-08-04T06:41:40.344211Z","submitted_at":"2026-04-05T19:08:51Z","title":"Hierarchical Semantic Correlation-Aware Masked Autoencoder for Unsupervised Audio-Visual Representation Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-13T10:41:51.251736Z"},"links":{"citing_paper":"/paper/2604.04229"},"observation_digest":"sha256:6d1f1c53ee232c414e5f380bda800f505bb8e87e7ba6b3beb6a79de392438635","observation_id":"390391de-ae92-453a-ba16-d26c9054299f","resolution":{"observed_at":"2026-07-13T10:41:51.251736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04959","last_updated":"2025-06-11T12:14:36Z","snapshot_observed_at":"2026-07-06T20:32:52.772976Z","submitted_at":"2025-02-07T14:22:56Z","title":"No Task Left Behind: Isotropic Model Merging with Common and Task-Specific Subspaces","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04959","snapshot_observed_at":"2026-07-13T10:41:51.251736Z","title":"No task left behind: Isotropic model merging with common and task-specific subspaces.arXiv preprint arXiv:2502.04959,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.04229","last_updated":"2026-04-05T19:08:51Z","snapshot_observed_at":"2026-08-04T06:41:40.344211Z","submitted_at":"2026-04-05T19:08:51Z","title":"Hierarchical Semantic Correlation-Aware Masked Autoencoder for Unsupervised Audio-Visual Representation Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-13T10:41:51.251736Z"},"links":{"cited_paper":"/paper/2502.04959","citing_paper":"/paper/2604.04229"},"observation_digest":"sha256:c5d16386466feb42709359f5554a3915ed4c8f7fbc240579e19a0ee865ef40ad","observation_id":"84cf7589-7af5-4494-9015-535a8b0179a0","resolution":{"observed_at":"2026-07-13T10:41:51.251736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.07843","last_updated":"2016-09-26T04:06:13Z","snapshot_observed_at":"2026-07-06T05:12:10.387914Z","submitted_at":"2016-09-26T04:06:13Z","title":"Pointer Sentinel Mixture Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.07843","snapshot_observed_at":"2026-07-13T10:41:51.251736Z","title":"Pointer sentinel mixture models.arXiv preprint arXiv:1609.07843,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.04229","last_updated":"2026-04-05T19:08:51Z","snapshot_observed_at":"2026-08-04T06:41:40.344211Z","submitted_at":"2026-04-05T19:08:51Z","title":"Hierarchical Semantic Correlation-Aware Masked Autoencoder for Unsupervised Audio-Visual Representation Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-13T10:41:51.251736Z"},"links":{"cited_paper":"/paper/1609.07843","citing_paper":"/paper/2604.04229"},"observation_digest":"sha256:3620ab8e2cc7473e22ac8b70f01e3b8c73cd53f4b058b25795e7da22767e534e","observation_id":"ddcbfb9c-1074-440a-ad74-9eefefca9547","resolution":{"observed_at":"2026-07-13T10:41:51.251736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18290","last_updated":"2024-07-29T22:26:36Z","snapshot_observed_at":"2026-08-01T16:34:38.795326Z","submitted_at":"2023-05-29T17:57:46Z","title":"Direct Preference Optimization: Your Language Model is Secretly a Reward Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18290","snapshot_observed_at":"2026-07-13T10:41:51.251736Z","title":"Direct preference optimization: Your language model is secretly a reward model.arXiv preprint arXiv:2305.18290,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.04229","last_updated":"2026-04-05T19:08:51Z","snapshot_observed_at":"2026-08-04T06:41:40.344211Z","submitted_at":"2026-04-05T19:08:51Z","title":"Hierarchical Semantic Correlation-Aware Masked Autoencoder for Unsupervised Audio-Visual Representation Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-13T10:41:51.251736Z"},"links":{"cited_paper":"/paper/2305.18290","citing_paper":"/paper/2604.04229"},"observation_digest":"sha256:2f32832b89c3720e036adf5d3817786f31769241f76161735880f40d0abf61d6","observation_id":"1f5c8f18-14d3-4f5b-a251-fb83a8d614e6","resolution":{"observed_at":"2026-07-13T10:41:51.251736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:41:51.251736Z","title":"Blur: A bi-level optimization approach for llm unlearning.arXiv preprint arXiv:2506.08164,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.04229","last_updated":"2026-04-05T19:08:51Z","snapshot_observed_at":"2026-08-04T06:41:40.344211Z","submitted_at":"2026-04-05T19:08:51Z","title":"Hierarchical Semantic Correlation-Aware Masked Autoencoder for Unsupervised Audio-Visual Representation Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-13T10:41:51.251736Z"},"links":{"citing_paper":"/paper/2604.04229"},"observation_digest":"sha256:78e7ca0419076f68aa5526549b622592497f6b35123572b746430f217e4511f6","observation_id":"70a01157-f76b-4462-8ca0-12c1ad065f49","resolution":{"observed_at":"2026-07-13T10:41:51.251736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13416","last_updated":"2025-05-19T17:50:45Z","snapshot_observed_at":"2026-07-06T21:26:30.087184Z","submitted_at":"2025-05-19T17:50:45Z","title":"Gluon: Making Muon & Scion Great Again! (Bridging Theory and Practice of LMO-based Optimizers for LLMs)","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.13416","snapshot_observed_at":"2026-07-13T10:41:51.251736Z","title":"Gluon: Making muon & scion great again!(bridging theory and practice of lmo-based optimizers for llms).arXiv preprint arXiv:2505.13416,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.04229","last_updated":"2026-04-05T19:08:51Z","snapshot_observed_at":"2026-08-04T06:41:40.344211Z","submitted_at":"2026-04-05T19:08:51Z","title":"Hierarchical Semantic Correlation-Aware Masked Autoencoder for Unsupervised Audio-Visual Representation Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-13T10:41:51.251736Z"},"links":{"cited_paper":"/paper/2505.13416","citing_paper":"/paper/2604.04229"},"observation_digest":"sha256:caeca5cb7c1c289e72a8b866baf35d87791a69f5645ac637d2a1bd6cd90b10ea","observation_id":"01af50d3-6af2-442a-80c6-d57f0bc2f4ea","resolution":{"observed_at":"2026-07-13T10:41:51.251736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06460","last_updated":"2024-07-14T20:14:02Z","snapshot_observed_at":"2026-07-06T18:43:22.614883Z","submitted_at":"2024-07-08T23:47:29Z","title":"MUSE: Machine Unlearning Six-Way Evaluation for Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06460","snapshot_observed_at":"2026-07-13T10:41:51.251736Z","title":"Muse: Machine unlearning six-way evaluation for language models.arXiv preprint arXiv:2407.06460,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.04229","last_updated":"2026-04-05T19:08:51Z","snapshot_observed_at":"2026-08-04T06:41:40.344211Z","submitted_at":"2026-04-05T19:08:51Z","title":"Hierarchical Semantic Correlation-Aware Masked Autoencoder for Unsupervised Audio-Visual Representation Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-13T10:41:51.251736Z"},"links":{"cited_paper":"/paper/2407.06460","citing_paper":"/paper/2604.04229"},"observation_digest":"sha256:476932cc1c96a724a865dea6e21dd584c8fabd83ad97b8400b6b970592d0a152","observation_id":"dfb8a17f-185d-4a12-9cea-53a8c1f74f1d","resolution":{"observed_at":"2026-07-13T10:41:51.251736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:41:51.251736Z","title":"Position: Capability control should be a separate goal from alignment.arXiv preprint arXiv:2602.05164,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.04229","last_updated":"2026-04-05T19:08:51Z","snapshot_observed_at":"2026-08-04T06:41:40.344211Z","submitted_at":"2026-04-05T19:08:51Z","title":"Hierarchical Semantic Correlation-Aware Masked Autoencoder for Unsupervised Audio-Visual Representation Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-13T10:41:51.251736Z"},"links":{"citing_paper":"/paper/2604.04229"},"observation_digest":"sha256:07f015c952c1401dddacf3d0e0e4c3e0b8840b095c6a71a3fce74ce0e3cee602","observation_id":"52e8cd8d-242b-404a-b54b-7ddfd19ba23e","resolution":{"observed_at":"2026-07-13T10:41:51.251736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:41:51.251736Z","title":"Steering llm reasoning through bias-only adaptation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04229","last_updated":"2026-04-05T19:08:51Z","snapshot_observed_at":"2026-08-04T06:41:40.344211Z","submitted_at":"2026-04-05T19:08:51Z","title":"Hierarchical Semantic Correlation-Aware Masked Autoencoder for Unsupervised Audio-Visual Representation Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-13T10:41:51.251736Z"},"links":{"citing_paper":"/paper/2604.04229"},"observation_digest":"sha256:65acd1d71a31f7dcf8d3866cad02f9d083ed0b0b75f910d939d74e9afe4cc58a","observation_id":"b7d230bf-a130-43e2-8943-47872a7f2565","resolution":{"observed_at":"2026-07-13T10:41:51.251736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:41:51.251736Z","title":"Zijun Wang, Haoqin Tu, Yuhan Wang, Juncheng Wu, Jieru Mei, Brian R","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.04229","last_updated":"2026-04-05T19:08:51Z","snapshot_observed_at":"2026-08-04T06:41:40.344211Z","submitted_at":"2026-04-05T19:08:51Z","title":"Hierarchical Semantic Correlation-Aware Masked Autoencoder for Unsupervised Audio-Visual Representation Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-13T10:41:51.251736Z"},"links":{"citing_paper":"/paper/2604.04229"},"observation_digest":"sha256:6b7a19e311f31f3e3b2d918bd9e7d56be619d34115a5f632e4c37a9547074c8d","observation_id":"232716db-44c1-4e52-b906-7d7e68230fba","resolution":{"observed_at":"2026-07-13T10:41:51.251736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:41:51.251736Z","title":"Low-rank adaptation for foundation models: A comprehensive review.arXiv preprint arXiv:2501.00365,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.04229","last_updated":"2026-04-05T19:08:51Z","snapshot_observed_at":"2026-08-04T06:41:40.344211Z","submitted_at":"2026-04-05T19:08:51Z","title":"Hierarchical Semantic Correlation-Aware Masked Autoencoder for Unsupervised Audio-Visual Representation Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-13T10:41:51.251736Z"},"links":{"citing_paper":"/paper/2604.04229"},"observation_digest":"sha256:91f496b5a774d51bc0504cab45447b478bdc97dce6e1b6bf8fc0a3da61be297f","observation_id":"e9f2f169-1fe4-49f3-9b96-ed8e2a679deb","resolution":{"observed_at":"2026-07-13T10:41:51.251736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:41:51.251736Z","title":"Merging beyond: Streaming llm updates via activation-guided rotations.arXiv preprint arXiv:2602.03237,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.04229","last_updated":"2026-04-05T19:08:51Z","snapshot_observed_at":"2026-08-04T06:41:40.344211Z","submitted_at":"2026-04-05T19:08:51Z","title":"Hierarchical Semantic Correlation-Aware Masked Autoencoder for Unsupervised Audio-Visual Representation Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-13T10:41:51.251736Z"},"links":{"citing_paper":"/paper/2604.04229"},"observation_digest":"sha256:8c0c203c445472e007242551aa0639204d6008ba8208796f637495ce19941c2b","observation_id":"92da45d7-1e70-4bae-85bd-dea43198e7d2","resolution":{"observed_at":"2026-07-13T10:41:51.251736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08109","last_updated":"2025-08-10T02:49:05Z","snapshot_observed_at":"2026-07-06T19:31:18.802964Z","submitted_at":"2024-10-10T16:56:05Z","title":"A Closer Look at Machine Unlearning for Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08109","snapshot_observed_at":"2026-07-13T10:41:51.251736Z","title":"A closer look at machine unlearning for large language models.arXiv preprint arXiv:2410.08109,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.04229","last_updated":"2026-04-05T19:08:51Z","snapshot_observed_at":"2026-08-04T06:41:40.344211Z","submitted_at":"2026-04-05T19:08:51Z","title":"Hierarchical Semantic Correlation-Aware Masked Autoencoder for Unsupervised Audio-Visual Representation Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-13T10:41:51.251736Z"},"links":{"cited_paper":"/paper/2410.08109","citing_paper":"/paper/2604.04229"},"observation_digest":"sha256:f7203003c7206e3361832ae72787560c7dfe760a62260df4d882b657265b8021","observation_id":"bcc0a25d-8bcb-468a-8db9-8f197ea93d1c","resolution":{"observed_at":"2026-07-13T10:41:51.251736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02612","last_updated":"2024-12-03T17:41:24Z","snapshot_observed_at":"2026-08-02T21:27:26.884251Z","submitted_at":"2024-12-03T17:41:24Z","title":"GLM-4-Voice: Towards Intelligent and Human-Like End-to-End Spoken Chatbot","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02612","snapshot_observed_at":"2026-07-13T10:41:51.251736Z","title":"Glm-4-voice: Towards intelligent and human-like end-to-end spoken chatbot.arXiv preprint arXiv:2412.02612, 2024a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.04229","last_updated":"2026-04-05T19:08:51Z","snapshot_observed_at":"2026-08-04T06:41:40.344211Z","submitted_at":"2026-04-05T19:08:51Z","title":"Hierarchical Semantic Correlation-Aware Masked Autoencoder for Unsupervised Audio-Visual Representation Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-13T10:41:51.251736Z"},"links":{"cited_paper":"/paper/2412.02612","citing_paper":"/paper/2604.04229"},"observation_digest":"sha256:bb3791ade5f505cbf162b4d669a4576c6213ac21493f5929deaa5216631ec215","observation_id":"f79f6af8-d026-4f35-a0cd-278bcafbacf1","resolution":{"observed_at":"2026-07-13T10:41:51.251736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05868","last_updated":"2024-10-10T22:00:41Z","snapshot_observed_at":"2026-07-06T17:57:27.510162Z","submitted_at":"2024-04-08T21:05:42Z","title":"Negative Preference Optimization: From Catastrophic Collapse to Effective Unlearning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05868","snapshot_observed_at":"2026-07-13T10:41:51.251736Z","title":"Negative preference optimization: From catastrophic collapse to effective unlearning.arXiv preprint arXiv:2404.05868, 2024b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.04229","last_updated":"2026-04-05T19:08:51Z","snapshot_observed_at":"2026-08-04T06:41:40.344211Z","submitted_at":"2026-04-05T19:08:51Z","title":"Hierarchical Semantic Correlation-Aware Masked Autoencoder for Unsupervised Audio-Visual Representation Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-13T10:41:51.251736Z"},"links":{"cited_paper":"/paper/2404.05868","citing_paper":"/paper/2604.04229"},"observation_digest":"sha256:66e5c668fe8054c6e9ab266c38a12e1fbef1ef9ae50c4c191b7e2ae3134028d0","observation_id":"ba2ca2d0-f75a-491e-82e3-6d2cc63e97bd","resolution":{"observed_at":"2026-07-13T10:41:51.251736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:41:51.251736Z","title":"Hanqing Zhu, Zhenyu Zhang, Hanxian Huang, DiJia Su, Zechun Liu, Jiawei Zhao, Igor Fedorov, Hamed Pirsiavash, Zhizhou Sha, Jinwon Lee, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.04229","last_updated":"2026-04-05T19:08:51Z","snapshot_observed_at":"2026-08-04T06:41:40.344211Z","submitted_at":"2026-04-05T19:08:51Z","title":"Hierarchical Semantic Correlation-Aware Masked Autoencoder for Unsupervised Audio-Visual Representation Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-13T10:41:51.251736Z"},"links":{"citing_paper":"/paper/2604.04229"},"observation_digest":"sha256:a45b15b8074d99dfd50aaacee11fc48698facb6069a43f078c34508df440b27b","observation_id":"4b7231da-09af-4be3-a3d2-8fbbb414c8e0","resolution":{"observed_at":"2026-07-13T10:41:51.251736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:41:51.251736Z","title":"The construction procedure follows (Zeng et al., 2024b)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04229","last_updated":"2026-04-05T19:08:51Z","snapshot_observed_at":"2026-08-04T06:41:40.344211Z","submitted_at":"2026-04-05T19:08:51Z","title":"Hierarchical Semantic Correlation-Aware Masked Autoencoder for Unsupervised Audio-Visual Representation Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-13T10:41:51.251736Z"},"links":{"citing_paper":"/paper/2604.04229"},"observation_digest":"sha256:696780420b20a3402257fceb1868baf0edacf139a2599943d1ee102b8e87fbd4","observation_id":"1eb182c2-96ae-4d46-acca-c5a53b99708c","resolution":{"observed_at":"2026-07-13T10:41:51.251736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2604.04229","last_updated":"2026-04-05T19:08:51Z","latest_version":1,"primary_category":"cs.MM","snapshot_observed_at":"2026-08-04T06:41:40.344211Z","submitted_at":"2026-04-05T19:08:51Z","title":"Hierarchical Semantic Correlation-Aware Masked Autoencoder for Unsupervised Audio-Visual Representation Learning"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":33,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 1 inbound Pith citation observation for arXiv:2604.04229."}