{"as_of":"2026-08-16T00:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:42b920911b728f4e38204b4182f564093455b07c73155bd76c5c15a19adbf52d","coverage":[{"denominator":108,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T04:44:25.836440Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.08418/citation-record","integrity":"/paper/2608.08418/integrity","json":"/paper/2608.08418/citation-record.json","paper":"/paper/2608.08418"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.234204Z","title":"Cluster analysis of multivariate data: Efficiency versus interpretability of classifications,","venue":null,"work_id":null,"year":1965},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.234204Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:cc8c0a479d2c1e27a86129fa568ec90cdc838c7faaf47037d77d06af4bf2f5d9","observation_id":"1fb95f5c-c17d-4ed9-9f63-bafbf0f055bd","resolution":{"observed_at":"2026-08-14T04:44:25.234204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.239800Z","title":"Some methods for classification and analysis of multi- variate observations,","venue":null,"work_id":null,"year":1967},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.239800Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:774432a4d26cc0d1d970915899dd9c11037815c7bb1f4e597e482399ff1fa997","observation_id":"dbefbffc-10de-4faf-880a-5fe3eda3366c","resolution":{"observed_at":"2026-08-14T04:44:25.239800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.244824Z","title":"k-means++: the advantages of careful seeding,","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.244824Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:3a939734e48e18f95d156a9e73697cc62b1112c2de391106776c4e10f9d5f0ca","observation_id":"154bd7c1-cd6e-4eb6-805e-6e7e209eb519","resolution":{"observed_at":"2026-08-14T04:44:25.244824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.250057Z","title":"Subspace clustering,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.250057Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:5594e6a31a7227bcdb89d40a343cb2e313eb2ddf9a773ab16f7c8c3bcf1ea765","observation_id":"63051331-bf8c-4fed-b030-732e6af2e43a","resolution":{"observed_at":"2026-08-14T04:44:25.250057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.254771Z","title":"Vidal, Y","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.254771Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:718341fc6577bfb063757fa614c658a84d5ee71699d63b68fc433bfa6073138b","observation_id":"594bb285-ea1a-4359-ad74-6bcd780cbd9f","resolution":{"observed_at":"2026-08-14T04:44:25.254771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.259636Z","title":"Structured sparse subspace clustering: A joint affinity learning and subspace clustering framework,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.259636Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:f8e51e79083638ecb69a8f1057dde4b963a97f9db53e45f3dfb08894a3a732eb","observation_id":"a3f68b98-9b94-43d8-9c2a-89903b1ab54b","resolution":{"observed_at":"2026-08-14T04:44:25.259636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.265089Z","title":"Kernel sparse subspace clustering,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.265089Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:7bedf611be32b4d23846f301b7af703a5ebffad42185bc17aaf859a258e652d0","observation_id":"03a797b6-9fc8-4ea5-9895-a3c48294e503","resolution":{"observed_at":"2026-08-14T04:44:25.265089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.269850Z","title":"Sparse manifold clustering and embed- ding,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.269850Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:3594851876895296eb60ac0bbe28f1391ed2997a5b3fa1b80b2de85d8d346b20","observation_id":"e28296b2-0311-4fe3-973b-e23838fc231e","resolution":{"observed_at":"2026-08-14T04:44:25.269850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.10000","last_updated":"2022-01-24T23:13:37Z","snapshot_observed_at":"2026-08-13T16:53:56.386244Z","submitted_at":"2022-01-24T23:13:37Z","title":"Neural Manifold Clustering and Embedding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.10000","snapshot_observed_at":"2026-08-14T04:44:25.274594Z","title":"Neural manifold clustering and embedding,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.274594Z"},"links":{"cited_paper":"/paper/2201.10000","citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:cdc78ee27230ecd60d71db630c063f1855c12747fd81d88ec4ef8495e2dedcee","observation_id":"3b6ae6e9-d96b-475d-a481-8e4b56089055","resolution":{"observed_at":"2026-08-14T04:44:25.274594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.279539Z","title":"Unsupervised manifold linearizing and clustering,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.279539Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:241c9efd5fb4daaee1392c6c8af570cc958eebf15302a3fc0a4b79507e69da67","observation_id":"9a90ed83-a83c-4ff0-b072-353b72be3b5a","resolution":{"observed_at":"2026-08-14T04:44:25.279539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.284028Z","title":"Gradient-based learning applied to document recognition,","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.284028Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:51d75293ff04a0118082b18e9eb442a1924a4a4651fc8c452cf88341b73874ac","observation_id":"b34a2fa8-7b5c-4e38-973e-8d6f78154f3d","resolution":{"observed_at":"2026-08-14T04:44:25.284028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.289800Z","title":"Learning multiple layers of features from tiny images,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.289800Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:528e2f34398106cabe242a9aa4bae6aaff7ff16c19b7ffb83a3c41a19f805768","observation_id":"c536172c-6e7a-4983-bc5c-4b128a298b06","resolution":{"observed_at":"2026-08-14T04:44:25.289800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.294047Z","title":"Imagenet: A large-scale hierarchical image database,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.294047Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:0849f2d9a5ba5bc572236018605d6ae10598652b58235898f46383a8b6ac1b8b","observation_id":"38802e18-d86c-463b-853b-34de4b7071bf","resolution":{"observed_at":"2026-08-14T04:44:25.294047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.298202Z","title":"A survey on deep clustering: from the prior perspective,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.298202Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:de6d6cfad00d2100a3f035703fb1777262a27706d94e15358de8ffb1d6b62b1c","observation_id":"21932a58-67a4-431c-8212-9d0347c52487","resolution":{"observed_at":"2026-08-14T04:44:25.298202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.303511Z","title":"Deep clustering: A comprehensive survey,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.303511Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:f94f0ce2baf0345de4776f1a832782f1d7899d7eb331d81f33dcea18bf2545fe","observation_id":"3b042388-7a8c-48f1-a0a3-6ade29d01396","resolution":{"observed_at":"2026-08-14T04:44:25.303511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.308790Z","title":"Deep subspace clustering with sparsity prior,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.308790Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:f24f2af0d28278273b007845e54502e489aa61ab36be90380acc6a76e807d45b","observation_id":"0a988793-51f1-4a9f-8f10-e50366b6949d","resolution":{"observed_at":"2026-08-14T04:44:25.308790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.313744Z","title":"Unsupervised deep embedding for clustering analysis,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.313744Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:1d271efa19a52552346bf7c9b90ba1bde35fc0a41252420481f9fed45d7d762d","observation_id":"c41cdc24-6f21-44b9-91ad-8df0447139c2","resolution":{"observed_at":"2026-08-14T04:44:25.313744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.318297Z","title":"Improved deep embedded clustering with local structure preservation,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.318297Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:670d9148c54e245dcfb805ee65d87299b256124b0921b6dd10743d20a84d0b78","observation_id":"27f30847-e989-42a2-b965-512e2b3d1376","resolution":{"observed_at":"2026-08-14T04:44:25.318297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.322928Z","title":"Towards k- means-friendly spaces: Simultaneous deep learning and clustering,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.322928Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:a155e6616e4ee74a94cb41a3368446b2e006c9a891a44606d6a25b02a59179f2","observation_id":"3725ab85-76bf-4941-9519-5f62741164f4","resolution":{"observed_at":"2026-08-14T04:44:25.322928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.327735Z","title":"SCAN: Learning to classify images without labels,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.327735Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:962ecbaf2cb30a2fd54f87fdf99215d6c531114a6568dad012270937efcceaf8","observation_id":"f66c3731-2232-4e74-b06c-7ceda06d6f2d","resolution":{"observed_at":"2026-08-14T04:44:25.327735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.332507Z","title":"Contrastive clustering,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.332507Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:2d889901a88660f7df932905930fb95f712a4fead0652b02ce315e752a3a9ccb","observation_id":"1a9f73b5-9435-475a-87a9-ebd018779ee0","resolution":{"observed_at":"2026-08-14T04:44:25.332507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.337187Z","title":"Graph contrastive clustering,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.337187Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:72e25decd41cd017de30f8e74231d62f43eabd05d931535f4e1a14c0780c4af5","observation_id":"57d5f23a-69fe-4774-a717-1fb0f2a57aff","resolution":{"observed_at":"2026-08-14T04:44:25.337187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.341682Z","title":"Nearest neigh- bor matching for deep clustering,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.341682Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:94885c8416b80afd47c3085b737056123df99236a6d0f030e67d2f8c71edf16a","observation_id":"31081883-35ea-4436-ab5e-595b81a066f6","resolution":{"observed_at":"2026-08-14T04:44:25.341682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.346239Z","title":"SPICE: Semantic pseudo-labeling for image clustering,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.346239Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:e2a8a506f749408cfcce7f1927ba36a2687367639888f98546c995439d14f930","observation_id":"57d3a438-4bf3-4a8c-b49f-19f2dacd7843","resolution":{"observed_at":"2026-08-14T04:44:25.346239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.350777Z","title":"Exploring the limits of deep image clustering using pretrained models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.350777Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:be26f6fa86a23d56be23543645a765a6049fdd287332952881da06eaaa29eebd","observation_id":"a2446c52-b183-4ecc-aef9-4212d1ea5a72","resolution":{"observed_at":"2026-08-14T04:44:25.350777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.355480Z","title":"Semantic-enhanced image clustering,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.355480Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:21e045a000d970835f6f7b3e0a330b30f51f35bf547b417e5642775a83b998f1","observation_id":"cbd3ca47-6797-48b5-84ab-5feaad2392fa","resolution":{"observed_at":"2026-08-14T04:44:25.355480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.360920Z","title":"Image clustering via the principle of rate reduction in the age of pretrained models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.360920Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:083f3dba632e844d202a6bdf48f139c0c0db7f81cc42ae10b55424d4445c0f26","observation_id":"d563a94a-14ee-4d9b-a0a0-9f97bdc78bdb","resolution":{"observed_at":"2026-08-14T04:44:25.360920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.366385Z","title":"Image clustering with external guidance,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.366385Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:ef592d0a9b6d4940ae51bc920aea6a371f64b44ce6a656a5696454cd7beb90da","observation_id":"11ae8765-1dd0-4359-8a0f-cf3107b722a3","resolution":{"observed_at":"2026-08-14T04:44:25.366385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.373181Z","title":"Leveraging cross-modal neighbor representation for improved clip classification,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.373181Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:f16d684b7bec83c432cc7af13b067c1df370540e8ae919f0cadda3e1791d1850","observation_id":"db13c356-0dcb-41d5-81c1-b654b3ca4270","resolution":{"observed_at":"2026-08-14T04:44:25.373181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:27.496592Z","title":"Cross the gap: Exposing the intra-modal misalignment in clip via modality inversion,","venue":null,"work_id":"25f781c9-eb76-4c6d-955c-a282f75400f3","year":2025},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.378749Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:8496ab9c4420fb006e44243ba4ffeeeeacba97b4384fb0bb7cf2b392fcf7a5ba","observation_id":"333c3ea2-2694-498b-a6f4-3f2111f5d5fb","resolution":{"observed_at":"2026-08-14T04:44:27.502546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:27.473597Z","title":"Quantifying & modeling multimodal interactions: An information decomposition framework,","venue":null,"work_id":"c47f9b26-4194-4d9d-8d16-3b566b544106","year":2023},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.386644Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:942b21e95881a826e627d7608b7c3551c3025d0034af06f5b7f4bfd467364b05","observation_id":"40d0e557-66f9-4dce-a6a3-7b177ee15d06","resolution":{"observed_at":"2026-08-14T04:44:27.479945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:27.453904Z","title":"Foundations & trends in multimodal machine learning: Principles, challenges, and open questions,","venue":null,"work_id":"14851f1a-4bf9-4796-8053-7c8d1951af87","year":2024},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.392449Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:53b046a062c85a8edc53652f53024df6d7e3fd2299cf9c59e9c7918193d6622b","observation_id":"64c322fd-e1d9-4e9d-85f7-11312a5700bb","resolution":{"observed_at":"2026-08-14T04:44:27.460738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.397461Z","title":"Mind the gap: Understanding the modality gap in multi-modal contrastive representation learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.397461Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:1355eaa929dd370b85ae7841ec61f026cf5e543bf0d5f9898982fd13cf464742","observation_id":"95dc37bf-c143-40d9-b62b-418e34b14b3d","resolution":{"observed_at":"2026-08-14T04:44:25.397461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:27.414233Z","title":"Two effects, one trigger: On the modality gap, object bias, and information imbalance in contrastive vision-language models,","venue":null,"work_id":"48f04870-96bb-43c5-a09f-cec05224efd9","year":2025},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.404165Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:8f4debc9b437268f00d652b529d53baa89e90bcaa69b3c5dfb1f88e9fa7f13e1","observation_id":"356fee10-f69c-423a-87e2-381c83013c13","resolution":{"observed_at":"2026-08-14T04:44:27.421686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:27.395001Z","title":"Position: the platonic rep- resentation hypothesis,","venue":null,"work_id":"91cce8a3-d1e5-4c4f-9083-10b432796a0e","year":2024},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.409375Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:e98124e1580ce62c4c90305d81f553f15a04dbb0066d2cff48e77452133c769a","observation_id":"98182cc1-b9c7-4820-942b-024d2f60c360","resolution":{"observed_at":"2026-08-14T04:44:27.400118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:27.377879Z","title":"Understanding the emergence of multimodal representation alignment,","venue":null,"work_id":"316566e8-66b3-4578-b7ae-d94180551ac4","year":2025},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.414508Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:c6680dc80d0e14033da764feec7c75e70439343dec38d7c4b8657ed324da5a75","observation_id":"3a011144-5e2d-40b2-8bed-b0c909e1e020","resolution":{"observed_at":"2026-08-14T04:44:27.383087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.14486","last_updated":"2026-06-25T06:33:52Z","snapshot_observed_at":"2026-08-15T15:50:15.548685Z","submitted_at":"2026-02-16T06:01:23Z","title":"Revisiting the Platonic Representation Hypothesis: An Aristotelian View","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.14486","snapshot_observed_at":"2026-08-14T04:44:25.420442Z","title":"Revisiting the platonic representation hypothesis: An aristotelian view,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.420442Z"},"links":{"cited_paper":"/paper/2602.14486","citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:16db17472959c7fa0709e475d27c145ebcea2c25fad2d81c362a691a6eea8189","observation_id":"68eb8321-6718-4ec1-940d-de5960a7b2ee","resolution":{"observed_at":"2026-08-14T04:44:25.420442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:27.357356Z","title":"Emergence of separable manifolds in deep language representations,","venue":null,"work_id":"d3740c4b-ecc4-419a-a0ee-6f382a7b2894","year":2020},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.429446Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:0fbaea5e058817158486bc3618616f095b18d1bd5bb8e2bccaa2c25abd77e484","observation_id":"99f3b559-9771-4db1-b502-5a59903a629e","resolution":{"observed_at":"2026-08-14T04:44:27.363958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:27.337241Z","title":"Exploring the common principal subspace of deep features in neural networks,","venue":null,"work_id":"e555ceed-093b-4dc9-9d1d-ab25985882c5","year":2022},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.435257Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:b95f7626c2e298c8a4ef4cc6f4ffc6dfb40f98b9ce33b331095fa3979986097b","observation_id":"90b054a8-6c10-4495-82e0-34bdee4d4f93","resolution":{"observed_at":"2026-08-14T04:44:27.344855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:27.307322Z","title":"Verifying the union of manifolds hypothesis for image data,","venue":null,"work_id":"93b81054-bc88-4369-b13b-3b5d740a8ec3","year":2023},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.440689Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:8c593b803b79821686bee1999a422f91f5dd16d02e2ac8ec6314f3c2cd43ff0a","observation_id":"008d6cae-8099-4909-bdad-fcc6fa1bb239","resolution":{"observed_at":"2026-08-14T04:44:27.319485Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:27.283574Z","title":"Linear spaces of meanings: compositional structures in vision- language models,","venue":null,"work_id":"d6b7dcdd-2f4f-4f7d-ad2f-5f6214e15260","year":2023},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.446403Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:aeb8b2b4ddd0e11c91ad61da5128a149363681d3bbfe27039bb52f75abdeafff","observation_id":"f235a9ff-9564-4929-930b-64c864b4316b","resolution":{"observed_at":"2026-08-14T04:44:27.289931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:27.258112Z","title":"Approximating latent manifolds in neural networks via vanishing ideals,","venue":null,"work_id":"432860e1-a2ef-4dcf-bd7f-fd3f7bf8487e","year":2025},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.453022Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:e69c11da17a90b64a5f3a1dedc7df69373f34d8ba12fcc21d119493a7b343d85","observation_id":"06c43a6a-c3f2-49cb-a36a-94e945c9fbaf","resolution":{"observed_at":"2026-08-14T04:44:27.263991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:27.236690Z","title":"A simple frame- work for contrastive learning of visual representations,","venue":null,"work_id":"3f276f1d-7593-426e-9a80-2a1dc62a85f8","year":2020},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.459038Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:9b9e83f3f4d926e31a1d68ed0c6d04ffe61d8ba50e510861ff67750fe1f592eb","observation_id":"0dd02c1d-7f63-4411-9ebd-18f38f955e09","resolution":{"observed_at":"2026-08-14T04:44:27.243560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.471443Z","title":"Momentum contrast for unsupervised visual representation learning,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.471443Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:4288e663f2bc7138f5263e1048aa7704009c6b860590a52428d5228546a5db8c","observation_id":"91dfd5b4-e198-40e7-9aec-d0fa017bbba2","resolution":{"observed_at":"2026-08-14T04:44:25.471443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:27.195753Z","title":"Unsupervised visual represen- tation learning by online constrained k-means,","venue":null,"work_id":"a8db64a6-3496-4ade-94fb-2c3da474bf90","year":2022},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.480553Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:9294fe47013362a30b02ab17875ada8663bb4845aefed79a509cfcb758a81385","observation_id":"ebfd0c01-a3e7-4233-b5ad-cc9e36d2962b","resolution":{"observed_at":"2026-08-14T04:44:27.201998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:27.176227Z","title":"Stable cluster discrimination for deep clustering,","venue":null,"work_id":"b11287c1-298d-4a30-a4b1-320fe1dbbafe","year":2023},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.491523Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:6d0d9d99f1c204c26abc7dc4863223e487b126249a38ce26c6036b752787d08f","observation_id":"d1bc89df-000d-4941-842d-3a0be74a05b3","resolution":{"observed_at":"2026-08-14T04:44:27.181894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:27.157153Z","title":"Learning representation for clustering via prototype scattering and positive sampling,","venue":null,"work_id":"c585d992-b682-4b64-aafd-10104cd79c44","year":2023},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.498640Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:edc6c90842c5416e79127df86cc0ddba052dfac76c5fa97bd90c55b8bfde9a89","observation_id":"50c38b54-9131-40b6-b62f-4b5501c65b14","resolution":{"observed_at":"2026-08-14T04:44:27.163102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:27.131644Z","title":"Contextually affinitive neighborhood re- finery for deep clustering,","venue":null,"work_id":"6405a874-363c-4fbb-a61a-d0776ce0b188","year":2023},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.504957Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:fd8f6d141055680a6c584422ae39ae49141dc88af437f2ebb65480529dac7e95","observation_id":"a2ecb637-922e-4e1f-b758-9735860f5ac1","resolution":{"observed_at":"2026-08-14T04:44:27.143224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:27.107528Z","title":"Contrastive multiview coding,","venue":null,"work_id":"c3363a35-0493-4605-8e1a-ab5aefc5e526","year":2020},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.510199Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:5af2f39fad091387681e85964594fcfdb0bef30f8777b804056a3b4f4d60ac63","observation_id":"0c8cb96a-25e1-4b3d-b3e2-214c87ec3e14","resolution":{"observed_at":"2026-08-14T04:44:27.116040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:27.082829Z","title":"Completer: Incomplete multi-view clustering via contrastive prediction,","venue":null,"work_id":"ada2676f-0b4a-409c-ab25-c48c7ae9916e","year":2021},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.516134Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:658393e30830b86cca5cb38fa63a96668f723e6cad1b1d7c9b094661e50b1c7b","observation_id":"e81f0199-ec1c-4e79-894b-79536619dbab","resolution":{"observed_at":"2026-08-14T04:44:27.092318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:27.061810Z","title":"Multi-view contrastive graph clustering,","venue":null,"work_id":"57a2157f-f253-420e-a2c4-f9b1bdc08709","year":2021},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.522039Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:a48bc49947e5aba4bc07cdb0398b3fc62baf49e6f476d1cde0af4fc170bfd5e8","observation_id":"45229f53-5af5-4310-b0e9-e234d303f23a","resolution":{"observed_at":"2026-08-14T04:44:27.068571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:27.038553Z","title":"Re- considering representation alignment for multi-view clustering,","venue":null,"work_id":"f2503448-7ce7-4cfb-b299-9a0285e3d34f","year":2021},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.528952Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:5b74785b7d57999401cc1f7d17597c7b0fa082103643872fa8494b6809940fe6","observation_id":"b244d0c2-d564-4608-b7ae-a685411149e3","resolution":{"observed_at":"2026-08-14T04:44:27.048435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:27.004861Z","title":"Robust multi-view clustering with incomplete information,","venue":null,"work_id":"93ab26d7-d501-4571-8601-9cc176140731","year":2022},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.534352Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:cf331dfb2019e6353b803dd8c4360a8cc7b4b81d108d40ec6523b9f36ff759ae","observation_id":"425c95d0-01b5-4f1f-b1f0-cfd97ad0bc91","resolution":{"observed_at":"2026-08-14T04:44:27.014275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:26.982875Z","title":"Gcfagg: Global and cross-view feature aggregation for multi-view clustering,","venue":null,"work_id":"c37448e7-8873-479a-a57f-0dad59cfda73","year":2023},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.539977Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:09e34f04feb1ba5af481f49ddf5e9cc1054e406bce0a8171739267570e80a73d","observation_id":"44f1731a-8f74-4969-934d-d670af11efcd","resolution":{"observed_at":"2026-08-14T04:44:26.991118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:26.955520Z","title":"Decoupled contrastive multi-view clustering with high-order random walks,","venue":null,"work_id":"a1cb4382-731f-493f-9a77-0e1595bb2da3","year":2024},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.545979Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:c63041c11478f677ce085a34ac89e59c70f7ad6c3b3dfa9f5103a3559f40f8a4","observation_id":"2d3a5cdd-3c40-4bbe-9612-22ad77ee2c63","resolution":{"observed_at":"2026-08-14T04:44:26.963592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:26.925146Z","title":"Robust contrastive multi-view clustering against dual noisy correspondence,","venue":null,"work_id":"caa3264a-a890-4f93-ae86-27f8c8f0b94c","year":2024},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.553101Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:a6fbd33eca01c334e11d1bc4a37d399fea0ffb7b10376b0a4355b622b709bda0","observation_id":"5253507a-2173-49ef-95ac-3e3717431cab","resolution":{"observed_at":"2026-08-14T04:44:26.935070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:26.890816Z","title":"Multi-level cross-modal align- ment for image clustering,","venue":null,"work_id":"99e4d03f-8bec-426f-b047-8e27fa554dab","year":2024},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.559582Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:7e13a29ad7a3c15daea4964f15da2cf9029c8d54777924fce4f3844aa158b848","observation_id":"9374a741-5263-40e0-b697-135fca3f29bb","resolution":{"observed_at":"2026-08-14T04:44:26.901231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:26.866864Z","title":"Hierarchical semantic alignment for image clustering,","venue":null,"work_id":"6a9dd396-2bf6-494d-ad24-bf155c69f8b7","year":2026},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.566222Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:a141d0137139f3c120e2270b5af6564433eb316c4a4d479db73be8f38b32aa49","observation_id":"97a46a02-c4b6-4b9e-b71e-f2b4246c919d","resolution":{"observed_at":"2026-08-14T04:44:26.872869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:26.844646Z","title":"On the provable importance of gradients for autonomous language-assisted image clustering,","venue":null,"work_id":"2376e776-1977-48bc-88d5-353345627928","year":2025},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.571627Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:003b65c9955760cacbb15868436404da1683cba3a1a28df3f36ef2e50f649d96","observation_id":"a8e01860-c616-441e-a10c-538bfba89eaf","resolution":{"observed_at":"2026-08-14T04:44:26.850406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:26.826419Z","title":"Sparse subspace clustering,","venue":null,"work_id":"27283f89-a343-4c53-915f-7c8cd381d50f","year":2009},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.576463Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:ce9b44b3e5a43bdededb525435ec0523c5034e90e1838448e18ec30075c1ee7f","observation_id":"16abc9b1-082f-47d9-9e18-b695b25ca7dc","resolution":{"observed_at":"2026-08-14T04:44:26.831704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:26.805561Z","title":"Robust subspace segmentation by low- rank representation,","venue":null,"work_id":"89df4f8a-2583-449e-9bd8-0fd084eab94c","year":2010},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.581752Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:91485b0b4e296e8260972ac81b459534a18f8a6001fb8b033738b90d96a24d53","observation_id":"7ea1f845-66ef-4249-aee5-db1abdb99a59","resolution":{"observed_at":"2026-08-14T04:44:26.812711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.587146Z","title":"Sparse subspace clustering: Algorithm, theory, and applications,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.587146Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:89d8c08d9a823d39c79e268eb3f56001c70537745fa5e980875f136c42d2cb69","observation_id":"10fec468-6579-4258-8e68-9a13e149f0f6","resolution":{"observed_at":"2026-08-14T04:44:25.587146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:26.761181Z","title":"A geometric analysis of subspace clustering with outliers,","venue":null,"work_id":"3442b824-f304-4b87-93ad-bb7ac1dbcd17","year":2012},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.592006Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:692572ff4385a5e1340fb6d61a2b68dd10bd77882aa24d1ebf63317ca6a514bf","observation_id":"41c634ec-38fc-4f03-b3f4-61d80aced7ab","resolution":{"observed_at":"2026-08-14T04:44:26.768204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.599011Z","title":"On geometric analysis of affine sparse subspace clustering,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.599011Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:e4fdc8c895395e834e2ad03f5e365e95d7ab6bbd17cc2edd1abb87ea69005a11","observation_id":"0883f055-29ee-4f9a-9005-ae490c8f4689","resolution":{"observed_at":"2026-08-14T04:44:25.599011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.605201Z","title":"Normalized cuts and image segmentation,","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.605201Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:25310264e1d53d16dc5c6d40d4ab8241a001ae436732f9fb65d42bcc8cad53ee","observation_id":"94dce9e6-f595-43b5-9698-28cb9b23914d","resolution":{"observed_at":"2026-08-14T04:44:25.605201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:26.713204Z","title":"Oracle based active set algorithm for scalable elastic net subspace clustering,","venue":null,"work_id":"fd583081-8949-4d2a-98d9-be47809d17de","year":2016},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.611873Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:6cadb11a7c23fcf6f4535e8bea1d0cc325de957eaff9649b671b3f1c615171da","observation_id":"dbc8d6dc-ecb2-43c8-a446-253aac5e6eba","resolution":{"observed_at":"2026-08-14T04:44:26.719928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:26.690794Z","title":"Stochastic sparse subspace clustering,","venue":null,"work_id":"73adfe53-1712-4ac6-8f68-1a0f3876e1e8","year":2020},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.620212Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:b6c3db02665dae951daa95d23271f2b5dbb9bec33dc6b02db9904656ecf3074a","observation_id":"ef9d9cc3-b9fa-467b-9db5-50269643a90e","resolution":{"observed_at":"2026-08-14T04:44:26.697224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:26.670320Z","title":"Learning a self-expressive network for subspace clustering,","venue":null,"work_id":"2098e2e0-5229-4123-8742-7c9da78102b5","year":2021},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.640085Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:4fd31d0425e1f4c857229423822df3e4a31dc5f69653a36e57c9127cef0a383a","observation_id":"f2a26fec-4b4c-4c82-bbdf-5dee0a3b2432","resolution":{"observed_at":"2026-08-14T04:44:26.675624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:26.647499Z","title":"Graph convolu- tional subspace clustering: A robust subspace clustering framework for hyperspectral image,","venue":null,"work_id":"d93d9ad4-cc72-497d-9480-688684ecb218","year":2020},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.648743Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:780a4c4339826ace8e18dae72b63588c08bf2821a9e60f201d940a2c9c4a67ec","observation_id":"36380051-8252-4f68-accb-0908fe06d36a","resolution":{"observed_at":"2026-08-14T04:44:26.655357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:26.627398Z","title":"Towards clustering- friendly representations: Subspace clustering via graph filtering,","venue":null,"work_id":"20362e36-396b-4dd9-932a-79d01edbd8d2","year":2020},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.657268Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:2146a9c4f9ecd5d07bee0532d52e0c8d1f529a9dab10ef73ba642bd1f5eec589","observation_id":"86a54bc1-fe52-4b34-b6f7-f4c709da2da0","resolution":{"observed_at":"2026-08-14T04:44:26.632959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.662437Z","title":"Adaptive graph convolutional subspace clustering,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.662437Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:532eaaaae190bddd5f35b2b6296837104668ee95b228bfb217a9d06425e9d084","observation_id":"205844c8-cd83-40d0-aeee-753a72bc60ca","resolution":{"observed_at":"2026-08-14T04:44:25.662437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.668002Z","title":"Exploring a principled framework for deep subspace clustering,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.668002Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:48e89adcb25f5fb554364869bf39d07cc590a66f0bcb6b1b6bc744c2040f75f7","observation_id":"5d6fbbee-2f31-48df-9904-606428713cbd","resolution":{"observed_at":"2026-08-14T04:44:25.668002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.674261Z","title":"Deep self-expressive learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.674261Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:167e6ae4eaced652c7e2b79fe05938bef9745f09f43a7669aa5a3ace5d7d8992","observation_id":"510c83b0-0dc2-43f1-b009-a40068f9ad96","resolution":{"observed_at":"2026-08-14T04:44:25.674261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:26.576221Z","title":"Attention: Self-expression is all you need,","venue":null,"work_id":"a6648988-fd8e-4c93-a6f2-54c05a2f4477","year":2025},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.679610Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:fb059e866303f0d62fc51240fec0b2e36fe4e93f6e124d8d34a330c653383f99","observation_id":"b287ad08-e439-4bcb-8e20-c273036ed72e","resolution":{"observed_at":"2026-08-14T04:44:26.582073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:26.556023Z","title":"OLE: Orthogonal low- rank embedding - a plug and play geometric loss for deep learning,","venue":null,"work_id":"14fea17a-d2bc-48c8-b9dc-e92097771031","year":2018},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.684723Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:3b3948826e7f7578969c700d01ef72f39b024611fd45142840c5f5200b4d79e6","observation_id":"5a0c5052-e7c4-4917-b75a-7604843b2d1d","resolution":{"observed_at":"2026-08-14T04:44:26.562998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:26.538441Z","title":"Learning diverse and discriminative representations via the principle of maximal coding rate reduction,","venue":null,"work_id":"73bbd8ab-55ec-48b7-98bf-79bbaf6d58ca","year":2020},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.690139Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:6e73b17f5135214134d23fcd2fc807e085d92c5da14915247ac8f2e84a3737d9","observation_id":"63b2b935-9d17-486c-b50d-0f7b26b39c13","resolution":{"observed_at":"2026-08-14T04:44:26.543945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.695162Z","title":"A global geometric analysis of maximal coding rate reduction,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.695162Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:a8fffdee4bb1288920897ab78cc16f6b108be4e070a3584997d8657b06543d6b","observation_id":"70cec3ad-3961-47fe-a637-871a98a7e003","resolution":{"observed_at":"2026-08-14T04:44:25.695162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.700078Z","title":"A critique of self-expressive deep subspace clustering,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.700078Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:dbfb43d625e65c4daf63a2200efa7dbfff1157dd74a634c860740ed5fad8eb78","observation_id":"7575a1d2-bf10-403e-9c4e-84870ad94715","resolution":{"observed_at":"2026-08-14T04:44:25.700078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:26.482050Z","title":"When is “near- est neighbor","venue":null,"work_id":"7d222284-177e-4b40-aeb0-9b72ce4d3a9d","year":1999},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.706343Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:052696aeba03876975be32ef48cf68842486faf296c19b4538c919562aef51c6","observation_id":"3676b0f0-04d9-4071-b00e-e196f4493812","resolution":{"observed_at":"2026-08-14T04:44:26.486846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:26.465370Z","title":"On the surprising be- havior of distance metrics in high dimensional space,","venue":null,"work_id":"f55af139-b059-4c67-aa18-2c8092a842f3","year":2001},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.711761Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:373802780164465d927b12cae2e24725e0f7cd1973fa0b5ac5afee88b8ee8483","observation_id":"94f9f606-e5ed-437e-bb35-18d95191e3de","resolution":{"observed_at":"2026-08-14T04:44:26.471060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:26.447869Z","title":"Think globally, fit locally: Unsupervised learning of low dimensional manifolds,","venue":null,"work_id":"78036122-6968-485b-b1ab-018895b6cdbf","year":2003},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.716789Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:4cda3ab27731b3a4dfdee5c27a18f11e3598e6aef7aae9b19a868d041a9776cf","observation_id":"86244ca9-c513-454f-b08a-ebccb17df0d0","resolution":{"observed_at":"2026-08-14T04:44:26.453321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.723022Z","title":"Wright and Y","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.723022Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:94dd12c0caba99eae80d75649655d2e3471e046eedd95837fb726ec9361b6346","observation_id":"37727ffb-75cc-4ebb-bd3c-1a4d97cff3a6","resolution":{"observed_at":"2026-08-14T04:44:25.723022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.728868Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.728868Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:d38fe10e38c26030f1ff2a3b7b21a3f1b679fe49e37156279e11a7068b5124c4","observation_id":"c76b9720-baa3-4235-a556-3cb199d81422","resolution":{"observed_at":"2026-08-14T04:44:25.728868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:26.408904Z","title":"Matching pursuits with time-frequency dictionaries,","venue":null,"work_id":"36ad6dca-567f-4f22-b2da-b7046a232197","year":1993},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.734301Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:4819cdd0854c1d1ebfcc32587e611043ae38513ef66b04dd12f7763c0e64b232","observation_id":"afbc3936-b3e5-48b1-a657-b80a61d530d3","resolution":{"observed_at":"2026-08-14T04:44:26.414627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.740107Z","title":"Unsupervised learning of visual features by contrasting cluster assign- ments,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.740107Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:87314327dca85b722e2acc69ab0dd35de1cf74e670b6319324507d5d45454349","observation_id":"953db7af-0e2f-43cf-8637-cea41b1a6e5f","resolution":{"observed_at":"2026-08-14T04:44:25.740107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:26.375602Z","title":"Understanding doubly stochastic clustering,","venue":null,"work_id":"77c9691b-0835-4013-8d13-074bdb9c6ab8","year":2022},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.744936Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:e5d542956e176d8aaa190cecdc0ba31224ef39541a26ae6f66aa63497849c26b","observation_id":"be042f59-b836-4772-9a39-5e20792ea2d2","resolution":{"observed_at":"2026-08-14T04:44:26.381922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:26.355891Z","title":"Sinkhorn distances: Lightspeed computation of opti- mal transport,","venue":null,"work_id":"421da3eb-f72d-43af-b71c-99d7bdeb4984","year":2013},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.749701Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:fd9862b1070d2ac3884bc1a98c51f81b96dd5128260dc48d068376a67848a46f","observation_id":"4aa31857-4340-4caf-9e29-ec1b34877be5","resolution":{"observed_at":"2026-08-14T04:44:26.361841Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.24880","last_updated":"2026-01-05T16:51:18Z","snapshot_observed_at":"2026-08-03T01:54:33.526522Z","submitted_at":"2025-12-31T14:16:26Z","title":"mHC: Manifold-Constrained Hyper-Connections","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.24880","snapshot_observed_at":"2026-08-14T04:44:25.754173Z","title":"mHC: Manifold-constrained hyper- connections,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.754173Z"},"links":{"cited_paper":"/paper/2512.24880","citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:3cd372dd48cb450969a34cbe88edbef5ee10649c5aca9809749a5e577ca17e10","observation_id":"c9b9a1a5-d18c-4ff4-b5cb-8f16899a29f6","resolution":{"observed_at":"2026-08-14T04:44:25.754173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:26.339128Z","title":"Deep adaptive image clustering,","venue":null,"work_id":"7e05a8f7-298b-4742-92b3-271742028cfd","year":2017},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.759141Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:acc9e573738bec7d8cb98a21fdc0e3db279f0282056db9f0ba5dc7653b591bd6","observation_id":"089837b8-7929-4243-a7f3-46add83027c2","resolution":{"observed_at":"2026-08-14T04:44:26.344221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:26.322718Z","title":"Describing textures in the wild,","venue":null,"work_id":"0c8bd576-76f1-4f4f-80da-e10abede6682","year":2014},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.765200Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:24a2c7f126101c9d701f5ef84438606b4bc8d18de88d6f68be56754c7dfad962","observation_id":"253bd684-59eb-4519-aded-97d791dcdc5a","resolution":{"observed_at":"2026-08-14T04:44:26.327925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-08-15T13:34:03.745436Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-14T04:44:25.777748Z","title":"Ucf101: A dataset of 101 human actions classes from videos in the wild,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.777748Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:4abe2b3e377d77a0fa3fc714493467c7aa6b1cbb928103ec9dd4e1b106d94126","observation_id":"1ca703c0-e132-4d2a-9785-092ccc1165a6","resolution":{"observed_at":"2026-08-14T04:44:25.777748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:26.304683Z","title":"Segmentation of multivariate mixed data via lossy data coding and compression,","venue":null,"work_id":"9e863047-5c35-4b82-9c27-91c151771e45","year":2007},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.786539Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:842307b292dd633b6af9e28034f84087c461a2fb050529340386980e67c1eada","observation_id":"7e4bb4a5-ee3a-46cc-a7a0-dda3fe5cdc85","resolution":{"observed_at":"2026-08-14T04:44:26.310751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:26.283159Z","title":"COPER: Correlation- based permutations for multi-view clustering,","venue":null,"work_id":"1dbb6725-bbbb-4e39-a1f7-8eace1738d9f","year":2025},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.792966Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:9e3177ac96d0ea6f15ed2231520f938e3f44c6392942af79aa5c322bb7db93fa","observation_id":"50234464-96f3-4930-9f2c-3832ff847a83","resolution":{"observed_at":"2026-08-14T04:44:26.290125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:26.267125Z","title":"Tip-adapter: Training-free adaption of clip for few-shot classification,","venue":null,"work_id":"1c75c4db-83a6-4509-8891-dbc86e2df2d4","year":2022},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.800140Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:b9f34fd37df68f8b57b67cac15713d71df0dabfc1e9acc43ba3c6b764e008167","observation_id":"f7cbb2f5-17c2-4897-a77a-fb6036579c80","resolution":{"observed_at":"2026-08-14T04:44:26.272443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.806019Z","title":"Test-time prompt tuning for zero-shot generalization in vision-language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.806019Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:2b3f82ab646e22aed1f12b85a67bfe612d64fc5472ae1a7fa397f30f27faecdd","observation_id":"927481bf-3ef9-4a73-8309-8126f4afea2e","resolution":{"observed_at":"2026-08-14T04:44:25.806019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.811703Z","title":"Diverse data augmentation with diffusions for effective test-time prompt tuning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.811703Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:10232e91527eb2be2472539b8492f7846198b60485b5fc95d44fdd1c00c4b379","observation_id":"5ce93efe-a606-47ed-a05d-7e1700effb5e","resolution":{"observed_at":"2026-08-14T04:44:25.811703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:26.227564Z","title":"Dual memory networks: A versatile adaptation approach for vision-language models,","venue":null,"work_id":"51a7c33d-5732-403b-a84f-16fc9dbf932d","year":2024},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.817542Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:e1d1c6dac7d9ae68de194692e9335f70be5a8c5dd7f2c062f558a645a06161f5","observation_id":"6136fcfc-3771-4305-b381-bd96b4cc14df","resolution":{"observed_at":"2026-08-14T04:44:26.232382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:25.823271Z","title":"Efficient test-time adaptation of vision-language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.823271Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:a14f4547837903357e83cdb131dc309dbfb33e596a725b02360a612273c2c810","observation_id":"7febcadd-a4b9-42bb-8b59-8908432a5a90","resolution":{"observed_at":"2026-08-14T04:44:25.823271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:26.194221Z","title":"Label propagation for zero-shot classifi- cation with vision-language models,","venue":null,"work_id":"12dc18a9-cf5f-4adf-82d9-024f282498df","year":2024},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.828936Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:0dc516a53973a6abf07b3eea4d5689c4fde076fe54764cb2024357ea76476793","observation_id":"28cb9c06-db95-48f7-8321-6a1797056ec2","resolution":{"observed_at":"2026-08-14T04:44:26.200801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:44:26.176739Z","title":"Efficient and context- aware label propagation for zero-/few-shot training-free adaptation of vision-language model,","venue":null,"work_id":"9c07ef32-eb10-48b3-aa9d-3b302851eaf5","year":2025},"citing_paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-14T04:44:25.836440Z"},"links":{"citing_paper":"/paper/2608.08418"},"observation_digest":"sha256:acd2703f3228898eef02458b290f0db8a7775b2362451f56de5421e0c813eaa9","observation_id":"17461c39-c4d1-401e-97a2-6fd6c35620ea","resolution":{"observed_at":"2026-08-14T04:44:26.182151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.08418","last_updated":"2026-08-09T02:23:49Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T00:05:42.707157Z","submitted_at":"2026-08-09T02:23:49Z","title":"Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":48,"verified_exact":0,"verified_fuzzy":52},"total_outbound_references":108},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 100 of 108 outbound references and 0 inbound Pith citation observations for arXiv:2608.08418."}