{"as_of":"2026-08-09T06:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e5d4a211c5bdfb97ac1287cf5218cc787648e75b0754c26deda09743d702e55d","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:26:57.657461Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.18193/citation-record","integrity":"/paper/2506.18193/integrity","json":"/paper/2506.18193/citation-record.json","paper":"/paper/2506.18193"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2105.04906","last_updated":"2022-01-28T12:23:37Z","snapshot_observed_at":"2026-07-06T11:08:17.373935Z","submitted_at":"2021-05-11T09:53:21Z","title":"VICReg: Variance-Invariance-Covariance Regularization for Self-Supervised Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.04906","snapshot_observed_at":"2026-08-06T23:26:57.450855Z","title":"Vicreg: Variance-invariance-covariance regularization for self-supervised learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.450855Z"},"links":{"cited_paper":"/paper/2105.04906","citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:170ec2c8d9d8680cb08c54b41c40d4df2b330aa9fe5638248a80da710cc298aa","observation_id":"c388f0b2-1b06-4380-8cf2-6d23c7125f04","resolution":{"observed_at":"2026-08-06T23:26:57.450855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.316845Z","title":"A simple framework for contrastive learning of visual representations","venue":null,"work_id":"1c82dac1-19a9-448e-bc52-347f0088bc13","year":2020},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.456545Z"},"links":{"citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:3f4250b752ee6eab9b74af57e6247b70b74b6cda0a92280d7a5a488f8b07c6da","observation_id":"be30775a-80c1-4fa4-a002-b92f26803bb2","resolution":{"observed_at":"2026-08-06T23:26:58.322084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.462358Z","title":"Exploring simple siamese representation learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.462358Z"},"links":{"citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:c7f17211c46d077427be742ead78c46830907546237fda16fdc36838636a5f97","observation_id":"7a0c6306-74e8-4d03-bce5-83dbc06ea3c1","resolution":{"observed_at":"2026-08-06T23:26:57.462358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.04297","last_updated":"2020-03-09T17:56:49Z","snapshot_observed_at":"2026-07-06T09:03:25.467987Z","submitted_at":"2020-03-09T17:56:49Z","title":"Improved Baselines with Momentum Contrastive Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.04297","snapshot_observed_at":"2026-08-06T23:26:57.467697Z","title":"Improved baselines with momentum contrastive learning","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.467697Z"},"links":{"cited_paper":"/paper/2003.04297","citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:843a018a990b9a09cbbe9924eeec00f9a69125f3e17bb38bbd2a55941e8f4fca","observation_id":"784545d4-a8b4-4037-8080-9da872fa051b","resolution":{"observed_at":"2026-08-06T23:26:57.467697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.472885Z","title":"Cover and Joy A","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.472885Z"},"links":{"citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:d3b19379c67144c03ae0905418dea1486adea68cefa0bfa065d4e5eafbed3ea9","observation_id":"32e81805-7175-4a6d-b78e-1a813abbfcc7","resolution":{"observed_at":"2026-08-06T23:26:57.472885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.477781Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.477781Z"},"links":{"citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:eb2f18a11252674ae8ae586403001bf365008a6544f96c7724bd6fe0912f4b1e","observation_id":"08b738f5-a120-4607-9dc8-5670e287677a","resolution":{"observed_at":"2026-08-06T23:26:57.477781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.488270Z","title":"Momentum contrast for unsupervised visual representation learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.488270Z"},"links":{"citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:99b539d8a8de17d2124f6c30ef490869f0a0cd9ed45eaa4ae8598b7efb9265e1","observation_id":"d0a78dba-7271-4fda-bf92-07a8f3786f66","resolution":{"observed_at":"2026-08-06T23:26:57.488270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.258357Z","title":"Realizing synchronized parameter updating, dynamic layer accumulation, and forward shortcuts in supervised contrastive parallel learning","venue":null,"work_id":"be57233d-b814-4bbe-bffb-87a6fa742ca5","year":2022},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.493838Z"},"links":{"citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:dc50ff667b60705f51e33387d75522463e1f4720ccdf41e27f41ce2c34546a2c","observation_id":"e82299ff-2db8-4652-b5f2-fdeed3903fee","resolution":{"observed_at":"2026-08-06T23:26:58.263815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.240849Z","title":"The vanishing gradient problem during learning recurrent neural nets and problem solutions","venue":null,"work_id":"b331e272-f6c1-4b6b-bb96-d5d09757c527","year":1998},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.498485Z"},"links":{"citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:de34cb53156554126c5c29665a5080e03d2dc7d9d2a8abbda42a055a81bb2ff3","observation_id":"4dcd5582-e147-4f6c-b586-29347b88fb07","resolution":{"observed_at":"2026-08-06T23:26:58.247747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.503717Z","title":"Gpipe: Efficient training of giant neural networks using pipeline parallelism","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.503717Z"},"links":{"citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:f12b4cb814d8f390fc343b3f2f55765a54ab71a1cdc4d20cbadc36d366dfc150","observation_id":"fdc4c9c2-c22a-452e-906b-5473b8124927","resolution":{"observed_at":"2026-08-06T23:26:57.503717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.509106Z","title":"Batch normalization: Accelerating deep network training by reducing internal covariate shift","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.509106Z"},"links":{"citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:c7e340c9421a934a9c0dcdccd6ca42ef475be2acea64e2367e0d61d0b706d4ad","observation_id":"2728d8a9-bb81-4295-b989-4564a9edbec6","resolution":{"observed_at":"2026-08-06T23:26:57.509106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.200565Z","title":"Decoupled neural interfaces using synthetic gradients","venue":null,"work_id":"27e29bdf-a2fe-4101-a813-b307d5311b07","year":2017},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.514659Z"},"links":{"citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:c9351ce18e0be17cf9bdb45c31b7d7b807882bdce9b0a0fdbaa1da79f8b229af","observation_id":"3a6da181-4b7f-457d-a2c8-41d2e86e94b9","resolution":{"observed_at":"2026-08-06T23:26:58.205482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.180898Z","title":"Scaling up visual and vision-language representation learning with noisy text supervision","venue":null,"work_id":"950e2fd9-993e-4c92-8401-1776d20dc831","year":2021},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.519927Z"},"links":{"citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:078e7edd23fcae6e7d3f22d0b4dc3bdbaca7d122b197f98df5c15d7abeb4b4ba","observation_id":"242ffc12-a2b4-46ce-a093-c1d5d4d59350","resolution":{"observed_at":"2026-08-06T23:26:58.189312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.161524Z","title":"Beyond data and model parallelism for deep neural networks","venue":null,"work_id":"7d59d525-37fc-4f81-8693-753f434cafcc","year":2019},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.524598Z"},"links":{"citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:c58203280aa298af757236ed9da5961b2a39658464f8dfdeee01958cdf92a4cb","observation_id":"fe51f5de-4382-40eb-bb94-b50c88b6c61c","resolution":{"observed_at":"2026-08-06T23:26:58.167616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.09348","last_updated":"2022-04-23T16:44:20Z","snapshot_observed_at":"2026-08-04T13:22:09.326175Z","submitted_at":"2021-10-18T14:22:19Z","title":"Understanding Dimensional Collapse in Contrastive Self-supervised Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.09348","snapshot_observed_at":"2026-08-06T23:26:57.529622Z","title":"Understanding dimensional collapse in contrastive self-supervised learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.529622Z"},"links":{"cited_paper":"/paper/2110.09348","citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:07b1845e2345e300ca99bd12cc494324a776ea110c55cd94c4f0a61e211579f0","observation_id":"49fab7b8-4434-4fb6-841b-ee94661c9887","resolution":{"observed_at":"2026-08-06T23:26:57.529622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.143884Z","title":"Associated learning: Decomposing end-to-end backpropagation based on autoencoders and target propagation","venue":null,"work_id":"52a59fd0-8111-4f84-9eb6-6255647983c4","year":2021},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.535725Z"},"links":{"citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:777b81357f5931a7d43187e04ea91d76081954c46d6af7a90980bc3d14977eaf","observation_id":"2ce60da5-11a2-4fbc-abcf-dfadacb3f077","resolution":{"observed_at":"2026-08-06T23:26:58.149525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.541027Z","title":"Supervised contrastive learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.541027Z"},"links":{"citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:e7fb1af8cd2f913fc096f27c1c6f614442092181af2782162d80e00f3a1ff677","observation_id":"8bc937a6-9fcd-486e-8d5f-1a950da3c547","resolution":{"observed_at":"2026-08-06T23:26:57.541027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.111115Z","title":"Deeply-supervised nets","venue":null,"work_id":"789df0bb-c785-41b0-b5a0-5d450d7234fa","year":2015},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.546520Z"},"links":{"citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:0c1a07cf1afd2f61f434f8c6b56bfc57a681cdbe172be22dc77a88775cb58823","observation_id":"153bf6f5-f95e-4bf9-a030-c85e0ef45a5d","resolution":{"observed_at":"2026-08-06T23:26:58.118048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.093628Z","title":"Self-organization in a perceptual network","venue":null,"work_id":"134bd78b-6db1-4fd7-934c-4f64a2c674a9","year":1988},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.551019Z"},"links":{"citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:74432e0281ea6a5bbdf378ad8a1e5dda99b7719ce496bc73b933b44938b70e6b","observation_id":"3af4fdac-b2c4-45fc-91d6-3dcdb32897d8","resolution":{"observed_at":"2026-08-06T23:26:58.099196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.077217Z","title":"Pipedream: Generalized pipeline parallelism for dnn training","venue":null,"work_id":"f23ea55d-4377-4e0f-acbc-e28b2311ce82","year":2019},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.556575Z"},"links":{"citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:60b258ee580c5ceebda70f4244278e9d4c573988e998fc3e649fb06be24e1f50","observation_id":"dee2e877-933f-4b7c-ba2a-112565c41671","resolution":{"observed_at":"2026-08-06T23:26:58.082012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.062210Z","title":"Training neural networks with local error signals","venue":null,"work_id":"b00d4535-2625-4d00-bc16-54b47fe63c0d","year":2019},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.561148Z"},"links":{"citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:456ed01a8f1039a32b5ce2346dbbb2ba4aaa8f02247005d672d41edc7f979009","observation_id":"012f512a-8fc0-4a50-be4e-f0b8185696eb","resolution":{"observed_at":"2026-08-06T23:26:58.066682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-07-06T06:49:24.960992Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-08-06T23:26:57.565665Z","title":"Representation learning with contrastive predictive coding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.565665Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:31cfefe882ba236d56697faa7b6d9b01593046ac6cc83814b26680950162cbd9","observation_id":"8ce6b912-27a8-43bb-8b4a-360fe840e197","resolution":{"observed_at":"2026-08-06T23:26:57.565665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.046331Z","title":"Self-supervised learning with an information maximization criterion","venue":null,"work_id":"de1c2b37-e623-4227-9dbc-f8672a0035e3","year":2022},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.570723Z"},"links":{"citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:b703d2efa2a2b35eaaf19785471a085eab0018e39aa384de0e97fcc8ff90d0a1","observation_id":"22345f68-9e7b-4d74-86bd-dfc5ae86257f","resolution":{"observed_at":"2026-08-06T23:26:58.051244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.028711Z","title":"Glove: Global vectors for word representation","venue":null,"work_id":"1cf32b1e-460e-4ffc-9817-daa4229c991e","year":2014},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.575506Z"},"links":{"citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:c7466b4eabef50792049f7fc420ef0d2b10487e45ac95072a426d25792a65ff0","observation_id":"df07c045-0e8e-455b-9968-7d1d510601a8","resolution":{"observed_at":"2026-08-06T23:26:58.034829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.579992Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.579992Z"},"links":{"citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:04767b189c21d1f683af30c4726cfe7c7b4d6c8aa21ce7dc8b5feeba049bb0e2","observation_id":"421aacf7-3a6b-47f2-bafb-b38ba406ec97","resolution":{"observed_at":"2026-08-06T23:26:57.579992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.999429Z","title":"Measuring the effects of data parallelism on neural network training","venue":null,"work_id":"cca4ffd5-c9bc-453a-bf53-d80944b9a2d3","year":2019},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.584931Z"},"links":{"citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:13b66910320f51340be4bfd027fd652008f4213627bb8df6b02b6d9d8788029c","observation_id":"ddb7adb3-55ea-4e58-8a38-dee92c250240","resolution":{"observed_at":"2026-08-06T23:26:58.004489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.983603Z","title":"Spatiotemporal co-attention recurrent neural networks for human-skeleton motion prediction","venue":null,"work_id":"b00d881b-b4dd-453f-92f2-7c57445ab150","year":2021},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.589757Z"},"links":{"citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:d4dadea47715547bcdc0680540f4f09bb464de857cc354ca1fbced165ffb9463","observation_id":"e10cd162-444b-4edc-b00a-b16ec53fb830","resolution":{"observed_at":"2026-08-06T23:26:57.988918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.968326Z","title":"Multi-granularity anchor-contrastive representation learning for semi-supervised skeleton-based action recognition","venue":null,"work_id":"1f70d099-7e60-4edb-8ac7-86ceaefe995e","year":2022},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.596748Z"},"links":{"citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:21811ecf5a63e9075c194d89b5cf44ba066e0556dde5280dae4caddd2ac9e6ee","observation_id":"60f1719e-bca3-491f-90f8-95f0c5214584","resolution":{"observed_at":"2026-08-06T23:26:57.973377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01647","last_updated":"2024-08-11T15:59:30Z","snapshot_observed_at":"2026-08-08T01:16:23.204625Z","submitted_at":"2023-02-03T10:48:24Z","title":"Blockwise Self-Supervised Learning at Scale","version":2},"cited_work":{"arxiv_id":"2302.01647","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.01647","snapshot_observed_at":"2026-08-06T23:26:57.726720Z","title":"Blockwise Self-Supervised Learning at Scale","venue":"cs.CV","work_id":"9cb38824-dfec-4dda-9fae-73d4c1c73dac","year":2023},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.601682Z"},"links":{"cited_paper":"/paper/2302.01647","citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:50b04301a76b031f7ba96902cc4cc64c00bd2a2a8d8f971ba703f61ac8d3c6d2","observation_id":"b9930b06-96f9-4454-a215-2bd38e38a9dc","resolution":{"observed_at":"2026-08-06T23:26:57.734033Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-07-06T03:53:32.549552Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-06T23:26:57.606756Z","title":"Very deep convolutional networks for large-scale image recognition","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.606756Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:ccf694f27e76f52a43856c05a85e9d4694286e97aca2fee31390f2189fac9db5","observation_id":"c61c2737-1340-41a6-8a3e-7f38716a5ee3","resolution":{"observed_at":"2026-08-06T23:26:57.606756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.611920Z","title":"Going deeper with convolutions","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.611920Z"},"links":{"citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:c553275927961c61f6aaef17d273eaa0618c36c0fb6385788853f2140a1eca3d","observation_id":"9cd33261-1e28-45a8-8abe-f2de59e8647c","resolution":{"observed_at":"2026-08-06T23:26:57.611920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.941440Z","title":"Coherence constrained graph lstm for group activity recognition","venue":null,"work_id":"d3ee0142-9b4b-469a-9f6a-8741495aa336","year":2019},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.617219Z"},"links":{"citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:a08fca9e21583ecea56490dc6a486de9ac2a1d3771632838234e3c08d715acd9","observation_id":"e6bff137-6afd-471f-b044-cf033e9009fa","resolution":{"observed_at":"2026-08-06T23:26:57.946542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.923848Z","title":"Branchynet: Fast inference via early exiting from deep neural networks","venue":null,"work_id":"35e1436e-25e0-43e0-a25b-8a1d10088d8c","year":2016},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.621754Z"},"links":{"citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:d39c6be87245e5103563bd994acdffee2bb00074165717c734b6ecb2956d5154","observation_id":"c3e1a715-e5e5-4e38-926e-26cca7277c3d","resolution":{"observed_at":"2026-08-06T23:26:57.929597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.13625","last_updated":"2020-01-23T09:08:54Z","snapshot_observed_at":"2026-07-06T08:11:34.239342Z","submitted_at":"2019-07-31T17:50:51Z","title":"On Mutual Information Maximization for Representation Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.13625","snapshot_observed_at":"2026-08-06T23:26:57.626429Z","title":"On mutual information maximization for representation learning","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.626429Z"},"links":{"cited_paper":"/paper/1907.13625","citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:e0ce3082b159f2b049a6283fb1a23fee68ce6def2c0504e9b61fb9150b438469","observation_id":"7339ba12-af84-48d9-b96b-df14e369345b","resolution":{"observed_at":"2026-08-06T23:26:57.626429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.904462Z","title":"Decomposing end-to-end backpropagation based on SCPL","venue":null,"work_id":"94a6d8c7-dd7a-4ac7-8a9f-e5da28cb40a8","year":2021},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.631815Z"},"links":{"citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:02e3ff0d8210eaadca0712548071cfc31d5ff1100cc18ae75d8fd55573dd2937","observation_id":"df8cb2d5-0da2-4f9a-9c18-2ec3e0f0a52f","resolution":{"observed_at":"2026-08-06T23:26:57.912169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.885737Z","title":"Revisiting locally supervised learning: an alternative to end-to-end training","venue":null,"work_id":"c9dd32d1-feba-4163-8fd7-aef1800cb276","year":2021},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.637259Z"},"links":{"citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:756d7ec8d22af3aee51ab386ecf9430c685b6680917a022810b89646e67197cb","observation_id":"e01b6e66-013f-4979-b7ca-20e6d397fc93","resolution":{"observed_at":"2026-08-06T23:26:57.891822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.869182Z","title":"Associated learning: an alternative to end-to-end backpropagation that works on cnn, rnn, and transformer","venue":null,"work_id":"691e1418-52bd-45ea-9106-89a5711fb8b4","year":2021},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.643276Z"},"links":{"citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:acc4889784b72cdb67edfa2759635b845e3c6030dafaaf7ef2e43e6a11b40bdd","observation_id":"fd0c88f0-a2e2-447d-9e7c-ebffa07a0316","resolution":{"observed_at":"2026-08-06T23:26:57.874035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.851409Z","title":"Higcin: Hierarchical graph-based cross inference network for group activity recognition","venue":null,"work_id":"af98611f-c1a1-4460-8040-ca2c467d6a5a","year":2020},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.648582Z"},"links":{"citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:924c79e80c67687d2934cbada7c25bb5591ef74419e2afe1b3b8c4f5d9961e10","observation_id":"3eebe8f7-85dd-422c-b572-47c69195dd76","resolution":{"observed_at":"2026-08-06T23:26:57.857346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.834924Z","title":"Towards interpretable deep local learning with successive gradient reconciliation","venue":null,"work_id":"44ef52a4-c6fe-420b-9ed7-cbb6024993f0","year":2024},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.652962Z"},"links":{"citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:5f20a307e2188535332a2b8261e7d2a916ec5a55a7edebfccba7285755e48c34","observation_id":"d791d001-0a9f-4450-9f21-9334a589695d","resolution":{"observed_at":"2026-08-06T23:26:57.840799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.816576Z","title":"Barlow twins: Self-supervised learning via redundancy reduction","venue":null,"work_id":"5112a2d8-5c68-420b-91ce-8f0f2c1fbc31","year":2021},"citing_paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T23:26:57.657461Z"},"links":{"citing_paper":"/paper/2506.18193"},"observation_digest":"sha256:f747eccf84b6f3242fcb0a71a4de51e638caa4a4f5877ef495098bc02f28cc96","observation_id":"51fa7bcc-d9b0-467a-8985-0f9edb92ece5","resolution":{"observed_at":"2026-08-06T23:26:57.821790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.18193","last_updated":"2025-07-15T14:29:38Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T11:12:59.760985Z","submitted_at":"2025-06-22T22:50:06Z","title":"DeInfoReg: A Decoupled Learning Framework for Better Training Throughput"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":1,"verified_fuzzy":24},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 0 inbound Pith citation observations for arXiv:2506.18193."}