{"as_of":"2026-08-16T08:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:64703cdfbb119257b10d935113fc51fe11c5b26cbe1f64d2269675d6945b349d","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-09T19:57:27.683657Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.07117/citation-record","integrity":"/paper/2607.07117/integrity","json":"/paper/2607.07117/citation-record.json","paper":"/paper/2607.07117"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T20:36:32.065641Z","title":"High-resolution image synthesis with latent diffusion models,","venue":null,"work_id":"89e7205e-b974-456c-b4d8-c44fb02938b3","year":2022},"citing_paper":{"arxiv_id":"2607.07117","last_updated":"2026-07-08T07:58:48Z","snapshot_observed_at":"2026-08-14T18:43:29.717220Z","submitted_at":"2026-07-08T07:58:48Z","title":"Tree-of-Thoughts Reasoning for Text-to-Image In-Context Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-09T19:57:27.683657Z"},"links":{"citing_paper":"/paper/2607.07117"},"observation_digest":"sha256:e17aff5142b72d6e8ac07da0a37e2bae14382360ade9544beca31f5c34df0856","observation_id":"403b430b-28d4-424a-986f-484a9fd04e8f","resolution":{"observed_at":"2026-07-09T20:36:32.067004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T20:36:32.042470Z","title":"Zero-shot text-to-image generation,","venue":null,"work_id":"49cf849b-cfa3-4e7d-8a8a-17253003b92c","year":2021},"citing_paper":{"arxiv_id":"2607.07117","last_updated":"2026-07-08T07:58:48Z","snapshot_observed_at":"2026-08-14T18:43:29.717220Z","submitted_at":"2026-07-08T07:58:48Z","title":"Tree-of-Thoughts Reasoning for Text-to-Image In-Context Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-09T19:57:27.683657Z"},"links":{"citing_paper":"/paper/2607.07117"},"observation_digest":"sha256:0062f4a046b8150f2430cef810921054b6a602abf68e0dc44533a78b975fbe88","observation_id":"2e59a1cc-2226-4687-9109-062c01040787","resolution":{"observed_at":"2026-07-09T20:36:32.043965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T20:36:32.067643Z","title":"Composi- tional visual generation with composable diffusion models,","venue":null,"work_id":"feadb22b-3312-498a-922d-4eb021b06a3e","year":2022},"citing_paper":{"arxiv_id":"2607.07117","last_updated":"2026-07-08T07:58:48Z","snapshot_observed_at":"2026-08-14T18:43:29.717220Z","submitted_at":"2026-07-08T07:58:48Z","title":"Tree-of-Thoughts Reasoning for Text-to-Image In-Context Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-09T19:57:27.683657Z"},"links":{"citing_paper":"/paper/2607.07117"},"observation_digest":"sha256:f821a9c48f60031cc948c021cdd0cc3d74a784eec76658badba27b925e365261","observation_id":"b9f51144-23bc-4e5d-b153-a366b5c0785e","resolution":{"observed_at":"2026-07-09T20:36:32.068822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T20:36:32.032598Z","title":"Flamingo: A visual language model for few- shot learning,","venue":null,"work_id":"14105f4d-8050-4f14-9ba8-a887c9bd2b2f","year":2022},"citing_paper":{"arxiv_id":"2607.07117","last_updated":"2026-07-08T07:58:48Z","snapshot_observed_at":"2026-08-14T18:43:29.717220Z","submitted_at":"2026-07-08T07:58:48Z","title":"Tree-of-Thoughts Reasoning for Text-to-Image In-Context Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-09T19:57:27.683657Z"},"links":{"citing_paper":"/paper/2607.07117"},"observation_digest":"sha256:91448af990bac66ab9c55605e3af780c8eda707453c9689e32973d0c8bc837c3","observation_id":"1a59b81e-b536-4b76-896b-228f2177febe","resolution":{"observed_at":"2026-07-09T20:36:32.034325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T20:36:32.063814Z","title":"Context diffusion: In-context aware image generation,","venue":null,"work_id":"7d86f7dc-d8ef-4d5c-80b0-1c3e4155504e","year":2024},"citing_paper":{"arxiv_id":"2607.07117","last_updated":"2026-07-08T07:58:48Z","snapshot_observed_at":"2026-08-14T18:43:29.717220Z","submitted_at":"2026-07-08T07:58:48Z","title":"Tree-of-Thoughts Reasoning for Text-to-Image In-Context Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-09T19:57:27.683657Z"},"links":{"citing_paper":"/paper/2607.07117"},"observation_digest":"sha256:c1521d95837ea4d295614a88e5113cf1e84eaec451550c696592abfc625129ce","observation_id":"58d7ec09-f8d6-4d78-885f-74b5c06718f6","resolution":{"observed_at":"2026-07-09T20:36:32.065097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T20:36:32.036615Z","title":"Can mllms perform text-to-image in-context learning?","venue":null,"work_id":"810e1b96-c861-4648-b373-294dff9c588b","year":2024},"citing_paper":{"arxiv_id":"2607.07117","last_updated":"2026-07-08T07:58:48Z","snapshot_observed_at":"2026-08-14T18:43:29.717220Z","submitted_at":"2026-07-08T07:58:48Z","title":"Tree-of-Thoughts Reasoning for Text-to-Image In-Context Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-09T19:57:27.683657Z"},"links":{"citing_paper":"/paper/2607.07117"},"observation_digest":"sha256:07fc90c061a240e83e01faa4246e8cc45709d04250e635e18b2775227722e1bb","observation_id":"c254052c-3377-4936-aa1d-f5897c536b60","resolution":{"observed_at":"2026-07-09T20:36:32.037928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T20:36:32.063674Z","title":"Explaining generative diffusion models via visual analysis for interpretable decision-making process,","venue":null,"work_id":"71a27e90-023f-45c8-8775-2f1b057cc3e2","year":2024},"citing_paper":{"arxiv_id":"2607.07117","last_updated":"2026-07-08T07:58:48Z","snapshot_observed_at":"2026-08-14T18:43:29.717220Z","submitted_at":"2026-07-08T07:58:48Z","title":"Tree-of-Thoughts Reasoning for Text-to-Image In-Context Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-09T19:57:27.683657Z"},"links":{"citing_paper":"/paper/2607.07117"},"observation_digest":"sha256:30bb2c658c32399786d0e5699450cd24993d2d6629b2f93b7a6a83f6cc04c827","observation_id":"42150841-b078-418d-9e81-67c6623c97a1","resolution":{"observed_at":"2026-07-09T20:36:32.065257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T20:36:32.057775Z","title":"Flipconcept: Tuning-free multi- concept personalization for text-to-image generation,","venue":null,"work_id":"82ff0289-00d7-4036-bf58-3c7fab36a95d","year":2025},"citing_paper":{"arxiv_id":"2607.07117","last_updated":"2026-07-08T07:58:48Z","snapshot_observed_at":"2026-08-14T18:43:29.717220Z","submitted_at":"2026-07-08T07:58:48Z","title":"Tree-of-Thoughts Reasoning for Text-to-Image In-Context Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-09T19:57:27.683657Z"},"links":{"citing_paper":"/paper/2607.07117"},"observation_digest":"sha256:65f9329003e671fabdaaa678b1f531313d74c20183e6b06380059040f29b1cd4","observation_id":"01dcfc9d-8b6e-4edd-9fff-cf29d7864cc6","resolution":{"observed_at":"2026-07-09T20:36:32.059244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T20:36:32.050944Z","title":"Ranni: Taming text-to-image diffusion for accurate instruction following,","venue":null,"work_id":"d59fc5b6-0666-4139-88c0-bece8709f510","year":2024},"citing_paper":{"arxiv_id":"2607.07117","last_updated":"2026-07-08T07:58:48Z","snapshot_observed_at":"2026-08-14T18:43:29.717220Z","submitted_at":"2026-07-08T07:58:48Z","title":"Tree-of-Thoughts Reasoning for Text-to-Image In-Context Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-09T19:57:27.683657Z"},"links":{"citing_paper":"/paper/2607.07117"},"observation_digest":"sha256:b9fa20cc0878a3fad886f39c274177f7e2ebcfc4cd6dbfefc5b4b9fe46733777","observation_id":"7d8fdf50-3625-415a-b772-ad4778e0a7c0","resolution":{"observed_at":"2026-07-09T20:36:32.052566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T20:36:32.030927Z","title":"Versagen: Unleashing versatile visual control for text- to-image synthesis,","venue":null,"work_id":"d3fe6867-f7d1-43a7-9159-adad1cf9a300","year":2025},"citing_paper":{"arxiv_id":"2607.07117","last_updated":"2026-07-08T07:58:48Z","snapshot_observed_at":"2026-08-14T18:43:29.717220Z","submitted_at":"2026-07-08T07:58:48Z","title":"Tree-of-Thoughts Reasoning for Text-to-Image In-Context Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-09T19:57:27.683657Z"},"links":{"citing_paper":"/paper/2607.07117"},"observation_digest":"sha256:38a94bc13f20863990f2bf90bc717fc0d4e2345441c5a042cea11b81f58586ad","observation_id":"916e7072-b778-488e-890c-ff15b6012f40","resolution":{"observed_at":"2026-07-09T20:36:32.032176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T20:36:32.055936Z","title":"A survey on in-context learning,","venue":null,"work_id":"587d0d4c-d62a-4721-9f67-3c372410a7dd","year":2024},"citing_paper":{"arxiv_id":"2607.07117","last_updated":"2026-07-08T07:58:48Z","snapshot_observed_at":"2026-08-14T18:43:29.717220Z","submitted_at":"2026-07-08T07:58:48Z","title":"Tree-of-Thoughts Reasoning for Text-to-Image In-Context Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-09T19:57:27.683657Z"},"links":{"citing_paper":"/paper/2607.07117"},"observation_digest":"sha256:f6608ff7bb37e22be9cac1db5905ebce61e282576931b84b761e16b8858083a4","observation_id":"b220fd54-367b-42a0-9f7d-97263039009d","resolution":{"observed_at":"2026-07-09T20:36:32.057435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T20:36:32.042058Z","title":"Few-shot learning with geometric con- straints,","venue":null,"work_id":"d595c4a4-9282-4530-a31b-ca1e8e9b4c2a","year":2020},"citing_paper":{"arxiv_id":"2607.07117","last_updated":"2026-07-08T07:58:48Z","snapshot_observed_at":"2026-08-14T18:43:29.717220Z","submitted_at":"2026-07-08T07:58:48Z","title":"Tree-of-Thoughts Reasoning for Text-to-Image In-Context Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-09T19:57:27.683657Z"},"links":{"citing_paper":"/paper/2607.07117"},"observation_digest":"sha256:08acb0a0ae7ba2b3c51012b9d6e5e130ba2266da8f97936a77e7af3e4d06f2b6","observation_id":"22b92d01-890e-4646-abad-aa0c87ddfa84","resolution":{"observed_at":"2026-07-09T20:36:32.043726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T20:36:32.046558Z","title":"Self-augmentation: General- izing deep networks to unseen classes for few-shot learning,","venue":null,"work_id":"0a40b616-5d53-4f53-b504-181b1610c60e","year":2021},"citing_paper":{"arxiv_id":"2607.07117","last_updated":"2026-07-08T07:58:48Z","snapshot_observed_at":"2026-08-14T18:43:29.717220Z","submitted_at":"2026-07-08T07:58:48Z","title":"Tree-of-Thoughts Reasoning for Text-to-Image In-Context Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-09T19:57:27.683657Z"},"links":{"citing_paper":"/paper/2607.07117"},"observation_digest":"sha256:5ad952aa33b0adf7d12570b079044f4e06f219aba53b8c2c6be0a9a0c44cfb84","observation_id":"08963385-4348-406f-b175-d1bc7c941bdf","resolution":{"observed_at":"2026-07-09T20:36:32.048110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T20:36:32.060091Z","title":"Spatial reasoning for few-shot object detection,","venue":null,"work_id":"8ecc1497-562c-43de-a762-063ff17bbf42","year":2021},"citing_paper":{"arxiv_id":"2607.07117","last_updated":"2026-07-08T07:58:48Z","snapshot_observed_at":"2026-08-14T18:43:29.717220Z","submitted_at":"2026-07-08T07:58:48Z","title":"Tree-of-Thoughts Reasoning for Text-to-Image In-Context Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-09T19:57:27.683657Z"},"links":{"citing_paper":"/paper/2607.07117"},"observation_digest":"sha256:a4f39ef350f387c8272f26a5b23d10423cfc26b72b47c9e32188c9bf806f1589","observation_id":"cd26680c-39d9-4561-9299-ed588f0710a7","resolution":{"observed_at":"2026-07-09T20:36:32.061321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T20:36:32.048716Z","title":"Discriminative context learning with gated recurrent unit for group activity recognition,","venue":null,"work_id":"c49d0c62-f8fb-4f9e-80a6-b61c16d67613","year":2018},"citing_paper":{"arxiv_id":"2607.07117","last_updated":"2026-07-08T07:58:48Z","snapshot_observed_at":"2026-08-14T18:43:29.717220Z","submitted_at":"2026-07-08T07:58:48Z","title":"Tree-of-Thoughts Reasoning for Text-to-Image In-Context Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-09T19:57:27.683657Z"},"links":{"citing_paper":"/paper/2607.07117"},"observation_digest":"sha256:38cd5705844dd0f20bee9cd321317b81d242337a2b561f6f587bc554259b8eef","observation_id":"bad1700c-c825-4510-9205-f22322dcb064","resolution":{"observed_at":"2026-07-09T20:36:32.050292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T20:36:32.055728Z","title":"Imagegen-cot: Enhancing text-to-image in-context learning with chain-of-thought reasoning,","venue":null,"work_id":"3a299945-4f65-4e35-a5ef-f789766edd11","year":2025},"citing_paper":{"arxiv_id":"2607.07117","last_updated":"2026-07-08T07:58:48Z","snapshot_observed_at":"2026-08-14T18:43:29.717220Z","submitted_at":"2026-07-08T07:58:48Z","title":"Tree-of-Thoughts Reasoning for Text-to-Image In-Context Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-09T19:57:27.683657Z"},"links":{"citing_paper":"/paper/2607.07117"},"observation_digest":"sha256:7af9ac8b1005b06e7b3e21a37f5f419e6f0fa7f0be0b5435810c1442db45bdc7","observation_id":"4f9f5c64-0148-4f25-8af4-66488261c05f","resolution":{"observed_at":"2026-07-09T20:36:32.057251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T20:36:32.059786Z","title":"In-context learning unlocked for diffusion models,","venue":null,"work_id":"c3341ef9-d713-4458-8d9e-71c2c4fdd90d","year":2023},"citing_paper":{"arxiv_id":"2607.07117","last_updated":"2026-07-08T07:58:48Z","snapshot_observed_at":"2026-08-14T18:43:29.717220Z","submitted_at":"2026-07-08T07:58:48Z","title":"Tree-of-Thoughts Reasoning for Text-to-Image In-Context Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-09T19:57:27.683657Z"},"links":{"citing_paper":"/paper/2607.07117"},"observation_digest":"sha256:96a05c6c88292918480e550f0ca73a48108bd862668438bc96a40ff3f5c1b981","observation_id":"9e5fd312-fd29-4976-b22c-8a8f1bad1375","resolution":{"observed_at":"2026-07-09T20:36:32.061092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T20:36:32.061628Z","title":"Analogist: Out-of-the-box visual in-context learning with image diffusion model,","venue":null,"work_id":"d33303ad-2b44-43ec-b91c-9e70ad894734","year":2024},"citing_paper":{"arxiv_id":"2607.07117","last_updated":"2026-07-08T07:58:48Z","snapshot_observed_at":"2026-08-14T18:43:29.717220Z","submitted_at":"2026-07-08T07:58:48Z","title":"Tree-of-Thoughts Reasoning for Text-to-Image In-Context Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-09T19:57:27.683657Z"},"links":{"citing_paper":"/paper/2607.07117"},"observation_digest":"sha256:6148628b7d466e9412e35d754faebf03bd6bc019010f6c99d1080bfb3042059e","observation_id":"91f43ace-d5ab-43ea-b719-075d5d5ae228","resolution":{"observed_at":"2026-07-09T20:36:32.063055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T20:36:32.061809Z","title":"Pill-id: Matching and retrieval of drug pill images,","venue":null,"work_id":"db974afe-ffdd-4d7d-b315-cf1d749672fc","year":2012},"citing_paper":{"arxiv_id":"2607.07117","last_updated":"2026-07-08T07:58:48Z","snapshot_observed_at":"2026-08-14T18:43:29.717220Z","submitted_at":"2026-07-08T07:58:48Z","title":"Tree-of-Thoughts Reasoning for Text-to-Image In-Context Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-09T19:57:27.683657Z"},"links":{"citing_paper":"/paper/2607.07117"},"observation_digest":"sha256:ee007b0df8382c3e029c0c66ea60034380691e9de5af9baac85340b33935a21d","observation_id":"058b68f2-56b9-4afa-af60-3bf5bad83f4e","resolution":{"observed_at":"2026-07-09T20:36:32.063222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T20:36:32.044570Z","title":"Nighttime face recog- nition at large standoff: Cross-distance and cross-spectral matching,","venue":null,"work_id":"cd981f9a-6582-452f-b742-2c77475f6f7b","year":2014},"citing_paper":{"arxiv_id":"2607.07117","last_updated":"2026-07-08T07:58:48Z","snapshot_observed_at":"2026-08-14T18:43:29.717220Z","submitted_at":"2026-07-08T07:58:48Z","title":"Tree-of-Thoughts Reasoning for Text-to-Image In-Context Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-09T19:57:27.683657Z"},"links":{"citing_paper":"/paper/2607.07117"},"observation_digest":"sha256:3f25197d9c90d6f5831d6360e5e6ef692d42387d840656242d034271d0175fde","observation_id":"cc16b19d-ada7-4719-9c05-4d17873b942c","resolution":{"observed_at":"2026-07-09T20:36:32.046350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T20:36:32.037577Z","title":"View-independent human action recognition with volume motion template on single stereo camera,","venue":null,"work_id":"b3260cec-6928-4385-9e5c-2f396c86d44f","year":2010},"citing_paper":{"arxiv_id":"2607.07117","last_updated":"2026-07-08T07:58:48Z","snapshot_observed_at":"2026-08-14T18:43:29.717220Z","submitted_at":"2026-07-08T07:58:48Z","title":"Tree-of-Thoughts Reasoning for Text-to-Image In-Context Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-09T19:57:27.683657Z"},"links":{"citing_paper":"/paper/2607.07117"},"observation_digest":"sha256:7fa82cdbfbf0d6f623e0e7cdf9fb8d4649bebd79b5b1677012ed9f8e187f6ba9","observation_id":"960caad5-3b38-41ed-908c-9a10aec24f1d","resolution":{"observed_at":"2026-07-09T20:36:32.039191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T20:36:32.035044Z","title":"Text extraction in mpeg compressed video for content-based indexing,","venue":null,"work_id":"ecf77cc2-fa7c-4cbd-bc45-e873e625d5da","year":2000},"citing_paper":{"arxiv_id":"2607.07117","last_updated":"2026-07-08T07:58:48Z","snapshot_observed_at":"2026-08-14T18:43:29.717220Z","submitted_at":"2026-07-08T07:58:48Z","title":"Tree-of-Thoughts Reasoning for Text-to-Image In-Context Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-09T19:57:27.683657Z"},"links":{"citing_paper":"/paper/2607.07117"},"observation_digest":"sha256:59f263c9ed7bad50cf59b198fe8c8dd5a6ef60a846ab5f6ad9c2b07583ec0f1d","observation_id":"c1270256-7c6e-4edf-870d-60c10df25e5c","resolution":{"observed_at":"2026-07-09T20:36:32.036813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T20:36:32.039902Z","title":"Chain-of-thought prompting elicits reasoning in large language models,","venue":null,"work_id":"66e4d4af-0643-4975-a23e-70a65584f4df","year":2022},"citing_paper":{"arxiv_id":"2607.07117","last_updated":"2026-07-08T07:58:48Z","snapshot_observed_at":"2026-08-14T18:43:29.717220Z","submitted_at":"2026-07-08T07:58:48Z","title":"Tree-of-Thoughts Reasoning for Text-to-Image In-Context Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-09T19:57:27.683657Z"},"links":{"citing_paper":"/paper/2607.07117"},"observation_digest":"sha256:6ec14b5102f05e4ea08ac2f3597a4eb363851cab2df132b89448cdafbd2632d7","observation_id":"67888d8a-e5f6-4226-aa07-9929617d478b","resolution":{"observed_at":"2026-07-09T20:36:32.041750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T20:36:32.057991Z","title":"Tree of thoughts: Deliberate problem solving with large language models,","venue":null,"work_id":"84e9a87f-55b0-4453-bb65-c5973e0d045d","year":2023},"citing_paper":{"arxiv_id":"2607.07117","last_updated":"2026-07-08T07:58:48Z","snapshot_observed_at":"2026-08-14T18:43:29.717220Z","submitted_at":"2026-07-08T07:58:48Z","title":"Tree-of-Thoughts Reasoning for Text-to-Image In-Context Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-09T19:57:27.683657Z"},"links":{"citing_paper":"/paper/2607.07117"},"observation_digest":"sha256:9cb4a959b3d9aa5c975a2ccfaa16cfb67b74bd0744e123b70e83ca1466aa16e1","observation_id":"2ef7a423-e528-43d7-9c7b-3bcc5b703c81","resolution":{"observed_at":"2026-07-09T20:36:32.059442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01218","last_updated":"2023-10-02T14:03:02Z","snapshot_observed_at":"2026-08-16T07:40:15.155512Z","submitted_at":"2023-10-02T14:03:02Z","title":"Making LLaMA SEE and Draw with SEED Tokenizer","version":1},"cited_work":{"arxiv_id":"2310.01218","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.01218","snapshot_observed_at":"2026-07-09T20:16:29.588718Z","title":"Making llama see and draw with seed tokenizer","venue":"cs.CV","work_id":"9453feaf-a19d-4603-b9de-da50593c5d43","year":2023},"citing_paper":{"arxiv_id":"2607.07117","last_updated":"2026-07-08T07:58:48Z","snapshot_observed_at":"2026-08-14T18:43:29.717220Z","submitted_at":"2026-07-08T07:58:48Z","title":"Tree-of-Thoughts Reasoning for Text-to-Image In-Context Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-09T19:57:27.683657Z"},"links":{"cited_paper":"/paper/2310.01218","citing_paper":"/paper/2607.07117"},"observation_digest":"sha256:8eb7ddfd4f69c9cc427b60c0943e07bbedfa2d0e042902dff712a99c5bcae92c","observation_id":"59d22b61-4684-47c4-b9ba-0d776255867f","resolution":{"observed_at":"2026-07-09T20:16:29.589913Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T20:36:32.069323Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":"a64dc937-90a7-45cd-84c7-098bec9b51eb","year":2021},"citing_paper":{"arxiv_id":"2607.07117","last_updated":"2026-07-08T07:58:48Z","snapshot_observed_at":"2026-08-14T18:43:29.717220Z","submitted_at":"2026-07-08T07:58:48Z","title":"Tree-of-Thoughts Reasoning for Text-to-Image In-Context Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-09T19:57:27.683657Z"},"links":{"citing_paper":"/paper/2607.07117"},"observation_digest":"sha256:bbb941b3a5dc6b9294f9437e19013e5e9ebc2c04144bb9575ba3c1da082a3f95","observation_id":"dd7479bd-8832-4c19-ac2a-5bacae58b8c1","resolution":{"observed_at":"2026-07-09T20:36:32.070457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.07117","last_updated":"2026-07-08T07:58:48Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T18:43:29.717220Z","submitted_at":"2026-07-08T07:58:48Z","title":"Tree-of-Thoughts Reasoning for Text-to-Image In-Context Learning"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":1,"verified_fuzzy":25},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 0 inbound Pith citation observations for arXiv:2607.07117."}