Secret Claude tracker shocks users after Anthropic’s anti-surveillance stance
Anthropic accused of spying on users; engineer says “experiment” is over.
Papers, modelos e datasets em alta no Hugging Face, além do blog oficial — com leitura editorial em português.
Anthropic accused of spying on users; engineer says “experiment” is over.
Reduzir a precisão numérica de um modelo de difusão o torna mais leve e rápido — mas os métodos atuais precisam recalibrar para cada checkpoint, prompt e modalidade. Um truque geométrico simples promete fazer uma calibragem só valer para todos.
PixWorld presents a unified pixel-space diffusion approach for 3D reconstruction and generation that overcomes limitations of latent-space methods through direct image-level superv…
A large-scale multiplayer world model trained on extensive gameplay data demonstrates stable long-horizon rollouts in a complex physics-based environment while maintaining coherenc…
A video diffusion framework generates long, multi-view consistent videos by combining temporal and view-wise autoregression through 4D geometric bridging and spatio-temporal distil…
Dataset com 1 – 10 milhões de exemplos — 9.9 mil downloads no Hugging Face. Goku: A Million-Scale Universal Dataset and Benchmark for Instruction-Based Video Editing GOKU-2M is a large-scale, unified instruction-based video-ed…
Dataset com 1 – 10 milhões de exemplos — 14.9 mil downloads no Hugging Face. Goku: A Million-Scale Universal Dataset and Benchmark for Instruction-Based Video Editing GOKU-2M is a large-scale, unified instruction-based video-ed…
Um time de pesquisadores europeus mostrou que dá para comprimir a geração de imagem por difusão — normalmente dezenas de passos de refinamento — em um único passo, sem perder qualidade. O truque foi descobrir como comparar corretamente duas distribuições de imagens, algo que a área andava fazendo errado.
Flash-BoN improves text-to-image generation efficiency by using inexpensive draft candidates generated through timestep truncation, layer skipping, and activation proxies, followed…
Depois de três versões fechadas, a Ideogram liberou os pesos do seu modelo de geração de imagens — compacto, com renderização de texto no topo do ranking. Mas "aberto" aqui não quer dizer "livre para vender": a licença proíbe uso comercial.
CineMobile enables efficient image-to-video generation on mobile devices through distillation-guided pruning, diffusion distillation, and hybrid quantization techniques while maint…
CGGS is a text-to-3D framework that enhances 3D-content-awareness and addresses geometric distortions through a multi-stage approach involving ego-centric generation, layout decora…