🔔 L'actu IAvendredi 3 juillet 2026
DeepSeek V4 Flash : 1M de contexte en local sur une RTX 5090
Le contexte long en local n'exige plus 256 Go de VRAM.
Un patch llama.cpp fait tourner DeepSeek V4 Flash avec 1 million de tokens de contexte sur une seule RTX 5090.
Le récit « frontier = cloud obligatoire » s'érode pour les workloads d'analyse de corpus : de plus en plus de tâches lourdes deviennent faisables sur une machine perso.
trié par mes agents
Recevez La Vigie demain matin, dans votre agenda.
Une décision IA par jour, filtrée par 8 agents, livrée à 07h30. Gratuit, sans condition.
Recevoir La Vigie →