← Home

AI Briefing — 2026-07-13

🔬 Research

Vidu S1: A Real-Time Interactive Video Generation Model

128 upvotes · Zhang et al. · Paper

Vidu S1 est un modèle de génération vidéo en temps réel, capable de produire des vidéos 540p à 42 FPS sur un GPU grand public, avec une longueur infinie et sans dégradation visuelle. Les utilisateurs contrôlent les personnages à la voix et peuvent importer leurs propres images (personnes réelles, anime, animaux de compagnie). Construit sur TurboDiffusion et TurboServe, il surpasse tous ses concurrents sur les métriques de test. Une démo jouable est disponible sur vidu.com/vidu-stream — à surveiller pour les usages en streaming interactif et en création de contenu personnalisé.


SciReasoner: Raisonnement structurel natif pour les sciences

85 upvotes · Tang et al. · Paper

SciReasoner est un modèle de fondation multimodal qui raisonne nativement sur des structures scientifiques (protéines, petites molécules, cristaux inorganiques), en tokenisant coordonnées et topologies comme des unités d'évidence directement adressables. Sur 86 benchmarks, il atteint l'état de l'art sur 67 tâches, dont la rétrosynthèse monoétape (0,63 → 0,72) et l'annotation GO cellulaire pour protéines orphelines (F-max : 0,42 → 0,55). Les traces de raisonnement sont jugées préférables ou comparables à celles d'un LLM frontier dans 98 % des cas en évaluation en double aveugle. Un outil majeur pour l'accélération de la découverte scientifique en biologie, chimie et science des matériaux.


Video-Oasis: Repenser l'évaluation de la compréhension vidéo

58 upvotes · Lim et al. · Paper

Video-Oasis n'est pas un nouveau benchmark, mais un outil d'audit des benchmarks vidéo existants. Son diagnostic révèle que 55 % des échantillons des benchmarks actuels sont résolubles sans aucune entrée visuelle ni contexte temporel — ce qui fausse considérablement l'évaluation des Video-LLMs. Une fois ces raccourcis filtrés, les meilleurs modèles actuels tombent à des performances à peine au-dessus du hasard. Une contribution critique pour quiconque évalue ou compare des modèles de compréhension vidéo. Code disponible sur GitHub.


🛠 Tools

HKUDS/Vibe-Trading — Agent de trading personnel

768 stars/jour · 21 116 ⭐ total · Repo

Framework Python (FastAPI + React 19) qui transforme un agent LLM en agent de trading autonome via une seule commande d'installation (pip install vibe-trading-ai). Il offre des capacités complètes de trading — analyse de marché, prise de décision, exécution — en s'appuyant sur des modèles de langage. La popularité explosive (21k étoiles) signale un intérêt fort, mais la prudence s'impose avant tout usage en production avec des fonds réels.


anthropics/claude-cookbooks — Recettes pratiques pour Claude

459 stars/jour · Repo

Dépôt officiel Anthropic de notebooks Jupyter montrant des usages concrets et créatifs de Claude via l'API. Idéal comme point de départ pour prototyper rapidement des intégrations d'agents, workflows multimodaux ou pipelines RAG. Le dépôt est maintenu directement par Anthropic, ce qui garantit des exemples à jour avec les dernières capacités du modèle.


Dicklesworthstone/destructive_command_guard — Garde-fou pour agents IA

444 stars/jour · 3 547 ⭐ total · Repo

dcg est un hook haute performance écrit en Rust qui intercepte et bloque les commandes shell ou git destructrices avant leur exécution par un agent IA. Il supporte nativement Claude Code, Codex CLI, Gemini CLI, GitHub Copilot, Cursor, Grok, Aider et bien d'autres. S'installe en une ligne et répond à un besoin réel de sécurité opérationnelle à mesure que les coding agents gagnent en autonomie.


📡 Analysis

Directly Responsible Individuals (DRI)

2026-07-12 · Post · tags: apple, management, ai, ai-ethics, coding-agents

Simon Willison revient sur le concept de "Directly Responsible Individual" — popularisé chez Apple, formalisé dans le handbook GitLab — pour argumenter qu'un agent LLM ne devrait jamais en être un : les machines ne peuvent pas rendre de comptes. Il cite une diapositive IBM de 1979 ("A computer can never be held accountable, therefore a computer must never make a management decision") comme principe toujours valide. Un rappel utile alors que l'autonomie des agents s'étend : la responsabilité doit rester humaine.


Fable gets another bump — La guerre des abonnements Anthropic vs OpenAI

2026-07-12 · Post · tags: anthropic, openai, llm-pricing, claude-mythos-fable

Anthropic prolonge une nouvelle fois l'accès à Claude Fable 5 sur les plans payants jusqu'au 19 juillet, sous pression de GPT-5.6 Sol (modèle de classe Fable/Mythos). OpenAI, en parallèle, supprime les limites horaires pour ses plans Plus/Business/Pro et annonce 6M d'utilisateurs actifs. Simon estime qu'Anthropic devrait rendre Fable permanent sur ces plans : l'incertitude autour de la disponibilité du modèle est un avantage compétitif cédé gratuitement à OpenAI.


Sources: HuggingFace Papers API, GitHub Trending, simonwillison.net