Skip to the content

Open IA

AI News

  • Microsoft IA
  • Google IA
  • NVIDIA IA
  • Openai IA
  • MIT IA
  • TLDR.TECH
  • ScienceDaily IA
  • SiècleDigital IA
  • Developpez.com
  • BonPrompt.com
  • Toute l’IA
  • A propos
  • Microsoft IA
  • Google IA
  • NVIDIA IA
  • Openai IA
  • MIT IA
  • TLDR.TECH
  • ScienceDaily IA
  • SiècleDigital IA
  • Developpez.com
  • BonPrompt.com
  • Toute l’IA
  • A propos
  • Search

Category

Research

  • How AI training scales

    30 Août
  • Quantifying generalization in reinforcement learning

    30 Août
  • Spinning Up in Deep RL

    30 Août
  • Learning concepts with energy functions

    30 Août
  • Plan online, learn offline: Efficient learning and exploration via model-based control

    30 Août
  • Reinforcement learning with prediction-based rewards

    30 Août
  • FFJORD: Free-form continuous dynamics for scalable reversible generative models

    30 Août
  • The International 2018: Results

    30 Août
  • Large-scale study of curiosity-driven learning

    30 Août
  • OpenAI Five Benchmark: Results

    30 Août
  • Learning dexterity

    30 Août
  • Variational option discovery algorithms

    30 Août
  • Glow: Better reversible generative models

    30 Août
  • Learning Montezuma’s Revenge from a single demonstration

    30 Août
  • OpenAI Five

    30 Août
  • Retro Contest: Results

    30 Août
  • Learning policy representations in multiagent systems

    30 Août
  • GamePad: A learning environment for theorem proving

    30 Août
  • Gym Retro

    30 Août
  • AI and compute

    30 Août
  • Evolved Policy Gradients

    30 Août
  • Gotta Learn Fast: A new benchmark for generalization in RL

    30 Août
  • Retro Contest

    30 Août
  • Variance reduction for policy gradient with action-dependent factorized baselines

    30 Août
  • Improving GANs using optimal transport

    30 Août
  • On first-order meta-learning algorithms

    30 Août
  • Reptile: A scalable meta-learning algorithm

    30 Août
  • Some considerations on learning to explore via meta-reinforcement learning

    30 Août
  • Ingredients for robotics research

    30 Août
  • Multi-Goal Reinforcement Learning: Challenging robotics environments and request for research

    30 Août
  • Interpretable machine learning through teaching

    30 Août
  • Discovering types for entity disambiguation

    30 Août
  • Requests for Research 2.0

    30 Août
  • Scaling Kubernetes to 2,500 nodes

    30 Août
  • Block-sparse GPU kernels

    30 Août
  • Learning sparse neural networks through L₀ regularization

    30 Août
  • Interpretable and pedagogical examples

    30 Août
  • Learning a hierarchy

    30 Août
  • Generalizing from simulation

    30 Août
  • Sim-to-real transfer of robotic control with dynamics randomization

    30 Août
  • Asymmetric actor critic for image-based robot learning

    30 Août
  • Domain randomization and generative models for robotic grasping

    30 Août
  • Competitive self-play

    30 Août
  • Meta-learning for wrestling

    30 Août
  • Nonlinear computation in deep linear networks

    30 Août
  • Learning to model other minds

    30 Août
  • Learning with opponent-learning awareness

    30 Août
  • OpenAI Baselines: ACKTR & A2C

    30 Août
  • More on Dota 2

    30 Août
  • Dota 2

    30 Août
  • Gathering human feedback

    30 Août
  • Better exploration with parameter noise

    30 Août
  • Proximal Policy Optimization

    30 Août
  • Robust adversarial inputs

    30 Août
  • Hindsight Experience Replay

    30 Août
  • Teacher–student curriculum learning

    30 Août
  • Faster physics in Python

    30 Août
  • Learning to cooperate, compete, and communicate

    30 Août
  • UCB exploration via Q-ensembles

    30 Août
  • OpenAI Baselines: DQN

    30 Août
  • Robots that learn

    30 Août
  • Roboschool

    30 Août
  • Equivalence between policy gradients and soft Q-learning

    30 Août
  • Stochastic Neural Networks for hierarchical reinforcement learning

    30 Août
  • Unsupervised sentiment neuron

    30 Août
  • Spam detection in the physical world

    30 Août
  • Evolution strategies as a scalable alternative to reinforcement learning

    30 Août
  • One-shot imitation learning

    30 Août
  • Learning to communicate

    30 Août
  • Emergence of grounded compositional language in multi-agent populations

    30 Août
  • Prediction and control with temporal segment models

    30 Août
  • Third-person imitation learning

    30 Août
  • PixelCNN++: Improving the PixelCNN with discretized logistic mixture likelihood and other modifications

    30 Août
  • Universe

    30 Août
  • #Exploration: A study of count-based exploration for deep reinforcement learning

    30 Août
  • On the quantitative analysis of decoder-based generative models

    30 Août
  • A connection between generative adversarial networks, inverse reinforcement learning, and energy-based models

    30 Août
  • RL²: Fast reinforcement learning via slow reinforcement learning

    30 Août
  • Variational lossy autoencoder

    30 Août
  • Extensions and limitations of the neural GPU

    30 Août
  • Transfer from simulation to real world through learning deep inverse dynamics model

    30 Août
  • Infrastructure for deep learning

    30 Août
  • Generative models

    30 Août
  • OpenAI Gym Beta

    30 Août
  • Weight normalization: A simple reparameterization to accelerate training of deep neural networks

    30 Août

Newer

© 2026 Open IA

Design Jean-Louis Maso

Gérer le consentement
Pour offrir les meilleures expériences, nous utilisons des technologies telles que les cookies pour stocker et/ou accéder aux informations des appareils. Le fait de consentir à ces technologies nous permettra de traiter des données telles que le comportement de navigation ou les ID uniques sur ce site. Le fait de ne pas consentir ou de retirer son consentement peut avoir un effet négatif sur certaines caractéristiques et fonctions.
Fonctionnel Toujours activé
L’accès ou le stockage technique est strictement nécessaire dans la finalité d’intérêt légitime de permettre l’utilisation d’un service spécifique explicitement demandé par l’abonné ou l’utilisateur, ou dans le seul but d’effectuer la transmission d’une communication sur un réseau de communications électroniques.
Préférences
L’accès ou le stockage technique est nécessaire dans la finalité d’intérêt légitime de stocker des préférences qui ne sont pas demandées par l’abonné ou l’internaute.
Statistiques
Le stockage ou l’accès technique qui est utilisé exclusivement à des fins statistiques. Le stockage ou l’accès technique qui est utilisé exclusivement dans des finalités statistiques anonymes. En l’absence d’une assignation à comparaître, d’une conformité volontaire de la part de votre fournisseur d’accès à internet ou d’enregistrements supplémentaires provenant d’une tierce partie, les informations stockées ou extraites à cette seule fin ne peuvent généralement pas être utilisées pour vous identifier.
Marketing
L’accès ou le stockage technique est nécessaire pour créer des profils d’internautes afin d’envoyer des publicités, ou pour suivre l’utilisateur sur un site web ou sur plusieurs sites web ayant des finalités marketing similaires.
  • Gérer les options
  • Gérer les services
  • Gérer {vendor_count} fournisseurs
  • En savoir plus sur ces finalités
Voir les préférences
  • {title}
  • {title}
  • {title}