Skip to the content

Open IA

AI News

  • Microsoft IA
  • Google IA
  • NVIDIA IA
  • Openai IA
  • MIT IA
  • TLDR.TECH
  • ScienceDaily IA
  • SiècleDigital IA
  • Developpez.com
  • BonPrompt.com
  • Toute l’IA
  • A propos
  • Microsoft IA
  • Google IA
  • NVIDIA IA
  • Openai IA
  • MIT IA
  • TLDR.TECH
  • ScienceDaily IA
  • SiècleDigital IA
  • Developpez.com
  • BonPrompt.com
  • Toute l’IA
  • A propos
  • Search
  • AI safety needs social scientists

    30 Juil
  • Better language models and their implications

    30 Juil
  • Computational limitations in robust classification and win-win results

    30 Juil
  • OpenAI Fellows Summer 2018: Final projects

    30 Juil
  • How AI training scales

    30 Juil
  • Quantifying generalization in reinforcement learning

    30 Juil
  • Spinning Up in Deep RL

    30 Juil
  • Learning concepts with energy functions

    30 Juil
  • Plan online, learn offline: Efficient learning and exploration via model-based control

    30 Juil
  • Reinforcement learning with prediction-based rewards

    30 Juil
  • Learning complex goals with iterated amplification

    30 Juil
  • OpenAI Scholars 2019: Applications open

    30 Juil
  • OpenAI Fellows Winter 2019 & Interns Summer 2019

    30 Juil
  • FFJORD: Free-form continuous dynamics for scalable reversible generative models

    30 Juil
  • OpenAI Scholars 2018: Final projects

    30 Juil
  • The International 2018: Results

    30 Juil
  • Large-scale study of curiosity-driven learning

    30 Juil
  • OpenAI Five Benchmark: Results

    30 Juil
  • Learning dexterity

    30 Juil
  • Variational option discovery algorithms

    30 Juil
  • OpenAI Scholars 2018: Meet our Scholars

    30 Juil
  • OpenAI Five Benchmark

    30 Juil
  • Glow: Better reversible generative models

    30 Juil
  • Learning Montezuma’s Revenge from a single demonstration

    30 Juil
  • OpenAI Five

    30 Juil
  • Retro Contest: Results

    30 Juil
  • Learning policy representations in multiagent systems

    30 Juil
  • Improving language understanding with unsupervised learning

    30 Juil
  • GamePad: A learning environment for theorem proving

    30 Juil
  • OpenAI Fellows Fall 2018

    30 Juil
  • Gym Retro

    30 Juil
  • AI and compute

    30 Juil
  • AI safety via debate

    30 Juil
  • Evolved Policy Gradients

    30 Juil
  • Gotta Learn Fast: A new benchmark for generalization in RL

    30 Juil
  • Retro Contest

    30 Juil
  • Variance reduction for policy gradient with action-dependent factorized baselines

    30 Juil
  • Improving GANs using optimal transport

    30 Juil
  • Report from the OpenAI hackathon

    30 Juil
  • On first-order meta-learning algorithms

    30 Juil
  • Reptile: A scalable meta-learning algorithm

    30 Juil
  • OpenAI Scholars

    30 Juil
  • Some considerations on learning to explore via meta-reinforcement learning

    30 Juil
  • Ingredients for robotics research

    30 Juil
  • Multi-Goal Reinforcement Learning: Challenging robotics environments and request for research

    30 Juil
  • OpenAI hackathon

    30 Juil
  • Preparing for malicious uses of AI

    30 Juil
  • OpenAI supporters

    30 Juil
  • Interpretable machine learning through teaching

    30 Juil
  • Discovering types for entity disambiguation

    30 Juil
  • Requests for Research 2.0

    30 Juil
  • Scaling Kubernetes to 2,500 nodes

    30 Juil
  • Block-sparse GPU kernels

    30 Juil
  • Learning sparse neural networks through L₀ regularization

    30 Juil
  • Interpretable and pedagogical examples

    30 Juil
  • Learning a hierarchy

    30 Juil
  • Generalizing from simulation

    30 Juil
  • Asymmetric actor critic for image-based robot learning

    30 Juil
  • Sim-to-real transfer of robotic control with dynamics randomization

    30 Juil
  • Domain randomization and generative models for robotic grasping

    30 Juil
  • Competitive self-play

    30 Juil
  • Meta-learning for wrestling

    30 Juil
  • Nonlinear computation in deep linear networks

    30 Juil
  • Learning to model other minds

    30 Juil
  • Learning with opponent-learning awareness

    30 Juil
  • OpenAI Baselines: ACKTR & A2C

    30 Juil
  • More on Dota 2

    30 Juil
  • Dota 2

    30 Juil
  • Gathering human feedback

    30 Juil
  • Better exploration with parameter noise

    30 Juil
  • Proximal Policy Optimization

    30 Juil
  • Robust adversarial inputs

    30 Juil
  • Hindsight Experience Replay

    30 Juil
  • Teacher–student curriculum learning

    30 Juil
  • Faster physics in Python

    30 Juil
  • Learning from human preferences

    30 Juil
  • Learning to cooperate, compete, and communicate

    30 Juil
  • UCB exploration via Q-ensembles

    30 Juil
  • OpenAI Baselines: DQN

    30 Juil
  • Robots that learn

    30 Juil
  • Roboschool

    30 Juil
  • Equivalence between policy gradients and soft Q-learning

    30 Juil
  • Stochastic Neural Networks for hierarchical reinforcement learning

    30 Juil
  • Unsupervised sentiment neuron

    30 Juil
  • Spam detection in the physical world

    30 Juil
  • Evolution strategies as a scalable alternative to reinforcement learning

    30 Juil
  • One-shot imitation learning

    30 Juil
  • Distill

    30 Juil
  • Learning to communicate

    30 Juil
  • Emergence of grounded compositional language in multi-agent populations

    30 Juil
  • Prediction and control with temporal segment models

    30 Juil
  • Third-person imitation learning

    30 Juil
  • Attacking machine learning with adversarial examples

    30 Juil
  • Adversarial attacks on neural network policies

    30 Juil
  • Team update

    30 Juil
  • PixelCNN++: Improving the PixelCNN with discretized logistic mixture likelihood and other modifications

    30 Juil
  • Faulty reward functions in the wild

    30 Juil
  • Universe

    30 Juil
  • #Exploration: A study of count-based exploration for deep reinforcement learning

    30 Juil
  • OpenAI and Microsoft

    30 Juil

Newer

Older

© 2026 Open IA

Design Jean-Louis Maso

Gérer le consentement
Pour offrir les meilleures expériences, nous utilisons des technologies telles que les cookies pour stocker et/ou accéder aux informations des appareils. Le fait de consentir à ces technologies nous permettra de traiter des données telles que le comportement de navigation ou les ID uniques sur ce site. Le fait de ne pas consentir ou de retirer son consentement peut avoir un effet négatif sur certaines caractéristiques et fonctions.
Fonctionnel Toujours activé
L’accès ou le stockage technique est strictement nécessaire dans la finalité d’intérêt légitime de permettre l’utilisation d’un service spécifique explicitement demandé par l’abonné ou l’utilisateur, ou dans le seul but d’effectuer la transmission d’une communication sur un réseau de communications électroniques.
Préférences
L’accès ou le stockage technique est nécessaire dans la finalité d’intérêt légitime de stocker des préférences qui ne sont pas demandées par l’abonné ou l’internaute.
Statistiques
Le stockage ou l’accès technique qui est utilisé exclusivement à des fins statistiques. Le stockage ou l’accès technique qui est utilisé exclusivement dans des finalités statistiques anonymes. En l’absence d’une assignation à comparaître, d’une conformité volontaire de la part de votre fournisseur d’accès à internet ou d’enregistrements supplémentaires provenant d’une tierce partie, les informations stockées ou extraites à cette seule fin ne peuvent généralement pas être utilisées pour vous identifier.
Marketing
L’accès ou le stockage technique est nécessaire pour créer des profils d’internautes afin d’envoyer des publicités, ou pour suivre l’utilisateur sur un site web ou sur plusieurs sites web ayant des finalités marketing similaires.
  • Gérer les options
  • Gérer les services
  • Gérer {vendor_count} fournisseurs
  • En savoir plus sur ces finalités
Voir les préférences
  • {title}
  • {title}
  • {title}