{"product_id":"glubokoe-obuchenie-s-podkrepleniem-alphago-i-drugie-tekhnologii-9785446110797","title":"Дубинско учење са појачањем: AlphaGo и друге технологије","description":"\u003cp\u003eОва књига је свеобухватни водич кроз најновије алате за дубоко учење појачања и њихова ограничења. Имплементирамо и тестирамо методе унакрсне ентропије и Q-учења, као и градијенте политика. Разноврсна окружења за учење појачања (RL) се користе за експерименте, од класичних CartPole и GridWorld до Atari емулатора и окружења континуиране контроле (базираних на PyBullet и RoboSchool). Многи примери су засновани на нестандардним окружењима, где ћемо развити модел окружења од нуле. У овој књизи: • Научићете како се RL методе уклапају у контекст дубоког учења и имплементирати сложене моделе дубоког учења. • Научите основе RL: Марковљеве процесе одлучивања. • Размотрите примере имплементација RL метода: метод унакрсне ентропије, DQN, A3C, TRPO, PPO, DDPG, D4PG и друге. • Научите како да радите са дискретним и континуираним просторима акције у различитим окружењима. • Погледајте како да развијете систем који учи Atari игре користећи учење појачања. • Креирајте сопствено окружење засновано на OpenAI Gym моделу за обуку берзанског посредника. • Имплементирајте AlphaGo Zero метод за играње игре Connect4. • Упознајте се са применом RL у обради говора: научићете како да тренирате дијалошки бот на фразама из филмова.\u003c\/p\u003e","brand":"Питер","offers":[{"title":"Default Title","offer_id":44748300255285,"sku":"978-5-4461-1079-7","price":3280.0,"currency_code":"RSD","in_stock":false}],"thumbnail_url":"\/\/cdn.shopify.com\/s\/files\/1\/0688\/7732\/0245\/files\/vtko7dpk64v02a9s1wyhdbg64n1syosp.jpg?v=1764802051","url":"https:\/\/belavrana.com\/sr\/products\/glubokoe-obuchenie-s-podkrepleniem-alphago-i-drugie-tekhnologii-9785446110797","provider":"Белая Ворона - ваш книжный в Сербии!","version":"1.0","type":"link"}