PT Phạm Duy Tùng AI · DATA · SYSTEMS

Share

Twitter Facebook

Cài đặt

Quay lại Tải lại Sao chép URL Chia sẻ
  • Courses
  • Tools
  • Categories
  • Archives
  • Tags
  • Community
    • Facebook Group
    • GitHub
    • Contact

    • Câu hỏi thường gặp
  1. Trang chủ
  2. Tags
  3. Reinforcement Learning
Sử dụng mô hình Double DQN  huấn luyện mô hình Reinforcement Learning với game marioMở bài viết ↗
27/10/2024 33 phút đọc reinforcement learningdeep reinforcement learninggame ai

Sử dụng mô hình Double DQN huấn luyện mô hình Reinforcement Learning với game mario

Chào các bạn, sau một thời gian ở ẩn, chúng ta lại tiếp tục với việc thực chiến AI, ở bài viết này, chúng ta sẽ train mô hình AI Reinforcement Learning với tựa game đã đi vào bao...

Đọc tiếp
Reinforcement Learning và tictactoeMở bài viết ↗
27/12/2020 13 phút đọc reinforcement learninggame aipython

Reinforcement Learning và tictactoe

Trong khi trong các phương pháp lý thuyết trò chơi nói chung, ví dụ thuật toán min-max, thuật toán luôn giả định chúng ta có một đối thủ hoàn hảo, công việc phải thực hiện là tối...

Đọc tiếp
Phân nhóm các thuật toán học máyMở bài viết ↗
19/04/2019 22 phút đọc Machine Learningml algorithmsreinforcement learning

Phân nhóm các thuật toán học máy

Machine Learning đã và đang được quan tâm, nghiên cứu sâu rộng, có rất nhiều các thuật toán được cho ra đời. Như vậy liệu các thuật toán ấy có đặc điểm hay chức năng tương đồng và...

Đọc tiếp

Bài gần đây

  • Kimi Delta Attention: Khi AI học cách nhớ như một cái bảng trắng thay vì ôm cả nhà kho
  • Cloudflare OS: Khi AI Agent bắt đầu cần một hệ điều hành riêng cho doanh nghiệp
  • AirLLM: Nhét một mô hình 2.8 nghìn tỷ tham số qua khe cửa 4GB VRAM
  • Khi log biết tự điều tra: TReNDS dùng AI Agent để tìm Root Cause trong chưa đầy một phút
  • Kitesurf: Khi trình duyệt không còn được xây cho con người

series

Khóa Học Python Căn Bản5 Khóa Học C++ Căn Bản3 Machine Learning Dataset2 Chứng Khoán Căn Bản1

tools

Tool Random3

categories

Python5 C++3 Dataset2

tags

Machine Learning26 Deep Learning23 LLM17 Computer Vision16 Python14 AI Agent10 Recommendation System7 System Design7 Time Series6 Uber Engineering6
    • Community
    • Facebook Group
    • GitHub
    • Contact Us
    • Câu hỏi thường gặp
    • Docs
    • Điều khoản sử dụng
    • Chính sách bảo mật
    • Features
    • Tạo password ngẫu nhiên
    • Liên kết khác
    • Netlify
    • facebook
Copyright © 2016-2026 Phạm Duy Tùng. All Rights Reserved.
Website chia sẻ kiến thức của Phạm Duy Tùng và Đặng Thị Hằng. Vui lòng liên hệ email [email protected] nếu bạn có thông tin cần trao đổi.