PT Phạm Duy Tùng AI · DATA · SYSTEMS

Share

Twitter Facebook

Cài đặt

Quay lại Tải lại Sao chép URL Chia sẻ
  • Courses
  • Tools
  • Categories
  • Archives
  • Tags
  • Community
    • Facebook Group
    • GitHub
    • Contact

    • Câu hỏi thường gặp
  1. Trang chủ
  2. Tags
  3. LLM
AirLLM: Nhét một mô hình 2.8 nghìn tỷ tham số qua khe cửa 4GB VRAMMở bài viết ↗
09/08/2026 19 phút đọc LLMAirLLMgpuInferenceModel Serving

AirLLM: Nhét một mô hình 2.8 nghìn tỷ tham số qua khe cửa 4GB VRAM

AirLLM không làm mô hình nhỏ đi. Nó biến GPU thành một căn phòng nhỏ, chỉ đưa từng layer hoặc từng expert vào tính toán rồi lập tức đẩy ra ngoài. Đổi lại, VRAM giảm cực mạnh nhưng...

Đọc tiếp
Kimi Delta Attention: Khi AI học cách nhớ như một cái bảng trắng thay vì ôm cả nhà khoMở bài viết ↗
09/08/2026 19 phút đọc Kimi Delta AttentionLinear AttentionLLMKimi K3Transformer

Kimi Delta Attention: Khi AI học cách nhớ như một cái bảng trắng thay vì ôm cả nhà kho

Kimi Delta Attention (KDA) là cơ chế linear attention đứng sau Kimi Linear và Kimi K3. Thay vì giữ toàn bộ KV cache ngày càng phình ra theo context, KDA nén quá khứ vào một trạng...

Đọc tiếp
Đừng biến mọi thứ thành đồ thị: Khi nào GraphRAG thật sự thắng Vector RAG?Mở bài viết ↗
03/08/2026 19 phút đọc GraphRAGragKnowledge GraphLLMAI Infrastructure

Đừng biến mọi thứ thành đồ thị: Khi nào GraphRAG thật sự thắng Vector RAG?

GraphRAG không phải phiên bản cao cấp hơn của Vector RAG. Nó chỉ thật sự phát huy sức mạnh khi câu hỏi cần nối nhiều dữ kiện, hiểu quan hệ hoặc nhìn toàn bộ kho dữ liệu.

Pailitao-MMSearch: Khi mỗi sản phẩm trở thành một chuỗi token trong bộ não tìm kiếm của TaobaoMở bài viết ↗
29/07/2026 6 phút đọc multimodal-searchgenerative-retrievalsemantic-idE-commerceLLM

Pailitao-MMSearch: Khi mỗi sản phẩm trở thành một chuỗi token trong bộ não tìm kiếm của Taobao

Phân tích học thuật Pailitao-MMSearch, mô hình tìm kiếm thương mại điện tử đa phương thức của Alibaba, từ Hybrid Semantic ID, continual pre-training, on-policy distillation đến...

Đọc tiếp
AI review PRD: Một yêu cầu sai có thể sinh ra hàng nghìn dòng code đúngMở bài viết ↗
09/07/2026 28 phút đọc aiPRDproduct managementLLMragSystem DesignUber Engineering

AI review PRD: Một yêu cầu sai có thể sinh ra hàng nghìn dòng code đúng

AI không nhất thiết phải thay Product Manager. Đôi khi, việc có giá trị nhất mà AI làm được chỉ là đọc bản PRD đầu tiên, lục lại những điều cả nhóm đã quên và hỏi những câu ngớ...

Đọc tiếp
AI Agent đang có một cuộc khủng hoảng danh tínhMở bài viết ↗
08/07/2026 8 phút đọc AI AgentMCPOAuthOIDCSecurityLLMSystem Design

AI Agent đang có một cuộc khủng hoảng danh tính

AI Agent đang dần trở thành một nhân viên thực thụ trong doanh nghiệp. Nhưng nếu AI có thể đọc email, chuyển tiền, tạo đơn hàng hay deploy production, câu hỏi quan trọng nhất không...

Đọc tiếp
Code as Agent Harness: Khi AI Agent Không Chỉ Nói, Mà Bắt Đầu Suy Luận Bằng CodeMở bài viết ↗
07/07/2026 24 phút đọc LLMAI Agentcode-agentharnesscodex

Code as Agent Harness: Khi AI Agent Không Chỉ Nói, Mà Bắt Đầu Suy Luận Bằng Code

Ngôn ngữ tự nhiên rất tiện, nhưng cũng rất mơ hồ. Khi AI agent chỉ suy luận bằng chữ, nó có thể nói nghe rất hợp lý nhưng vẫn sai. Hướng Code as Agent Harness đề xuất một cách nhìn...

Đọc tiếp
MCP Server Architecture Patterns - Khi API không còn phục vụ con ngườiMở bài viết ↗
06/07/2026 21 phút đọc aiLLMMCParchitectureagent

MCP Server Architecture Patterns - Khi API không còn phục vụ con người

MCP Server không giống API thông thường, vì client lần này là LLM. Khi người gọi tool là AI, tool description, số lượng tool, session, bảo mật dữ liệu và cách tổ chức workflow trở...

Đọc tiếp
AI Agent và giấc mơ công ty tự chạy. Robot làm việc được, nhưng ai chịu trách nhiệm?Mở bài viết ↗
04/07/2026 8 phút đọc AI AgentLLMautomationAI Governancefuture of workmeta

AI Agent và giấc mơ công ty tự chạy. Robot làm việc được, nhưng ai chịu trách nhiệm?

AI agent đang đi từ những demo vui vẻ sang các bài toán rất thật của doanh nghiệp, gọi tool, đọc dữ liệu, gửi email, tạo báo cáo, xử lý workflow và ra quyết định. Nhưng khi AI...

Đọc tiếp
AI không bay trên mây. Cái giá vật lý sau một câu promptMở bài viết ↗
04/07/2026 7 phút đọc aidata centerLLMchatgptAI Infrastructureenergy

AI không bay trên mây. Cái giá vật lý sau một câu prompt

Một câu hỏi gửi cho ChatGPT nhìn rất nhẹ, chỉ là vài chữ gõ lên màn hình rồi chờ câu trả lời hiện ra. Nhưng phía sau cái nhẹ như mây đó là một chuỗi phản ứng vật lý rất thật, điện...

Đọc tiếp
File không chỉ là một đống byte: Cách Uber dùng AI để hiểu dữ liệu đang rời khỏi công tyMở bài viết ↗
01/07/2026 31 phút đọc generative aiData Loss PreventionSecurityLLMOCRSemantic AnalysisUber Engineering

File không chỉ là một đống byte: Cách Uber dùng AI để hiểu dữ liệu đang rời khỏi công ty

DLP truyền thống có thể nhìn thấy số thẻ, email và từ khóa nhạy cảm, nhưng lại không hiểu câu chuyện nằm trong một tài liệu. Uber xây File Semantic Analyzer để đọc, tóm tắt, phân...

Đọc tiếp
AI đi chợ không chỉ cần biết món gì ngon, nó còn phải hiểu trứng được bán theo vỉMở bài viết ↗
17/06/2026 37 phút đọc AI AgentUber EatsLLMAgentic AIE-commerceSystem DesignEvaluation

AI đi chợ không chỉ cần biết món gì ngon, nó còn phải hiểu trứng được bán theo vỉ

Uber Eats xây Cart Assistant để biến một dòng chữ, ảnh chụp danh sách đi chợ hoặc kế hoạch bữa ăn thành một giỏ hàng có thể chỉnh sửa. Điều đáng học không phải là AI biết tự mua...

Đọc tiếp
Xu hướng sử dụng LLM. Phân tích dựa trên ứng dụng của LLM trong tài chínhMở bài viết ↗
14/09/2025 12 phút đọc LLMfinancial airagfintech

Xu hướng sử dụng LLM. Phân tích dựa trên ứng dụng của LLM trong tài chính

Tài chính vốn là một lĩnh vực rộng lớn và phức tạp, nơi con số và thông tin chạy đua từng giây từng phút. Nhưng đằng sau những bảng báo cáo dày cộp, những dòng hợp đồng dài hàng...

Đọc tiếp
Giới thiệu vLLM -  Công cụ Phục vụ LLM Hiệu suất Cao cho Ứng dụng AIMở bài viết ↗
15/06/2025 6 phút đọc LLMvllmllm servingAI Infrastructure

Giới thiệu vLLM - Công cụ Phục vụ LLM Hiệu suất Cao cho Ứng dụng AI

Trong thời đại bùng nổ của trí tuệ nhân tạo (AI), việc triển khai các mô hình ngôn ngữ lớn (LLM) vào môi trường sản xuất không chỉ đòi hỏi hiệu suất vượt trội mà còn cần khả năng...

Đọc tiếp
Dung lượng VRAM cho Người Dùng Phổ Thông Muốn Tiếp Cận LLM hoặc Machine LearningMở bài viết ↗
14/06/2025 5 phút đọc LLMgpuvramlocal ai

Dung lượng VRAM cho Người Dùng Phổ Thông Muốn Tiếp Cận LLM hoặc Machine Learning

Ngoài việc phục vụ chơi game, VRAM cũng đóng vai trò quan trọng trong các lĩnh vực như **Machine Learning (ML)** và **Large Language Models (LLM)**. Bài viết này sẽ giúp bạn hiểu...

Đọc tiếp
  • Trước ‹
  • 1
  • 2
  • Sau ›

Bài gần đây

  • Kimi Delta Attention: Khi AI học cách nhớ như một cái bảng trắng thay vì ôm cả nhà kho
  • Cloudflare OS: Khi AI Agent bắt đầu cần một hệ điều hành riêng cho doanh nghiệp
  • AirLLM: Nhét một mô hình 2.8 nghìn tỷ tham số qua khe cửa 4GB VRAM
  • Khi log biết tự điều tra: TReNDS dùng AI Agent để tìm Root Cause trong chưa đầy một phút
  • Kitesurf: Khi trình duyệt không còn được xây cho con người

series

Khóa Học Python Căn Bản5 Khóa Học C++ Căn Bản3 Machine Learning Dataset2 Chứng Khoán Căn Bản1

tools

Tool Random3

categories

Python5 C++3 Dataset2

tags

Machine Learning26 Deep Learning23 LLM17 Computer Vision16 Python14 AI Agent10 Recommendation System7 System Design7 Time Series6 Uber Engineering6
    • Community
    • Facebook Group
    • GitHub
    • Contact Us
    • Câu hỏi thường gặp
    • Docs
    • Điều khoản sử dụng
    • Chính sách bảo mật
    • Features
    • Tạo password ngẫu nhiên
    • Liên kết khác
    • Netlify
    • facebook
Copyright © 2016-2026 Phạm Duy Tùng. All Rights Reserved.
Website chia sẻ kiến thức của Phạm Duy Tùng và Đặng Thị Hằng. Vui lòng liên hệ email [email protected] nếu bạn có thông tin cần trao đổi.