Khám phá thế giới Khoa học · 2 thg 8, 2026 · 20:12
Nghe trong ứng dụng Podli 🎧
Theo dõi podcast yêu thích, nghe ngoại tuyến và trên xe với CarPlay và Android Auto, và luôn tiếp tục đúng chỗ đang nghe dở. Dùng thử miễn phí.
Trong tập podcast này, chúng ta khám phá High-Bandwidth Flash (HBF) – công nghệ bộ nhớ thế hệ mới có thể thay đổi tương lai của ChatGPT, Large Language Models (LLM), Retrieval-Augmented Generation (RAG) và toàn bộ hạ tầng AI.
Bạn sẽ tìm hiểu vì sao High-Bandwidth Memory (HBM) đang trở thành "bức tường bộ nhớ" của GPU hiện đại; cách HBF cung cấp dung lượng lớn gấp 8–16 lần ngay trên cùng gói chip; kỹ thuật TileLens giúp loại bỏ hiện tượng read amplification; và kiến trúc HAVEN đưa việc tìm kiếm vector trực tiếp vào bên trong bộ nhớ flash bằng mô hình compute-near-data. Những cải tiến này giúp giảm độ trễ tới 40 lần, tăng thông lượng 20 lần, mở đường cho AI có thể xử lý cơ sở tri thức khổng lồ mà không còn bị giới hạn bởi HBM.
Nếu bạn quan tâm đến AI, ChatGPT, GPU NVIDIA, bán dẫn, kiến trúc máy tính, vector database và tương lai của trí tuệ nhân tạo, đây là tập podcast không nên bỏ lỡ.
📚 Nguồn tham khảo: HAVEN: High-Bandwidth Flash Augmented Vector ENgine for Large-Scale Approximate Nearest-Neighbor Search Acceleration (arXiv, 2026); TileLens: Efficiently Using Large-Granularity Memory Systems with Transparent Two-Dimensional Memory Layout (arXiv); Massive AI Storage Demand Creates a New Memory Wall (EE Times, 2026); SanDisk Bets on Stacking NAND and Compute on One Chip (Wccftech, 2026).
#AI #LLM #ChatGPT #HighBandwidthFlash #HBF #HBM #GPU #NVIDIA #RAG #VectorDatabase #Semiconductor #TriTueNhanTao #CongNghe #Podcast #KhoaHoc
Các tập: Khám phá thế giới Khoa học