我的電腦能自動尋找目標?AI 時代的引擎:ROCm 10.0 的故事
AMD 公佈的 ROCm 10.0 在 AI 代理時代帶來了哪些變化?本文將以淺顯易懂的方式介紹開發者專用的 AI 優化工具及其重要性。
AMD 公佈的 ROCm 10.0 在 AI 代理時代帶來了哪些變化?本文將以淺顯易懂的方式介紹開發者專用的 AI 優化工具及其重要性。
AMD发布的ROCm 10.0在AI代理(Agentic AI)时代带来了哪些变革?本文为您简单解读专为开发者打造的AI优化工具及其重要性。
AMD가 공개한 ROCm 10.0은 AI 에이전트 시대를 맞아 어떤 변화를 가져왔을까요? 개발자를 위한 AI 최적화 도구와 그 중요성을 쉽게 설명합니다.
AMDが発表したROCm 10.0は、AIエージェント時代にどのような変化をもたらしたのでしょうか?開発者向けのAI最適化ツールとその重要性を分かりやすく解説します。
How has AMD’s ROCm 10.0 brought changes in the era of AI agents? We explain AI optimization tools for developers and their importance in simple terms.
介紹一場技術之旅,探討如何在最新的 NVIDIA B200 GPU 上,從零開始最佳化 AI 運算的核心——「注意力核心 (Attention Kernel)」。
최신 NVIDIA B200 GPU에서 AI 연산의 핵심인 '어텐션 커널'을 밑바닥부터 최적화하는 과정을 다룬 기술적 여정을 소개합니다.
最新のNVIDIA B200 GPUにおいて、AI演算の心臓部である「アテンション・カーネル」をゼロから最適化していく過程を追った技術的探求を紹介します。
We introduce a technical journey covering the process of optimizing the 'attention kernel,' the core of AI computation, from scratch on the latest NVIDIA B200 GPU.
從 AI 訓練與高效能作業不可或缺的 GPU 健康管理方法,到能大幅提升行動 AI 效能的 Pantheon 技術,帶您輕鬆了解。
AI 학습과 고성능 작업을 위해 필수적인 GPU 건강 관리법부터, 모바일 AI 성능을 획기적으로 높여주는 Pantheon 기술까지 쉽게 알아봅니다.
AI学習や高性能作業に不可欠なGPUの健康管理法から、モバイルAIのパフォーマンスを劇的に向上させるPantheon技術まで、分かりやすく解説します。
From essential GPU health management for AI training and high-performance tasks to 'Pantheon' technology that revolutionizes mobile AI performance, we make it easy to understand.
研究發現,AI 編寫的 GPU Kernel 程式碼實際上存在大量缺陷。我們將介紹一種用於解決此問題的全新『合約等級(Contract-grade)』驗證工具。
AI가 작성한 GPU 커널 코드가 실제로는 다수 결함이 있다는 사실이 밝혀졌습니다. 이 문제를 해결할 새로운 '계약 수준' 검증 도구를 소개합니다.
AIが作成したGPUカーネルコードに多数の欠陥があることが判明しました。この問題を解決する新しい『コントラクト・グレード(契約レベル)』検証ツールを紹介します。
It has been revealed that a significant number of GPU kernel codes written by AI contain defects. We introduce a new 'contract-grade' verification tool to solve this problem.
我們將以淺顯易懂的方式,解析大型語言模型(LLM)在生成文字時,AMD 最新 MI450 GPU 如何將核心的「注意力解碼(Attention Decode)」過程進行極致優化。
거대언어모델(LLM)이 텍스트를 생성할 때 핵심적인 '어텐션 디코드' 과정을 AMD 최신 MI450 GPU에서 어떻게 극도로 최적화하는지 쉽게 풀어드립니다.
大規模言語モデル(LLM)がテキストを生成する際の核心的な「アテンション・デコード」プロセスを、AMDの最新GPU「MI450」でどのように極限まで最適化しているのかを分かりやすく解説します。
We simplify how Large Language Models (LLMs) achieve extreme optimization on the latest AMD MI450 GPUs during the crucial 'attention decode' phase of text generation.
這篇文章將以淺顯易懂的方式,為您介紹能將最新 AI 模型速度提升 1.41 倍以上的全新 GPU 優化技術:『NF4 去量化 Triton 內核』。
최신 AI 모델의 속도를 1.41배 이상 높여주는 새로운 GPU 최적화 기술 'NF4 디퀀타이제이션 Triton 커널'을 쉽게 설명해 드립니다.
最新のAIモデルの速度を1.41倍以上向上させる、新しいGPU最適化技術「NF4デクオンタイゼーションTritonカーネル」について分かりやすく解説します。
We explain the new GPU optimization technology, 'NF4 Dequantization Triton Kernel,' which increases the speed of the latest AI models by over 1.41x.
기업들이 이미 가진 AI 인프라를 더 효율적으로 사용하는 방법, Expanse(익스팬스)가 제시하는 GPU 연산 효율화의 미래를 알아봅니다.
企業がすでに保有しているAIインフラをより効率的に活用する方法。Expanse(エクスパンス)が提示するGPU演算効率化の未来に迫ります。
How companies can use their existing AI infrastructure more efficiently; discover the future of GPU compute optimization proposed by Expanse.