Mastodon discussion Apr 10

【クロードにCUDAカーネルの構築とオープンモデルの指導を依頼しました!】https://huggingface.co/blog/upskill※AI生成の自動投稿(見出し+リンク)#AI #生成AI #LLM #AIGenerated

【クロードにCUDAカーネルの構築とオープンモデルの指導を依頼しました!】https://huggingface.co/blog/upskill※AI生成の自動投稿(見出し+リンク)#AI #生成AI #LLM #AIGenerated

Mastodon discussion Apr 10

【イベントレポート】「NVIDIA Gamer Day 2026」で「GeForce RTX 50シリーズ」搭載PCや本邦初公開のASUSゲーミングモニターが多数展示。岸大河さん&伊織もえさんらによる特別セッションも! | Game*Spa...

【イベントレポート】「NVIDIA Gamer Day 2026」で「GeForce RTX 50シリーズ」搭載PCや本邦初公開のASUSゲーミングモニターが多数展示。岸大河さん&伊織もえさんらによる特別セッションも! | Game*Spark https://www.yayafa.com/?p=2778134 #AgenticAi #AI #Artific...

Mastodon discussion Apr 10

Triton比6倍超の性能を30行で:MetaのHelionがAIカーネルの標準へ カーネル最適化は長年、GPUプログラミングの深い知識を持つ一握りの専門家が支配してきた領域だ。NVIDIAのCUDAでAttentionカーネルを書けば数千...

Triton比6倍超の性能を30行で:MetaのHelionがAIカーネルの標準へ カーネル最適化は長年、GPUプログラミングの深い知識を持つ一握りの専門家が支配してきた領域だ。NVIDIAのCUDAでAttentionカーネルを書けば数千行に及び、2019年にOpenAIが発表したTritonで約120行まで圧縮されても、手動チューニングの壁はほとんど変わ...

Mastodon discussion Apr 10

NVIDIA® Llama Nemotron™:推論・指示理解・チャットに強い次世代LLMの全貌|GPUサーバープラットフォームの設計/構築なら「技術力」のNTTPC https://www.yayafa.com/2777756/ #Age...

NVIDIA® Llama Nemotron™:推論・指示理解・チャットに強い次世代LLMの全貌|GPUサーバープラットフォームの設計/構築なら「技術力」のNTTPC https://www.yayafa.com/2777756/ #AgenticAi #AI #ArtificialGeneralIntelligence #ArtificialIntelli...

Mastodon discussion Apr 10

Sudo su (@sudoingX)Qwen 3.5-0.8B의 24개 레이어를 하나의 fused CUDA 커널로 처리해 CPU 왕복 없이 단일 커널 런치만으로 고성능을 달성했다는 내용이다. RTX 3090이 411 t...

Sudo su (@sudoingX)Qwen 3.5-0.8B의 24개 레이어를 하나의 fused CUDA 커널로 처리해 CPU 왕복 없이 단일 커널 런치만으로 고성능을 달성했다는 내용이다. RTX 3090이 411 tok/s로 Apple M5 Max의 229 tok/s를 앞질렀다고 소개하며, CUDA 최적화와 추론 성능 개...

Mastodon discussion Apr 10

NVIDIA対中供給再開が示す「実利」の境界線 米中摩擦下で演算の覇者が選んだ生存戦略 25%徴収金を受け入れH200を再投入 グロック連携の推論チップで販路維持へ(1/2) | JBpress (ジェイビープレス) https://www...

NVIDIA対中供給再開が示す「実利」の境界線 米中摩擦下で演算の覇者が選んだ生存戦略 25%徴収金を受け入れH200を再投入 グロック連携の推論チップで販路維持へ(1/2) | JBpress (ジェイビープレス) https://www.yayafa.com/2777752/ #AgenticAi #AI #ArtificialGeneralIntell...