Slurm運用に慣れた私たちが、AWSのマネージドSlurm運用でつまずいた6つのこと | Tech Blog - Turingのフィード
Amazon SageMaker HyperPodでSlurmを運用し、カスタムAMIや独自設定を導入した際に直面した6つの課題と対処法をまとめた記録です。
マネージドサービスの仕様による設定上書きや初期化失敗などの実例を挙げ、プラットフォームエンジニアやSREに向けた知見を共有しています。
Slurm運用に慣れた私たちが、AWSのマネージドSlurm運用でつまずいた6つのこと | Tech Blog - Turingのフィード
Amazon SageMaker HyperPodでSlurmを運用し、カスタムAMIや独自設定を導入した際に直面した6つの課題と対処法をまとめた記録です。
マネージドサービスの仕様による設定上書きや初期化失敗などの実例を挙げ、プラットフォームエンジニアやSREに向けた知見を共有しています。
#ハイブリッド量子 #スーパーコンピューティング #ニュース
#ハイブリッド量子 #スーパーコンピューティング #ニュース
要約:
西川和久のコラムでは、古いゲーミングPCでQwen3.8-Flash-Nextモデルを動作させるための推論エンジン「Strata」の試験結果が紹介されています。Qwen3.8-Flash-NextはAlibabaが公開したマルチモーダルモデルで、総パラメータ125B、アクティブパラメータ6Bを持ち、VRAM 12GBのビデオカードでも動作することが示されています。推論エンジン「Strata」は、モデルをGPU、RAM、SSDの3層に分けて配置す...
要約:
西川和久のコラムでは、古いゲーミングPCでQwen3.8-Flash-Nextモデルを動作させるための推論エンジン「Strata」の試験結果が紹介されています。Qwen3.8-Flash-NextはAlibabaが公開したマルチモーダルモデルで、総パラメータ125B、アクティブパラメータ6Bを持ち、VRAM 12GBのビデオカードでも動作することが示されています。推論エンジン「Strata」は、モデルをGPU、RAM、SSDの3層に分けて配置す...
個人的に刺さったのはXeon Wベースってところ。マルチGPU構成でもPCIeレーン潤沢に確保できるのはやっぱり強い。ただ電源とか騒音考えると、これはもう「自作」じゃなくて「設備投資」の領域だなと。憧れはあるけど電気代でめまいがする。
#自作PC #AIワークステーション
URL:
▶ 記事の続きを読む
個人的に刺さったのはXeon Wベースってところ。マルチGPU構成でもPCIeレーン潤沢に確保できるのはやっぱり強い。ただ電源とか騒音考えると、これはもう「自作」じゃなくて「設備投資」の領域だなと。憧れはあるけど電気代でめまいがする。
#自作PC #AIワークステーション
URL:
▶ 記事の続きを読む
3人で1000GPU超を統合運用する?マルチクラウド&オンプレを跨ぐ、構築と運用のリアル!
3人で1000GPU超を統合運用する?マルチクラウド&オンプレを跨ぐ、構築と運用のリアル!
https://speakerdeck.com/kazukun0716/3-hito-de-1000gpu-chou-o-tougou-unyou-suru-o-matagu-kouchiku-to-unyou-no-riaru
https://speakerdeck.com/kazukun0716/3-hito-de-1000gpu-chou-o-tougou-unyou-suru-o-matagu-kouchiku-to-unyou-no-riaru
https://speakerdeck.com/kazukun0716/3-hito-de-1000gpu-chou-o-tougou-unyou-suru-o-matagu-kouchiku-to-unyou-no-riaru
https://speakerdeck.com/kazukun0716/3-hito-de-1000gpu-chou-o-tougou-unyou-suru-o-matagu-kouchiku-to-unyou-no-riaru
メイン画面が遅れて映る原因は、マルチモニター環境下でのDisplayPortのリンク確立(ハンドシェイク)遅延やDSC(画像圧縮技術)の認識引っかかりです。以下を順にお試しください。
モニターのOSD設定: 「DP Deep Sleep」等の省電力機能をオフにし、リフレッシュレートやDSC設定を調整する。
GPUのポート挿し替え: PG27AQDPをGPUの最優先(1番目)のDPポートに接続する。
高速スタートアップの無効化: Windowsの電源設定から「高速スタートアップ」をオフにする。
切り分け: サブモニターを外して起動し、即座につくか確認する。
メイン画面が遅れて映る原因は、マルチモニター環境下でのDisplayPortのリンク確立(ハンドシェイク)遅延やDSC(画像圧縮技術)の認識引っかかりです。以下を順にお試しください。
モニターのOSD設定: 「DP Deep Sleep」等の省電力機能をオフにし、リフレッシュレートやDSC設定を調整する。
GPUのポート挿し替え: PG27AQDPをGPUの最優先(1番目)のDPポートに接続する。
高速スタートアップの無効化: Windowsの電源設定から「高速スタートアップ」をオフにする。
切り分け: サブモニターを外して起動し、即座につくか確認する。
Nestrilabsが9月24日、KVMゲスト内でNVIDIA GPUのニアネイティブなパフォーマンスを実現するオープンソースプロジェクトvirtio-nvgpuを公開した。
https://648news.com/ai_industry/2026/09/25-nestrilabs-virtio-nvgpu-kvm-gpu-access
#AI
Nestrilabsが9月24日、KVMゲスト内でNVIDIA GPUのニアネイティブなパフォーマンスを実現するオープンソースプロジェクトvirtio-nvgpuを公開した。
https://648news.com/ai_industry/2026/09/25-nestrilabs-virtio-nvgpu-kvm-gpu-access
#AI
https://localmodelwatch.tsuchitsuchi.com/2026/09/22/nvidia-dynamo-triton-2607-tensorrt-multi-gpu/
https://localmodelwatch.tsuchitsuchi.com/2026/09/22/nvidia-dynamo-triton-2607-tensorrt-multi-gpu/
#量子エラー訂正 #ハイブリッド量子コンピューティング #ニュース
#量子エラー訂正 #ハイブリッド量子コンピューティング #ニュース
AWSのマルチAZでも一部データを復旧できず
OpenAIがモデルの異常行動6件を公表
Windows 11のローカル移行機能を廃止
Edge 153はChrome修正後もフリーズ継続
Qwen3.8-27Bが24GB級GPUで動作
RTX 6090の発売時期を巡りリーク対立
Ubuntu 26.10の基本コマンドがRustへ
AppleがM8 Ultra搭載AIサーバーを検討
9歳児の広告費1,830万円、父親が経緯を説明
Excel更新後、貼り付けが無言で失敗
note.com/joho_no_toda...
AWSのマルチAZでも一部データを復旧できず
OpenAIがモデルの異常行動6件を公表
Windows 11のローカル移行機能を廃止
Edge 153はChrome修正後もフリーズ継続
Qwen3.8-27Bが24GB級GPUで動作
RTX 6090の発売時期を巡りリーク対立
Ubuntu 26.10の基本コマンドがRustへ
AppleがM8 Ultra搭載AIサーバーを検討
9歳児の広告費1,830万円、父親が経緯を説明
Excel更新後、貼り付けが無言で失敗
note.com/joho_no_toda...
CGE Sculpting Tool for Maya
3dnchu.com/archives/cge...
by CGElementary (Morteza Ahmadi)
#Maya3d
CGE Sculpting Tool for Maya
3dnchu.com/archives/cge...
by CGElementary (Morteza Ahmadi)
#Maya3d
多数の演算コアで処理能力を高めるCell の登場は業界に衝撃を与えた。インテル やAMD などCPUベンダー、さらにはGPUベンダーまでもが、シングルスレッド性能の追求からマルチコア化による処理能力向上へと舵を切るきっかけとなった。GPUを汎用処理にも使う「GPGPU」という発想も、この流れの延長線上にある。
多数の演算コアで処理能力を高めるCell の登場は業界に衝撃を与えた。インテル やAMD などCPUベンダー、さらにはGPUベンダーまでもが、シングルスレッド性能の追求からマルチコア化による処理能力向上へと舵を切るきっかけとなった。GPUを汎用処理にも使う「GPGPU」という発想も、この流れの延長線上にある。