生成AI・ML基盤 2026年7月7日 11:01 Inferentia2で推論コストが月280万→84万になった話|GPUからの乗り換え現実記 AWSのInferentia2を6ヶ月運用してGPUコストを70%削減。成功した理由から、実装時のハマりどころまで、チームが実際に経験した内容を赤裸々に語ります。
生成AI・ML基盤 2026年6月11日 17:02 SageMaker HyperPodで1年運用して分かったこと|スケーリング・コスト・本番障害の現実 EC2クラスタからSageMaker HyperPodに移行して1年。スケーリングの速度、コスト最適化、予想外の障害対応まで、実装チームが体験した現実を赤裸々に解説します。