生成AI・ML基盤 2026年7月13日 11:02 月380万のGPU請求から脱出|Inferentia2導入で70%コスト削減した6ヶ月の記録 SageMaker推論費380万→114万へ。AWS Inferentia2・Trainiumへの乗り換えで何が変わったのか、実装の落とし穴と本番運用データをすべて公開します。
生成AI・ML基盤 2026年6月13日 17:02 Bedrock Fine-tuning本番6ヶ月で直面した、データ準備・コスト・精度の現実的な課題 BedrockのFine-tuning機能を実際に本番運用して6ヶ月。ドキュメントに書いてないデータセット準備の落とし穴、想定外のコスト、推論精度の失敗を赤裸々に共有します。
生成AI・ML基盤 2026年6月2日 08:04 Inferentia2・Trainium2を本番導入して6ヶ月、GPUコスト70%削減できた話 「このGPU代、持続可能なのか…」と思いながら運用してませんか?うちのチームがInferentia2・Trainium2に移行して気づいたコスト効率の現実と、ハマりポイントを実測データで。
生成AI・ML基盤 2026年6月1日 14:04 Bedrock モデル評価を本番で半年やって気づいた、比較の落とし穴と実務的な選び方 「ベンチマーク見てClaude一択でしょ」と思ってたら全然違った。本番トラフィックで半年回してわかった、コスト・レイテンシ・精度の実態と、今の構成に落ち着くまでの話。