Blogs
How We Cut GPU Inference Cost by ~75%: Async, Autoscaled Diffusion on GKE
By Sandeep Kumar Nayak — AI Engineer at Gaudiy A technical deep-dive on how a single oversized GPU turned into ~90% of a bill, and the four changes that brought it back down. Framing note. This is a s
GKE から Cloud Run に戻した話
はじめに こんにちは、SRE のあんどう(@Andoobomber)です。 突然ですが、2024 年に「Kubernetes 初学者が担当した GKE 移行プロセスの全貌」という記事を書きました。Cloud Run で動いていた弊社のプロダクトを GKE に移行した、というお話です。 あれから約 2 年。今度はその逆をやりました。 つまり、GKE で動かしていたプロダクトを、もう一度 Cloud
GenJAX: Probabilistic Programming with Programmable Inference
GenJAX: プログラマブル推論を備えたプロバビリスティック・プログラミング
そのLLMアプリ、正しく評価できてますか?:クロスオーバーA/Bテストのすゝめ
この記事は#GauDev Advent Calendar 2025の23日目です。 こんにちは!GaudiyのPdM、MLエンジニアのたつきーぬと申します。 みなさん今日も元気にLLMアプリ、改善してますか? LLMアプリの開発では、言うまでもなく 「評価」 が大事ですよね。 そして評価には大きく分けて、オフライン評価 と オンライン評価 があります。 ただ、昨今のLLMアプリ開発では 「とにかく
React Native でリッチエディタどうする?Lexical WebView 実装という選択肢
こんにちは☄️ Gaudiyでプロダクトエンジニアとしてプロダクト開発に携わっている Sho です。 この記事は、#GauDev Advent Calendar 2025 の 22 日目の記事です🎄 はじめに 僕が携わっているプロジェクトでは Web アプリのリッチエディタに Lexical を採用しています。 画像やリンク表示・区切り線などのカスタムノードも実装しています。 Webアプリ