LLMの評価を性能に変える3つの行き先
LLMアプリやエージェントの評価についての記事は増えましたが、評価は測って終わりではありません。スコアやフィードバックを「どこに反映するか」で、その先の改善手法は大きく分岐します。 この記事は、評価シグナルをAIシステムの改善に繋げる手法を
LLMアプリやエージェントの評価についての記事は増えましたが、評価は測って終わりではありません。スコアやフィードバックを「どこに反映するか」で、その先の改善手法は大きく分岐します。 この記事は、評価シグナルをAIシステムの改善に繋げる手法を
mdBook でドキュメントを書いていて、組み込みの検索ボックスに日本語を打ってもほとんどヒットしない、という経験はないでしょうか。英単語なら見つかるのに、東京 や 検索 と入力しても何も出てこない。 これは「mdBook が日本語に対応し
はじめに 本記事は連載「ESP32でWASMアプリを動かす」MP3プレーヤー編の第 9 回です。編の全体像と到達点は第 8 回: MP3プレーヤーアプリをつくるへ。 ここからは Phase 6「MP3 プレーヤーの WASM アプリ化」に入
W杯リアタイ勢をやり切って体調と生活リズムが終わってしまいました。 fujitani sora です。 Grok Build のforkにパッチを当てて手元のマシンで使う運用についてです。 現状は外部PR不可であるため、この対応にしています
タイトルの「月18万行」はリファクタリングに伴うコードの移動や削除も含んだ数字なので、生産性の指標としてはあまり参考になりません。キャッチーなのでタイトルに使いましたが、インパクト重視の数字だと思って読んでください。本記事で伝えたいのは行数
1999 年、Quake III Arena のソースコードから発見された 魔法定数 0x5f3759df による逆平方根 (1/√x) 実装は、当時の CPU (fsqrt が 30+ cycles かかった時代) で圧倒的な高速化を実現
Sakana AIは2026年7月21日、同社が提供するAIオーケストレーションモデル「Sakana Fugu」をアップデートし、サイバー防御機能を特別に強化した「Fugu-Cyber」をリリースした。
2026年7月17日にSALT2で開催された社内勉強会「Youki から学ぶ OS / Container 技術入門」で、青柳さんがOSの役割、仮想マシンとコンテナの違い、コンテナランタイムの構造を解説しました。本稿では、Youkiを入口に
Windows 向けの軽量な解凍・圧縮ソフト「Karuzip」を個人開発して公開しました。技術構成は Tauri 2 + Rust + 同梱 7-Zip(子プロセス呼び出し)、フロントはフレームワークなしの純 HTML/CSS/JS です。
同じ官公庁の研究申請フォーム(セル内で回転したラベル)を Word・Oxi・LibreOffice・SILURUS で描いたもの 要約 Rust + WebAssembly で .docx レンダリングエンジン Oxi を書いていま
「今期、あなたの成果は何でしたか?」 評価面談で、誰もが一度は詰まる質問です。 「PR を 120 個マージしました」と答えた瞬間の、あの微妙な空気を経験したことがある人も多いのではないでしょうか。数字としては立派なのに、言った本人も聞いた
はじめに 1日中 AI が自分の手を離れて、自分が欲しいものを作り続けてくれたら... この記事は2つの話を1本にしたものです。 作ったもの: VS Code上でMarkdownをWYSIWYG編集[1]できる拡張機能 作り方:
はじめに Unity公式のCLIであるUnity CLIがリリースされました。 https://unity.com/ja/blog/meet-the-unity-cli 今回はUnity CLIのインストール方法、AIエージェントの連携に
Oblien LLCは2026年7月18日、オープンソースのデプロイメントプラットフォーム「OpenShip」をApache 2.0ライセンスのもとGitHub上で公開した。
OpenTelemetry と聞くと、サーバーサイドのトレースやメトリクスを集めるためのもの、という印象を持っている人は多いと思います。実際、バックエンドでは OpenTelemetry を使った計装をよく見かけるようになりました。 一方で
こんにちは、株式会社estie(エスティ) 取締役CTO の Nari (@tiwanari)です。 みなさんはコードレビューにAIツールを活用されているでしょうか?汎用のAIコードレビューツールは便利なのですが、自社のコードにおける書き振
レプリカ遅延を確認するときは、SHOW REPLICA STATUSのSeconds_Behind_Sourceをよく見ます。ただし、この値だけでは遅延の原因まではわかりません。
第81回目は、モデルを作っていくときに意識するといい点について見ていきます。
はじめに 技術関係のメモをNotionからObsidianに移行し、すでに契約していたAIサブスク(ChatGPT / Claude)の利用範囲内で、AIがメモを整理してくれる環境を作りました。この記事では、自分とまったく同じ環境を再現する
LLMの学習で「AIの評価を報酬にする」手法が主流になりつつあります。人間の代わりにLLMが応答を採点し(RLAIF: Reinforcement Learning from AI Feedback)、そのスコアでモデルを強化学習する。De