momit.fm

「子育てをテクノロジーでハッピーに🌈」をコンセプトにおしゃべりする子育テックPodcast🎧

102. Agentic AI Summit 2026レポート / キーワード集計で見るエージェント開発の現在地 / モデルよりも評価基盤と組織

2026/10/8

今回は 8 月に参加してきた「Agentic AI Summit 2026」の参加レポート回。UC バークレーの研究センターが主催する、参加者約 5,000 人・登壇者 150 人超の大規模カンファレンスなのに、日本語の情報がほぼゼロ。現地の空気感から、セッションのアーカイブを AI で総ざらいして集計した"効くキーワード"ランキング、そして「エージェント導入のボトルネックはモデルでも技術でもなく、評価基盤と組織」という一言まとめまで、たっぷり語ります。


🎓 大学主催のニュートラルなカンファレンス – 主催は UC Berkeley RDI(研究センター)。ベンダーの製品発表会ではなく、研究者と実務家が同じ壇上に並ぶ"手作り感"のある 2 年目のイベント

📝 日本語情報ゼロで飛び込んだ – 行く前の不安と、「このカンファレンス自体を紹介したい」と参加レポートを書いた動機

🌟 トップオブトップの登壇陣 – OpenClaw の Peter 氏、Google DeepMind VP、OpenAI・Replit・Factory AI・GitHub Copilot…CxO と VP ばかりの 4 ステージ構成

🏫 4 つのステージの使い分け – キーノートはビジョン系、教室ステージでは CTO や AI 推進者による導入・ガバナンス・失敗談の具体事例、研究寄りの Nexus も

🤝 現地でしか得られないもの – セッションはアーカイブで見られるからこそ、空気感・熱量・話しかけてくる人たちとの交流が収穫

🇯🇵 日本のプレゼンスの低さ – アジア系は多いのに日本人はほぼ皆無。参加費 399 ドルと円安のハードル、そしてバークレーの治安は意外と良かった話

📊 キーワード集計:1 位 Evaluation、4 位 Harness – アーカイブを AI でさらって集計。Benchmark / Workflow / Security / Context / Memory…と続きく

🧠 Harness は流行語ではなく常用語 – 評価基盤とそれを制御する仕組みは、研究者もエンタープライズも共通言語として語っていた

🧱 ボトルネックは評価基盤と組織 – モデルの性能競争が一段落した今、事業 KPI に依存するエージェント評価をどう定義し、リリース後にどう早く軌道修正するか

💸 評価作業のモデル×コスト使い分け – 対話は高いモデル、評価は安いモデルに落とす。トークンとコストを可視化しながら、Claude Code でダッシュボードを整える実務の工夫


…………………………………………………………………

✨\ momit hub更新しました // ✨

【家族の予定、もう手入力しない】Slackに送るだけでGoogleカレンダーに自動登録するAI活用術

…………………………………………………………………


…………………………………………………………………

✨ 📩 フィードバック募集中!

  • ハッシュタグ #momitfm もしくは お便りフォーム でのご意見ご感想お待ちしています!📩
  • 💛 番組のフォローと⭐評価もお願いいたします!

…………………………………………………………………


✨🎧 Credits

🎙️This Show Hosted by @_yukamiya & @m2vela

🎶 Intro Crafted by @kirillovlov2983

See Privacy Policy at https://art19.com/privacy and California Privacy Notice at https://art19.com/privacy#do-not-sell-my-info.