コラム

【週刊 AI 懐疑論 #24】週刊 AI 懐疑論 #24:「利用率9.1%」は本当に遅れなのか

日本で生成AIを使ったことがある人は9.1%。この数字は2024年に公表されてから、「日本は周回遅れ」という話の決まり文句になりました。焦りを覚えた方も多いはずです。ただ、この数字から「とにかく使わせる」という結論に飛ぶと、現場には別の、見...
AIプロダクト

モデルの次は「環境」を共有する時代へ。Hugging Face Hubに加わったRL環境の意味

強化学習の「環境」まで、モデルやデータセットのように共有できるようになったら、何が変わるでしょうか。Hugging Faceは公式ブログ Welcome RL Environments to the hub で、強化学習(RL)の環境をHu...
AIエージェント

AIコードレビューに「共通の物差し」が登場、ReviewBenchが変える選定の前提

AIコードレビューの精度は、結局どう測るのか。導入を検討するチームが最初に突き当たる問いです。GitHub Blogの ReviewBench: An open benchmark for AI code review - The GitH...
生成AI

AI生成テキストに「透かし」は入るのか。OpenAIがEU規則への対応で研究者を先頭に置いた理由

生成AIの文章に見えない印を付ける。この話は、技術の議論から実装の段階に入りつつあります。OpenAIは Our approach to EU text provenance rules で、EUのルールの下でテキストの透かし(ウォーターマ...
LLM・基盤モデル

ChatGPTの広告は検索広告の延長なのか。ビジュアル形式と計測の拡充が示す変化

会話の中に広告が入る。それは、これまでの検索広告やバナー広告の単なる延長なのでしょうか。OpenAI が公開した Building advertising for the way people use AI は、ChatGPT に新しいビジ...
LLM・基盤モデル

6週間で3回のFlash更新、モデル選定は「一度決めたら終わり」ではなくなるのか

6週間でFlashが3回更新される状況で、「いまのモデルを選ぶ」という判断にどれだけ意味が残るのでしょうか。同じ価格のまま、能力だけが上がるGoogle DeepMindは Introducing Gemini 3.8 Flash and ...
生成AI

天気予報は「見るもの」から「組み込むもの」へ。WeatherNext 3 が示す変化

天気予報は、これから「見るもの」ではなく「自社の判断に組み込むもの」になるのでしょうか。Google DeepMind が 2026 年 9 月 3 日に公開した WeatherNext 3: Our most advanced globa...
生成AI

レポート生成を「小さく速いモデル」で回せるか。AstaBriefの公開が示す選択肢

調査レポートの下書きに、毎回フロンティア級の大規模モデルを使う必要はあるのでしょうか。Ai2は、研究支援プラットフォーム Asta で使っている高速なレポート生成モデルを公開しました。元記事は Open-sourcing AstaBrief...
AIエージェント

「完了しました」を信じない設計が、エージェント運用の次の標準になる

エージェントが「完了しました」と報告したのに、データベースを見ると反映されていない。そんな経験は、エージェントを業務に組み込み始めたチームなら一度はあるはずです。Hugging Face のブログ記事 The Agent Said It W...
AIエージェント

AIが開発の仕事を変える今、エンジニアが磨く価値のある力とは

「AIにコードを書かせる時代に、人間のエンジニアは何を磨けばいいのか」。この問いに、開発者向けプラットフォームを運営するGitHubが自社ブログで答えを出しています。GitHub BlogのAI is changing developer ...