技術の記事

AI駆動開発の実装・つまずき・設計の知見。手を動かした一次情報として綴ります。

tech技術116 · 4/13ページ
技術Grok Imagine Image 2.0とは何か ──xAIの新しい画像生成AIの機能と、「世界2位」の実際を解説

Grok Imagine Image 2.0とは何か ──xAIの新しい画像生成AIの機能と、「世界2位」の実際を解説

xAIの画像生成AI新版「Grok Imagine Image 2.0」を解説します。公式が掲げる「世界2位」はランキングの実データでも事実でしたが、根拠は1位の数十分の1の投票数による暫定順位でした。増えたのは作る機能より直す機能で、APIは未提供のため今日は業務システムに組み込めません。

甲斐ショウジ10分で読めます
技術Agent Plugins 1.0とは何か ──OpenAI・Microsoft・Amazon・Googleが合意したAIエージェント拡張機能の共通フォーマットを解説

Agent Plugins 1.0とは何か ──OpenAI・Microsoft・Amazon・Googleが合意したAIエージェント拡張機能の共通フォーマットを解説

2026年8月6日に公開されたAIエージェント拡張機能の共通フォーマット「Agent Plugins 1.0」を解説します。Amazon・Cursor・Microsoft・OpenAI・Vercelが策定しGoogleも合流。決まったのは配布用の箱の形だけで、権限・サンドボックス・署名検証は意図的に未定です。互換クライアント5つにAnthropicのClaude Codeは入っていません。

甲斐ショウジ13分で読めます
技術Claude Codeのセッション間メッセージングとは ──別々に動くAIどうしが、要点だけを渡して引き継ぐ新機能を実機で確かめた

Claude Codeのセッション間メッセージングとは ──別々に動くAIどうしが、要点だけを渡して引き継ぐ新機能を実機で確かめた

別々に動いている2つのClaude Codeが、互いに短いメッセージを送り合えるようになりました。渡るのは要点のテキスト1本だけで、会話履歴もファイルも渡りません。実際に2セッション立てて送受信を確かめ、届いた文面・届かなかったときのエラー・止め方まで整理します。

甲斐ショウジ11分で読めます
技術LFM2.5-2.6Bとは何か ──スマホの中だけで動くAIエージェントと、「トークン課金ゼロ」が成立する条件を解説

LFM2.5-2.6Bとは何か ──スマホの中だけで動くAIエージェントと、「トークン課金ゼロ」が成立する条件を解説

Liquid AIが2026年8月4日に公開したLFM2.5-2.6Bは、スマホやノートPCの中だけで動くAIエージェント向けのモデルです。メモリ2.5GBに収まりながら、ツールを使う能力では約4倍サイズのモデルと並びました。クラウドに送らない・トークン課金がかからない利点の一方、公式が「制限なく使える」と書くライセンスには年商の条件が付いています。向く仕事と向かない仕事まで解説します。

甲斐ショウジ11分で読めます
技術Cloudflare Codexとは何か ──社内ルールをAIに守らせ、4か月で23万件を指摘・1.6万件のマージを止めた仕組みを解説

Cloudflare Codexとは何か ──社内ルールをAIに守らせ、4か月で23万件を指摘・1.6万件のマージを止めた仕組みを解説

社内の技術ルールをAIに守らせる——Cloudflareがその運用実績を公開しました。4か月で約23万件を指摘し、約1.6万件では承認を出していません。効いているのはAIの性能ではなく、ルールをAIが読める単位に分解したことと、指摘だけの期間と止める期間を分けたこと。自社で始める順序まで整理します。

甲斐ショウジ11分で読めます
技術Cloudflare Wallets を解説 ──AIエージェントに「上限付きの財布」を持たせる仕組みと、今日できること

Cloudflare Wallets を解説 ──AIエージェントに「上限付きの財布」を持たせる仕組みと、今日できること

Cloudflareが2026年8月4日に発表したCloudflare Walletsは、AIエージェントに支出上限つきの「財布」を持たせる仕組みです。ただし今日開いたのは名前の予約だけで、入金も支払いも数か月後。何が新しく何がまだ動かないのか、上限・取引先リスト・1回あたりの上限という3つのガードレールの設計思想、そしてx402まわりで指摘されている安全性の課題まで、一次情報で整理します。

甲斐ショウジ13分で読めます
技術ARC-AGI-3のスコアが設定2つで3倍になった ──OpenAIの検証と、ARC側の反論を解説

ARC-AGI-3のスコアが設定2つで3倍になった ──OpenAIの検証と、ARC側の反論を解説

同じモデル・同じ問題で、API設定を2つ変えただけでスコアが13.3%から38.3%になり、出力トークンは6分の1に減りました。OpenAIが公開したARC-AGI-3の検証と、「それは公平な比較ではない」というARC側の反論を、AIを発注する側の見方に翻訳して解説します。

甲斐ショウジ11分で読めます
技術Anthropicが公開した3件の侵入事故 ──評価テスト中のClaudeが実在企業に侵入し、PyPIにマルウェアを公開するまでを解説

Anthropicが公開した3件の侵入事故 ──評価テスト中のClaudeが実在企業に侵入し、PyPIにマルウェアを公開するまでを解説

Anthropicが7月30日、評価テストの最中にClaudeが実在する3組織の本番環境へ侵入していたと公表しました。原因はモデルの脆弱性ではなく、「ネット接続はない」と伝えた環境に実際は接続があったという設定の食い違いです。PyPIに公開された偽パッケージが15台で実行された経緯と、同社が「アラインメントではなくハーネスと運用の失敗」と結論づけた理由を解説します。

甲斐ショウジ13分で読めます
技術NVIDIA主導「Open Secure AI Alliance」とは何か ──AIエージェントの安全は「どのモデルか」ではなく「土台」で決まる、という宣言を解説

NVIDIA主導「Open Secure AI Alliance」とは何か ──AIエージェントの安全は「どのモデルか」ではなく「土台」で決まる、という宣言を解説

AIエージェントの安全性は、モデルの中身が公開されているかではなく、それを動かす「土台」で決まる──2026年7月27日に発足したNVIDIA主導の業界団体は、そう主張しています。識別・権限・ハーネス・記録という6つの要素の中身、各社が持ち寄った実物、そしてCAGが名簿を突合して分かった参加社数の推移(6日で37社→74社)と、まだ来ていない4社まで解説します。

甲斐ショウジ11分で読めます