Trend Digest

元 OpenAI の David Robinson による安全文化への批判が Techmeme の首位に入り、Hacker News では Flock の検索を「無差別な大量監視」とした判決と、Aleph Alpha のオープンウェイトモデル Kolibri が上位を占める

Techmeme では、OpenAI の Safety Systems チームを退社した David Robinson が The Atlantic への寄稿でシリコンバレーには安全を中心に据えた文化が欠けていると論じた件が首位、退社を伝える Business Insider の記事が 2 位となり、Hacker News でも The Guardian の記事が上位 10 件に入った。Hacker News では、警察による Flock のナンバープレート検索を連邦判事が「無差別な大量監視」とした件が首位で Techmeme にも並び、Aleph Alpha のオープンウェイトモデル Kolibri が 496 ポイント・298 コメントで最多のエンゲージメントを集めた。日本では、はてなブックマークで韓国の銀行 6 行への AI を使ったとみられる攻撃が首位に入り、日本語推敲スキル yomiyasu の公開記事が Zenn で、yomiyasu を含む 3 つの推敲スキルの比較記事が Qiita で首位となった。

  1. 1
    元 OpenAI の安全・政策担当 David Robinson:シリコンバレーには安全を中心に据えた文化が欠けており、ラボは他分野の安全対策に学ぶべきで、試行錯誤の時代は終わった(新しいタブで開く)TechmemeDavid Robinson, ex-OpenAI safety and policy: SV lacks a safety-centric culture; labs must study other fields' safety approaches; time for trial and error's overTechmeme の首位で、同じ退社を伝える Business Insider の記事が 2 位に入った。Hacker News でも The Guardian の記事が 89 ポイント・45 コメントを集め、2 サービスにまたがった
  2. 2
    Kolibri:主権型のオープンウェイトモデル(新しいタブで開く)Hacker NewsKolibri: A Sovereign Open-Weight ModelHacker News で 496 ポイント・298 コメントと当日最多のエンゲージメントを集めた。新しいオープンウェイトモデルという高関心テーマに該当する
  3. 3
    Claude と Claude Code で Opus 5.5 を最大限に活用する方法(新しいタブで開く)Hacker NewsGetting the most out of Opus 5.5 in Claude and Claude CodeHacker News で 155 ポイント・114 コメント。Claude Code での Opus 5.5 の使い方を扱い、AI コーディングエージェントという高関心テーマに直接該当する
  4. 4
    新しい日本語推敲スキル「yomiyasu」がバズっていたので、Claudeで日本語推敲スキル3つを比べてみた(新しいタブで開く)QiitaQiita の首位で、はてなブックマークでも当日最多の 419 users を集めて 2 位に入った。比較対象の yomiyasu の公開記事は Zenn で 3 日続けて首位となり、3 サービスにまたがった
  5. 5
    韓国6行に「AIハッキング」、4行で個人情報流出(新しいタブで開く)はてなブックマークはてなブックマークで 179 users の首位。上位 10 件にはアバハウスの全顧客情報の漏えい疑いや Codex Security・Claude Security の入門記事も入り、AI とセキュリティの両テーマに該当する
78件38件

グローバル

Hacker News

10件
1

Federal judge calls Flock 'indiscriminate mass surveillance'

米国の連邦判事が、警察官による Flock のナンバープレート検索を「無差別な大量監視」と呼び、令状を取るべきだったとして違憲と判断したことを伝える TechCrunch の記事。

コメントの要約

米国の連邦判事が、保安官代理が Flock のナンバープレート読み取り網で車の移動履歴を検索した行為を「無差別な大量監視」と呼び、令状を取るべきだったとして違憲と判断したことを伝える TechCrunch の記事。同じ判決は Techmeme でも 404 Media の記事として上位に入った。

コメントでは、保安官代理が女性の移動履歴を車両捜索の根拠の一つにし、約 91 ポンドの覚醒剤が見つかったとされる経緯を挙げ、技術が本来の役目を果たした例でもあり勝利とは言い切れないという見方が出た。公道での行動は公開されており、警察が自らのデータを調べるのは捜索に当たらないという反論もあった。

一方で、指定したナンバーに一致したときだけ記録する仕組みにすべきだという提案や、裁判所の命令がある場合に限って照会を認めるなど厳しく規制すべきだという声、街頭での被害を見てきた経験から Flock を擁護しつつ警官の増員の方が望ましいという意見も並んだ。

プライバシー/監視techcrunch.com268pt / 168コメントコメントを見る(新しいタブで開く)スコア 97
2

Kolibri: A Sovereign Open-Weight Model

ドイツの Aleph Alpha が公開したオープンウェイトの言語モデル。コメントによればアクティブパラメータは 3B で、技術レポートも併せて公開されている。

コメントの要約

ドイツの AI 企業 Aleph Alpha が、「主権型(sovereign)」をうたうオープンウェイトモデル Kolibri を公開した発表記事で、技術レポートも公開されている。コメントで引用された記事の記述によれば、知識量やマルチターンのツール呼び出し、コーディングエージェントとしての性能が劣ることを自ら挙げ、「ドイツ語で考える」点も特徴として書いている。

コメントでは、RTX Pro 6000 で FP8 を動かし、アクティブパラメータ 3B のため毎秒約 170 トークンと速い一方、考えすぎてトークンを使いすぎるという報告があった。弱点を並べた記述を引いて何が得意なのかを問う声や、取り組んでいる領域を考えればベンチマークは健闘しているという評価も出た。

Aleph Alpha は人材が抜けて他のラボに追いつけず投資家向けの存在になったという厳しい意見や、ドイツの利用者として期待しているのは Mistral と Black Forest Labs だという声も並んだ。

ハイライトAI/LLMaleph-alpha.com496pt / 298コメントコメントを見る(新しいタブで開く)スコア 94興味マッチ度 3
3

Hole Punch: Sling your spaceship around gravitational fields

画面上に重力源となる穴を置いて質量を足し、その重力で宇宙船の軌道を曲げて飛ばすブラウザゲーム。使える質量には限りがある。

コメントの要約

重力場で宇宙船を振り回すブラウザゲーム Hole Punch の紹介ページ。コメントによれば、クリックし続けることで穴に質量を足していく操作で、使える質量には限りがある。

コメントでは、楽しい、面白い発想だという反応が多く、「スペースゴルフのよう」という感想や、星やブラックホールの間で投射物を撃ち合うターン制の Scorched Earth 風にする案も出た。今年は昔のブラウザゲームや Flash ゲームが形を変えて戻ってきているという見方もあった。

改善点としては、質量を足しすぎたときに減らしたり穴を消したりできない点への不満や、Safari ではクリックで質量が速く減りすぎるため数値で入力したいという要望、実行中に時間を早送りするキーを求める声、デスクトップ向けでタッチ操作に対応していないという指摘が並んだ。

ゲームnotoriousbfg.com219pt / 57コメントコメントを見る(新しいタブで開く)スコア 92
4

Getting the most out of Opus 5.5 in Claude and Claude Code

Anthropic が claude.dev のブログで公開した、Claude と Claude Code で Opus 5.5 を使いこなすための指針。コメントでは 1 時間を超える長時間タスクを任せられるという評価が出た。

コメントの要約

Anthropic が claude.dev のブログで公開した、Claude と Claude Code で Opus 5.5 を使いこなすための指針。コメントで引かれた記述には「返答の中で推論を示すよう求めない」という項目と、「このアプローチを選んだ理由を 3 文で説明して」という指示例がある。

コメントでは高い評価が目立ち、1 時間を超える長時間タスクを任せられた最初のモデルだという声や、CI の高速化を指示して計画を Fable のサブエージェントに確認させた事例、1 週間で 3 か月分の作業が進んだという報告が出た。Java から Node.js へのリファクタリングで Fable に近い品質をより安く得られたという比較もあった。

一方で、大きなタスクを並列化させたら Max プランの週間トークンを約 1 日で使い切ったという報告や、リリース前の週に Opus 5 がループでトークンを浪費していたという指摘、サブエージェントの起動もモデル自身が判断すべきで GPT 6 系は自動で行うという意見が並んだ。

ハイライトAI/開発claude.dev155pt / 114コメントコメントを見る(新しいタブで開く)スコア 90興味マッチ度 3
5

FTL: A new operating system for clouds

クラウドでの利用を想定した新しい OS。コメントによれば Rust で書かれ、Linux 互換レイヤーで Linux のプログラムを動かせる。v0.1.0 が公開された。

コメントの要約

クラウドでの利用を想定した新しい OS FTL のサイトで、ソースは GitHub の nuta/ftl で公開されている。コメントによれば、v0.1.0 で非同期 Rust(マルチスレッドの Tokio ランタイム)への対応と、Linux 互換レイヤーの不足部分が多数追加された。

コメントでは、Linux のプログラムを動かして自分のサイトを配信できるだけの機能を持つマイクロカーネル風の設計だという理解や、ユニカーネルなのかを問う声、Unikraft よりも gVisor に近く、システムコールの横取りがより速いのではという見方が出た。

KVM のゼロデイと VM エスケープの脆弱性が出ている今、メモリ安全でレガシーを持たない新しい OS を検討する時期だという意見や、Rust 製なのにサイトでそれを打ち出していないことに触れる投稿、Linux の発表文をもじった「ただの趣味で GNU のように大きくはならない?」という冗談、ASCII アートの図が崩れているという指摘も並んだ。

OSftl-os.org145pt / 58コメントコメントを見る(新しいタブで開く)スコア 87
6

We want you to build the next Git platform on Cloudflare

Cloudflare が、数百から数千のエージェントが同じコードベースで同時に作業する時代の Git プラットフォームを自社基盤上で作るよう呼びかけたブログ記事。

コメントの要約

Cloudflare が、AI エージェント時代の次の Git プラットフォームを Cloudflare 上で作るよう開発者に呼びかけたブログ記事。コメントで引用された本文は、数百、数千のエージェントが同じコードベースで同時に作業する世界で基盤はどうあるべきかを問いかけている。コメントによれば賞金は 2.5 万ドル。

コメントでは、1,250 億ドル企業が次の GitHub を 2.5 万ドルで作らせるのは安すぎるという指摘や、エージェントを好き勝手に動かすと混乱の管理が増えるという見方が出た。そもそも数百のエージェントが必要なのかを先に問うべきだという意見や、エージェント向けならエージェント自身に挑戦させればいいという皮肉もあった。

特定の企業が製品のライフサイクルを握らない分散型にしてほしいという要望や、億万長者のプラットフォームに頼らず机の下のコンピュータで作ればいいという反応、米国のインフラはもう使わないという声も並んだ。

AI/開発blog.cloudflare.com97pt / 87コメントコメントを見る(新しいタブで開く)スコア 82興味マッチ度 2
7

OpenAI safety leader quits, warning AI company's culture is 'broken'

OpenAI の安全部門のリーダー David Robinson が退社し、同社の文化は「壊れている」と警告したことを伝える The Guardian の記事。Techmeme でも本人の寄稿と退社の報道が 1、2 位に入った。

コメントの要約

OpenAI で安全対策に携わっていた David Robinson が退社し、同社の文化は「壊れている」と警告したことを伝える The Guardian の記事。Techmeme では本人の The Atlantic への寄稿が首位に入った。記事は、最先端のラボは原子力発電所や空港のように冗長な安全層を持って運営すべきだという本人の主張を引いている。

コメントでは、その主張は規制による参入障壁づくりに見えるという指摘や、サンドボックスの強化のような実務的な安全と、Roko's Basilisk のような終末論的な安全のどちらの担い手なのかを問う声が出た。「超人的な AI の開発で全員が死ぬ確率は約 50%」という引用に根拠を問う投稿もあった。

株式の権利確定まで勤めてから声を上げるのは偽善的だという批判や、安全の担当者は EA フォーラムより実際のサイバーセキュリティの教科書を読むべきだという意見、AI 企業向けに学習データを作っていた経験から OpenAI の案件が最も有害だったという証言も並んだ。

AItheguardian.com89pt / 45コメントコメントを見る(新しいタブで開く)スコア 77興味マッチ度 2
8

The work by Valve's Timur Kristóf on improving old AMD GPUs on Linux

Valve の Timur Kristóf が XDC 2026 で発表した、Linux 上で古い AMD GPU の動作を改善する取り組みを紹介する Phoronix の記事。

コメントの要約

Valve に所属する Timur Kristóf が X.Org の開発者会議 XDC 2026 で発表した、Linux で古い AMD GPU の動作を改善する取り組みを紹介する Phoronix の記事。コメントには講演動画のタイムスタンプ付きリンクも投稿された。

コメントでは、こうした改善が LLM の推論にも生かせれば、廃棄されるはずの GPU を推論に使えるようになるのではという期待が出た。中古で買った携帯ゲーム機 Ayaneo 2 の RDNA 2 世代のモバイル GPU が Linux 上で Windows より速く滑らかに動き、最新の AAA タイトル以外はほぼ快適だという報告もあった。本来は AMD 自身がこうした作業をすべきだという声も出た。

Linux/GPUphoronix.com100pt / 11コメントコメントを見る(新しいタブで開く)スコア 74
9

Celebrating the 100th birthday of the kidney donated to him as a teenager

10 代のときに母親から腎臓の提供を受けた米国の男性が、その腎臓の 100 歳の誕生日を祝ったという地元局 WHEC のニュース。

コメントの要約

10 代で母親から腎臓の提供を受けた男性が、その腎臓の 100 歳の誕生日を祝ったという米国の地元局 WHEC のニュース。コメントによれば、母親が存命なら 100 歳になることから腎臓も 100 歳とみなしている。手術の日、2 人はストレッチャーの上で手を握り、母親は Genesis のコンサートに行くから心配いらないと言い、実際に 2 人ともコンサートに行けたという。

コメントでは、自身も 16 歳で母親から腎臓を受け 19 年もったという経験談や、2000 年に父親へ腎臓を提供し 23 年の時間をもたらしたという投稿が寄せられ、それらと比べて極めて長く機能している臓器だという指摘が出た。

移植された臓器は受け手の生物学的な年齢に同期するという観察を紹介する投稿や、提供を受けた人が亡くなった後に同じ臓器が 3 人目に移植される例はあるのかという疑問も並んだ。

whec.com136pt / 40コメントコメントを見る(新しいタブで開く)スコア 71
10

Reasons I didn't become an EMT, ranked

長年 EMT(救急医療技術者)を目指しながら言い訳を重ねて先延ばしにしてきた理由を、順位付けで振り返った個人ブログ。

コメントの要約

長年 EMT(救急医療技術者)になりたいと思いながら、何年も言い訳を重ねてきた理由を順位付けで振り返った個人ブログ。投稿者はコメントで、先延ばしにしていることに踏み出すきっかけになればと書き、最悪でも楽しめるかもしれないと添えている。

コメントでは、救急医療の現場の負担に触れる投稿が目立った。EMT から救急救命士になった友人がある日辞めて資格も更新せず、理由を語らないという話や、元同僚がひどい PTSD を抱え、この職業ではそれがありふれているうえ、BC 州の救急サービスは支援が必要な職員を冷遇するという証言が出た。

消防士を目指したが時間のかなりの部分が募金活動に充てられると知ったという体験や、血を見るのが苦手で人ではなく木や車やコンピュータを扱う仕事を続けているという声、医師が監修する Coursera の講座で講習内容を事前に確かめられるという情報も並んだ。

ben.stolovitz.com75pt / 29コメントコメントを見る(新しいタブで開く)スコア 70

Lobsters

10件3件
1

I got targeted: Trying to get your credentials via a git post-checkout hook

著者が、Git の post-checkout フックを悪用して認証情報を盗もうとする攻撃の標的になった経験を書いたブログ記事。前日にも上位に入っていた。

コメントの要約

著者が、Git の post-checkout フックを悪用して認証情報を盗み取ろうとする攻撃の標的になった経験を書いたブログ記事で、前日にも上位に入っていた。Lobsters ではセキュリティとバージョン管理のタグが付いている。

コメントでは、さらに悪質な手口として、.git/config の core.fsmonitor に悪意あるコマンドを設定して配る方法が挙げられ、git status のような基本的な操作でも実行されると指摘された。これに対し、clone では悪意ある設定は入らず、警戒すべきは clone 以外の方法でディレクトリ一式を受け取る場合だという補足があった。

フックはリポジトリにコミットできず各クローンに閉じているという説明や、direnv のように allow コマンドで許可するまでフックを実行しない仕組みが Git にあればという提案が出た。他人のフックや direnv の設定を強制されるのは自律性を奪ううえセキュリティ上の問題にもなるとして、フックは自分で書くという声もあった。

セキュリティfrankwiles.com107pt / 37コメント既出コメントを見る(新しいタブで開く)スコア 87興味マッチ度 2
2

Zig 0.17.0 Release Notes

プログラミング言語 Zig 0.17.0 のリリースノート。前日に続き上位に入り、コメントではメモリを再利用しない SafeAllocator や i0 型の削除が話題になった。

コメントの要約

プログラミング言語 Zig 0.17.0 のリリースノートで、前日にも複数のサービスで上位に入っていた。コメントでは、メモリを再利用しない SafeAllocator や i0 型の削除などが取り上げられた。

今後予定されているビルドサーバープロトコルと ZLS の作業に期待する声や、言語設計にとどまらない丁寧な作業を続けるコアチームの姿勢を評価する投稿が出た。i0 型が存在した理由と今回削除された経緯を議論した issue へのリンクも共有された。

SafeAllocator は背後のアロケータがメモリを再利用しなければ自らも再利用しないとあり、Web サービスのような長時間動くプロセスでメモリを使い果たすのではという疑問が出た。仮想メモリにより再利用せずにページを解放できるという説明と、64 ビットのアドレス空間でも割り当て頻度次第で 4GB は簡単に消費するという補足が続いた。

プログラミング言語ziglang.org119pt / 13コメント既出コメントを見る(新しいタブで開く)スコア 87
3

Actual RFC1149 packet being auctioned

伝書鳩で IP パケットを運ぶエイプリルフールの規格 RFC1149 に従って実際に送られたパケットが、Christie's のオンラインオークションに出品されている。

コメントの要約

伝書鳩で IP パケットを運ぶエイプリルフールの規格 RFC1149 に従って実際に送られたパケットが、Christie's のオンラインオークションに出品された。コメントによれば、送ったノルウェーの Bergen Linux User Group(BLUG)は、IP パケットがフレームに包まれて送られるのになぞらえ、パケットを物理的な額縁(フレーム)に入れていた。

コメントでは、IP over Avian Carrier や Hypertext Coffeepot Control のような遊び心が、エージェント同士が「会話」する時代にインターネットが人のために作られたことを思い出させるという声が出た。2001 年に Bergen で Linux に夢中だった 15 歳だったという投稿者の思い出話もあった。

自分で伝書鳩の RFC1149 パケットを送りたいという投稿や、QoS の RFC2549 と IPv6 の RFC6214 もあるという補足、存命中に数千ドルで売るのは不思議だという意見も並んだ。

ネットワークonlineonly.christies.com92pt / 10コメント既出コメントを見る(新しいタブで開く)スコア 82
4

The Era of Software Quality, or the Era of Ostriches?

GNOME のブログに掲載された、ソフトウェアの品質とセキュリティを論じる記事。コメントで引かれた本文は、現状の最善策は言語のパッケージマネージャーを使わないことだと述べている。

コメントの要約

GNOME 開発者のブログに掲載された、ソフトウェアの品質とセキュリティを論じる記事。コメントで引用された本文は、Rust はメモリ安全性の問題をほぼ解消し、C や C++、Vala の同等のプロジェクトより脆弱性が 1 桁少ないと見込めるとする一方、現状の最善策は言語のパッケージマネージャーを使わないことだと述べている。

コメントでは、著者がパッケージマネージャーの利用と依存関係の無秩序を混同しているという指摘が出た。Rust は Cargo に縛られず make や cmake でもビルドでき、cargo vendor で依存をベンダリングできるという反論や、言語ではなくエコシステムの問題だという整理もあった。

依存の数については、複雑な GUI アプリで数百から 1,000 以上の依存を引き込んだ例が示された一方、サプライチェーン攻撃の観点では依存の数よりパッケージ作者の数が重要だという意見も出た。

セキュリティ/開発blogs.gnome.org24pt / 37コメントコメントを見る(新しいタブで開く)スコア 79興味マッチ度 2
5

The Four Horsemen of Agentic Coding

エージェント型コーディングの問題を「黙示録の四騎士」になぞらえて論じた記事。前日に続き上位に入り、コメントでは人がコードを理解する速度がボトルネックだという議論が出た。

コメントの要約

エージェント型コーディングの問題を「黙示録の四騎士」になぞらえて論じた Substack の記事で、前日にも上位に入っていた。エージェント型コーディングに比較的寛容だという投稿者からも高く評価されている。

その投稿者は、エージェントを仮想のペアプログラミング相手に限定し、コードの半分は自分で書く運用を紹介した。本当のボトルネックはコードを書くことではなく問題とコードを理解することで、理解より速くコードを生むものは問題になるという考えで、Opus 5.5 や Fable はやりすぎてコードで溺れさせるという返信には、単純なモデルを使うのは自分を正直に保つためだと答えている。

LLM 向けのコメントをエディタに書くと同じバッファに返答が書き込まれる自作ツール sidekick を紹介する投稿や、pi ハーネスに Claude Code の learning 出力スタイルを模したプラグインを入れたら自分で書くコードが半分よりずっと少なくなったという報告も並んだ。

AI/開発distantprovince.substack.com56pt / 22コメント既出コメントを見る(新しいタブで開く)スコア 79興味マッチ度 3
6

The forgetful CPU (Linux on M4)

Apple M4 チップで Linux を動かす取り組みを書いたブログ記事。リバースエンジニアリングを伴う内容で、前日にも上位に入っていた。

コメントの要約

Apple M4 チップで Linux を動かす取り組みを書いたブログ記事で、Lobsters ではハードウェア、Linux、リバースエンジニアリングのタグが付いた。前日にも上位に入っており、63 ポイントを集めている。

コメントは 1 件のみで、関連するプロジェクトとして、M4 向けの Asahi Linux のフォーク Gravity Linux が紹介された。

Linux/ハードウェアyuka.dev63pt / 1コメント既出コメントを見る(新しいタブで開く)スコア 76
7

Lobsters Interview with Sjamaan

Scheme 処理系 CHICKEN に携わる Sjamaan こと Peter Bex へのインタビュー。CHICKEN を選んだ理由として、Cheney on the MTA という技法に触れている。

コメントの要約

Lobsters のユーザー Sjamaan こと Peter Bex へのインタビュー記事で、Scheme 処理系 CHICKEN への関わりが話題の中心になっている。「なぜ CHICKEN か」という問いには、Cheney on the MTA という技法を使う、知られている限り 2 つしかない処理系の一つだと答えている。

コメントでは、CHICKEN が今も C にコンパイルして CPS で継続を実装し、C スタック上に alloca で割り当て、スタックの溢れをきっかけにコピーする方式を使っているのかという質問が出て、インタビュー中の回答が示された。

一時期 CHICKEN を使い、純粋な Scheme の中では最も好ましいが Lisp 全体では Racket を選ぶという声や、学部時代に 4 系を使い、最近 5.4 の r7rs モードで自作言語に取り組み直しているとして貢献に感謝する投稿もあった。

プログラミング言語alexalejandre.com51pt / 4コメントコメントを見る(新しいタブで開く)スコア 73
8

gVisor is being donated to CNCF

Google が開発するコンテナ向けサンドボックス gVisor を CNCF に寄贈すると発表した公式ブログ記事。Linux カーネルへのパッチが断られてきた経緯にも触れている。

コメントの要約

Google が開発するサンドボックス gVisor を CNCF に寄贈すると発表した公式ブログ記事。コメントで引かれた本文によれば、性能改善のための Linux カーネルパッチを上流に送ったが、gVisor が Google の単独所有のプロジェクトであることを理由にメンテナに断られてきたという。記事は macOS で gVisor を動かせることにも触れている。

コメントでは、その経緯と CNCF への寄贈を合わせて「人質のよう」に見えるという声が出た。これに対し、複数の利害関係者の問題を解決する貢献だけを受け入れるのが Linux カーネルの原則だという説明や、その原則が一貫して適用されていないという皮肉、カーネルの規約に沿っていない巨大なパッチ群だったという記憶も示された。

技術面では、ptrace より速くホストに KVM を必要としない systrap バックエンドを中間解として評価する声や、Windows など他の OS で Linux 互換を得る手段にならないかという期待も並んだ。

インフラ/セキュリティgvisor.dev38pt / 7コメントコメントを見る(新しいタブで開く)スコア 72興味マッチ度 2
9

Updates to Full Disk Access in macOS

Apple が開発者向けに、AI エージェントがもたらすリスクを受けて macOS のフルディスクアクセスに新たな制限を設けると告知した記事。前日に続き上位に入った。

コメントの要約

Apple が開発者向けニュースで告知した macOS のフルディスクアクセスの変更。AI エージェントがもたらすリスクに対応するための新たな制限で、前日には同じ件が Techmeme の首位にも入っていた。

コメントでは、AI エージェントを使わずに Snow Leopard 時代のように UNIX のパーミッションだけで管理したいという声が出た。これに対し、それではホームディレクトリから暗号資産のウォレットや SSH 鍵を盗むマルウェアを防げないという反論があり、マルウェアは自分で防げるという再反論にも「誰もがそう思っている」と返された。

ケイパビリティは乗っ取られた上流の依存から守るためのもので、npm の更新ひとつで被害に遭いうる以上、サンドボックス化されたアプリモデルは 20 年前に必要だったという意見や、iOS のように利用者を締め出すのが解決策なのかという反発、SSH 鍵は OpenSSH 8.2 から使える FIDO U2F の ed25519-sk 鍵で守れるという補足も並んだ。

AI/セキュリティdeveloper.apple.com21pt / 31コメント既出コメントを見る(新しいタブで開く)スコア 64興味マッチ度 3
10

The hidden design compromises of Docker layers

Docker イメージのレイヤーの仕組みと、その設計に含まれる妥協点を詳しく解説した長文の記事。前日にも上位に入っていた。

コメントの要約

Docker イメージのレイヤーがどう作られ、その設計にどんな妥協が含まれているかを解説した長文の記事で、前日にも上位に入っていた。コメントには著者本人も参加している。

コメントでは、興味深い実装の詳細だが 2 段落で書ける内容だという感想が出て、著者は冒頭に要約を置くべきだったと応じた。チートシートの節がその役割を果たせるという声もあり、ディレクトリのホワイトアウトが抜けているという指摘や、シーク可能な tar と遅延読み込みへの関心も示された。

新しいレイヤーが古いレイヤーのエントリを消す仕組みを指すホワイトアウトは、ファイルシステムに限らずマージされた辞書全般で使われる用語で、特定の文化に由来する言葉だという解説や PAX 形式の歴史の補足も寄せられた。ファイルシステムの差分は何度も再発明されてきたので既製の解決策があるべきだという意見もあった。

インフラloige.co23pt / 12コメント既出コメントを見る(新しいタブで開く)スコア 61

Reddit

8件
1

Skip List Data structure

連結リストに複数階層のリンクを重ね、要素を飛ばしながら探索できるようにするデータ構造、スキップリストを解説した Substack の記事。

コメントの要約

連結リストに複数階層のリンクを重ね、要素を飛ばしながら探索できるようにするデータ構造、スキップリストを解説した記事。r/programming に投稿され、著者もコメントに参加している。

コメントでは、好きなのに見過ごされがちなデータ構造だという声の一方、用途の異なる連結リストと比べても意味が薄く、上の層から要素の情報が得られるから飛ばせるという点を説明すべきだという指摘が出て、著者はその節を加えると答えた。確率的でない決定的なスキップリストもあるという論文の紹介もあった。

ロックフリー実装でこそ面白く、それ以外では平衡木のほうが少ないメモリで速いという意見や、B+ 木にも並行アルゴリズムはあるがスキップリストははるかに単純だという反応、速い・遅いと書くならベンチマークを示すべきだという指摘も並んだ。

アルゴリズムpradyumnachippigiri.substack.comコメントを見る(新しいタブで開く)スコア 94
2

Go JSON v2 in Go 1.27: what breaks when you migrate from encoding/json

Go 1.27 の JSON v2 へ既存の encoding/json から移行する際に、挙動が変わる点や壊れる点を整理した記事。

コメントの要約

Go 1.27 で使える JSON v2 に既存の encoding/json から移行するとき、何が壊れるのかを整理した記事。r/programming に投稿された。

コメントは少なく、JSON にコメントを書けるようにしてほしかったという要望や、旧来の json パッケージはすでに壊れているという声が出た。後者には、旧版と v2 の出力を添えれば議論できるという返信があり、互換性の変更なのかバグなのか単なるデフォルトの違いなのかを分けるため、Go のバージョンと、コンパイルエラーか出力の変化かを明記すべきだという補足も続いた。

7

From SSH to REST: A Security-Driven Modernization of Slack’s EMR Data Pipelines

Slack のエンジニアリングブログ記事。EMR 上のデータパイプラインへのアクセスを SSH から REST 経由に切り替えた、セキュリティを動機とする刷新を扱う。

セキュリティ/インフラslack.engineeringコメントを見る(新しいタブで開く)スコア 36興味マッチ度 2

GitHub Trending

10件0件
1

AI エージェントが Twitter、Reddit、YouTube、GitHub、Bilibili、小紅書を API 料金なしで読み取り、検索できるようにする CLI。

記事の要約

AI エージェントにインターネット上の情報を読ませるための CLI。エージェントに YouTube の字幕取得や Twitter の検索、Reddit の閲覧を頼んでも、有料 API やサーバー IP の遮断、ログイン要件、HTML の整形といった壁で失敗するという問題を出発点にしている。

導入は、インストール手順の URL を添えた一文をエージェントに渡すだけで、更新も同様の一文で行う。対応先は Twitter、Reddit、YouTube、GitHub、Bilibili、小紅書、RSS、Web ページなど。各プラットフォームは主系と予備系の複数のバックエンドで振り分け、2026 年 6 月に yt-dlp が Bilibili に遮断された際は bili-cli に切り替えたとしている。

ツールはすべてオープンソースで無料とし、費用がかかりうるのはサーバー用プロキシの月 1 ドル程度。Cookie は手元にのみ保存し、Claude Code、OpenClaw、Cursor などに対応する。

AI/開発github.com+1696 stars today / 計89,814 / Python既出スコア 94興味マッチ度 3
2

AI エージェントに最小限のコードだけを書かせるスキル。Claude Code での計測で、スキルなしと比べてコード量が平均約 54%、コストが約 20% 減ったとしている。

記事の要約

AI エージェントを、50 行のコードを黙って 1 行に置き換える古参のシニア開発者のように振る舞わせるスキル。日付ピッカーを頼まれて flatpickr やラッパーコンポーネントを足し始めるエージェントを、最小限の記述で済ませる例を示している。

計測は、FastAPI と React で構成された full-stack-fastapi-template をヘッドレスの Claude Code で編集させ、残った git diff を採点する方式。12 の機能チケットを Haiku 4.5 で各 4 回実行し、スキルなしと比べてコード行数 54%、トークン 22%、コスト 20%、時間 27% の削減と、安全性 100% を報告している。

対照群の簡潔文体スキル caveman はコード行数 20% 減、「YAGNI と 1 行で書け」というプロンプトは 33% 減だが安全性 95% だった。以前の単発ベンチマークで示した 80〜94% は平均ではなくタスクごとの上限だったと訂正している。

AI/開発github.com+1281 stars today / 計153,419 / JavaScript既出スコア 90興味マッチ度 3
3

Claude Code、Codex、OpenCode、Cursor などのエージェント向けに、スキル、記憶、セキュリティ、調査優先の開発手順をまとめたハーネス最適化システム。

記事の要約

コーディングエージェントに、計画、テスト、実装、レビュー、検証、記憶、改善という一連の工程を組み込むためのシステム。毎回プロンプトで手順を組み立て直す代わりに一度導入して使う形で、7 つのハーネスに対応し、1 人のメンテナが毎週リリースしているという。

README の冒頭では、導入元を GitHub リポジトリ、npm の ecc-universal と ecc-agentshield、GitHub App、プラグイン ecc@ecc、公式サイト ecc.tools に限るよう警告しており、第三者による再アップロードや非公式ミラーにはマルウェアが含まれうるとしている。

Claude Code ではガイド付きセットアップかネイティブのプラグインコマンドで同じ ecc@ecc プラグインを導入し、両方を重ねないよう求めている。リポジトリは MIT ライセンスで、プライベートリポジトリ向けのホスト型 GitHub App である ECC Pro は 1 席月 19 ドルから。

AI/開発github.com+897 stars today / 計272,251 / JavaScript既出スコア 85興味マッチ度 3
4

Matt Pocock が日常の開発で使うエージェントスキル集。小さく組み合わせやすい構成で、Claude Code の公式マーケットプレイスからプラグインとして導入できる。

記事の要約

Matt Pocock が自身の .agents ディレクトリから公開した、vibe coding ではない実際のエンジニアリング向けのスキル集。GSD、BMAD、Spec-Kit のようにプロセスを丸ごと握る手法は制御を奪い不具合を直しにくくすると指摘し、小さく改変しやすく組み合わせられる設計にしたという。

導入方法は 2 通りで、Claude Code のプラグインは claude plugins install mattpocock-skills で読み取り専用の一式として入り、公式マーケットプレイス経由で自動更新される。skills.sh の npx skills@latest add mattpocock/skills は編集可能なファイルをプロジェクトにコピーする方式で、両方入れるとスキルが重複するため一方を選ぶよう求めている。

インストーラーでは setup-matt-pocock-skills を必ず選ぶよう注意しており、Codex 向けのネイティブプラグインはロードマップにあるとしている。

AI/開発github.com+751 stars today / 計275,371 / Shell既出スコア 81興味マッチ度 3
5

AI コーディングエージェントのフロントエンドデザインを改善するスキル。24 のコマンドと、AI が生成した UI の典型的な癖を検出する 61 の決定的なルールを備える。

記事の要約

AI コーディングエージェント向けのデザインガイダンスで、1 つのスキル、24 のコマンド、ブラウザでのライブな反復、AI 生成のフロントエンドデザインを検出する 61 の決定的なルールで構成される。Anthropic の frontend-design スキルを出発点にしたとしている。

同じ SaaS テンプレートで学習したモデルは、すべてに Inter を使う、紫から青へのグラデーション、カードの入れ子、色付き背景の灰色文字、見出しの上の角丸アイコンといった共通の癖を出すと指摘する。/impeccable init は対象読者や目的、制約、文体などの前提を PRODUCT.md に記録し、既存の視覚体系は DESIGN.md に分けて残す。

コマンドには polish、audit、critique、distill、animate、bolder、quieter などがあり、決定的なルールは CLI とブラウザ拡張から LLM や API キーなしで実行できる。

AI/開発github.com+699 stars today / 計75,308 / JavaScript既出スコア 77興味マッチ度 3
6

コーディングエージェント向けのスキル群と開発手法をまとめたフレームワーク。仕様の聞き取り、計画、TDD、サブエージェントによる実装を順に進めさせる。

記事の要約

コーディングエージェントに使わせる組み合わせ可能なスキル群と、それを確実に使わせる初期指示からなる開発手法。Claude Code、Codex、Cursor、Gemini CLI、GitHub Copilot CLI、OpenCode、Pi、Qwen Code など多数のエージェントへの導入手順を載せている。

エージェントは何かを作ろうとしていると察知してもすぐにはコードを書かず、利用者が本当にやりたいことを尋ねて仕様を引き出し、読める分量に分けて提示する。設計の承認後は、文脈も判断力もなくテストを嫌う熱心な新人でも従えるほど明確な実装計画を作る。

計画は red/green の TDD、YAGNI、DRY を重視し、利用者が開始を指示するとサブエージェント駆動の開発に移って、各タスクをエージェントに実行させ、その成果を検査、レビューしながら進める。

AI/開発github.com+577 stars today / 計294,917 / Shell既出スコア 73興味マッチ度 3
7

コーディングエージェントに原始人のような簡潔な話し方をさせ、トークンを約 65% 減らすとするスキルとプロキシ。

記事の要約

AI コーディングエージェントの冗長な説明を削り、原始人のような短い話し方に変えるスキルとプロキシ。npx skills add JuliusBrussee/caveman -g の 1 コマンドで導入でき、アカウントや API キーは要らないとしている。

例として、React コンポーネントの再レンダリングの原因を説明する 63 トークンの回答を、同じ診断と同じ useMemo による修正のまま 20 トークンに縮めている。コード、コマンド、ファイルパス、正確なエラーメッセージは対象外としている。

根拠として、Adobe Research の論文 CAVEWOMAN がこの形式の出力でコストが 1.4〜2.4 倍、最大 3 倍下がったと測定したこと、JetBrains が 86 件の実際のコーディングタスクで試し、品質に測定可能な損失はなかったとしたことを挙げている。

AI/開発github.com+507 stars today / 計109,535 / Go既出スコア 69興味マッチ度 3
8

最小構成で拡張可能なエージェントハーネス Pi。統一 LLM API、エージェントループ、TUI、コーディングエージェント CLI を含み、サブエージェントやプランモードは標準では持たない。

記事の要約

自分の作業に合わせて作り変えることを前提にした、最小構成で拡張可能なエージェントハーネス。拡張機能、スキル、プロンプトテンプレート、テーマで調整でき、それらを Pi パッケージとして npm や git で共有できる。

強力な既定値を持つ一方、サブエージェントやプランモードのような機能はあえて含めず、必要なら Pi 自身に作らせるかパッケージを入れる方針。対話的な利用のほか、print / JSON モードでの自動化、RPC での制御、TypeScript SDK でのアプリ構築に対応し、実際の統合例として OpenClaw を挙げる。

インストールは依存を固定するスクリプトで行い pi update で更新するか、npm で --ignore-scripts を付けて入れる。Node.js 22.19 以降が必要。新規コントリビューターの issue と PR は既定で自動クローズされ、メンテナが毎日確認するとしている。

AI/開発github.com+408 stars today / 計112,159 / TypeScript既出スコア 65興味マッチ度 3
9

型付きエラー、依存性注入、構造化並行性、スキーマ検証などを備えた TypeScript のアプリケーション構築ライブラリ。Effect 4.x は長期サポート版と位置づけられた。

記事の要約

TypeScript で堅牢で保守しやすく型安全なアプリケーションを作るためのライブラリ。型付きエラー、依存性注入、構造化並行性、スケジューリング、トレーシング、統一されたスキーマ検証といった、規模が大きくなると難しくなる問題を扱うとしている。

Effect 4.x は長期サポート(LTS)リリースと位置づけられ、3.x からの移行ガイドが用意されている。動作要件は TypeScript 5.9 以降で、性能と Effect の TypeScript ツールとの互換性の面から TypeScript 7 を推奨する。

Node.js は 18 以降が一般的な最低要件だが、@effect/sql-sqlite-node は Node.js 22.16 以降を必要とするなど、統合パッケージによってはより新しいランタイムが要る。tsconfig.json で strict を有効にすることも必須としている。

TypeScriptgithub.com+302 stars today / 計16,819 / TypeScript既出スコア 60興味マッチ度 2
10

MCP のツール出力をサンドボックスに隔離して AI コーディングエージェントのコンテキスト消費を約 98% 減らし、セッションの記憶も保持するツール。

記事の要約

AI コーディングエージェントのコンテキストウィンドウを節約するツール。MCP のツール呼び出しは生のデータをそのままコンテキストに流し込み、Playwright のスナップショット 1 回で 56KB、GitHub の issue 20 件で 59KB、アクセスログ 1 つで 45KB を消費して、30 分で 40% が埋まると問題を示している。

会話を圧縮する際に、編集中のファイルや進行中のタスク、直前の依頼をエージェントが忘れることも課題に挙げる。対策として、ツールの出力をサンドボックスに隔離して約 98% 削減し、セッションの記憶を永続化し、MCP とフックを通じて 17 のプラットフォームで振り分けを強制するとしている。

ライセンスは Elastic License 2.0 で、Hacker News で 1 位を取ったことをバッジで示している。

AI/開発github.com+256 stars today / 計25,250 / TypeScript既出スコア 56興味マッチ度 3

すべて既出

Techmeme

10件7件
1

David Robinson, ex-OpenAI safety and policy: SV lacks a safety-centric culture; labs must study other fields' safety approaches; time for trial and error's over

OpenAI を今週退社した David Robinson が The Atlantic に寄稿し、シリコンバレーには安全を中心に据えた文化が欠けていると論じた。AI ラボは他分野の安全への取り組みに学ぶべきだとしている。

ハイライトAItheatlantic.comコメントを見る(新しいタブで開く)スコア 100興味マッチ度 2
2

David Robinson, who worked on OpenAI's Safety Systems team and had previously led policy planning, left OpenAI last week

Business Insider の記事。OpenAI の Safety Systems チームのリーダー David Robinson が退社し、公開したエッセイで同社には AI を責任を持って扱う謙虚さが足りないと示唆した。

AIbusinessinsider.com既出コメントを見る(新しいタブで開く)スコア 90興味マッチ度 2
3

Sources: ShinyHunters member Saif al-Din Khader, aka “Rey,” was detained in Jordan and is cooperating to identify other hackers involved in the FBI breach

FBI の全職員のデータを盗んだと主張するハッカー集団 ShinyHunters の主要メンバーがヨルダンで拘束され、他のメンバーの特定に協力していると Reuters が関係者の話として伝えた。

セキュリティreuters.comコメントを見る(新しいタブで開く)スコア 90興味マッチ度 2
4

Sources: AI czar Jay Clayton to chair the WH's AI task force, called “Super Intelligence Force”, to pen a report on AI's risks and opportunities within 120 days

WSJ によれば、ホワイトハウスが AI のリスクと機会を検討するタスクフォースを新設し、国家情報長官で AI 担当を務める Jay Clayton が率いる。120 日以内に報告書をまとめる。

5

A look at the Swarmchasers forum, which has 400 members, including the Nightingale Collective and Transluce, who comb the web for traces of rogue AI agents

WSJ の記事。不正な振る舞いをする AI エージェントの痕跡をウェブ上で追う約 400 人のフォーラム Swarmchasers を取り上げ、AI が問題を起こしたときに何が起きるかを伝えている。

AI/セキュリティwsj.comコメントを見る(新しいタブで開く)スコア 79興味マッチ度 3
6

A US judge rules an officer's use of Flock to search a car's license plate was a form of “indiscriminate mass surveillance”, and violated the Fourth Amendment

404 Media の記事。判事は、全米に広がる Flock のネットワークが網羅的な法執行に近づいているとし、警察官は令状を取るべきだったと述べた。Hacker News でも首位に入った。

プライバシー/監視404media.coコメントを見る(新しいタブで開く)スコア 76
7

OpenAI's DevDay 2026 announcements to turn ChatGPT into a place to discover, launch, and use software could potentially disrupt the traditional app store model

TechCrunch の記事。DevDay ではエージェント型アシスタント dots や新モデルが中心だったが、発表を合わせると ChatGPT が従来のアプリストアの役割を担いうると分析している。

AItechcrunch.comコメントを見る(新しいタブで開く)スコア 76興味マッチ度 2
8

Amazon says it has stopped using NDAs with county officials for data center projects and acknowledges community backlash is leading to data center moratoriums

Wired の記事。Matt Garman CEO がブログで、データセンター建設をめぐる地域の反発を受けて同社がすでに取っている対応を説明した。

データセンターwired.com既出コメントを見る(新しいタブで開く)スコア 69
9

YouTube says it is adjusting its Shorts recommendations to prioritize “original content” and reduce the reach of channels re-uploading others' content

9to5Google の記事。YouTube がオリジナリティを重視する方針として、Shorts のレコメンドで独自のコンテンツを優先すると明らかにした。

10

Meta announces Muse Gadgets, providing an open source ESP32 microchip firmware and a Linux SDK to let users bring Muse to their hardware, like Raspberry Pi 5

Engadget の記事。Meta は独自のスマートホーム機器 Muse Home Link も作っており、たまごっちのような AI デバイスについてはまだ詳細が少ないとしている。

AI/ハードウェアengadget.com既出コメントを見る(新しいタブで開く)スコア 62

日本

はてなブックマーク

10件
1

10 月 1〜2 日に韓国の少なくとも 6 つの銀行で AI ツールを使ったとみられるハッキングが同時多発し、うち 4 行で個人情報が流出したと伝える朝鮮日報の記事。

コメントの要約

10 月 1 日から 2 日にかけて、新韓銀行、KB 国民銀行、ハナ銀行、ウリ銀行、NH 農協銀行、BNK 釜山銀行など韓国の少なくとも 6 つの銀行で、AI ツールを使ったとみられるハッキング攻撃が同時多発的に起き、4 行で個人情報が流出したと伝える朝鮮日報日本語版の記事。新韓銀行では約 2 万 5,000 人が対象とされる。

コメントでは、地方銀行のシステムを網羅的に攻撃すれば深く侵入できる者もいそうだという懸念や、金融システムの担当経験者から韓国が駄目なら日本はもっと駄目だろうという声が出た。オープンソースの LLM がすでに Mythos に近い攻撃能力を持ち、攻撃的なプロンプトも通せるようカスタマイズできるという記事を見たとして、「AI 大海賊時代」に入ったのかという投稿もあった。

見出しの「4 行」を 4 行のコードやプロンプトと読み違えたという反応が複数あり、ハッキングではなくクラッキングだという指摘、預金を引き出して手元に置こうかという声も並んだ。

ハイライトセキュリティchosunonline.com179 usersコメントを見る(新しいタブで開く)スコア 91興味マッチ度 2
2

日本語推敲スキル yomiyasu、natural-japanese、japanese-tech-writing を同じ条件で比べた Qiita の記事。3 つとも読みやすくなったが、手の入れ方が異なったとしている。

コメントの要約

X で話題になった日本語推敲スキル yomiyasu に natural-japanese と japanese-tech-writing を加え、同じ Claude、同じ原文、同じ指示で比べた Qiita の記事。yomiyasu は原文をかなり残し、natural-japanese は段落から組み直し、japanese-tech-writing は技術文書として余分な表現を削ったとしている。Qiita の人気記事でも首位に入った。

コメントでは、3 つを推敲の強さの弱・中・強と見る整理や、スキルは完璧ではないが手直しや指示のやり直しが減るだけで助かるという声が出た。出力をそのまま出す人も、それを前提に腐す人も問題だという意見や、まだ多くが出ては消えるだろうという見方もあった。

AI の文章を人間らしく偽るより AI による文章だと明示する方が潔いという意見や、公開前に音声読み上げで確認するという習慣の紹介、技術文書なら読者への呼びかけは情報量がなく邪魔だという好みも並んだ。

AI/開発qiita.com419 usersコメントを見る(新しいタブで開く)スコア 89興味マッチ度 3
3

アバハウスインターナショナルが、社内システムへの不正アクセスで顧客情報が漏えいした可能性を発表した。データベース全体にアクセスされた可能性があり、会員全員が対象になるおそれがある。

コメントの要約

ファッションブランド「アバハウス」などを展開するアバハウスインターナショナルが 10 月 2 日、第三者による社内システムへの不正アクセスで顧客の個人情報の一部が漏えいした可能性があると発表したことを伝える ITmedia の記事。データベース全体に不正アクセスされた可能性があり、会員情報を預けているすべての顧客が対象になるおそれがある。見出しによれば、不審な返金メールが届いたという報告で発覚した。

コメントでは、漏えいが相次ぎ迷惑メールが減らないわけだという声や、攻撃者はなぜすぐ発覚するようなことをするのかという疑問が出た。データベースを丸ごと抜かれたとしたうえで、クレジットカード情報を持っていなかったのは幸いだという見方もあった。

住所なども ID で管理し各サイトには ID だけを連携する仮想的な個人情報の仕組みがあればというアイデアと、それはマイナンバーではないかという自問、長年の愛用者からの反応も並んだ。

セキュリティitmedia.co.jp90 usersコメントを見る(新しいタブで開く)スコア 81興味マッチ度 2
5

Codex Security と Claude Security を使い、AI で自社サービスの脆弱性を発見・検証する方法をまとめた npaka 氏の note 記事。

コメントの要約

OpenAI の Codex Security と Anthropic の Claude Security を使い、AI で自社の Web サービスの脆弱性を発見して検証する方法をまとめた入門記事。氏名やメールアドレス、住所などを扱うサービスに、気付いていない脆弱性が残っているのではという問題意識から始めている。

要約を付けたコメントによれば、AI がコード全体の関係を読んで認証・認可や攻撃経路を調べ、修正案を示すもので、PR レビューと定期スキャンを組み合わせ、従来のツールも併用し、権限を絞って修正は人間が確認・テストする構成を紹介している。

コメントでは、ISMS はともかく PCI DSS や P マークはざるなので、こうしたスキャンを毎月回していると示す方が実効性の面で信用できるという意見や、静的解析と AI の併用は筋がよさそうだが最後は人間のレビューが要るという声が出た。

AI/セキュリティnote.com137 usersコメントを見る(新しいタブで開く)スコア 79興味マッチ度 3
6

60 以上の AWS サービスを単一ポートでローカルに再現する無料のエミュレーター MiniStack を紹介する GIGAZINE の記事。マルチアカウント・マルチリージョンに対応し、セルフホストできる。

コメントの要約

AWS の API を PC 上で再現し、AWS CLI や Terraform から S3、DynamoDB、Lambda など 60 以上のサービスをローカル環境だけで無料で使えるエミュレーター MiniStack を紹介する GIGAZINE の記事。単一のポートで動き、マルチアカウントとマルチリージョンに対応し、セルフホストできる。動作確認のたびにクラウド上でリソースを作成・削除し、料金を管理する手間を省く用途を想定している。

コメントは 1 件で、LocalStack がオープンソースから外れた隙間を突いた代替品だが、再現度が気になるという指摘だった。

開発ツールgigazine.net64 usersコメントを見る(新しいタブで開く)スコア 76
7

地面に落としたネジを写真から Grok に探させたところすぐに見つけたという X の投稿をまとめた Togetter。画像認識での AI の能力が話題になった。

コメントの要約

地面に落としたネジを写真から Grok に探してもらったところ、すぐに見つけてくれたという X の投稿と反応をまとめた Togetter のページ。画像処理における AI の能力の高さを示す例として紹介されている。

コメントでは、自分も一瞬で見つけたので何がすごいのか分からないという反応が複数出た。一方で、自動運転も人間より優れたパターン認識を持つ映像認識エンジンを作ることだという見方や、便利だという短い反応も並んだ。

AItogetter.com34 usersコメントを見る(新しいタブで開く)スコア 74
8

イベント Startup in Agile #7「ボトルネックは人の意思決定?『決め方』の変遷教えて」で発表された、意思決定の進め方をどう他者に渡していくかを扱うスライド。

コメントの要約

Startup in Agile #7 の「ボトルネックは人の意思決定?『決め方』の変遷教えて」をテーマにした回で発表されたスライドで、意思決定の進め方をどう他者に渡していくかを扱っている。

81 users に対してブックマークコメントは付いておらず、議論は起きていない。

組織speakerdeck.com81 usersコメントを見る(新しいタブで開く)スコア 73興味マッチ度 2
9

内閣府などが、AI の社会実装を妨げている規制や制度について広く情報提供を募っているページ。7 月に閣議決定された人工知能基本計画を受けたもの。

コメントの要約

内閣府の規制改革推進室と人工知能政策推進室、デジタル庁、経済産業省が、AI の社会実装に関する規制・制度について情報提供を募るページ。2026 年 7 月 14 日に閣議決定された人工知能基本計画が、AI を導入するだけでなく意思決定や業務の進め方を見直す AX に取り組むとしていることを受けている。

コメントでは、各省庁が公開する統計データを API や MCP で提供してほしいという要望や、DRM が AI の活用を妨げており電子書籍を買っても LLM に読ませる手段がないという指摘が出た。法令や通達などの規制を知っていることが前提だという注意もあった。

一方で、規制緩和だけでなく AI の社会実装にあるべき規制の姿を聞くべきだという批判や、反 AI の立場から大量の意見が送られるのではという見方、if/then も AI だとすればすべてのプログラムが AI だという皮肉も並んだ。

AI/政策www8.cao.go.jp67 usersコメントを見る(新しいタブで開く)スコア 73
10

高市首相が、生成 AI に相談する若者の増加を受けて、Apple にデバイスへの自殺防止機能の搭載を求めていたことを X で公表したと伝える ITmedia の記事。

コメントの要約

高市早苗首相が 10 月 2 日、Apple との間で交わした子どもの安全対策や自殺防止の取り組みに関するやり取りを X で公開したことを伝える ITmedia Mobile の記事。首相は Tim Cook 前 CEO から手紙を受け取ったとし、若者の間で生成 AI への相談が増えている現状や海外の深刻な事例を挙げて、デバイスへの自殺防止機能などの搭載を求めていた。

コメントでは、それは政治の仕事ではないかという疑問や、自殺しなくて済む社会をつくってほしいという声、自殺防止機能として催眠アプリのようなものを作らせるつもりかという皮肉が出た。

AI/政策itmedia.co.jp45 usersコメントを見る(新しいタブで開く)スコア 73

Zenn

10件0件
1

AI が生成した読みにくい日本語を、禁止語ではなく統語構造の復元と比喩的な動詞の具体化で書き直すスキル yomiyasu の公開記事。v1.0.5 の公開に合わせて追記された。

記事の要約

AI 生成の読みにくい日本語(AI-Slop)を書き直すエージェントスキル yomiyasu の公開記事で、10 月 4 日に v1.0.5 の公開が追記された。v1.0.4 以降は文末表現を文書の立場で統一するなどの変更を重ね、npx skills update yomiyasu で更新できる。Claude Code、Codex、Cursor などから /yomiyasu で呼び出す。

従来の対策が単語を禁止する方式だったのに対し、「誰が・何を・どうした」の統語構造の復元と比喩的な動詞の具体化に絞った点を特徴とする。「最大の落とし穴」「静かに壊れます」「地味に効いてくる」「時間を溶かさない」などを含む例文を AI-Slop の典型として示している。

禁止語方式では「手触り」が「実態」に言い換えられるだけで文の骨格は変わらず、人間味を求めると「真理」「美学」のような大げさな語彙に流れると指摘する。根拠として、2019〜2026 年の Qiita 記事 70,524 件で AI 普及前後の文章構造を計測した調査を引いている。

AI/開発zenn.devいいね466 / ブクマ160既出スコア 84興味マッチ度 3
2

AI がコードを書く時代のテスト戦略を、テストの種類ごとに検出できる不具合の違いと、AI の修正ループでの実行速度の違いから整理した記事。

記事の要約

テストの役割は検出できる不具合の種類で決まり、AI がコードを書くようになっても変わらないと論じる記事。型・lint、ユニットテスト、PBT、integration テスト、E2E テスト、探索的テストが、計算の誤りや状態遷移、DB の誤り、画面をまたぐ誤りなどをそれぞれどの程度検出するかを表で示している。

どの自動テストも書かれたことしか検証しないため、書き手の想定外の不具合は探索的テストで探すしかないとする。E2E でも計算の誤りに気づくことはあるが、境界値の組み合わせを何十通りも E2E で検証するのは現実的ではないという。

AI に実装させテストが通るまで修正させる進め方では、テストの待ち時間と修正回数が生産性を左右する。型検査、lint、ユニットテスト、PBT は変更のたびに全部回して AI に素早く返し、遅い integration や E2E は結合や実環境の確認に集中させる方が活きるとしている。

AI/開発zenn.devいいね218 / ブクマ94既出スコア 81興味マッチ度 3
3

15 年 Git を使ってきた筆者が、AI コーディングの普及を機に Jujutsu へ移行し、Git に戻れなくなった理由を挙げた記事。作業ディレクトリがそのままコミットになる点などを取り上げる。

記事の要約

2011 年から Git を使ってきた筆者が、2026 年に初めて自分の意思で VCS を選び、Jujutsu に移行した経緯と理由を書いた記事。AI コーディングエージェントの登場で、add と commit の手間や、生成コードを後から直す rebase で重要な変更を消してしまうことが日常的になったという。

日本では 2026 年 1 月ごろに Jujutsu の紹介記事が相次いで話題になり、筆者も試したが、設計思想とコマンド体系の違いから最初は使いこなせなかった。インデックスがない手軽さと、どの操作も undo で戻せる安心感で 1 か月ほどで慣れ、今はすべてのリポジトリと原稿を Jujutsu で管理している。

戻れない理由の 1 つ目として、Jujutsu では作業ディレクトリの状態がそのままコミットになるため、履歴への保存のタイミングを考える必要がなく、stash に当たる退避も要らず、作業中のコードが消える危険もほぼないと説明している。

開発ツールzenn.devいいね126 / ブクマ43既出スコア 79興味マッチ度 2
4

トランザクション内の処理の順番について、Jim Gray の論文の分類に基づき、メール送信のような取り消せない処理は最後に置くという指針を示した短い記事。

記事の要約

トランザクションの中に処理を書く順番について、簡単な指針を示す記事。EC サイトの注文確定で、注文確定メールを送ってから注文ステータスの更新と在庫の引き当てを行うと、引き当てに失敗してロールバックしてもメールだけが送られた状態で残る例を挙げている。

Jim Gray の 1981 年の論文「The Transaction Concept: Virtues and Limitations」に従い、トランザクション内の処理を、取り消しも再実行も要らない非保護、ロールバックで戻せる保護(通常の DB 操作)、実行したら取り消せない実(メール送信や現金の払い出し)の 3 つに分類する。

そのうえで、実アクションを最後に実行すれば後続の失敗で取り消せない処理が残る事態を防げるとし、例のコードもメール送信を末尾に移している。実アクションが複数ある場合などの選択肢として、トランザクショナルアウトボックスパターンを挙げている。

設計zenn.devいいね114 / ブクマ52既出スコア 76興味マッチ度 2
5

筆者が Rust で実装した Unix ライクな OS octox が、サンフランシスコ大学の授業 CS 631 の教材として使われていることを紹介した記事。

記事の要約

筆者が Rust で実装した学習用の Unix ライクな OS octox が、サンフランシスコ大学の 2026 年春学期の授業「CS 631: Systems Foundations」で教材に使われていることを紹介する記事。octox は xv6-riscv に触発され、カーネルだけでなくユーザーランドやビルド処理も Rust で書かれている。

授業サイトの「The Octox Guide」は、OS の概念、octox のコード、Rust での実装の解説の順に構成され、ソースファイルと行番号も示す。システムコールの講義では 9 つのサンプルプログラムで、リダイレクトやパイプが fork、exec、dup2、pipe でどう実現されるかを扱う。

カーネルの講義では getpid() を ecall からトラップ処理、ユーザー空間への復帰まで追い、仮想メモリの講義では RISC-V の Sv39 と walk()、mappages() の実装、アドレスを PAddr、KVAddr、UVAddr の別の型で表す設計を取り上げている。

OS/Rustzenn.devいいね116 / ブクマ26既出スコア 73
6

Cloudflare の新しい統合 CLI cf(v1.0.0-beta)へ wrangler から移行する手順と、cf migrate だけでは解決しない設定やエラーへの対処をまとめた記事。

記事の要約

Cloudflare の次世代統合 CLI cf(現在 v1.0.0-beta)への移行記事。設定は wrangler.jsonc などから TypeScript の cloudflare.config.ts への移行が推奨される。公式の cf migrate だけでは本番稼働できず、React Router v8 と Vite による Workers 構成やマルチ Worker 構成で必要だった手順とエラー対処を整理している。

利点として、bindings.hyperdrive() などのヘルパーによる型チェック、設定から env の型を推論する cf workers types(InferEnv)、DNS、R2、D1、WAF なども操作できる統合 CLI を挙げる。

cf dev が Vite の開発サーバーを自動検出して HMR に対応する点や、CLI の自己記述スキーマ(cf schema)で AI エージェントの誤設定を防ぎやすい点も挙げている。

Web/インフラzenn.devいいね95 / ブクマ31既出スコア 71興味マッチ度 2
7

OpenAI DevDay 2026 の発表を現地からまとめた記事。24 時間稼働のエージェント dots、GPT-6.1 Sol、Ultrafast、Codex の強化など、Recap に載る 25 項目を扱う。

記事の要約

サンフランシスコで開催された OpenAI DevDay 2026 の発表を現地からまとめた、加筆中の記事。公式の Recap ページには 25 項目が載り、dots、GPT-6.1 Sol、Ultrafast、Codex の刷新、Decisions API、Computer Use 対応の Agents API、ChatGPT Space、Sign in with ChatGPT などが含まれる。

dots は GPT-6 Astra を使う常時稼働のエージェントで、専用のクラウド上のコンピューターを持ち、フィードバックから学びながらゴールに向けて 24 時間動く。プラグイン経由で 4,000 を超えるアプリにつながり、対象は Pro と Business Premium。

GPT-6.1 Sol は GPT-6 Astra に近い性能を低コストで使えるモデルで、高速にトークンを生成する Ultrafast をサブスク内で使える月額 500 ドルの Pro 500 も追加された。

AI/LLMzenn.devいいね105 / ブクマ20既出スコア 68興味マッチ度 3
8

テスト設計書の前にテスト要求仕様(TRS)を挟み、仕様レイヤーとテスト設計レイヤーに分けて書くことでテスト設計が楽になったという QA エンジニアの記事。

記事の要約

e-dash の QA チームが、テスト設計書の前にテスト要求仕様(TRS)を挟むようにした経緯を書いた記事。従来のテンプレートは確認項目ごとに観点と因子・水準を整理してテストパターンに落とす段階的な形だったが、何を 1 つの確認項目とするかが書き手任せで、対象が大きくなると全体を見渡しにくくなっていたという。

TRS は 2 層構成で、仕様レイヤーではユーザーストーリーとユースケースの対応表、正常・準正常・例外に分けた振る舞い、Gherkin で書く受け入れ基準によって「あるべき挙動」を確定させる。テスト設計レイヤーでは因子一覧や因子の制約、組み合わせの指定で検証方法を定義し、読む順も書く順も仕様レイヤーからの一方向とする。

受け入れ基準には具体的な値を書かず、<権限> や <操作> のような可変部だけを置き、値と組み合わせは因子一覧が引き受ける形にしている。

テスト/QAzenn.devいいね67 / ブクマ37既出スコア 66
9

データ分析でエージェントに必ず実施させたい診断と可視化を、手法・ツール・診断のセットとしてスキル化し、2 段階のルーティングで呼び分ける設計を紹介した記事。

記事の要約

データサイエンス向けの AGENTS.md とスキルを公開した前回の記事の続編で、決まった分析手法を実行するときの診断の標準化を扱う。MCMC なら PyStan ではなく CmdStanPy を使い収束診断を必ず行う、決定木の可視化は dtreeviz、因子分析ならバイプロット、回帰分析なら診断図といった「手法×ツール×可視化・診断」のセットを事前に定義しておく考え方を示す。

難しい点として、案件ごとに手法が大きく変わる組織での取捨選択と、スキルを増やしすぎることによるコンテキストの肥大化や似たスキルの取り違えを挙げる。対策として、statistical-inference-diagnostics などの SKILL.md を第 2 のルーターにする 2 段階のルーティング(progressive disclosure)を採った。

スキルが生成する診断図はギャラリーとして公開しており、リポジトリは atsushi-green/ds-ai-coding-skills。

AI/開発zenn.devいいね58 / ブクマ32既出スコア 63興味マッチ度 3
10

生成 AI の出力を人間が中継するだけになる「Meat Proxy」の事例を描き、破綻の原因は AI ではなく人間の責任放棄にあると論じたエッセイ。

記事の要約

仕様提案から設計レビュー、顧客の要件定義までほぼ生成 AI の出力になった現場で起きる問題を論じたエッセイ。要点として、Meat Proxy での破綻は AI のせいではなく求められる責任を放棄した結果であり、責任を持てない生成 AI は原理的に副操縦士の域を出ず、人間の介在価値は意思と責任を持つことにあるとする。生成 AI の活用を否定する意図はなく、自戒だと断っている。

創作を交えた事例では、ドメイン知識のないエンジニアが、AI 構文で埋まった議事録と仕様書、AI が要約したチケットを Codex に渡し、20 分で数千行の設計書を Notion に書かせる。PL も設計書を読まずに社内のレビュー AI の指摘をそのまま貼り、エンジニアはそれを Codex に渡して反論と修正案を 1 分で作らせる。

筆者は、誰かを責めるためではなく、読者が自分に当てはまるかを顧みるためにこの事例を書いたとしている。

キャリアzenn.devいいね75 / ブクマ13既出スコア 60興味マッチ度 2

すべて既出

Qiita

10件0件
1

日本語推敲スキル yomiyasu、natural-japanese、japanese-tech-writing を、同じ Claude・同じ原文・同じ指示で比べた記事。3 つとも読みやすくなったが、手の入れ方が異なったとしている。

記事の要約

日本語推敲スキル yomiyasu、natural-japanese、japanese-tech-writing の 3 つを、同じ Claude、同じ原文、同じ指示で比べた記事。 3 つとも読みやすくなったが、yomiyasu は原文をかなり残し、natural-japanese は段落から組み直し、japanese-tech-writing は技術文書として余分な表現を削ったという。

yomiyasu は文の骨格と比喩を直す規則に検査用の yomiyasu_lint.py を同梱し、natural-japanese は設計から収束までの執筆工程と lint を持ち、japanese-tech-writing は技術文書向けの文章規範だと整理している。

比較は Claude Code から Claude Sonnet を effort: low で使い、毎回 --safe-mode で他のプラグインや CLAUDE.md を止めて行った。1 つの原文を 1 回ずつ通しただけで、優劣を決める検証ではないと断っている。

ハイライトAI/開発qiita.comLGTM111 / ストック89既出スコア 84興味マッチ度 3
2

SODA 2027 に採択された論文「The Balanced Four-Color Theorem」の著者が、四色定理の「バランス版」の研究を一般向けに紹介する記事。

記事の要約

大学院修士 2 年の筆者が、アルゴリズム分野の最先端研究の一端を紹介する記事。題材は 2026 年 7 月に投稿し、トップ国際会議 SODA 2027 に採択された論文「The Balanced Four-Color Theorem」で、米田優峻氏と指導教員の河原林健一氏との共著。

一般の IT エンジニアやプログラミングと数学が好きな高校生でも前提知識なしで読めるとし、研究成果の紹介、実世界と関わるグラフ構造、四色定理の歴史、「バランス版」四色定理とアルゴリズムの順に進む。

四色定理は、どんな地図も 4 色あれば塗り分けられるという定理で、記事では読者に日本地図を 4 色で塗れるか確かめさせたうえで、塗り分けの一例を示している。

アルゴリズムqiita.comLGTM35 / ストック12既出スコア 82
3

「アウトプットしないことは知的な便秘だ」という言葉を手がかりに、Qiita への投稿や LT 登壇を続ける理由を、実績づくり、インプットの増加、頭の整理の 3 点から述べた記事。

記事の要約

X で見かけた「アウトプットしないことは知的な便秘だ」という言葉をきっかけに、筆者がアウトプットを続ける理由を書いた記事。アウトプットしない人を責める意図はないと断り、仕事で成果が出ず悩んでいたときに知人から「考えていることを排泄しよう」と言われたのが始まりだと紹介する。人によって適切な形と周期があるという立場をとる。

アウトプットを、学習や経験で得た知識や考えを話す、書く、行動するといった形で外に出すことと定義し、筆者の場合は Qiita への投稿、JAWS-UG などでの LT 登壇、社内発表がそれに当たる。

続ける理由は、社内外に実績を示すこと、準備や反応を通じてインプットが増える循環、記事や資料を作る過程で暗黙知が形式知に整理されることの 3 つ。Codex や Claude Code で並列にタスクをこなして頭が疲れる最近は、特に 3 つ目を必要と感じているという。

キャリアqiita.comLGTM67 / ストック38既出スコア 81興味マッチ度 2
4

非エンジニアの企画職が社内エンジニアと業務効率化ツールを作り、メルマガ作成を 1 回約 1 時間から約 15 分に短縮した経験と気づきをまとめた記事。

記事の要約

医薬情報事業部の企画職である筆者が、技術広報プロジェクトで社内エンジニアと業務効率化ツールを作った記録。薬剤師向けに隔週で配信する研修案内メルマガの作成に 1 回約 1 時間かかっていたのを、約 15 分まで短縮したという。筆者は課題のヒアリング、要件定義、画面遷移図の作成、一部のプログラム修正、テストの検討を担当した。

要件では、新着研修を入力した開始日と終了日の間に登録されたものに限る、配信日の 14 日前以降に開催が始まる研修を表示するなど、基準の日付や境界の扱い、未入力時の挙動を誰が見ても同じ解釈になるまで詰める必要があったとしている。

気づきとして、開発の全体像と要件定義の深さが分からなかったこと、SLA や非機能要件、バリデーション、元サービスの規約確認など機能以外に決めることが多いこと、リクエストを最小限にする工夫や、あえてリッチにしすぎない設計判断を挙げている。

業務改善qiita.comLGTM18 / ストック9既出スコア 76
5

AWS 認定に新設された Business カテゴリの試験 AI Business Strategist のベータ版に合格した体験記。試験の概要と、約 5 時間の対策内容をまとめている。

記事の要約

AWS 認定に 5 つ目のカテゴリとして追加された Business の試験 AWS Certified AI Business Strategist に、早期受験で合格した体験記で、情報は 2026 年 9 月 29 日時点。AI 投資の評価、ビジネスケースの構築、ガバナンス設計、組織での導入拡大を問う試験で、コーディングや AWS の実装経験は不要とされる。

ベータ試験は 85 問、170 分、合格点 700 点で、試験ガイドの 130 分とは申し込み時の表記が異なっていたという。推奨知識として Amazon Bedrock、Amazon SageMaker AI、Amazon Quick が挙がり、KPI や ROI などビジネス寄りの用語が多い。

対策は空き時間で約 5 時間。Skill Builder の公式模擬問題集を初見で 70% 正解し、さらに試験ガイドを Claude Code に読み込ませて模擬試験を自作した。正解の選択肢が他より長くなる傾向があったため調整したとしている。

資格qiita.comLGTM23 / ストック7既出スコア 74
6

タイムズカーや佐川急便、ヤマト運輸の不正アクセスが続くなか、情報が漏れたときに失うものの大きさを基準に、業界別の「ハッキングされないでくれ」ランキングを作った記事。

記事の要約

2026 年 9 月末から生活に近いサービスの不正アクセスの公表が続いていることを受けた記事。タイムズカーでは約 660 万アカウントの情報が取得され、うち約 160 万件で運転免許証などの画像も漏れた。佐川急便では約 100 日分の送り主と届け先の情報が流出した可能性があり、ヤマト運輸はクロネコ代金後払いサービスを止めた。

警察庁によれば 2026 年上半期のランサムウェア被害は 123 件で半期の過去最多、侵入経路の約 5 割が VPN 機器だった。パスワードは変えられても免許証の顔写真や生年月日、病歴は変えられないとして、漏れたときに何を失うかを基準に業界別の順位を付け、1 位を医療・調剤と電子カルテの基盤とした。

挙げた企業名は業界の例であり、各社のセキュリティが弱いという評価ではないと明記している。

セキュリティqiita.comLGTM15 / ストック11既出スコア 73興味マッチ度 2
7

Claude Code に追加された Mods と意思決定モデル Jev を使い、プロンプトに応じて Haiku、Sonnet、Opus を切り替えるモデルルーターを作った記事。

記事の要約

Claude Code に追加された Mods を使い、プロンプトに応じて Sonnet、Opus、Haiku を切り替えるモデルルーターを作った記事。筆者がドキュメントを読まずに Claude Code に作れるか尋ねると、実行中のビルドの Mods API の型定義を確認し、必要なフックは揃っていると答えたという。

意思決定モデル Jev を使うよう依頼して作らせたルーターは GitHub の moritalous/claude-mods-router で公開している。簡単な質問は Haiku、少し考える必要があるものは Sonnet、無茶な依頼には Opus が応答し、どのモデルを使ったかを画面下に表示する機能も Claude Code が実装した。

仕組みの説明には、1 行のプロンプトだけでできた eli5 スキルを使い、絵の多い HTML アーティファクトで解説させている。

AI/開発qiita.comLGTM14 / ストック5既出スコア 67興味マッチ度 3
8

GitHub Copilot SDK の配信アーカイブをもとに、SDK の背後にあるランタイムの仕組みをまとめた記事。2.0 ではランタイムが TypeScript から Rust に書き直された。

記事の要約

2026 年 9 月 25 日の配信「Let's Learn GitHub Copilot SDK」のアーカイブを、公式ドキュメントと照らし合わせてまとめた記事。自分のアプリに Copilot の機能を組み込める SDK の使い方ではなく、中身と仕組みを扱うとしている。登壇者は Microsoft の Cloud Advocate と SDK のプロダクトマネージャー。

以前は CLI SDK と呼ばれていた GitHub Copilot SDK は 2026 年 6 月に GA となり、まもなく出るバージョン 2.0 ではランタイムと開発者ツールを含め全体が作り直された。ランタイムは TypeScript から Rust に書き直され、柔軟性や性能、多様なプラットフォームでの動作が向上したという。

要点として、Node.js で動く CLI を SDK 経由で呼び出す構造から、Rust 製のネイティブな共通ランタイムへ移り、各アプリのプロセス内に組み込んで実行する方式もオプトインで選べるようになったと整理している。

AI/開発qiita.comLGTM15 / ストック7既出スコア 65興味マッチ度 3
9

文章を生成せず有限個の選択肢から確率を返す意思決定モデル(System One)について、Jev、Clef、d1、Jeff、Kev などを構造と料金から比較した記事。

記事の要約

2026 年 10 月 2 日時点の情報で、意思決定モデル(System One Model)を仕組みから比べた記事。状態、質問、選択肢を渡すと各選択肢の確率を返す形式で、TypeSafe AI の Jev が 9 月 15 日の初公開で形式を示し、Cloudflare の Clef、Liquid AI の d1、Upstage の Solar Decide などが同じ形式の API を提供している。

構造を、内部非公開のホスト型、27B 級のベースに LoRA とヘッドを付けたもの、0.8B〜9B 級のベースに付けたもの、エンコーダ型の 4 つに分ける。Cloudflare が測った Jev の応答時間の中央値は 524.1ms で、TypeSafe AI が示す上限 500ms を超えていたが、測定条件が違う数字は直接比べられないとしている。

通常の LLM に enum を選ばせる方法との差は、各候補の確率が返ることと出力の課金方式だとし、確信度が低いときだけ上位のモデルへ回す構成を示している。

AI/LLMqiita.comLGTM7 / ストック6既出スコア 62興味マッチ度 3
10

Claude Code 2.1.286 で、verify という名前のスキルがあるとコミット直前に実行されるようになった挙動を、30 回の実行で確かめた記事。

記事の要約

Claude Code 2.1.286(2026 年 9 月 30 日)の changelog にある、verify という名前のスキルがあればコミット直前に実行するよう指示される、ただしドキュメントのみとテストのみのコミットは除く、という変更を検証した記事。同じ日に取得した公式のスキル解説にはこの規約が載っていなかったという。

マーカーファイルを書くだけのスキルを置いた使い捨てリポジトリで、コミットだけを頼む実行を 30 回(費用 3.12 ドル)行った。2.1.286 でスキル名が verify のときはコード変更で 3 回中 3 回実行され、verify2 に変えるか 2.1.285 にすると 0 回、ドキュメントのみやテストのみの変更でも 0 回だった。

実行された 3 回のうち 2 回はコミットの 2〜3 秒前にマーカーが書かれ、残り 1 回は同じ秒で判定できなかった。ディレクトリ名と SKILL.md の name: を同時に変えたため、どちらが引き金かは切り分けていないとしている。

AI/開発qiita.comLGTM11 / ストック2既出スコア 57興味マッチ度 3

すべて既出