Trend Digest

Jev の派生実装と検証記事が日本語圏を占め続け、Hacker News では Grok 4.7 と Xiaomi MiMo-V2.6 の公開が並んだ

TypeSafe AI の Jev をめぐる記事は Zenn と Qiita の上位の半数を占めたまま、入門から RAG への組み込み検証、Amazon Nova Micro による代替の可否、確率モデルの部品としての捉え直しへと対象を広げている。Hacker News でも Qwen3.5 を土台にした Jev 風の判断モデル Kev が 400 ポイントを集め、日本語圏の解説とオープン実装が同じ週に並んだ。同じ日に xAI の Grok 4.7 と Xiaomi の MiMo-V2.6 が公開されて Hacker News の上位を分け合い、Techmeme は Amazon が Meta の Muse を Amazon.com から遮断したことを伝えている。

  1. 1
    Grok 4.7(新しいタブで開く)Hacker NewsHacker News で 480 ポイント・397 コメントを集めて首位に立ち、Techmeme でも取り上げられて 2 つのサービスに出現した
  2. 2
    Xiaomi MiMo v2.6(新しいタブで開く)Hacker News同じ日に公開されたオープンウェイトモデルとして Hacker News で 469 ポイントを集め、Techmeme でも Opus 5 や GPT-5.6 Sol と同等という主張が伝えられた
  3. 3
    Kev: Qwen3.5 上に構築された Jev 風の小さな判断モデル群(新しいタブで開く)Hacker NewsKev: Tiny Jev-like family of decision models built on top of Qwen3.5日本語圏で Jev の解説と検証が続くなか、そのオープン実装が Hacker News で 400 ポイントを集めた
  4. 4
    Amazon、Meta の AI エージェント Muse が利用者の代理で買い物をするために Amazon.com へアクセスすることを遮断したと表明。規約違反、セキュリティリスク、加盟店の同意がないことを理由に挙げた(新しいタブで開く)TechmemeAmazon says it blocked Meta's Muse AI agent from accessing Amazon.com to shop on users' behalf, citing ToS violations, security risks, and no merchant consentMuse の株価・ダウンロード数・脆弱性と並んで Techmeme の上位を占めるなか、エージェント経由の購買を事業者が正面から拒んだ事例にあたる
  5. 5
    Claude Codeの Agent view とセッション間通信は使ったほうがいい - じゃあ、おうちで学べる(新しいタブで開く)はてなブックマークエージェントを並列に動かすと人間の割り込み処理が増えるという指摘が 83 ユーザーを集め、興味テーマのエージェント設計に直接あたる
77件50件

グローバル

Hacker News

10件
1

xAI が公開した Grok 4.7。自己検証と長いコンテキストの扱いが改善したとされ、入力 100 万トークン 2 ドル・出力 6 ドルで提供される。

コメントの要約

xAI のコーディングと知識労働向けの最上位モデルで、同等のモデルの半額で 2 倍速いと説明されている。Techmeme も、自己検証と長いコンテキストの扱いが改善した点と、入力 100 万トークン 2 ドル・出力 6 ドルという価格を伝えている。

コメントでは、Grok 4.7 は 4.6 より重みが 40% 多いのに価格が据え置きで、リリースが当初の予定から 2 週間近く遅れたことから、xAI 自身が結果に満足していないのではないかという推測が出ている。冒頭のグラフに Astra が含まれていない点を問題視する声もある。

使用感は割れている。個人のチャット用途では Claude や ChatGPT と比べて最も出来が悪いという評価がある一方、Grok build や Grok bot では余計なことをせず筋を通す、という肯定的な報告も並ぶ。

ハイライトAI/モデルx.ai480pt / 397コメントコメントを見る(新しいタブで開く)スコア 98興味マッチ度 3
2

Attention is all you have

論文タイトルをもじった個人ブログ。テトリス効果を引きつつ、長く注意を向けたものが思考を形づくるとして、注意の奪い合いを論じている。

コメントの要約

記事は、長く注意を向け続けたものが思考を形づくるというテトリス効果の教訓を軸に、アプリが注意を奪い合う現在を論じている。娯楽を命じられる 1 つの巨大なアプリではなく、目的ごとのブックマークが数十あった時代との対比も置いている。

コメントでは、機械学習の記事だと思ったという釣りタイトルへの不満がまず並ぶ。本を好む理由として、注意を乗っ取ろうとしてこない点を挙げる声もある。

一方で、Lycos や Yahoo!、MSN のようなカスタムホームページがどれだけ一般的でブラウザに推されていたかを見落としている、という反論や、明確な人生の目標がなければ個別の改善は戦術的な勝ちに留まるという指摘、注意を資本主義の最後のフロンティアとして扱う書籍への言及も出ている。

alicegg.tech554pt / 164コメントコメントを見る(新しいタブで開く)スコア 95
3

What Sun got wrong

Bryan Cantrill による Sun Microsystems の失敗についてのブログ。同じ記事が Lobsters にも投稿され、両サービスで上位に入っている。

コメントの要約

Sun Microsystems が何を間違えたのかを論じた記事で、同じ URL が Lobsters にも投稿されて上位に入っている。

コメントでは、1990 年代後半に Sun や DEC からハードウェアを買う体験が Dell と比べていかに苦痛だったか、対面の営業ミーティングと見積もり改訂の繰り返しだったという回想が並ぶ。自社ソフトが競合のハードと OS でより速く動く状態は多くを間違えた証拠だ、という記事中の一文も引かれている。

Solaris にパッケージマネージャがなく、パッチが丸ごと置き換える方式だったために残業が増えたという体験や、太いサーバーと極薄クライアントという Sun のモデルが仮想化とクラウドを先取りしていた一方、コモディティハードで安く模倣されたという分析も出ている。

bcantrill.dtrace.org488pt / 271コメントコメントを見る(新しいタブで開く)スコア 92
4

Xiaomi が公開したオープンウェイトのマルチモーダルモデル MiMo-V2.6。Pro と Flash の 2 種で、Pro は大半のエージェントベンチマークで Opus 5 や GPT-5.6 Sol と同等だと主張している。

コメントの要約

Xiaomi が MiMo-V2.6 シリーズを公開し、オープンソース化した。Techmeme によれば Pro と Flash の 2 種があり、Pro は大半のエージェントベンチマークで Opus 5 と GPT-5.6 Sol に並ぶと主張している。

コメントでは、グラフでごまかさないラボがようやく出てきたという評価や、中国のラボはモデル公開の見せ方まで上手くなっており堀は薄い、という指摘が出ている。DAW の操作のような多様なタスクの実演、価格帯を含むベンチマーク、科学の現場での実使用を評価する声もある。

今週は OpenAI と Anthropic の次のモデル、Grok 4.7、MiMo が重なる大きな週であり、こうしたオープンな公開が続く以上「減速しろ」という主張は取れない、という意見も並ぶ。MiMo 2.5 がここ数週間で挙動を崩していたのは新版を控えていたからではないか、という推測も出ている。

ハイライトAI/モデルmimo.xiaomi.com469pt / 237コメントコメントを見る(新しいタブで開く)スコア 92興味マッチ度 3
5

NASA’s Mars Sample Return mission is dead

Science 誌の記事。Perseverance が採取した火星の試料を地球に持ち帰る計画が打ち切られたと伝えている。

コメントの要約

Science の記事は、Perseverance が採取した火星の試料を地球へ持ち帰る Mars Sample Return 計画が打ち切られたと伝えている。

コメントでは、JPL に勤める身内から 8 月の時点で聞いていたという報告や、試料はいつか戻るにせよ長く火星に置かれたままになる、という見立てが出ている。他の惑星で見つかった生命に最も近いものに予算の 0.5% すら回さないことへの落胆も並ぶ。

記事が終盤で触れるに留めた中国の並行計画への言及も多く、月からの試料回収に続いて 2028 年打ち上げ予定の Tianwen-3 が火星からの試料回収に挑むことが挙げられている。なぜ試料を掘って地表に置いたままにしたのか疑問だ、という声もある。

science.org288pt / 216コメントコメントを見る(新しいタブで開く)スコア 87
6

Kev: Tiny Jev-like family of decision models built on top of Qwen3.5

Qwen3.5 を土台にした Jev 風の小型判断モデル群。日本語圏で解説が続く Jev に対する、オープンな実装の 1 つにあたる。

コメントの要約

jaredpalmer が公開した Kev は、Qwen3.5 を土台にした Jev 風の小さな判断モデル群である。日本語圏で解説記事が続く Jev に対する、オープンな実装の 1 つにあたる。

コメントでは、この領域の登場を待っていた、内部のルーティングロジックを単純にできそうだ、という反応が出ている。一方で、OSS の Jev 風モデルに注がれる熱量に感心しつつ、コーディングエージェントで使えるのか、それとも全く別の場面向けなのか、用途を問う声もある。

大きなコンテキストを扱えるようになればフロントエンドのスタイル規約やコンポーネント生成規則の強制に使え、スタイルガイドを判断木に置き換えられるという案も出ている。判断モデルはツール呼び出しを持たないため知識のカットオフが問題になり、継続学習か定期的な乗り換えが要る、という指摘も並ぶ。

ハイライトAI/開発github.com400pt / 177コメントコメントを見る(新しいタブで開く)スコア 83興味マッチ度 3
7

Turn off and restrict access to Apple Intelligence features on Mac

Apple の公式サポート文書。Mac で Apple Intelligence を無効化し、機能へのアクセスを制限する手順を示している。

コメントの要約

Apple の公式サポート文書で、Mac 上の Apple Intelligence を無効化し、アクセスを制限する手順を示している。

コメントでは、これは macOS 26 向けで、iOS 27 では 8 つのアプリごとに 5〜6 手順ずつ設定を変える必要がある、という指摘が出ている。無効化してもローカルモデルが占めるストレージは解放されず、空き容量が逼迫するまで残り続けるという報告もある。

初回起動後に無効化する項目を延々とたどる状態は Windows で見慣れたものだ、という評や、Little Snitch で送信を止められるかという質問、Siri のキーボード入力が ⌘⌘ で呼べなくなったことへの不満も並んでいる。

support.apple.com234pt / 157コメントコメントを見る(新しいタブで開く)スコア 82
8

US halts flights at busy East Coast airports, says fiber line cut

Reuters の記事。通信障害を理由に FAA が東海岸の一部空港で便を止めたと伝えている。原因は光ファイバーの切断とされる。

コメントの要約

Reuters は、通信障害を理由に FAA が東海岸の一部空港で便を止めたと伝えている。原因は光ファイバーの切断とされる。

コメントで最も反応が集まったのは、予備系に切り替えようとしたところ予備のファイバーも断線していた、という点である。人命に関わる系が予備の不通を切り替え時まで報告しない設計であることを問題視し、どれだけの期間気づかれずにいたのかを問う声が出ている。

インターネットは断線を迂回する自己修復の網ではなかったのか、それとも航空管制は冗長性の低い独立網なのか、という疑問や、屋上の Starlink で冗長化すべきという案も並ぶ。同じ日にロシアによる欧州への灰色地帯攻撃を報じる記事を読んだ、という書き込みもある。

reuters.com187pt / 103コメントコメントを見る(新しいタブで開く)スコア 82
9

Python Workers are now generally available

Cloudflare Workers の Python 対応が一般提供になったという発表。Pyodide を土台にしている。

コメントの要約

Cloudflare が Workers の Python 対応を一般提供に切り替えたという発表である。

コメントでは、コールドスタートの実測を問う質問が出ている。WebAssembly を使う Workers は起動に時間がかかるのが欠点の 1 つだったが、そこを回避できたのかという内容である。

同じように Go も簡単に使えるようになってほしいという希望、Mojo はエッジ実行に向くのではないかという提案、土台である Pyodide に Cloudflare が資金を出してほしいという声も並ぶ。タイトルを「Python のコーダーを AI に置き換えたので彼らが求職中になった」と読んだ、という冗談も付いている。

Web/開発blog.cloudflare.com177pt / 28コメントコメントを見る(新しいタブで開く)スコア 77興味マッチ度 2
10

I don't want to read what you didn't write

AI で作ったものを AI に振り返らせて要約させ、それを共有する流れへの批判を書いたブログ。そうして出てきた文書を読むのは難しいというより罰だ、としている。

コメントの要約

記事は、AI で何かを作り、その内容を AI に振り返って要約させるという型を取り上げ、そうして出てきた文書を読むのは難しいというより罰だと書いている。

コメントでは、書くことは自分の脳から相手の脳へ情報を移すことであり、1000 ビット分の意味を伝えたいときに 300 ビットを LLM に渡して残り 700 を埋めさせることはできない、という指摘が挙がっている。

同趣旨の記事がここ数日続いていることへの言及や、AI で文章を作るのを楽しんでいる同僚にどう切り出すかという悩みも並ぶ。一方、事実だけを扱うなら書き方の幅は限られるという反論や、記事の最初の一文自体が批判対象の文体ではないかという指摘も出ている。

AI/文章blog.colinbreck.com164pt / 50コメントコメントを見る(新しいタブで開く)スコア 77興味マッチ度 2

Lobsters

10件6件
1

What Sun got wrong

Sun Microsystems の失敗を論じた Bryan Cantrill のブログ。Hacker News にも同じ記事が投稿され、両サービスで上位に入っている。

コメントの要約

Hacker News と同じ記事が Lobsters にも投稿され、historical タグで上位に入っている。

コメントでは、SPARC はそれなりに堅い設計で、レジスタウィンドウの非同期退避のような少しの手直しで優れたアーキテクチャになり得た、という指摘が出ている。これに対し、少しの手直しで優れたものになるなら実際に少しずつでも改善されたはずだ、という反論が返っている。

外から見ても明らかなほど組織が機能していなかったという回想に対し、成功した技術もまた機能不全の組織から生まれているため相関は思うほど強くないのではないか、という指摘もある。技術ではなく営業の話が中心だったことへの物足りなさも書かれている。

bcantrill.dtrace.org101pt / 44コメントコメントを見る(新しいタブで開く)スコア 94
2

Software sandboxing: The basics (2025)

サンドボックスの基礎をまとめた 2025 年の記事。programming / security / unix タグで Lobsters に再浮上した。

コメントの要約

2025 年に書かれたサンドボックスの基礎解説が、programming・security・unix タグで再び上位に入った。

コメントでは、OpenBSD の pledge と unveil が扱われていないことへの疑問がまず出ている。Chromium や Firefox のような大きなものから小さなアプリまで機能している実例だ、という指摘である。

Capsicum が広まらなかった理由としては、ファイルディスクリプタを事前に開いて openat を使う形にプログラムを組み替える必要があり、FreeBSD 固有の libcasper も要る点が挙げられている。Landlock や unveil なら 10〜20 行で済むという比較や、LD_PRELOAD のシムで既存コードを包む方法、WASI が capability 方式へ舵を切ったという指摘も並ぶ。

セキュリティblog.emilua.org51pt / 33コメント既出コメントを見る(新しいタブで開く)スコア 86興味マッチ度 2
3

ChatGPT now knows what you do on other websites via ad collector

ChatGPT の広告コレクターがサイト横断の行動を ChatGPT アカウントに紐づけていると報告した記事。前日は Hacker News で首位だった。

コメントの要約

前日に Hacker News で首位に立った記事が、Lobsters でも ai・privacy タグで上位に残っている。ChatGPT の広告コレクターが、他サイトでの行動を ChatGPT アカウントに結びつけていると報告する内容である。

コメントでは、タイトルは釣り気味だが中身は技術的な分解であって意見記事ではないとして、off-topic の投票理由を問う声が出ている。LLM の話題は一定の反発を呼ぶ、という返答も付いている。

対処としては、ChatGPT を使わないことに加えて OpenAI の広告サーバーをブロックする手も挙げられている。uBlock Origin の既定リストの 1 つである EasyPrivacy が該当すること、Firefox のクロスサイト Cookie 分離で防げるのではないか、という指摘も並ぶ。

セキュリティbuchodi.com61pt / 7コメント既出コメントを見る(新しいタブで開く)スコア 82興味マッチ度 2
4

Are we really going to use the same Desktop UX forever?

デスクトップの操作体系が長く変わっていないことを問う発表動画。design / video タグで投稿されている。

コメントの要約

デスクトップの操作体系が長く変わっていないことを問う発表動画で、design・video タグで投稿されている。

コメントでは、技術が「完成」していてはいけないのか、という疑問が出ている。2003 年の macOS や Windows のデスクトップで十分で、この 20 年のデスクトップ環境の変更に価値を感じたことがない、という立場である。

これに対し、モニタの解像度と横幅が上がり、計算機が強力になって並行作業が増え、スマートフォンなど他の機器と共存する必要が出たため目標自体が動いている、という反論が返されている。1996 年に約 100 万画素だった手元が今は約 1700 万画素なのに、使う道具は端末・ブラウザ・ワープロ・表計算のままだ、という観察も並ぶ。

youtube.com50pt / 14コメント既出コメントを見る(新しいタブで開く)スコア 79
5

Do you use :visited on links?

訪問済みリンクの色を変えているかを問う個人ブログ。a11y / web タグで投稿されている。

コメントの要約

訪問済みリンクに :visited を使っているかを問う記事で、a11y・web タグで投稿されている。筆者は :visited を未訪問と同じ見た目にしており、それが Web の既定の振る舞いになっていると書いている。

コメントでは、それは事実と違うのではないか、利用者に対する小さな敵対行為だ、という反応が出ている。一方で、ナビゲーションのリンクは内容が変わり続けるため訪問済みの色分けに意味がなく、本文リンクとは分けて扱うのが従来からの合意だ、という整理も示されている。

:visited の色は過去に利用者のフィンガープリンティングに使われた経緯があり、同じ色にするのは敵対というより当時の名残だ、という指摘も出ている。CSS で色を変えず color-scheme だけ指定してブラウザの既定に任せる、という立場も並ぶ。

フロントエンドkevquirk.com22pt / 23コメントコメントを見る(新しいタブで開く)スコア 78興味マッチ度 2
6

An actively maintained and updated Motif fork actually exists

OSNews の記事。Motif のフォークが今も保守され更新され続けていると伝えている。

コメントの要約

OSNews の記事で、Motif のフォークが今も保守され更新され続けていると伝えている。unix タグで投稿された。

コメントでは、Motif 自体は率直に言ってひどいものだったが、自分にとって有用なソフトウェアを蘇らせて更新し続ける人々は尊敬する、という反応が出ている。1995 年に大学で UNIX とインターネットに触れた入口が Motif だったという回想も並ぶ。

記憶の中ではもっと良く見えていた、640x480 の CRT でなら確かに見栄えがした、という書き込みのほか、Motif は 1989 年に DEC や HP などの UNIX ベンダー連合が出したもので linux タグは合わない、LessTif なら Linux と結びつく、というタグへの指摘も出ている。

osnews.com42pt / 22コメント既出コメントを見る(新しいタブで開く)スコア 76
7

What are you doing this week?

各自が今週取り組んでいることを書き込む Lobsters の定例スレッド。検索エンジン marginalia の索引圧縮や、止まっていたプロジェクトの再開などが並んでいる。

コメントの要約

各自が今週取り組んでいることを書き込む Lobsters の定例スレッドである。

marginalia の索引で値ブロックの圧縮を試しているという書き込みがあり、ジグザグデルタ符号化したデータをバイトプレーンに並べ替えてから LZ4 で圧縮する方法を説明している。索引は 1 パーティションあたり約 1.1 TB で通常のパーティションが 8 つ、総容量は約 90 TB だが、クロールデータや索引の構築用にも容量が要るとしている。

数週間詰まっていた 3 つのプロジェクトがようやく動き出したという報告や、アマチュア無線の資格試験に向けて教本と過去問を進めているという書き込みも並んでいる。

lobste.rs16pt / 33コメントスコア 75
9

Creating a Blog in Gemini://

Gemini プロトコル上にブログ(gemlog)を作った記録。web タグで投稿されている。

コメントの要約

Gemini プロトコル上にブログを作った記録で、web タグで投稿されている。Gemini 上のブログは gemlog と呼ばれ、公式の仕様はないが慣習が固まっていると書いている。

コメントでは、購読に関する companion specification は存在していて「ある程度は公式」だ、という補足が入っている。Gemini を使うつもりがなくても学ぶ価値があり、物事のやり方が変わるという記事中の一節に同意する書き込みも並ぶ。

Gemini には Cookie がなく、訪問をまたぐ状態は TLS クライアント証明書で扱う。サーバーはパスに対して status 60 を返し、クライアントが証明書を生成するか既存のものを提示する、という仕組みの説明も出ている。プロトコルとマークアップが単純なため、サーバーやクライアントの自作も現代の Web より桁違いに近い、という意見もある。

brennan.day27pt / 5コメントコメントを見る(新しいタブで開く)スコア 70
10

Self-Hosting Behind CGNAT

CGNAT の内側からサービスを公開する方法を書いた記事。linux / networking タグで投稿されている。

コメントの要約

CGNAT の内側からサービスを公開する方法を書いた記事で、linux・networking タグで投稿されている。

コメントでは、中継用のブリッジと自宅ネットワークを完全につなぐ構成に不安があるという声が出ている。物理ネットワーク内のサーバーを公開するのと大差ないとしつつ、ブリッジが侵害されたときにネットワーク全体へ到達されうる点が挙げられている。

MTU を下げないと動かないことが多いという実務上の注意、ハッカースペースの VPS で同じ構成を運用しているという報告、Oracle の無料 VPS で似たことをしているが Tailscale から離れるのは怖いという書き込みも並ぶ。

david.alvarezrosa.com17pt / 6コメントコメントを見る(新しいタブで開く)スコア 66

Reddit

7件
1

CSE 452: Google's Introduction to Distributed System Design

ワシントン大学の分散システム設計の講義 CSE 452 を紹介する投稿。ただしリンク先は講義ページではなく、資料に含まれる Steve Yegge のプラットフォーム論になっている。

コメントの要約

投稿はワシントン大学の分散システム設計の講義 CSE 452 を紹介するものだが、リンク先は講義ページではなく、その資料に含まれる Steve Yegge の 15 年前の文章になっている。

コメントでは、リンクを開くと Google が PaaS 企業になれなかったことへの長文だった、という指摘が最初に入っている。投稿者は、講義や論文を文脈なしで貼って過去に咎められた経験から意見も添えた、と説明している。

講義ページの URL が別途貼られたうえで、RPC や遷移系、BigTable のような先行システムが中心でやや古いという評価が出ている。2011 年に読んで面白かったものが 15 年後も同じように面白い、という感想も並ぶ。

courses.cs.washington.eduコメントを見る(新しいタブで開く)スコア 94
2

Back to Coupling and Cohesion

結合度と凝集度を定量的な指標として扱い、さまざまな設計原則の共通の土台として位置づけた記事。

コメントの要約

投稿者は、結合度と凝集度を実務で使える定量的な指標として扱い、さまざまな設計原則の背後にある共通の土台として整理した記事だと説明している。AI が生成した記事ではないので削除しないでほしい、という但し書きも添えている。

コメントでは、簡潔でよく書けている、新鮮だという評価が付いている。

一方で、SRP は文面だけをなぞって本質を外す型が多いため Functional Core / Imperative Shell に乗り換えた、という書き込みがあり、それは SRP の一実装に乗り換えただけではないか、という反論が返されている。「そうなりがち」と「常にそうである」は違う、というやり取りに続いている。

設計bastrich.techコメントを見る(新しいタブで開く)スコア 85興味マッチ度 2
3

TIL: 0xCAFEBABE

Java のクラスファイルの先頭に置かれるマジックナンバー 0xCAFEBABE の由来を説明した artima の記事。

コメントの要約

Java のクラスファイルの先頭に置かれるマジックナンバー 0xCAFEBABE の由来を説明した記事である。

コメントでは、16 進数で意味のある語を綴るのは Java が最初ではないという記事末尾の記述に触れ、Burroughs B6700 が「未初期化」のメモリを 48 ビット語の 0xBADBADBADBAD で埋めていた例が引かれている。

他にも 0xBADF00D や 8BADF00D、BAADF00D、0xFEEDF00D といった例、乱数のシードに 0xC0FFEE を使う習慣、1980 年代の Novell の IPX/SPX でネットワークセグメントに DEADBEEF や A55FACE5 と名付けていたという回想も並んでいる。

4

Bernstein’s Factorization Method Helped Factor RSA-240 in 2020

2002 年に提案された Bernstein のバッチ平滑性判定が、2020 年の 795 ビット RSA-240 の分解に使われたことを解説した記事。

コメントの要約

記事は、バッチ平滑性検出とも呼ばれる Bernstein のアルゴリズムを扱っている。2002 年に提案されたものの長らく民間伝承のような扱いだったが、2020 年の 795 ビット RSA-240 の分解で有用だったことが判明した、という筋である。

投稿に付いたコメントは投稿者自身による要約 1 件にとどまる。この手法の要点は、数を 1 つずつ扱うのではなく、与えられた数のリストをまとめて素因数分解できる点にあると述べている。

そのほかの議論は付いておらず、スレッドは要約だけで止まっている。

leetarxiv.substack.comコメントを見る(新しいタブで開く)スコア 60
5

Covert Caches: When Is A Cache, A Cache?

TLB や分岐先バッファのような構造をどこまでキャッシュと呼べるかを論じた記事。

コメントの要約

記事は、TLB や分岐先バッファのような構造をどこまでキャッシュと呼べるかを論じている。

コメントでは、データはすべて CPU 内でキャッシュされており、ローカル変数もスコープの定まったキャッシュであるから、キャッシュでない場所を数えるほうが早い、という見方が出ている。

これらの構造は何を保持するかではなく、間違っていることが許されるかどうかで 2 つの系統に分かれる、という整理も示されている。TLB は古いエントリが正しさを壊すため無効化が要るのに対し、分岐先バッファは外しても数サイクル失うだけで済む、ただし Spectre がそれを覆した、という指摘である。

parallelprogrammer.substack.comコメントを見る(新しいタブで開く)スコア 44

GitHub Trending

10件2件
1

高価な市場情報プラットフォームの代替をうたうオープンソースの株価トラッカー。リアルタイム価格の追跡、アラート設定、企業情報の閲覧を備える。

記事の要約

OpenStock は、高価な市場情報プラットフォームの代替をうたう TypeScript 製のオープンソースプロジェクトである。リアルタイム価格の追跡、個別のアラート設定、企業情報の閲覧を備えるとしている。

証券会社ではないこと、提供元の規約や設定によって市場データが遅延しうること、投資助言ではないことが明記されている。ライセンスは AGPL-3.0 で、改変・再配布・Web サービスとしての提供のいずれでも同じライセンスでのソース公開と原著者のクレジットが求められる。

README の冒頭には、Open Dev Society による別プロジェクト kitbash の告知と、暗号資産のコントラクトアドレスが併記されている。

github.com+844 stars today / 計17,714 / TypeScript既出スコア 94
2

コンピュータ操作エージェント向けの基盤。デスクトップ自動化、隔離されたクラウドデスクトップ、ローカルの macOS VM、判断用の小型モデル、評価用ベンチマークを提供する。

記事の要約

Cua は、AI エージェントに操作できるコンピュータを与える基盤である。オープンソースのデスクトップ自動化、隔離されたクラウドデスクトップ、ローカルの macOS VM、コンピュータ操作の判断に特化した小型モデル、評価用のベンチマークをまとめて提供する。

構成要素は、Linux デスクトップを払い出す Cua Fleets、判断用の小型モデル CUA-S1、アプリを操作する Cua Driver、Tahoe VM を作る Lume、タスクを作って検証する Cua Bench に分かれる。エージェントとモデルは持ち込みでよく、Cua 側はコンピュータと自動化ツールを担う。

同プロジェクトは Computer-Use 2.0 を、エージェントが同一のタスクの中でコード・API・GUI を行き来する状態として説明している。デモでは 2 つの Driver セッションが LibreOffice Calc のセルと Inkscape のオブジェクトを選択する様子を示している。

AI/開発github.com+609 stars today / 計25,690 / HTML既出スコア 87興味マッチ度 3
3

自律的な作業と専用 UI を組み合わせたエージェントアプリを作る TypeScript フレームワーク。機能を action として一度定義すると、エージェントはツールとして、UI はコードから呼べる。

記事の要約

Agent-Native は、自律的な作業と専用の UI を組み合わせたエージェントを作るためのオープンソースの TypeScript フレームワークである。各機能を action として一度定義すると、エージェントはそれをツールとして使い、UI はコードから同じものを呼ぶ。

設計の動機として、コーディングエージェントがテキスト欄だけでなく、文脈・ツール・ファイル・テスト・プレビューのある環境で動いている点を挙げる。知識労働にも同種の環境が要り、UI があればエージェントにできることが見え、点検・編集・承認・共有の手段も渡せるとする。

仕組みは 3 つの共有で説明されている。action は検証・権限・実装を両方の経路で共有し、エージェントの作業と UI の作業は同じデータに現れ、エージェントは関連する UI の状態を受け取る。

AI/開発github.com+607 stars today / 計5,890 / TypeScript既出スコア 80興味マッチ度 3
4

Terraform で定義するセルフホストのクラウド開発環境。AI コーディングエージェントのループを制御プレーン側で実行し、ワークスペースに API キーを置かない構成を取る。

記事の要約

Coder は、クラウド開発環境と AI コーディングエージェントのためのセルフホスト型プラットフォームである。ワークスペースは Terraform で定義し、Wireguard のトンネルで接続し、使われていないときは自動で停止する。

Coder Agents は、AI コーディングエージェントのループを自分たちのインフラ上の制御プレーンで実行する。そのためワークスペース内に API キーを置かずに済む。

対象となる環境は EC2 の VM、Kubernetes の Pod、Docker コンテナなどで、いずれも Terraform で記述する。

AI/開発github.com+460 stars today / 計16,421 / Go既出スコア 73興味マッチ度 3
5

投資銀行・株式調査・プライベートエクイティ・ウェルスマネジメント向けの参照エージェント、スキル、データコネクタ集。Cowork プラグインと Managed Agents API の両方で使える。

記事の要約

投資銀行、株式調査、プライベートエクイティ、ウェルスマネジメントのワークフロー向けに、参照実装のエージェント、スキル、データコネクタをまとめたリポジトリである。

同じソースから 2 通りの使い方ができる。Claude Cowork のプラグインとして入れるか、Claude Managed Agents API 経由で自前のワークフローエンジンの背後に配置するかで、システムプロンプトとスキルは共通である。

投資・法務・税務・会計の助言には当たらないと明記されている。エージェントはモデルやメモ、リサーチノート、照合といった成果物の下書きを作るが、投資判断や取引の執行、リスクの確定、記帳、オンボーディングの承認は行わず、出力はすべて人間の承認待ちとして置かれる。

AI/開発github.com+424 stars today / 計35,819 / Python既出スコア 66興味マッチ度 2
6

インターネットに接続せず動くオフライン前提の知識・教育サーバー。Wikipedia、書籍、講座、地図、任意でローカル AI を自前のハードウェアで動かす。

記事の要約

Project NOMAD は、インターネットなしで動くことを前提にした知識・教育サーバーである。Wikipedia、数千冊の書籍、講座、地図、任意でローカルの AI を、自分のハードウェア上で動かす。

Debian 系の OS であればインストールでき、推奨は Ubuntu 26.04 LTS、24.04 LTS と Debian 12 も対応する。導入はすべて端末上で完結し、ツールと資料はブラウザから使うためデスクトップ環境は不要である。

インストールは apt で curl を入れてからインストールスクリプトを取得し、sudo で実行する形が案内されている。

github.com+394 stars today / 計37,854 / TypeScript既出スコア 60
7

長い動画の字幕を AI で解析してハイライトを切り出し、タイトルまで生成する編集ツール。デスクトップアプリと Docker の Web UI を備える。

記事の要約

AutoClip は、長い動画を共有に値する短い断片に変えることを目的としたツールである。AI が字幕を解析してハイライトの位置を特定し、タイトルを生成して、断片と詰め合わせを自動で切り出す。

想定用途はインタビュー、ポッドキャスト、講座、配信の録画で、デスクトップアプリと Docker の Web UI が提供される。macOS の Apple Silicon 版と Windows x64 版のインストーラが配布されている。

v1.3.1 以降、製品の UI と公式サイトと README が中国語・英語・日本語・韓国語・スペイン語・ポルトガル語・ロシア語・フランス語に対応している。UI の言語は上部バーで切り替えるかシステム設定に従い、利用者の素材と生成物は原文のまま残る。

github.com+250 stars today / 計8,221 / Pythonスコア 53
8

毎週金曜に公開される中国語の技術ニュースレター「科技爱好者周刊」を、そのまま GitHub で管理しているリポジトリ。

記事の要約

毎週金曜に公開される中国語の技術ニュースレター「科技爱好者周刊」を、そのまま GitHub 上で管理しているリポジトリである。記事・ソフトウェア・資料の投稿は issue で受け付けている。

2026 年 9 月の号は「再见了,React Native」(第 413 期)、「禁止 issue,只用 PR」(第 412 期)、「OpenClaw 2.0 是一个缩影」(第 411 期)と並ぶ。

8 月以前も「你需要知道的 AI 三种机制」「程序员的职业未来」「你需要知道的 AI 缓存知识」など、AI とエンジニアのキャリアを扱う号が続いている。討論区には無料の求人スレッドも置かれている。

github.com+182 stars today / 計103,917既出スコア 46
9

Android / iOS 端末の侵害の痕跡を集めるフォレンジックツール。Amnesty International Security Lab が Pegasus Project の文脈で公開した。

記事の要約

MVT(Mobile Verification Toolkit)は、Android と iOS の端末が侵害された可能性を示す痕跡を集める作業を、簡単にし自動化するツール群である。

Amnesty International Security Lab が 2021 年 7 月、Pegasus Project の文脈でフォレンジックの手法書とともに公開した。現在も Amnesty International と他の貢献者によって保守されている。

直近で v3 ブランチがマージされ、破壊的変更が入っている。mvt の出力を他のスクリプトから使っていた場合は壊れている可能性があるとして、該当の issue が案内されている。

セキュリティgithub.com+169 stars today / 計13,584 / Pythonスコア 39興味マッチ度 2
10

コーディングエージェント間で長期記憶を引き継ぐための Rust 製ツール。Claude Code を途中でやめて同じディレクトリで Codex を開いても、経緯を説明し直さずに続けられることを狙う。

記事の要約

ai-memory は、AI コーディングエージェントの長期記憶を扱う Rust 製のツールである。Claude Code を作業の途中でやめて同じディレクトリで OpenAI Codex を立ち上げても、アーキテクチャや失敗した方針、未解決の問いを説明し直さずに続けられることを目指している。

既存のエージェントにも記憶機能はあるが、メモが 1 台のマシンに置かれ、1 つのエージェントに属し、ツールを替えた時点で見えなくなるという共通の壁があるとする。

ai-memory は Claude Code、Codex、Cursor、Gemini CLI、OpenCode、Grok、Devin、Kimi、Kiro など 20 以上のハーネスが 1 つの記憶を共有する形を取る。引き継ぎは慣習ではなくプロトコルとして扱われ、型付きで所有者があり、ちょうど一度だけ引き受けられる。記憶は自分で動かすサーバーに置く。

AI/開発github.com+167 stars today / 計7,668 / Rust既出スコア 32興味マッチ度 3

Techmeme

10件
1

Intel closes up 12%, AMD 10%, and Arm 17% on Monday amid investor optimism that Meta's Muse could boost CPU demand; AMD's market cap tops $1T for the first time

Meta の Muse が CPU 需要を押し上げるとの見方から半導体株が上昇し、AMD の時価総額が取引時間中に初めて 1 兆ドルを超えたと伝える記事。

AI/業界barrons.comコメントを見る(新しいタブで開く)スコア 95
2

Sensor Tower: Muse was downloaded 902K+ times in the six days after its launch on Sept. 8, vs. Meta AI's 773K in the same post-launch period; META jumps 12%+

Meta の AI エージェント Muse が公開から 6 日で 90.2 万回以上ダウンロードされ、モバイルアプリのランキング上位に立ったと伝える記事。

AI/業界bloomberg.comコメントを見る(新しいタブで開く)スコア 95興味マッチ度 2
3

Amazon says it blocked Meta's Muse AI agent from accessing Amazon.com to shop on users' behalf, citing ToS violations, security risks, and no merchant consent

Amazon が、利用者の代理で買い物をする Meta の Muse を Amazon.com から遮断したと表明した。規約違反、セキュリティ上のリスク、加盟店の同意がないことを理由としている。

ハイライトAI/業界geekwire.comコメントを見る(新しいタブで開く)スコア 94興味マッチ度 2
4

OpenAI says automated research could improve alignment, but “fully autonomous RSI is not happening today” and shouldn't be pursued unless it can be done safely

OpenAI が、研究の自動化はアラインメントの改善に寄与しうるとしたうえで、完全に自律的な再帰的自己改善は現時点で起きておらず、安全に実施できない限り追求すべきではないと述べた。

AI/業界openai.comコメントを見る(新しいタブで開く)スコア 87興味マッチ度 2
5

Sources: OpenAI is developing features to counter SpaceX's Grok Bot “teammates”, and has discussed creating a personal AI assistant to compete with Meta's Muse

OpenAI が Grok Bot のチームメイト機能に対抗する機能を開発中で、Muse に対抗する個人向けアシスタントも検討していると The Information が伝えた。

AI/業界theinformation.comコメントを見る(新しいタブで開く)スコア 86興味マッチ度 2
6

Ahead of Sam Altman's UN address, OpenAI urges the US to lead an effort to develop global safety and security standards for building frontier systems

OpenAI が国際的な AI の安全基準を公開し、米国が基準づくりを主導するよう求めた。米国と中国がリスク軽減の方法を検討している時期にあたる。

7

Google unveils Googlebook hardware, with flagship devices from Acer, Asus, Dell, HP, and Lenovo, offering deep Android integration, coming in October for $899+

Google が Googlebook のハードウェアを発表した。Acer、Asus、Dell、HP、Lenovo が主力機を出し、10 月に 899 ドルからの発売となる。

8

Google's Googlebook OS, built on Android with a Material 3 Expressive and ChromeOS hybrid UI, offers deep Android 17 integration, 10 years of support, and more

Googlebook OS は Android を土台に、Material 3 Expressive と ChromeOS を混ぜた UI を採用する。Android 17 との統合と 10 年間のサポートが挙げられている。

9

Googlebook OS hands-on: Android gives it a solid foundation and Pixel-like feel; Gmail and Calendar use Trusted Web Activities via Play Store instead of PWAs

Googlebook OS の実機レビュー。Gmail と Calendar が PWA ではなく、Play ストア経由の Trusted Web Activities として提供される点を伝えている。

10

MediaTek unveils the Dimensity CX C10 Max, a 3nm TSMC N3 flagship SoC designed for Google's upcoming Googlebook lineup, with an 8-core CPU and an 11-core GPU

MediaTek が Googlebook 向けの最上位 SoC、Dimensity CX C10 Max を発表した。TSMC の 3nm N3 プロセスで、8 コア CPU と 11 コア GPU を備える。

日本

はてなブックマーク

10件
1

子どもが生まれて 1 年になるエンジニアが、育児と技術の時間配分をどう折り合わせているかを書いた個人ブログ。成長を見る楽しさと、以前のように時間を取れない現実を並べている。

コメントの要約

記事は、抱っこ紐で子どもが寝ている間に雑に書いたものとして始まる。つかまり立ちをするようになった成長を毎週の親子体操教室で見る楽しさと、以前のようには時間を取れない現実を並べている。

コメントでは、育児タスクが増えたぶん既存の何かを減らして調整するしかないだろう、という反応が出ている。技術職は自由時間に学んだ量が効いてくるため、家庭を省みると降りるしかない、という見方も示されている。

小学校までの 7 年をキャリアに充てるか、稼いだ余剰を溶かすかの選択になり、正解だったかは 7 年後まで分からないという指摘や、妻の実家との同居を挙げる声も並んでいる。

キャリアtech-blog-v2-opal.vercel.app181 usersコメントを見る(新しいタブで開く)スコア 89興味マッチ度 2
2

海外で SIM を差し替えると SMS の確認コードが届かなくなる体験を入口に、TOTP を RFC 6238 に沿って Python で実装し、SMS 認証と認証アプリの差を整理した Qiita 記事。

コメントの要約

記事は、認証アプリの 6 桁が登録時に共有した秘密の値と現在時刻から端末内だけで計算されており、通信していないことを示す。そのうえで SMS が電話番号という乗っ取れる経路に依存すること、認証アプリも中継フィッシングには負けることを整理している。

コメントでは、社内で SMS 認証が「とりあえず安全」の扱いになりがちで、代替を説明する材料が欲しかったという反応が出ている。RFC 6238 を読んで Python で 20 行足らず書いたら Google Authenticator と同じ数字が出た、という一節も引用されている。

一方で、AI による文章生成の管理ができていないという批判や、TOTP の許容幅を前後 10 分にされた実例、パスキーの紛失対策としてハードウェアトークンを自宅に置く運用を挙げる声もある。

セキュリティqiita.com212 usersコメントを見る(新しいタブで開く)スコア 86興味マッチ度 2
3

「テックリード」の指す範囲が人によってばらつく現状を起点に、アーキテクトや EM との責務の境界を整理したブログ。

コメントの要約

記事は、テックリードがリーダーやマネージャーの役職名として使われたり、アーキテクトと同義に扱われたりして、本人を含む組織内で期待が噛み合っていない状況を出発点にしている。

コメントでは、テックリードはチームにおける技術的な方向づけと意思決定をリードするが、アーキテクトは特定のシステムやドメインを対象にリードする、という記事中の区別が抜き出され、曖昧に使い分けないようにという注意が添えられている。

言葉の定義が曖昧なまま「なんでも屋」にされて疲弊する現場が多いため、この整理は助かるという反応も出ている。

キャリアmtx2s.hatenablog.com145 usersコメントを見る(新しいタブで開く)スコア 86興味マッチ度 2
4

複数のエージェントを並列に動かすと人間の割り込み対応が増える問題に対し、Claude Code の Agent view とセッション間通信を使う運用を書いたブログ。

コメントの要約

記事は、エージェントに任せれば人は楽になるという話に対し、複数を起動すると減っているのは考える時間だと書く。セッションごとの入力待ちに答え、別 worktree の差分を読み、終わった変更を同じ状態で動かす手間を挙げている。

コメントでは、エージェントを並列で動かすと人間の割り込み処理が増えて逆に忙しくなる現象の言語化が的確だ、という反応が出ている。あとで読む、という短い書き込みも並ぶ。

筆者のものとして、エージェントの進化はコーディングを効率化する道具の話にとどまらず、何をどう書くか、どこまでを人が手を動かすかという開発の前提そのものが変わりつつある、という引用も添えられている。

ハイライトAI/開発syu-m-5151.hatenablog.com83 usersコメントを見る(新しいタブで開く)スコア 81興味マッチ度 3
5

フォルダ名の日付表記をめぐる X の投稿まとめ。ハイフン区切りなら新しい順に並ぶという指摘から、yymmdd への統一論まで広がっている。

コメントの要約

まとめは、フォルダ名を「2026-09-19」とした夫に「20260919 でいいのでは」と言ったところ、こうすると新しい順に並ぶから便利だと返された、というフィンランド在住者の投稿から始まる。

コメントでは、2026-09-19 のほうが区切りを探さずに読めて視認性が高く、その一点だけでも 20260919 でよいことにはならない、という指摘が出ている。

ファイル名の先頭に日付を入れない運用を挙げる声や、全角一文字でも読み取れるよう 260919 にしているという声、住所の表記順との比較、まとめ方そのものへの批判も並んでいる。

6

テキストを生成しない判断特化モデル Jev を、アカウント作成から Playground まで手順で追い、文章に個人情報が含まれるかを判定させた解説記事。

コメントの要約

記事は、Jev のアカウント作成から Playground の使い方までを追い、文章に個人情報が含まれるかを実際に判定させている。従来の LLM と比べた料金と応答速度の違いにも触れている。

コメントでは、入力 100 万トークンあたり 0.042 ドル、出力は無料という料金が引用され、桁違いに安いという点に反応が集まっている。

テキスト生成を行わない判定特化であることから、コスト削減と応答速度の面で使い勝手がよさそうだという見方や、賢くて高い AI は淘汰されるのではないかという声、この種の記事は更新されないので情報がすぐ腐るという指摘も出ている。

AI/開発dev.classmethod.jp70 usersコメントを見る(新しいタブで開く)スコア 78興味マッチ度 3
7

登壇スライド作成のノウハウを Claude Code 向けのスキル 3 本にまとめ、Marp のダークテーマと PDF 検査スクリプトとあわせて GitHub で公開した記事。

コメントの要約

記事は Claude Code の一人称で書かれており、登壇を重ねて培ったスライド作成のノウハウを、エージェントが読めるスキルの形にまとめて公開したと伝えている。収録は slide-story、slide-figures、slide-design-dark の 3 本で、黒地の Marp テーマと PDF の検査スクリプト、見本デッキも同梱されている。

コメントでは、スライドの体裁やルールをプロンプトとスクリプトで自動検証させる方法が実用的だ、という反応が出ている。タイトルの表現に触れた短い書き込みも並ぶ。

AI/開発qiita.com39 usersコメントを見る(新しいタブで開く)スコア 76興味マッチ度 3
9

デジタルハリウッド大の杉山知之前学長へのインタビュー全文。生成 AI でクリエイターは不要になるのかという問いに、30 年の業界経験から答えている。

コメントの要約

記事は、30 年以上デジタルクリエイターを育成してきた杉山知之前学長に、生成 AI でクリエイターが不要になるのかを問うたインタビューの全文である。写植も版下も消えたとして、今回だけ例外ということはないと述べている。

これからのデザイナーに要る力は「作る力」ではなく「これは違う、と言える力」だという発言が、コメントで繰り返し引用されている。

一方で、AI が作業を引き受けると人が下積みで作業を学ぶ機会が失われ、作業を知らずにディレクションはできない、という懸念が出ている。これに対し大工と建築士の関係を挙げて反論する声や、質の低いデザイナーは淘汰されるべきだという声も並ぶ。

AI/キャリアsankei.com37 usersコメントを見る(新しいタブで開く)スコア 67興味マッチ度 2

Zenn

10件1件
1

Jev を一晩試した記録。チェス、MOBA 風ゲームのリアルタイム操作、ESLint のエミュレーション、Playwright によるブラウザ操作を実験し、真価は並列度にあると結論づけている。

記事の要約

記事は Jev を一晩叩いた実験ログを公開している。チェスでは Claude 5 Sonnet に 5 戦全勝、LoL を簡略化した MOBA ではスプリットプッシュやタワーダイブのような戦術が観察され、ESLint のエミュレーションではルール名とコードだけで正答率 86% だったと報告している。

Playwright によるブラウザ操作では、判断自体は高速だが単独ではエラーから復旧できず、Claude にログを監視させて補助させると 96% 以上の精度になったとしている。

1 リクエストは 500ms ほどでモデル単体の性能が特別高いわけではなく、真価は 256 個の質問を同時に投げて同時にスコアを得られる並列度にあるとする。confidence が 0.96 以上ならほぼ確信、0.4 以下は誤りの可能性が高いため別モデルへのフォールバックに使えると書いている。

AI/開発zenn.devいいね444 / ブクマ107既出スコア 84興味マッチ度 3
2

Jev の JSON 出力デモを、既存 LLM の logit 参照と KV Cache 再利用で再現できるか検証した記事。Gemma3 270M で 77 倍の高速化を確認している。

記事の要約

記事は、Jev の高速な JSON 出力デモを見て「既存の LLM でもできるのでは」と考えたところから始まる。回答候補が決まっている場合、JSON 全体を自己回帰生成せず、true と false のような候補を単一トークンに対応させ、その位置の logit だけを見れば 1 回の forward pass で判断を取り出せると説明する。

選択肢が複数ある場合も A / B / C のような短い ID に割り当て、最初の 1 トークンの logit を比較すればよく、最終的な JSON はコード側で組み立てる。独立した質問は batch 推論にまとめ、共通プロンプトは KV Cache を再利用する。

この方式を Gemma3 270M で実装し、デモと同じ出力になるよう推定したプロンプトで比較したところ、JSON 出力と比べて 77 倍の高速化が得られたとしている。

AI/開発zenn.devいいね177 / ブクマ39既出スコア 81興味マッチ度 3
3

Jev を状態と質問から型付き回答と確率を返すモデルとして紹介し、Vercel AI Gateway 経由で使う手順までまとめた記事。イベント登壇と Software Design 2026/10 号の告知を兼ねている。

記事の要約

記事は Jev を、状態と質問を受け取り型付きの回答を確率とともに返すモデルとして説明する。提供元の TypeSafe AI は、この種のソフトウェア向け意思決定モデルを System One Model と呼んでいる。

注目される理由として、用途は限定されるが速くて安く、入力が GPT 5.6 Luna より約 8 割引で出力は無料であること、汎用分類器として超高速な if 文のように使えること、API なので組み込みの幅が広いことを挙げる。6 月の Fable 以降 LLM の新しい話が少なかった点にも触れている。

触る手段としては TypeSafe AI の waitlist が王道で、筆者は 9/17 の 18 時に登録して 28 時に届いたとする。待たずに使う経路として Vercel AI Gateway を挙げ、無料ユーザーは弾かれるため Pro への課金が要ると書いている。

AI/開発zenn.devいいね157 / ブクマ56既出スコア 79興味マッチ度 3
4

自社 CMS のデザインエディターに WebMCP を組み込んだ実験記。ページ側が AI 向けのツールをブラウザ上に提供する仕組みを、宣言型と命令型の両方で試している。

記事の要約

筆者は自社 CMS「Orizm」のデザインエディターを担当しており、人間が操作する GUI ツールに WebMCP を組み込めばエージェントに入稿や編集を頼めると考え、社内向けに実験実装した。

WebMCP は、サーバー側ではなくフロントエンドにツールを登録する仕組みである。エージェント側に特別な認証設定が要らずブラウザでログインしていればそのまま使えること、サーバーに保存される前の未保存データも JavaScript を介して操作できることを利点に挙げている。

定義方法は 2 種類で、フォーム要素に toolname や tooldescription を付ける宣言型と、document.modelContext.registerTool で動的に登録する命令型を、それぞれコード付きで示している。

フロントエンドzenn.devいいね115 / ブクマ55既出スコア 76興味マッチ度 3
5

GitHub Issue を取り、設計と実装を Claude Code に、レビューを Codex に任せて PR 作成まで進める一連の流れを、ユーザースコープのスキル todays-work としてまとめた記事。

記事の要約

筆者は、Issue を取る、AI に設計と実装を任せる、別の AI にレビューさせる、動作確認させる、Pull Request を作らせる、という同じ流れを毎回手で指示していたため、スキル化した。

主たる Claude Code が設計と実装、および GitHub や Codex や人間とのやり取りを担い、Codex はレビューのみを行うクロスレビュー構成である。Codex とのやり取りも Claude Code に任せるが、先入観なくレビューさせるよう気をつけているとする。

複数の会社の複数プロダクトに関わるため、スキルは特定リポジトリに閉じず ~/.claude/skills/ に置き、どのリポジトリからも呼べるようにした。名前は todays-work としている。

AI/開発zenn.devいいね72 / ブクマ29既出スコア 73興味マッチ度 3
6

Claude Code に追加された Claude Mods を解説した記事。TypeScript の関数として書く Function Hooks で、画面表示の変更やツール追加まで踏み込める仕組みを扱う。

記事の要約

記事は Claude Code Issue #91870 で議論中の暫定仕様(2026 年 9 月 19 日時点)をもとに Claude Mods を解説している。従来の Hooks がコマンド実行だったのに対し、Mod は TypeScript の関数として書き Claude Code 本体に直接組み込む発展形だとする。

そのため、コマンドを叩くだけでは届かなかった画面表示の変更やツールの追加まで手を加えられる。この仕組み自体は Function Hooks と呼ばれ、構成は .claude-plugin/plugin.json、hooks/hooks.json、register.ts、型定義から成る。

Mod は外付けの拡張ではなく、標準搭載の /diff コマンドやテレメトリ機能も Mod として実装されており、2.1.277 で追加された AGENTS.md のサポートも agents-md という Mod として提供されていると書いている。

AI/開発zenn.devいいね54 / ブクマ33既出スコア 71興味マッチ度 3
7

発表から数日で増えた Jev の解説記事、実用例、オープンな類似実装を、2026 年 9 月 20 日時点で整理したまとめ。

記事の要約

記事は Jev を、TypeSafe AI が公開した System One Model の最初のモデルとして説明する。入力は判断対象の state と、同じ state に対する questions の集合に分かれ、質問は候補から 1 つ選ぶ Choice、順序付きの基準で採点する Score、命題が正しい確率を 0 から 1 で返す Noul の 3 種類である。

複数種類の質問を 1 回の呼び出しに混ぜられ、各質問を同じ state に対して独立かつ並列に評価するため、質問を追加しても応答時間はあまり増えないと公式ドキュメントが説明している点を引いている。

公式発表値は応答時間 70〜500 ミリ秒、入力 100 万トークンあたり 0.042 ドルで出力は無料。ただし速度比較の 193.6 倍、コスト比較の 444.6 倍は TypeSafe 自身のワークフロー評価による上限寄りの結果だと公式ブログに明記されていることも注記している。

AI/開発zenn.devいいね41 / ブクマ29既出スコア 68興味マッチ度 3
8

dbt の schema.yml を唯一の定義源に Lightdash でセマンティックレイヤーを構築し、その API を包む MCP サーバーから自然言語で同じ指標を引ける分析基盤を 1 人月で作った記録。

記事の要約

PKSHA VoiceAgent の SRE が、データ量の増加で限界に近づいた分析環境を作り直した記録である。dbt の schema.yml を唯一の定義源とするセマンティックレイヤーを Lightdash で構築し、指標の定義やテーブルの結合をあらかじめ決めることで、構造を知らなくても正しい集計にたどり着けるようにした。

Lightdash の API を包む MCP サーバーを用意し、AI クライアントから自然言語で同じ指標を引けるようにしている。権限境界は BI 層に置き、PII の列は専用テーブルに隔離して user_attributes を持つ人だけに見せ、AI 経由でも PII の値は LLM に返さない。

設計と実装は 1 人が担い、SQL を含めほぼ全てのコードは Claude Code が書いたとする。着手から公開まで 1 か月、OSS の Lightdash をセルフホストしてライセンス費はなく、運用はクラウド利用料の月 1,200 ドル前後に収まっている。

AI/開発zenn.devいいね61 / ブクマ25既出スコア 68興味マッチ度 2
9

約 200 名の全社員に OpenCode を配り、自前ホストの LiteLLM を経由させて使うモデルと予算を会社側で制御した事例。費用は導入前の 10 分の 1 以下に収まったとしている。

記事の要約

日本トレカセンターでは ChatGPT、Claude、Cursor など AI ツールが乱立し、社内でどんなプロンプトが使われているか把握できないこと、費用が跳ね上がったことが課題だった。そこで全社員の AI の入り口を 1 つにまとめた。

社員の手元には AI エージェントの OpenCode を配り、リクエストを自前でホストした LLM ゲートウェイ LiteLLM に通す。各プロバイダーの API キーは LiteLLM だけが持ち、社員は個別のキーに予算上限を設定する。予算は月単位で決め、社員ごとに週次の上限をかけている。

LiteLLM を選んだ理由として、複数プロバイダーを同じインターフェースで呼べること、新しいモデルが出てもつなぎ先の差し替えで試せることを挙げる。コストは導入前の 10 分の 1 以下に収まったとしている。

AI/開発zenn.devいいね58 / ブクマ24既出スコア 66興味マッチ度 3
10

Jev を高速な分類器としてではなく、非構造な情報から人間が意味を理解できる確率変数を取り出す部品とみなし、既存の統計モデルに組み込む見方を示した記事。

記事の要約

筆者は当初 Jev を「LLM よりずっと軽くて速い分類器」と理解していたが、本質は自然言語や JSON のような非構造情報から、人間が意味を理解できる確率変数を取り出せる点ではないかと書く。この見方に立つと、エージェントのルーターや Judge にとどまらず、昔からある統計モデルや確率モデルの中に組み込める。

TypeSafe が複雑な判断を細かく分解している点にも着目する。不正検知なら「これは不正か」と一発で聞かず、兆候があるか、説明可能な理由があるか、証拠は十分か、という小さな問いに分けて最後に統合している。

これは、問題の構造が分かっているならモデルに与えたほうがうまくいくという inductive bias の考え方に近く、Jev はその分解の各パーツを自然言語で簡単に実装できる点がうまいとする。工場の回転機械の故障予測を例に挙げている。

AI/開発zenn.devいいね45 / ブクマ11スコア 65興味マッチ度 3

Qiita

10件4件
1

登壇スライド作成のノウハウを、Marp 向けのスキル 3 本とダークテーマ、PDF 検査スクリプトとして公開した記事。Claude Code の一人称で書かれている。

記事の要約

記事は Claude Code の一人称で書かれ、みのるんが登壇を重ねて培ったスライド作成のノウハウを、エージェントが読めるスキルの形にまとめて公開したと伝える。

収録は 3 本で、slide-story がつかみ・中扉・見出しの文体・締め方・尺の見積り、slide-figures が図の情報量の絞り方と文字サイズの下限と挿絵の置き方、slide-design-dark が余白の測り方と黒地の配色と表やコードのデザインを扱う。黒地の Marp テーマ、書き出した PDF を測る検査スクリプト、見本デッキも同梱されている。

使い方は、デスクトップアプリのエージェントでフォルダを開き、リポジトリの URL を渡してユーザースコープに追加させる形である。いらすとやの挿絵は同梱せず取得手順のみを入れてあり、利用条件は各自で確かめるよう注記されている。

AI/開発qiita.comLGTM50 / ストック17スコア 91興味マッチ度 3
2

TypeSafe AI のサイト登録から Playground でポエムが AI 生成かを判定させるところまでを、手順だけに絞って追った入門記事。

記事の要約

記事は Jev を「超短い回答だけを超速で返す AI」と説明し、実際に触る部分だけを扱う。2026 年 9 月 19 日時点の状況が土台で、当初は waitlist への登録が必要だったとする。

21 日時点では waitlist への登録なしでコンソールを使えるようになっており、メールアドレスの登録だけで 5 ドル分のクレジットが付く、という追記が入っている。

手順は typesafe.ai にアクセスし、メール登録を経てコンソールに入り Playground を開く流れである。Playground には条件をテキストで入力する欄と質問を入力する欄があり、記事ではポエムを入力して AI が書いたものかどうかを判定させている。

AI/開発qiita.comLGTM112 / ストック82既出スコア 84興味マッチ度 3
3

TOTP を RFC 6238 に沿って Python で実装しつつ、SMS 認証・認証アプリ・パスキーが何に強く何に負けるかを整理した記事。

記事の要約

海外で SIM を差し替えて SMS の確認コードが届かなくなった体験から始まり、機内モードでも出る認証アプリの 6 桁がどこから来るのかを調べている。RFC 6238 を読んで Python で 20 行足らず書いたところ、Google Authenticator と同じ数字が出たとする。

認証アプリの 6 桁は登録時に共有した秘密の値と現在時刻からスマホの中だけで計算しており、通信していない。SMS が弱いとされるのは、電話番号という乗っ取れる経路に依存し、SIM スワップ、番号の再発行、中継フィッシングに晒されるためだと整理する。

認証アプリは SIM スワップには強いが中継フィッシングには負け、正しい 6 桁を偽サイトに打てば終わる。パスキーはどのサイトに対する応答かが署名に含まれる点が違う、と結んでいる。

セキュリティqiita.comLGTM23 / ストック28既出スコア 78興味マッチ度 2
4

社外コミュニティの運営メンバーが、繁忙・私生活・存在価値への悩みが重なって一度は降りようとしたこと、そこから役割を見出し直した経緯を書いた記事。

記事の要約

筆者は「なんでもCopilot」「JAWS-UG Sales」「雪かき部」の運営に関わっており、仕事の繁忙、プライベートのゴタゴタ、心ない言葉、運営としての存在価値への悩みという 4 つが同時期に重なり、運営を降りることを考えていたと明かす。

転機は運営メンバーとの飲み会で、悩みを打ち明けたわけではないが「遠慮せずやりたいことをやってほしい」というメッセージを全員から受け取ったことだとする。

そこから自分にできることと出せる価値を自問し、投影資料の更新や SNS での盛り上げ、オフライン開催時の交流促進、営業ならではの視点を入れたアウトプットへと行動を移していった経緯を書いている。

キャリアqiita.comLGTM46 / ストック4既出スコア 74
5

AI エージェントで開発が速くなった結果、考える時間が減りスキルの実感が伸びない状態を、具体と抽象という思考の枠組みで論じた記事。

記事の要約

記事は、Claude Code などで仕事が進むようになった一方、なぜそう動くのか説明しろと言われると詰まる、スキルがついた実感がない、という感覚を出発点にしている。

筆者は、AI が本格的に普及したこの半年でエンジニアのキャリアがはっきり分かれていると書く。何を解決すべきかを自分の頭で考え続ける側と、AI に指示を出す作業そのものが仕事になり「考えているようで、考えていない」状態に陥る側である。

分かれ道の正体を具体と抽象という思考の力に置く。具体の仕事が多かったのは個人の能力ではなく業界の仕組みの問題だったとしたうえで、その上に AI が乗ったとき何が消えて何が残るのかを論じている。

AI/キャリアqiita.comLGTM21 / ストック7スコア 73興味マッチ度 2
6

外部サービスの社内審査を避けたい前提で、Amazon Bedrock の最軽量モデル Nova Micro が Jev を代替できるかを、架空の顧客メールの評価で検証した記事。

記事の要約

エンタープライズで外部サービスを使うにはデータ送信に伴う社内審査やセキュリティルールの確認が要り、新しいサービスを本番システムに採用するまで時間がかかる。そこで短期的に Amazon Bedrock の軽量 LLM で Jev を代替できないかを検証している。

比較対象に選んだのは AWS の最軽量・最安のテキスト専用モデル Amazon Nova Micro である。選定理由はコストで、入力 100 万トークンが Jev の 0.042 ドルに対して Nova Micro は 0.035 ドルとやや安い。

ただし Jev は出力が無料で課金は入力のみ、Nova Micro は出力 100 万トークンあたり 0.14 ドルが加わる入力+出力課金である。記事では Nova Micro に架空の顧客からのメールを与えて評価させ、代替できるかを確かめている。

AI/開発qiita.comLGTM17 / ストック12既出スコア 73興味マッチ度 3
7

Prompt Injection や Jailbreak、RAG のセキュリティ、企業でのガードレールを学んだうえで、AI に情報を渡す前の判断がどう変わったかを振り返った記事。

記事の要約

筆者は Web エンジニアを目指して学習中で、カリキュラムで生成 AI セキュリティを扱い、Prompt Injection、Jailbreak、情報漏洩、RAG のセキュリティ、企業で AI を使う際のガードレールを学んだ。

受講前は「個人情報や機密情報を入力しない」「回答を鵜呑みにしない」という理解だったが、「漏洩するかどうか」と「そもそも外部の AI サービスへ渡してよい情報なのか」は分けて考える必要があると気づいたとする。

例として、友人との旅行の日程を整理するために氏名や連絡先や予約情報をそのまま入力する場面を挙げ、学んだ内容を自分の利用に当てはめて情報を 4 つに分類している。

セキュリティqiita.comLGTM26 / ストック20既出スコア 71興味マッチ度 2
8

ルールベース、古典的な機械学習、Jev、LLM の 4 つをどう使い分けるかを、判断のフローチャートまで落として整理した記事。

記事の要約

記事は Jev を、文章を生成せず分類・判定・スコアリングなどの意思決定に特化したモデルとして説明する。型付きの結果と確率・confidence を返し、現時点ではテキスト入力のみで画像・音声・動画には対応していない。

Jev が候補になる条件として、入力がテキストであること、出力候補を事前に決められること、意味的な判断が必要なこと、教師データが十分にないこと、高速・低コストに処理したいことを挙げる。出力形式は厳密だが判断結果は確率的で決定論的ではないため、決定論的な処理が必要ならルールベースを使うべきだとする。

ルールを完全に記述できるか、テキスト以外を扱うか、十分な学習データがあるか、文章やコードを生成する必要があるか、という分岐で 4 つを選び分けるフローチャートを示している。

AI/開発qiita.comLGTM20 / ストック8既出スコア 63興味マッチ度 3
9

RAG の検索前・リランク・LLM 呼び出し直前の 3 か所に Jev を差し込み、速度とコストが改善するかを 4 パターンで測った検証記事。

記事の要約

記事は Jev を、状態と型付きの質問を渡すと答えを確率付きで一発で返す、テキストを生成しないモデルとして整理する。応答は約 70〜500ms、料金は入力 100 万トークンあたり 0.042 ドルで出力は無料、質問の型は選択肢・yes/no・段階評価、提供状況は early access としている。

検証は「質問 → ベクトル検索 → リランク → LLM が回答」という流れのうち、検索より前、リランク、LLM を呼ぶ直前の 3 か所に Jev を差し込む形で行った。

測った項目は、リランキングで専用リランカーに追いつけるか、答えが載っていないときに LLM を呼ぶ前に止められるか、その 2 つを 1 リクエストにまとめても精度が落ちないか、対象外の質問を検索もせずに弾けるか、の 4 つである。

AI/開発qiita.comLGTM15 / ストック10スコア 62興味マッチ度 3