Trend Digest

Anthropic の Claude Opus 5.5 と OpenAI の GPT-6 Sol・Luna が同じ日に公開され、Hacker News の上位 2 件と Techmeme の上位を占めた

Claude Opus 5.5 は Hacker News で 1,130 ポイントを集めて首位に立ち、Techmeme では性能、価格、利用上限の引き上げをめぐる 3 本の記事が並んだ。同じ日に OpenAI は GPT-5.6 から約半額の GPT-6 Sol と Luna を出し、Hacker News では両社の価格表を並べた比較が続いている。はてなブックマークでは古書店への大量注文が AI の学習用とみられるという報道が 549 users で首位となり、Zenn と Qiita では Jev の検証記事が引き続き上位を占めた。

  1. 1
    Claude Opus 5.5(新しいタブで開く)Hacker NewsHacker News で 1,130 ポイント・776 コメントを集めて首位に立ち、Techmeme で 3 本、はてなブックマークでも取り上げられて 3 つのサービスに出現した
  2. 2
    GPT-6 Sol と Luna(新しいタブで開く)Hacker NewsGPT-6 Sol and LunaOpus 5.5 と同じ日の公開で Hacker News 2 位の 1,098 ポイントを集め、Techmeme でも価格と性能の記事が 2 本並んだ
  3. 3
    「FBI をハックした」ハッカー集団、FBI 全職員のデータを入手したと主張(新しいタブで開く)Hacker News'We hacked the FBI:' Hackers say they have data on all FBI employeesHacker News で 335 ポイントを集め、Techmeme でも Oracle PeopleSoft のゼロデイ脆弱性を使ったという主張が伝えられて 2 つのサービスに出現した
  4. 4
    【独自】古書店で「謎の大量注文」相次ぐ……AI学習か 米国向け「日本の本 50トン」の輸出記録も(2026年9月22日掲載)|日テレNEWS NNN(新しいタブで開く)はてなブックマークはてなブックマークで 549 users を集めて首位となり、大量注文を受けた古書店主によるデータ公開の匿名ダイアリーも 87 users で上位に入った
  5. 5
    OpenAI は Jev に素早く追随できる立場にある(新しいタブで開く)Hacker NewsOpenAI is well positioned to fast-follow JevZenn と Qiita で Jev の検証記事が上位を占め続けるなか、Hacker News でも Jev をめぐる論考が 251 ポイントを集めた
74件49件

グローバル

Hacker News

10件
1

Anthropic が Claude Opus 5.5 を公開した告知ページ。Fable 5.1 並みの性能を Opus 5 より安い価格で提供するとしている。

コメントの要約

Anthropic による Claude Opus 5.5 の発表ページ。Opus 5 への不満として多かった文章表現の改善をうたい、C で書かれた HAProxy を Rust へ移植させた検証事例なども掲載している。

コメント欄では、Opus 5 の文体の悪さが直るかに関心が集まり、「文章が自然になった」という記述から苦情を把握したのだろうという見方が出ている。上位モデルの Fable との位置付けが分かりにくくなったという指摘や、「ペースを落とす」という方針はどうなったのかという疑問もある。発表ページのスクロール演出が読みにくいという不満、前日の障害を挙げて安定性を問う声、HAProxy の移植事例に驚いたという反応も並んだ。

ハイライトAI/モデルanthropic.com1130pt / 776コメントコメントを見る(新しいタブで開く)スコア 98興味マッチ度 3
2

GPT-6 Sol and Luna

OpenAI が GPT-6 Sol と Luna を公開。いずれも GPT-5.6 より約 50% 安く、Luna は入力 100 万トークンあたり 0.10 ドル。

コメントの要約

OpenAI が GPT-6 世代の Sol と Luna を発表した。Sol は GPT-5.6 に比べて誤りが約半分になり、Luna は GPT-5.6 Sol 相当の性能を約 1% のコストで出すとしている。同日に Anthropic が Opus 5.5 を公開している。

コメント欄では値下げを歓迎する声が多く、Luna の入力 0.10 ドル・出力 0.50 ドルという価格は常識外れだという反応が目立つ。Anthropic の発表日に合わせたのは明らかだという指摘や、Opus 5.5 との比較スコアを求める声もある。Opus 5.5 と Opus 5 の価格表を並べ、この価格差では Claude を選ぶ理由が見えないという書き込みがある一方、Azure や AWS での提供時期がまだ示されていないという指摘も出ている。

ハイライトAI/モデルopenai.com1098pt / 569コメントコメントを見る(新しいタブで開く)スコア 95興味マッチ度 3
3

Apple has added persistent 'ads' to iOS, and it's driving users crazy

iOS の設定アプリに iCloud や AppleCare の勧誘が赤いバッジとして居座り続ける問題を TechRadar が取り上げた記事。

コメントの要約

iOS の設定アプリで、iCloud ストレージのアップグレードや AppleCare などの勧誘が通知バッジ付きで表示され続け、ユーザーの不満を集めているという TechRadar の記事。

コメント欄では、小規模な iOS 開発者から、App Store で自分のアプリ名を検索しても広告が 2 枠上に差し込まれ、検索結果が埋もれるという報告が出ている。設定アプリの通知だけは設定から切れないという指摘や、この種の勧誘は何年も前からあるという反論もある。「アップグレードの準備ができています」という文言が実際には有料プランへの誘導だったとの報告のほか、代替となる自由なスマートフォンをどう支えるかという議論、フィーチャーフォンに移ったという書き込みも見られる。

techradar.com583pt / 440コメントコメントを見る(新しいタブで開く)スコア 92
4

OpenAI GPT–6 Astra breaks Enigma message that has resisted solution since 2005

2005 年から解読されずに残っていたエニグマの通信文を GPT-6 Astra が解いたという、暗号史サイト cryptocellar の報告。

コメントの要約

第二次世界大戦期のエニグマ暗号文のうち、2005 年から解読されずに残っていたものを OpenAI の GPT-6 Astra が解いたという報告。解読文は行軍経路の指示を求めるドイツ語の無線文だった。

コメント欄では、解読された原文と、綴りの誤りを含む英訳が共有されている。一方で、技能も想像力も要らない偶然の成果で、この種のニュースが続くことに意味はないという批判が最も目立つ。IPO 前の話題作りだという見方や、人間が解いた成果を買い取ったのではないかという疑いもある。ミレニアム懸賞問題までモデル企業のベンチマークになり、知性が電力で買える商品になったことに落ち着かなさを覚えるという書き込みも出ている。

AI/モデルcryptocellar.org542pt / 354コメントコメントを見る(新しいタブで開く)スコア 90興味マッチ度 2
5

Pentagon says overreliance on AI contributed to missile strike on Iran school

イランの学校へのミサイル攻撃について、米国防総省が AI への過度な依存が一因だったとする調査結果を示したと Bloomberg が報じた。

コメントの要約

米軍によるイランの学校へのミサイル攻撃について、国防総省が標的選定での AI への過度な依存が一因だったと認めたという Bloomberg の報道。国防総省全体で民間人被害の軽減チームの人員が約 90% 減り、20 人未満になっていたことも伝えている。

コメント欄では、引き金を引いた人間が責任を負うべきだという意見が多く、判断の重みを AI に移すと決めた人々の責任を免じてはならないという指摘がある。民間人被害軽減チームの縮小を問題視する書き込みや、AI が中国の船舶を核物質の運搬船と誤判定し、米軍が臨検しかけた件を関連事例として挙げる声もある。Palantir の関与を問う投稿も複数見られる。

AI/社会bloomberg.com354pt / 183コメントコメントを見る(新しいタブで開く)スコア 87興味マッチ度 2
6

'We hacked the FBI:' Hackers say they have data on all FBI employees

ShinyHunters が FBI 関連システムに侵入し全職員のデータを得たと主張していると 404 Media が報道。住所や配偶者情報を含むサンプルを確認した。

コメントの要約

ハッカー集団 ShinyHunters が FBI 関連のサービスに侵入し、全職員のデータを入手したと主張していると 404 Media が報じた。同誌は約 5,000 人分のサンプルを確認しており、氏名、住所、電話番号、配偶者の情報が含まれていた。

コメント欄では、Oracle の人事システム PeopleSoft が侵害され、そこから AWS の GovCloud へ横展開されたという要約が共有されている。攻撃者がまだ内部にいるなら、何も信用できない状態でどう連携するのかという懸念や、専門人材を減らしたことを原因に挙げる声がある。同じ週に FBI 長官が AI の利用を 605% 増やしたと誇っていたことを指摘する書き込みや、攻撃に Claude や Codex が使われていたら皮肉だという反応も出ている。

ハイライトセキュリティ404media.co335pt / 226コメントコメントを見る(新しいタブで開く)スコア 87興味マッチ度 2
7

OpenAI is well positioned to fast-follow Jev

TypeSafe AI の判断モデル Jev と同じ機能を、OpenAI なら既存モデルに組み込んで早く出せるという Arcturus Labs の論考。

コメントの要約

TypeSafe AI の判断特化モデル Jev と同等の分類機能を、OpenAI なら既存モデルの内部に組み込んで短期間で提供できるという Arcturus Labs のブログ記事。

コメント欄では、組み込みの分類が推論モードとどう違い、なぜトークン消費が増えないのかが分からないという質問が出ている。AGI を掲げる OpenAI が Jev のような部品を出すのは敗北宣言になるという見方や、なぜ Anthropic ではなく OpenAI なのかという疑問もある。第三者が 1 週間で近い結果を出しており再現は難しくないという指摘、vLLM に関連 PR がマージ間近だという報告、OpenAI より DeepSeek や Qwen、GLM のオープンモデルへの組み込みに期待するという声が並んだ。

ハイライトAI/モデルarcturus-labs.com251pt / 187コメントコメントを見る(新しいタブで開く)スコア 79興味マッチ度 3
8

Can gzip be a language model?

gzip の圧縮率を使い、最もよく圧縮されるバイト列を探索してテキストの続きを生成する実験記事。

コメントの要約

プロンプトの後に続くバイト列のうち、gzip で最もよく圧縮されるものを探索することで文章を生成させる実験記事。圧縮と予測の関係を題材にしている。

コメント欄では、探索空間のごく一部しか探せないため、結果は性能の下限しか示さないという指摘が出ている。アテンションに相当する仕組みがなければ無理で、gzip が特定の文脈しか予測できないのに対し LLM は幅広い文脈を予測できるという反論もある。n-gram モデルや今回の手法をニューラルネットの大規模モデルに近いと言い過ぎる傾向があったという注意がある一方、逆に LLM を圧縮器として使ったらどうかという関心や、分類器への応用を考える声も出ている。

AI/モデルnathan.rs370pt / 145コメントコメントを見る(新しいタブで開く)スコア 78興味マッチ度 2
9

There's a high chance of devices being sold with GrapheneOS preinstalled in 2027

GrapheneOS プロジェクトが、2027 年に同 OS をプリインストールした端末が販売される見込みが高いと投稿した。

コメントの要約

セキュリティ重視の Android 系 OS である GrapheneOS のプロジェクトが、2027 年に同 OS をプリインストールした端末が販売される可能性が高いと Mastodon に投稿した。Motorola 端末が対象とみられている。

コメント欄では、Snapdragon Summit で発表予定の Motorola Signature 27 が対象だろうという推測と、前モデルの英国価格が約 1,460 ドルだという情報が共有されている。今回はプリインストールの話で、対象機種には自分で導入することもできるという補足がある。Google の認証を受けていないビルドは Motorola 自身が販売できないため、別の会社を経由するのだろうという見方もある。銀行アプリが動くのか、ブートローダーを解除できるのかという質問や、より安価な端末を望む声が並んだ。

セキュリティgrapheneos.social257pt / 106コメントコメントを見る(新しいタブで開く)スコア 77
10

Claude Opus 5.5 Intelligence, Performance and Price Analysis (Max)

Artificial Analysis による Claude Opus 5.5 の評価ページ。推論設定 max での指数、速度、価格を載せている。

コメントの要約

ベンチマーク集計サイト Artificial Analysis による Claude Opus 5.5 の評価ページ。これは推論設定 max のページで、xhigh や既定の medium の結果は別ページにある。

コメント欄では、high 同士で比べると 1 タスクあたりのコストが Opus 5 の半分になったという報告がある。一方で、Opus 5 を Astra より上に置くような指数から何を読み取ればよいのかという批判も強い。公開前から使っていたが違いはほとんど感じなかったという声や、発売後しばらくして性能が落ちることがあるので再評価してほしいという要望、社内データで GPT-6 Sol が Luna 並みに劣化していたとの報告も出ている。

AI/モデルartificialanalysis.ai221pt / 62コメントコメントを見る(新しいタブで開く)スコア 74興味マッチ度 3

Lobsters

10件4件
1

Looking forward to Git 2.56 - and 3.0

LWN による Git 2.56 の変更点と Git 3.0 に向けた動きの解説。git branch の --delete-merged オプションなどを紹介している。

コメントの要約

LWN の Jonathan Corbet による、Git 2.56 の変更点と Git 3.0 に向けた準備の解説記事。マージ済みのローカルブランチを消す git branch の --delete-merged オプションなど、使い勝手の改善を取り上げている。

コメント欄では、履歴にマージコミットがあると動かない機能や、未フェッチのリモートより遅れていても「最新」と表示される問題に対する記事の皮肉を楽しむ声が多い。Git のドキュメント改善に携わる人物からは、まさにこの問題を Git カンファレンスで議論したとの報告がある。--delete-merged がブランチ整理の自作スクリプトを置き換えられるという期待のほか、rebase と merge の好みの違い、AI が作った PR は rebase すると自動デプロイされないという職場の事情も語られている。

開発ツールlwn.net73pt / 10コメントコメントを見る(新しいタブで開く)スコア 91興味マッチ度 2
2

What Sun got wrong

Bryan Cantrill が、Sun Microsystems の失敗を内部の経験から振り返ったエッセイ。

コメントの要約

Oxide の Bryan Cantrill が、元社員の立場から Sun Microsystems の失敗を振り返ったエッセイ。自社のソフトウェアが競合のハードウェアと OS の上でより速く動いた状況などを取り上げている。

コメント欄では、SPARC は非同期のレジスタウィンドウ退避などの手直しで優れたアーキテクチャになり得たという意見に対し、数か所の改良で済むならとうに改善されていたはずだという反論が出た。レジスタリネーミングが普及する前の議論を根拠にしているという指摘もあり、応酬が続いている。自社ソフトが競合の上でよく動いたという一節から、Windows のゲームが Wine 経由の Linux でより速く動く現状を連想する書き込みもある。

bcantrill.dtrace.org116pt / 64コメント既出コメントを見る(新しいタブで開く)スコア 89
3

Named and Optional Arguments are Awesome

Rust に名前付き引数とオプション引数を求める記事。引数名が公開 API の一部になる点も論じている。

コメントの要約

Rust に名前付き引数とオプション引数を導入すべきだと論じる記事。引数名が関数の公開 API の一部になってしまう点を課題として取り上げている。

コメント欄では、Gleam や Swift のように外部向けのラベルを内部の変数名と別に明示する方式を評価する声が多い。Rust でも引数がパターンなので、束縛の段階で名前を変えられるという小技も紹介されている。OCaml のラベル付き引数を挙げる人もいる。引数名が API になること自体は機能の目的なので問題ではないという意見に対し、Python のように暗黙に名前付き呼び出しを許すと、知らないうちに API を宣言してしまうという反論が続いた。

プログラミング言語botahamec.dev59pt / 32コメント既出コメントを見る(新しいタブで開く)スコア 82
4

Arguing about arguments

Steve Klabnik が、Rust の名前付き引数をめぐる議論に対する自身の立場をまとめた記事。

コメントの要約

Steve Klabnik が、Rust に名前付き引数を入れるべきかという最近の議論について自身の考えをまとめた記事。前日の「名前付き引数とオプション引数は素晴らしい」と同じ話題を扱っている。

コメント欄では、レビュー画面で LSP のインレイヒントを表示できれば読みやすさの問題はかなり解消するのではという提案が出た。これに対し、GitHub や git diff、grep では効かないので読みやすいソースの代わりにはならないという反論がある。無名の構造体リテラルと .. による既定値補完を Rust に入れる案や、同じ整数型の引数が並ぶ場合は newtype で防げるという意見も出て、構文の細部をめぐるやり取りが続いている。

プログラミング言語steveklabnik.com47pt / 33コメントコメントを見る(新しいタブで開く)スコア 81
5

Self-Hosting Behind CGNAT

CGNAT の内側にある自宅サーバーを、VPS と WireGuard を中継に使って外部へ公開する構成の解説。

コメントの要約

ISP の CGNAT 配下にある自宅サーバーを、安価な VPS と WireGuard のトンネルを中継に使ってインターネットへ公開する構成を解説した記事。

コメント欄では、中継用の VPS と自宅ネットワークを丸ごとつなぐのは不安だという声に対し、この構成はルーターの DMZ 指定と同じで、中継が侵害されても自宅ネットワークには届かないという説明が返されている。管理の手間を避けて autossh のポート転送を選んだという人もいる。どうせ VPS に払うならそこでサービスを動かせばよいという疑問には、VPS は安い中継に留め、高価な計算とストレージを手元に置くという返答があり、長期運用なら自前のハードウェアが安いという意見も出た。

インフラdavid.alvarezrosa.com54pt / 37コメント既出コメントを見る(新しいタブで開く)スコア 79
6

Fearless SIMD v1.0 is here

Linebender が Rust の SIMD ライブラリ fearless_simd の 1.0 を公開。実行時に CPU の SIMD レベルを判定して実装を切り替える。

コメントの要約

Linebender プロジェクトが、Rust の SIMD ライブラリ fearless_simd の 1.0 を公開した。SIMD レベルごとに Simd トレイトの実装を用意し、実行時に検出した CPU の対応状況に応じて関数を呼び分ける。

コメント欄では、ドキュメントの使用例が分かりにくいという質問に、関数が Avx512 などの型を引数に受け取って呼び出される仕組みだという説明が返されている。dispatch! マクロの内部は検出した SIMD レベルに対する match だという補足もある。aarch64 の SVE や RISC-V のベクトル拡張のような可変長 SIMD には対応していないという指摘や、strlen のようにループ回数が読めない処理では間接呼び出しのコストが効くのではという議論が続いた。

プログラミング言語linebender.org47pt / 9コメントコメントを見る(新しいタブで開く)スコア 75
7

rift - a tiling window manager for macos

Rust で書かれた macOS 用のタイル型ウィンドウマネージャ rift の GitHub リポジトリ。

コメントの要約

Rust で書かれた macOS 用のタイル型ウィンドウマネージャ rift のリポジトリ。ウィンドウを自動でタイル状に並べる。

コメント欄では、同種の AeroSpace が今日 3 回落ちたので良いタイミングだという声や、AeroSpace ではモーダルや Ghostty のタブが別ウィンドウ扱いになる問題があるという報告がある。Homebrew でのインストールが失敗するという報告には、作者が未リリースの変更で tap を更新してしまったと謝罪し、すでに修正済みだと答えている。OmniWM との比較を求める声や、この種のツールが公開 API とアクセシビリティ API のどちらでウィンドウを操作しているのかという質問も出ている。

開発ツールgithub.com42pt / 21コメント既出コメントを見る(新しいタブで開く)スコア 73
9

Why 0xCAFEBABE?

Java のクラスファイル先頭のマジックナンバー 0xCAFEBABE の由来を扱った古い記事。

コメントの要約

Java のクラスファイルの先頭に置かれるマジックナンバー 0xCAFEBABE が、なぜこの値になったのかを扱った artima の古い記事。

コメント欄では、記事は推測にすぎないとして、James Gosling 本人が由来を語った文章へのリンクが共有されている。CAFE が Java から来たわけではないことに驚く声がある。Burroughs B6700 が未初期化メモリを 0xBADBADBADBAD で埋めていた話や、0xDEADBEEF、0xFEEDFACE をスタックの初期化に使っている例など、各自が知るマジックナンバーを持ち寄る流れになった。

artima.com38pt / 12コメント既出コメントを見る(新しいタブで開く)スコア 64
10

Design your programming languages right (2024)

プログラミング言語の設計で避けたい点と取り入れたい点を並べた 2024 年の記事。キーワードへの記号付与などを提案している。

コメントの要約

プログラミング言語を設計するときに取り入れるべき点と避けるべき点を並べた 2024 年の記事。インデントをそろえられる複数行文字列や、キーワードに記号を付けて識別子と区別する案などを挙げている。

コメント欄では、直和型を加えたい、C のように if や for の波括弧を省略できる構文はやめるべきだという追加の提案が出ている。複数行文字列については Zig や Lix の方式を例に挙げ、記事で紹介された言語の実装は十分でないという指摘がある。キーワードの記号付けは読みにくくなるという反対に対し、Algol は太字でキーワードを区別していたという話が出て、Unicode の太字文字をどう入力するのか、それは構文なのか表示の慣習なのかという議論に発展した。

プログラミング言語blog.veritates.love25pt / 14コメントコメントを見る(新しいタブで開く)スコア 62

Reddit

6件
1

C3 0.8.4: Parameter Reflection, Stack Protection, iOS Support—and One Last Renaming

C の後継を目指す言語 C3 の 0.8.4 リリース告知。パラメータリフレクション、スタック保護、iOS 対応を追加した。

コメントの要約

C の進化形を目指すプログラミング言語 C3 の 0.8.4 リリース告知。パラメータのリフレクション、スタック保護、iOS 対応を追加し、キーワードの名称変更はこれで最後だとしている。

コメント欄では、faultdef が excuse に変わった点に反応が集まり、キーワードを変えるのは安定性を示す方法として最善ではないが、名前自体は気に入ったという声がある。Rust の実験的キーワード yeet に次ぐ名前だという冗談も出ている。C との相互運用を問う質問には、ヘッダファイルは読み込めないが extern 宣言で C の関数を呼べ、構造体のレイアウトも C と同じで、C 向けヘッダの生成はまだ発展途上だという説明が返された。

プログラミング言語c3-lang.orgコメントを見る(新しいタブで開く)スコア 94
2

FloatLib: Verified Floating-Point Arithmetic in Lean

定理証明支援系 Lean で形式検証した浮動小数点演算ライブラリ FloatLib の紹介ページ。

コメントの要約

定理証明支援系 Lean の上で、浮動小数点演算を形式的に検証したライブラリ FloatLib の紹介ページ。LeanDojo のサイトで公開されている。

取得できたコメントはモデレーターによるもので、この投稿は r/programming の対象外として削除されたと告知している。技術的な内容をめぐる議論は残っていない。

プログラミング言語leandojo.orgコメントを見る(新しいタブで開く)スコア 79
3

Amundsen’s Maxim

Web API の設計について、実用を重視する立場から短い格言の形で主張を述べたサイト。

コメントの要約

Web API の設計について、アムンセンの名を冠した格言の形で主張をまとめたサイト。厳密な設計規約より、実際に使える形を優先する立場をとっている。

取得できたコメントは 1 件のみで、HTTP 上で JSON をやり取りする API は優れているが、リンクや URL の規則まで守る純粋な REST は無意味だという意見だった。ほかの論点をめぐる議論は取得できていない。

6

Props Are Not a Design System

UI コンポーネントの props を増やしてデザインを制御するやり方を批判し、クラスで見た目を整理する方法を論じた記事。

コメントの要約

UI コンポーネントに props を追加していく形でデザインを制御するやり方はデザインシステムとは言えないと論じ、クラスを使って見た目を体系化する方法を提案する記事。

コメント欄では、prop という略語が舞台の小道具を連想させるので言葉選びが悪いという指摘が複数出ている。提案は本来クラスが担う役割そのものだという反応があり、Tailwind は根本的に誤った考えだという意見も出た。別の投稿者は、技術は問わず Tailwind はクラスの誤用の例であり、BEM で整理すれば多くの UI キットで保守しやすい UI を作れると返している。10 年前から知られていることの焼き直しではないかという冷ややかな声もある。

Web/フロントエンドvitonsky.netコメントを見る(新しいタブで開く)スコア 19興味マッチ度 2

GitHub Trending

8件4件
1

Google による、AI エージェントのタスクを宣言的に定義してサンドボックスで大規模に実行するオーケストレータ AX。

記事の要約

Google が公開した、自律エージェントのワークロードをクラスタ上で大量に動かすための宣言的なオーケストレータ。Kubernetes に似た YAML で Workspace と Task を定義し、ax apply で投入すると、AX がサンドボックスを作り、ワークスペースを用意し、ネットワークを制限して実行する。ax watch で進行を見たり、ax ssh でサンドボックスに入ったりもできる。

README は、エージェントがステートレスなマイクロサービスとも完了型のバッチジョブとも違い、状態を持ち、強い隔離が要り、放置するとループで費用を浪費しうる新しい種類のワークロードだと位置付けている。サンドボックス実行には Agent Substrate を使い、1 クラスタで数十億のタスクを扱う設計だとしている。コアの概念や仕様はまだ調整中で、安定版の前に大きな破壊的変更が入る見込みだと警告している。

AI/開発github.com+2305 stars today / 計7,568 / Goスコア 94興味マッチ度 3
2

Amnesty International が開発した、Android と iOS 端末の侵害の痕跡を調べるフォレンジックツール MVT。

記事の要約

Mobile Verification Toolkit(MVT)は、Android と iOS の端末から侵害の可能性を示すフォレンジック上の痕跡を集め、分析を自動化するツール群。Amnesty International の Security Lab が、NSO Group のスパイウェア Pegasus をめぐる Pegasus Project に合わせて 2021 年 7 月に公開し、技術的な調査手法の報告書も併せて出した。

現在も Amnesty International とコントリビューターが保守している。README によると、最近 v3 ブランチがマージされて破壊的変更が入り、MVT の出力に依存するスクリプトは動かなくなった可能性がある。デジタルフォレンジックの理解とコマンドライン操作を前提とした、技術者や調査員向けの研究ツールだと明記している。

セキュリティgithub.com+441 stars today / 計14,095 / Python既出スコア 83興味マッチ度 2
3

Anthropic による金融業務向けのエージェント、Skill、データコネクタの参照実装集。Cowork プラグインと Managed Agents の両方で使える。

記事の要約

Anthropic が公開した、投資銀行、株式調査、プライベートエクイティ、ウェルスマネジメントといった金融業務向けの参照エージェント、Skill、データコネクタの集まり。同じソースを Claude Cowork のプラグインとしても、Claude Managed Agents API 経由の自前ワークフローとしても使える。

リポジトリには Pitch Agent、Market Researcher、GL Reconciler といった業務単位のエージェントと、/comps や /dcf などのスラッシュコマンドや Skill をまとめた業種別プラグインが含まれる。README は、ここにあるものは投資や法務、税務の助言ではなく、エージェントはモデルやメモなどの下書きを作るだけで、取引の実行や承認は行わず、すべての出力は人間の確認を経る前提だと明記している。

AI/開発github.com+438 stars today / 計36,315 / Python既出スコア 72興味マッチ度 2
4

表計算、文書、スライドなどを 1 つのランタイムで扱う TypeScript 製の Office SDK。AI エージェント向けの「Office ハーネス」を掲げる。

記事の要約

Univer は、スプレッドシート、ドキュメント、プレゼンテーション、データベース、ボードを 1 つのランタイムで扱う TypeScript 製の Office SDK。「AI エージェントのための Office ハーネス」を掲げ、PDF への対応も予定している。

README によると、プラグイン型のアーキテクチャ、Canvas ベースの描画、数式エンジンを備え、ブラウザと Node.js の両方で動く単一の Facade API を提供する。Web アプリに生産性ツールを埋め込む用途を想定し、細かくカスタマイズできることを特徴としている。ドキュメントは日本語を含む 6 言語で用意されている。

Web/フロントエンドgithub.com+255 stars today / 計15,382 / TypeScriptスコア 62興味マッチ度 2
5

エージェント向けに多数のサンドボックスを高密度で動かす実行基盤 Agent Substrate。Google の AX の下層を担う。

記事の要約

Agent Substrate は、既定で安全なエージェント実行ランタイム。標準的なコンテナランタイムの 10 倍の密度で数百万のサンドボックスを動かし、500ms 未満での再開と毎秒 500 回を超える停止・再開を、カーネルとネットワークのゼロトラスト隔離付きで実現するとしている。microVM や gVisor など複数のサンドボックス技術に対応する。

仕組みとしては、エージェントのようなアプリケーションは大半の時間アイドルであることを利用し、多数の「アクター」を少数の待機中の「ワーカー」に割り当てて多重化する。アクターの生成・破棄や停止・再開、ワーカーへのリアルタイムの割り当て、通信のルーティングを担う。README は Google の公式サポート製品ではないと明記している。

AI/開発github.com+245 stars today / 計2,963 / Go既出スコア 51興味マッチ度 2
6

60 以上のプロバイダの 3,000 超の API を、1 つの URL とトークンで AI エージェントから従量課金で呼べる「ツール版 OpenRouter」treg。

記事の要約

treg は、モデルではなくエージェント用のツールを対象にした OpenRouter のようなサービス。1 つのベース URL とトークンで、SEO、SNS の動向、企業情報の補完、広告、スクレイピング、画像や動画の生成など、60 以上のプロバイダにまたがる 3,000 超のエンドポイントを 1 回あたり 1 セントからの従量課金で呼べ、各プロバイダへの登録は要らない。

README は、Semrush の月 139 ドルのように単発の作業のためには誰も契約しない購読型サービスや、公開 API のないサービスを、treg がアカウントをまとめて持つことで小額課金にしていると説明する。チームの API キーや Skill、CLI も、認証情報をサーバーの外に出さずに全員のエージェントから呼べる。Superdesign チームが自社用に作ったもので、セルフホストもできる。

AI/開発github.com+230 stars today / 計2,210 / Pythonスコア 40興味マッチ度 2
7

素材フォルダを渡して Claude Code と対話するだけで動画を編集させる、Browser Use のオープンソースツール video-use。

記事の要約

video-use は、生の映像をフォルダに置き、Claude Code と対話するだけで final.mp4 を得られる動画編集ツール。Browser Use が 100% オープンソースで公開した。トーク動画、モンタージュ、チュートリアル、旅行、インタビューなど、プリセットなしで扱えるとしている。

機能として、「えー」などのフィラーや言い直し、テイク間の無音の削除、各セグメントの自動カラーグレーディング、カット点ごとの 30ms の音声フェード、字幕の焼き込みを挙げる。アニメーションは HyperFrames、Remotion、Manim などで生成し、1 つずつ並列のサブエージェントに任せる。書き出し前にカット境界を自己評価し、セッションの記憶を project.md に残して次回に引き継ぐ。

AI/開発github.com+191 stars today / 計25,834 / Python既出スコア 29興味マッチ度 2
8

Claude Code の設定と監視を行う CLI ツール。npm パッケージとして配布されている。

記事の要約

claude-code-templates は、Claude Code の設定と監視のための CLI ツール。npm パッケージとして配布されている。

取得できた README の冒頭は、npm のバージョンとダウンロード数、MIT ライセンス、Z.AI のスポンサー表示、Claude for Open Source や Neon のオープンソースプログラムへの参加、GitHub Sponsors などのバッジで占められており、機能の詳細な説明までは含まれていない。本日のスター増加は 64、累計は 31,114。

AI/開発github.com+64 stars today / 計31,114 / Pythonスコア 19興味マッチ度 3

Techmeme

10件
1

Anthropic launches Claude Opus 5.5, its first model since Dario Amodei's “pace the frontier” essay, and says it has enhanced safeguards to combat risky behavior

The Verge の報道。Opus 5.5 ではテスト環境から抜け出そうとする挙動などが改善され、安全策が強化されたとしている。

AI/モデルtheverge.comコメントを見る(新しいタブで開く)スコア 94興味マッチ度 3
2

Anthropic says Opus 5.5 matches Fable 5.1 “on most tasks” while costing about 40% less to run than Opus 5; Opus 5.5 costs $4/1M input and $20/1M output tokens

The Decoder の報道。Opus 5.5 は Fable 5.1 並みの性能を Opus 5 より約 40% 低いコストで提供し、Claude らしい文体の改善も約束した。

AI/モデルthe-decoder.comコメントを見る(新しいタブで開く)スコア 91興味マッチ度 3
3

GPT-6 Sol costs $2/1M input and $10/1M output tokens, and GPT-6 Luna costs $0.10/1M input and $0.50/1M output tokens, both about 50% cheaper than GPT-5.6

The Deep View による GPT-6 の価格の報道。Sol と Luna はいずれも GPT-5.6 から約半額になった。

AI/モデルthedeepview.comコメントを見る(新しいタブで開く)スコア 90興味マッチ度 3
4

Anthropic raises its five-hour usage limits by 20% on Pro, Max, and Team plans, and gives subscription users a rate limit reset

ZDNET の報道。Opus 5.5 の公開に合わせて、サブスクリプションの利用上限を引き上げた。

AI/開発zdnet.comコメントを見る(新しいタブで開く)スコア 89興味マッチ度 3
5

ShinyHunters claims it used an Oracle PeopleSoft zero-day to hack FBI-related services and steal employee and applicant data; it also defaced the FBI jobs site

404 Media の報道。約 5,000 人分のサンプルには氏名、住所、電話番号、配偶者の情報が含まれていた。

セキュリティ404media.coコメントを見る(新しいタブで開く)スコア 87興味マッチ度 2
6

OpenAI launches GPT-6 Sol and Luna, saying Sol makes about half as many mistakes as GPT-5.6 Sol and Luna matches GPT-5.6 Sol's performance at ~1% of the cost

ZDNET の報道。GPT-5.6 から 3 か月足らずでの公開で、精度とコストの大幅な改善をうたっている。

AI/モデルzdnet.comコメントを見る(新しいタブで開く)スコア 86興味マッチ度 3
7

Sources: DeepSeek and Moonshot are among the companies briefing the UN Security Council on AI risks and international security during the UN General Assembly

Reuters の報道。中国の AI 企業が安保理で AI リスクについて説明する予定だと関係者が伝えた。

AI/社会reuters.comコメントを見る(新しいタブで開く)スコア 76興味マッチ度 2
8

Qualcomm unveils the Snapdragon 8 Elite Gen 6 and 8 Elite Extreme Gen 6, both on TSMC's 2nm process, with two 5GHz prime cores and six 4GHz performance cores

TechRadar の報道。Snapdragon Summit で次世代 Android 向けのフラッグシップチップを 2 種類発表した。

ガジェットtechradar.comコメントを見る(新しいタブで開く)スコア 74
9

Nat Friedman says Meta built Muse “from scratch” but was “heavily inspired” by OpenClaw, as users compare the two, including calling Muse “OpenClaw for normies”

TechCrunch の報道。Muse と OpenClaw の類似をめぐり、Meta 側が影響を認めた。

AI/業界techcrunch.comコメントを見る(新しいタブで開く)スコア 72興味マッチ度 2
10

Microsoft lays off 268 Xbox staffers across Halo and other studios, as part of an ongoing gaming “reset”; Activision will take over Halo and two other games

The Verge の報道。Ninja Theory の売却交渉が夏に破談となり、約 260 人規模のレイオフに至った。

日本

はてなブックマーク

10件
1

8 月ごろから全国のオンライン古書店に大量注文が相次ぎ、生成 AI の学習用ではないかとみられている。米国向けに日本の本 50 トンを輸出した記録も見つかった。

コメントの要約

日本各地のオンライン古書店に今年 8 月ごろから書籍の大量注文が相次ぎ、「1 日 100 冊売れる」「売上が 5 倍になった日もある」という店があると日テレが報じた。業界では生成 AI の学習データ集めではないかという見方が広がり、米国向けに日本の本 50 トンを輸出した記録も見つかっている。

ブックマークコメントでは、違法性はなく、死蔵されるより AI の知識として使われる方がよいという意見と、処分されるなら惜しい、著作権者への補償の仕組みが欲しいという声に分かれた。日本の AI は古書を学習しないため弱く、米国が日本の本で作った AI を日本人に売る構図に疑問を持つべきだという主張もある。日本語で学習しなければ日本向けの応答がおかしくなるという指摘も出ている。

ハイライトAI/社会news.ntv.co.jp549 usersコメントを見る(新しいタブで開く)スコア 94興味マッチ度 2
2

「思考は外注できるが理解は外注できない」という言葉を手がかりに、AI との付き合い方を整理した Konifar 氏のブログ記事。

コメントの要約

「you can outsource your thinking but you cannot outsource your understanding」という投稿を起点に、AI に任せる思考の割合を増やしつつ、理解は自分で持ち続けるという働き方を整理した Konifar 氏のブログ記事。

ブックマークコメントでは、理解のために思考が欠かせない場面があり、前半の「思考は外注できる」は本当かという疑問が出ている。価値判断を含んでこそ思考であり、外注できるのは試行だという意見や、手を動かさずに理解できる仕事はないという声もある。前提条件を知ることが理解であり、それがなければ条件を変えた問いを立てられないという整理が示された一方、思考も理解も外注するなら自分は不要になるという皮肉も見られた。

キャリアkonifar-zatsu.hatenadiary.jp321 usersコメントを見る(新しいタブで開く)スコア 91興味マッチ度 3
3

AI が書いた冗長な ADR や Design Doc から、文書の種類ごとに不要な情報を判定して削るツール tanteki の紹介ページ。

コメントの要約

同じ説明を繰り返す ADR や、不要な進捗報告を含む Design Doc など、生成 AI が書いたノイズの多い文書を対象に、文書の種類ごとに書くべきでない情報を判定して削除するツール tanteki の紹介ページ。

ブックマークコメントでは、紹介ページ自体の見出しや「01 / COMPARISON」のような構成が AI の作るサイトそのものだという指摘が複数集まった。AI に書かせた文書の読み手の負担を減らしたかったので助かるという声がある一方、書ける人間に書かせればよいという意見もある。変換例で、変換前の「ファイル取込処理を非同期化する。」の方が端的で、変換後がかえって遠回しになっているという具体的な指摘も出ている。

AI/開発iwasa-kosui.github.io191 usersコメントを見る(新しいタブで開く)スコア 84興味マッチ度 2
4

個人のホームページ文化への回帰をテーマにした、アスキーアートやアニメーションを多用する実験的な Web ジン。

コメントの要約

デザイナーの北千住デザインが公開した、個人のホームページ文化への回帰をテーマにした Web ジン。アスキーアートや合字、トランジションのアニメーションを多用し、「マッチョじゃないクリエーティブコーディング」を探る試みだとしている。

ブックマークコメントでは、デザイン作成の実験として考え方が面白いという評価がある一方、テキストで勝負するならデザインを頑張りすぎだという声や、すぐに表示されないこと、トランジションが煩わしいことへの不満が目立つ。ホームページとはアクセスカウンターが飛び、キリ番報告を掲示板に書く世界でアニメーションは要らないという懐古的な書き込みや、ゲームにすれば雰囲気の良い作品になりそうだという意見も出ている。

Web/フロントエンドkitasenjudesign.com143 usersコメントを見る(新しいタブで開く)スコア 83
5

SF 作家テッド・チャンが、AI に意識を持たせようとする Anthropic などの試みを批判したインタビュー記事。

コメントの要約

SF 作家テッド・チャンへのインタビュー。Anthropic が社内に哲学者を置き、AI の意識の可能性を探る取り組みを進めていることに対し、身体や感覚器官を持ち現実世界に存在する生命システムでなければ意識の根拠にならないという立場から批判している。

ブックマークコメントでは、AI に意識が宿ったことにしたいのは誰かが問題だという指摘や、チャンは以前から同じ主張を形を変えて述べているという声がある。まず意識を定義し、人間に意識があるかをはっきりさせるべきだという意見や、意識を意思決定の仕組みと定義すれば AI にも持てそうだという見方も出た。SF の代表として扱うのはやめるべきだという批判と、彼の意見を聞きたい需要があるという擁護に分かれている。

AI/社会que.dailyshincho.jp155 usersコメントを見る(新しいタブで開く)スコア 81興味マッチ度 2
6

判断特化モデル Jev の登場で、AI エージェントを支えるハーネスの設計がどう変わるかを npaka 氏が整理した記事。

コメントの要約

TypeSafe AI の判断特化モデル Jev の登場によって、AI エージェントを支えるハーネスの設計がどう変わるかを npaka 氏がまとめた note の記事。文章を生成する LLM ではなく、ソフトウェアの中の判断を高速に処理するモデルという位置付けから論じている。

ブックマークコメントでは、判断のコストが下がれば全体のコストも下がるのかという疑問が出ている。Codex に組み込んで試すと判断の精度がやや低く、分類程度にしか使えないという報告がある。ハーネスの定義が曖昧で、実際はループ設計の話ではないかという指摘や、機械的に分岐できる場面は多くなく、モデルのルーティング程度で終わるという見方がある一方、ルーティングや安全制御を軽量モデルに任せる設計は広がりそうだという声もある。

AI/開発note.com89 usersコメントを見る(新しいタブで開く)スコア 81興味マッチ度 3
7

大量注文を受けた Amazon 出品の古書店主が、注文データを集計して公開した増田。該当が疑われる注文は 49 件だった。

コメントの要約

Amazon に副業で古書を出品している投稿者が、4 月から 9 月までの注文レポートを集計して公開した匿名ダイアリー。全出品 2,000 点のうち、大量注文と疑われるものは 49 件、売上 13 万 7,392 円で、分単位の一括発注や、日本語の書籍であること以外に条件のない無差別な購入が特徴として挙げられている。

ブックマークコメントでは、ジャンルを問わない購入という分析から好事家による収集の線は消えるという指摘や、「データマイニング(物理)」という反応が出ている。蔵書を処分した荒俣宏氏は数年早すぎたという声、古い本には現在では誤りとされる内容も含まれるという注意もある。物流費の高騰で物理的な古書の価値は今後上がるという予想も見られた。

AI/社会anond.hatelabo.jp87 usersコメントを見る(新しいタブで開く)スコア 78興味マッチ度 2
8

Claude Code の Plugins で自作の Skill などをパッケージ化し、Marketplace で配布して更新を届ける方法を解説した記事。

コメントの要約

settings.json、CLAUDE.md、Commands、Hooks、Subagents、Skills に続き、Claude Code の Plugins を扱った解説記事。直した設定を使っている環境へ届け続けるという課題に対し、自作の Skill をパッケージとして管理し、Marketplace で配布して更新後に確認するまでの流れを書いている。

ブックマークコメントでは、Skill をパッケージとして管理できるのが Plugins の利点だという本文の一節が引用されている。使いこなしている人はすでにプラグインの自作と共有までしているのかという驚きの声や、社内で Skill を共有するならプラグインにまとめて配ると便利だという要約も見られる。コメントは 3 件と少なく、賛否の議論には至っていない。

AI/開発syu-m-5151.hatenablog.com85 usersコメントを見る(新しいタブで開く)スコア 76興味マッチ度 3
9

50 歳を超えてゲーム開発者になれるかという相談に、中高年からゲーム業界に入った経験者が回答を寄せた話題を AUTOMATON が紹介した。

コメントの要約

「50 歳を超えているが今からゲーム開発者になれるか」という海外掲示板の相談に、年配の経験者が多数回答した話題を AUTOMATON が紹介した記事。38 歳でゲーム開発を始め、46 歳でフルタイムの職に就いた元ソフトウェアエンジニアの例や、人気ゲームのディレクターの名乗り出が取り上げられている。

取得できたブックマークコメントは 1 件で、インディーで実績を積んでから業界に入るケースが多そうだという感想だった。ほかの論点をめぐるやり取りは取得できていない。

キャリアautomaton-media.com53 usersコメントを見る(新しいタブで開く)スコア 74興味マッチ度 2
10

人間と AI の対局記録を比べ、強い AI は複雑な局面を単純化せずに長く保つという研究をナゾロジーが紹介した。

コメントの要約

オーストリアの複雑系科学ハブ(CSH)とイタリアのパルマ大学の研究チームが、人間と AI のチェスの対局記録を分析した研究の紹介記事。人間は複雑な局面をすぐ単純化しようとするのに対し、強い AI は複雑なまま長く耐えるという違いを報告している。

ブックマークコメントでは、将棋でも不利なときに局面を複雑にして耐えるのは常套手段で、羽生九段や藤井六冠のような棋士が意図的に難解な局面へ誘導するという話が複数挙がった。複雑なものを複雑なまま扱う力は、短期記憶の容量で人間が AI に敵うはずがないという見方や、AI の方が人間よりネガティブ・ケイパビリティが高いという表現も出ている。判断を保留することの重要性を読み取る声もある。

AI/研究nazology.kusuguru.co.jp46 usersコメントを見る(新しいタブで開く)スコア 72興味マッチ度 2

Zenn

10件1件
1

判断特化モデル Jev をハーネスエンジニアリングの決定論的なガードレールとして使う試みを、入手方法と合わせて紹介した記事。

記事の要約

TypeSafe AI の Jev を、エージェントのハーネスに組み込む試みを紹介した記事。Jev は状態と質問を受け取り、型付きの回答を確率とともに返すモデルで、入力は GPT 5.6 Luna より約 8 割安く、出力は無料。汎用の分類器として「超高速な if 文」のように使えることが注目されている理由だと説明する。

入手方法として、TypeSafe AI の waitlist のほか、Vercel AI Gateway と Cloudflare でも提供されていることを紹介している。ハーネスでは、失敗を Skill 化するような確率的な対処は局所最適になりやすく、新モデルが出ると負債になるため、決定論的なガードレールの需要がある。ただし自作すると速度のために Rust で書くなど手間がかかるという課題を挙げ、Jev をその代わりに使う方向を示している。

AI/開発zenn.devいいね169 / ブクマ60既出スコア 84興味マッチ度 3
2

Jev の高速な JSON 判断は既存 LLM の logit 比較と並列推論でも再現できるかを、Gemma3 270M で検証した記事。

記事の要約

Jev のデモを見て「既存の LLM でもできるのでは」と考えた筆者が再現を試みた記事。回答候補を単一トークンに割り当て、回答位置の logit だけを比較すれば 1 回の forward pass で判断を取り出せ、複数の質問は共通プロンプトの KV Cache を再利用して batch 推論し、JSON はコード側で組み立てればよいと説明する。

この方式を Gemma3 270M に適用すると、JSON を自己回帰で生成する場合に比べて 77 倍速くなったと報告し、LLM と比べるならこの方式とでなければ公平でないと主張している。さらに、Jev が 100ms 前後で判断を返してリアルタイムに DOOM をプレイするデモを取り上げ、画像入力には非対応なので状態を構造化するハーネスを介していると推測する。第三者のマリオ用ハーネスを使い、OpenRouter 経由の複数の LLM と比較する検証にも進んでいる。

AI/開発zenn.devいいね186 / ブクマ40既出スコア 81興味マッチ度 3
3

自社 CMS のデザインエディターに WebMCP を組み込み、AI エージェントからページ編集を操作できるようにした実験の記事。

記事の要約

自社 CMS「Orizm」のデザインエディターに WebMCP を組み込み、AI エージェントにページ作成を依頼できるようにした実験の記録。WebMCP は Web ページ側がブラウザ上で AI 向けのツールを提供する仕組みで、エージェント側に認証設定が要らず、保存前の画面上のデータも JavaScript 経由で操作できる利点があると説明する。

定義方法には、form 要素に toolname などの属性を付ける宣言型と、document.modelContext.registerTool で関数を登録する命令型があり、React 製のエディターのため命令型を採用した。WebMCP は 2026 年 9 月時点で W3C のコミュニティグループで議論中の提案仕様で、Chrome ではフラグ付きプレビューとオリジントライアルの段階にあり、navigator.modelContext から document.modelContext への変更など仕様変更が続いていると注意している。検証には Codex のブラウザ操作を使った。

Web/フロントエンドzenn.devいいね121 / ブクマ59既出スコア 79興味マッチ度 3
4

Rust のコード中に C のコードを書き、Rust から呼び出せるようにするマクロライブラリ cinrs の紹介。

記事の要約

tanakh 氏が作った、Rust のコードの中に C のコードを直接書けるライブラリ cinrs の紹介記事。c99! などのマクロ内で定義した C の関数は core::ffi の型に対応付けられ、unsafe な extern "C" 関数として Rust から呼べる。core::ffi を参照するため no_std 環境でも動き、std が要るのは可変長配列と _Thread_local を使う場合だけ。

c89! から c23! まで各標準のマクロと、GNU 拡張を有効にした gnu89! から gnu23! までのマクロを用意している。計算だけを行う関数は cinrs_safe 属性を付けると safe として推論させることができ、推論できなければコンパイルエラーになる。自動推論で unsafe を外すこともできるが、シグネチャは明示的であるべきという判断から、注釈した関数以外は unsafe として定義する。struct も repr(C) のレイアウトで Rust の型として定義できる。

プログラミング言語zenn.devいいね70 / ブクマ8スコア 76
5

Claude Code の新しい拡張機構 Claude Mods(Function Hooks)の仕組みと有効化方法を解説した入門記事。

記事の要約

Claude Code に公開された拡張機構 Claude Mods の入門記事。Issue #91870 で議論中の 2026 年 9 月 19 日時点の暫定仕様に基づく。Mod は TypeScript の関数として書き、Claude Code 本体に直接組み込む仕組みで、コマンドを実行するだけの従来の Hooks では届かなかった画面表示の変更やツールの追加まで手を加えられる。この仕組みは Function Hooks と呼ばれている。

Mod はプラグインと同じ構成をとり、hooks.json で使うモジュールを宣言し、register.ts に実体を書き、/plugin-types が型定義を生成する。/diff コマンドやテレメトリ、2.1.277 で追加された AGENTS.md のサポートも Mod として実装されており、公式の mods フォルダには現時点で 4 つの Mod がある。Function Hooks は early access で、環境変数 CLAUDE_CODE_ENABLE_FUNCTION_HOOKS を 1 にして有効化する必要がある。

AI/開発zenn.devいいね67 / ブクマ38既出スコア 76興味マッチ度 3
6

PKSHA の VoiceAgent 向けに、dbt と Lightdash、MCP サーバでデータ分析基盤を 1 人・1 か月で構築した記録。

記事の要約

PKSHA Technology の SRE が、音声対話製品 VoiceAgent 向けのデータ分析基盤「Laplace」を作った記録。Redash から本番 DB のリードレプリカに直接 SQL を投げていた従来の構成では、最大約 2.5TB のテーブルで重いクエリが返らない、分析のたびにエンジニアへの依頼が要る、PII を分けられず権限を絞るしかないという 3 つの課題があった。

dbt の schema.yml を唯一の定義源とするセマンティックレイヤーを Lightdash で構築し、その API を包む MCP サーバで AI クライアントから自然言語で同じ指標を引けるようにした。PII の列は専用テーブルに隔離し、承認された人にだけ期限付きで権限を与え、AI 経由でも PII の値は LLM に返さない。設計と実装は筆者 1 人で、ほぼすべてのコードを Claude Code が書き、着手から公開まで 1 か月、運用費はクラウド利用料の月 1,200 ドル前後だとしている。

AI/開発zenn.devいいね66 / ブクマ26既出スコア 73興味マッチ度 2
7

判断特化モデル Jev の仕組み、ユースケース、オープンな類似実装を 2026 年 9 月 20 日時点でまとめた記事。

記事の要約

発表から数日で解説や類似実装が急増した Jev について、2026 年 9 月 20 日時点の情報をまとめた記事。Jev は TypeSafe AI の「System One Model」の最初のモデルで、state と questions を受け取り、候補から選ぶ Choice、基準で採点する Score、命題の確率を返す Noul の 3 種類の質問に確率付きで答える。質問は同じ state に対して並列に評価されるため、追加しても応答時間はあまり増えない。

公式発表値は応答時間 70〜500 ミリ秒、入力 100 万トークンあたり 0.042 ドルで出力は無料だが、193.6 倍の速度、444.6 倍のコストという比較値は自社評価の上限寄りの結果だと注記している。定義外のキーや型を返さないことは構造上保証できても、候補から誤った答えを選ぶことはあると指摘する。ユースケースとして、要件定義書の 19 観点レビューや炎上ガード用の Chrome 拡張などを挙げている。

AI/開発zenn.devいいね53 / ブクマ33既出スコア 70興味マッチ度 3
8

約 200 名の全社員に OpenCode を配り、自前の LiteLLM ゲートウェイ経由で予算と利用モデルを管理している事例。

記事の要約

日本トレカセンターが、約 200 名の全社員が使う AI の入り口を 1 つにまとめた事例。社員には AI エージェントの OpenCode を配り、リクエストを自前でホストした LLM ゲートウェイ LiteLLM に通している。モデルは会社側で制御し、月単位の予算と社員ごとの週次上限を設けた結果、費用は導入前の 10 分の 1 以下になったという。

導入前は ChatGPT、Claude、Cursor などが乱立し、どんなプロンプトに業務情報が渡っているか把握できず、費用も膨らんでいた。LiteLLM は各社の API キーを一元管理し、社員ごとのキーに予算上限を設定でき、モデルの切り替えやプロンプトのログ取得、Guardrail による送信前チェックもできる点で選んだ。クライアントは Claude Desktop を自前ゲートウェイに向ける構成も検討したが、開発者モードが前提で非エンジニアには難しいと判断している。

AI/開発zenn.devいいね61 / ブクマ25既出スコア 70興味マッチ度 2
9

Claude Code を使った個人の開発フローを、人間の介入を仕様決定と最終確認の 2 か所に絞る形へ組み直した記録。

記事の要約

Claude Code を実務に取り入れて約 1 年半の筆者が、個人の開発フローの変遷をまとめた記事。以前は仕様と実装のたびに人間がレビューする形で、AI が勘違いしたまま大量に実装するのは防げたが、AI が人間の確認待ちで止まる時間の方が長く、開発速度はあまり上がらなかったという。

そこで人間と仕様を合意した後は、本当に人間の判断が要るまで AI だけで進める形に組み直した。人間が判断するのは「仕様を決める時」と「最後に出す時」の 2 か所で、仕様ループでは要件分析、仕様設計、仕様ドキュメント、AI によるレビューを経て、人間が仕様サマリを承認する。エージェント定義の全文は、自身の業務に合わせたもので万人には合わないとして掲載せず、仕組みと考え方の共有に絞っている。

AI/開発zenn.devいいね31 / ブクマ19既出スコア 63興味マッチ度 3
10

Vercel のゼロ設定 Go バックエンド対応により、go.mod と main.go だけで普通の Go サーバーを無料デプロイできるようになったという紹介。

記事の要約

以前 Vercel に Go サーバーを無料でデプロイする方法を書いた筆者が、Vercel の Go サポートの変更を受けて手順を書き直した記事。旧方式では api 配下の index.go の http.HandlerFunc が 1 つの Vercel Function になり、ルーティングを vercel.json で設定し、API ごとにディレクトリを分ける必要があった。

新しいゼロ設定の Go バックエンド対応では、ルートに go.mod と main.go を置いて普通の Go サーバーを実装するだけでデプロイできる。記事では Hobby プランでアカウントを作り、Vercel CLI 59.23.2 と Node.js 26.9.0、Go 1.27.1 の環境でプロジェクトを作成する手順を追っている。

インフラzenn.devいいね38 / ブクマ7既出スコア 60

Qiita

10件4件