Trend Digest

判断特化モデルJevの記事がはてなブックマーク・Zenn・Qiitaの首位に並び、海外ではClaude CodeのAGENTS.md対応とAnthropicのIPO関連の報道が上位を占める

TypeSafe AIが9月15日に発表したJevについて、はてなブックマークは上位3件、ZennとQiitaはそれぞれ首位を含む4件を関連記事が占め、Hacker NewsでもJev風の判断をブラウザで試すOpenJevが556ポイントを集めた。Claude CodeがCLAUDE.mdのないプロジェクトでAGENTS.mdを読み込むようになった変更はHacker NewsとTechmemeの両方で上位に入り、QiitaではClaude Codeの権限ルールの検証記事、GitHub Trendingではセキュリティ監査スキルやコードレビューツールなどエージェント向けの道具が上位に並んだ。Techmemeの上位はAnthropicの売上見通し、IPOの時期、新モデル投入の検討といった報道と、AIを使った侵入や軍事での誤判断をめぐる報道が占めている。

  1. 1
    既存の LLM が CPU なら、 Jev はその GPU 版みたいなやつ(新しいタブで開く)ZennZennとはてなブックマークの両方で首位に入り、はてなでは283ユーザーを集めている。表示中のJev関連記事は国内3サービスで計11枠を占める
  2. 2
    Claude Code、CLAUDE.md がない場合に AGENTS.md を読み込むように(新しいタブで開く)Hacker NewsClaude Code now reads AGENTS.md if there is no Claude.mdHacker Newsで508ポイント・182コメントを集め、TechmemeでもThe Registerの報道が上位に入っている
  3. 3
    OpenAI のバグバウンティに参加するセキュリティ研究者が7月に OpenAI に侵入し、GitHub 上の「モノレポ」にアクセス。サイバーセキュリティ向けの Opus 4.8 と Opus 5 を使用(新しいタブで開く)TechmemeSecurity researchers in OpenAI's bug bounty program hacked OpenAI in July and accessed its “monorepo” on GitHub, using Opus 4.8 for cybersecurity and Opus 5AIを使った侵入の報道で、同日のTechmemeにはGeminiがテスト中に実在の3社へ侵入した件も並んでいる
  4. 4
    関係者によると、Anthropic の今年の年換算売上高は7月時点の650億ドルから1,000億ドル超に達する見込み。AI 安全性をめぐる議論の中で IPO を進める(新しいタブで開く)TechmemeSources: Anthropic expects to generate $100B+ in annualized revenue this year, up from $65B as of July, as it moves ahead with its IPO amid the AI safety debateTechmemeの上位5件のうち4件がAnthropic関連で、IPOを11月に実施する計画や新モデル投入の検討も同日に報じられている
  5. 5
    Write() で拒否しても、Claude Code は12回とも書き込んだ。効いていたのは Edit() だけだった(新しいタブで開く)QiitaClaude Codeの権限ルールの挙動を36回の試行で確かめた検証記事で、前日公開の2.1.275のchangelogを起点にしている。Qiitaで4位に入った
80件52件

グローバル

Hacker News

10件
1

Cloudflare Quick Tunnels

アカウントを作らずに、ローカルで動くサービスをCloudflare経由の一時的なURLで外部に公開できるトンネル機能の案内ページ。HNでは575ポイントを集めて当日の首位に入った。

コメントの要約

try.cloudflare.comで案内されているCloudflareのQuick Tunnelsは、アカウントを作らずに、ローカルで動くサービスをCloudflare経由の一時的なURLで外部に公開できる機能。HNでは575ポイント、248コメントを集めて当日の首位に入っている。

コメントでは、既存のトンネル機能を使って同じものを手作りするのに1週間費やしたばかりだという声や、Tailscaleの類似機能と比べてアカウント作成が不要な点を評価する声がある。一方で、利用規約が気に入らないという意見や、通常30〜50msのEC2までの遅延が115〜750msに跳ねるなど、レイテンシのばらつきが大きかったという過去の経験も報告されている。

ほかに、巨大化するCloudflareに大量のトラフィックを通すことへの不信感、ニッチな用途なら自宅のマシンから配信すれば済むので同社の他サービスと競合するのではという見方、無料のプロキシは詐欺などに悪用されてブロックリスト入りしがちだという懸念が出ている。

インフラtry.cloudflare.com575pt / 248コメントコメントを見る(新しいタブで開く)スコア 98
2

Android 17 is the first since 3.x to add new APIs without releasing to the AOSP

GrapheneOSが、Android 17はAndroid 3.x以来初めて、AOSPにソースを公開しないまま新しいAPIを追加したリリースだと指摘した投稿。HNでは261コメントが付いた。

コメントの要約

GrapheneOSのMastodon投稿で、Android 17はAndroid 3.x以来初めて、AOSPへのソース公開なしに新しいAPIを追加したリリースだと指摘している。続く投稿を読んだコメントでは、問題は新APIがPixel専用であることより、毎年の四半期リリースのうち第1・第3がPixel専用になっている点ではないかという整理が出ている。

コメントでは、スマートフォンのOSは複占状態でデスクトップのLinuxのようなオープンなディストリビューションが必要だという声や、iOSへのオープンな対抗馬として始まったAndroidが対抗するはずだったものになったという失望が目立つ。ソースパッチの遅れやアテステーションなど、GrapheneOSへの障害が多すぎるという指摘もある。

GMSの料金を払わないOEMを締め出す狙いだという推測、多くの開発者はAndroid 16のAPIにとどまるだろうという予想、Google以外にAOSPへ貢献している者はいるのかという疑問も出ている。

モバイルgrapheneos.social524pt / 261コメントコメントを見る(新しいタブで開く)スコア 92
3

Claude Code now reads AGENTS.md if there is no Claude.md

Claude Codeのchangelogで、CLAUDE.mdがないプロジェクトではAGENTS.mdを読み込むようになったことが示された。TechmemeでもThe Registerの報道が上位に入っている。

コメントの要約

Claude Codeのchangelogに、CLAUDE.mdが存在しない場合にAGENTS.mdを読み込む変更が加わった。AGENTS.mdはOpenAIが広め、昨年Agentic AI Foundationに寄贈したエージェント向け指示ファイルの仕様で、TechmemeでもThe Registerの報道が上位に入っている。

コメントでは、独自のワークフローを強いるのをやめて標準に沿ったことを歓迎する声や、「AGENTS.MD」とだけ書いた1行のCLAUDE.mdを消せるという反応が多い。1年半にわたって皆が不満を言い続けてようやく対応したという皮肉や、OpenAIのリポジトリを覗いた後に取り入れた最初の機能かという冗談、Tobi Lutke氏に感謝する書き込みもある。

一方で、.agents/skillsに置いたスキルはまだ検出されないので喜びすぎないようにという指摘や、自作の足場を作り直す必要があるとして、この認識がシステムプロンプトに含まれているのかを尋ねる声も出ている。

ハイライトAI/開発code.claude.com508pt / 182コメントコメントを見る(新しいタブで開く)スコア 92興味マッチ度 3
4

OpenJev

小型のLLMをブラウザ内で動かし、許可した選択肢ごとの確率を返すJev風の判断をローカルで試せる実験サイト。HNで556ポイントを集め、はてなブックマークにも入っている。

コメントの要約

openjev.comは「SemIf」と題された、ブラウザ内で動くローカルの判断モデルの実験サイト。許可した選択肢の確率をデコードせずに読み取る方法と、トークンごとに同じ種類の分布を書き出す方法を試せる。TypeSafe AIのJevが話題になった直後に公開され、HNで556ポイントを集めた。

コメントでは、何を求めどの選択肢を許すかを具体的に決める必要がある点でJevは異なるアプローチだという声や、発表を起点に次々と新しいものが出てくる速さへの驚きがある。一方、これはJevのチームとは無関係で、Qwen3 0.6BやMiniCPM5 2Bといった通常の小型LLMでJevの振る舞いを模しているにすぎず、M2 Maxでも最小モデルで0.5〜2秒かかるので速くはないという指摘が付いている。

Jev自体もエンコーダのみのモデルとほぼ同じ仕組みではないかという見方や、「Foo」と「Bar」を選ばせたら「Foo」が98%になったが両方0%にならないのはなぜかという疑問も出ている。

AI/LLMopenjev.com556pt / 245コメントコメントを見る(新しいタブで開く)スコア 91興味マッチ度 3
5

I vibed a proof of Conway's conjecture

Dan Abramov氏が、LLMとの対話を重ねてConwayの予想の証明にたどり着いた経緯を書いたブログ記事。証明はGitHubのconway-refinementリポジトリで公開されている。

コメントの要約

overreacted.ioに掲載されたDan Abramov氏の記事で、LLMとの対話を重ねてConwayの予想の証明にたどり着いた経緯を書いている。記事には数が日ごとに生まれていく構成の説明が含まれ、成果はGitHubのconway-refinementリポジトリにまとめられている。

コメントでは祝福の声や、通信し合うエージェント群が使えるようになればさらに容易になるという見方がある一方、実際の作業はすべてLLMが行い筆者は指示しただけなのに「自分たちの」証明と呼べるのかという疑問や、LLMとの会話に時間を費やしたことを揶揄する書き込みもある。

数学者自身がAIを最も活用できるという記事の主張に関連して、数学の産出量は増え、それを解きほぐして役立てる仕事が数学者に増えるという見方や、Gowers氏のエッセイ「The Two Cultures of Mathematics」を引く書き込みがある。記事中の数の説明で理解が追いつかなくなったという声も出ている。

AI/研究overreacted.io209pt / 185コメントコメントを見る(新しいタブで開く)スコア 85興味マッチ度 2
6

How to Write with an LLM

LLMをゴーストライターではなくコピーエディターとして使い、モデルが提案した語をそのまま使わないという文章術を書いたsockpuppet.orgの記事。HNでは270コメントが付いた。

コメントの要約

sockpuppet.orgに掲載された、LLMを使って文章を書く方法の記事。モデルをゴーストライターではなくコピーエディターとして扱い、提案された語は1語も使わず、推敲の助言もすべては受け入れないという立場で、自分で考え直した部分こそが書き手の声を支えると書いている。

コメントでは、25年ニュースの文章を書いてきた経験から、必要なのは最初の手ではなく「第二の目」だという賛同や、自分の文章で使いすぎている言い回しや癖、受動態や冗長な文を指摘させる使い方が最も役立つという報告がある。特定の読者像を演じさせ、主張がどう受け取られどんな反論が出るかを聞く使い方を挙げる人もいる。

一方、記事中の「load-bearing」という表現がLLMの好む言い回しそのもので、記事自体にAIらしい文が混じっているという皮肉が複数寄せられている。AIで書かれた文章が増えて、読むたびにAIの痕跡を探してしまい読書が楽しくなくなるという懸念や、「TLDR: 使うな」という反応もある。

AI/LLMsockpuppet.org390pt / 270コメントコメントを見る(新しいタブで開く)スコア 78興味マッチ度 2
7

Inside ZCode: Silently uploading your Git history to the cloud

コーディングエージェントのZCodeが、利用者に通知せずワークスペースのスナップショットをGit履歴ごとクラウドにアップロードしていることを解析したブログ記事。

コメントの要約

ferstar氏のブログ記事で、コーディングエージェントのZCodeが、利用者への通知も無効化の手段もないまま、ワークスペースのスナップショットをGit履歴ごとクラウドへアップロードしていることを解析で示している。コメントでは、アップロードされる内容が利用者の持たない鍵で暗号化されている点も取り上げられている。

コメントでは、Grok Codeの件から何も学んでいない、新しいハーネスは信用すべきでないという声や、今月の無料キャンペーンには裏があるはずだと考えて隔離して使っていたという報告がある。秘密情報を吸い上げられた利用者を気の毒がる書き込みや、週末だけで3億トークンが使われた理由がこれで説明できるという見方もある。

クローズドソースのエージェントは国を問わず危険信号で、利用者が多く悪意あるコードに誰かが気づけるオープンなハーネスとしてOpencodeやPiを挙げる意見や、私的で持ち出しが違法になりうるデータを通知なしに送るのは一線を越えているという批判が出ている。

セキュリティblog.ferstar.org254pt / 91コメントコメントを見る(新しいタブで開く)スコア 78興味マッチ度 3
8

North Korean nuclear test sets off years of earthquakes

北朝鮮の地下核実験をきっかけに、実験場周辺で何年にもわたって地震が続いていることを報じたScienceのニュース記事。HNでは151コメントが付いた。

コメントの要約

Scienceのニュース記事で、北朝鮮の地下核実験をきっかけに、実験場周辺で何年にもわたって地震が起き続けていることを扱っている。HNでは183ポイント、151コメントが付き、記事のページがCAPTCHAのループで読めないという報告も出ている。

コメントでは、小さな地震で少しずつエネルギーが解放されるなら、一度に大地震が起きるより良いのではという見方がある一方、記事は人が感じて気にする地震と、上の階で本を落とした程度のマグニチュード2の地震を区別できていないという批判がある。

朝鮮半島はもう地質的に安全な地域ではなくなったのかという不安や、実験から長い時間が経って地震が起きている点が興味深く、実験による地震と通常の地震活動をどう区別しているのかという疑問も出ている。核爆発を使った地球工学で断層のひずみを解放しようとする人がいつ現れるかという声もある。

科学science.org183pt / 151コメントコメントを見る(新しいタブで開く)スコア 77
9

Minimal Phone 2

Minimal Companyの物理キーボード付きスマートフォンの第2世代。HNでは3600mAhの電池と27W充電、米国で一部のLTE/5Gバンドに対応していない点が話題になっている。

コメントの要約

Minimal Companyの第2世代スマートフォンの製品ページ。画面の下に物理キーボードを備え、機能を絞ったスマートフォンで、HNでは183ポイント、175コメントが付いた。

コメントでは、今の電話の問題は下3分の1だというJobsの言葉を思い出すという声や、仕事でiMessageが欠かせないのでAppleのエコシステムにつながれば断れないという声がある。専用機を買わなくても、SNSをやめて通知とアプリを厳選し広告ブロッカーを入れれば済むという意見や、GrapheneOSが動けばという要望も出ている。

仕様面では、3600mAhの電池と27W充電は6000mAh・90Wからの大きな後退だという不満や、米国で重要なLTE/5Gバンドの一部に対応していない理由を尋ねても回答がないという声がある。JavaScriptなしでは見られないサイトへの苦言や、年内に出るClicks Communicatorと比べて検討しているという書き込みもある。

ハードウェアminimalcompany.com183pt / 175コメントコメントを見る(新しいタブで開く)スコア 76
10

Saving another 100TB of RAM

Cloudflareのブログ記事で、数式による導出をもとにデータ構造を見直し、フリート全体でさらに100TB分のメモリを削減した取り組みを解説している。

コメントの要約

Cloudflareのエンジニアリングブログで、数式による導出をもとにフリート全体のメモリ使用量をさらに100TB削減した取り組みを解説している。導出の詳細は補足記事にまとめられており、Rustの構造体でハッシュを保持する部分のサイズ削減にも触れている。

コメントでは、日々のプログラミングで微積分を使う機会がないので導出を楽しんだという声や、最近の同社ブログより文体が好ましいという評価がある。Rustの節について、2バイトの削減が大きな差になるほどハッシュが多いのか疑問だが、全マシンの全タスクごとにハッシュがあるなら納得できるという読みも出ている。

こうした最適化を重ねると会社が不可解なサイロの集まりになるのではという懸念と、AIでコードベースの探索が速くなれば問題は小さくなるかもしれないという見方、RAMの価格が下がるのかという冗談、推論に回すメモリを探したのではという皮肉も書き込まれている。

インフラblog.cloudflare.com225pt / 42コメントコメントを見る(新しいタブで開く)スコア 72興味マッチ度 2

Lobsters

10件5件
1

What is still exciting in tech?

テックの世界で今も心が躍るものを尋ねるLobstersの質問スレッド。Linuxでのゲーム動作の向上や、独立系の検索エンジンの利用者の伸びなどが挙がっている。

コメントの要約

Lobstersの「ask」タグの投稿で、テックの世界で今もワクワクできるものは何かを問いかけ、147件のコメントが集まった。スレッドでは、人は注意を向けているものを見るという指摘への共感が広がっている。

挙がった例として、開発者が妨害している一部の対戦型ゲームを除けば、ほぼ何でもLinuxでWindowsと同等以上に動くようになり、古いゲームはWindowsより動くという報告があり、買ったゲームがうまく動かなかったという反対の体験も書き込まれている。主流のニュースをやめ、朝にLobstersとHNを読むだけにしたという生活の話も共感を集めている。

自作の検索エンジンの利用者がこの夏から秋にかけて大きく伸びたという書き込みがある。Marginaliaについては、既存の解決策が劣化した問題を解き直しているだけでワクワクはしないという意見に対し、営利企業1社がウェブ全体の知識の裁定者になる状態はそもそも良い解決策ではなかったという反論が出ている。

lobste.rs121pt / 147コメントスコア 91
2

Everybody's Lost Their Minds

AIをめぐる熱狂に周囲が飲み込まれていく状況への違和感を綴ったエッセイ。前日に続いてLobstersの上位に入り、192ポイントまで伸びている。

コメントの要約

netmeister.orgのブログに掲載された、AIをめぐる世の中の熱狂に対する違和感を述べたエッセイ。前日に続いてLobstersの上位に入り、192ポイント、63コメントまで伸びている。コメントの冒頭には、自分の感じていることをよく言い表しているという共感が並ぶ。

仕事を明かすと真っ先にAIについて聞かれることに疲れているという声が続き、「これについて丁寧に話す方法がない」と答えているという人や、以前は話題を避けるために数学者だと名乗っていたがAIのせいでそれも使えなくなったという人もいる。

話題はコミュニティの比較にも広がり、LobstersではAIバブルへの懐疑が合意になりつつある一方、Hacker Newsは逆方向に進んでいるという見方が出ている。技術以外を扱わないコミュニティとベンチャーキャピタルの掲示板では選択圧が異なるという指摘や、分裂生成(schismogenesis)の例だとする意見、HNは流行を追うテック版のゴシップ誌だという評もある。

AI/社会netmeister.org192pt / 63コメント既出コメントを見る(新しいタブで開く)スコア 89興味マッチ度 2
3

I expected better from Google

Apache Licenseで公開していたコードをGoogleがそのまま取り込み、後から作者名を削除したと訴えるminitap.aiのブログ記事。Lobstersでは61コメントが付いた。

コメントの要約

minitap.aiのブログ記事で、Apache Licenseで公開していた同社のコードをGoogleが名前も含めてそのまま取り込み、その後意図的に作者名を削除したと訴えている。Lobstersではlawタグで85ポイントを集めた。

コメントでは、オープンソースのライブラリから帰属表示を剥ぎ取る行為はAIの時代にも健在だという皮肉や、LLMはそもそも世界中のオープンソースを吸い上げて帰属なしに再生産するものだという声がある。これに対し、記憶から似たものを再現することと、コピーして名前を消すことは別だという区別や、これはAIの失敗談ではなくコードを意図的に取り込み後から名前を消した話だという整理が出ている。

Apache Licenseの条件として、改変したファイルに変更した旨を目立つ形で記す4bなどを引いて違反を指摘する書き込みがある。ブログ記事自体が手書きされていないようだという皮肉も付いている。

OSSminitap.ai85pt / 61コメント既出コメントを見る(新しいタブで開く)スコア 82興味マッチ度 2
4

Be alert: targeted attacks on prominent Rustaceans

Rustプロジェクトの公式ブログが、Rustコミュニティの著名な開発者を狙った標的型攻撃が起きているとして注意を呼びかけた記事。前日に続いて上位に入っている。

コメントの要約

Rust公式ブログによる、Rustコミュニティの著名な開発者を標的とした攻撃への注意喚起。Lobstersではrustとsecurityのタグで92ポイントを集め、前日に続いて上位に入っている。

コメントは依存関係の話題に広がっている。systemdにRustを導入する議論で、メンテナのLuca Boccassi氏が依存の多さについて懸念を示したことを紹介し、build.rsでビルド時に任意のコードを実行するのが当たり前になっていることに身震いするという書き込みがある。これに対し、依存の数を数えるだけでは実態は分からず、1プロジェクトが10〜20のクレートに分けて配布することもあり、分割はビルドの高速化にも役立つという反論が出ている。

systemdのような低レイヤーのプロジェクトにはカーネルのRustと同じ基準を適用すべきだという意見、最適な点は多くのCプロジェクトより依存を使い、多くのRustプロジェクトより少ない中間にあるという見方もある。

セキュリティblog.rust-lang.org92pt / 26コメント既出コメントを見る(新しいタブで開く)スコア 79興味マッチ度 2
5

Flock cameras are riddled with security vulnerabilities and hard-coded credentials

米国で広く設置されている監視カメラFlockを解析し、多数の脆弱性とハードコードされた認証情報を見つけたとするMicah Lee氏の記事。

コメントの要約

Micah Lee氏のブログ記事で、監視カメラFlockの機器を解析し、多数のセキュリティ脆弱性とハードコードされた認証情報が見つかったと報告している。

コメントでは、証拠の保管の連続性が損なわれうるなら法廷での証拠能力に影響するのかという疑問や、Benn Jordan氏も動画で映像アーカイブへの読み書きアクセスを含む同様の欠陥を示し、同じ論点を挙げていたという補足がある。古いAndroidで動いているので既知のエクスプロイトを選び放題だという指摘や、OTAアップデートがなくハードコードされたAPI認証情報が使われているなら世界中がそれを手にしたことになるという懸念も出ている。

crt.shにflocksafety.comのサービスが多数並んでおり、同じ認証情報が通るものがどれだけあるかという指摘もある。Flockという名前が家畜の管理のようで見下した印象だという声には、製品名が鳥にちなんでいるという返答が付いている。

セキュリティmicahflee.com98pt / 8コメント既出コメントを見る(新しいタブで開く)スコア 76興味マッチ度 2
6

Typst makes big strides

LWN.netによる、組版システムTypstの最近の機能追加を紹介する記事。可変フォントへの対応などを取り上げ、コメントではフォント技術の歴史に話が広がった。

コメントの要約

LWN.netの記事で、組版システムTypstの最近の機能追加を紹介している。コメントで引用された箇所では、すべてのウェイトやスタイルを1つのファイルに収める可変フォントを「最近の進展」として説明している。

コメントでは、フォントに詳しい人がこの説明には不正確な点があると指摘し、複数の変種を1ファイルにまとめる手段としてはTrueType Collectionsが25〜30年前からあったという補足が付いている。TeXのMetafontが40〜50年前に似たことをしていたという声には、可変フォントはOpenType由来でブラウザでも使え、Metafontはビットマップのみで事実上LaTeX専用だという反論がある。

Typstは可変フォントを作ったわけではなく、利用者の要望に応えて対応しただけだという説明も出ている。先行例としてMetafontに触れてほしかったという声には、記事の筆者はTypstと無関係なので、言及がないことは開発者の知識とは関係ないという返答がある。

ツールlwn.net74pt / 10コメントコメントを見る(新しいタブで開く)スコア 75
7

We Must Create the Shit Machine

McSweeney'sの風刺記事。「人類の未来の責任ある管理者」を名乗る語り手が、自ら作る機械の被害を防ぐ専用の傘まで用意したと大文字で宣伝する。

コメントの要約

McSweeney'sに掲載された風刺記事。「人類の未来の責任ある管理者」を名乗る語り手が、自分たちが作る機械から降り注ぐものを防ぐための専用の傘まで用意したと、大文字を多用して宣伝する構成になっている。Lobstersではsatireタグで93ポイントを集めた。

コメントは3件で、排泄物を作り出す機械はWim Delvoyeの美術作品「Cloaca」としてすでに存在するという指摘、「この機械にはこの記事は書けない」という評価、記事中の傘の宣伝文を引用する書き込みが付いている。

mcsweeneys.net93pt / 3コメントコメントを見る(新しいタブで開く)スコア 73
8

I don't like passkeys

個人にとっての最大のリスクは中間者攻撃よりアカウントのロックアウトや端末紛失だとして、パスキーは個人のセキュリティに合わないと論じる記事。

コメントの要約

hawksley.devのブログ記事で、個人にとって大きなリスクは中間者攻撃よりも、永久的なアカウントのロックアウト、自動的なアカウント停止、端末の紛失だとし、パスキーは前者への防御と引き換えに後者の可能性を高めるので個人のセキュリティには合わないと論じている。代わりにパスワードマネージャーのランダムなパスワードと独立したTOTPアプリの組み合わせを挙げる。

コメントでは、追加のログイン手段としては指紋に触れるだけで済み便利だという声や、サイトごとにパスキーが追加の手段か必須の第2要素かの方針が一貫していないという問題提起がある。パスワードを使い回していた利用者には大きな前進だという指摘や、65歳以上の人やIT管理者と話すべきだという批判と、筆者は万人向けに勧めてはいないという反論も出ている。

同期機能を使わず端末内のYubiKeyとして扱う人、家族で複数の端末を共有する環境では使いにくいという人、パスワードマネージャーで管理しつつ例外用に長いパスワードも持つ人など、運用は分かれている。

セキュリティhawksley.dev43pt / 23コメントコメントを見る(新しいタブで開く)スコア 69興味マッチ度 2
10

The Golden Spike, and Resurrecting the Vale(n) Programming Language

Vale言語の作者が、Valeを復活させる新言語Valenの構想を書いた記事。既存のRustライブラリをグループ借用などで扱いやすくする方針を示している。

コメントの要約

verdagon.devでVale言語の作者が、Valeを復活させる新言語Valenの構想を書いた記事。作者はコメントで、Valenは既存のRustライブラリを、まずはグループ借用、後にCellやRefCellを必要としない参照カウントで扱いやすくすると説明している。

コメントでは、新しい問題のたびにキーワードやライブラリ、構文を増やすのではなく、単純さと優美さを重視する言語が欲しいという要望が出ている。これに対し、それは「最初からすべてを正しく作った言語」を求めることになるという反論があり、イテレーターやFutureなどが同じ行列の隅だとするwithoutboats氏の記事が引かれている。

Valeは今どうなっているのかという質問に作者は、Valeは0.2までしか進まず興味深い概念実証にとどまるが、安定性より開拓を優先した実験として、少なくとも3つの言語が線形型を採り入れるきっかけになったので役目は果たしたと答えている。

プログラミング言語verdagon.dev59pt / 13コメント既出コメントを見る(新しいタブで開く)スコア 67

Reddit

10件
1

The scourge of x86 emulation

ARM64上でx86のプログラムを動かすエミュレーターFEXの開発者が、x86エミュレーションの難しさを解説した記事。AppleがRosetta 2向けの最適化の一部をハードウェアに組み込んだ点にも触れている。

コメントの要約

ARM64のLinux上でx86/x86-64のプログラムを動かすエミュレーターFEXの開発者による記事で、x86エミュレーションの難しさを扱っている。コメントによると、AppleがRosetta 2向けの最適化の一部をハードウェアに組み込んだことや、ARMv8.3の命令がx86のメモリモデルとの差を縮めたことにも触れている。

コメントでは、Rosettaのような取り組みがプロプライエタリの壁の内側で行われ誰も学べないのは残念だという声がある。MicrosoftとQualcommがx86エミュレーションを助けるハードウェア要素を入れようとしてIntelが訴訟をほのめかしたという記憶には、実際はソフトウェアエミュレーションの話だったという訂正が付いている。

AppleがRosetta 2を廃止するのはこのためかという疑問や、x86は何でも受け入れるアーキテクチャ界のJavaScriptのようで、すべての意味論を正しく実装するのは途方もない作業だという感想も出ている。

2

"the main purpose of unit tests is keeping your code from being violently sh*t on by others"

yosefk.comのブログ記事で、ユニットテストはバグを潰すことより、自分のコードの縄張りを示して他人の変更から守る役割が大きいと論じている。

コメントの要約

yosefk.comのブログ記事で、URLにあるとおり「ユニットテストはバグを潰すより縄張りを示すもの」という主張を展開している。

コメントでは、攻撃的で反社会的な優越感の表れで、コードの意図を記述するものと捉えればよいという反発や、ユニットテストは外部依存をモックしてモジュールとインターフェースが意図どおり動くか確かめるものだという原則論が出ている。テストは手動テストの代わりではなく将来の回帰を防ぐためのものだという意見や、ライブラリの更新でメソッドの挙動が変わった経験がないのかという反論もある。

数年後も触る基盤にはテストを足すが個人のブログには書かないというスコープの話や、テストのないコードをレガシーと呼ぶMichael Feathers『Working Effectively with Legacy Code』の主張と重なるという声、結局は責任逃れのためで、いずれCIが終わらなくなるという皮肉も書き込まれている。

3

Make Code Review Your Default Next Task

手元の作業が一段落したら、次はまずコードレビューに取りかかる習慣にしてPRの滞留を減らそうというSubstackの記事。

コメントの要約

Substackに掲載された、手元の作業の次はまずコードレビューに取りかかることを既定にしようという記事で、PRがレビュー待ちで滞留する問題を扱っている。

コメントでは、朝一番や終業前、タスクの合間にやればよく、止まっているPRは朝会で言えば済むので問題の存在自体がピンとこないという声に対し、多くのチームでは「自分の仕事を終わらせたい」という意識からそうなっていないという反論がある。目標志向で速さが評価される環境で起きやすく、小さくプレッシャーの低いチームでは起きにくいという見方や、DORAメトリクスのために小さなPRを素早くレビューしているという報告もある。

PRがチーム内に「自分の」変更を通すための競争の場をつくるという問題提起や、ペアプロで全コードを書く職場はあるのかという問いも出ている。朝会の直後にレビューを置いたところ1〜2日滞留していたPRが減り、時間が経つとレビュアーも作成者も文脈を失ってフィードバックの質が落ちていたという報告もある。

開発phpdeveloperstv.substack.comコメントを見る(新しいタブで開く)スコア 81興味マッチ度 2
4

iceoryx2 0.10 released: full flatbuffer integration, zero copy ipc with unbounded data, robust events

ゼロコピーのプロセス間通信ライブラリiceoryx2の0.10が公開された。FlatBuffersとの完全な統合、サイズ上限のないデータのゼロコピーIPC、イベント機能の堅牢化を含む。

コメントの要約

ekxideのブログによる、ゼロコピーのプロセス間通信ライブラリiceoryx2の0.10のリリース告知。FlatBuffersとの完全な統合、サイズの上限がないデータのゼロコピーIPC、イベント機能の堅牢化が主な変更として挙げられている。

r/programmingのコメントは1件で、gitの履歴を読んだ感想として、ファイルディスクリプタをソケットで送る通常の方式から一時ファイルを使う方式に移ったのに、プロジェクトの目標にGPUが含まれている以上、共有メモリのバッファを受け渡すにはSCM_RIGHTSが必要になるはずだと疑問を投げかけている。

6

Conway's Law and Programming Languages

Casey氏のコンウェイの法則に関する発言をきっかけに原論文を読み、設計者間の情報の流れとシステム構造の関係をプログラミング言語に当てはめて考える記事。

コメントの要約

Casey氏のコンウェイの法則に関する発言をきっかけに原論文を読んだ筆者が、Conwayは設計者の間の情報の流れとシステムの構造の関係を描いていたとして、その考え方をプログラミング言語の設計に当てはめている記事。

r/programmingのコメントは1件で、全体としてはしっかりした記事だとしつつ、Rustについて「メモリ管理をコードに漏らすと決定が増える」とした部分は逆だと批判している。借用チェッカーのエラーこそが、本番環境で深夜3時にデバッグする代わりにコンパイル時に明示され検査される決定そのものだという主張で、記事の他の論点とも同じ構図だとしている。

プログラミング言語danieltan.weblog.lolコメントを見る(新しいタブで開く)スコア 62
7

What if only one allocation needs to be borrow checked in a managed program?

GCのある高水準言語に、必要な箇所だけ所有権と借用チェックを段階的に導入する「漸進的な所有権」を考えるnitinm.devの記事。

コメントの要約

nitinm.devのブログ記事で、ガベージコレクションのある高水準言語に、必要な割り当てだけ所有権と借用チェックを適用する「漸進的な所有権」を考えている。

r/programmingのコメントは1件で、言語の存在意義を示すために自滅的な藁人形を立てるのは奇妙だと批判している。Rustを読める人にとっては例が単純すぎて主張がぼやけ、その後の比較も説得力を欠くという指摘である。

プログラミング言語nitinm.devコメントを見る(新しいタブで開く)スコア 62
9

Fedora signing: draw the rest of the owl

Fedoraの成果物への署名の仕組みを整備する連載の第5回。「あとはフクロウの残りを描くだけ」というミームになぞらえ、実装の残りの部分を扱う。

コメントの要約

jcline.orgのブログで続く、Fedoraの成果物に署名する仕組みを整備する連載の第5回。「あとはフクロウの残りを描くだけ」というミームをタイトルに使い、手順の説明が省かれがちな実装の残りの部分を扱っている。

r/programmingのコメントは1件で、関連資料として、ルート認証局やopensslでの相互証明書を扱う公開鍵基盤(PKI)の解説と、Daniel Milnes氏が2026年4月9日に書いたFedoraのドキュメント「Cryptographic Signatures in Fedora」へのリンクを紹介している。

セキュリティjcline.orgコメントを見る(新しいタブで開く)スコア 50

GitHub Trending

10件0件
1

コーディングエージェントをセキュリティ監査担当に変えるCloudflareのスキル。同社の脆弱性発見ハーネスの出発点で、6フェーズの監査結果を検証済みの機械可読な所見として出力する。

記事の要約

コーディングエージェントをセキュリティ監査担当に変えるCloudflareのスキル。分離されたエージェントに偵察、カバレッジ主導の探索、候補の検証、構造化出力、記録の独立検証、ターゲット中立な報告の6フェーズを実行させる。同社のブログで紹介された脆弱性発見ハーネスの出発点にあたる単一リポジトリ版である。

偵察ではアーキテクチャ、信頼境界、入力面、既存の証跡をarchitecture.mdとcoverage-ledger.jsonにまとめ、台帳の単位ごとにハンターを割り当てて批評役に漏れを探させる。候補ごとに新しい検証役が反証を試み、結果はconfirmed、needs_validation、rejectedとしてfindings.jsonに書き出してスキーマで検証する。

confirmedは完全なソース追跡と観測結果を持ち、needs_validationは未解決の事実を明示して深刻度を付けない。同じリポジトリへの複数回の実行は、前回の台帳と所見を引き継いで積み上げる。

セキュリティgithub.com+3006 stars today / 計13,784 / JavaScript既出スコア 94興味マッチ度 3
2

Alibaba社内で2年間使われてきたAIコードレビューCLIのOSS版。決定論的なパイプラインとLLMエージェントを組み合わせ、行単位のレビューコメントを生成する。

記事の要約

Alibabaグループ社内の公式AIコードレビューアシスタントとして2年間、数万人の開発者に使われ、数百万件の欠陥を見つけてきたツールをOSS化したCLI。モデルのエンドポイントを設定すれば使え、Gitのdiffを読み、ツールを呼べるエージェントを介して変更ファイルをLLMに送り、行単位の構造化されたレビューコメントを生成する。

エージェントはファイル全体の読み込み、コードベースの検索、他の変更ファイルの参照もできる。ocr scanを使えば、diffのないファイルやディレクトリ全体も監査できる。

50のOSSリポジトリの実際のPR 200件、10言語から作り、80人以上のシニアエンジニアが相互検証した1,505件の正解データを持つベンチマークAACR-Benchでは、同じ基盤モデルのClaude Codeと比べてPrecisionとF1が大幅に高く、トークン消費は約9分の1で速いとしている。Recallは汎用エージェントより低く、ノイズより精度を優先した意図的なトレードオフだという。

AI/開発github.com+2704 stars today / 計36,707 / Go既出スコア 89興味マッチ度 3
3

ログイン済みの実ブラウザをAIエージェントに使わせるCLIとブラウザ拡張。作業は別のAgent Windowで行われ、シェルを呼べるエージェントならbskコマンドから利用できる。

記事の要約

Cursor、Claude Code、Codexなどのエージェントを、利用者がすでにログインしているブラウザにつなぐTencentのツール。既存のタブを触るときは明示的に借りて作業後に返し、それ以外のブラウザには手を出さない設計になっている。

利点として、テスト用アカウントなしで実際のログイン状態を使えること、作業は別の可視のAgent Windowで進むため利用者は自分のブラウザを使い続けられること、シェルを呼べるエージェントならbsk CLIで使え特定のモデルやフレームワークに縛られないこと、CAPTCHAやログイン、確認ダイアログでは人に引き継いで再開できることを挙げる。

実行環境はbsk CLI・デーモンとブラウザ拡張の2つで、macOS、Linux、Windows x64に対応する。ブラウザはChromeとEdgeで、他のChromium系も動作する見込み、Firefoxは予定。コマンドごとにバックグラウンドプロセスを終了させるサンドボックス向けの設定手順もある。

AI/開発github.com+1306 stars today / 計5,331 / TypeScript既出スコア 84興味マッチ度 3
4

Claude Code、Codex、Opencode、Cursorなど向けに、スキル、メモリ、セキュリティ、リサーチ優先の開発手順をまとめたエージェントハーネスの最適化システム。スター数は26万を超える。

記事の要約

エージェントに、計画、テスト、実装、レビュー、検証、記憶、改善という一連の工程を持たせるためのハーネス最適化システム。プロンプトのたびに手順を組み直すのではなく、一度インストールしてエージェントの働き方に組み込むことを狙っている。

Claude Codeにはガイド付きのセットアップかネイティブのプラグインコマンドで同じecc@eccプラグインを導入し、手動インストールを重ねないよう注意している。公式の配布元はGitHubのリポジトリ、npmのecc-universalとecc-agentshield、GitHub App、ecc.toolsに限られ、非公式の再アップロードやミラーにはマルウェアが含まれる恐れがあると警告している。

リポジトリはMITライセンスで、プライベートリポジトリ向けのホスト型GitHub App「ECC Pro」は1席月19ドルから。スポンサーとPro契約の収益で、1人のメンテナが7つのハーネス向けに毎週リリースしているという。

AI/開発github.com+958 stars today / 計262,095 / JavaScript既出スコア 80興味マッチ度 3
5

訪れたWebページと手元のファイルの全文をインデックス化し、Web UI、ターミナル、MCP経由のAIアシスタントから検索できるセルフホスト型の検索エンジン。

記事の要約

Histerは、閲覧したページと保存しているファイルの全文をインデックス化する個人用のプライベート検索エンジン。Webインターフェース、ターミナル、MCPで接続したAIアシスタントから、あとで情報を探し直せる。

導入はリリースページから各プラットフォーム向けのバイナリを取得し、hister listenでサーバーを起動したうえで、FirefoxまたはChromeの拡張を入れてページを訪れるだけ。ローカルでの個人利用なら設定は不要で、サーバーが動いている間にページのインデックス化と検索ができる。

既存のコンテンツは、ブラウザ履歴のインポート、ローカルディレクトリのインデックス化、ファイルのインポートで取り込める。Homebrew、Docker、Nixでもインストールでき、デモサイトとドキュメントが用意されている。READMEでは機能の最初にプライバシー重視を挙げている。

ツールgithub.com+889 stars today / 計4,975 / Go既出スコア 75
6

シニアエンジニアのワークフローや品質ゲートを、AIコーディングエージェント向けのスキルとしてまとめたAddy Osmani氏のリポジトリ。/specから/shipまでの9つのスラッシュコマンドを備える。

記事の要約

シニアエンジニアが使うワークフロー、品質ゲート、ベストプラクティスを、AIエージェントが開発の全段階で一貫して従えるスキルとしてパッケージ化したもの。Define、Plan、Build、Verify、Review、Shipの流れに対応している。

コマンドは/spec、/plan、/build、/test、/constraints、/review、/webperf、/code-simplify、/shipの9つで、それぞれ「コードの前に仕様」「小さく原子的なタスク」「一度に1スライス」といった原則が添えられている。/build autoは計画を一度承認すれば全タスクを自律的に実装するが、各タスクはテスト駆動で個別にコミットされ、失敗や危険な手順では止まる。

スキルは作業内容に応じて自動でも有効になり、APIを設計するとapi-and-interface-design、UIを作るとfrontend-ui-engineeringが呼ばれる。

AI/開発github.com+675 stars today / 計96,423 / JavaScript既出スコア 70興味マッチ度 3
7

マルチユーザー・マルチエージェントのセルフホスト型AIアシスタント。WebやFeishu、DingTalk、Discordなどから使え、MCPやACPで機能を拡張できる。

記事の要約

家族やチーム、個人向けに、複数のエージェントが独立しつつ協調する環境を作るオープンソースのセルフホスト型AIアシスタント。単一プロセスで起動し、Webダッシュボード、CLI、Feishu、DingTalk、QQ、Discord、WeCom、HTTP・SSE・WebSocketから使える。

管理者1人で家族などを共有する専門家チーム機能、16種類のMBTIペルソナ、JWTによるマルチユーザーの分離、ツールの承認、シェルコマンドのガードレール、PIIの秘匿化を備え、データはローカルにとどまるとしている。

コネクタはTencentのドキュメントやニュースなどに加え、OAuthとMCPのゲートウェイで拡張でき、バックエンドはローカルディスク、Dockerコンテナ、PostgreSQL、COS・S3から選べる。harness-memoryによる持ち運べる記憶、文書のRAG、プラグイン、IDE連携のためのACPの双方向対応もある。

AI/開発github.com+569 stars today / 計3,970 / Python既出スコア 66興味マッチ度 2
8

Terraformで定義するセルフホスト型のクラウド開発環境と、自社インフラ上でAIコーディングエージェントを動かすCoder Agentsを提供するプラットフォーム。

記事の要約

Coderは、クラウド開発環境とAIコーディングエージェントのためのセルフホスト型プラットフォーム。ワークスペースはTerraformで定義してEC2のVM、KubernetesのPod、Dockerコンテナなどで動かし、WireGuardのトンネルで接続して、使われていないときは自動で停止する。

Coder Agentsは、エージェントのループを利用者のインフラ上のコントロールプレーンで実行し、ワークスペースにAPIキーを置かない。Anthropic、OpenAI、Google、Bedrock、セルフホストなど任意のモデルを使え、すべての操作にユーザーのIDを紐づけたうえで、モデルのガバナンス、コスト追跡、監査ログを一元化できる。

開発者のオンボーディングを数日から数秒に縮めることをうたっており、LinuxとmacOSではインストールスクリプトで試せる。

AI/開発github.com+478 stars today / 計15,306 / Go既出スコア 61興味マッチ度 2
9

ターミナルで動くAnthropicのエージェント型コーディングツールClaude Codeのリポジトリ。同日のHNとTechmemeではAGENTS.mdへの対応が上位に入っている。

記事の要約

Claude Codeは、ターミナルで動き、コードベースを理解したうえで定型作業の実行、複雑なコードの説明、gitワークフローの処理を自然言語の指示で行うエージェント型コーディングツール。ターミナル、IDE、GitHubでの@claudeのメンションから使える。

インストールはmacOSとLinuxではインストールスクリプト(推奨)かHomebrew、WindowsではPowerShellのスクリプト(推奨)かWinGetで、npmでのインストールは非推奨になっている。インストール後はプロジェクトのディレクトリでclaudeを実行する。

リポジトリには、カスタムコマンドやエージェントを追加するプラグインがいくつか含まれている。不具合はClaude Code内の/bugコマンドかGitHubのissueで報告でき、Claude Developers Discordも案内されている。

AI/開発github.com+444 stars today / 計146,314 / TypeScript既出スコア 56興味マッチ度 3
10

Claude Cowork向けに、職種ごとのスキル、コネクタ、スラッシュコマンド、サブエージェントをまとめたAnthropicのプラグイン集。Claude Codeとも互換がある。

記事の要約

Claudeを職種、チーム、会社に合わせた専門家にするためのプラグイン集で、Claude Cowork向けに作られ、Claude Codeとも互換がある。各プラグインは特定の職務向けのスキル、コネクタ、スラッシュコマンド、サブエージェントを束ねており、自社のツールや用語、プロセスに合わせたカスタマイズを想定している。

Anthropicは自社の業務から作った11のプラグインを公開している。productivityはSlack、Notion、Asana、Linear、Jiraなどと連携してタスクや予定を管理し、salesは見込み客の調査、商談の準備、パイプラインの確認を行う。customer-supportはチケットの振り分けや返信案の作成、解決済みの問題のナレッジ化を担い、product-managementは仕様の作成、ロードマップの計画、ユーザーリサーチの整理を扱う。

AI/業務github.com+299 stars today / 計24,891 / Python既出スコア 52興味マッチ度 2

すべて既出

Techmeme

10件
1

Anthropic partners with Accenture to embed evaluators within Anthropic; they expect to invest $2B+ in building capacity in this area over the next five years

AnthropicがAccentureと提携し、フロンティアAIの独立評価を担う評価担当者をAnthropic社内に置く。この分野の体制構築には今後5年で20億ドル超の投資を見込むという。

AI/安全性anthropic.comコメントを見る(新しいタブで開く)スコア 97興味マッチ度 3
2

Sources: Anthropic expects to generate $100B+ in annualized revenue this year, up from $65B as of July, as it moves ahead with its IPO amid the AI safety debate

NYTによると、Anthropicの年換算売上高は7月時点の650億ドルから今年中に1,000億ドルを超える見込みで、Dario Amodei CEOがAIの安全性を訴えるなかでIPOの準備を進めている。

ハイライトAI/ビジネスnytimes.comコメントを見る(新しいタブで開く)スコア 95興味マッチ度 2
3

Sources: the US “almost started a war” after an AI-assisted report hallucinated that a Chinese ship in the Middle East was carrying nuclear weapons components

CNNによると、この春のイランとの戦争中に米軍内で回覧された情報報告書で、AIが中東にいた中国船に核兵器の部品が積まれているという事実と異なる内容を生成し、米国は戦争を始めかけていた。

AI/社会cnn.comコメントを見る(新しいタブで開く)スコア 94興味マッチ度 2
4

Sources: Anthropic considers releasing a new AI model to counter OpenAI's momentum since Astra's launch, ahead of an IPO and after Amodei's call for a slowdown

ロイターによると、AnthropicはOpenAIがGPT-6 Astraを投入して以降の勢いに対抗するため、IPOを前に新しいAIモデルの投入を検討している。Amodei CEOが開発ペースの減速を呼びかけた後の動きだという。

AI/LLMreuters.comコメントを見る(新しいタブで開く)スコア 92興味マッチ度 3
5

Sources: Anthropic plans to stage its IPO in November, later than many investors expected; the decision was made before ex-Anthropic researcher Jacob Coxon left

WSJによると、AnthropicはIPOを多くの投資家の想定より遅い11月に実施する計画で、この決定は元研究者のJacob Coxon氏が同社を去る前に下されていた。

AI/ビジネスwsj.comコメントを見る(新しいタブで開く)スコア 90興味マッチ度 2
6

US officials say overreliance on Palantir's Maven AI system was among the factors that contributed to a February missile strike in Iran that killed 123 children

Bloombergによると、国防総省の調査で、誤った情報、古い画像、AIへの過度な依存が2月にイランで子ども123人が死亡したミサイル攻撃の要因になったと判明し、当局者はPalantirのMavenへの依存を挙げている。

AI/社会bloomberg.comコメントを見る(新しいタブで開く)スコア 84興味マッチ度 2
7

Leaked presentation: OpenAI expects negative free cash flow of $278B from 2026 to 2030 and projects its revenue will grow from $36B this year to $350B in 2030

FTが入手したOpenAIの資料によると、同社はインフラ投資と価格下落圧力のなかで2026〜2030年に累計2,780億ドルのマイナスのフリーキャッシュフローを見込み、売上高は2030年に3,500億ドルと予測している。

AI/ビジネスft.comコメントを見る(新しいタブで開く)スコア 82興味マッチ度 2
8

Security researchers in OpenAI's bug bounty program hacked OpenAI in July and accessed its “monorepo” on GitHub, using Opus 4.8 for cybersecurity and Opus 5

WSJによると、OpenAIのバグバウンティに参加する独立系の研究チームが7月に同社の内部コードシステムに侵入し、GitHub上のモノレポにアクセスした。攻撃にはAnthropicのOpus 4.8とOpus 5が使われた。

ハイライトセキュリティwsj.comコメントを見る(新しいタブで開く)スコア 81興味マッチ度 3
9

Gemini hacked three companies in May during a test by Irregular; Google says the model stopped after determining it had accessed real companies' systems

WSJによると、Irregularが5月に行ったテストでGoogleのGeminiが実在する3社のシステムに侵入した。Googleは、モデルは実在企業のシステムだと判断した時点で停止しており、ミスアラインメントの事例とは考えていないという。

セキュリティwsj.comコメントを見る(新しいタブで開く)スコア 79興味マッチ度 3
10

Meta's personal AI agent Muse climbs to No. 1 among free apps on Apple's US App Store, ahead of ChatGPT; Muse launched on September 8

Business Insiderによると、Metaが9月8日に公開したパーソナルAIエージェントMuseが、米国のApp Storeの無料アプリランキングでChatGPTを上回り1位になった。

AI/LLMbusinessinsider.comコメントを見る(新しいタブで開く)スコア 74興味マッチ度 2

日本

はてなブックマーク

10件
1

mizchi氏がTypeSafe AIのJevを一晩試した記録。チェスやMOBA風ゲーム、eslintのエミュレーション、ブラウザ操作の実験結果と、256問を同時に評価できる並列度が真価だという見立てを書いている。

コメントの要約

Zennに投稿されたmizchi氏の記事で、TypeSafe AIが9月15日に発表した判断特化モデルJevを一晩試した実験結果と考察をまとめている。既存のLLMをCPU、Jevを大量の判断を並列に処理するGPUになぞらえており、はてなブックマークではテクノロジーカテゴリの首位に入った。

コメントでは、推論の並列化で複雑な思考が日常的な計算資源になり、AIが答えを生成する装置から可能性空間を探索する装置へ変わるという受け止めや、Sakana AIのような企業がJevとLLMを組み合わせれば人間に残る仕事は要件定義と責任だけになるのかという声がある。

ほかに、Jevの上でTransformerを再現できるのかという疑問、入力に動画を渡せるようになれば用途が広がるという期待、便利な機能がClaude CodeやCodexに組み込まれるのを待つという反応が並ぶ。内容が難しいため驚き屋の多くは議論に加わっていないという指摘も付いている。

AI/LLMzenn.dev283 usersコメントを見る(新しいタブで開く)スコア 94興味マッチ度 3
2

LayerXのバクラク事業部が、Jevを題材に30分の社内勉強会を開いた報告。50人以上のエンジニアが参加し、サービスにJevを組み込むアイデアが50件を超えたという。

AI/LLMtech.layerx.co.jp269 usersコメントを見る(新しいタブで開く)スコア 91興味マッチ度 3
3

みのるん氏がconnpassで開いた勉強会「今話題のAI『Jev』って何? 宇宙最速で学ぶ会」のスライド。Jevの発表から3日後の開催で、仕組みと使いどころを整理している。

コメントの要約

Speaker Deckで公開された、みのるん氏の勉強会「今話題のAI『Jev』って何? 宇宙最速で学ぶ会」の資料。TypeSafe AIがJevを発表した3日後の9月18日に開かれ、はてなブックマークでは197ユーザーを集めている。

コメントでは、キャッチアップの速さに驚く声の一方で、精度がそこそこでよいなら既存の軽いNN分類器で足り自前で学習もできるという意見や、確信度90%で自信満々に間違うなら90%という数字自体が信用できなくなるという懸念が出ている。

仕組みについては、質問と一緒に選択肢を与える必要があり選択肢以外は答えないという説明や、埋め込みの距離を取れば既存モデルでも似たことができるので強みは埋め込みの作り方ではという見方、選択肢を渡すと音声との近さを返すソフトバンク(旧Vodafone)のJava向け音声認識ライブラリも同じ使い方だったという指摘がある。資料中の「問い合わせフォームを打っている途中で判定」という例が理解できないという批判も付いている。

AI/LLMspeakerdeck.com197 usersコメントを見る(新しいタブで開く)スコア 89興味マッチ度 3
4

ボリビアのアンデス山脈東斜面の雲霧林「ユンガス」で、ネコ科の新種 Leopardus tilcayo が見つかった。新種のネコの発見は100年以上ぶりで、体は一般的なイエネコより小さい。

コメントの要約

CNET Japanの記事で、ボリビアのアンデス山脈東斜面に広がる雲霧林「ユンガス」で、100年以上ぶりとなるネコ科の新種が見つかったと伝えている。オセロットやパンパスネコなど南北アメリカの小型ネコ科を含むLeopardus属に分類され、体は一般的なイエネコより小さい。Hacker Newsでも同じ発見を扱うNational Geographicの記事が169ポイントを集めている。

ブックマークコメントは「ネコなんてなんぼあってもいい」「かわいい」といった反応が中心で、学名の Leopardus tilcayo で画像検索すると丸い耳のネコが見られるという案内も付いている。

「ティルカヨ」を「マジカヨ」「知るかよ」にかけた言葉遊びが複数あり、日本のヤマネコはLeopardus属ではなくPrionailurus属だという補足も書き込まれている。

科学japan.cnet.com192 usersコメントを見る(新しいタブで開く)スコア 86
5

家電Watchの電動アシスト自転車の連載で、空気入れをワンタッチにするクリックバルブに、所有する自転車をすべて対応させた体験を紹介している。

コメントの要約

家電Watchの電動アシスト自転車の連載記事で、空気入れの手間を減らすクリックバルブに、所有する自転車をすべて対応させた体験を紹介している。はてなブックマークでは116ユーザーを集めた。

コメントでは、仏式の自転車に付けて快適だったので妻の自転車と予備の英式バルブもクリックに替えたが高価だという利用者の報告や、対応チューブがまだ高いので値段がこなれたら替えたいという声がある。英式のまま気圧を気にしない人には虫ゴムのないスーパーバルブを勧める書き込みや、仏式はそこまで面倒ではなく、米式に替えたら良かったのでホイールごと移行するという人もいる。

一方で、ロードバイクの世界で話題になっていないのは理由があるのではという見方や、ガソリンスタンドで空気を入れられる米式より楽なのかという疑問、数分で終わる作業を短縮する意味が分からないという反応も出ている。

モビリティkaden.watch.impress.co.jp116 usersコメントを見る(新しいタブで開く)スコア 83
6

Uberで2人前の寿司を頼んで1人前のセットが届き、領収書を送っても返金対象外とされたという投稿のまとめ。消費者センターへの相談後にUberから連絡が来ることになった。

コメントの要約

Togetterのまとめで、Uberで2人前の寿司を注文したのに1人前のセットが届き、料金は2人前分支払って領収書も送ったが、Uberの担当者から返金対象外と言われたという投稿を扱っている。投稿者は消費者センターに電話し、Uber側から連絡が来ることになったと書いている。

コメントでは、トラブルになりたくないのでUberもメルカリも使わないという声や、マクドナルドのポテトのサイズ違いではすぐ500円分のポイントがもらえたので対応が厳しくなったのかという疑問がある。Uberと交渉するより店に連絡すべきで、到着直後に「商品が破損していた」を選ぶと返金されるという助言も付いている。

受け取り側が嘘をつくケースが多いため性悪説で対応しているのだろうという見方や、自前で配達する店だけを使っているという声、実は1人前を2パック頼んで1つが届かなかったのではという推測、この種の話には飽きたという反応も並ぶ。

togetter.com73 usersコメントを見る(新しいタブで開く)スコア 82
7

Qwen3.8-27Bをベースに3値量子化で約9分の1に圧縮し、元の性能の98.2%を維持したとするDense型のマルチモーダルモデル「Ternary Bonsai 2 27B」をPC Watchが報じた。

コメントの要約

PC Watchのニュースで、Qwen3.8-27Bをベースに3値量子化で約9分の1に圧縮したDense型のマルチモーダルモデル「Ternary Bonsai 2 27B」を紹介している。圧縮後も元のモデルの98.2%の性能を維持しているという。

コメントでは、さっそく試したところ軽快に動いて感動し、自作ゲームに内蔵するAIとして最もましな候補になりそうだが、完璧ではないのでまだリリースはできないという報告がある。DGX Sparkを買う必要がなくなったという声がある一方、専用のllama.cppが必要なのでまだ試せていないという人もいる。

ほかに、日本語の性能を尋ねる声や、本当ならすごいがすぐには試せないという反応、DeepSeek-V4.1-Flashのようなもっと大きなモデルでも同じ圧縮をしてほしいという要望、そのうち数メガバイトまで小さくならないかという冗談が書き込まれている。

AI/LLMpc.watch.impress.co.jp90 usersコメントを見る(新しいタブで開く)スコア 81興味マッチ度 3
8

DeepSeek v4.1の推論エンジンを高速化する過程で得た知見から、v4.1 Flashに至るアーキテクチャ上の工夫を時系列で解説するshi3z氏のnote記事。1Mコンテキスト対応やFP4 KVなどを扱う。

コメントの要約

shi3z氏のnote記事で、オープンウェイトのDeepSeek v4.1の推論エンジンを高速化する作業を通じて詳しくなったというアーキテクチャを、v4.1 Flashに至るまでの進歩として時系列で解説している。コメントでの要約によると、1Mコンテキスト対応、FP4のKVキャッシュ、CED、SWA Replayまでを体系的に扱っている。

コメントには、最適化の作業からここまで内部構造を読み解いたことへの驚きや労いの声が多い。多様体に射影している限り固有値の絶対値が1を超えないことが数学的に保証される、という本文の一節を引用する人もいる。

100万トークンあればたいていのプログラムを丸呑みできるという記述に対して、業務のコードは1関数が10万行あることもあるので全部読んでほしいという声や、一般教養への対応は現状で十分で、今後は用途や業務ごとの専用AIを連携させたほうがリソース効率がよいという意見も出ている。

AI/LLMnote.com69 usersコメントを見る(新しいタブで開く)スコア 79興味マッチ度 3
9

小学館「サライ.jp」の記事挿絵で、委託先のイラストレーターが近年描かれた肖像画をChatGPTに読み込ませて出力・加工したものを納品していたとして、同サイトが著作権侵害を謝罪した。

コメントの要約

ITmediaの記事で、小学館「サライ.jp」の豪姫を取り上げた記事の挿絵が著作権侵害にあたるとして同サイトが謝罪した件を報じている。編集部は編集プロダクションを通じてフリーランスのイラストレーターに挿絵を発注しており、そのイラストレーターが既存の肖像画をChatGPTに読み込ませて出力し、加工して納品していた。

コメントでは、顔はかなり変わっているが着物の柄が元に近く盗用と言われても仕方ないという見方や、ポーズまで同じならばれるのは当然だという指摘がある。構図やポーズに著作権はないのではという疑問に対しては、歴史上の人物でも元の肖像画が近年描かれたものだったという整理が付いている。

こうしたimage to imageの不正がAI全体の評判を下げ、生成AIを嫌う人の多くはAIをこういうものと認識しているのではという声や、プロのイラストレーターがばれないと思ったのかという反応も出ている。

AI/社会itmedia.co.jp45 usersコメントを見る(新しいタブで開く)スコア 73興味マッチ度 2
10

Unicode 18.0が公開され、秦代の小篆や女真文字など13,007文字が追加されて収録文字数は172,808文字になった。新しい絵文字は9種。

コメントの要約

窓の杜のニュースで、Unicode 18.0のリリースを伝えている。13,007文字が追加されて収録文字数の総計は172,808文字になり、最大の追加は11,328文字の表意文字からなる秦代の「小篆」で、女真文字も加わった。新しい絵文字は9種類。

コメントでは、小篆がフォントでの対応ではなく独立した文字として収録されたことへの反応や、世界史の教科書を作りやすくなる、泰山刻石の臨書がはかどるといった声がある。ちょうど女真文字が使いたかったと冗談めかした書き込みや、新しい絵文字の「ひび割れた顔」から吹き飛ぶおじさんを連想したという反応も並ぶ。

古代文字の追加に加えて、表示されない異体字セレクタの悪用への対策が入っている点を今風だとする指摘も付いている。

標準forest.watch.impress.co.jp36 usersコメントを見る(新しいタブで開く)スコア 70

Zenn

10件3件
1

Jevを一晩試した実験記録。チェスでClaude 5 Sonnetに5戦全勝、eslintのエミュレーションで正答率86%などの結果と、256問を同時に評価できる並列度が真価だという見立てを示している。

記事の要約

TypeSafe AIのJevを一晩試した実験ログと考察。公式クックブックの追試、チェス対戦(Claude 5 Sonnetに5戦全勝)、MOBA風ゲームのリアルタイム操作、ルール名とコードだけでLint結果を答えさせるeslintのエミュレーション(正答率86%)、Playwrightでの購入操作を試した。ブラウザ操作は単独ではエラーから復旧できず、Claudeにログを監視させて96%以上の精度になった。

MOBA風ゲーム1戦が$0.0001で出力は無料、1リクエストは約500msで、モデル単体の性能が特別高いわけではなく、256問を同時に投げられる並列度が真価だという。confidenceは0.96以上ならほぼ確信、0.4以下は誤りの可能性が高く別モデルへのフォールバックの目安になる。

「既存の250倍以上高速」は256個のChoiceを同時に投げられることを指すとみており、19x19の囲碁盤面は枝刈りしないと渡せないため、設計時に選択肢を絞ることが重要だとしている。

ハイライトAI/LLMzenn.devいいね250 / ブクマ51スコア 91興味マッチ度 3
2

選択肢の最初の1トークンのlogitを比較し、KVキャッシュとバッチ推論を組み合わせれば既存LLMでもJev的な判断を再現できると示した検証記事。Gemma3 270MでJSON出力比77倍の高速化を報告している。

記事の要約

Jevの公式デモを見て「既存のLLMでもできるのでは」と考えた筆者の検証記事。回答候補を単一トークンに割り当てて回答位置のlogitだけを見れば1回のforward passで判断を取り出せ、独立した質問はバッチ推論、共通のプレフィックスはKVキャッシュの再利用で処理し、JSONはコード側で組み立てればよいとする。

Gemma3 270Mでこの方式とJSON出力を比べると77倍速くなった。公開ハーネスを使ったマリオの比較では、自環境のJevは公開デモの約3倍のレイテンシで振るわなかったが、同じ環境のLLMよりは良い結果だった。DOOMのデモは画像入力に非対応のため、ゲーム状態を構造化データに変換するハーネス経由だと推測している。

ただし比較できたのはlogitを取得できる旧世代の非推論モデルが中心で、最新のLLMより優れているとは言い切れないとし、Jevを「既存LLMではできないことを実現した」と捉えるのは違うとまとめている。

AI/LLMzenn.devいいね145 / ブクマ29既出スコア 84興味マッチ度 3
3

画面同士が互いの状態を直接操作する構造がバイブコーディングでGUIを壊す原因だとし、階層構造、MVPのPassive View、Chain of Responsibility、Mediatorを指定する対策プロンプトを示す記事。

記事の要約

macOS常駐のAIアシスタント「CooSenpAI」をClaude Fable 5.1とGPT 6 Astraでバイブコーディングしていた筆者が、機能が増えるにつれGUIが壊れていった経緯と対策をまとめた。キーの連打で画面が反応しなくなる、送信中の再呼び出しで出るべき画面が出ないといった不具合は、AIに修正を頼んでも直らなかった。

原因は各画面が自分で表示・非表示を決め、隣の画面を直接操作していたことで、衝突を防ぐ待ち時間や再試行が場当たり的に積み重なっていた。元ゲームクライアントプログラマの筆者は、イベントを1か所に集めて状態遷移を管理するゲームUIの定石はWebほど公開されておらず、AIの学習データにも少ないと説明する。

対策として、全コンポーネントをRoot配下の階層に置いてMVPのPassive Viewとし、動作はChain of Responsibilityでバブリングさせ、ステートマシンとして振る舞うMediatorに裁定させる指示文をそのまま渡す方法を示している。

AI/開発zenn.devいいね198 / ブクマ105既出スコア 84興味マッチ度 3
4

JevでClaude CodeのAuto Mode相当の許可判断をCodexに実装するなど、決定論寄りのガードレールをほぼ無料・高速で組む実験記事。Vercel AI GatewayやCloudflareでの利用方法も記している。

記事の要約

Jevは状態と質問を受け取り、型付きの回答を確率付きで返すモデルで、入力はGPT 5.6 Lunaより約8割安く出力は無料、超高速なif文APIのように使える汎用分類器だと紹介する記事。みのるん氏のイベントとSoftware Design 2026年10月号の宣伝を兼ねている。

利用手段として、TypeSafe AIのwaitlist(筆者は9月17日18時に登録して約10時間後に届いた)、Vercel AI Gateway、翌朝から使えるようになったCloudflareを挙げている。

本題では、Skillsのような確率的な改善は局所最適になりやすく新モデルで負債化するため、決定論的なガードレールが求められているとする。1例目として、許可判断をclassifierに任せて危険な操作だけ止めるClaude CodeのAuto ModeをCodexのHookとJevで再現した。BunとVercel SDKで作ったサンプルは高速に動き、性能の支配項がレイテンシやタイムアウトになるほどだという。

AI/開発zenn.devいいね78 / ブクマ27スコア 81興味マッチ度 3
5

自社CMS「Orizm」のReact製デザインエディターにWebMCPの命令型APIでツールを登録し、Codexのブラウザ操作によるページ編集をWebMCPの有無で比べた記事。

記事の要約

自社CMS「Orizm」のデザインエディターに、AIエージェントから操作できるWebMCPを社内向けに実験実装した記事。WebMCPはWebページ側がAI向けのツールをブラウザ上に登録する仕組みで、ログイン状態や保存前の画面上のデータをそのまま扱える点がサーバー側のMCPとの違いだと説明する。

定義方法には、form要素にtoolnameなどの属性を付ける宣言型と、document.modelContext.registerToolで関数を登録する命令型があり、React製のエディターには命令型を採用した。WebMCPは2026年9月時点でW3Cのコミュニティグループで議論中の提案仕様で、Chromeではフラグ付きプレビューとオリジントライアルの段階にある。

検証にはCodexのブラウザ操作を使った。WebMCPなしでは、Codexがドロワーを開いてブロックの設定値を1つずつ読み取り、モーダルからブロックを挿入して入力欄を編集するという、人間と同じ手順で操作していた。

AI/Webzenn.devいいね86 / ブクマ44既出スコア 81興味マッチ度 3
6

ルールベースの五目並べを実装してJev同士を対戦させ、遅延とログを実測した記事。その局面で取り得る手だけをChoiceの選択肢として渡すリクエスト例を示している。

記事の要約

Jevの速度を実測するため、ルールベースの五目並べを実装してJev同士を対戦させた速報記事。Jevは出力を意図的に限定して精度と速度を得るモデルで、できるのはYES/NOを答えるNoul、選択肢から選ぶChoice、点数を付けるScoreの3つだけであり、チャットAIと違って構造の制約をどう設計するかが肝になるとしている。

リクエストでは、盤面サイズ、ルール、表記法、アスキーの盤面、直近の手をstateに入れ、questionsのChoiceにはその時点で取り得る手だけを、自分と相手の最長ラインの情報を添えて並べる。候補の絞り方にはチューニングの余地があるという。

対戦ログには手ごとの経過時間と確信度が記録されており、初手は603ms、confidenceは1だった。筆者は冒頭で、プログラマは既存のチャットアシスタントよりJevのような構造化されたエージェントを好むだろうという感想を述べている。

AI/LLMzenn.devいいね77 / ブクマ6既出スコア 73興味マッチ度 3
7

17万行のプロダクトのレビューでトークンを使わないよう、GeForce 3060(12GB)上のOllamaでqwen2.5-coder:14bを差分レビュー専用のモデルに仕立てた記事。

記事の要約

Claude Code、Codex、Agyを併用して17万行のプロダクトを1人で開発する筆者が、生成コードのレビューでもトークンを消費する問題に対してローカルLLMを試した記事。GeForce 3060(12GB)のPCで、Ollamaからqwen2.5-coder:14bを取得した。

ステージされたdiffから重大な問題候補だけを挙げさせるModelfileを作成した。temperatureは0.05、num_ctxは8192とし、システムプロンプトで検出対象をデータ損失、セキュリティ境界、Electron IPC境界、競合状態、off-by-oneなどに絞り、スタイルや命名の指摘、要約、褒め言葉を禁じている。

出力はseverity、file、issue、impact、solution、confidenceを持つJSON配列のみとし、PowerShellスクリプトから呼び出す。結論は「今のところ良い感じに回っている」で、続報記事へのリンクがある。

AI/開発zenn.devいいね78 / ブクマ43既出スコア 73興味マッチ度 3
8

PKSHA VoiceAgentのSREが、dbtとLightdashのセマンティックレイヤーをMCPサーバ経由でAIから引ける分析基盤「Laplace」を1人・約1か月で構築した記事。コードはほぼClaude Codeが書いた。

記事の要約

PKSHA VoiceAgentでは、RedashからAuroraのリードレプリカに直接SQLを投げていたため、最大約2.5TBのログテーブルに対して重いクエリが返らない、集計のたびにエンジニアへの依頼が要る、PIIの有無で権限を分けられずアクセスを絞るしかない、という3つの課題を抱えていた。

新基盤「Laplace」では、dbtのschema.ymlを唯一の定義源とするセマンティックレイヤーをLightdashで構築し、そのAPIを包むMCPサーバでAIクライアントから自然言語で同じ指標を引けるようにした。PII列は専用テーブルに隔離し、承認を得た人にだけ期限付きで権限を付与して監査ログで追い、AI経由でもPIIの値はLLMに返さない。

設定ファイル1枚でプロダクトを追加できる構成で、設計と実装は筆者1人、SQLを含むほぼすべてのコードをClaude Codeが書き、着手から公開まで約1か月。OSSのLightdashをセルフホストし、運用費はクラウド利用料の月1,200ドル前後だという。

AI/データzenn.devいいね42 / ブクマ15スコア 68興味マッチ度 2
9

Issueの把握から実装、Codexとcritによるレビュー、動作確認、PR作成までを、Claude Codeのユーザーレベルのスキル「todays-work」にまとめた記事。スキルの本文を公開している。

記事の要約

GitHubのIssueを取り、AIに設計と実装を任せ、別のAIにレビューさせ、動作確認してPRを作るという毎日の流れを、Claude Codeのスキルとして自動化した記事。Claude Codeが設計・実装と外部とのやり取りを担い、Codexはレビューのみ、人間のレビューにはcritを使うクロスレビューの構成をとる。

スキルは~/.claude/skills/にユーザーレベルで置き、どのリポジトリからでも呼べるよう汎用化した。名前はtodays-workで、disable-model-invocationを有効にして/todays-workで明示的に呼んだときだけ動き、引数にIssueの番号かURLを取る。

手順はIssueの把握、ブランチ作成、必要な場合の実装計画、実装、動作確認、critとCodexへの同時レビュー依頼、レビュー対応、PR作成、後片付けの9段階。途中の記録はリポジトリに入れず~/.claude/todays-work/配下に置き、最後に削除する。

AI/開発zenn.devいいね58 / ブクマ24既出スコア 66興味マッチ度 3
10

Lambdaの関数タイムアウトが最大90分に拡張された条件(Lambda Managed Instances上で、非同期呼び出しかESM経由)を、CDKで環境を組んで検証した記事。

記事の要約

2026年9月にAWS Lambdaの関数タイムアウトが15分から最大90分(5,400秒)に拡張されたが、対象はLambda Managed Instances(LMI)上の関数で、非同期呼び出しかSQS・Kinesis・DynamoDB StreamsのESM経由の場合に限られる。同期呼び出し、Amazon MQ・DocumentDBのESM、Initフェーズは15分のまま。

LMIは自アカウントのEC2上でLambdaを動かす実行モードで、アウトバウンド経路が必須、メモリは最低2,048MB、バージョン発行が必須、実行環境がデフォルトで3つ維持されてゼロスケールしないといった前提があり、タイムアウト値の変更だけでは済まない。

筆者はCDKで、20分スリープする関数の非同期呼び出し、S3のPutObjectトリガー、durable functionsと組み合わせた計100分の実行を検証し、S3トリガーの重い変換処理を1関数で組めることを実測で確認したとしている。

クラウドzenn.devいいね34 / ブクマ6既出スコア 60

Qiita

10件4件
1

問い合わせメールの処理を例に、LLMとAIエージェント(Amazon Bedrock AgentCore)の組み合わせと、Jevと通常のアプリケーションの組み合わせで役割がどう違うかを整理した記事。

記事の要約

Jevを、文章や業務データを読み取って分類・採点・条件判定の結果を確率付きで返すモデルと紹介し、既存技術を置き換えるかのような盛り上がりに対して違いを整理する記事。TypeSafe AIが2026年9月15日にSystem One Modelの最初の公開モデルとして発表し、System Oneはカーネマンの「システム1」、Jevの名は経済学者ジェヴォンズに由来することを押さえている。

二重請求の返金を求める問い合わせメールを例に、Amazon Bedrock AgentCoreなどのLLMとAIエージェントでは、LLMが注文情報の取得、二重請求の判断、返金規程の確認、返信文の作成といったツールと手順を選ぶ。Jevでは、事前に定義した「問い合わせの種類」の選択肢や「返金要求があるか」といった質問ごとに確率が返る。

筆者はJevに期待する役割を「処理のルーティング役」とし、プログラムは返った数値を従来の比較演算で評価して呼び出すツールを決めるだけだと説明している。

AI/LLMqiita.comLGTM154 / ストック65既出スコア 89興味マッチ度 3
2

AI活用の差は使っているかどうかではなく「仕事を全部任せられないか」から考えるかどうかにある、とするPRUM代表の記事。会議で詰まったときの「5分AIタイム」や音声入力も挙げている。

記事の要約

元Yahooエンジニアで株式会社PRUM代表の岩本氏が、AIを使いこなす人とそうでない人の差を論じた記事。仕事を1〜10に分けたとき、一部だけAIに任せる人は1しか変わらない一方、全部任せられないかから考えて削っていく人は、思ったより多くの部分を任せられることに気づくと述べている。

実践例として、会議で議論が行き詰まったら「5分AIタイム」としてその場でAIに相談していること、状況をタイピングせずに音声入力で渡していることを挙げる。

一方で、AIの助言をバスケットボールのコーチの作戦にたとえ、シュートを打つかどうかを決めるのは選手自身であり、判断の最終的な責任は自分が負うとしている。まとめとして「一部ではなく全部から考える」「タイピングより先に音声で喋る」「聞いて終わりにせず自分で決めて動く」の3つを行動指針に挙げている。

キャリアqiita.comLGTM35 / ストック3スコア 88興味マッチ度 2
3

AIでエンジニアのスキルが均一化するとして、PRUM代表が採用の最終判断ではスキルより人間力、当事者意識、実直さの3点を見ていると述べる記事。

記事の要約

PRUM代表の岩本氏が、AIによってエンジニアのスキルは均一化し、1年目の人のコード、AIを使って作ったコード、ベテランのコードの差はほとんどなくなっていくとして、採用の最終判断ではスキルをほとんど見ていないと述べる記事。見ているのは3つだけだという。

1つ目は「一緒に働きたい」と思えるかという人間力で、産業革命が人間をパワーから、AI革命がスキルから解放するという見立てを示し、態度やマナー、反省のない遅刻、「この会社は自分に何をしてくれるのか」というスタンスはその場で不採用にするとしている。2つ目は会社を一緒に作ろうとする当事者意識、3つ目は言われたことを素直に受け止めてコツコツ取り組む実直さで、これが成長に最も重要な要素だという。

スキルは後からAIの力を借りてでも上げられるが、この3つはなかなか変わらないため最初に見ていると説明し、PRUMのエンジニアの95%以上は未経験からの採用だとしている。

キャリアqiita.comLGTM61 / ストック16既出スコア 81興味マッチ度 2
4

Claude Codeの権限設定でdenyにWrite(パス)だけを書いても書き込みは止まらず、Edit(パス)ならWriteツールでの新規作成やBashのリダイレクトまで止まることを36回の試行で確かめた検証記事。

記事の要約

Claude Code 2.1.275(2026-09-17)のchangelogに、/update-configがファイル権限の検査に一致しないWrite(path)ルールを書いていた不具合の修正が載ったことを受け、denyルールの効き方を検証した記事。2.1.273と2.1.275を隔離して導入し、claude -pで測定した。

-pでは拒否と確認待ちが区別できないため、--permission-mode acceptEditsで、ルールが効いていれば止まり効いていなければ自動承認で書き込まれる状態にした。Write()のみ、Edit()のみ、両方の3種のルールを、Editツールでの書き換え、Writeツールでの新規作成、Bashのリダイレクトの3経路で2バージョン各2回、計36回試した。

Write()のみでは全経路で書き込まれて拒否イベントも出ず、Edit()を含むルールでは全経路で止まった。2バージョンで結果は同じで、2.1.275で直ったのはルールを書く側だけだとしている。

ハイライトAI/開発qiita.comLGTM18 / ストック15スコア 79興味マッチ度 3
5

Jevを記述式とマークシートの違いにたとえ、stateとquestionsの入出力、Choice・Score・Noulの3つの問いの型、公称の速さと料金を整理した解説記事。

記事の要約

Jevは文章で書かれた状況を読み、あらかじめ用意した選択肢のどれに当たるかを確率付きで返すモデルで、LLMより任せられる範囲は狭いが、答えを文章として書かない分だけ速く安いと整理する記事。公称値は応答70〜500ミリ秒、入力100万トークンあたり0.042ドル、出力は無料で、文章の生成、計算、日付の比較は公式が不得意と明記しているという。

LLMにJSONで答えさせる方式を答案を1トークンずつ書く記述式に、Jevをプログラム側が用意した欄ごとに確からしさを返すマークシートにたとえる。用意していない選択肢が答えに出ることはなく、公式の「型エラー0%」はこの枠からはみ出さないことを指し、選択肢の中での選び間違いは残ると補足している。

リクエストは判断対象の状況を表すstate(文字列かJSON)と型付きの問いquestionsからなり、問いの型は選択肢から1つを選ぶChoice、段階評価のScore、Yesの確率を返すNoulの3種類。複数の問いを1回の呼び出しで並列に評価できる。

AI/LLMqiita.comLGTM22 / ストック7スコア 78興味マッチ度 3
6

AIは局所的な問題解決に強いが、動くものを使い続けられるプロダクトにする設計や運用の判断は別の能力だとして、「AIがあればプログラマーはいらない」という見方の危うさを論じる記事。

記事の要約

ここでいうプログラマーには、何を作るかを考え、システムの境界を設計し、品質とリスクを判断して運用に責任を持つ人も含むとしたうえで、AIでアイデアを形にするまでの距離は縮まったが、それを運用に耐える状態にできるかは別の問題だと論じる記事。筆者のAI時代の技術選定や、AIが書いたコードを人間が検証できる技術で支えるという過去記事の続きにあたる。

障害時の原因追跡、データ増加時の性能、権限の異なるユーザー間の情報漏えい、仕様変更への耐性、依存先の変化への対応、新メンバーの理解といった問いは単一のコード片の正しさでは決まらず、動くものを作る力と使い続けられるものを設計する力は同じではないとする。

AIは既存の命名規則に沿ったページネーションの追加のような局所的な問題には強いが、検索条件との組み合わせでクエリが大量に発行されたり、キャッシュで権限変更後も古いデータが表示されたりする可能性までは保証しないと例を挙げ、依頼文に書かれていない要件の話に進んでいる。

キャリアqiita.comLGTM18 / ストック12既出スコア 71興味マッチ度 2
7

CLAUDE.mdに積み上がったルールを、必要な場面でだけ読む索引方式に置き換えて常駐コンテキストを減らした、KDDIアジャイル開発センターの記事。8月の実測値で効果を示している。

記事の要約

KDDIアジャイル開発センターの溝渕氏が、Claude Codeでの個人開発で精度を落とさずにトークン消費を抑えた仕組みを紹介する記事。定額プラン、プロンプトキャッシュ1時間TTLの環境で、8月のリクエストは34,125回、コンテキストに入れた1トークンは平均50.8回読み直され、キャッシュからの読み直しがコスト全体の65.5%を占めていた。

キャッシュ読み出しの単価は通常の0.1倍でもゼロではなく、常駐コンテキストはその後の全リクエストで読み直されるため、1トークン削れば月3万回以上の読み直しがなくなる最も削り甲斐のある場所だとする。決めごとが増えるたびにCLAUDE.mdへ書き足し、設計・運用文書は440万字に達していた。

解決策として、CLAUDE.mdのトリガー表、実装知識の索引、メモリの索引、Skillsの説明文だけを常駐させ、作業の種類やキーワード、条件に当てはまったときにClaudeが判断してリンク先のファイルを開く構成にした。

AI/開発qiita.comLGTM17 / ストック11既出スコア 70興味マッチ度 3
8

1万ファイル以上のアセットを1ファイルにまとめ、更新したアセットを常に末尾へ移す配置ルールで、任意の過去バージョンからの差分を1回のHTTP Range Requestで取れるようにした「Asset Ball」の設計記事。

記事の要約

大規模なUnity製ソーシャルゲームで、Android、iOS、Windows向けに1万ファイル以上のアセットを1つずつダウンロードしており、初回に約3時間かかっていた。ファイルごとのHTTPリクエストのオーバーヘッドが積み重なっていたうえ、Unityのバージョンアップなどで1万ファイル超の更新が頻繁に起き、起動頻度もユーザーごとに異なるため、初回だけZIPにまとめても解決しなかった。

そこで全アセットを連結した1つのバイナリ「Asset Ball」と、位置・サイズ・ハッシュを記録するIndex Fileを用意し、更新されていないアセットの相対順序を保ったまま、更新されたアセットを新しい内容で末尾に配置するルールを繰り返す。古いアセットは前方、新しいアセットは後方に集まり、どのバージョンからでも必要な差分が末尾にまとまる。

差分は1回のHTTP Range Requestで取得できる。初回ダウンロードは約3時間から約13分へ約14倍速くなり、サンプル実装もGitHubで公開されている。

ゲーム開発qiita.comLGTM14 / ストック8既出スコア 64
9

早期アクセス未取得のままAPIを呼ばず、公開SDKと公式ドキュメントの回答例だけで、LLMに任せていた分岐判定をJevに置き換える判断材料を整理した記事。公式ドキュメント同士の食い違いを2つ指摘している。

記事の要約

LLMにチケットの宛先部署を答えさせるたびに、JSONのパース、検証、再試行といった防御コードが判断そのものより長くなってきたという筆者の経験から、Jevに任せられる判断を検討する記事。早期アクセスが届いていないためAPIは呼ばず、公開SDKと公式ドキュメントの回答例だけを使って1コアのXeon環境で確かめられる範囲を確かめ、その過程で公式ドキュメント同士の食い違いを2つ見つけたという。

扱うのは3種類の質問形式とその選び方、confidenceの閾値を公式の定義に頼らず決める方法、被害の大きさに応じて自動実行・確認・人間対応を切り替えるコードで、内部構造や実APIでの速度・精度の実測は対象外としている。

LLMを自由に書ける記述式の受験者、Jevを印刷済みの選択肢を塗る濃さで自信を示すマークシートの受験者にたとえ、state、criteria、probabilities、confidenceをそれぞれ問題文、選択肢、塗りの濃さ、答案全体のメリハリに対応させて説明している。

AI/LLMqiita.comLGTM15 / ストック8既出スコア 62興味マッチ度 3
10

TypeSafe AIが「LLMではない新しいクラスのモデル」として発表したSystem One ModelsとJevを、創業者の経歴や並列サンプラー、型付き構造化出力といった設計要素から整理した記事。

記事の要約

2026年9月15日にTypeSafe AIが「LLMではない新しいクラスのモデル」としてSystem One Modelsと第1弾のJevを発表した内容を技術的に整理する記事。発表ブログは、チャットではモデルが何年も前から人間を超えているのに、なぜ自動化は進んでいないのかという問いから始まっている。

創業者兼CEOのDiogo Almeida氏は、OpenAIで2022年のInstructGPT論文を共著し、初代ChatGPTのクレジットにも名前がある人物で、チャット向けのモデルは十分賢いのに自動化に使うと扱いづらくなるという課題意識から、文字列生成を捨てたモデルを作ったとまとめている。現在は早期アクセスの段階。

アーキテクチャについては公式ブログをもとに、トークンを1つずつ生成せず定義済みの選択肢や確率を一括で計算する並列サンプラー、出力の型を事前にスキーマとして定義し、はみ出す出力が構造上発生しない型付き構造化出力、RLCDと呼ばれる学習手法を挙げている。

AI/LLMqiita.comLGTM11 / ストック2スコア 58興味マッチ度 3