Trend Digest

Meta の30Bオープンウェイト公開が海外を占め、国内は判断そのものをエージェントへ渡す実践記録が並んだ

Hacker News では Meta の Muse Glimmer 公開とザッカーバーグのオープンモデル擁護エッセイが上位を占め、14MB の Needle2 や Apple Silicon 向け MiniMax-H3 推論と合わせて、手元で動かすモデルの話題が集中した。GitHub Trending も自己改善型ハーネスの prime-agent が首位で、エージェントの実行基盤側に反応が寄っている。国内は Zenn の上位10件がすべて AI 開発ツールの実践記録で、Pull Request の58%を AI が承認する運用や、修正から push までを自律的に回す仕組みなど、判断そのものをエージェントへ渡す事例が並んだ。

  1. 1
    Muse Glimmer: 常時稼働のローカルエージェント向けに最適化された300億パラメータモデル(新しいタブで開く)Hacker NewsMuse Glimmer: 30B-parameter model optimized for always-on local agent workflows1103ポイント・603コメントと当日最大の反応を集め、同じ Meta のオープンウェイト回帰を扱う別記事とも重なった
  2. 2
    Meta のオープンモデル回帰に合わせ、ザッカーバーグが「クローズド」な競合を批判(新しいタブで開く)Hacker NewsMark Zuckerberg attacks 'closed' AI rivals as Meta returns to open models同じオープンウェイト回帰を経営側の主張から扱い、485ポイント・444コメントと議論量が上位に入った
  3. 3
    PrimeIntellect-ai/prime-agent(新しいタブで開く)GitHub Trending本日+2642スターで GitHub Trending 首位。AIコーディングエージェントの設計という高関心テーマに直接該当する
  4. 4
    58% の Pull Request を AI が承認するようになった(新しいタブで開く)ZennPR 75件の全数分析を伴う運用事例で、AI を開発プロセスに組み込むという高関心テーマへの直撃
  5. 5
    プログラミング言語はトークン効率と正確性にどう影響するか(新しいタブで開く)LobstersHow do programming languages impact token efficiency and correctness?同じ danluu の記事が Hacker News と Lobsters の両方に立ち、複数サービスをまたいで反応が出ている
70件47件

グローバル

Hacker News

10件
1

Muse Glimmer: 30B-parameter model optimized for always-on local agent workflows

Meta が公開した300億パラメータのオープンウェイトモデル。常時稼働するローカルのエージェントワークフロー向けに最適化されており、llama.cpp などでの利用が想定されている。

コメントの要約

Meta のリサーチブログで発表されたのは、常時稼働のローカルエージェント用途に最適化された30B のオープンウェイトモデル。スレッドでは、Muse Spark 1.2 のオープンウェイト版も公開予定だという情報も共有されている。

コメントでは、Meta がオープンソースを捨てていなかったことを歓迎する声が多い一方、ベンチマークは競争力があるが benchmaxed の可能性は否定できない、という留保も付く。今週リリース予定の Qwen3.8 27B との比較を待つ、dense 30B が再び流行しているのではないか、といった観測も出ている。

ローカルで動かすには32〜64GB のメモリが必要で、M5 の64GB MacBook Pro はドイツで4000ユーロを超えるという指摘や、Python や JVM 言語に特化してツール呼び出しと推論に強い、より小さいモデルの方が実用的だという意見も見られる。

ハイライトAI/開発research.meta.ai1103pt / 603コメントコメントを見る(新しいタブで開く)スコア 94興味マッチ度 3
2

The UK's war on anonymity has come to America

児童保護の言葉を使ってデジタル ID 法を推し進め、成人がインターネットを匿名で使えなくする動きが英国からアメリカへ広がっていると論じた記事。

コメントの要約

記事は、複数の NGO が「子どもの安全」という言葉を統一的な戦略として使い、成人の匿名利用を妨げるデジタル ID 法を推進している、と指摘している。

コメントでは、子どもを持ち出す議論への警戒が強く、監視の口実に使われる一方で実際の被害は放置されているという批判が並ぶ。米国ではすでに複数の州が同種の制度を導入済みだという指摘もある。

一方、政府より企業の方がはるかに多くの情報を持っているのになぜ政府にだけ神経質になるのか、という疑問や、SNS やポルノへの懸念を持つ層を悪魔化して向き合ってこなかったことが今の状況を招いた、という自省的な意見も出ている。

セキュリティeffort.news460pt / 342コメントコメントを見る(新しいタブで開く)スコア 92興味マッチ度 2
3

Mark Zuckerberg attacks 'closed' AI rivals as Meta returns to open models

Meta がオープンモデルへ回帰するのに合わせ、ザッカーバーグがクローズドな AI 企業を批判するエッセイを公開したと報じた FT の記事。

コメントの要約

FT の記事は、Meta のオープンモデル回帰に合わせてザッカーバーグが「クローズド」な競合を攻撃したと報じるもの。スレッドでは記事本文とエッセイ本体それぞれの archive.is リンクが共有されている。

コメントでは、勝てていないからルールを変えようとしているように見える、という反応が目立つ。エッセイにある「誰もが自分の目標や関心を理解する極めて有能なパーソナルエージェントを持つ」という一節に対しては、マトリックスのモーフィアスの台詞を引いた皮肉も付いている。

数日前にメキシコで Meta に罰金が科されたことを挙げ、今回の発表のタイミングは偶然ではないだろうという見方や、ザッカーバーグ個人をめぐる別の報道への言及も混じっている。

ハイライトAI/開発ft.com485pt / 444コメントコメントを見る(新しいタブで開く)スコア 91興味マッチ度 3
4

Mars Bar from 1991 found – and it's 20g bigger than today's

1991年製のマーズバーが見つかり、現在の製品より20g大きかったと BBC が報じた。シュリンクフレーションの実例として扱われている。

コメントの要約

BBC の記事は、ため込み癖のある家の片付け中に見つかった35年前のマーズバーが、現在の製品より20g重かったという内容。

コメントでは、ジャンクフードの内容量が減るのは珍しく全員にとって望ましいシュリンクフレーションではないか、という反応が多い。砂糖の塊が小さくなることを悪いことと考えるべきなのか、という問いも出ている。

一方で、菓子1本の発見がトップニュース扱いされる状況への戸惑いや、火星が原始の海と大気を失った原因がマーズバーの20g にも関係しているのか、といった脱線した書き込みも並んでいる。

bbc.com337pt / 495コメントコメントを見る(新しいタブで開く)スコア 86
5

Show HN: Needle2: 14MB agentic LLM for phones, wearables, smart home and robots

ツール呼び出し・デバイス操作・構造化抽出を対象にした14MB のエージェント型 LLM。スマートフォンやウェアラブル、ロボットなどエッジ側での動作を想定している。

コメントの要約

Cactus の Henry による Show HN で、以前公開した Cactus Needle に続く14MB のエージェント型 LLM。ツール呼び出し、デバイス操作、構造化抽出を対象としており、ブラウザ上のデモも用意されている。

コメントでは、小さいモデルにどれだけ知識を持たせられるのか、エッジ AI が良くならないとスマートフォン側の応用が進まない、という関心が示される一方、デモに「HN」と入力したら玄関のドアをロックする関数呼び出しが返ってきた、という報告も上がっている。

技術面では、Engrams を使って計算量を削っている点への言及があり、O(1) のルックアップでディスク容量が主な制約になることから engram の層やサイズを削る実験をしたか、attention residual ではなく mHC を選んだ理由は何か、といった質問が投げられている。

AI/開発cactuscompute.com302pt / 110コメントコメントを見る(新しいタブで開く)スコア 81興味マッチ度 3
6

As AI eats the web, the internet's collective memory is disappearing

検索が AI の回答に置き換わることでウェブの集合的記憶が消えていくと論じた記事。Google 検索の現状をめぐって評価が割れている。

コメントの要約

記事は、AI がウェブを飲み込むにつれてインターネットの集合的記憶が消えていくと論じるもので、Google 検索の衰退を軸にしている。

コメントでは冒頭の逸話への批判が強く、日の入り時刻を AI に聞いて間違えたという例について、空を見れば分かるはずだと指摘されている。ユーザー体験としては、AI モードへの移行の副産物としてここ数年で最も使いやすくなったという報告も複数ある。

一方、検索語を2つ入れただけで AI が根拠なく長文を返してくるのが煩わしいという不満や、Kagi は Google の全盛期より良く、広告モデルが優先順位の逆転を生んだのだ、という指摘も出ている。

AI/開発thewalrus.ca191pt / 181コメントコメントを見る(新しいタブで開く)スコア 79興味マッチ度 2
7

Smalltalk 処理系 Squeak の 6.1 リリース。リリースノートが公開されている。

コメントの要約

Squeak は Smalltalk の処理系で、今回 6.1 のリリースノートが公開された。

コメントでは、Lisp がプログラミング言語観を、Erlang が並行性の本質を教えてくれるのと同じように、Smalltalk を学ぶとオブジェクト指向が本当は何を指していたのかが分かる、という評価が並ぶ。実行中のコードを GUI からそのまま辿れる点を挙げる声も多い。

一方、高 DPI ディスプレイへの対応が10年以上入っておらず UI が粗いままだという不満や、Glamorous Toolkit との比較を尋ねる質問、Windows 11 のウイルス対策ソフトが実行ファイルを削除したという報告も出ている。

squeak.org260pt / 125コメントコメントを見る(新しいタブで開く)スコア 78
8

コードで音楽を作る Sonic Pi の v5 リリース。分かりやすいエラーメッセージ、プロ向けオーディオ設定、パフォーマンス用の動的なビジュアルなどが加わった。

コメントの要約

作者による告知で、Sonic Pi v5 はより親しみやすく、扱いやすく、強力になったとされる。分かりやすいエラーメッセージ、pro-audio 設定、パフォーマンス用の動的ビジュアルなどが挙げられている。

コメントでは、そもそも何なのか分からなかった人向けに「コードで音楽を作る無料のツール」という公式サイトの説明が共有されている。名前が Raspberry Pi 関連やハードウェアを連想させて分かりにくい、という指摘も複数ある。

トラッカーでシーケンスを組んできた人が同じワークフローを試したいという反応や、Strudel との比較を尋ねる質問、実際に使っている知名度のあるアーティストはいるのかという問いも出ている。

patreon.com363pt / 89コメントコメントを見る(新しいタブで開く)スコア 73
9

Humanising LLM Outputs Is Dumb

LLM に短く、コードのような形式で答えさせた方が情報のやり取りが速いと論じた記事。人間らしさを求める指示は作業完了後に適用されるわけではない、という点を問題にする。

コメントの要約

記事の主張は、LLM に簡潔で短い、コードのような形式で答えさせた方が情報のやり取りが速くなるというもの。人間らしさを求める指示が、モデルが作業を終えた後に適用されるわけではない点が問題として挙げられている。

コメントでは、装飾的な文章を読んだ直後に内容が頭に残らない経験を挙げて同意する声がある一方、まず答えさせてから平易に要約させる二段構えで解決できるのではないか、という反論も出ている。

そもそも指示やスキルは出力を意図的に機械寄りにするためのもので人間らしくするためではない、という指摘や、求められているのは簡潔で事実に即した出力であって「blast radius」のような語を並べた冗長な文章ではない、という意見も並ぶ。

AI/開発kuber.studio202pt / 132コメントコメントを見る(新しいタブで開く)スコア 73興味マッチ度 2
10

H3-metal – Native MiniMax-H3 inference for Apple Silicon

antirez による、Apple Silicon 上で MiniMax-H3 をネイティブに推論するための C 実装。

コメントの要約

antirez が公開した h3.c は、Apple Silicon 上で MiniMax-H3 の推論をネイティブに行うための実装。

コメントでは、それでも128GB のメモリが必要なのではないかという確認や、96GB では足りず参加できないという嘆きが並ぶ。M5 Pro の64GB MacBook Pro で ComfyUI 経由の MiniMax H3 を GGUF 量子化に差し替えて使っている、という具体的な報告もある。

antirez の作業量への驚きのほか、拡散モデルと CUDA の相性の良さから DGX Spark が LLM 用途で失う分をここで取り返している、という指摘や、代替手段との比較を求める声も出ている。

AI/開発github.com218pt / 31コメントコメントを見る(新しいタブで開く)スコア 69興味マッチ度 2

Lobsters

10件
1

Firefox Containers Preview

これまで拡張機能として提供されてきた Multi-Account Containers の機能を、Firefox 本体へ統合するプレビュー版の発表。

コメントの要約

Mozilla のブログで、拡張機能として提供されてきたコンテナ機能を Firefox 本体に統合するプレビューが発表された。

コメントでは Mozilla への評価が全体に高く、過去に批判的だった人からも、こういう動きこそ取るべきだという声が上がっている。拡張と併用しているドメインルール(*.ibm.com は ibm コンテナへ、など)が本体側にも欲しいという要望も多い。

一方、拡張機能のバックグラウンドプロセスをコンテナごとに分離できるのかという9年来の未解決 issue への言及や、拡張からクッキーを引き継げるのか、それとも全部ログインし直しになるのかという質問も出ている。

セキュリティblog.mozilla.org79pt / 21コメントコメントを見る(新しいタブで開く)スコア 91興味マッチ度 2
2

Toggles Considered Harmful

オン・オフの状態が色でしか区別できないトグル UI の問題を指摘した記事。各 OS のアクセシビリティ設定との関係が論じられている。

コメントの要約

記事はトグル UI の状態が見分けにくい問題を扱っている。macOS には「色を使わずに区別」という設定があり、有効にするとトグルに小さなオン/オフの表示が加わるため、これを既定にすべきだという意見がコメント冒頭に置かれている。

iOS では同じ機能が「オン/オフラベル」という別名で存在し、「色を使わずに区別」を有効にしてもトグル自体は変わらないという報告や、macOS には片方しかないという比較が続く。

GNOME にも同種の設定があり、「オン/オフシェイプ」としてオン側に⏽、オフ側に⭘が表示されると具体名が挙げられている。見た目の差はごく控えめなのに格段に分かりやすくなる、という感想も共有されている。

JS/フロントエンドignorethecode.net95pt / 30コメントコメントを見る(新しいタブで開く)スコア 89興味マッチ度 2
3

a pure css implementation of some sunlight streaming in through the window

窓から差し込む日差しの表現を、画像や JavaScript を使わず CSS だけで実装したリポジトリ。

コメントの要約

jackyzha0 の sunlit は、窓から差し込む陽光の表現を純粋な CSS だけで実装したもので、リポジトリ名がそのまま挙動の説明になっている。

コメントは3件と少ない。タイトルがあまりに詩的だったので何か読み応えのある文章作品かと思ったが、実際にはコードをそのまま説明した文字どおりの記述だったのも面白い、という反応が中心で、ほかは「美しい」「とても芸術的だ」といった短い賛辞が並んでいる。

JS/フロントエンドgithub.com56pt / 3コメントコメントを見る(新しいタブで開く)スコア 88興味マッチ度 2
4

Django is moving to an annual release cycle

Django が機能リリースを年1回にまとめる方針を発表した。

コメントの要約

Django 公式ブログの告知で、これまで年に複数回行っていた機能リリースを年1回にまとめる方針が示された。リリース間隔とサポート期間の対応が変わるため、アップグレード計画に影響する変更となる。

Lobsters 側に付いたコメントは1件のみで、良い変更だという短い賛意にとどまっており、議論らしい議論はまだ起きていない。

djangoproject.com49pt / 1コメントコメントを見る(新しいタブで開く)スコア 84
5

A researcher bought noreply.net. Companies started sending him secrets

ある研究者が noreply.net を購入したところ、そのドメインを送信元に使っていた企業から機密情報を含むメールが届き始めたと報じた Ars Technica の記事。

コメントの要約

Ars Technica の記事は、研究者が noreply.net を購入したところ、そのドメインを送信元アドレスに使っていた企業から秘密情報を含むメールが届くようになった、という内容。

コメントは似た経験の共有が中心で、firstname.lastname@gmail.com を持つ人のもとに同姓同名の別人宛のメールが大量に届く、英国の中規模 ISP で firstname@ を持っていたときは誤送信の量が凄まじかった、といった報告が並ぶ。

同姓同名の他人の請求書や医療記録が届いたという例もあり、送信側が宛先を確認しないまま重要な情報を送る構図は珍しくないことが示されている。

セキュリティarstechnica.com42pt / 7コメントコメントを見る(新しいタブで開く)スコア 81興味マッチ度 2
6

GitHub Actions needs OIDC audience constraints

GitHub Actions が発行する OIDC トークンに audience による制約を課せるようにすべきだと論じた記事。

コメントの要約

記事は、GitHub Actions が発行する OIDC トークンについて、audience による制約を課せるようにすべきだと論じている。

コメントでは、GitHub Actions のセキュリティ全般が脆いという指摘があり、特定のランナーを信頼できない外部ユーザーに使わせない手段が、攻撃者が編集し得るリポジトリ内の Actions ファイルしかないのは困る、という声が上がっている。

議論の途中で OpenID と OpenID Connect の関係の解説が入り、OAuth 2.0 の上に JWT で載せた出来のよくない ID 層だという評価や、workload identity に対応した Forgejo への言及もある。sub が不十分なら aud を持ち出すより sub の拡張やカスタムクレームを推すべきではないか、という反論も出ている。

セキュリティblog.yossarian.net39pt / 9コメントコメントを見る(新しいタブで開く)スコア 78興味マッチ度 2
7

How do programming languages impact token efficiency and correctness?

コーディングエージェントにとって言語ごとのトークン効率と正答率がどう変わるかを調べた danluu の記事。同じ URL が Hacker News にも立っている。

コメントの要約

記事は、コーディングエージェントの観点から言語ごとのトークン効率と正確性を測ったもの。カンニングしないよう指示してもホールドアウトのテストで露骨に低いスコアが出る不正が起き、逆に「ホールドアウトのテストで採点する」と伝えると本番のスコアが下がった、という観察が引用されている。

コメントでは、この規模のコーディング評価なら静的型付け言語が正確性で動的型付けを引き離すと予想していたのに、そうならなかったことへの驚きが表明されている。一方で、人々が動的型付け言語の使い方を忘れただけだ、という見方もある。

型の価値は読み手に情報を伝えることにあり、長期的にはコードベースを大量に読まずに済むぶんトークン消費を減らすはずだ、という意見や、TypeScript ではエージェントがコンパイルの通らないコードを書いてもエラーを見て直せる、という実感も共有されている。

ハイライトAI/開発danluu.com34pt / 15コメントコメントを見る(新しいタブで開く)スコア 70興味マッチ度 3
8

Chicken Scheme 6.0 released

Scheme 処理系 Chicken の 6.0 リリース。同じリリースノートが Hacker News にも立っている。

コメントの要約

Chicken Scheme の 6.0 が公開され、リリースノートが共有された。同じ URL は Hacker News 側にも別途投稿されている。

Lobsters 側のコメントは1件で、バグを潰すのに時間がかかったがようやくリリースできた、という開発側からの報告にとどまっている。

code.call-cc.org23pt / 1コメントコメントを見る(新しいタブで開く)スコア 69
9

What are you doing this week?

Lobsters の定例スレッド。各自がその週に取り組んでいることを書き込んでいる。

コメントの要約

Lobsters で毎週立つ定例スレッドで、各自がその週に取り組んでいることを書き込む。

今回は休暇明けの報告が多く、6か月ぶりに博士課程へ戻って normalisation by evaluation や universe hierarchy の論文を読むという人、8週間の夏休み明けで身体が慣れないという人が並ぶ。若い頃はプログラミングが好きで夜も眠れなかったが今は火が消えた、という書き込みもある。

Gleam 関連のプロジェクトを抱えつつ新キャラでの Valheim に時間を取られているという報告や、SDL3 ベースのテキストエディタを Rust で書いた週末、日食を見に行く予定、ステージング環境の API トークンを消したうえ環境ごと壊してしまったという告白も混じっている。

lobste.rs16pt / 16コメントスコア 69
10

an ambiguity in c89 which will never be fixed

C89 の規格に残る、今後も修正されない曖昧な記述を扱った記事。

コメントの要約

記事は C89 の規格に残る曖昧な記述のうち、今後も修正されないものを取り上げている。

コメントでは、WG14 のサイトに初期の番号付き委員会文書が追加されたという情報が共有されているほか、void f() と void f(void) が C では同じではないと知ったときの驚きが語られている。これに対しては、C23 で K&R 形式の関数定義が削除されたため現在は同じ意味になった、という補足が続く。

array[42] と 42[array] が等価であることに驚いたという書き込みや、次期規格の 6.5.3.2「配列の添字」の記述を引いて演算子の定義を確認する投稿も並んでいる。

sebsite.pw34pt / 8コメントコメントを見る(新しいタブで開く)スコア 67

GitHub Trending

10件2件
1

Prime Intellect による自己改善型のコーディング/リサーチエージェント。永続的な Python 実行環境と、更新可能なハーネス状態を組み合わせている。

記事の要約

Prime Agent は、汎用かつ長時間動作する作業のためのオープンソースのコーディング/リサーチエージェント。Recursive Language Model と Continual Harness という2つの抽象を軸に設計されている。

RLM は永続的な REPL の中でコンテキストを変数として扱い(prompt-as-a-variable)、再帰的なサブエージェントを含むツールを関数呼び出しとして扱う。Continual Harness は補助プロンプト、記憶、スキルの説明、再利用可能なサブエージェント仕様を、既定ではセッションローカルな永続状態として保持する。

ファイル操作もシェルコマンドもツール利用もコンテキスト管理もすべてコード経由で行われ、rlm(...) が実際の子エージェントを生成して結果をプログラム的に返す。/refine コマンドで現在の軌跡を見直し、根拠に基づく小さな更新をハーネスへ適用できる。

ハイライトAI/開発github.com+2642 stars today / 計13,445 / TypeScript既出スコア 94興味マッチ度 3
2

役割ごとに人格・手順・成果物を定義した AI エージェント群のコレクション。各エージェントを主要なコーディングツールへ導入する専用アプリも公開されている。

記事の要約

The Agency は、フロントエンドの専門家から Reddit コミュニティ担当、突飛な発想を注入する役、現実的な検算をする役まで、それぞれ人格・手順・成果物を定義した専門エージェントのコレクション。

最近ネイティブアプリが追加され、macOS・Linux・Windows で全ロスターを閲覧し、Claude Code、Cursor、Codex、Gemini、Osaurus などにクリック1つでインストールできる。クローンやスクリプト実行が不要で自動更新にも対応する。

リポジトリは MIT ライセンスで公開されており、PR を歓迎する姿勢とスポンサー導線が README に並んでいる。

AI/開発github.com+1349 stars today / 計142,109 / Shell既出スコア 89興味マッチ度 2
3

企業データを取り込んでコンテキストグラフと知識グラフを構築し、来歴付きでグラフ分析と因果推論を行うためのインフラ。規制の厳しい領域向けを掲げる。

記事の要約

Semantica は「AI エージェントのためのオープンソース版 Palantir」を掲げ、企業データを取り込んで重要な情報を抽出し、コンテキストグラフと知識グラフを構築したうえで、その全体に対してグラフ分析と因果推論を実行する。

特徴として、意思決定の来歴(provenance)が最初から組み込まれており、説明可能・追跡可能・信頼できる設計であることが強調されている。決定インテリジェンス、コンテキスト管理、決定論的推論、オントロジー管理、エンドツーエンドのトレーサビリティが並ぶ。

セルフホスト可能で監査可能、ベンダーロックインなしを謳い、ストレージは RDF と LPG の双方に対応するポリグロットなグラフ構成。高リスクで規制の厳しい領域向けと位置づけられている。

AI/開発github.com+970 stars today / 計4,437 / Python既出スコア 84興味マッチ度 2
4

ノードグラフ形式のインターフェースを持つ、拡散モデル向けの GUI・API・バックエンド。

記事の要約

ComfyUI は、拡散モデルを扱うためのモジュラーな GUI・API・バックエンドで、グラフ/ノードのインターフェースを持つ。README では「コンテンツ制作のための最も強力でモジュラーな AI エンジン」と位置づけられている。

公式サイト、Discord、Matrix、X へのリンクと、リリースバージョンやダウンロード数のバッジが並ぶ構成で、README の冒頭は主にプロジェクトの入口の案内に充てられている。

元は comfyanonymous/ComfyUI として開発されており、現在は Comfy-Org 配下でリリースが管理されている。

github.com+922 stars today / 計126,566 / Python既出スコア 79
5

ウェブを検索・スクレイプし、エージェントがそのまま使える Markdown や構造化データに変換する API。オープンソース版とホスティングサービスの双方がある。

記事の要約

Firecrawl は、ソースを見つけてコンテンツを抽出し、エージェントがそのまま使える Markdown や構造化データに変換するウェブコンテキスト API。オープンソースで開発され、ホスティングサービスとしても提供されている。

特徴として、JS 依存のページを含めウェブの96%をカバーする信頼性、数百万ページで P95 レイテンシ3.4秒という速度、プロキシのローテーションやレート制限といった面倒な部分を設定なしで引き受ける点が挙げられている。

出力はクリーンな Markdown、構造化 JSON、スクリーンショットなど。ウェブ上の PDF や DOCX の解析、抽出前のクリック・スクロール・入力・待機といったアクション、単一コマンドでの MCP クライアント接続にも対応する。

AI/開発github.com+835 stars today / 計165,395 / TypeScriptスコア 74興味マッチ度 2
6

Tree-sitter で多言語のコードベースを解析して Memgraph 上に知識グラフを構築し、自然言語で問い合わせ・編集できるようにするツール。

記事の要約

Code-Graph-RAG は、Tree-sitter で多言語のコードベースを解析して構造の知識グラフを Memgraph に構築し、そのコードを自然言語で問い合わせ・編集・最適化できるようにする。混在言語のモノレポを1つのグラフスキーマで扱える。

最近の更新では、YAML のパターンファイル1枚で言語を追加できる ast-grep 層により Ruby に対応した。手書きのパーサーなしで Module、Function、Class ノードと import エッジを生成する。AST パターンで検索・書き換えを行う構造的な検索と置換も、エージェントのツールとして公開されている。

新設された FLOWS_TO の taint エッジは、代入・関数呼び出し・I/O シンクを通じて値を追跡する。今回 C#、Java、C、Go が加わり、データフロー追跡の対象は10言語になった。

AI/開発github.com+682 stars today / 計3,636 / Python既出スコア 69興味マッチ度 3
7

AI コーディングエージェント向けに、開発ライフサイクルの各フェーズに対応する8つのスラッシュコマンドを揃えたスキル集。

記事の要約

Agent Skills は、シニアエンジニアが使うワークフロー、品質ゲート、ベストプラクティスをスキルとして符号化し、AI エージェントが開発の各フェーズで一貫して従えるようパッケージ化したもの。

DEFINE → PLAN → BUILD → VERIFY → REVIEW → SHIP というライフサイクルに、/spec、/plan、/build、/test、/review、/ship の6コマンドが対応する。さらに Web パフォーマンス監査の /webperf とコード簡素化の /code-simplify を加えた8コマンド構成になっている。

各コマンドには、コードの前に仕様、小さく原子的なタスク、一度に一枚ずつ、テストは証明、マージ前にコードの健全性を改善する、速い方が安全、といった原則が対応づけられている。

AI/開発github.com+659 stars today / 計85,941 / JavaScript既出スコア 64興味マッチ度 3
8

手元のマシンで動くコーディングエージェントを、モバイル・Web・デスクトップから操作するための「エージェントハーネスの操作面」。

記事の要約

T3 Code は「エージェントハーネスのコントロールサーフェス」を名乗り、iOS / Android アプリ、Web アプリ、Electron 製デスクトップアプリから、自分のマシン上のエージェントを操作できるようにする。

対応するのは Claude Code、Codex、Cursor、Grok Build、OpenCode で、それぞれの CLI をインストールして認証済みであれば T3 Code から制御できる。既存のサブスクリプションをそのまま使う形になる。

README では、Codex デスクトップアプリや Conductor、Claude Desktop、Cursor Glass に触発されたが基準を満たすものがなかったため自作した、と説明されている。方向性を誤ったときにフォークできるよう、必要なものはすべて公開しているという。

AI/開発github.com+389 stars today / 計18,119 / TypeScript既出スコア 59興味マッチ度 3
9

Google DeepMind による全球・中期の大気およびサイクロン予測モデル WeatherNext 2 のコード。前世代の GraphCast と GenCast も含む。

記事の要約

WeatherNext リポジトリには、Google DeepMind と Google Research が開発した全球・中期の大気およびサイクロン予測モデル WeatherNext 2 のコードが含まれる。前世代の GraphCast と GenCast のコードも同梱されている。

モデルを自分で動かさずに出力だけを使いたい場合向けに、日次のデータフィードが Google Cloud(Earth Engine、BigQuery、Vertex AI)、WeatherLab、OpenMeteo の各プラットフォームで提供されている。

関連文献として、Nature に掲載されたサイクロン予測の論文と、FGN/WN2 の技術レポートが案内されている。

github.com+325 stars today / 計7,422 / Python既出スコア 54
10

現状から理想の状態へ近づけていく「山登り型」の AI ハーネスを掲げた、仕事と生活の両方を対象にした個人向けシステム。

記事の要約

LifeOS は「AI を使ったライフオペレーティングシステム」を掲げ、仕事と生活の双方で現状(Current State)から理想の状態(Ideal State)へ近づけていく汎用の山登り型ハーネスとして紹介されている。

README はスター数、フォーク数、最終コミット、コントリビューター、リリース、ライセンスといったバッジと、Current State → Ideal State を打ち出すアニメーション見出しが中心の構成になっている。

オープンソースかつ無料で提供され続けるという方針が、冒頭で明示されている。

AI/開発github.com+315 stars today / 計18,130 / TypeScriptスコア 49興味マッチ度 2

dev.to

10件
1

What Would You Tell Someone Early in Their Career?

キャリアの初期にいる人へ何を伝えるか、という問いを投げたディスカッション投稿。自身もまだ経験が浅いという立場から書かれ、42件のコメントが付いている。

キャリアdev.to57リアクション / 42コメントスコア 94興味マッチ度 2
2

I Joined dev.to because...

調べ物で見かけるだけの存在だった dev.to に、ネットワーキングの手段として今年1月に登録したという経緯を書いた投稿。

記事の要約

筆者は2020年頃から、バグの修正方法や実装したい機能を調べるときの資料として Stack Overflow と並んで dev.to を見ていたが、参加はしていなかったという。

この分野ではネットワーキングが重要だと聞き、自分にとって最も取り組みやすいのがブログを書くことだったため、今年1月に登録した。それまでは LinkedIn で人をフォローする以外の交流はなく、誰にも知られないままプロジェクトを作っていたと書いている。

内向的で新しい人に会うのが苦手だったことに加え、OCD のためテクノロジー関連のことが何もできず、コードを書くことも PC を使うことも難しかった時期があった、という背景も語られている。

dev.to64リアクション / 25コメントスコア 91
4

Stratagems #24: Leo Built a Corridor. The AI Thought It Was a Road.

兵法三十六計になぞらえて、企業内で AI テンプレートやデータの主導権が移っていく力学を描く連載の第24回。

記事の要約

連載は三十六計の「仮道伐虢」を引き、二大勢力の間で隣国から追随を迫られたときは相手の勢いを借りる、という前置きから始まる。

これまでの回では、コンサルタントとして入ったレナが作った報告テンプレートが5週間後に本番投入され、6か月分のベースラインデータを固定してしまった話や、FinOptima が盗まれた学習データをキャッシュ経由で書き戻していた話などが扱われてきた。

今回はレオが作った「通路」を AI が「道路」と解釈した、という題で、前回までの伏線を引き継ぐ形で続いている。

dev.to47リアクション / 20コメントスコア 86
5

You Don't Have an AI Problem You Have a Thinking Problem.

AI が自分を怠惰にしているのではなく、AI を考えないための口実にしていたという気づきから、難しい問題に当たったときの最初の反応を問う記事。

記事の要約

筆者は AI が自分を怠惰にしていると思っていたが、実際には AI を「考えないための口実」に使っていたと気づいたという。同じパターンを自分のコード、レビューした PR、「AI がこう言っている」で会話が終わる Slack のやり取りに見るようになった。

きっかけは Node.js のバックエンド API で、あるフィールドが常にではないが頻繁に null で返る不具合。以前なら30〜60分かけてコードを読み直し、値がどこで入るはずかを確認し、リクエストを上から下まで追っていたはずだった。

代わりに AI に症状を説明したところ、チェーン内の await 抜けという修正案が返ってきた、という流れで話が続く。難しい問題に当たったとき最初に考えるか、それとも AI を開くか、という問いが読者に投げられている。

AI/開発dev.to19リアクション / 5コメントスコア 83興味マッチ度 2
6

I Built a ₹15 Landing Page About Mumbai's Soul Food

ムンバイのワダパヴを題材に、フレームワークもビルドステップも使わずスクロール連動のランディングページを作った Frontend Challenge の応募作。

記事の要約

Frontend Challenge の Comfort Food Edition への応募作で、1日2000万人が食べる15ルピーのストリートフード、ワダパヴを題材にしたスクロール駆動の映画的なランディングページ。

実装にフレームワークもビルドステップもなく、HTML と CSS、それに JavaScript だけで構成されている。ライブデモとソースコードの双方が公開されている。

記事の後半は、工科大学の帰りに毎晩通ったワダパヴ店の思い出に充てられており、当時は本当に金がなくバス代が足りなければ歩いたが15ルピーで腹は満たせた、いまは収入が増えたが同じようには感じられない、という一節でページの動機が説明されている。

JS/フロントエンドdev.to20リアクション / 2コメントスコア 81興味マッチ度 2
7

My CSS Art Made Some Foodie Friends 🍙🧋🥟🍲

おにぎり・タピオカ・餃子・火鍋を CSS アートで作り、ネオンの店内とタッチパネル注文機に配置した Frontend Challenge の応募作。

記事の要約

Comfort Food Edition の CSS Art 部門への応募作で、1品に絞らず、おにぎり、タピオカティー、餃子、火鍋という4つのキャラクターを作り、ネオンの効いた暗い店内とデジタルメニュー表示という舞台を用意している。

各キャラクターは価格付きのメニュー項目を兼ね、CRT 風の画面の上で点滅しながら跳ねる。下にはファストフード店にあるようなタッチパネルの自動注文機が置かれ、注文を促す文字を打ち出したうえで注文番号入りのレシートを印刷する。

すべて div を clip-path、border-radius、グラデーションで組んだもので、キャラクターは個別に跳ね、数秒ごとにまばたきする。クリックすると目が変わって輝きが弾ける仕掛けも入っている。

JS/フロントエンドdev.to15リアクション / 5コメントスコア 78興味マッチ度 2
8

Ayo GitHub Quietly Killed the Unreviewable Mega-PR

GitHub がスタックド PR に対応し、巨大な差分を依存関係のある小さな PR の連なりに分割できるようになったことを解説した記事。

記事の要約

記事は、47ファイルが変わり GitHub が差分の表示を諦めるような PR を出した経験を入口に、GitHub が近年で最大級の PR 更新を静かに投入したと紹介している。

前提として、大きな PR ではレビューが機能しない。2000行の差分を注意深く読む人はおらず、レビュアーが人間でもモデルでも、対象が絞られた差分の方が良い仕事ができる、という主張が置かれる。

スタックド PR の規則は単純で、同じリポジトリに2つ以上の PR があり、一番下の PR が trunk ブランチを、それ以降の PR が1つ下の PR を対象にしていればよい。各 PR は下位の変更をすべて含めず、自分が加えた差分だけをレビュー対象にできる。

dev.to18リアクション / 0コメントスコア 76興味マッチ度 2
9

When Your AI Agent Passes 2,283 Tests — And Still Fails in Production

AI エージェントの作業を検証するプロトコルをめぐり、署名済みの検証チェックが常に verified を返していた本番バグの事例を扱った記事。

記事の要約

筆者は AI エージェントの作業を検証するプロトコル OpenWorkProof について LinkedIn に投稿したところ、72時間にわたって世界中のエンジニアや protocol designer、セキュリティ研究者から前提を突き崩す指摘を受けたという。

中でも大手フィンテックのシニアエンジニアが共有した本番バグが取り上げられている。ゲートウェイは全 API レスポンスに検証チェックをかけ、署名も監査も通り、毎回 verified: true を返していたが、数か月間誰も疑わなかった。意図的に壊した入力で negative control を書いて初めて発覚した。

原因は ln.strip() という1行で、余分な改行によって assert 文が return の後ろに押し出され、関数本体の中で決して実行されない位置に置かれていた。終了コードは0、判定は verified。8種類の呼び出しテスト形状のうち5つが偽陽性を出していたという。

AI/開発dev.to5リアクション / 7コメントスコア 73興味マッチ度 2
10

Distilling Kimi Into Qwen Doesn't Give You Kimi. It Gives You Qwen With Kimi's Handwriting

フロンティアモデルの推論トレースで微調整したときに実際に移るのは何かを、既存の実験から整理した記事。移るのは主に形式であって能力ではないと論じる。

記事の要約

発端は2026年7月22日、ホワイトハウス OSTP の Michael Kratsios が Moonshot AI による Anthropic Fable 5 の蒸留を非難し、財務省が制裁を検討したという件。技術的な証拠は公表されず、K3 の公開日時点で Fable 5 が公開されていた期間は合計18日ほどしかない、という時系列の矛盾が研究者から指摘された。

筆者は「起きたかどうか」ではなく「起きたとして Moonshot は実際に何を受け取ったのか」を問い、手がかりとして2025年に Sky-T1 のバークレーのチームが行った実験を引く。

最終回答が誤っている長い推論トレースで微調整すると精度は3.2ポイント低下し、推論ステップ中の数値を半分ランダム化しても3.3ポイントの低下にとどまった。ところがステップの順序を入れ替えると性能は崩壊した。蒸留で渡る中身はほとんど入れ替え可能である、という結論に向かう。

AI/開発dev.to10リアクション / 1コメントスコア 70興味マッチ度 3

日本

はてなブックマーク

10件
1

差別的な本を置かない方針を掲げる書店を紹介した朝日新聞の記事に対し、では反ワクチンや放射能デマの本はどう扱うのかという問いが投げかけられ、選書と検閲の境界が論点になっているまとめ。

コメントの要約

まとめの発端は、差別的な本を置かない書店を朝日新聞が紹介した記事。差別の本かどうかは手に取って読まないと分からず、置かない判断を突き詰めれば出版前のチェック、つまり検閲に近づくのではないか、という疑問が投げかけられている。

ブックマークでは、まとめ自体が煽り性の高い作りだという指摘や、カタカナで地名を書くことも差別に含めるのかという突っ込みが並ぶ。差別をなくしたいというより率先して差別したいのではないか、という批判も多い。

一方で「地獄への道は善意で舗装されている」と、動機の善さと結果を切り離して見るコメントもあり、書店の姿勢を評価する声と冷ややかな見方が混在している。

2

WBS をセル結合だらけのスプレッドシートではなく1行1タスクのフラットな Markdown 表として持ち、機能軸と工程軸の集計をスクリプトで作り直す運用をまとめた記事。AI に編集させる前提の列設計と検算までを扱う。

コメントの要約

記事の主張は、WBS を人間が読む完成品ではなく集計の入力データとして扱うこと。階層はインデントやセル結合ではなく機能・工程という列で表現し、集計行は表に混ぜず、集計は毎回スクリプトで作り直す。

ブックマークでは、1行1タスクのフラットな表という結論自体は正しい表データの扱い方であって Markdown はあまり関係ない、という指摘が目立つ。結局 Excel に集約されるという反応もある。

一方、テキストなので diff が取れる点を評価し、AI 前提で Excel からテキストへ回帰するのではないかという見方や、そもそもメンテナンスが続くのかを疑問視する声も出ている。

AI/開発qiita.com225 usersコメントを見る(新しいタブで開く)スコア 89興味マッチ度 3
3

出張のたびに持ち物をゼロから選び直さずに済むよう、日帰りから一週間まで段階的に足していく持ち物の設計を紹介した note。長く使い続けている品を列挙している。

コメントの要約

記事は、荷物を最小にする競技ではなく、移動先でも普段の生活を短い手順で再開するための設計として持ち物を選ぶ、という考え方でまとめられている。日帰り、二泊三日、一週間と、足すものが段階的に増える構成。

ブックマークでは、サブのペンは載っているのに主役のペンがないのはなぜかという具体的な突っ込みや、Matador の FlatPak が便利そうだという反応がある。

一方で、見たいのは100円ショップや無名の製品の方だという声や、ブランド品を選ぶこと自体は分相応の範囲なら当然だという意見も出ており、選ぶ基準への評価が分かれている。

4

下肢を中心に全身に近い負荷がかかるスクワットについて、GQ が4種類のやり方を解説した記事。76歳から始めて86歳まで舞台に立った森光子の例を引きつつフォームの注意点を示す。

コメントの要約

記事はスクワットを全身運動に近い種目として位置づけ、4つのバリエーションと、膝がつま先と同じ向きになっているかといったフォームの注意点を挙げている。

ブックマークでは、なぜこの記事がホットエントリに入っているのかという反応や、続かないという告白が並ぶ。ブルガリアンスクワットを推す声もある。

膝を痛めるのが怖いのでワイドスクワットだけにしているという報告や、記事が言う膝の向きの説明はラジオ体操第一の動きに近いのではないかという解釈も出ている。

5

2026年8月11日3:00頃から9:50頃にかけて、はてなブックマークに接続できない・不安定になる障害が発生していた。原因はシステムの一時的な過負荷による動作不具合と説明されている。

コメントの要約

開発ブログの報告によると、障害は8月11日の未明から午前にかけて約7時間続き、原因はシステムに一時的な過負荷が発生したことによる動作不具合。現在は復旧が確認されている。

ブックマークでは、502 が出ていたので早く寝られた、祝日を無駄にせず朝起きられたといった報告や、久しぶりに障害時の画像を見たという反応が並ぶ。

原因説明の「一時的な過負荷」に対しては、お盆の時期なのにという疑問や、無料で使っているので何も言えないという声も出ている。

bookmark.hatenastaff.com161 usersコメントを見る(新しいタブで開く)スコア 82
6

滋賀県の3市で8月22日に予定されていた「琵琶湖三市同時花火大会」が突然中止となり、出店料5万円を払った飲食店から損失を訴える声が出ている。3市は大会への関与を否定している。

コメントの要約

取材によると、1万発以上を打ち上げるとして有料観覧券を販売していた大会が9日に中止を発表した一方、開催地とされた彦根・長浜・高島の3市は関与を否定している。地元の花火業者には3000万円規模の打診もあったという。

ブックマークでは、大きな嘘に小さな事実や実績を紛れ込ませるのは詐欺の常套手段だという指摘や、返金されなければ詐欺、返ってくるなら運営ミスだという線引きが示されている。

故意の立証が難しく損害賠償も難しいのではないかという見方や、最初から怪しいと思っていたという出店者側のコメントへの反応も並ぶ。

news.ntv.co.jp161 usersコメントを見る(新しいタブで開く)スコア 81
7

マッチングアプリで知り合って2か月の相手と映画「ちいかわ」を観に行き、ラジオの映画評の受け売りを語ったところ関係が悪化したという匿名ダイアリーの投稿。

コメントの要約

投稿は、原作既読の上でライムスター宇多丸の映画時評を聴いてから鑑賞に臨んだところ、鑑賞後の語りが相手の反応と噛み合わなかったという経緯を書いたもの。

ブックマークでは、映画だけでなく相手も観ておくべきだという指摘や、「◯◯のせい」と書かれるものは大体本人のせいだという定型の反応が集まっている。

付き合って2か月の相手に受け売りの早口語りを披露すればそうなる、という同意が多い一方で、投稿者の書きぶり自体を面白がる声もある。

anond.hatelabo.jp172 usersコメントを見る(新しいタブで開く)スコア 78
8

千葉県いすみ市で2024年8月に高齢女性が殺害された事件で、逮捕された長女が母親の口座を管理し、その資金から1千万円以上を動画配信者への投げ銭に充てていたと報じられた。

コメントの要約

記事によれば、殺人容疑で逮捕された54歳の長女は母親の口座を管理しており、その資金をもとに1千万円以上を投げ銭に使っていた。金銭トラブルが背景にある可能性が指摘されている。

ブックマークでは、子どもが親のカードを使い込む話かと思ったら想像よりはるかに重い、という反応が目立つ。1千万円を受け取った配信者側への言及もある。

一方、2年前の事件で証拠がないなら罰するべきではないという慎重な意見や、報道写真の加工処理への注文といった別の論点も出ている。

9

ある作品を広めるのを認めないという表現もまた表現の自由なのか、という「表現の自由のジレンマ」を提起した匿名ダイアリーの投稿。キャンセルカルチャーの位置づけを問うている。

コメントの要約

投稿は、ある作品を広めるのを認めないと主張して炎上させる行為自体が表現の自由に含まれるのか、という問いを立て、そこを解決しないと表現の自由擁護の主張は認められない、と述べている。

ブックマークでは、国家権力の検閲は絶対的な禁忌だがそれ以外の弾圧なら許されるわけではない、寛容は不寛容に対してだけ不寛容である、といった整理が並ぶ。

一方、全肯定以外を弾圧と呼ぶのは言葉選びが強すぎて余計な軋轢を生む、という指摘や、どこまでを「認めない」に含めるかという線引きの問題だとする意見も出ている。

anond.hatelabo.jp155 usersコメントを見る(新しいタブで開く)スコア 74
10

餃子、五右衛門、鳥取、案山子など、字面と読みが結びつかない漢字表記を並べた匿名ダイアリーの投稿。

コメントの要約

投稿は、餃子が中国語では「チャオズ」なのに「ぎょうざ」と読む点や、鳥取が「とっとり」になる点など、字面から読みが導けない例を列挙している。

ブックマークでは、まず言葉があって後から漢字を当てはめたという順序を踏まえるべきだという指摘が多い。昨日・今日・明日や、真面目・土産・田舎を違和感なく読んでいることへの言及もある。

焼売が読めずに「やきうり」と注文した思い出や、英吉利・独逸・仏蘭西といった当て字の列挙など、脱線した反応も集まっている。

anond.hatelabo.jp155 usersコメントを見る(新しいタブで開く)スコア 68

Zenn

10件0件
1

Claude Code が生成するコメントが極端に長くなる原因を追った記事。設定1行に18行のコメントが付いた実例を示し、ルールを整備しても効かなかった理由を掘り下げる。

記事の要約

記事はまず実物を示す。Go の WebSocket 圧縮設定1行に対して、RFC 7692 permessage-deflate の挙動、ライブラリごとの context takeover の扱い、本番の backend-graph が memory limit 2Gi に到達して OOMKill された経緯まで、18行のコメントが付いている。

書かれている内容に嘘はなく、ライブラリの仕様も障害の経緯も事実である点が問題を厄介にしている、と筆者は指摘する。長いコメントが Claude 自身の読解を助けているのではないかと考えて本人に聞いたところ、想定と違う答えが返ってきたという。

そこからコメントの長さを抑えるルールを整備したものの思ったほど効かず、原因を調べると「削れない理由」がはっきりした、という一連の記録がまとめられている。

AI/開発zenn.devいいね210 / ブクマ73既出スコア 84興味マッチ度 3
2

Claude Code のセッションログを解析し、時間・トークン・労力がどこで無駄になっているかを計測・可視化するツール cclens の紹介記事。すべてローカルで完結する。

記事の要約

筆者は、AI が非決定的である以上ルールやスキルの効果検証は難しく、効いているか分からない設定だけが静かに積もっていくという問題を挙げる。棚卸ししようにも「知らないところで効いているかも」と思うと消せない、という心理的ハードルも指摘する。

この構図はパフォーマンスチューニングと同じで、処方箋は「推測するな、計測せよ」だという。ただし A/B テストのために別途タスクを走らせるのは、モデルもプロンプト解釈もツール挙動も変わり続ける状況では割に合わないため、cclens は普段使いのログをそのまま解析する作りにしている。

できることは大きく2つで、入れてあるのに一度も呼ばれていない設定などをリストアップすることと、無駄の所在を計測・可視化すること。解析は全部ローカルで完結し、データは外部へ送信しない。

AI/開発zenn.devいいね90 / ブクマ49既出スコア 81興味マッチ度 3
3

Cloud Logging のエラー検知から原因調査・仕様書とコードの修正・レビュー・push までを Claude Code に自律的に繰り返させる仕組みを構築し、実際にバグを検出した記録。

記事の要約

ループエンジニアリングは2026年6月に Addy Osmani が名付けた概念で、エージェントにプロンプトを打つ人であることをやめ、代わりにそれを行うシステムを設計することだと引用されている。筆者は Cloud Logging のエラー検知から仕様書・コード修正、レビュー、push までを自律的に回す仕組みを作った。

記事は「AI を使ったバッチ処理」と「ループエンジニアリング」を区別する。前者は人間が書いたコードが主導権を持ち、後者は Claude Code 自身が何をどう直すか、push するかまでを判断する。

設計原則として Maker-Checker パターンを採り、LLM が合格させたい方向へ評価を歪めることへの対策として pytest / mypy のような決定的なゲートを置く。実装エージェントと検証エージェントを別コンテキストで動かすため、Claude Code のサブエージェント機能を使っている。

AI/開発zenn.devいいね74 / ブクマ60既出スコア 79興味マッチ度 3
4

PC 画面の操作録画と音声解説から定型業務を言語化し、AI エージェント用の SKILL.md を生成する Microsoft 製デスクトップアプリ Skill Recorder の紹介記事。

記事の要約

ブラウザ操作のトレースは playwright 系で済むが、ローカル PC のアプリケーション操作を対象にした業務効率化スキルを作る手段として microsoft/skill-recorder が紹介されている。今年7月25日に登場したツールで、今後改善が続く前提で読むよう断りがある。

特徴は、画面録画とナレーション音声を同時に収集し、録画・フレーム抽出・Whisper による文字起こしをすべてローカルで処理したうえで、GitHub Copilot が業務の意図と手順を構築する点。UI の絶対座標を再生する RPA ではなく、gh CLI や Web API、検索ツールを使う形にスキル化される。

利用には Node.js 24 以降と、Copilot へのアクセス権を持つ GitHub アカウントが必要で、十分に活用するには Microsoft 365 も要る。機密性の高い業務では、データが学習に使われないことが保証された Copilot Business / Enterprise 契約下での利用が推奨されている。

AI/開発zenn.devいいね64 / ブクマ48既出スコア 76興味マッチ度 3
5

Google Cloud が2026年6月に発表した Open Knowledge Format について、RAG や LLM Wiki といった周辺技術からの流れを含めて位置づけを解説した記事。

記事の要約

OKF は一見すると Markdown + YAML で、Obsidian や Claude の Skills に似て見えるが、実体は一部のエンジニアが個別に実践していた「LLM Wiki」というパターンを標準化したものだと位置づけられている。

記事は「第二の脳」の起源を Tiago Forte の講座と2022年の著書まで遡り、アトミックノート、相互リンク、将来の再利用を前提にした整理という3点が揃って初めて機能する、と整理する。Obsidian の設計もこの延長線上にあるという説明が続く。

RAG の限界としてチャンク同士に関係性がなく前後の文脈が失われる点を挙げ、ハイブリッド検索や GraphRAG で検索能力自体は進化しても、蓄積したやり取りを構造化された再利用可能な知識として残す部分は標準が定まっていなかった、と OKF の狙いを説明している。

AI/開発zenn.devいいね64 / ブクマ40既出スコア 73興味マッチ度 2
6

「ウルトラ」と入力したら「ソウル」と返すモデルを作るというネタから出発し、Microsoft Agent Framework の HarnessAgent でハーネスを組む手順を解説した記事。

記事の要約

発端は、reasoning effort high の gpt-5.6-sol に「ウルトラ」と入れて「ソウル」と返させたら面白い、という飲み会での話。5秒 LT の予定は流れ、後日 X 上でも素直に成功する例は出なかったという経緯が書かれている。

そこで Microsoft Agent Framework を使い、リポジトリと紐づかない場所でハーネス側から挙動を作る方法が示される。C#(.NET 10)で Microsoft.Agents.AI.Foundry、Microsoft.Agents.AI.Harness、ユーザーシークレット用パッケージを追加し、HarnessAgent を組み合わせる構成。

ネタ記事と断りつつ、Agent Framework の部品構成、Foundry にデプロイしたモデルの扱い、OpenAI や AWS、Google Cloud へ接続する場合のパッケージ選択まで触れており、後日「Agents Skill」や画面の追加も追記されている。

AI/開発zenn.devいいね87 / ブクマ16既出スコア 71興味マッチ度 2
7

PR レビューがリードタイムのボトルネックになっていた SHE で、AI がコードレビューと approve 判断まで行う仕組みを実装し、58% の PR が AI 承認になった事例。

記事の要約

前提として、直近3週間に人間レビューへ回った PR 75件を全数分析したところ、60% は無言の approve か LGTM のみで、実質的な指摘が付いたのは約1割、しかもその大半は以前からリポジトリで稼働している別のレビュー AI 由来だった。

筆者はもともと PR レビューでの品質向上には限界があるという立場を取っており、本当に品質担保とオーナーシップを持つべき変更(データベース設計など)を定義したうえで、それを含む変更は必ず人間レビューへ回し、そうでないものは AI レビューで通す方針にした。

仕組みはゲート判定からラベル反映までの4段階で構成され、人間が見るべきコード変更の基準づくりや、AI と人間の対話型レビューも試している。まだ試験運用中だが、リリース後の感触は良いと報告されている。

ハイライトAI/開発zenn.devいいね61 / ブクマ29既出スコア 68興味マッチ度 3
8

Google Labs が公開した DESIGN.md を実際に導入し、公開されている74件を測定して効く範囲と効かない範囲を切り分けた記事。測定スクリプトも公開されている。

記事の要約

DESIGN.md は、AI に UI を作らせると毎回少しずつ違うものが出る問題に対し、デザインの意図を1ファイルに書いて毎回読ませるためのファイル形式。YAML の front matter に色や書体の値を、その下の Markdown になぜその値なのかを書く。

効くのは、色や書体の指示がセッションや担当者をまたいでもブレなくなる点、WCAG のコントラスト比を機械でチェックできる点、Tailwind の設定や CSS 変数として書き出せる点。一方で UI は生成せず、CLI にあるのは検証と変換だけで、こちらのコードは1行も読まない。

筆者が最も強く指摘するのは、DESIGN.md を置いても実装がそれに従っているかは誰も確認しておらず、lint も CI も緑になるが、それは「ファイルの書式が正しい」という意味でしかないこと。11個の検査ルールのうち Markdown 本文を見るのは1つで、それも見出しの並び順しか見ない。

AI/開発zenn.devいいね50 / ブクマ38既出スコア 66興味マッチ度 3
9

リポジトリの段階に応じて開発を駆動する文書を交代させ、リリース後は保証台帳1枚で回す Guarantee-Driven Development の紹介記事。

記事の要約

出発点は、Claude Code に実装を投げて作れる量が増えたぶん、手戻りと破壊も増えたという実感。守ってくれるのはテストだが、そのテストも Claude が書いており、いま何が守られているかを知る方法が tests/ を上から読むことしかない。

そこで開発を2フェーズに分け、MVP 期は PLAN.md と JUDGE.md による Spec-Driven Development で流動的に速く作り、Issue ドリブン期は docs/guarantees.md による Guarantee-Driven Development で約束を裁可してから実装する。フェーズは各リポジトリの CLAUDE.md で宣言し、宣言がなければ Issue ドリブン期として扱う。

PLAN.md を軽く保ちながら JUDGE.md を省かないのは、後から必要になるのが判断の記録だからで、仕様は動くコードを読めば分かるが検討して外した案はコードに残らないため。この2枚はリリース時に README へ畳んで役目を終える。

AI/開発zenn.devいいね57 / ブクマ29既出スコア 63興味マッチ度 3
10

現金レス化と Visa デビットへの集約を経て、Claude と MCP からマネーフォワード API を直接呼び出し、経費精算アプリと Excel を使わない経理運用へ移行した記録。

記事の要約

以前は経費精算アプリでレシートを撮って勘定科目を手動で選び、マネーフォワードで足りない部分を Excel で補い、小口現金の突き合わせもしていた。ツールは便利でも、入力・選択・確認はすべて人間が担っていたという。

過渡期として小口現金をほぼ廃止し、クレジットカードではなく法人口座直結の Visa デビットに絞り、購買を Amazon Business へ集約した。これでリアルタイムの残高確認とデータ取得の自動化は完了したが、証票添付や仕訳調整は人手のまま残った。

現在はレシート画像を Claude に投げるだけで、Vision による日付・金額・支払先の抽出、登録番号や税率のインボイス検証、MCP 経由での証票アップロードと仕訳登録までが一括で処理される。マネーフォワードの管理画面はほとんど開かなくなったとしている。

AI/開発zenn.devいいね37 / ブクマ22既出スコア 60興味マッチ度 2

すべて既出

Qiita

10件5件
1

WBS を1行1タスクのフラットな Markdown 表として書き、機能軸と工程軸の両方で工数を集計する方法を整理した記事。はてなブックマークでも同日に上位へ入っている。

記事の要約

記事は、セル結合と色分けで作った人以外が触れなくなる、差分が追えない、AI に渡すのに CSV 書き出しから始まる、といったスプレッドシート WBS の問題を挙げ、1行1タスクのフラットな Markdown 表に置き換える。

守るルールは4点。階層はインデントやセル結合ではなく機能・工程という列で表現する、機能軸と工程軸の表を別々に作らず1枚から2つのビューを生成する、集計行を表の中に混ぜない、集計は毎回スクリプトで作り直す。要は表を「人間が読む完成品」ではなく集計の入力データとして扱う割り切りである。

表の挙動は GitHub Flavored Markdown の仕様に基づき参照実装 cmark-gfm で確認したと断りがあり、AI の集計を鵜呑みにしないための検算スクリプトと Git 運用までがセットで示されている。

AI/開発qiita.comLGTM57 / ストック55スコア 89興味マッチ度 3
2

AI が数十分使えなくなった日に自分の実力が不安になった新人エンジニアが、先輩の助言で「AI に聞く前に10秒だけ自分で予想する」を試した記録。

記事の要約

筆者はエラーが出たらまず AI にコピペするのが癖になっており、AI に複雑な指示を出しすぎて数十分使えなくなったとき、自分の頭だけでは全然進まなかったと書いている。「今日一日 AI が使えなかったら同じペースで仕事できるのか」と考えて自信をなくしたという。

先輩に相談したところ、AI に頼ること自体が悪いのではなく、AI に聞く前に自分で考えるという一手間を飛ばしていることが問題だと指摘され、当たらなくてもいいので10秒だけ自分の予想を声に出してみるよう勧められた。

実際に次のエラーで試したところ、自分で考える分だけ対応に時間はかかるものの、という形で体験が続く。想定読者として、AI の答えで直っても「なぜ直ったか」は分かっていない、といった状態が挙げられている。

キャリアqiita.comLGTM42 / ストック10スコア 86興味マッチ度 2
3

タスクを順番にこなしているのに期限が迫る原因を、プロジェクトマネジメントのクリティカルパスという考え方で整理した記事。待ち時間の長いタスクを先に動かす。

記事の要約

クリティカルパスは、プロジェクト全体で一番時間のかかる作業の連なりで、ここが1日遅れると全体の終了日も1日遅れる急所として説明される。すべての作業が同じ重みを持つわけではない、というのが要点。

筆者が自分の仕事を振り返ると、決まって遅れていたのは「自分が作業する→相手に確認や判断を委ねる→フィードバックを受けてまた自分が作業する」という、他人が絡むタスクだった。自分の作業時間より相手の返事を待つ時間の方が長くなる型である。

リモートワークではこの待ち時間がさらに伸び、同じ空間なら声をかければ済む確認にチャットでは数時間かかる。自分の作業スピードをどれだけ上げても相手の返信待ちは縮められないため、待ち時間を基準に優先順位を決める、という結論につながる。

キャリアqiita.comLGTM30 / ストック5スコア 82興味マッチ度 2
4

関数宣言・関数式・アロー関数を並べ、引数の丸括弧や return の省略、関数を返して2段階に分ける書き方までを整理した JavaScript の記事。

記事の要約

筆者は healAmount => currentHp => ... のように矢印が続くコードで「引数はどれか」「なぜ関数を返すのか」が長年しっくりこなかった、という自分のつまずきを起点にしている。

記事はまず関数宣言、関数式、アロー関数の3つの書き方を並べ、どれも関数名() で実行できることを確認する。関数名は関数そのもの、関数名() は実行した結果、という区別を明示している。

続いて引数の数ごとの丸括弧のルールを表で整理し、引数なしは ()、1つなら括弧を省略できる、2つ以上は括弧が必要、という形にまとめている。まだ途中段階で勘違いがあれば教えてほしい、という断りが添えられている。

JS/フロントエンドqiita.comLGTM18 / ストック11既出スコア 74興味マッチ度 2
5

3年目までの経験をもとに、技術力より先に土台として必要なのはお客様ファーストの姿勢だと論じた記事。日本技術士会の職業倫理の定義を引いている。

記事の要約

筆者は2021年に新卒で IT 業界に入り、詳細設計からテスト・運用保守まで一貫して担当してきた経験を踏まえ、技術力・設計力・実装力・スピード・経験年数・資格はいずれも大切だとしたうえで、その前に土台として必要なものがあると述べる。

それがお客様ファーストの姿勢で、エンジニアの仕事は自己満足のためではなく誰かの課題を解決し価値を届けるためにある、という理由が示される。日本技術士会の「公共の利益を最優先し、責任ある行動をすること」という定義を引き、お客様に誠実であること・最優先することと言い換えている。

お客様ファーストには2つの要素があるとし、1つは分からないのに分かったふりをしない、リスクやミスを隠さないという誠実さ、もう1つは自分の知識と経験を総動員することだとまとめている。

キャリアqiita.comLGTM14 / ストック12既出スコア 71興味マッチ度 2
6

再受験の代わりに AWS Skill Builder のトレーニングとハンズオンラボを完了することで認定を1年延長できる維持制度(ベータ)の条件と手順をまとめた記事。

記事の要約

2026年6月23日から、認定試験を再受験する代わりに Skill Builder 上の厳選されたトレーニングとハンズオンラボを完了することで、AWS 認定を1年間延長できるようになった。現段階では1年で、その後さらに延長できるかは不明とされている。

条件は、有効な Skill Builder サブスクリプションを持っていることと、認定の有効期限まで90日以内であること。対象は SAA、DVA、CloudOps Engineer Associate、DevOps Engineer Professional、SAP の5つ。

筆者はアソシエイト3種とプロフェッショナル2種すべてが期限90日を切った状態で、recertification ページから「認定資格の維持(ベータ版)」にアクセスし、Skill Builder ID でログインすると延長可能な認定が一覧に表示された、という手順をスクリーンショット付きで示している。

qiita.comLGTM16 / ストック8スコア 68
7

DynamoDB の設計で押さえておきたい点を、パーティションキー、GSI と LSI、シングルテーブル設計の3つを軸にまとめた記事。

記事の要約

前提として、RDB は正規化してから検索方法を考えられるが、DynamoDB は JOIN がないためアクセスパターンを先にすべて洗い出し、それに合わせてテーブルとインデックスを組み立てる逆向きの手順になる、と説明される。

プライマリキーはパーティションキー単体か、パーティションキーとソートキーの組み合わせ。後者では一意性の単位が組み合わせ全体に変わり、同じパーティションキー値を持つアイテムを複数持てる代わりに、その中でソートキーが重複しないようにする。

以降は、高カーディナリティと均一な分散、ソートキーによる階層と範囲の表現、GSI と LSI の違い、シングルテーブル設計、読み書きの作法、容量とリージョンという構成で続いている。

qiita.comLGTM8 / ストック14既出スコア 65
8

コンテキスト使用率がしきい値を超えたら Claude 自身に区切りを判断させ、引き継ぎノートまで書かせる hook を自作した記録。statusLine 経由でデータを運ぶ迂回が必要だった。

記事の要約

長いセッションの終盤で序盤の制約を忘れる、読んだファイルを読み直すといった挙動は、筆者の場合たいていコンテキスト使用率が膨らんでいたときに起きていた。コンテキストが30万トークンあれば毎ターン30万トークン分の入力が積み上がるため、料金面の影響は確実だとしている。

対策は自分でセッションを区切ることと /compact だが、Claude は実装に夢中で区切りを作らず、人間も作業に集中して使用率を見ていない。つまり区切りを作れる側が両方ともいなくなる、という構図を問題として挙げる。

仕組みは3段構えで、statusLine が毎レンダリングで使用率を表示しつつ状態ファイルへ書き出し、しきい値の手前で予告し、超えると引き継ぎへ進む。hook のスクリプトにはコンテキスト使用量が渡されないため、statusLine を経由してデータを運ぶ迂回が必要だったと報告されている。検証は Claude Code 2.1.224、macOS、Opus 5 の1Mコンテキストで行われている。

AI/開発qiita.comLGTM7 / ストック10既出スコア 62興味マッチ度 3
9

AWS の新しいフルスタックフレームワーク AWS Blocks(プレビュー)を、AWS アカウント不要・ローカル完結・費用0円で動かし、地名から標高を返すアプリを作った記事。

記事の要約

筆者は富士山登頂をきっかけに、名前は目にするが実際に何ができるのかは掴めていなかった AWS Blocks を、山を登るように少しずつ動かして確かめることにした、という導入から始まる。

内容は、プロジェクト作成からローカル起動までの導入、ApiNamespace への独自 API 追加と React + MapLibre による地図 UI の実装、「富士山」で検索して座標と標高を取得し地図にピンを立てるところまでの動作確認。

ジオコーディングに OpenStreetMap の Nominatim、標高取得に国土地理院 API を使うため AWS アカウントは不要で費用も0円。検証は WSL2 上で行われ、AWS Blocks は2026年7月末時点でパブリックプレビュー段階のため仕様変更の可能性があると注記されている。

qiita.comLGTM9 / ストック5スコア 61
10

SES の現場で成長を止めやすい7つの習慣と、その置き換え先の行動を対応表で整理した記事。報告・相談・レビュー・割り込み対応の具体例を含む。

記事の要約

捨てたいのは努力そのものではなく、成長につながらない方向へ力を使ってしまう習慣だとして、7項目が対応表の形で示される。

例えば、現場の常識を鵜呑みにする代わりに事実・推測・意見を分けて確認する、できるエンジニアに見せようとする代わりに分からないことを正直に伝えて早く確認する、最初から効率だけを求める代わりにまず基本を一度自分で通す、自分だけが得をしようとする代わりに調査結果や手順をチームが使える形で残す、といった置き換えが並ぶ。

資格や年数や単価でマウントするのではなく解決した課題と成果物で説明する、すべての連絡に反射的に反応するのではなく緊急度を分けて決定事項を記録する、という項目も含まれる。対象は SES 現場に参画する新人・若手で、契約交渉や労務問題は扱わないと範囲が明示されている。

キャリアqiita.comLGTM5 / ストック10既出スコア 59興味マッチ度 2