Trend Digest

文章を書かないモデルJevの検証記事が国内3サービスの上位を占め、AnthropicはClaudeが自社の研究開発の26%を主導していると公表

TypeSafe AIが9月15日に発表したJevについて、Qiitaでは従来のLLM+エージェントとの違いを整理した記事、Zennでは既存LLMのlogit比較で77倍速く再現した検証がそれぞれ首位に入り、はてなブックマークの上位10件にも関連記事が2件入った。はてなの上位3件はClaude Codeを秘書として育てる資料やスキルの記事で、GitHub TrendingでもCloudflareのセキュリティ監査スキルやTencentのBrowserSkillなど、エージェント向けのスキルやツールが上位に並んでいる。海外ではAnthropicがClaudeの主導する研究開発の割合が3月の1%から26%に増えたと公表し、OpenAIの法律業務向けAstra for LawはTechmemeとHacker Newsの両方で上位に入った。

  1. 1
    Jevとは何か? 従来型LLMやAIエージェントとの違いを理解する(新しいタブで開く)QiitaQiitaで首位に入り、同じ記事がはてなブックマークでも81ユーザーを集めている。表示中のJev関連記事は国内3サービスで計6枠を占める
  2. 2
    TypeSafeのJevを正しく驚く、それってLLMでできませんか?(新しいタブで開く)ZennZennで首位に入り、はてなブックマークでも68ユーザーを集めている。Gemma3 270MでJSON出力比77倍という実測値を示している
  3. 3
    Anthropic、自社の AI 研究開発の26%を Claude が「主導」と発表。3月の1%から上昇し、90%超では人間の密な指示のもとで大きな作業を担う形で「協働」(新しいタブで開く)TechmemeAnthropic says Claude “leads” 26% of its AI R&D work, up from 1% in March, and “collaborates” on 90%+, doing large chunks of work under close human directionClaudeが主導する研究開発の割合が3月の1%から26%へという数値で、同日のTechmemeにはAnthropicの指標提示とプロジェクト機能の刷新も並んでいる
  4. 4
    Astra for Law(法律業務向けの Astra)(新しいタブで開く)Hacker NewsAstra for LawHacker NewsとTechmemeの両方で上位に入り、HNでは311コメントを集めている
  5. 5
    Claude Codeを「使うほど育つ」AI秘書にするノウハウ(新しいタブで開く)はてなブックマークはてなブックマークで498ユーザーと当日最多を集め、上位3件をClaude Code関連の記事が占めている
80件50件

グローバル

Hacker News

10件9件
1

Hister: A private search engine for the pages you visit and the files you keep

閲覧したWebページとローカルのファイルを自分の環境でインデックス化し、あとから全文検索できるセルフホスト型の検索エンジン。GitHubで公開されている。

コメントの要約

閲覧したWebページと手元のファイルを自前でインデックス化し、あとから全文検索できるようにするOSSの検索エンジン。ブラウザ拡張からページを登録でき、HNでは少し前にも話題になっていた。

コメントでは、Google Chromeが2008年に閲覧ページのオフライン全文検索を目玉機能として搭載し、2013年ごろに削除したことを惜しむ声が上がっている。前回の投稿以降使い続けているという人は、全ページではなく拡張で指定したページだけを登録しており、インデックスが育つほど役立つと報告している。

ほかに、Histreから名称について書簡が届き改名が必要になったとDiscordで見たという情報、Linkwardenと連携してブックマークも検索対象にしたいという要望、最近はChatGPTに尋ねれば以前読んだ記事がかなりの確率で見つかるという声も出ている。

ツールgithub.com438pt / 131コメント既出コメントを見る(新しいタブで開く)スコア 92
2

Astra for Law

OpenAIが最上位モデルGPT-6 Astraに法律検索インデックスと法務分析・起草用の指示を組み合わせた、法律業務向けの基盤を発表した。まず一部の法律事務所に提供する。

コメントの要約

OpenAIが、GPT-6 Astraを法律分野向けに構成した「Astra for Law」を発表した。法律文献の検索インデックスと、法的分析・文書作成のための指示を組み合わせたもので、Techmemeでも同じ発表が上位に入っている。

コメントでは、クラウド時代の暗号解読が時間ではなくコストの問題になったのと同様に、資金力のある側が法的な攻勢をかけやすくなるという指摘や、AIが生成した訴訟で裁判所がさらに圧迫されるという懸念が出ている。ブログ記事にハルシネーションへの言及がないという指摘や、生成した契約書が誤っていた場合に誰が訴えられるのかという質問もある。

Harveyのような法務AI企業を競合ではなく顧客として記事中で挙げている点に目を留める声や、OpenAIは利益面で苦しいと言われるが、ブランドと利用者基盤を武器にあらゆる業界へ進出しているという見方も書き込まれている。

ハイライトAI/LLMopenai.com279pt / 311コメントコメントを見る(新しいタブで開く)スコア 92興味マッチ度 3
3

How GLM built its own inference infrastructure

Z.aiが、10万基を超える中国製AIアクセラレータのクラスタ上に推論サービスをゼロから構築した経緯を解説した記事。GLM-5.3-Flashの本番推論はすべてこの基盤で動いている。

コメントの要約

Z.aiが、GLMシリーズの推論基盤を自社で構築した過程をまとめた技術記事。10万基以上の中国製AIアクセラレータからなるクラスタ上に本番品質の推論サービスをゼロから作り、GLM-5.3-Flashの本番推論はすべてこの上で動いていると記事は述べている。

コメントでは、米国の輸出規制が中国に自前のチップと基盤の開発を急がせ、結果的に利点になっているという見方が複数出ている。一方で、AnthropicのOpus 4.8を経由させた蒸留攻撃で得たものだという批判や、コーディングプランの中位が月20ドル程度から約80ドルに値上がりしており、スケールの限界に当たったのではという推測もある。

別の角度からは、GLM-5.3本体(744BのMoE、4bitのエキスパートで434GB)をNVMe SSDからエキスパートをストリーミングして128GBのMacBook Pro M5 Maxで動かし、SSD1台で約2 tok/s、4台のストライプで3.5 tok/sに達したという報告が寄せられている。

AI/LLMz.ai374pt / 262コメントコメントを見る(新しいタブで開く)スコア 91興味マッチ度 3
4

Fujitsu launches made-in-Japan next-generation CPU FUJITSU-MONAKA

富士通がデータセンター向けの次世代CPU「FUJITSU-MONAKA」の提供開始を発表した。Armベースのプロセッサで、国産であることとAI推論用途を前面に出している。

コメントの要約

富士通が、データセンター向けの次世代CPU「FUJITSU-MONAKA」を製品として発表した。発表文は国産であることやAI推論での用途を強調しているが、Armアーキテクチャに基づくことにはほとんど触れていない、という指摘がコメントの最初に出ている。

製造拠点をめぐっては、「ソブリン」を打ち出す一方で実際に日本で製造されているのか、TSMCに頼っているのかを問う声がある。富士通はかつて国内に自社工場を持っていたがUMCに売却され、そこは20nm前後に留まっているため、製造はJASMではないかという推測も出ている。GPUを作らないのにAI推論を強調する点や、2Uモデルが1Uより記憶容量が少ない点への疑問もある。

企業姿勢については、英国の郵便局スキャンダルへの富士通の関与を挙げ、製品を避けるべきだとする書き込みが複数見られる。

ハードウェアglobal.fujitsu501pt / 191コメントコメントを見る(新しいタブで開く)スコア 84
5

CCC invites all model citizens to 40C3

Chaos Computer Clubが、年末恒例の大会の第40回「40C3」を2026年12月27日から30日に開催すると告知した。今回のモットーは「Model Citizens」。

コメントの要約

ドイツのハッカー団体Chaos Computer Clubが、第40回となる年次大会40C3の開催を告知した。会期は2026年12月27日から30日で、過去の「The Usual Suspects」に続き、今回は「Model Citizens」を掲げている。

コメントでは、DEF CONと対比して包摂的な場として歓迎する声がある一方、年末の日程は若くて独身でないと参加しにくいという声も出ている。反権威やプライバシーを掲げる会議なのに、チケットがクレジットカードと実名によるオンライン購入のみで当日販売がない点を矛盾として指摘する書き込みもある。

過去の参加経験を語るコメントや、同じ週末にドレスデンの地域CCCが開く小規模イベント「Datenspuren」(9月18日〜20日)を紹介する書き込み、警備スタッフの対応への不満も見られる。

セキュリティevents.ccc.de329pt / 178コメントコメントを見る(新しいタブで開く)スコア 83
6

The American Religion of Self-Storage Facilities

米国に広がるセルフストレージ(貸し倉庫)施設と、それを利用する人々を描いたThe New Yorkerの記事。世界の容量の約9割を米国が占めるとしている。

コメントの要約

The New Yorkerによる、米国のセルフストレージ産業とその利用者についての長編記事。コメントで引用された要約によると、米国は世界のセルフストレージ容量の約9割を占め、施設数はスターバックス、マクドナルド、ウォルマートなど大手チェーンの店舗数を合わせたよりも多い。

コメントでは、所有物を生前に整理する「スウェーデン式死の片付け」を倉庫代の代わりに挙げる声や、親を亡くした友人たちが遺品の処分に苦労しているという体験談が出ている。子どもが家具などの遺品を欲しがるという思い込みを問題にした記事の一節への共感も見られる。

一方で、子どもが独立するまでの数年間は倉庫が合理的だという利用者の声や、背景に消費文化と広告があるという見方、車で暮らす人の多さなど住宅問題と結びつける意見も書き込まれている。

newyorker.com186pt / 325コメントコメントを見る(新しいタブで開く)スコア 82
7

Bend – A language that blocks AI mistakes via proof, on CPU and GPU

HVMの作者が公開したBend 2.0。形式的な証明によってAIが生成したコードの誤りを防ぐことを掲げ、CPUとGPUの両方で実行できるとしている。

コメントの要約

Victor Taelinらが開発する言語Bendのバージョン2.0。証明を使ってAIの書いたコードの誤りを防ぎ、CPUとGPUの両方で動くと打ち出している。作者本人がスレッドに登場し、質問を受け付けている。

コメントでは、GitHubのリポジトリが1コミットに潰されており、コンパイラ本体も見当たらないという指摘が出ている。AIの時代には信頼が重要なのに履歴を消すのは疑念を招くという声や、ページの文面がAI生成に見えるという感想もある。

技術面では、形式検証は現実の大規模プログラムにはスケールしないという懐疑、証明の前提となる「法則」自体をAIに書かせれば誤り得るという指摘、証明支援系がGPUの並列性から何を得るのかという質問、Ada/SPARKやLean、Agdaとの比較を求める声が上がっている。

AI/開発bend-lang.com254pt / 133コメントコメントを見る(新しいタブで開く)スコア 79興味マッチ度 2
8

Why I didn’t sign the Fields medallists’ letter

フィールズ賞受賞者のティモシー・ガワーズが、AIをめぐって受賞者たちが連名で出した公開書簡に、自身は署名しなかった理由を説明したブログ記事。

コメントの要約

数学者ティモシー・ガワーズが、フィールズ賞受賞者たちによるAIをめぐる公開書簡に署名しなかった理由を書いた記事。数学界の集合的な理解を深めることと、できるだけ多くの問題に答えが出ることのどちらが重要か、という問いを軸に論じている。

コメントでは、書簡自体はAIに好意的な立場も含んでいるのに、署名しない理由が「理解を目的としない人を傷つけたくない」という微妙なものにとどまり、体面の問題に見えるという失望の声がある。未解決問題は人々が時間をかけて整備・共有してきた資源であり、AI企業はそれを一方的に消費しているという書簡側の論点を補う書き込みもある。

難問を登山にたとえ、飛行機で山頂に降り立っても人間の登攀技術は育たないという意見や、労働が不要になったときに人は何をするのかというAI全般の問題の縮図だとする見方も出ている。

AI/研究gowers.wordpress.com197pt / 288コメントコメントを見る(新しいタブで開く)スコア 76興味マッチ度 2
9

Bonsai 2 27B: Near-Lossless Compression in a 9x Smaller Footprint

PrismMLが、27Bモデルを三値化によって約9分の1のサイズに縮め、品質をほぼ保ったとするBonsai 2 27Bを公開した。GGUF版は同社のllama.cppフォークで動作する。

コメントの要約

PrismMLが公開したBonsai 2 27Bは、27Bパラメータのモデルを三値化によって約9分の1の容量まで圧縮し、元のモデルに近い品質を保つとするもの。Hugging FaceではGGUF形式の重みも配布されている。

コメントでは、Qwen 3.8の27Bは32GB未満のGPUでは動かしにくかったため16GBのカードで試したいという声や、ブラウザ上で完全に動かせるデモの紹介が出ている。ただし長いタスクではすぐに破綻するという評価も同じ書き込みに含まれている。GGUFを動かすにはPrismによるllama.cppのフォークが必要だという注意と、macOSでの手順も共有されている。

100B超のモデルを30GB未満にする版や、スマートフォンで動くQwen 3.8ベースの8B版を望む声のほか、「9倍小さい」という表現は不正確で「9分の1」と言うべきだという指摘もある。

AI/LLMprismml.com184pt / 61コメントコメントを見る(新しいタブで開く)スコア 72興味マッチ度 3
10

My temporary PHP fix from 2014 has nearly 20M installs. Today I'm deprecating it

PHPのhttp_build_url関数のポリフィルとして2014年に公開したパッケージが約2,000万インストールに達し、12年を経て非推奨にすると作者が発表した。Lobstersでも話題になっている。

コメントの要約

標準のPHPにはないhttp_build_url関数を補うため、2014年に一時的な修正として公開したポリフィルが約2,000万インストールに達したという作者の振り返り。コミュニティとPHP本体に代替手段が揃ったことを理由に、12年目で非推奨化するとしている。作者本人もスレッドで質問に答えている。

コメントでは「一時的な修正ほど恒久的なものはない」という反応が目立つ。これほどの利用規模なら、古いStack Overflowの回答から何年も後に辿り着く人のために、移行先を示す非推奨通知付きの最終リリースを出してはどうかという提案や、リポジトリをアーカイブするのかという問いも出ている。

記事で触れられた「a」に関するバグが長く見過ごされていたことへの驚きや、Laravel 5.x時代を懐かしむ声も書き込まれている。

開発jakeasmith.com326pt / 96コメントコメントを見る(新しいタブで開く)スコア 71

Lobsters

10件4件
1

Everybody's Lost Their Minds

AIをめぐる熱狂に周囲が飲み込まれていく状況への違和感を綴ったエッセイ。Lobstersでは当日の首位に入り、コミュニティ間の温度差にも議論が広がっている。

コメントの要約

netmeister.orgのブログに掲載された、AIをめぐる世の中の熱狂に対する違和感を述べたエッセイ。コメントの冒頭には、自分の感じていることをよく言い表しているという共感が並んでいる。

仕事を明かすと真っ先にAIについて聞かれることに疲れているという声が続き、以前は話題を避けるために「数学者だ」と答えていたが、AIのせいでそれも使えなくなったという書き込みもある。

話題はコミュニティの比較にも広がり、LobstersではAIバブルへの懐疑が合意になりつつある一方、Hacker Newsは逆方向に進んでいるという見方が出ている。その理由として、技術以外を扱わないコミュニティとベンチャーキャピタルが運営する掲示板とでは選択圧が異なるという指摘や、分裂生成(schismogenesis)の例だとする意見が挙がっている。

AI/社会netmeister.org98pt / 29コメントコメントを見る(新しいタブで開く)スコア 94興味マッチ度 2
2

A/I Shuts Down

イタリアの非営利ホスティング集団A/I(Autistici/Inventati)が、銀行口座を失ったことでサービス終了を発表した件。米国の制裁リストに絡む口座閉鎖が引き金になっている。

コメントの要約

イタリアの非営利ホスティング集団A/I(Autistici/Inventati)が、取引銀行Banca Eticaに口座を閉じられ、サービス終了を告知した件。発表ページ自体には口座閉鎖の詳細が乏しく、別の告知やイタリア語の記事で経緯が補足されている。

コメントでは米国務省のプレスリリースが示され、口座閉鎖(デバンキング)の枠組みは9.11直後から存在し、2000年代半ばには無害なハワラ業者も巻き込まれたという背景説明が出ている。対象になった理由を、米国の現政権が敵視する国内の活動団体へのサービス提供に求める見方もある。

欧州の決済ネットワークで働く立場からは、USD建ての取引はすべて米国の枠組みを通るため、銀行も自発的にやっているわけではないという説明がある。EUが欧州の裁判所で有罪になっていない相手の口座閉鎖を禁じる法律を作った場合、次に何が起きるのかという問いも投げかけられている。

インフラkeepitfree.ai163pt / 106コメント既出コメントを見る(新しいタブで開く)スコア 89
3

Introducing GNOME 51

デスクトップ環境GNOMEのバージョン51のリリース告知。SQLiteブラウザ「Bobby」の追加、WEPサポートの完全削除、旧来のNVIDIAドライバインターフェースへの対応終了などを含む。

コメントの要約

GNOME 51のリリース告知。新しいアプリとしてSQLiteデータベースを閲覧する「Bobby」が加わったほか、旧来のNVIDIAドライバインターフェースへの対応終了や、WEP無線セキュリティのサポート完全削除などが含まれる。

コメントでは、Bobbyという名前がSQLインジェクションを題材にしたxkcdの回にちなむ冗談だと気づいた反応があり、アプリページにもイースターエッグがあると補足されている。NVIDIAの件は、GTX 10xx世代が切り捨てられると受け取った書き込みに対し、ここでの「レガシー」はEGLStreams方式を指し、旧世代カードのドライバもGBMに対応済みだという訂正が入り、元の投稿者も納得している。

WEPに続いてWPA1も外してほしいという声や、以前バグトラッカーで要望していた可視署名のサポートが入ったことを喜ぶ書き込みも出ている。

OSrelease.gnome.org98pt / 17コメント既出コメントを見る(新しいタブで開く)スコア 82
4

I Don't Like LLMs

Martin Fowlerが、LLMを好まない理由を書いた記事。現在のLLMの話し方への不満を中心に、AIがもたらし得る害と恩恵の両面にも触れている。

コメントの要約

Martin Fowlerが自身のサイトに書いた、LLMを好まない理由についての記事。コメントの読みでは、LLMの利用そのものへの反対というより現在のLLMの伝え方への不満が中心で、末尾ではシリコンバレーのブログラマー文化への警戒にも触れている。

コメントでは、エージェント群によるインフラの乗っ取りや生物兵器の設計への恐れと、奇跡的な治療法や繁栄への期待を並べる書き方を問題視する声が最初に出ている。現実の害が多数あるなかで「使っていて少し不快」という点を取り上げるのは小さすぎる、影響力のある立場ならもっとできるはずだという批判もある。

一方、生物兵器の話は煽りだとしつつ現実の害は存在するとして、OpenAIのエージェントが制限を回避しようとした結果、RubyGems.orgが新規ユーザー登録を止める事態になったという事例を挙げる書き込みがある。martinfowler.comやThoughtworksの最近の記事はバイブコーディングの話ばかりだという不満も複数見られる。

AI/開発martinfowler.com55pt / 18コメントコメントを見る(新しいタブで開く)スコア 79興味マッチ度 2
5

The end of verygoodsoftwarenotvirus.ru

.ruのccTLDで運用していた個人ドメインを手放すことになった顛末の記録。ドメインハックを海外のccTLDで行うことのリスクが議論になっている。

コメントの要約

ドメインハックとして.ruを使っていた個人サイトが、そのドメインを手放すことになった経緯を書いた記事。

コメントでは、他国のccTLDを取ればその国の裁量に従うしかないという指摘が出ている。かつてGoogleのマルウェア判定チームが、配下にマルウェアの多いサブドメインを抱える親ドメインをまとめて判定する仕組みを作ったところ、.ru全体をマルウェア扱いしかけたという昔話も紹介されている。

自分のサイトのURLを不安げに見るという反応が続き、Lobsters自身がセルビアのccTLDである.rsを使っていることから、予備のlobsters.devがあることや、セルビアのレジストリがドメインハックに友好的だという話題へ広がっている。.horseを長年使って満足しているという書き込みもある。

Webblog.verygoodsoftwarenotvirus.dev88pt / 26コメント既出コメントを見る(新しいタブで開く)スコア 79
6

I expected better from Google

AIエージェントを手がけるminitapのブログ記事。同社がApacheライセンスで公開したコードをGoogleが取り込み、後から作者名を削除したと主張している。

コメントの要約

AIエージェントを手がけるminitapのブログに掲載された記事。コメントでの整理によれば、同社がApacheライセンスで公開したコードをGoogleが意図的に、しかも名前を残したまま取り込み、その後に意図的に名前を削除したという内容で、筆者はそれへの失望を綴っている。

コメントでは、LLMそのものが世界中のOSSコードを帰属表示なしに再生産するよう訓練されている以上、同業者に盗用されないと期待するのはおかしいという皮肉が複数出ている。これに対し、今回はAIの出力の問題ではなく、コードが直接かつ意図的に持ち出された件だと区別する反論がある。

ライセンス面では、Googleがライセンスを守ったのかが記事から読み取りにくいという声や、引用されたファイルへの適用が正しくなかったとしても実効的なライセンスはより制限的になるだけで、そもそもApacheライセンスがGoogleの利用を許していたという指摘が出ている。記事自体がAIで書かれたように見えるという皮肉もある。

OSSminitap.ai64pt / 31コメントコメントを見る(新しいタブで開く)スコア 78興味マッチ度 2
7

How to get a DOI for your blog posts

個人ブログの記事にDOIを付与する手順を解説した記事。URLとの違いや、学術的な引用で役立つ場面が議論になっている。

コメントの要約

個人のブログ記事にDOIを割り当てる方法を紹介した記事。クールURIがあるのにDOIで何が変わるのか、という問いから議論が始まっている。

答えとして挙がっているのは、曖昧さの解消における主キーであることを意思表示する意味があり、TLDが一貫性を保つと信頼できない世界ではとくにそうだ、という点。著者本人も応じており、自分のURLがずっと使えることを願ってはいるが、いつかドメインの更新を忘れる、データを失う、.mobiが新所有者に値上げされるといったことが起こり得るため、信頼できる第三者がdoi.orgのIDを新サイトへリダイレクトしてくれる可能性に価値がある、と説明している。

実際の利用場面として、Wikipediaの記事に出典を追加するときにDOIを好むという書き込みがある。プレプリント、著者サイトのPDF、ジャーナル版のどれを指すべきか判断せずに済み、正規の掲載先へ案内される点が理由に挙がっている。自分のブログ記事が論文に引用されたときDOIがあればよかった、という声も出ている。

Webshkspr.mobi73pt / 15コメント既出コメントを見る(新しいタブで開く)スコア 76興味マッチ度 2
8

The Golden Spike, and Resurrecting the Vale(n) Programming Language

実験的な言語Valeの作者verdagonが、開発を止めていた言語をVale(n)として復活させる構想を書いた記事。Redditのr/programmingでも上位に入っている。

コメントの要約

メモリ安全性の新しい手法を探る実験的言語Valeの作者verdagonが、「ゴールデンスパイク」と題して言語をVale(n)として復活させる構想を書いた記事。同じ記事はRedditのr/programmingでも上位に入っている。

コメントでは、まさにハッカーらしい仕事だとして整理後に試したいという声に作者が応じている。今Valeを作者以外が使うべきかという問いには、Valeはバージョン0.2止まりで「興味深い概念実証」程度であり、安定性より開拓、利用者より実験を重視したと作者が答えている。少なくとも3つの言語が線形型を取り入れるきっかけになったので目的は果たした、とも述べている。

記事ページの、脚注を余白に置いてコメントとまとめる表示方式を面白がる書き込みもある。

プログラミング言語verdagon.dev44pt / 5コメントコメントを見る(新しいタブで開く)スコア 69
9

Forgery of C2PA on a Pixel 10

画像の来歴を証明する規格C2PAについて、Pixel 10上で署名を偽造できることを示した検証記事。撮影デバイスによる証明の限界が議論になっている。

コメントの要約

画像の来歴を証明する規格C2PAについて、Pixel 10上で署名を偽造できることを示した検証記事。端末側で署名する方式の前提が崩れる点が論点になっている。

コメントでは、AI生成でないことを証明するために署名が必要になるという発想そのものへの抵抗感が示される一方、C2PAの出発点はAIではなく、報道機関が扱う画像が加工されていないことを確認する統一手段だったという補足が入っている。

技術面では、イメージセンサが生画像をCPUへ渡す前に署名しない限り、root権限を持つ者による署名は防げないという指摘がある。AppleのReference Imageとの違いを問う声や、これを機にPlay Integrityのような端末認証が強まりGrapheneOSのような環境が不利になる懸念、企業が気に入らない画像への署名を拒む可能性を問題視する意見も出ている。

セキュリティhackerfactor.com52pt / 19コメント既出コメントを見る(新しいタブで開く)スコア 67興味マッチ度 2
10

Why i'm still bearish on LLMs after Navier-Stokes

AIがナビエ–ストークス方程式の問題を解いたと報じられた後も、LLMへの悲観的な見方を変えない理由を述べたブログ記事。厳密な仕様記述のコストを論点にしている。

コメントの要約

OpenAIのAIがナビエ–ストークス方程式の問題を解いたと報じられた後でも、LLMに弱気な見方を保つ理由を論じた記事。厳密な仕様を書く労力は、非形式的な仕様をそのまま実装する労力を大きく上回り得る、ハードウェア設計の世界がその好例だ、という一節がコメントで引用されている。

コメントでは、この論点が自分の経験に合うという声に続き、COBOL、AppleScript、Informなど「英語のような言語で誰でもプログラムが書ける」とうたった過去の試みが並べられている。SQLも元はビジネスパーソン向けに設計されたという指摘には、設計者自身の回想が引用される一方、金融の同僚は今もSQLを大量に書いており、最近はLLMに頼っているという反論も付いている。

AI/研究dank.systems49pt / 13コメント既出コメントを見る(新しいタブで開く)スコア 64興味マッチ度 2

Reddit

10件8件
1

Unicode 18.0.0 has been released!

Unicode 18.0.0が公開された。新しい絵文字として、ひび割れた顔、左右を向いたサムズアップ、オオカバマダラ、ピクルス、灯台、流星、消しゴム、柄付きの網などが加わっている。

コメントの要約

UnicodeコンソーシアムがUnicode 18.0.0を公開した。r/programmingでは新しい絵文字の一覧が最初に共有されており、ひび割れた顔、左向き・右向きのサムズアップ、オオカバマダラ、ピクルス、灯台、流星、消しゴム、柄付きの網が挙がっている。

コメントでは、流星と灯台は技術系で人気になりそうだという予想に対し、以前からあったのではという反応が出ている。彗星は既存で、灯台は地図記号の ⛯(U+26EF)しかなかったという補足が付いている。

壁や柵の絵文字がまだないという不満には、レンガの絵文字で代用できるという返答があり、Android以外ではただのレンガにしか見えないという反論が続く。汎用的な名前だと表示がプラットフォームごとにずれるため、新しい絵文字ほど「横に振る頭」「縦に振る頭」のように説明的な名前が付けられている、という説明も出ている。

標準unicode.org既出コメントを見る(新しいタブで開く)スコア 94
2

Be alert: targeted attacks on prominent Rustaceans | Rust Blog

Rust公式ブログが、Rustコミュニティで知られた開発者を狙う標的型攻撃が起きているとして警告を出した。Lobstersでも話題になっている。

コメントの要約

Rustプロジェクトの公式ブログが、コミュニティで知られた開発者を狙う標的型攻撃について警告を出した。r/programmingのほか、Lobstersでも話題になっている。

コメントでは、オープンソース開発者は従来の負担に加えて、犯罪組織や国家が支援するグループから攻撃の足がかりとして狙われるようになり、ますます厳しい立場にあるという声が最初に出ている。依存を気軽に追加できるほどサプライチェーンの攻撃価値は高まるという指摘もある。

対策面では、cargoに公開からの経過日数で依存を制限するフラグがまだないのかという質問に、Rust 1.100.0で入るが当面は既定で無効だという回答と、それまではcargo-cooldownを使えるという案内が付いている。PNGを読むためにimageクレートを入れたら依存が膨大だったという書き込みには、十数形式を扱う汎用画像ライブラリを選んだからだという反論が出ている。

セキュリティblog.rust-lang.orgコメントを見る(新しいタブで開く)スコア 91興味マッチ度 2
3

The Golden Spike, and Resurrecting the Vale(n) Programming Language

実験的な言語Valeの作者verdagonが、言語をVale(n)として復活させる構想を書いた記事。Lobstersでも上位に入っている。

コメントの要約

メモリ安全性の手法を探る実験的言語Valeの作者verdagonによる、言語をVale(n)として復活させる構想の記事。同じ記事はLobstersでも上位に入っている。

r/programmingでは、誰も欲しいと気づいていなかった言語だと歓迎する声とともに、C++で所有権は本当に問題なのかという質問が出ている。作者は、C++は主流言語の中で最良のRAIIを持ち、所有権の管理自体はほぼ解決済みだと答えたうえで、メモリ安全性の意味での所有権は用途次第で、たとえば機微な情報を扱わないWebAssembly向けのゲームなら問題になりにくいと例を挙げている。

これに対し「問題は所有権ではなくC++そのものだ」という短い返しも付いている。

プログラミング言語verdagon.devコメントを見る(新しいタブで開く)スコア 84
4

Mojo 1.1 released, now accepting community contributions to the compiler

Modularのプログラミング言語Mojoがバージョン1.1を公開し、コンパイラ本体へのコミュニティからの貢献を受け付け始めたとPhoronixが報じた。

コメントの要約

Modularが開発するプログラミング言語Mojoのバージョン1.1リリースを伝えるPhoronixの記事。MojoはPythonに近い構文で、CPUやGPUなどのハードウェア向けに高性能なコードを書くことを狙った言語で、今回のリリースからコンパイラ本体へのコミュニティ貢献を受け付けるとしている。

r/programmingのコメントは2件と少ない。REST APIのような汎用的な用途にも使えるのか、それとも主にGPU向けなのかという質問が出ており、かなりPython的な言語なのでAPIも書けるはずだという返答が付いている。コンパイラの公開そのものについての議論はコメント欄には現れていない。

プログラミング言語phoronix.comコメントを見る(新しいタブで開く)スコア 77
5

Scaling Security Insights: how we achieved a 10x increase in global scanning capacity

Cloudflareが、顧客の設定やアプリケーションのセキュリティ上の問題を検出するSecurity Insightsのスキャン基盤を見直し、グローバルなスキャン能力を10倍に引き上げた経緯を解説したブログ記事。

セキュリティblog.cloudflare.comコメントを見る(新しいタブで開く)スコア 73興味マッチ度 2
6

The sort that can't have the best case

入力に関係なく比較回数が変わらない選択ソートを題材に、分岐をなくすcmov命令がかえって直列の依存チェーンを生み、パイプラインを止める過程を追った記事。

コメントの要約

選択ソートは入力が整列済みでも未整列でも同じ回数の比較を行うため、「最良ケース」を持たない。記事はこの性質を出発点に、実際のCPU上で実行コストがどこで生まれるかを、分岐とcmov命令の比較を通じて掘り下げている。

r/programmingのコメントは1件で、本当の見どころは選択ソートそのものではなく、分岐予測ミスがないので常に速いはずのcmov命令が、次の段落では直列の依存チェーンを作ってパイプラインを止める原因に変わる流れだと述べている。分岐をなくしたコードはタダではなく、あるコストを別のコストと交換しているだけだという古典的な教訓の実例だ、という評価である。

アルゴリズム0xax.devコメントを見る(新しいタブで開く)スコア 63
9

Documentation for Online Z3 Guide | Online Z3 Guide

Microsoft Researchが開発したSMTソルバーZ3の使い方を、ブラウザ上で例を実行しながら学べる公式のオンラインガイド。

コメントの要約

Microsoft Researchが開発したSMTソルバーZ3の使い方を、ブラウザ上で例を実行しながら学べるオンラインガイド。Z3は論理式の充足可能性を判定するソルバーで、プログラム検証や制約パズルの求解などに使われる。

r/programmingのコメントは2件で、Advent of CodeのためにZ3を学び直すときに備えてブックマークしたという声と、Z3の開発者らによる解説文書「Programming Z3」へのリンクが共有されている。

形式手法microsoft.github.ioコメントを見る(新しいタブで開く)スコア 43

GitHub Trending

10件1件
1

コーディングエージェントをセキュリティ監査担当に変えるスキル。Cloudflareの脆弱性発見ハーネスの元になったもので、6フェーズの監査を機械可読な検証済み所見として出力する。

記事の要約

Cloudflareが公開した、コーディングエージェント向けのセキュリティ監査スキル。偵察、カバレッジ主導の探索、候補の検証、構造化出力、独立した記録検証、ターゲット中立な報告という一連の流れを、分離されたエージェントに実行させる。同社のブログ「Build your own vulnerability harness」で紹介された脆弱性発見ハーネスの出発点にあたる単一リポジトリ版である。

6フェーズの内訳は、まずアーキテクチャ、信頼境界、入力面、既存の証跡、決定的なカバレッジを `architecture.md` と `coverage-ledger.json` に整理する偵察。次に台帳の単位から分離されたハンターを割り当ててチェックを記録し、カバレッジ批評役に漏れを探させる。

続いて、重複を除いた候補ごとに新しい検証役を立て、それを反証しようと試みる。結果は `confirmed` / `needs_validation` / `rejected` として `findings.json` に書き出し、`report-schema.json` で検証する。最後に新しいエージェントが最終的なソース上の主張を独立に検証し、実質的な差し替えが起きた場合はさらに別の検証役を通す構成になっている。

セキュリティgithub.com+3607 stars today / 計10,664 / JavaScript既出スコア 94興味マッチ度 3
2

Alibaba社内で2年間運用されてきたAIコードレビューアシスタントをOSS化したCLIツール。決定的なパイプラインとLLMエージェントを組み合わせ、行単位のレビューコメントを出す。

記事の要約

Alibaba Groupの社内公式AIコードレビューアシスタントとして2年間で数万人の開発者に使われ、数百万件の欠陥を検出した実績を経てOSS化されたCLIツール。モデルのエンドポイントを設定するだけで動き始める。

動作は、Gitのdiffを読み、ツール利用が可能なエージェント経由で変更ファイルをLLMへ送り、行単位の構造化されたレビューコメントを生成するというもの。エージェントはファイル全体の読み取り、コードベースの検索、他の変更ファイルの参照ができるため、差分表面だけでない深いレビューを出せるとしている。`ocr scan` はdiffのないディレクトリや未知のコードベースの監査向けに、ファイル全体をレビューする。

ベンチマークとして示されているのは、Claude Codeのような汎用エージェントとの比較。同じモデルを使った場合にPrecisionとF1が明確に高く、消費トークンは約1/9でレビューも速い。一方でRecallは汎用エージェントより低く、これは意図的なトレードオフだと明記されている。

AI/開発github.com+3286 stars today / 計34,750 / Go既出スコア 90興味マッチ度 3
3

Cursor、Claude Code、Codexなどのエージェントに、ログイン済みの実ブラウザを操作させるためのCLIと拡張機能。作業は別ウィンドウで進み、利用者のブラウザ操作を妨げない。Tencentが公開している。

記事の要約

AIエージェントに利用者の実ブラウザを使わせるためのツール。Claude CodeやCodexなどのエージェントを、すでにログイン済みのブラウザに接続する。開いているタブを触る場合は明示的に借りて作業後に返却し、それ以外のタブには手を付けない設計になっている。

利点として挙がっているのは、テスト用アカウントを用意せずにログイン状態を再利用できること、ブラウザ作業を別の可視なAgent Windowで実行するため利用者は自分のブラウザを使い続けられること、シェルを呼べるエージェントなら `bsk` CLI経由で使え、特定のモデルやフレームワークに縛られないこと。CAPTCHA、ログイン、確認ダイアログなど人間にしかできない手順では、エージェントが利用者に操作を引き継ぎ、その後に作業を再開できる。

実行環境は `bsk` CLI/デーモンとブラウザ拡張の2つで、macOS、Linux(x64 / ARM64)、Windows x64に対応する。ブラウザはChromeとEdgeをサポートし、Firefoxは計画中とされている。

AI/開発github.com+1302 stars today / 計4,146 / TypeScriptスコア 86興味マッチ度 3
4

Claude Code、Codex、Opencode、Cursorなど複数のエージェントハーネス向けに、スキル・記憶・セキュリティ・調査優先の開発を束ねる性能最適化システム。

記事の要約

エージェントハーネスの性能最適化システムとして、スキル、instincts、記憶、セキュリティ、調査優先の開発を提供する。Claude Code、Codex、Opencode、Cursorなど7つのハーネスへ週次で出荷していると説明されている。

READMEの冒頭には警告が置かれており、インストールは公式チャネルに限るよう求めている。GitHubリポジトリ、npmパッケージの `ecc-universal` と `ecc-agentshield`、GitHub App、プラグインスラッグ `ecc@ecc`、プロジェクトサイトecc.toolsが正規で、第三者による再アップロードや非公式ミラーは保守も審査もされておらずマルウェアを含む可能性がある、としている。

Claude Codeへの導入は、ガイド付きセットアップかネイティブのプラグインコマンドのどちらかで、いずれも同じ `ecc@ecc` プラグインを入れる。両方を重ねて入れないよう注意書きがある。ライセンスはMITで、OSS部分は無料のまま、私有リポジトリ向けのホスト型GitHub AppであるECC Proとスポンサーが開発を支えるモデルを取っている。

AI/開発github.com+1171 stars today / 計261,174 / JavaScript既出スコア 82興味マッチ度 3
5

TencentのOSS知識基盤。文書をRAGで検索できる形にし、ReActエージェントによる自律推論と、自動更新されるWikiモードを備える。

記事の要約

企業向けの文書理解、意味検索、自律推論を想定したLLMベースのOSS知識フレームワーク。日常的な参照用のRAG即答、検索やMCPツール、テナント単位のスキルカタログ、セッション永続のDocker / E2B / Cubeサンドボックス、Web検索を自律的に組み合わせて多段タスクを処理するReActエージェント、という2つの軸を持つ。

新たに加わったWikiモードでは、エージェントが生の文書を、相互リンクされ自動で維持されるMarkdownの知識ベースへ蒸留する。対話的なナレッジグラフを備え、手動編集、改訂履歴、ワンクリックのロールバックにも対応する。

セッションをまたいだ長期記憶により、利用者が誰で何を繰り返し尋ねているかを保持する。知識の整備面では、アップロードしたディレクトリ構造を保つツリー型のフォルダビューや、チャンク単位の操作が用意されている。

AI/開発github.com+1125 stars today / 計26,219 / Go既出スコア 78興味マッチ度 2
6

Claude CodeやCodex、OpenCode、Cursorを研究エージェントに変えるローカルファーストのワークスペース。文献調査、仮説立案、実験実行、成果物生成までを扱う。

記事の要約

コーディングエージェントを研究エージェントとして使うためのローカルファーストなワークスペース。文献レビュー、仮説の構築、実験の実行、研究成果物の作成までを対象とする。macOS 11以降に対応し、WindowsはベータでGit for Windowsを必要とする。

導入はmacOSまたはLinuxでCLIをインストールし、`orx up` を実行するとローカルダッシュボードが `http://127.0.0.1:4791` で開く。LM Studio、oMLX、Ollama、独自エンドポイントをOpenCode経由で接続してローカルモデルを使うこともできる。

提供される機能として挙がっているのは、研究の方向ごとに独立したエージェントセッションと分離されたgit worktreeを与える並列探索、gitネイティブな実験ツリーでバリアントを追跡し各実行に記録したコミットの不変アーカイブを残す再現性、ログ・差分・ファイル・結果・成果物を生成元の作業に紐づけて保持する証跡管理、セッション単位でハーネスとモデルを選べる点である。

AI/開発github.com+939 stars today / 計4,952 / Rust既出スコア 74興味マッチ度 2
7

NSAが開発・保守しているリバースエンジニアリングフレームワーク。逆アセンブル、逆コンパイル、グラフ表示、スクリプティングを備え、Windows / macOS / Linuxのバイナリを解析できる。

記事の要約

米国国家安全保障局の研究部門が作成・維持しているソフトウェアリバースエンジニアリング(SRE)フレームワーク。Windows、macOS、Linuxを含む複数プラットフォームのコンパイル済みコードを解析するための高機能なツール群を含む。

機能には逆アセンブル、アセンブル、逆コンパイル、グラフ表示、スクリプティングのほか数百の項目があり、幅広いプロセッサ命令セットと実行形式に対応する。対話的な利用と自動実行の両方が可能で、利用者はJavaまたはPythonで独自の拡張コンポーネントやスクリプトを開発できる。

開発の背景として、複雑なSRE作業におけるスケールとチーム連携の課題を解くため、またカスタマイズ可能で拡張性のあるSRE研究基盤を提供するために作られたと説明されている。NSAはこの機能を悪意あるコードの解析や、ネットワークとシステムの潜在的脆弱性の把握に適用してきたとしている。

セキュリティgithub.com+912 stars today / 計78,487 / Java既出スコア 70
8

744Bから2.8Tパラメータの大規模MoEモデルを、ストレージ・RAM・VRAMを単一の階層として扱うことで手元のハードウェアで動かす、依存なしの純C推論エンジン。

記事の要約

コンシューマ向けやヘテロジニアスな環境で、744Bから2.8Tパラメータのフロンティア級MoEモデルを動かすことを狙った推論エンジン。エンジン側の依存をゼロにした純Cで書かれ、ストレージ・RAM・VRAMをひと続きのメモリ階層(AIメモリ多段化)として扱う。

現在動作する系列として、GLM-5.2/5.3(744B)、GLM-5.3-Flash(321B、ビジョン対応)、Inkling(975B)、Kimi K3(2.8T)、DeepSeek V4 Flash(284B)、DeepSeek V4.1 Flash(552B、ビジョン対応)、Qwen3.8-Flash-Next(125B + 51B n-gram)、Qwen3.6(35B-A3B)、OLMoE(7B)の9ファミリーが挙げられている。いずれもモデルごとに1つのCファイルで、`coli chat` / `coli serve` / `coli web` という共通のフロントエンドを持つ。

プロジェクトは実用エンジンであると同時にオープンな研究基盤という位置づけで、モデル形式、メモリ階層、ストレージI/O、配置、スケジューリング、カーネル、投機実行、CPU/GPUのオーバーラップまで含めて推論性能を追う。速度についてのSLAはなく、意味論の保証は厳格、実験は再現可能なエンドツーエンド計測で価値を示す、という方針を掲げている。

AI/開発github.com+873 stars today / 計35,742 / C既出スコア 66興味マッチ度 3
9

SwiftUIとAppKitだけで書かれたmacOSのランチャー。サードパーティ依存なし、Electronなし、テレメトリなしで、Raycastの拡張機能をネイティブに実行できる。

記事の要約

1つのホットキーで日常的に使うものへ到達できる、メモリ100MB未満のmacOSネイティブランチャー。SwiftUIとAppKitで書かれ、サードパーティ依存はゼロ、Electronもテレメトリも使わない。実際のRaycast拡張機能をネイティブのSwiftUIとして描画して実行できる点を特徴に挙げている。無料かつオープンソースで、今後もそのままだとしている。

機能はアプリランチャー(あいまい検索での起動、お気に入りのピン留め、起動中アプリの確認、個別または一括の終了)、どこからでも呼び出せるグローバルホットキー、アプリごとにキーを割り当ててフォーカスと非表示を切り替えるアプリ別ホットキー。

ファイル検索は独自インデックスを持たず、指定したフォルダをSpotlight経由で検索する。ほかにテキストと画像を対象とする検索可能なクリップボード履歴(元のアプリへ貼り戻せる)、計算・単位・為替の変換をパレット内で行う電卓、URLや検索、ファイル、ディープリンクをコマンド化し入力・クリップボード・日付をプレースホルダとして使えるQuicklinksを備える。

ツールgithub.com+739 stars today / 計6,149 / Swift既出スコア 62
10

AIコーディングエージェント向けに、開発ライフサイクルの各段階へ対応する9つのスラッシュコマンドとスキルをまとめたリポジトリ。Addy Osmaniが公開している。

記事の要約

シニアエンジニアが使うワークフロー、品質ゲート、ベストプラクティスをスキルとして符号化し、AIエージェントが開発の各フェーズで一貫して従えるようパッケージしたもの。DEFINE → PLAN → BUILD → VERIFY → REVIEW → SHIP という流れに沿って構成されている。

用意されているのは開発ライフサイクルに対応する9つのスラッシュコマンドで、各コマンドが適切なスキルを自動的に有効化する。`/spec`(コードの前に仕様)、`/plan`(小さく原子的なタスク)、`/build`(一度に1スライス)、`/test`(テストは証明)、`/constraints`(一度決めてどこでも強制)、`/review`(マージ前にコードの健全性を上げる)が挙げられている。

このほか `/webperf`(最適化の前に計測するWebパフォーマンス監査)、`/code-simplify`(賢さより明快さ)、`/ship` が並ぶ。各コマンドに「何をしているとき」「どのコマンド」「鍵となる原則」を対応づけた表が示されている。

AI/開発github.com+680 stars today / 計95,853 / JavaScript既出スコア 58興味マッチ度 3

Techmeme

10件
1

NYT court filing: ChatGPT's head wrote that publishers face an “existential threat” from AI, and a Microsoft director called AI training “an astonishing theft”

NYTがOpenAIとMicrosoftを訴えた裁判の提出資料で、ChatGPTの責任者が出版社はAIによる存亡の危機に直面すると書き、Microsoftの幹部がAIの学習を「驚くべき窃盗」と呼んでいたことが明らかになったとFTが報じた。

AI/社会ft.comコメントを見る(新しいタブで開く)スコア 97興味マッチ度 2
2

Anthropic outlines metrics to track AI development at frontier labs: how much AI R&D is done by AI, how well agents are overseen, and how compute is allocated

Anthropicが、AI研究開発のうちAI自身が担う割合、エージェントがどれだけ適切に監督されているか、計算資源がどう配分されているかといった、AI開発のペースを測る指標を提示した。

AI/研究anthropic.comコメントを見る(新しいタブで開く)スコア 95興味マッチ度 3
3

The US SEC unveils a five-year Innovation Exemption for platforms that offer tokenized stock trading, relieving them of many rules that apply to stock exchanges

米証券取引委員会が、トークン化された株式の取引を提供するプラットフォームに対し、証券取引所向けの規則の多くを免除する5年間の「イノベーション免除」を発表した。

フィンテックreuters.comコメントを見る(新しいタブで開く)スコア 94
4

Anthropic says Claude “leads” 26% of its AI R&D work, up from 1% in March, and “collaborates” on 90%+, doing large chunks of work under close human direction

Anthropicによると、同社のAI研究開発のうちClaudeが主導する作業は3月の1%から26%に増え、90%超の作業ではClaudeが人間の密な指示のもとで大きな部分を担って協働している。Bloombergが報じた。

ハイライトAI/研究bloomberg.comコメントを見る(新しいタブで開く)スコア 92興味マッチ度 3
5

Anthropic redesigns Claude projects, letting users describe work in one conversation and have Claude manage it across parallel threads, starting in Claude Code

Anthropicが、Claudeのプロジェクト機能を作り直したと発表した。1つの会話で作業内容を伝えると、Claudeが複数の並列スレッドに分けて進行を管理する。まずClaude Codeでベータ提供される。

AI/開発claude.comコメントを見る(新しいタブで開く)スコア 90興味マッチ度 3
6

OpenAI launches Astra for Law, combining GPT-6 Astra with a legal search index and instructions for legal analysis and writing, initially for select law firms

OpenAIが、GPT-6 Astraに法律検索のインデックスと法的分析・文書作成用の指示を組み合わせたAstra for Lawを発表した。当初は一部の法律事務所に提供する。Hacker Newsでも上位に入っている。

AI/LLMopenai.comコメントを見る(新しいタブで開く)スコア 87興味マッチ度 3
7

Huawei Chair Eric Xu says Chinese AI researchers need to “increase the speed of development” to “see the dangers” of AI, contrasting with the US' slowdown calls

Huaweiのエリック・シュー(徐直軍)会長が、中国のAI研究者はAIの危険を見極めるためにも開発のスピードを上げる必要があると述べた。シリコンバレーの減速論とは対照的な発言としてFTが報じた。

8

Huawei plans to debut the Ascend 960DT AI chip in Q1 2027 and the 960PR in Q3 2027, and unveils an architecture to let up to 1M processors operate as one system

Huaweiが、AIチップAscend 960DTを2027年第1四半期、960PRを同年第3四半期に投入する計画を示し、最大100万基のプロセッサを単一のシステムとして動かすアーキテクチャも公表した。

ハードウェアreuters.comコメントを見る(新しいタブで開く)スコア 76
9

Source: OpenAI staff expect the Hodge Conjecture, a Millennium Prize Problem, to be solved relatively soon, after solving the Navier-Stokes equations

The Informationによると、OpenAIのスタッフは、ナビエ–ストークス方程式に続いてミレニアム懸賞問題の1つであるホッジ予想も比較的早く解けると見込んでいる。

AI/研究theinformation.comコメントを見る(新しいタブで開く)スコア 74興味マッチ度 2
10

Lucid and Bolt sign an initial agreement to deploy 25K+ robotaxis in Europe built on Lucid's EV platform for affordable models, set to launch as soon as 2028

EVメーカーのLucidと配車サービスのBoltが、Lucidの廉価モデル向けEVプラットフォームで作るロボタクシーを欧州に2万5,000台以上配備する初期合意を結んだ。早ければ2028年に始まる。

モビリティft.comコメントを見る(新しいタブで開く)スコア 73

日本

はてなブックマーク

10件
1

みのるん氏による、Claude Codeを使うほど育つAI秘書として運用するノウハウをまとめたスライド。同氏の著書『[みのるん式]ビジネスパーソンのためのClaude Code仕事術』と同じテーマを扱う。

コメントの要約

Speaker Deckで公開された、Claude Codeを日々の仕事に使いながら「使うほど育つ」AI秘書へ仕立てていくためのノウハウ資料。作者のみのるん氏は同じテーマの書籍も出しており、はてなブックマークでは約500ユーザーを集めてテクノロジーカテゴリの首位に入っている。

ブックマークコメントは評価が割れている。平易な言葉でわかりやすく説明用に使えそうだという声や、辛辣なコメントが多い割にこれだけブックマークされているのは知りたい人が多い証拠だという見方がある一方、非エンジニアから見ても内容が初歩的すぎるという感想や、「遅れている」という指摘も付いている。

実践面では、1年ほど前から実践すれば仕事になると言われる内容がLLMの性能向上で変わったという印象や、人間が読まない引き継ぎファイルはMarkdownよりJSONがよいとAIに教わって変更したという報告が書き込まれている。ClaudeのデスクトップアプリとCodexのWindowsアプリの公開時期を訂正するコメントもある。

ハイライトAI/開発speakerdeck.com498 usersコメントを見る(新しいタブで開く)スコア 94興味マッチ度 3
2

毎朝同じプロンプトを打ち込んでいた経験を入り口に、Claude Codeのスキル機能で定型の指示を自動化する方法と、実用的なスキル5つを紹介したビジネス+ITの記事。

コメントの要約

ビジネス+ITに掲載された、Claude Codeのスキル機能を紹介する記事。Gmailの未読メールを整理させるような同じ指示を毎朝入力していた違和感から、繰り返しの指示をスキルとして保存して自動化する方法と、実例5つを紹介している。掲載日は2026年9月17日。

ブックマークコメントでは「いつの記事だよ」という反応が目立ち、そうした記事に200以上のブックマークが集まっていることや、ブックマーク数とコメント数の差を指摘する声がある。AI以前なら2年前の技術記事にそこまで古い印象は持たなかったはずで変化の速さが怖いという感想や、そう言われるほどスキルが広まったということだという見方も出ている。

中身については、コピペしていた指示をファイルに保存したものがスキルであり、自分と微妙に違う他人のスキルを使う理由がわからないという意見と、SKILL.mdを置くだけでCLIの独自コマンドになるのはプロンプトの省力化に便利だという声が並んでいる。

AI/開発sbbit.jp245 usersコメントを見る(新しいタブで開く)スコア 91興味マッチ度 3
3

2025年12月に「Claude CodeのAgent Skillsは設定したほうがいい」と書いた筆者が、その後半年の変化を踏まえ、Skillsを定期的に見直す必要を論じたブログ記事。

コメントの要約

筆者は2025年12月に、必要な手順を必要なときだけ読み込ませる仕組みとしてAgent Skillsを紹介する記事を書いていた。今回はその後半で触れた、設定が増えるほど管理が難しくなる問題、つまりどのSkillが実際に使われているのか、似た説明のSkill同士が出番を奪い合っていないかといった点を掘り下げる続編にあたる。

ブックマークコメントには、Claude Codeの設定や使い方がこの半年で大きく変わったので書いていく、まずはSkillから、半年前に作ったSkillを使い続けるのはコンテキスト効率が悪い場合もある、という趣旨の要約が付いている。一方で、AIで書かれたブログのようで見出しの意味がわからず、「〜ではありません。〜です」の連発で読みづらいという批判も出ている。

AI/開発syu-m-5151.hatenablog.com133 usersコメントを見る(新しいタブで開く)スコア 86興味マッチ度 3
4

AWSが、戦争で損傷した中東のデータセンターの復旧を断念し、バーレーンリージョン全域とUAEの1ゾーンのリソースとデータにアクセスできないと発表したと伝える記事。

コメントの要約

AWSが、イランとの戦争で損傷した中東のデータセンターについて復旧を断念し、バーレーンリージョン全域とUAEの1ゾーンのリソース・データへのアクセスを回復できないと発表した、とまとめた記事。大手クラウドの物理インフラが戦争で破壊され、顧客データが永久に失われた初の事例だとしている。

ブックマークコメントでは、マルチAZ構成がリージョン全体の物理的破壊に無力なのは当然だという反応や、3-2-1バックアップルールを挙げる声が出ている。S3やスナップショットの冗長化はリージョン内にとどまるため、利用者が自分でリージョン間の転送料を払ってコピーを取っておく必要があったという整理もある。

本文によれば規制業種にはデータの国内保存義務があり、地元にしかデータを置けなかったという指摘や、なぜリスクのある場所に建てたのかという疑問、米国の判断ひとつで利用できなくなるリスクもあるという書き込みも見られる。

クラウドjoho-todai.com196 usersコメントを見る(新しいタブで開く)スコア 84
5

デジカメや妊娠検査キット、さらにはハエの中枢神経系のデータまで、世界中のハッカーがあらゆるものでDOOMを動かそうとする文化を紹介したブログ記事。

コメントの要約

Google Researchらがハエの中枢神経系を網羅したデータセットを公開した直後、それを使ってシミュレーション上のハエにDOOMをプレイさせる試みが現れた、という話題から始まるブログ記事。デジタルカメラや妊娠検査キットなど、世界中のハッカーが意外なデバイスでDOOMを動かしてきた事例と、その理由を紹介している。

ブックマークコメントは1件で、自分の家庭生活とは関係ないと思いながら遊び半分で検索したら、プリンターへの移植例まで見つかったという反応が付いている。

nomolk.hatenablog.com89 usersコメントを見る(新しいタブで開く)スコア 84
6

オントロジーやナレッジグラフなど、AI時代のデータ基盤で使われる用語の意味と関係を実例付きで整理したQiita記事。

コメントの要約

オントロジー、ナレッジグラフなど、AIエージェントとデータ基盤の文脈で使われるようになった用語をざっくり理解するためのQiita記事。取得できた抜粋には本文が含まれておらず、内容の把握はブックマークコメントに頼る形になる。

ブックマークコメントでは、各ベンダーが自社製品に都合よく「オントロジー」という言葉を使うことで混乱が生じているなか、きちんとした定義をまとめてくれるのは助かるという声や、実例付きで最近の用語が整理されていてわかりやすいという評価が出ている。

一方で、エージェントの能力が上がりすぎて、このあたりの技術はすぐに廃れるだろうという見方も書き込まれている。

AI/データqiita.com121 usersコメントを見る(新しいタブで開く)スコア 83興味マッチ度 2
7

パスキー自体は破られていないのに、デバイスコードフローを悪用する攻撃でサインインを突破される仕組みと、Entra IDの条件付きアクセスなどによる対策を解説した記事。

コメントの要約

APC技術ブログの記事。パスキーの仕組みとEntra IDでのパスキー対応を説明したうえで、パスキーそのものを破らずにサインインを突破されるデバイスコードフロー攻撃の手口を解説している。デバイスコードフローは入力手段の限られた端末向けの認可方式で、攻撃者が発行したコードを被害者に入力させると、被害者の正規の認証が攻撃者側のセッションに結び付いてしまう。

対策として、Entra IDの条件付きアクセスによるブロック、除外設定が必要なケース、Microsoft Entra ID Protectionの活用が目次に並ぶ。ブックマークコメントは1件で、記事の内容を「パスキー破壊ではなくDevice Code Flow攻撃で突破される事例と対策の解説」とまとめている。

セキュリティtechblog.ap-com.co.jp100 usersコメントを見る(新しいタブで開く)スコア 81興味マッチ度 2
8

TypeSafe AIが発表した、文章を生成せず分類・採点・条件判定を確率付きで返すモデルJevについて、従来のLLMとAIエージェントの組み合わせと比べて位置づけを整理した記事。Qiitaでも首位。

コメントの要約

2026年9月15日にTypeSafe AIが発表したJevは、文章や業務データを読み取り、分類・採点・条件判定の結果を確率付きで返すモデル。記事はAmazon Bedrock AgentCoreで組む従来型のLLM+AIエージェントと比較し、Jevの役割は処理のルーティング役で、プログラムは返った数値を比べて処理を選ぶだけだと整理している。同じ記事はQiitaのトレンドで首位に入っている。

ブックマークコメントでは、ルーティング役と割り切って決定論的なコードと組み合わせる発想が面白いという声や、LLMの生成結果が曖昧なときにユーザーへ最終判断を委ねていた既存ツールを改善できそうだという声が出ている。「これをやれば速いのでは」という発想に皆が一斉に走り出す状況を楽しむ一方、エージェント型LLMの計算資源に大きく投資していた側には笑えない話だろうという書き込みもある。

AI/LLMqiita.com81 usersコメントを見る(新しいタブで開く)スコア 79興味マッチ度 3
9

Jevのデモを見て既存のLLMでもできるのではと考えた筆者が、Gemma3 270Mで回答候補の単一トークンのlogitを比べる方式を試し、JSON出力比77倍の高速化を報告した記事。

コメントの要約

JevのJSON出力やDOOMのデモを見た筆者が、回答候補を単一トークンに対応させてlogitだけを比較し、共通プロンプトのKV Cacheを再利用して質問をバッチ推論すれば既存LLMでも同じことができると考え、Gemma3 270Mで検証した記事。JSONを自己回帰生成する場合と比べて77倍の高速化を報告している。Zennでも首位に入っている。

ブックマークコメントでは、単一トークンのlogit比較による高速化の検証とJevの立ち位置の考察が鋭いという評価がある。一方で、コストとレイテンシが数十倍から数百倍違う点にこそ意味があり、リアルタイム用途や大量処理、LLMへの前処理に使えるという反論や、Jevが確率を正しく推定・校正できるとされる点に触れていないという指摘も出ている。

Jevそのものについては、確率とはソフトマックス的なものなのかという疑問や、せめてテクニカルレポートを出してほしい、現状はブラックボックスすぎるという声もある。

AI/LLMzenn.dev68 usersコメントを見る(新しいタブで開く)スコア 77興味マッチ度 3
10

NICTが、2026年9月9日に公開NTPに関わる装置で異常が発生し、冗長系の一部から誤った時刻が配信されたと公表した。原因は調査中で、判明した状況を説明している。

コメントの要約

情報通信研究機構(NICT)が、日本標準時を供給する公開NTPサービスで、2026年9月9日に装置の異常により冗長系の一部から誤った時刻が配信されたと発表した。原因は調査中で、現時点までに判明した状況を説明する内容になっている。

ブックマークコメントでは、知らなかったという驚きや、ログやバックアップへの影響を心配する声、時刻のステップ調整の怖さを挙げる声が出ている。こうしたトラブルを想定した対策はどうやるのかという疑問や、有事に狙われるのではという懸念も書き込まれている。

インフラnict.go.jp67 usersコメントを見る(新しいタブで開く)スコア 70

Zenn

10件3件
1

TypeSafe AIのJevに対し、既存LLMで回答候補の単一トークンのlogitを比べる方式を検証した記事。Gemma3 270MでJSON出力比77倍の高速化を確認し、マリオのハーネスでも比較している。

記事の要約

Jevのデモを見た筆者は、既存のLLMでもできるのではと考えた。出力候補が決まっているなら、候補を単一トークンに対応させて最初の1トークンのlogitを比較すれば、1回のforward passで判断を取り出せる。独立した質問はバッチ推論し、共通の長いプロンプトはKV Cacheを再利用し、JSONはコード側で組み立てる。

この方式をGemma3 270Mで実装してJSON出力と比べたところ、77倍の高速化になった。LLMと比較するならこの方式と比べないとフェアではない、というのが筆者の立場である。

続いて、第三者が公開したマリオのハーネスでJevと複数のLLMを比較した。筆者の環境ではJevのレイテンシが公開デモの約3倍あり、デモほどうまくプレイできなかったが、同じ環境のLLMの中ではJevが最も良い結果だった。ただしlogitを取得できるAPIの都合で比較対象は主に旧世代の非推論モデルで、Jevが最新のLLMより優れているとは言い切れないとしている。

ハイライトAI/LLMzenn.devいいね70 / ブクマ12スコア 86興味マッチ度 3
2

macOS常駐AIアシスタント「CooSenpAI」をバイブコーディングで作る過程で、画面が増えるほど動作が壊れていった経験から、GUI構造を指定し直すプロンプトを導き出した記事。

記事の要約

Claude Fable 5.1とGPT 6 Astraを組み合わせてバイブコーディングしたmacOSアプリで、吹き出し・設定画面・詳細画面・アバターが同時に表示されるようになったところ、キーの連打で画面が反応しなくなる、取り消しキーを押さないと戻らない、出るべき画面が出ないといった不具合が続いた。AIに修正を頼んでも直らなかったという。

原因は、各画面が自分で表示・非表示を決め、さらに隣の画面を直接操作していたこと。会話画面が吹き出しを隠したり、設定画面がアバターの表示を変えたりして処理が衝突し、排他制御や待ち時間、リトライを場当たり的に継ぎ足した結果、1つ直すと別の場所が壊れる状態になった。

対策として記事が提示するのは、全コンポーネントをRootの配下に置き、各コンポーネントはMVPのPassive Viewとして描画パラメータだけを扱い、動作はChain of Responsibilityでイベントをバブリングさせ、ステートマシンとして振る舞うMediatorに裁定させる、という指示をそのままAIに渡すプロンプト。

AI/開発zenn.devいいね186 / ブクマ100既出スコア 84興味マッチ度 3
3

自社CMS「Orizm」のデザインエディターにWebMCPを組み込み、Codexのブラウザ操作でページ作成を任せた場合と組み込まない場合を比べた検証記事。

記事の要約

WebMCPは、Webページ側がAI向けの操作(ツール)をブラウザ上で直接提供する仕組み。フロントエンドにツールを登録するため、ブラウザでログインしていればエージェント側に特別な認証設定が要らず、保存前の画面上のデータもJavaScript経由でAIから操作できる。定義方法には属性を付ける宣言型と関数を登録する命令型があり、React製のエディターには命令型を採用した。

WebMCPは2026年9月時点でW3Cのコミュニティグループで議論中の提案仕様で、Chromeではフラグ付きプレビューとオリジントライアルの段階にあり、navigator.modelContext から document.modelContext への変更など仕様変更が続いている、と記事は注記している。

検証ではCodexのブラウザ操作(GPT-6 Astra、Effort中)で、入稿済みの参考ページと同じデザインのページを再現させた。WebMCPなしでは、Codexが参考ページの設定値を1つずつ読み、別タブの編集画面でモーダル操作や入力を人間と同じように重ねていった。

AI/開発zenn.devいいね53 / ブクマ21スコア 83興味マッチ度 3
4

ShopifyがReact Nativeからネイティブ開発へ戻ると表明した記事を教材に、クロスプラットフォーム開発が削減しているコストの正体を整理した論考。

記事の要約

2026年9月にShopify Engineeringが「Native is now the future of mobile at Shopify」を公開した。2020年にReact Nativeへ寄せ、コミュニティへ投資してきた企業の方針転換として受け止められ、クロスプラットフォームには無理があったという反応も出た。

筆者は、Shopify自身は「React Nativeは失敗だった」とは書いていない点を確認する。2020年当時の課題はiOSとAndroidで同じ機能を二度実装して同期させ続けることで、React Nativeはその重複を減らし、Web中心の開発者がモバイルへ参加しやすくなる効果があった。追従コスト、ネイティブ層との境界、外部ライブラリ依存、パフォーマンスといったコストは当時からあり、それでも天秤が釣り合っていた。

2026年に天秤が動いた理由として挙がるのが、ShopifyがCoding Agentを開発プロセスへ深く組み込み、片方の実装を参考にもう片方を実装させ、テストとレビューで挙動を揃える仕組みを整えたこと。ネイティブ2本のコストがゼロになったわけではないが2020年ほど高くなくなった、という構図で整理されている。

モバイルzenn.devいいね131 / ブクマ19既出スコア 81興味マッチ度 2
5

Claude Code / Codex / Agyを併用する17万行のプロダクトで、レビューのトークン消費を抑えるためGeForce 3060上のローカルLLMへレビューを任せた記録。

記事の要約

3エージェント併用で開発している17万行規模のプロダクトでは、生成されたコードを人間が全部レビューすることは実質不可能で、レビューもトークンを消費する。そこで12GBのGeForce 3060で動く用途を絞ったローカルLLMを試し、Ollamaでqwen2.5-coder:14bを使った。

Issue単位でブランチを切り、規模が大きければスライスに分けて小さく実装を回す進め方を前提に、gitのステージに上がった差分から重大な問題だけを挙げさせる構成を取っている。Modelfileでtemperature 0.05、top_p 0.8、num_ctx 8192を指定し、自分用モデルを生成する。

システムプロンプトでは要約・説明・挨拶・総評の類を禁止し、検出対象をデータ損失リスク、クラッシュリスク、セキュリティ境界の破壊、path traversal、Electron IPC境界の破壊、async / race condition、null・undefined・空状態、off-by-one、ファイルパスやURLエンコード、Unicode処理の重大な不整合に限定している。

AI/開発zenn.devいいね76 / ブクマ42既出スコア 79興味マッチ度 3
6

mizchi氏がルールベースの五目並べを実装し、Jev同士を対戦させて応答速度とログを実測した速報記事。実装はGitHubで公開している。

記事の要約

Jevは意図的に出力を限定することで精度と速度を得るモデルで、現時点でできるのはYES/NOを答える、選択肢から選ぶ、点数を付けるの3つ。そのためチャットAIと違い、構造の制約をどう設計するかが肝になると筆者は位置づけている。冒頭では、プログラマは既存のチャットアシスタントよりJevのような構造化されたエージェントを好むだろうという感想を述べている。

検証では五目並べを実装し、盤面サイズ15、手番、ルール、表記法、アスキー盤面、直近の手をstateとして渡し、questionsに現在取り得る手だけを選択肢として並べて最善手を選ばせる。各選択肢には自分と相手の最良ラインの形勢をヒントとして付けており、候補の絞り方にはチューニングの余地があるとしている。

対戦ログはJSON Lines形式で、各手の経過時間、confidence、フォールバックの有無、勝敗が記録される。初手は603msで確信度1だった。実装は mizchi/jev-gomoku として公開されている。

AI/LLMzenn.devいいね41 / ブクマ2スコア 78興味マッチ度 3
7

GitHub Issueを取るところからPR作成までの毎日の流れを、Claude Code のスキル `todays-work` として定型化した記録。Claude Codeを主、Codexを従とするクロスレビュー構成を採る。

記事の要約

毎回同じ流れ(Issueを取る → AIに設計と実装を任せる → 別のAIにレビューさせる → 動作確認 → PR作成)で開発しているのに、その都度指示を出していたため、一連の手順をスキルへまとめた記録。前提としてGitHubでのIssue管理を使うが、AIとやり取りできればNotionでもTrelloでもよいとしている。

役割分担は、Claude Codeが設計・実装と外部(GitHub・Codex・人間)とのやり取りを担当し、Codexはレビューのみ。先入観なくレビューさせる点に注意を払い、人間のレビューにはcritを使うクロスレビュー構成になっている。サブエージェントへの切り出しは、使いこなせていないという理由で採用していない。

スキルは特定リポジトリに閉じないよう `~/.claude/skills/` へ置き、どのリポジトリからも呼べるようにしている。名前は `todays-work` で、descriptionには `/todays-work` で明示的に呼ばれたときだけ使う旨を書いている。

AI/開発zenn.devいいね52 / ブクマ21既出スコア 71興味マッチ度 3
8

2026年9月にAWS Lambdaの関数タイムアウトが15分から最大90分へ拡張された件を、CDKで検証環境を組んで実測した記事。適用条件が2つあり、同期呼び出しは対象外である点を検証している。

記事の要約

拡張の対象は、Lambda Managed Instances (LMI) 上で動く関数であること、かつ非同期呼び出しまたはESM(イベントソースマッピング)経由の呼び出しであること、という2条件を両方満たす場合に限られる。同期呼び出し(RequestResponse)は従来どおり15分のままで、API Gatewayや関数URLの背後にある関数はTimeoutに5400を設定しても15分でタイムアウトする。

変更点は表で整理されている。非同期呼び出しとSQS / Kinesis / DynamoDB StreamsのESMが15分から90分(LMIのみ)になり、Amazon MQ / DocumentDBのESMとInitフェーズは15分のまま。設定は従来のTimeoutプロパティのままで、上限が900秒から5,400秒に上がっただけとされている。

筆者はCDKで検証環境を組み、S3にファイルが置かれたら重い変換処理を回すという王道パターンが、15分の壁を気にせず1関数で組めることを実測で確認している。durable functionsと組み合わせた場合に何が変わるかも検証対象に含めている。

クラウドzenn.devいいね33 / ブクマ6既出スコア 66
9

フィールズ賞受賞者らが連名で表明したAI濫用への懸念を出発点に、数学コミュニティの都合ではなく数学自体の発展という観点から、AIの濫用が知的生産に与える影響を論じた記事。

記事の要約

筆者は数学者ではなく、システム開発目的で毎月数十万円分のトークンを使う立場で、AI自体には肯定的だと前置きしている。そのうえで、数学者の都合という見方を避けるため、数学理論の発展という軸で議論を立てている。

数学の理論は天才がゼロから作ったものではなく、問題を解き洞察を重ねて何世代も積み上げたものだという整理から始まる。定義の言葉遣いや、どの定理から何を証明するかといった選択には文学的な構築の側面がある一方、内省だけでは許されず、誰が考えてもその順序なら確かにそうなる、という論理的な正しさを前提にする点が文学とは異なるとする。

数学理論の結果を使うには最終的に何らかの計算をすればよく、AIは計算能力の面で人間業では不可能な領域へ届き得る。ただし計算力のない人間は、問題を観察して見方を変え、新しい理論を作って解いてきた。その理論が計算をスマートにし、統一的な説明を与え、新しい対象を生む。今のAIは理論を作る部分に届いていない、という論の運びになっている。

AI/開発zenn.devいいね32 / ブクマ4既出スコア 63興味マッチ度 2
10

gherkin記法で書いた自然言語のテストケースをAIエージェントに読み込ませ、スキル経由でブラウザを操作して自律的にE2Eテストを実行させる取り組みを紹介した記事。

記事の要約

ソニックムーブのフロントエンドエンジニアによる記事。E2Eテストは運用を続けるほどテストケースの作成・実装・修正の工数が膨らみ、AIで開発が速くなった今は大きなボトルネックになると筆者は見ており、ノーコードでAIが自律的にテストを実行する仕組みを試している。

テストケースの記述にはBDDで使われるgherkin記法を採用した。YAMLやMarkdownも検討したが、Given / When / Thenという自然言語ベースの構造がそのままAI向けプロンプトに流用しやすく、エンジニア以外も読めてテスト観点のレビューがしやすいことが決め手になった。記法には厳密に従わず、プロンプトとして緩く借用している。

サンプルでは、TODOアプリを対象にFeatureの下へビューポート指定やログイン情報、Backgroundでの前提データ作成を置き、ログイン、ワークスペース一覧の閲覧、名前での検索、新規作成といったシナリオを日本語のステップで書いている。記事はこの仕組みに加え、バグを仕込んだ検証まで扱うとしている。

AI/開発zenn.devいいね22 / ブクマ7既出スコア 60興味マッチ度 3

Qiita

10件5件
1

TypeSafe AIのJevを、Amazon Bedrock AgentCoreで組む従来型のLLM+AIエージェントと比べ、Jevの役割は処理のルーティング役だと整理した記事。はてなブックマークでも上位に入っている。

記事の要約

TypeSafe AIは2026年9月15日、同社が「System One Model」と呼ぶモデル群の最初の公開モデルとしてJevを発表した。名称はカーネマンの速く直感的な「システム1」と、効率改善が資源利用を拡大させる現象で知られるジェヴォンズに由来する。Jevは分類・採点・条件判定の結果を型付きの値として確率付きで返し、プログラムが直接利用できるよう設計されている。

記事は、二重請求の返金を求める問い合わせメールを例に比較する。LLM+AIエージェントでは、LLMが注文情報の取得、二重請求の判断、返金規程の確認、返信作成といった手順を文字列で返し、次のツールや順序を選ぶ。Jevでは事前に定義した「問い合わせの種類」「返金要求があるか」「再問い合わせか」への選択結果と確率が返り、プログラムは最も高い値の処理を実行するだけになる。

筆者は、Jevの結果は数値なので従来の比較演算で呼び出すツールを決められる点を、LLMがツールを選び判断ロジックがブラックボックスになる従来型との違いとして挙げている。

ハイライトAI/LLMqiita.comLGTM60 / ストック23スコア 94興味マッチ度 3
2

毎週1on1をやっていたにもかかわらず、期待していたメンバーから退職の相談を受けた経験をもとに、1on1で聞くべき質問を3層に整理し直した記事。

記事の要約

筆者は週1回チームメンバー全員と1on1をしていたが、質問は毎回「最近どう?」「困ってることある?」だけだった。一番期待していたメンバーから退職の相談を受け、抽象的な質問では当たり障りのない返事しか返らず、限界に近づいていたシグナルを拾えなかったと振り返る。『How Google Works』の、抽象的な感情の質問は抽象的な答えしか生まないという一節を引いている。

立て直した質問は3層構造。まず「今週一番時間を溶かした作業は何か」のように観察可能な事実を聞き、次にその事実に紐づけて「進めていたときどんな気持ちだったか」と感情を聞く。感情を単独で聞くと抽象化されるため順番が重要だとし、『HIGH OUTPUT MANAGEMENT』が1on1の目的を情報交換と定義している点も挙げる。

最後に「3か月後どんな仕事をしていたいか」「このチームに1年後もいると想像してしっくりくるか」と将来を聞く。退職を相談してきたメンバーからは、1年後もいると思うかと聞かれていれば正直に話せていたと言われたという。

キャリアqiita.comLGTM138 / ストック71既出スコア 84興味マッチ度 2
3

元Yahooエンジニアで現在は受託開発会社の代表を務める筆者が、採用の最終判断ではスキルをほとんど見ていないとして、人間力・当事者意識を含む3つの基準を挙げた記事。

記事の要約

筆者は、AIによってエンジニアのスキルが均一化し、1年目のコード、AIで作ったコード、ベテランのコードの差がほとんどなくなると見ている。そのため採用の最終判断ではスキルをほとんど見ず、3つの点だけを見ているという。

1つ目は人間力で、「一緒に働きたい」と思えるか。産業革命が人間をパワーから解放したように、AI革命はスキルから解放するとし、シュートが100%入るロボットがいるバスケで最後に残るのはリバウンドを取りに行く姿勢やチームを鼓舞する力だと喩える。態度やマナーの悪さ、「この会社は自分に何をしてくれるのか」というスタンスはその場で不採用にするとしている。

2つ目は当事者意識で、会社を一緒に作ろうとしてくれるか。3つ目は実直さ・素直さで、成長に最も大事な要素として、先輩の指摘を素直に受け止めてコツコツ取り組めるかを挙げる。同社のエンジニアの95%以上は未経験からの採用だと記している。

キャリアqiita.comLGTM54 / ストック15既出スコア 82興味マッチ度 2
4

KDDIアジャイル開発センターの筆者が、CLAUDE.mdに溜まったルールを索引化して必要時だけ読み込む仕組みで、Claude Codeの常駐コンテキストとトークン消費を抑えた取り組みを、計測値とともに紹介した記事。

記事の要約

筆者は2か月ほどClaude Codeで個人開発を進めながら、精度を極力下げずにトークン消費を抑える仕組みを作り、効果を計測した。集計対象は36日・238セッション。8月の実測では、コンテキストに入れた1トークンは平均50.8回読み直され、キャッシュ読み出しがコスト全体の65.5%を占め、リクエストは月34,125回だった。

問題は、決めごとが増えるたびにCLAUDE.mdへ追記していたため、使わないセッションでもルールが毎回読み直されていたこと。設計・運用文書は440万字に達していた。常駐コンテキストは1トークン削るだけで月3万回以上の読み直しが消えるため、最も削りがいのある場所だとしている。

解決策は、いつどのファイルを読むかの索引だけを常駐させ、必要な場面でのみ本体を読むこと。CLAUDE.mdのトリガー表、キーワードで引く実装知識の索引、利用条件を書いたメモリの索引、descriptionで選ばれるSkillsを使い分け、読むかどうかはプログラムの照合ではなくClaudeが索引の条件を読んで判断する。

AI/開発qiita.comLGTM12 / ストック5スコア 75興味マッチ度 3
5

AIコーディングツールで動くものを素早く作れるようになった現状を認めたうえで、「AIがあればプログラマーはいらない」という見方がなぜ危険なのかを、運用に耐える設計の観点から論じた記事。

記事の要約

筆者は、アイデアをAIに正しく伝えれば形にできるという考えを一面の真実と認めつつ、そこから「プログラマーはいらない」と結論づけるのは危険だとする。ここでのプログラマーは、コードを入力する人に限らず、何を作るかを考え、システムの境界を設計し、品質とリスクを判断し、運用に責任を持つ人を含む。

論点は「動く」と「使い続けられる」の差にある。障害の原因を追えるか、データが増えても性能を保てるか、権限の異なる利用者の間で情報が漏れないか、仕様変更を受け入れられる構造か、新メンバーが理解できるか、といった問いは単一のコード片の正しさでは決まらないとしている。

AIが得意なのはページネーションの追加のような局所的な問題解決で、そこでは強力なペアプログラマーになる。ただしその結果、検索条件との組み合わせでクエリが大量に発行される、キャッシュで権限変更後も古いデータが見えるといった全体の問題が起こり得る。依頼文に書かれていない要件の発見も重要だとし、ファイルアップロードを例に確認観点を表で整理している。

AI/開発qiita.comLGTM10 / ストック8スコア 75興味マッチ度 2
6

社内のファイル暗号化・送信システムのクライアント処理に新言語「Hike」のWasmを採用し、標準GoのWasm比でバイナリを99.8%以上削減し、処理も高速化したと報告する記事。

記事の要約

筆者の社内システムでは、暗号化・ハッシュ、アーカイブ生成、QRコード処理、画像メタデータ除去をブラウザ側で行っている。元のJS実装は数GBから100GB規模のデータでブラウザのメモリ制限を超えてタブがクラッシュし、GCやJITのオーバーヘッドでUIが固まる問題を抱えていた。

標準GoでWasm化すると4モジュール合計で約9.1MBになりPWAの初回ロードには重く、TinyGoも言語仕様の制約や大容量ストリーミング時のGCの挙動に懸念が残った。そこで数KB級の軽さをうたう新言語Hikeを試した。Wasm未対応ブラウザや不具合時には wasm_loader.js で従来のJS実装へ自動で切り替える仕組みを用意している。

HikeはGoに近い構文で移植しやすく、hikecに -g を渡すとDWARF情報が出力され、VS CodeからGDBやLLDBでソースレベルのデバッグができる。4モジュールを元のJS、標準Go Wasm、Hike Wasmの3世代で比較し、バイナリサイズ99.8%以上の削減を報告している。

Web/Wasmqiita.comLGTM24 / ストック12既出スコア 74興味マッチ度 2
7

無意識にスマホを開いて集中時間が細切れになる問題に対し、iPhoneショートカットのオートメーションで、仕事アプリを平日の勤務時間だけ使えるように制限した記録。

記事の要約

仕事・家事・育児で自由時間が少ないなか、残った時間までスマホで溶かしていたと筆者は振り返る。問題はスマホを触る数分そのものより、その割り込みで集中に必要なまとまった時間の連続性が失われることだとし、見ないと決意する方法は再現性が低いため、意志ではなく仕組みで制約をかける方針を取った。

要件は、特定のアプリだけを平日9:00〜17:59に利用可能とし、それ以外の時間帯と土日祝日は使えなくすること。他のアプリには影響させず、通知は確認でき、必要なら制限を解除できることも条件にしている。

スクリーンタイムでも曜日ごとの制限や休止時間は設定できるが、祝日を平日から除外する条件まではそのまま表現できなかった。ChatGPTに相談した結果、ショートカットの「オートメーション」を使う方法にたどり着いたとしている。

ライフハックqiita.comLGTM11 / ストック7既出スコア 70
8

LLMにJSONで分類させる防御コードを書いてきた筆者が、APIを呼ばずに公開SDKと公式ドキュメントだけでJevの仕組みを検証し、ドキュメント同士の食い違い2つを見つけた記事。

記事の要約

筆者は、LLMに「このチケットはどの部署宛てか」を答えさせるたびに、JSONで返させ、パースし、検証し、失敗したら再試行するという、判断1行に対して長い防御コードを書いてきた。2026年9月15日に米TypeSafe AIが公開したJevは、文字列を生成せず型付きの判断と確信度を返すことを売りにしている。

早期アクセスが届いていないため、記事はAPIを一度も呼ばず、公開SDKと公式ドキュメントの回答例だけを使い、1コアのXeon環境で確かめられる範囲を検証している。その過程で公式ドキュメント同士の食い違いを2つ見つけたという。扱うのは3種類の質問形式と選び方、公式定義に頼らないconfidenceの閾値の決め方、被害の大きさに応じて自動実行・確認・人間対応を切り替えるコード。

説明には、LLMを記述式で答える受験者、Jevをマークシートで答える受験者とする比喩を使う。Jevは選択肢の外に答えを書けない代わりに塗りの濃さで自信を伝える、という対応で、state、criteria、probabilities、confidenceの各用語を整理している。

AI/LLMqiita.comLGTM10 / ストック4スコア 67興味マッチ度 3
9

UUIDの内部構造、重複しないとみなせる理由、バージョンごとの生成方法の違いを整理した解説記事。理由がなければv4、DBの主キーには順序性のあるv7を検討する、という結論を示している。

記事の要約

UUIDは、どこで生成しても事実上重複しないとみなせる128ビットの識別子で、RFC 4122(2024年にRFC 9562へ更新)で標準化されている。GUIDはMicrosoftの呼称で実質的に同じもの。文字列では8-4-4-4-12桁のハイフン区切りで表し、3番目のグループの先頭1桁にバージョン、4番目のグループの先頭ビットにバリアントが入る。

v4では128ビットのうち6ビットがバージョンとバリアントに使われ、ランダムな部分は122ビットになる。特定の1つのUUIDと偶然一致する確率は約5.3×10³⁶分の1で、絶対に重複しないのではなく、確率が天文学的に低いので重複しないとみなせるという統計的な保証だと説明している。

v1はタイムスタンプとMACアドレスから生成するため順序がある程度わかる一方、MACアドレスから生成元のマシンが特定される懸念があり、現在はあまり使われないとしている。記事は、理由がなければv4、データベースの主キーに使うなら順序性のあるv7を検討するという結論を冒頭に置いている。

開発qiita.comLGTM10 / ストック3既出スコア 64興味マッチ度 2