Playa Phone
バーニングマン会場
コメントの要約
会場に
コメントには、この電話ボックスの隣で結婚式を挙げたという参加者の体験談や、20年前に Brad Templeton が同種の設置をしていたという指摘が挙がった。通話を録音して書き起こしてほしいという要望も出ている。
一方でバーニングマン自体への冷ややかな見方も多く、参加者層が裕福なテック・金融関係者に偏っているのではという疑問や、文化的には差し引きマイナスだったという意見が並んだ。
GitHub Trending の
Playa Phone
バーニングマン会場
会場に
コメントには、この電話ボックスの隣で結婚式を挙げたという参加者の体験談や、20年前に Brad Templeton が同種の設置をしていたという指摘が挙がった。通話を録音して書き起こしてほしいという要望も出ている。
一方でバーニングマン自体への冷ややかな見方も多く、参加者層が裕福なテック・金融関係者に偏っているのではという疑問や、文化的には差し引きマイナスだったという意見が並んだ。
OpenShot 4.0 – Open-source video editor
オープンソースの
発表が
カラーグレーディング用の hue vs hue、hue vs sat といったコントロールやベクトルスコープの有無を問う声、VST に対応すれば DaVinci Resolve から移れるという要望が出た。After Effects や Premiere Pro との比較を求める声もある。
エンコードの速度と安定性を問う声も上位に来た。数年前に書き出しが頻繁に壊れた経験から距離を置いているという報告や、.org ドメインで広告 Cookie バナーが出る点への批判が並んでいる。
I turned my security cameras into an automatic bird identification system
既設の
RTSP で
同種の構成の報告も並ぶ。Unifi のドアベルカメラで同じことをした例、太陽光電源の野鳥ステーション、e-ink ディスプレイへの出力を次の週末の課題にしているという報告があった。BirdWeather のような既製品を選んだという声も。
「待ち時間なし、クラウドなし、サブスクなし、2年後にサービスが終わることもなし」という記事中の記述が引用され、支持を集めている。こうした工作をする時間があることへの羨望も書かれた。
Apple caught off guard by AI demand for Mac Mini and Mac Studio
AI ワークロード向けに
記事に
コメントでは Xserve の復活を望む声や、冗長電源とリモート管理を備えたコロケーション向け機種を求める声が並ぶ。値上げ幅への不満、Ternus 体制で iPhone 以外の製品にも目が向くことへの期待も出た。
ローカル AI 環境がクラウドに対して実用的かを疑う声もある。16GB クラスの GPU では月20ドルのサブスクに遠く及ばないという報告が挙がった。
Breaking Claude Code Opus 5 Auto Mode
Claude Code の
攻撃は
Anthropic の Boris Cherny が多層防御で未知の間接プロンプトインジェクションをほぼゼロにできると述べた件が引かれ、小規模サンプルで最大80%の成功率が出たという著者の記述との食い違いを批判する声があった。
Auto Mode が既定であることと表示のされ方が問題で、被害が積み上がれば集団訴訟になるという意見も。Auto Mode が後片付けを妨げる場合があるという指摘や、この種の攻撃が実環境でもっと観測されていないのが不思議だ、という反応もあった。
I think the military commissary's freezers were hacked
米軍の
冷凍庫の
設計上の欠陥や運用能力の低下という単純な説明で足りるという反対意見が上位に来た。母数(軍全体で冷凍庫が何台あり、そのうち何台が不調なのか)を示さないまま攻撃説に進んでいる、という批判も出ている。
米国外のコミッサリーでは影響が大きいという指摘もあった。下位の隊員は月2400ドル程度で、安価な売店に依存しているためである。サポートのない脆弱な機器が社会に置かれている状況への嘆きも並んだ。
Google Has Removed MV2 Extensions from the Chrome Web Store, Including UBO
Chrome ウェブストアから
MV2 廃止の
コメントの大半は Firefox への移行を勧める内容で占められた。MV2 の計画が発表された時点で移り、以後困ったのは1〜2サイトだけだったという報告が複数ある。Safari を使っていて不都合はない、WebKit の挙動の違いを学ぶ機会になるという声も。
Mozilla が Signal のような寄付・財団型の収益構造を採るべきだという意見、Android の閉鎖化を同じ流れとして挙げる声も出た。2010年当時 Chrome を勧めていたのが今は逆になった、という感想が繰り返し書かれている。
Internet centralization and the original sin of NAT
家庭の
NAT に
「原罪」は言い過ぎだという反論も強い。制御できる通常の NAT は問題なく、真に有害なのは CGNAT であり、ポート開放が面倒なのは家庭用ルーターの UX の問題にすぎない、という指摘。
NAT が「機器が隠れる」というセキュリティ機能として正当化されたことが修正を遅らせた、という指摘も引用された。逆に IPv6 に懐疑的で、NAT やリバースプロキシによるアドレス共有を進めるべきだという意見もある。
ChatGPT Work Tool and Skill Reference
ChatGPT Work が
ChatGPT Work の
最も興味深いのは control-browser スキルだという指摘が上位に来た。Node.js REPL から Playwright を起動し、`nodeRepl.write(await browser.documentation())` を実行して追加の指示を得る仕組みになっている。Codex にできることとの違いが分からない、という疑問も出た。
AI が生成したサイトやレポートはなぜどれも同じ見た目になるのか、Bootstrap 時代のようだ、というメタな話題も伸びている。サイドバーが単独でスクロールしないという UI 上の指摘もあった。
ravynOS: Pre-alpha open-source OS based on Darwin, FreeBSD, Apple open-source
macOS の
macOS 互換を
macOS の GUI はクローズドなので複製は法的に危ういのではという疑問に対し、FAQ が ReactOS、GNUstep、Darling を先例として挙げていることが引用された。Apple のエコシステムが閉じてきたという前提自体を疑う声もある。
概要ページにスクリーンショットが1枚もないことへの批判が複数上がった。過去の HN スレッド(2023年12月、2025年11月)へのリンクも張られ、同種の試みが繰り返し登場していることが確認されている。
curl: a CVE dispute
curl が
実害の
MITRE に3回説明する必要があった点への呆れと、それでも撤回に至ったことを「良い仕組みだ」と評した Stenberg の姿勢への評価が並んだ。CV を埋めるための CVE 乱発への批判も繰り返されている。
攻撃者が既に root を持っている前提でしか成立しない不具合はセキュリティを弱めない、という Raymond Chen の記事が引かれた。HackerOne 上の返信が LLM で書かれていた点については、自分なら即座に対応を打ち切ったという声も出ている。
There's no such thing as Just a Tool
道具は
道具が
React の例には共感が集まった。Web を JS の中で完結させる方向に押し流され、ブラウザ標準より壊れやすい自作コンポーネントが増えたという指摘が出ている。一方で、バックエンド出身者にとっては React が最も入りやすい入り口だったという反論もあった。
箸の例には批判が集まり、フォークでも同じことができる、共有の大皿から自分の茶碗に取り分ける前提が抜けている、という文化的な補足が入った。技術が特定の集団の権力を強化するという Langdon Winner の議論への接続も挙がっている。
I attended a conference recently and AI use by academics was absurd
学会で
パネル登壇中、
同意する声が多く、上司や同僚から LLM の出力をそのまま貼られた経験が「敬意の欠如」として語られた。人と直接話す以外に学会に行く理由があるのか、という問いも出ている。
学会発表は業績評価の都合で義務化されている面があるという事情の説明も入った。AI に課題を採点させておきながら生徒の AI 利用には激怒していた高校教師の例も挙がっている。
Omarchy: Any User Process Can Escalate to Root
Omarchy の
Omarchy の
議論の主な対立軸は、守るべきはユーザーレベルのアカウントであって root 昇格はさほど重要でない、という意見とその反論にある。前者の側からは xkcd 1200 が引かれ、気にしているのは自分のホームディレクトリのファイルだと書かれた。
反論側は、アプリケーションのサンドボックス化など現代のユーザーレベルの防御は root を取られると一気に回避されると指摘。Flatpak が dbus 接続をフィルタしていること、パスワードマネージャの読み出しにはユーザー操作が必要なことが根拠として挙げられている。
VibeCoded AI-Slop License v1.0
AI に
冗談めかした
同種の既存ライセンスとして Unlicense が挙げられ、揶揄なしで同じことができると紹介されている。
議論の大半はパブリックドメイン宣言の有効性に流れた。オーストラリアでは権利放棄ができないので何らかのライセンスが要るという主張に対し、当のオーストラリア人から疑問が返されている。ディストリビューションや企業利用では明示的なライセンスが必要だ、という実務的な指摘も入った。
July in Servo: more platforms, faster canvas, web fonts in SVG, and more
Servo の
Servo は
コメントは1件のみで、Android 対応が大きく前進していることを歓迎する内容だった。
But where does taste come from?
コードや
センスは
LLM 以前から同じ問題はあったが速度が上がって顕在化した、という同意が多い。テストや CI が整った環境で働いた経験の有無が後の判断に効く、という体験談も添えられた。
反論として、建築家はレンガを積まなくても設計できるのではという例が出た。これに対し、建築家は機能する空間の設計者であり同時にプロジェクト管理者でもあって、現場から離れているわけではないという指摘が返されている。
Transfer files over an ethernet patch cable
2台の
直結した
現代の Linux でも NetworkManager が IPv6 を自動設定し、systemd-resolved が mDNS/LLMNR を扱うので同じことができる、という補足が続く。
議論はユーザーから見えるアプリケーション層の話に移り、GNOME の gvfs が DNS-SD バックエンドを持つことが示された。ただし相手側が自分を広告する設定(systemd の dnssd サービス定義)をディストリビューションが用意しているかは別問題だ、という指摘で終わっている。
A Better SQL in 11 Lines of Code
Prela と
独自言語 Prela の
既存の SQL サーバーで使えるのかという期待に対し、リポジトリを見る限り SQL へコンパイルするわけではなく独自実装だ、という訂正が入った。期待した側も読み飛ばしを認めている。
比較対象として挙げられた「20行超の SQL」は、より新しい構文を使えば12行程度で書けるという反証が投稿された。これに対し INNER JOIN は30年前から当たり前で「より新しい」とは言えない、SQL 界隈は新機能の採用が遅い、というやり取りが続いている。
Repeating Ourselves Less with M4
OpenBSD の
OpenBSD 上で
M4 への評価は厳しく、マクロという概念は有用でも M4 の実装には見るべきところがない、5分で自作したものの方が壊れにくい、という批判が最上位に来た。チルダ2個で壊れるエスケープ回避策への疑問も出ている。
GNU Guix なら設定を本物のプログラミング言語で書ける、という対案も挙がった。ただし著者は OpenBSD を学ぶこと自体が目的だったと応じている。sed に検索文字列と置換文字列を別々に渡すオプションが欲しい、という余談も出た。
a CVE dispute
curl の
curl が
CVE 1件ごとに世界中のセキュリティチームが動くコストは curl 側には見えないが無視すべきでない、という記事の一節が引用され、CVE のインフレに対して理にかなった立場を取り続けていることへの評価が集まった。
MITRE に3回説明する必要があった点への呆れ、報告者が当時 Grok に不満を述べていたことへの揶揄(LLM がバグを見つけ、LLM がその苦情に同意する構図)が並んだ。自分なら早々にプロジェクトを降りていた、という声も出ている。
Please, I beg you, we need to stop using Stored Procedures (from applications)
アプリケーションの
アプリ側から
コメントには実例が集まった。認証まで含めてすべてがストアドプロシージャで、アプリは DB の薄い層でしかなかったという15年前の事例、バリデーションやエラーメッセージまで DB が返していたという例が挙がっている。ロジックがアプリと DB に分散する状態よりはまだましだ、という擁護も出た。
記事にない反対理由として、ビジネスロジックが DB に隠れるとテストが難しくなるという指摘があった。SQL 関数が HTML を動的に生成していた、ストアドプロシージャがブラウザ向けのマークアップを返していた、といった極端な例も報告されている。
p99 0 ms* autocomplete for 240 million domain names
2億4000万件の
2億4000万件の
コメントは技術的な検証よりも、紹介されたデモサイトが 500 Internal Server Error を返している点に集中した。
「その 500 は速かったか」「とても速かった」といった応酬が続き、nginx が処理しきれていない状況を茶化す流れで終わっている。
35 years later, Torvalds' hobby project remains developed worldwide.
Linux が
Linux 誕生から
コメントは最初の投稿にあった「GNU のように大きくてプロフェッショナルなものではない」という一節を踏まえたジョークが中心で、ATA ドライブ以外もサポートするようになった、といった定番の返しが並んだ。
話題はデスクトップに移り、GUI が未だに十分でないという意見と、Cinnamon の方が Windows の UI より好みだという反論、Windows を「安定」と呼ぶことへの異議が交わされている。
The Hugging Face incident from a security engineering perspective
OpenAI の
記事は
訴訟に至らない理由として、被害が数人分の調査工数にとどまること、悪意によるものではないこと、OpenAI との関係悪化や市場の反応の方が損失として大きいことが挙げられた。それでも調査には時間と費用がかかり、初期には相手が OpenAI のモデルだと分からなかった点は指摘されている。
インシデント対応の実務からは、AI が単純な GET ではなく certutil でファイルを落とすなどマルウェアと同じパターンを使うため、マルウェアか AI が書いたコードかの判別が難しくなっているという報告が出た。一方でモデルの能力を過小評価した結論ありきの記事だという批判と、著者本人の反論も交わされている。
A Self-Baked Async FFI Framework for Rust C# Interop
tokio と
Node.js sandboxes powered by QuickJS and WebAssembly
Wasmer Edge の
Using stable and evolutionary problems to guide program decomposition
変化しに
George Fairbanks の
コメントは2件で、具体例が欲しかった、リンク先の記事を読んで理解したという感想と、それに対する著者の返答(元記事が十分な出来なので繰り返しを避けた)だった。
Terminating elegantly: a guide to graceful shutdowns
Kubernetes 上の
エージェントが
Archify は
検証済みの2つのスナップショットを Before / Delta / After として比較でき、追加・削除・変更・移動・経路変更を事実として列挙する。マージ前のアーキテクチャ変更のレビューを想定した機能になっている。
ノードの検索、リビジョン検証済みのソースを開く操作、上流・下流の到達範囲と経路の追跡が可能で、トポロジを勝手に作らないことを設計方針に挙げる。出力は自己完結の HTML に加え PNG、SVG、WebM、1200×630 の共有カード。MIT ライセンス。
プロンプト1つから
ワンクリックで
セッションはサーバー側で保持されて再起動をまたいで残るため、途中でのキャンセル、再開、方向転換ができる。教材は文書・音声・動画のアップロードか Web 検索から取り込み、エージェントがそれをもとに構築する。
スライド、クイズ、インタラクティブ教材、PBL、画像、動画、音声、.pptx の取り込みなど20の組み込みスキルを持つ。モデル、メディア、検索プロバイダ、ストレージはいずれも差し替え可能な設計としている。
科学研究向けの
生物学を
Agent Skills と Agent Plugins の標準に沿っており、Cursor、Claude Code、Codex、Google 系のツールなど複数のホストで動作するとしている。
リポジトリには security-scan と skill-tests の GitHub Actions ワークフローが置かれ、その状態が README のバッジとして掲示されている。
リバースエンジニアリングと
AI エージェントが
処理の流れは、RULES.md からルーティング用の PowerShell スクリプト、case-init と scope.md(認可とネットワークプロファイルの確認が済むまで対象へ行動しない)、シナリオ別スキル、ツール/MCP/スクリプト、タイムラインと Evidence→Finding→Path、レポートと作業記録、という順に定められている。
README は冒頭で、AI エージェントは README_AI.md の指示に厳密に従うよう指定している。中国語と英語のドキュメント、プロジェクトサイト、オンラインチュートリアルを備える。
Semrush や
Semrush や
対応するワークフローはキーワード調査、順位追跡、競合分析、被リンク、サイト監査、AI 可視性の6つ。肥大した SEO スイートではなく、用途を絞ったワークフローを掲げている。
MCP サーバーを公開しており、Claude Code や OpenClaw、Hermes などのエージェントから利用できる。組み込みのスキルに加えて自作スキルも追加できる。
中国の
設計文書と
もう一つの用途は公開特許の平易な読解で、請求項や用語、実装の文脈を通俗的なノートと図に落として Obsidian に取り込む。双方向リンクやグラフを使って私的な特許知識ベースとして蓄積する構想を掲げる。
実装は Python 3.9 以上で、mermaid のレンダリングと CNIPA の操作に Playwright を使う。MIT ライセンス。
Claude Code や
スキル、
README の冒頭は警告で始まる。公式は GitHub リポジトリ、npm の ecc-universal と ecc-agentshield、GitHub App、プラグインスコープ ecc@ecc、ecc.tools のみで、第三者による再アップロードや非公式ミラーは保守もレビューもされておらずマルウェアを含む可能性がある、と明記している。
導入は `npx ecc-universal setup` を実行する形で、Node.js 18 以上、Git、PATH 上の Claude Code 2.1 以上が必要。README は日本語を含む13言語に翻訳されている。
言語モデルから
Transformer 系の
手法は directional ablation(abliteration、Arditi et al. 2024)の高度な実装を中核に据えている。
Trendshift の Repository of the Day 1位のバッジを掲示し、Discord と Matrix のコミュニティ、Hugging Face の heretic-org、Codeberg のミラーを持つ。
Wand
Wand アプリの
README の大部分は警告に割かれている。公式の YouTube チュートリアルもビルド済み実行ファイルの配布もなく、GitHub のリリースにはリリースノートしか含まれない。プロジェクト名を騙った偽チュートリアルの説明欄でマルウェアやパスワード窃取ツールが配られている、と注意している。
同梱の version.dll プロキシは Wand に読み込まれ、Electron の挙動を変更する。GitLab にミラーがある。
約3元の
完全に
主線の最小版はサイズが GPT-3 の約 1/2700 で、一般的な個人の GPU でも学習と再現ができることを狙う。
構造と学習の全工程をオープンにしており、MoE、データクリーニング、事前学習、教師ありファインチューニング、LoRA、RLHF(DPO)までを含む。
How long does it take for you to write a dev.to article?
記事1本に
Fixing Delicate Cache Mismatches in a Brownfield SPA: A Pragmatic Solution
DEV 本体の
Remember CLAIM-24? Here's what happened.
6月に
2026年6月4日から
起点は6月7日に tacoda/keystone に立てた issue で、Cell 7 をモックではなく実際の署名 API に対してテストできないかを問うもの。このスレッドは41件のコメントに膨らみ、以降の内容はすべてそこから出ている。
8月5日から6日にかけて実 API を通して基準値を取り直し、最初の不具合が見つかった。自作のパーサーが ISO 8601 のタイムスタンプを必須としていたことが原因だったと記されている。
Free AWS Certification for Students: The Complete Step-by-Step Guide
在学確認を
著者は
その後 AWS が旧 AWS Educate ETC の経路を閉じたため、以降1年間コメント欄が問い合わせ窓口のようになり、同じ質問が繰り返し寄せられたと経緯を説明している。
本記事はその置き換えとして、在学確認を通した学生が Student Rewards から100ドル分の認定バウチャーを得るまでの正確な経路、バッジ取得のコツ、避けるべき失敗を順に示す構成になっている。
Badger: An E-Ink Badge I Use For Conferences
カンファレンスで
I Tried to Beat Peter Norvig and Accidentally Became Ryan Gosling
DEV の
HTML と
課題は Peter Norvig を救出するというもので、対戦相手は彼の実行時間(wall-clock time)。挑戦を受けて GitHub リポジトリに移動した。
そこで自分のプロフィールが書き換えられ、スペースの追加と2文字の大文字化によって Ryan Gosling になっていたことに気づく。通常のコーディング課題ではないと分かった、と続いている。
I'm 12. I built a social network for developers. Adults are NOT allowed. (Yes, you. Close the tab.)
5歳から
5歳から
作った理由として、インターネットでは常に「若すぎる」と言われてきたこと、多くのプラットフォームが若い開発者にとって威圧的であることを挙げている。
著者は12歳で、AI コーディングメンター KODA を公開済み、dev.to のフォロワーは1,400人以上と書いている。
I'm 12. 1,946 followers. I read your comments out loud — and I'm building the 3rd platform: KODA LEARN.
同じ
Sessions vs JWTs: you are choosing how often you pay for state
セッションと
どの
JWT が現代的でセッションは古い、という一般的な位置づけは誤りであり、その枠組みが特定の落とし穴に人を導いている、というのが主張の中心にある。
記事はまず両者のフローを追う構成で、違いは細部にあるとしている。著者は LiveReview という AI コードレビューを作っている開発者。
My LLM Critic Flip-Flops on Every Run. That's Fine — Because a Frozenset Decides What's Fatal.
LLM に
On his last day as CEO, Tim Cook pens an emotional memo reflecting on his time at Apple and says he takes “enormous comfort” in handing the helm to John Ternus
Tim Cook が
Gurman: Apple is moving App Store to services unit run by Eddy Cue, who previously oversaw it until 2015; Cue is taking on a more influential role under Ternus
App Store の
Sources: Phil Schiller stepped down from his role leading the App Store and product events; he will remain at Apple to work on unspecified initiatives
App Store と
The FTC and 22 state AGs sue Amazon, alleging it overcharged advertisers over $20B since 2019 via hidden surcharges, with costs largely passed on to consumers
Amazon の
Amazon says the FTC's complaint over Sponsored Ads cites no evidence of consumer price increases or advertiser harm, and misunderstands how advertisers operate
前項の
The EU designates ChatGPT as a very large online search engine, and Reddit and Roblox as very large online platforms after each hit 45M monthly users in the EU
EU の
Nvidia plans to invest $3.5B into MediaTek through convertible bonds; MediaTek forecasts AI chip revenue of about $2B this year
Nvidia に
OpenAI says its ad business has hit $1B in annualized revenue run rate and is expanding globally, as it touts its “diversified business model” ahead of an IPO
OpenAI の
MapQuest becomes the top free iPhone app on the App Store in Canada and fourth on the US App Store after refusing to change Lake Ontario to Lake America
地図上の
The Pentagon launches ChatGPT Mil and Grok for Government on its GenAI.mil platform, giving its 3M personnel access to AI tools “tailored to warfighter needs”
国防総省の
LoopArena: Benchmarking Models as Runtime Controllers for Loop Engineering
コーディングエージェントを
ループエンジニアリングは、
しかし end-to-end の実行結果1回では、成功や失敗がループの誘導によるものかエージェント自身の実行能力によるものかを切り分けられない。
LoopArena はこの点を分離する。評価対象のモデルは Controller として各ラウンド後に構造化された実行要約を受け取り、固定されたコーディングエージェント(Worker)に次に何をするか、何を検証するかを指示するか、停止するかを判断する。
DART-SD: Diamond-topology Aware Retrieval and Tuning for Self-Distillation of Multi-Turn Tool-Calling Agents
順序に
多ターンの
この豊かな位相を単一の軌跡へ押し込めると位相の崩壊が起き、妥当な別経路まで一律に罰せられて方策の多様性が大きく損なわれる。
DART-SD は全体を強制する方式から、位相に沿った局所的な修正へ切り替える。実行過程を収束する Interaction-State Transition Graph として表し、成功・失敗の探索経路が持つダイヤモンド構造をそのまま捉えたうえで、自律的なロールアウト中に修正箇所を特定する。
Beyond Data Scaling: Representation-Centric Continued Pre-training for Vision-Language-Action Models
ロボットの
汎用の
提案する VLAct は、タスク固有のファインチューニングの前に、広範で不均質な多身体のロボットデータで学習した VLA 向け VLM バックボーン。VLM の事前知識を保ちつつ、身体をまたいだ共通の行動意味を促す。
具体的には VLM 事前知識の保持、複数ヘッドによる連続行動の共監督、部分的に統一した身体横断の行動レイアウトを使い、ファインチューニング時にはタスク固有の行動ヘッドを許す。シミュレーション、実機、未知の身体への転移のいずれでも下流性能が一貫して改善したとしている。
Agentic Artifact Creation: Systems, Evaluation, Principles, and Opportunities
AI が
生成モデルは
本稿は agentic artifact creation を、AI が成果物を実質的に構築・改訂し、途中の観測が後続の作業を方向づける「状態を持った構築」と定義する。機能的には、成果物の操作的表現、構築方策、後続の行動を変えうる実行時検証の3つが結びついたものになる。
2026年8月20日までに入手できた259本を精査し、定義に該当するシステム230本とベンチマーク29本を対象とした。成果物を6つの系統に分けて比較し、応用場面と評価手法を別々の軸として分析している。
Code as Worlds: Agentic Discovery of Executable World Representations for Physical Reasoning
物理世界の
現代の
Code-as-World は物理世界を実行可能な世界表現として表す枠組み。物理的な構成、動的な変化、見た目を実行可能なコードとして書くことで、コンパクトで量的に裏づけられ、制御可能な抽象を与える。
自然言語の記述や実世界の動画といったマルチモーダルな観測からこの表現を作るため、仮説形成的推論に着想を得たエージェントの発見ループを設計した。エージェントが提案し、実行し、描画し、検証する、という流れになる。
J-Zero: Unified Challenger--Solver--Judge Co-Evolution from Zero Data
検証可能な
自己進化する
J-Zero は Challenger・Solver・Judge を統一的に共進化させる枠組みで、両方の領域にまたがる自己改善を扱う。Challenger は次第に難しい課題を作り、Solver はそれに対してより質の高い応答を出すよう学習する、という敵対的な相互作用になる。
Judge は自分のスコアからではなく、応答の生成のされ方から順序が事前に分かる選好ペア(Challenger の答えより Solver の答え、一発の答えより分解して再構成した答え)を使って共適応する。ベースラインを上回る結果が報告されている。
Revisiting Local Context for Long-Horizon Streaming 3D Reconstruction
直前11フレームの
極端に
近年の手法は短距離の文脈に永続的あるいは多階層の長距離メモリを組み合わせて長期の安定性を上げてきた。本稿は別の方針を取り、学習される時間的状態を厳密に局所へ留め、目標が系列長に依存しない形で予測を定式化する。
提案する ABot-Recon は直前11フレームの KV 特徴のみをキャッシュし、現在のカメラ座標系での点群と隣接フレーム間の相対姿勢を予測する。これらは参照フレームの取り替えに対して同変で、全体の姿勢と形状は逐次合成によって復元される。
Puro-2B: Poor Lab's Qwen2-1.5B Trained on RTX 5090 within $5090
コンシューマー向け RTX 5090 と
言語モデルの
小規模でも Llama-3.2-3B の学習には150万ドル超、SmolLM3-3B の再現には70万ドル超がかかると挙げている。本稿はこの障壁を下げるオープンな事前学習レシピを示す。
コンシューマー向けの RTX 5090 上で FP8 精度を使い、最大1.4兆トークンで Puro-2B のモデル群をゼロから学習した。トークン予算とレシピの変種が異なる複数のモデルからなり、最良のものは計算コスト6,900ドル未満で、評価手順のもとで Qwen2.5-1.5B の性能に近づいたとしている。
LayerRecall: A State-Conditioned Memory Router for Long-Horizon Consistency in Video Generation
動画 DiT の
自己回帰的な
既存のメモリ機構はモデルに非局所的な履歴を見せるが、アクセスできることが有効な利用を保証しない。分析からは、動画 DiT の層ごとに現在・直近・遠方の文脈への好みが異なることが分かり、長距離のメモリでは何を取り出すかと同時にどこで使うかを決める必要が示された。
LayerRecall は現在の状態に条件づけて層を選ぶメモリルータで、関連する過去の K/V 状態を取り出し、バックボーンごとにメモリに敏感な層だけへ注入し、他の層では局所的な注意を保つ。加えて Cross-Horizon Prediction Matching を提案している。
Act with Intent: Distilling Behavior Intent for Vision-Language-Action Models
行動クローンでは
VLA モデルは
未来に基づく監督はフレームや潜在観測、軌跡、運動表現で行動学習を補強するが、これらは起こりうることの個別の実現を捉えるにとどまり、これから行う行動が共有する意味的な目的そのものではない。
提案する Intention Distillation は行動レベルの意図を行動デコーダへ蒸留する。学習時は固定した教師 VLM が、現在の観測・指示・粗い行動要約・実行動画から示された区間を解釈し、実際に動く VLA はその標準入力からデコーダ中間層でマルチモーダルな意図表現を復元して行動を組織化する。
LLM の
記事は、
コメントでは、研究に使われたモデルが古いのは研究の性質上やむを得ないが、最新モデルを使っているであろう筆者の実感とも矛盾しないので今も傾向は残るのではないか、という見方が上位に来た。
文脈が足りないだけではないかという反論、特定分野に特化したモデルを専門家が使えば既存理論の応用で新発見もありうるという意見、ハッタリが上手いなら研究よりマーケティング向きだという感想も並んだ。AI の進化速度と論文化までの時間差により、AI の社会実装に関する研究や書籍の価値が下がる点を問題視する声もある。
OpenAI が
メモリ不足に
規制を求める声が上位に来た。チキンレースで自浄作用が働かないので EU の出番だ、という意見や、再値上げを懸念する声、M6 の Mac mini も買い占められそうだという予想が並ぶ。
一方で、民生機がデータセンターに並ぶのは以前からあり Mac mini をサーバー用途で買う例も昔からあった、OpenAI だから話題になっただけだ、という冷静な指摘も出た。Thunderbolt 5 でクラスタを組んでも大して速くないという記事を読んだ、という疑問も投げられている。
Bluesky の
Bluesky を
コメントでは AT Protocol の理想と現実の乖離を指摘する声が多い。最初は素晴らしいと思ったが分散型は削除がしづらく、そこが分かりにくいという指摘も出た。
日本語圏の投稿が閑散としていて虚空に向かってつぶやくようだ、Twitter からの移動を宣言した人が今も X にいる、といった利用実態の話が中心になっている。運営の基準が不透明で絵師の BAN が起きるため日本人が増えない、という主張もあった。
Claude Code の
半年前の
コメントはこの冒頭部分への反応が多く、普通に読んで良い記事だったので Like を押した、Zenn はアカウントがなくても Like できると知った、という報告が並んだ。冒頭のプロンプトに実際効果があるのかという疑問も出ている。
内容面では、8bitDo micro を片手コントローラーにする構成が面白がられた。こうした設定を取り込むほど CLAUDE.md や rules が肥大化してしまう、公式にはいったんほとんど削った方がよいとも聞く、という悩みも書かれている。
Kaspersky が
Kaspersky の
コメントでは、ログにプロンプトインジェクションを仕込むということかという確認と、直接貼り付けるとユーザーの指示と見分けがつかない、という指摘が上位に来た。
対策としては、AI が動くターミナルのサンドボックス化とホワイトリスト方式が最低限必要という意見、権限確認の「言い方」自体を考え直す必要があるという意見が出た。Claude Code でも悪意ある指示をコピペしてしまう可能性があり、実行前の警告を CLAUDE.md に書けば効くかという問いも投げられている。
デジタル庁デザインシステムが
非推奨の
コメントでは、WCAG 2.2 が「トップへ戻るボタン」自体を非推奨としているわけではなく、むしろ補助機能として有用とされている、実装方法によって違反しやすい注意点があるだけだ、という訂正が上位に来た。
縦に長いサイトでは付いていてほしいという意見、Chrome 拡張で自前で実装しているので廃止されてもかまわないという意見、そもそも長いページを作らなければよいという感想が並んだ。当の記事自体にも折りたたまれた形で実装されている、という指摘もある。
Claude に
ネット上の
評価としては、例外処理の指摘から最後の「不要な最適化」というオチまで一貫してシニアらしい振る舞いだった、役割分担プロンプトの有効性が分かる、という反応が目立った。マイクロ最適化を誇張する人間よりずっと役に立つ、という感想も。
疑問としては、ジュニアエンジニアのペルソナで同じことをさせたらどうなるのか、役割によるプロンプト圧縮は「担当範囲以外に手を出さない」という制限と相性が悪いのではないか、再現性はどうなのか、という点が挙がっている。
M5 Max 搭載の
CPU と
180W のアダプタに替えても本体側が受け取れる電力に上限があるため解決しない、という記事の記述が引用された。M1 Max の頃からある問題だという指摘もある。
省電力の ARM ベースに移った意味は何だったのか、という批判の一方で、CPU と GPU を同時に100%近く回す処理はほとんどない、仕様が振り切れていて面白い、という反応も並んだ。
メモリ価格の
マウスコンピューターの
コメントは実体験が中心で、年末に確保しておいてよかった、Windows 10 のサポート終了に伴う入れ替えが去年で済んでよかった、逆にサポートを延長した人は苦しいのではないか、といった声が並ぶ。
現状ではグラボなしでも30万円台に届くという価格感の報告、規格更新のたびに買い替えていたが風向きが変わったのはマイニングによるグラボ高騰からだ、という振り返りも出ている。パソコンではなく半導体関連の株を買えと教えてほしかった、という冗談も。
スペンサー・チャンの
AI に
AI に
理解負債はコードベースへの開発者の理解が追いつかなくなる現象。溜まると誰も仕様を把握しておらず、重要な改修が困難になる。細かい実装は徐々に見なくてよくなるとしても、仕様を把握して自分の言葉で説明できることは必要であり続ける、という立場。
前提として Claude Code、Codex CLI、gh コマンドを使える状態にしておく。ワークフローでは、Total TypeScript の Matt Pocock が公開しているスキル集に含まれる grill-with-docs など2つのエージェントスキルを使う。
TypeScript ライブラリと
従来は
GUI を持たずプログラムからの操作を前提とするヘッドレスブラウザになぞらえて、「ヘッドレス組版エンジン」と定義している。組版処理を固有の DSL や GUI から切り離し、汎用のプログラミング言語から直接実行できる形にしたもの。
Node.js、Bun、Web ブラウザの複数ランタイムで動作し、文書構造やレイアウトは TypeScript のオブジェクトと関数で記述する。記事自体も minitype で組版した PDF として読める。
開発の
退勤直前に
クラウドエージェントは、リポジトリの clone、依存のインストール、ビルド、テスト、アプリの起動までを自前の環境で完結させる。1台まるごと自分の環境を持っている状態で、セッションは PC を閉じても保持されるためスマホアプリから確認も指示もできる。
傍証として、Cursor 内でマージ済み PR に占めるクラウドエージェント由来の割合が昨年12月の10%から2026年7月末に56%へ伸びたこと、Matt Pocock や SpaceXAI の Lauren Tan の投稿が挙げられている。
Claude Code の
半年前の
入力は 8bitDo micro を縦持ちして片手で操作するターミナルコントローラーとして使う。y 単体を送ると承諾の意味になるためそこに割り当てているなど、マッピングは模索中と書かれている。声を出せる場所では音声入力も併用する。
自律的に実装させるため、以前の bypassPermissions から後発の auto に切り替えた。細かいコード確認をしないぶん表示の必要も薄れるとして、viewMode を focus にしている。
並行開発向けの
VSCode や
評価の中心は内蔵ブラウザ。並行開発で重要なのは脳のコンテキストを素早く切り替えることで、AI とのチャットよりブラウザの方が重いコンテキストになる。セッションを切り替えるとブラウザのタブ群も一緒に切り替わる点を利点として挙げる。
既存ツールの内蔵ブラウザは1セッション1タブでパスキーが使えないなどの制約があり、隣に Chrome を並べる運用になっていた。Orca は元々 E2E テスト関連のサービスを作っていた開発者によるもので、Google ログイン対応に苦労している様子も公開されている。
Claude Code の
権限確認ダイアログで
約1,800円の M5Atom Lite を3Dプリントしたフィギュアに入れ、ハート型の窓から LED を透かせる。待機は青の常灯、作業中は白の呼吸、承認待ちは赤の点滅から30秒後に常灯、完了は緑の点滅6秒、エラーは赤の高速点滅。30分間イベントがなければ自動消灯し、次のセッションで復帰する。
構成は Claude Code の hooks から HTTP GET で M5Atom Lite の WebServer を叩き、FastLED 経由で SK6812 を光らせるだけ。はんだ付けも追加部品も不要で、hooks の設定には async: true が必須(付けないと Claude Code の実行がブロックされる)。
Terraform から
インフラも
比較対象は3つ。LocalStack は110超のサービスに対応するが無償の Community Edition で使えるのは Lambda・S3・DynamoDB・SQS・SNS・IAM などのコアサービスに限られ、2026年3月以降は無償でも認証トークンの登録が必須。Floci は2026年に登場した MIT ライセンスの OSS で68サービス程度に対応し、登録もトークンも不要、Quarkus Native 製で起動は公称約24ミリ秒、アイドル時メモリは約13MiB。moto は Python のテスト用モックを moto_server として立てる形になる。
無償のまま RDS のようなサービスまで触れる Floci を使って検証を進める。Floci は docker compose で起動し、LocalStack と同じ 4566 番ポートで待ち受けるため既存の設定を流用できる。
M4 Max・128GB の
構成は
課題には合成ベンチマークではなく、自社 OSS(intent-system)で既に解決してマージ済みの本物の issue を使い、当時と同じ状態から実装させて実際にマージされた差分と突き合わせた。
結果として、作業指示を読み、grep と read でリポジトリを探索し、直すべき箇所を特定して実装し、dotnet build / test を走らせ、コミットし、gh で draft PR を作り、投稿されたレビューを自分で読みに行って修正するところまでが人間の介入なしで一周した。理由はモデルが急に賢くなったからというより、ワークフローが実時間のうちに閉じるようになったためだと著者は考えている。n=2 の小さな観察と断っている。
IME の
長文を
修飾キーは頻度が低い操作や慎重にすべき操作に付けるもの。長文では改行を何十回も打つが送信は1回で、誤改行は Backspace 1回で直せるのに対し誤送信は取り消せない。よって「修飾キー+Enter で送信」が自然な設計だとする。
「Enter で送信」は Enter を送信専用に使える英語圏の設計であり、日本語では前提が崩れているという指摘。著者は手元のどのターミナルでも動いた Option+Enter に統一しており、修飾キーを必須にするとアプリが IME 変換中の Enter を送信と誤処理するバグの回避策にもなると書いている。
デジタル庁デザインシステムが
デジタル庁デザインシステムの
挙げられている課題は、アイコンだけでスクリーンリーダーに認識されない(1.1.1 レベルA)、smooth スクロール指定時のめまい・吐き気(2.3.3 レベルAAA)、別ページから戻ったときの予測できない挙動(3.2)、ターゲットサイズ不足による誤タップ(2.5.8 レベルAA は24px 以上、2.5.5 レベルAAA は44px 以上)。
解決策も併記されている。a 要素の中にテキストを置いて Visually Hidden を当てる、prefers-reduced-motion メディアクエリを付与する、見た目ではなく透明なクリッカブルエリアでサイズを確保する、といった対応が挙がる。
GitHub Trending で
対象は
結果は、起動時のトークンが自作3,225に対し導入したものは90,000で28倍。実装は SKILL.md 1本に対し Python 308ファイル・32MB。標準的な Windows では Python 3.12+ が必須のため動かない。
導入自体は CLI から `claude plugin marketplace add` と `claude plugin install` で1分で完了した。`claude plugin details` でプラグインのトークンコストを確認できる。検証環境は Windows 10 / Claude Code 2.1.251 で、測定は2026-08-31時点。
AI への
エンジニアの
何を知りたいかを言語化する力と、検索結果の正確さを見極める力が生産性を大きく左右する、というのが主張。AI に対しても「検索内容を省略して、とりあえず調べて」で済ませている場面が多いのではないかと指摘する。
対比として、曖昧な指示「前回の続きをいい感じに修正して」と具体的な指示「H2-1の章を約300文字に要約して、H3見出しをキャッチーに変更して」を並べ、AI は文脈を察するのが苦手だと述べている。
ドジャースの
毎日のように
できることは、ドジャース全試合の日程・放送情報の同期と、大谷翔平・山本由伸・佐々木朗希の先発予定のみを絞り込んだ同期。Google カレンダーと Apple カレンダー(iPhone / Mac)に対応する。
一度登録すれば日程変更や追加が自動で反映され、手動更新は不要。同期対象は複数同時に選べないため、追加したい対象ごとに登録する形になっている。
ESP32 シリーズを
ESP32 は
Arduino UNO ほど flash が少ないわけでもなく、UART・SPI・I2C といった主要な通信プロトコルに対応し、PWM や ADC も載っている(DAC は搭載していなさそう、と但し書きがある)。
モデル選定の目安として、ESP32-S は高性能でカメラ接続やエッジコンピューティング向け、ESP32-C は S より低性能だが低消費電力で WiFi と Bluetooth を搭載、ESP32-H は Bluetooth のみでさらに低消費電力、と整理している。環境構築と実機動作は後編にまとめられている。
20代の
漠然とした
2つ目は周囲の人と所属組織を大切にすること。著者自身が20代でできなかったこととして挙げ、引き継ぎをきちんとして貢献してから去る人は次の環境でも信頼が続く、若いうちに築いた人間関係は一生ものの財産になると書く。
3つ目は先輩やビジネス書の教えを素直に実行すること。納得できたことは理解できてもできなくてもやってみる、その差が結果の差になるという主張。著者自身、Yahoo 入社時に社内で活躍している先輩に声をかけて話を聞いた経験を挙げている。
「ラズベリーパイ部」を
会社の
想定読者として、ラズベリーパイを電子工作の用語として理解できていない人、マイコンボードとパソコンの違いを人に説明できない人、IT 用語なのに名前だけ聞くと食べ物や別ジャンルに見えるものがあると感じている人を挙げている。
食べ物のパイとはスペルが違うことなど、名前の由来から順に説明していく構成になっている。
日本の
「外部の
調査結果は、データの保管場所を公開資料から確認できたのが56件中41件で、15件は記載なし。認証方式は48件、セキュリティの記述は53件、解約時の持ち出しは49件で確認できた。「書かれていない」ことと「危ない」ことは別だが、社内で説明を求められたときに答えられないという意味では同じ問題になる、と述べる。
4つのうち最も判断材料になるのは「やめるとき」だとしている。入るときより出るときの方が差が出るためである。認証方式については OAuth を「入館証」として説明している。
AI チャット・
「学習に
同じ製品名でも個人向けと法人向けで結論が逆になる例が34件中10件あった。「人が読む場合がある」と規約に明記している製品も実在する。
最も知りたい「学習された内容が他人の回答に出てくるのか」に、規約はほとんど答えていない。記事はこの点を公開研究の側から補う構成を取り、リスクを4段階(使われる/条件つき/使わないと明記/記載なし)の色分けで統一して示している。
未経験から
採用担当と
最初に知ってほしいこととして、IT 業界の仕事はプログラムを書く仕事だけではないと述べる。
未経験から始めやすい仕事として、システムが問題なく動いているか確認する運用・監視、不具合をチェックするテスト、利用者を支援するヘルプデスク・テクニカルサポート、IT 関連の事務作業を挙げている。
AWS DevOps Agent を