Anthropic が
コメントの要約
Anthropic に
コメント欄では、Opus 5 の文体の悪さが直るかに関心が集まり、「文章が自然になった」という記述から苦情を把握したのだろうという見方が出ている。上位モデルの Fable との位置付けが分かりにくくなったという指摘や、「ペースを落とす」という方針はどうなったのかという疑問もある。発表ページのスクロール演出が読みにくいという不満、前日の障害を挙げて安定性を問う声、HAProxy の移植事例に驚いたという反応も並んだ。
Claude Opus 5.5 は
Anthropic が
Anthropic に
コメント欄では、Opus 5 の文体の悪さが直るかに関心が集まり、「文章が自然になった」という記述から苦情を把握したのだろうという見方が出ている。上位モデルの Fable との位置付けが分かりにくくなったという指摘や、「ペースを落とす」という方針はどうなったのかという疑問もある。発表ページのスクロール演出が読みにくいという不満、前日の障害を挙げて安定性を問う声、HAProxy の移植事例に驚いたという反応も並んだ。
GPT-6 Sol and Luna
OpenAI が
OpenAI が
コメント欄では値下げを歓迎する声が多く、Luna の入力 0.10 ドル・出力 0.50 ドルという価格は常識外れだという反応が目立つ。Anthropic の発表日に合わせたのは明らかだという指摘や、Opus 5.5 との比較スコアを求める声もある。Opus 5.5 と Opus 5 の価格表を並べ、この価格差では Claude を選ぶ理由が見えないという書き込みがある一方、Azure や AWS での提供時期がまだ示されていないという指摘も出ている。
Apple has added persistent 'ads' to iOS, and it's driving users crazy
iOS の
iOS の
コメント欄では、小規模な iOS 開発者から、App Store で自分のアプリ名を検索しても広告が 2 枠上に差し込まれ、検索結果が埋もれるという報告が出ている。設定アプリの通知だけは設定から切れないという指摘や、この種の勧誘は何年も前からあるという反論もある。「アップグレードの準備ができています」という文言が実際には有料プランへの誘導だったとの報告のほか、代替となる自由なスマートフォンをどう支えるかという議論、フィーチャーフォンに移ったという書き込みも見られる。
OpenAI GPT–6 Astra breaks Enigma message that has resisted solution since 2005
2005 年から
第二次世界大戦期の
コメント欄では、解読された原文と、綴りの誤りを含む英訳が共有されている。一方で、技能も想像力も要らない偶然の成果で、この種のニュースが続くことに意味はないという批判が最も目立つ。IPO 前の話題作りだという見方や、人間が解いた成果を買い取ったのではないかという疑いもある。ミレニアム懸賞問題までモデル企業のベンチマークになり、知性が電力で買える商品になったことに落ち着かなさを覚えるという書き込みも出ている。
Pentagon says overreliance on AI contributed to missile strike on Iran school
イランの
米軍に
コメント欄では、引き金を引いた人間が責任を負うべきだという意見が多く、判断の重みを AI に移すと決めた人々の責任を免じてはならないという指摘がある。民間人被害軽減チームの縮小を問題視する書き込みや、AI が中国の船舶を核物質の運搬船と誤判定し、米軍が臨検しかけた件を関連事例として挙げる声もある。Palantir の関与を問う投稿も複数見られる。
'We hacked the FBI:' Hackers say they have data on all FBI employees
ShinyHunters が
ハッカー集団 ShinyHunters が
コメント欄では、Oracle の人事システム PeopleSoft が侵害され、そこから AWS の GovCloud へ横展開されたという要約が共有されている。攻撃者がまだ内部にいるなら、何も信用できない状態でどう連携するのかという懸念や、専門人材を減らしたことを原因に挙げる声がある。同じ週に FBI 長官が AI の利用を 605% 増やしたと誇っていたことを指摘する書き込みや、攻撃に Claude や Codex が使われていたら皮肉だという反応も出ている。
OpenAI is well positioned to fast-follow Jev
TypeSafe AI の
TypeSafe AI の
コメント欄では、組み込みの分類が推論モードとどう違い、なぜトークン消費が増えないのかが分からないという質問が出ている。AGI を掲げる OpenAI が Jev のような部品を出すのは敗北宣言になるという見方や、なぜ Anthropic ではなく OpenAI なのかという疑問もある。第三者が 1 週間で近い結果を出しており再現は難しくないという指摘、vLLM に関連 PR がマージ間近だという報告、OpenAI より DeepSeek や Qwen、GLM のオープンモデルへの組み込みに期待するという声が並んだ。
Can gzip be a language model?
gzip の
プロンプトの
コメント欄では、探索空間のごく一部しか探せないため、結果は性能の下限しか示さないという指摘が出ている。アテンションに相当する仕組みがなければ無理で、gzip が特定の文脈しか予測できないのに対し LLM は幅広い文脈を予測できるという反論もある。n-gram モデルや今回の手法をニューラルネットの大規模モデルに近いと言い過ぎる傾向があったという注意がある一方、逆に LLM を圧縮器として使ったらどうかという関心や、分類器への応用を考える声も出ている。
There's a high chance of devices being sold with GrapheneOS preinstalled in 2027
GrapheneOS プロジェクトが、
セキュリティ重視の
コメント欄では、Snapdragon Summit で発表予定の Motorola Signature 27 が対象だろうという推測と、前モデルの英国価格が約 1,460 ドルだという情報が共有されている。今回はプリインストールの話で、対象機種には自分で導入することもできるという補足がある。Google の認証を受けていないビルドは Motorola 自身が販売できないため、別の会社を経由するのだろうという見方もある。銀行アプリが動くのか、ブートローダーを解除できるのかという質問や、より安価な端末を望む声が並んだ。
Claude Opus 5.5 Intelligence, Performance and Price Analysis (Max)
Artificial Analysis に
ベンチマーク集計サイト Artificial Analysis に
コメント欄では、high 同士で比べると 1 タスクあたりのコストが Opus 5 の半分になったという報告がある。一方で、Opus 5 を Astra より上に置くような指数から何を読み取ればよいのかという批判も強い。公開前から使っていたが違いはほとんど感じなかったという声や、発売後しばらくして性能が落ちることがあるので再評価してほしいという要望、社内データで GPT-6 Sol が Luna 並みに劣化していたとの報告も出ている。
Looking forward to Git 2.56 - and 3.0
LWN に
LWN の
コメント欄では、履歴にマージコミットがあると動かない機能や、未フェッチのリモートより遅れていても「最新」と表示される問題に対する記事の皮肉を楽しむ声が多い。Git のドキュメント改善に携わる人物からは、まさにこの問題を Git カンファレンスで議論したとの報告がある。--delete-merged がブランチ整理の自作スクリプトを置き換えられるという期待のほか、rebase と merge の好みの違い、AI が作った PR は rebase すると自動デプロイされないという職場の事情も語られている。
What Sun got wrong
Bryan Cantrill が、
Oxide の
コメント欄では、SPARC は非同期のレジスタウィンドウ退避などの手直しで優れたアーキテクチャになり得たという意見に対し、数か所の改良で済むならとうに改善されていたはずだという反論が出た。レジスタリネーミングが普及する前の議論を根拠にしているという指摘もあり、応酬が続いている。自社ソフトが競合の上でよく動いたという一節から、Windows のゲームが Wine 経由の Linux でより速く動く現状を連想する書き込みもある。
Named and Optional Arguments are Awesome
Rust に
Rust に
コメント欄では、Gleam や Swift のように外部向けのラベルを内部の変数名と別に明示する方式を評価する声が多い。Rust でも引数がパターンなので、束縛の段階で名前を変えられるという小技も紹介されている。OCaml のラベル付き引数を挙げる人もいる。引数名が API になること自体は機能の目的なので問題ではないという意見に対し、Python のように暗黙に名前付き呼び出しを許すと、知らないうちに API を宣言してしまうという反論が続いた。
Arguing about arguments
Steve Klabnik が、
Steve Klabnik が、
コメント欄では、レビュー画面で LSP のインレイヒントを表示できれば読みやすさの問題はかなり解消するのではという提案が出た。これに対し、GitHub や git diff、grep では効かないので読みやすいソースの代わりにはならないという反論がある。無名の構造体リテラルと .. による既定値補完を Rust に入れる案や、同じ整数型の引数が並ぶ場合は newtype で防げるという意見も出て、構文の細部をめぐるやり取りが続いている。
Self-Hosting Behind CGNAT
CGNAT の
ISP の
コメント欄では、中継用の VPS と自宅ネットワークを丸ごとつなぐのは不安だという声に対し、この構成はルーターの DMZ 指定と同じで、中継が侵害されても自宅ネットワークには届かないという説明が返されている。管理の手間を避けて autossh のポート転送を選んだという人もいる。どうせ VPS に払うならそこでサービスを動かせばよいという疑問には、VPS は安い中継に留め、高価な計算とストレージを手元に置くという返答があり、長期運用なら自前のハードウェアが安いという意見も出た。
Fearless SIMD v1.0 is here
Linebender が
Linebender プロジェクトが、
コメント欄では、ドキュメントの使用例が分かりにくいという質問に、関数が Avx512 などの型を引数に受け取って呼び出される仕組みだという説明が返されている。dispatch! マクロの内部は検出した SIMD レベルに対する match だという補足もある。aarch64 の SVE や RISC-V のベクトル拡張のような可変長 SIMD には対応していないという指摘や、strlen のようにループ回数が読めない処理では間接呼び出しのコストが効くのではという議論が続いた。
rift - a tiling window manager for macos
Rust で
Rust で
コメント欄では、同種の AeroSpace が今日 3 回落ちたので良いタイミングだという声や、AeroSpace ではモーダルや Ghostty のタブが別ウィンドウ扱いになる問題があるという報告がある。Homebrew でのインストールが失敗するという報告には、作者が未リリースの変更で tap を更新してしまったと謝罪し、すでに修正済みだと答えている。OmniWM との比較を求める声や、この種のツールが公開 API とアクセシビリティ API のどちらでウィンドウを操作しているのかという質問も出ている。
Textbook review: Is Parallel Programming Hard, And, If So, What Can You Do About It?
Paul McKenney に
Why 0xCAFEBABE?
Java の
Java の
コメント欄では、記事は推測にすぎないとして、James Gosling 本人が由来を語った文章へのリンクが共有されている。CAFE が Java から来たわけではないことに驚く声がある。Burroughs B6700 が未初期化メモリを 0xBADBADBADBAD で埋めていた話や、0xDEADBEEF、0xFEEDFACE をスタックの初期化に使っている例など、各自が知るマジックナンバーを持ち寄る流れになった。
Design your programming languages right (2024)
プログラミング言語の
プログラミング言語を
コメント欄では、直和型を加えたい、C のように if や for の波括弧を省略できる構文はやめるべきだという追加の提案が出ている。複数行文字列については Zig や Lix の方式を例に挙げ、記事で紹介された言語の実装は十分でないという指摘がある。キーワードの記号付けは読みにくくなるという反対に対し、Algol は太字でキーワードを区別していたという話が出て、Unicode の太字文字をどう入力するのか、それは構文なのか表示の慣習なのかという議論に発展した。
C3 0.8.4: Parameter Reflection, Stack Protection, iOS Support—and One Last Renaming
C の
C の
コメント欄では、faultdef が excuse に変わった点に反応が集まり、キーワードを変えるのは安定性を示す方法として最善ではないが、名前自体は気に入ったという声がある。Rust の実験的キーワード yeet に次ぐ名前だという冗談も出ている。C との相互運用を問う質問には、ヘッダファイルは読み込めないが extern 宣言で C の関数を呼べ、構造体のレイアウトも C と同じで、C 向けヘッダの生成はまだ発展途上だという説明が返された。
FloatLib: Verified Floating-Point Arithmetic in Lean
定理証明支援系 Lean で
定理証明支援系 Lean の
取得できたコメントはモデレーターによるもので、この投稿は r/programming の対象外として削除されたと告知している。技術的な内容をめぐる議論は残っていない。
Amundsen’s Maxim
Web API の
Web API の
取得できたコメントは 1 件のみで、HTTP 上で JSON をやり取りする API は優れているが、リンクや URL の規則まで守る純粋な REST は無意味だという意見だった。ほかの論点をめぐる議論は取得できていない。
The History of Compiled (portion of) Javascript and V8 Engine
V8 以前も
Category Theory Explained for Haskell Programmers – Part 1 ZuriHac 2026
ZuriHac 2026 で
Props Are Not a Design System
UI コンポーネントの
UI コンポーネントに
コメント欄では、prop という略語が舞台の小道具を連想させるので言葉選びが悪いという指摘が複数出ている。提案は本来クラスが担う役割そのものだという反応があり、Tailwind は根本的に誤った考えだという意見も出た。別の投稿者は、技術は問わず Tailwind はクラスの誤用の例であり、BEM で整理すれば多くの UI キットで保守しやすい UI を作れると返している。10 年前から知られていることの焼き直しではないかという冷ややかな声もある。
Google に
Google が
README は、エージェントがステートレスなマイクロサービスとも完了型のバッチジョブとも違い、状態を持ち、強い隔離が要り、放置するとループで費用を浪費しうる新しい種類のワークロードだと位置付けている。サンドボックス実行には Agent Substrate を使い、1 クラスタで数十億のタスクを扱う設計だとしている。コアの概念や仕様はまだ調整中で、安定版の前に大きな破壊的変更が入る見込みだと警告している。
Amnesty International が
Mobile Verification Toolkit
現在も Amnesty International とコントリビューターが保守している。README によると、最近 v3 ブランチがマージされて破壊的変更が入り、MVT の出力に依存するスクリプトは動かなくなった可能性がある。デジタルフォレンジックの理解とコマンドライン操作を前提とした、技術者や調査員向けの研究ツールだと明記している。
Anthropic に
Anthropic が
リポジトリには Pitch Agent、Market Researcher、GL Reconciler といった業務単位のエージェントと、/comps や /dcf などのスラッシュコマンドや Skill をまとめた業種別プラグインが含まれる。README は、ここにあるものは投資や法務、税務の助言ではなく、エージェントはモデルやメモなどの下書きを作るだけで、取引の実行や承認は行わず、すべての出力は人間の確認を経る前提だと明記している。
表計算、
Univer は、
README によると、プラグイン型のアーキテクチャ、Canvas ベースの描画、数式エンジンを備え、ブラウザと Node.js の両方で動く単一の Facade API を提供する。Web アプリに生産性ツールを埋め込む用途を想定し、細かくカスタマイズできることを特徴としている。ドキュメントは日本語を含む 6 言語で用意されている。
エージェント向けに
Agent Substrate は、
仕組みとしては、エージェントのようなアプリケーションは大半の時間アイドルであることを利用し、多数の「アクター」を少数の待機中の「ワーカー」に割り当てて多重化する。アクターの生成・破棄や停止・再開、ワーカーへのリアルタイムの割り当て、通信のルーティングを担う。README は Google の公式サポート製品ではないと明記している。
60 以上の
treg は、
README は、Semrush の月 139 ドルのように単発の作業のためには誰も契約しない購読型サービスや、公開 API のないサービスを、treg がアカウントをまとめて持つことで小額課金にしていると説明する。チームの API キーや Skill、CLI も、認証情報をサーバーの外に出さずに全員のエージェントから呼べる。Superdesign チームが自社用に作ったもので、セルフホストもできる。
素材フォルダを
video-use は、
機能として、「えー」などのフィラーや言い直し、テイク間の無音の削除、各セグメントの自動カラーグレーディング、カット点ごとの 30ms の音声フェード、字幕の焼き込みを挙げる。アニメーションは HyperFrames、Remotion、Manim などで生成し、1 つずつ並列のサブエージェントに任せる。書き出し前にカット境界を自己評価し、セッションの記憶を project.md に残して次回に引き継ぐ。
Claude Code の
claude-code-templates は、
取得できた README の冒頭は、npm のバージョンとダウンロード数、MIT ライセンス、Z.AI のスポンサー表示、Claude for Open Source や Neon のオープンソースプログラムへの参加、GitHub Sponsors などのバッジで占められており、機能の詳細な説明までは含まれていない。本日のスター増加は 64、累計は 31,114。
Anthropic launches Claude Opus 5.5, its first model since Dario Amodei's “pace the frontier” essay, and says it has enhanced safeguards to combat risky behavior
The Verge の
Anthropic says Opus 5.5 matches Fable 5.1 “on most tasks” while costing about 40% less to run than Opus 5; Opus 5.5 costs $4/1M input and $20/1M output tokens
The Decoder の
GPT-6 Sol costs $2/1M input and $10/1M output tokens, and GPT-6 Luna costs $0.10/1M input and $0.50/1M output tokens, both about 50% cheaper than GPT-5.6
The Deep View に
Anthropic raises its five-hour usage limits by 20% on Pro, Max, and Team plans, and gives subscription users a rate limit reset
ZDNET の
ShinyHunters claims it used an Oracle PeopleSoft zero-day to hack FBI-related services and steal employee and applicant data; it also defaced the FBI jobs site
404 Media の
OpenAI launches GPT-6 Sol and Luna, saying Sol makes about half as many mistakes as GPT-5.6 Sol and Luna matches GPT-5.6 Sol's performance at ~1% of the cost
ZDNET の
Sources: DeepSeek and Moonshot are among the companies briefing the UN Security Council on AI risks and international security during the UN General Assembly
Reuters の
Qualcomm unveils the Snapdragon 8 Elite Gen 6 and 8 Elite Extreme Gen 6, both on TSMC's 2nm process, with two 5GHz prime cores and six 4GHz performance cores
TechRadar の
Nat Friedman says Meta built Muse “from scratch” but was “heavily inspired” by OpenClaw, as users compare the two, including calling Muse “OpenClaw for normies”
TechCrunch の
Microsoft lays off 268 Xbox staffers across Halo and other studios, as part of an ongoing gaming “reset”; Activision will take over Halo and two other games
The Verge の
8 月ごろから
日本各地の
ブックマークコメントでは、違法性はなく、死蔵されるより AI の知識として使われる方がよいという意見と、処分されるなら惜しい、著作権者への補償の仕組みが欲しいという声に分かれた。日本の AI は古書を学習しないため弱く、米国が日本の本で作った AI を日本人に売る構図に疑問を持つべきだという主張もある。日本語で学習しなければ日本向けの応答がおかしくなるという指摘も出ている。
「思考は
「you can outsource your thinking but you cannot outsource your understanding」と
ブックマークコメントでは、理解のために思考が欠かせない場面があり、前半の「思考は外注できる」は本当かという疑問が出ている。価値判断を含んでこそ思考であり、外注できるのは試行だという意見や、手を動かさずに理解できる仕事はないという声もある。前提条件を知ることが理解であり、それがなければ条件を変えた問いを立てられないという整理が示された一方、思考も理解も外注するなら自分は不要になるという皮肉も見られた。
AI が
同じ
ブックマークコメントでは、紹介ページ自体の見出しや「01 / COMPARISON」のような構成が AI の作るサイトそのものだという指摘が複数集まった。AI に書かせた文書の読み手の負担を減らしたかったので助かるという声がある一方、書ける人間に書かせればよいという意見もある。変換例で、変換前の「ファイル取込処理を非同期化する。」の方が端的で、変換後がかえって遠回しになっているという具体的な指摘も出ている。
個人の
デザイナーの
ブックマークコメントでは、デザイン作成の実験として考え方が面白いという評価がある一方、テキストで勝負するならデザインを頑張りすぎだという声や、すぐに表示されないこと、トランジションが煩わしいことへの不満が目立つ。ホームページとはアクセスカウンターが飛び、キリ番報告を掲示板に書く世界でアニメーションは要らないという懐古的な書き込みや、ゲームにすれば雰囲気の良い作品になりそうだという意見も出ている。
SF 作家テッド・チャンが、
SF 作家テッド・チャンへの
ブックマークコメントでは、AI に意識が宿ったことにしたいのは誰かが問題だという指摘や、チャンは以前から同じ主張を形を変えて述べているという声がある。まず意識を定義し、人間に意識があるかをはっきりさせるべきだという意見や、意識を意思決定の仕組みと定義すれば AI にも持てそうだという見方も出た。SF の代表として扱うのはやめるべきだという批判と、彼の意見を聞きたい需要があるという擁護に分かれている。
判断特化モデル Jev の
TypeSafe AI の
ブックマークコメントでは、判断のコストが下がれば全体のコストも下がるのかという疑問が出ている。Codex に組み込んで試すと判断の精度がやや低く、分類程度にしか使えないという報告がある。ハーネスの定義が曖昧で、実際はループ設計の話ではないかという指摘や、機械的に分岐できる場面は多くなく、モデルのルーティング程度で終わるという見方がある一方、ルーティングや安全制御を軽量モデルに任せる設計は広がりそうだという声もある。
大量注文を
Amazon に
ブックマークコメントでは、ジャンルを問わない購入という分析から好事家による収集の線は消えるという指摘や、「データマイニング(物理)」という反応が出ている。蔵書を処分した荒俣宏氏は数年早すぎたという声、古い本には現在では誤りとされる内容も含まれるという注意もある。物流費の高騰で物理的な古書の価値は今後上がるという予想も見られた。
Claude Code の
settings.json、
ブックマークコメントでは、Skill をパッケージとして管理できるのが Plugins の利点だという本文の一節が引用されている。使いこなしている人はすでにプラグインの自作と共有までしているのかという驚きの声や、社内で Skill を共有するならプラグインにまとめて配ると便利だという要約も見られる。コメントは 3 件と少なく、賛否の議論には至っていない。
50 歳を
「50 歳を
取得できたブックマークコメントは 1 件で、インディーで実績を積んでから業界に入るケースが多そうだという感想だった。ほかの論点をめぐるやり取りは取得できていない。
人間と
オーストリアの
ブックマークコメントでは、将棋でも不利なときに局面を複雑にして耐えるのは常套手段で、羽生九段や藤井六冠のような棋士が意図的に難解な局面へ誘導するという話が複数挙がった。複雑なものを複雑なまま扱う力は、短期記憶の容量で人間が AI に敵うはずがないという見方や、AI の方が人間よりネガティブ・ケイパビリティが高いという表現も出ている。判断を保留することの重要性を読み取る声もある。
判断特化モデル Jev を
TypeSafe AI の
入手方法として、TypeSafe AI の waitlist のほか、Vercel AI Gateway と Cloudflare でも提供されていることを紹介している。ハーネスでは、失敗を Skill 化するような確率的な対処は局所最適になりやすく、新モデルが出ると負債になるため、決定論的なガードレールの需要がある。ただし自作すると速度のために Rust で書くなど手間がかかるという課題を挙げ、Jev をその代わりに使う方向を示している。
Jev の
Jev の
この方式を Gemma3 270M に適用すると、JSON を自己回帰で生成する場合に比べて 77 倍速くなったと報告し、LLM と比べるならこの方式とでなければ公平でないと主張している。さらに、Jev が 100ms 前後で判断を返してリアルタイムに DOOM をプレイするデモを取り上げ、画像入力には非対応なので状態を構造化するハーネスを介していると推測する。第三者のマリオ用ハーネスを使い、OpenRouter 経由の複数の LLM と比較する検証にも進んでいる。
自社 CMS の
自社 CMS
定義方法には、form 要素に toolname などの属性を付ける宣言型と、document.modelContext.registerTool で関数を登録する命令型があり、React 製のエディターのため命令型を採用した。WebMCP は 2026 年 9 月時点で W3C のコミュニティグループで議論中の提案仕様で、Chrome ではフラグ付きプレビューとオリジントライアルの段階にあり、navigator.modelContext から document.modelContext への変更など仕様変更が続いていると注意している。検証には Codex のブラウザ操作を使った。
Rust の
tanakh 氏が
c89! から c23! まで各標準のマクロと、GNU 拡張を有効にした gnu89! から gnu23! までのマクロを用意している。計算だけを行う関数は cinrs_safe 属性を付けると safe として推論させることができ、推論できなければコンパイルエラーになる。自動推論で unsafe を外すこともできるが、シグネチャは明示的であるべきという判断から、注釈した関数以外は unsafe として定義する。struct も repr(C) のレイアウトで Rust の型として定義できる。
Claude Code の
Claude Code に
Mod はプラグインと同じ構成をとり、hooks.json で使うモジュールを宣言し、register.ts に実体を書き、/plugin-types が型定義を生成する。/diff コマンドやテレメトリ、2.1.277 で追加された AGENTS.md のサポートも Mod として実装されており、公式の mods フォルダには現時点で 4 つの Mod がある。Function Hooks は early access で、環境変数 CLAUDE_CODE_ENABLE_FUNCTION_HOOKS を 1 にして有効化する必要がある。
PKSHA の
PKSHA Technology の
dbt の schema.yml を唯一の定義源とするセマンティックレイヤーを Lightdash で構築し、その API を包む MCP サーバで AI クライアントから自然言語で同じ指標を引けるようにした。PII の列は専用テーブルに隔離し、承認された人にだけ期限付きで権限を与え、AI 経由でも PII の値は LLM に返さない。設計と実装は筆者 1 人で、ほぼすべてのコードを Claude Code が書き、着手から公開まで 1 か月、運用費はクラウド利用料の月 1,200 ドル前後だとしている。
判断特化モデル Jev の
発表から
公式発表値は応答時間 70〜500 ミリ秒、入力 100 万トークンあたり 0.042 ドルで出力は無料だが、193.6 倍の速度、444.6 倍のコストという比較値は自社評価の上限寄りの結果だと注記している。定義外のキーや型を返さないことは構造上保証できても、候補から誤った答えを選ぶことはあると指摘する。ユースケースとして、要件定義書の 19 観点レビューや炎上ガード用の Chrome 拡張などを挙げている。
約 200 名の
日本トレカセンターが、
導入前は ChatGPT、Claude、Cursor などが乱立し、どんなプロンプトに業務情報が渡っているか把握できず、費用も膨らんでいた。LiteLLM は各社の API キーを一元管理し、社員ごとのキーに予算上限を設定でき、モデルの切り替えやプロンプトのログ取得、Guardrail による送信前チェックもできる点で選んだ。クライアントは Claude Desktop を自前ゲートウェイに向ける構成も検討したが、開発者モードが前提で非エンジニアには難しいと判断している。
Claude Code を
Claude Code を
そこで人間と仕様を合意した後は、本当に人間の判断が要るまで AI だけで進める形に組み直した。人間が判断するのは「仕様を決める時」と「最後に出す時」の 2 か所で、仕様ループでは要件分析、仕様設計、仕様ドキュメント、AI によるレビューを経て、人間が仕様サマリを承認する。エージェント定義の全文は、自身の業務に合わせたもので万人には合わないとして掲載せず、仕組みと考え方の共有に絞っている。
Vercel の
以前
新しいゼロ設定の Go バックエンド対応では、ルートに go.mod と main.go を置いて普通の Go サーバーを実装するだけでデプロイできる。記事では Hobby プランでアカウントを作り、Vercel CLI 59.23.2 と Node.js 26.9.0、Go 1.27.1 の環境でプロジェクトを作成する手順を追っている。
みのるん氏の
AI エージェントの
ローカルで
54 歳で
RAG 検索の
プロンプト、
Amazon Bedrock の
無職から
Excel 作業の
AI エージェントの