[記事] Score: 3
Apple Wallet driver's licenses coming to three new states soon
Apple Walletの運転免許証対応が米3州で近く始まる見通し。ユタ、ケンタッキー、ノースカロライナが候補。バージニアとオクラホマでは最近開始し、16州とプエルトリコが既に対応。ケンタッキーはデジタルIDシステム更新後、ノースカロライナは2027年初頭までに対応予定。AppleはデジタルIDの普及を進めている。
[記事] Score: 3
Apple Walletの運転免許証対応が米3州で近く始まる見通し。ユタ、ケンタッキー、ノースカロライナが候補。バージニアとオクラホマでは最近開始し、16州とプエルトリコが既に対応。ケンタッキーはデジタルIDシステム更新後、ノースカロライナは2027年初頭までに対応予定。AppleはデジタルIDの普及を進めている。
[ブログ] Score: 7
ソフトウェア開発が依然難しい理由を、住宅の改修に例えて非技術者に説明した記事。ハッカソンでAIツールを使い初日9割完成も2日目に破綻した体験を語り、リファクタやインフラを軽視する非技術経営者への反論として、屋根の漏水や2階増築を例に、根本原因への対応や事前の基盤整備が結果的に安価だと説く。ソフトは住宅と違い完成せず、居住しながら改修し続ける必要があると主張している。
[ブログ] Score: 15
SAMLは設計の失敗作でありOIDCへ移行すべきだと論じた記事。著者は、SAMLがXML上に構築され、正規化やenveloped署名、仕様の過剰設計、陳腐化により脆弱性が絶えないと指摘する。SSO業界を築いた功績は認めつつ、OIDCへの移行計画を進めるべきだと主張する。
[ブログ] Score: 27
Unreal LabsのUnreal Agentは、非同期なツール呼び出し管理でモデルの待機やポーリング負荷を減らすエージェント基盤である。Codex比で最大40%のコスト削減を達成し、性能を維持。ベンチマークで高効率を示し、Goライブラリや実行ツールを提供すると述べる。
[ブログ] Score: 31
Discordが年齢確認の新方式を発表し、9割超は確認不要になる。同社は2026年9月、年齢保証の拡大を受け、アカウント年齢や参加サーバー、活動量などのシグナルから18歳以上か13〜17歳かを自動推定すると説明した。メッセージや通話、内容は見ない。成人は変更なし、未成年には年齢制限コンテンツ等を制限する保護を追加。確認方法にはクレジットカード、Apple/Google、Google Wallet、AgeKeyを用意し、顔推定は端末内処理に限定。ベンダー透明性や技術ブログ、透明性報告も公表した。
[サービス・ツール] Score: 23
AIエージェント経由で住宅・アンブレラ保険を比較購入できる保険仲介サービスである。Coverage Catは認可保険ブローカーとして、価格透明性、プライバシー、迅速さを重視し、人間向けポータルとAIエージェント向けAPI・MCPで保険比較を提供する。カリフォルニア、フロリダ、ニューヨーク、テキサス、ワシントンで稼働中である。開発者向けにスキル文書やOpenAPIも公開している。
[記事] Score: 124
AnthropicのClaude Opus 5.5の知能・性能・価格を分析したページである。知能指数は58で212モデル中首位だが、価格は入力100万トークン4ドル、出力20ドルと同価格帯では高めだと報告されている。推論モデルでテキストと画像入力に対応し、コンテキストは100万トークン、出力トークン260Mと冗長性が高いとされる。
[記事] Score: 86
WordPressの未認証パストラバーサル脆弱性に関するアドバイザリ。ページテンプレート解決の不備により、攻撃者が任意のローカルPHPファイルを読み込ませ、サーバー環境とテーマの前提条件が揃えばRCEに至る。CVSSスコア9.2のCriticalでCVE-2026-87902。影響は4.7以降の広範な版、修正は7.1.2と各旧系列へのバックポート。
[サービス・ツール] Score: 730
Anthropicが新モデルClaude Opus 5.5を発表し、性能向上と40%のコスト削減を実現したと述べた記事。前世代Opus 5から性能が大幅に向上し、エージェント型コーディングや知識労働の各種ベンチマークで最高水準を記録したとしている。トークン単価と使用量の削減により実行コストは40%減、出力速度も30%以上向上。安全性監査では過去最高のスコアを得て、プロンプトインジェクション耐性も強化された。生物・サイバー領域は検証プログラム経由で提供し、Sonnet 5.5とHaiku 5.5も追って公開予定としている。
[ブログ] Score: 10
数学学習では、長時間を少回数より短時間を高頻度で行う方が良いと主張する記事。習慣化しやすく、集中力が保て、セッション間の忘却も減るためだ。ただし短すぎると文脈切替の負荷が増え、忙しいと予定通りにできないため、各回は切替コストが無視できる長さにすべきとも述べる。
[ブログ] Score: 75
エージェント型LLMに反復的にRustコードを最適化させ、ベンチマーク指標と制約を与える手法を解説。ベンチマーク操作や安全でないコードを禁じ、品質検証と多様な入力で汎用性を確保。MLアルゴリズムや各種ライブラリで2~20倍の高速化を達成したと主張する。
[ブログ] Score: 256
MetaのAI Museからファイルを書き出させ、内部文書やSSH鍵を含む6.8GBを取得したと筆者が報告する記事。Hatchという内部名の実行環境、約68のスキル、Markdownベースの記憶機構、家庭内デバイス連携Home Linkの文書などが含まれていた。Metaのバグバウンティでは該当なしと判定され、コンテナ脱出は実証できなかったと述べている。
[サービス・ツール] Score: 16
ロボティクスモデル向け高性能配信ランタイムInstinctFlashの公開記事。Jetson Thor上で5B級world-actionモデルをリアルタイム実行する。8モデル系統を単一Runtimeで配信し、FP8やサンプリング削減で最大33.78倍の高速化を報告。RTX 4090/5090にも対応し、Python APIとopenpi互換WebSocket、チェックポイント検証機能を提供する。
[ブログ] Score: 197
TypeSafeのJevに対し、OpenAIが追随し分類機能を自社モデルへ統合する可能性を論じた記事である。OpenAIは従来からLLMを暗黙の分類器として利用してきたと指摘し、Jevの技術的な堀は浅いと見る。TypeSafeの強みは合成データと学習手法にあるが、OpenAIが分類を組み込めば安全性判断やモデル選択、推論の効率化につながると論じる。Jevの精度と汎用性の検証が今後の焦点だと述べる。
[記事] Score: 102
MetaのAIアシスタントMuseに深刻な0-day脆弱性が見つかったと報じる記事。macOSの任意アプリや端末コマンドが未公開設定を変更でき、文字起こし先を攻撃者のサーバーに差し替えると認証トークンが奪われ、アカウント全体を掌握される。ClickFix攻撃だけで成立する。発見したWardle氏は、Metaがクラウド文字起こしを選び全アプリに設定変更を許した設計を問題視し、当初からセキュリティを考えていないと主張。Metaは約12時間後に修正し、AmazonもMuseをブロックした。
[サービス・ツール] Score: 129
DropはgVisor対応のrootless Linuxサンドボックスで、プログラムやコーディングエージェントを隔離する。既存ディストリビューションを利用し、ユーザー名前空間などで動作する。TOML設定で公開するファイルやローカルサービスを指定でき、使い捨て可能な環境を提供する。gVisor利用時はホストカーネルへの直接アクセスを防ぐ追加の隔離層になると説明している。
[記事] Score: 435
OpenAI GPT-6 Astraが、2005年以降未解読だった1941年ドイツ軍エニグマ暗号MVUEHを自律的に解読した。著者によれば、Astraは未解読文を分析してMVUEHを選び、既解読のSIPVXとの平文類似を疑い、反復地名ROSENOWをcribに、EnigmaシミュレータとBombeを自ら実装して鍵と平文を得た。鍵は同日の他鍵と大きく異なり、暗号文転記誤りや左車輪の回転も解読を難しくしていた。Astraは独資料館の文書番号にも言及し、著者はAIが専門的暗号解読者やアーカイブ研究者のように二日で成し遂げたと驚嘆している。
[ブログ] Score: 33
オープンウェイト推論の経済性を分析し、新型GPUの登場で旧世代が陳腐化するとの通説に反論する論文。オープンウェイトモデルは知能当たりで閉鎖モデルの約5分の1の費用で済む。A100はgpt-oss-120bでH100より安く、5年契約でも1ヶ月価格の80%を維持する。長時間エージェントなど遅延許容ワークロードは旧GPUで処理でき、新世代が出ても旧世代は数年稼働し続けられると主張する。ただし需要がA100稼働率を上げた因果は立証していない。
[サービス・ツール] Score: 18
型付き意思決定モデル向けの再現可能なベンチマークJevBenchの結果を紹介する記事。Benchmark Heaven独自のv1.3.0は、状態と限定ルーブリックを入力に型付き回答を返す52システムを、534問(難問220問を含む)で評価し、知能・較正・速度・コストを各25%で合成したスコアで順位付けする。首位はJev 1.13.0で、オープン実装や再ランカー、零ショット分類器も比較対象に含まれる。結果はテストした構成を表すもので、全用途を保証しないとしている。
[記事] Score: 12
AI生成の商用Webコンテンツを構造的特徴から識別する研究。単語レベルではなく、情報の提示順・根拠・語り口などの構造シグネチャに着目する。StoryScopeを商用ブログに再現し、ChatGPT以前の人間記事2,250件と5モデルによるAI記事11,250件を比較。LLMで214特徴を評価し、187構造特徴のみでマクロF1 98.0を達成、言い換え後も98.1。AI記事は整った自己宣伝的な型を持ち、モデル推定正解率は79.3%。人間記事は希少な構造配置を取る。データ等も公開。
[ブログ] Score: 348
AIは知恵を持たず、依存する開発者も同様だと論じる記事。AI生成コードは保守不能になりがちだが、保守性の悪影響は数カ月から数年後まで測れないため、AIは即時報酬で学習できず、未熟なルールや悪いコードから学ぶと著者は指摘。AIに作成・読解を任せると開発者は選択と責任を失い熟達できないと主張し、将来はNO-AI方針を競争優位とする企業が増えると予測する。
[ブログ] Score: 9
ソフトウェアが権限を付与する仕組みを、ホテルの鍵カードの比喩で解説した記事。識別・認証・認可の順序を整理し、RBAC・ABAC・ReBAC各モデルの利点と限界を示したうえで、実システムは役割・関係・属性を組み合わせて同じ問いに答えると説く。認可不備はOWASP Top10の首位で、IDORやUI非表示のみの防御、confused deputyなどの失敗例を挙げ、認可は業務固有の知識を含むため既製品では解決しにくいと主張している。
[ブログ] Score: 84
フィンランドのAIクラウド企業Verdaが1億8900万ドルを調達した記事。Emergence Capital主導で累計調達額は4億5000万ドル超。資金はデータセンター容量、AI Lab、推論基盤、迅速なプロビジョニング、企業向け機能の強化に充てる。2026年7月時点で年換算売上1億6500万ドル、50カ国以上で利用。2027年に250MW超の運用とNVIDIA最新GPUの早期導入を計画する。
[ブログ] Score: 756
AppleがmacOS 27でAI機能の無効化設定を撤去したと批判する記事。著者は2025年、macOS 15.3でApple Intelligenceを無効化したが、27へ更新後に「いいえ」の選択肢が消え、Siriも停止できず22.28GBを占有されたと報告する。AI業界は同意を軽視し選択を奪うと主張し、関連する訴訟や倫理的問題を挙げて批判している。
[ブログ] Score: 357
圧縮アルゴリズムgzipを言語モデルとして利用できるか検証した記事。筆者は圧縮と予測の等価性に着目し、OS標準のgzipにコーパスをウィンドウとして与え、候補文の圧縮長をスコア化してbeam searchでテキスト生成する手法を試した。完全な文章にはならないがコーパスの特徴を捉えた出力が得られたと報告している。実装はzlibのみのPythonで公開されている。
[記事] Score: 147
XiaomiのオープンウェイトモデルMiMo-V2.6-Proの知能・速度・価格を分析した記事。知能指数46で同規模のオープンモデル中央値18を大きく上回り、毎秒76.2トークンと平均より高速。価格は入力100万トークンあたり0.435ドル、出力0.87ドル、キャッシュ割引99%と手頃だがやや冗長。テキスト・画像・音声・動画入力に対応し、100万トークンのコンテキスト窓を持つ。総1兆・活性420億パラメータ、MITライセンスで公開されている。
[ブログ] Score: 181
Git 2.56の内容と、次期Git 3.0に向けた互換性破壊の議論を解説した記事。2.56は約700のコミットを含むが大規模な変更は控えめで、git history dropやgit refsの新サブコマンドなど usability 改善が中心だと説明する。次のリリースを3.0とするかが議論され、SHA-256のデフォルト化、reftable採用、Rust必須化といった互換性破壊が含まれるため懸念が示された。GitHubのSHA-256対応やlibgit2の準備状況も整理され、最終的に2026年12月の2.98を経て2027年4月に2.99と3.0が同時リリースされる計画が示されたと述べている。
[ブログ] Score: 635
不可視の追跡信号「スパイマーク」の危険性を論じた記事。Google SynthIDなどは画像・音声・テキストへ利用者に無断で識別子を埋め込み、身元や公開元を追跡可能にする。標準的なEXIF等と違い検知・削除が難しく、編集後も残存し得る。著者はこれを「透かし」ではなく監視ツール「スパイマーク」と呼び、その脅威を認識すべきだと主張している。
[ブログ] Score: 970
AIが生成した文章は読むに耐えないと筆者が論じる随筆。文脈を共有しないAI文書は読者を疲弊させ、信頼や関係性を損なうと指摘する。一方、自身の論文執筆では校閲や出典整理、図表作成などの補助としてAIを活用し、執筆が速く快適になったと述べる。AIは要約や抽象化に優れるが、経験や関係性に根ざした文章は人間が書くべきだと主張する。
[サービス・ツール] Score: 584
GPT-2をブラウザで動かしTransformerの仕組みを対話的に可視化する教育ツールである。埋め込み、自己注意、MLP、出力確率を解説し、温度やtop-k、top-pも説明する。入力文への注意重みや次トークン予測を操作でき、nanoGPT由来のONNX RuntimeモデルとSvelte、D3.jsで実装されている。補助機構にも触れ、ジョージア工科大学のPolo Clubらが開発した。
[GitHub] Stars: 36,241
Claudeを金融業務向けエージェントとして使うAnthropic公式リポジトリ。投資銀行、株式調査、PE、資産管理などの業務フロー向けに、エージェント、スキル、データコネクタを提供する。Coworkのプラグインとして導入するか、Managed Agents APIで自社ワークフロー基盤に配備するかの二通りで利用可能。出力は人間の承認を前提とし、投資助言ではないと明記している。
[GitHub] Stars: 2,882
エージェント実行基盤SubstrateのGitHubリポジトリ。安全なサンドボックス実行を高密度に実現するランタイムである。コンテナより10倍高密度で数百万サンドボックスを動かし、500ms未満の再開と毎秒500回超の中断・再開、ゼロトラスト分離を特徴とする。アクターを少数のワーカーへ多重化し、Kubernetes上でライフサイクル管理や振り分けを行う。gVisorやmicroVMに対応し、ADK、LangChain、MCPなどを実行可能。Agent Executorやkagentとの連携例がある。早期開発段階で本番利用は未推奨と明記されている。
[GitHub] Stars: 15,251
UniverはAIエージェント向けOffice基盤となるOSSのSDKである。表計算・文書・プレゼン・キャンバス・テーブル・PDFを単一ランタイムで扱い、プラグイン構成、Canvas描画、数式エンジン、ブラウザとNode.js共通のFacade APIを提供する。既存製品への埋め込みやサーバー処理、必要機能のみの構成が可能で、人とAIが同じファイルで協働するOffice体験を構築できる。
[GitHub] Stars: 31,045
Claude Code向けの設定テンプレート集とCLIツールを提供するリポジトリ。AIエージェント、カスタムコマンド、設定、フック、MCP連携、プロジェクトテンプレートを網羅し、100以上のコンポーネントをWebインターフェースやnpxコマンドで閲覧・導入できる。開発ワークフロー強化を目的とする。
[GitHub] Stars: 7,364
Googleが公開したエージェント向け実行基盤AXのリポジトリ。AXはKubernetesに似た宣言的なオーケストレータで、サンドボックス化したエージェントタスクをクラスタ上で大規模に実行する。Task、Workspace、Gateway、Modelの4要素をマニフェストで定義し、ax applyやssh、suspend、resumeなどのコマンドで操作する。Git接続や送信先の許可リスト制限、アイドル時の停止と再開を提供する。ライセンスはApache-2.0。
[GitHub] Stars: 13,964
MVTはAndroidやiOS端末の侵害痕跡を調べるモバイル端末フォレンジックツール群である。アムネスティ国際セキュリティラボが2021年7月にPegasus Projectの文脈で公開し、現在も維持されている。公開IOCを使い既知スパイウェア感染の兆候を走査できるが、公開IOCだけでは端末が安全と断定できないと警告する。mvt-iosやmvt-androidなどのコマンドライン手段を提供し、v3で破壊的変更が導入された。プラグイン拡張やシェル補完にも対応する。
[GitHub] Stars: 2,126
エージェント向けツールのOpenRouterを標榜するレジストリである。3,000以上のAPIを60以上のプロバイダから1つのトークンで呼び出せる。プロキシは認証をサーバー側で注入し上流を中継するだけで、呼び出し側が鍵を持たない設計だとする。チーム独自の鍵やCLI、スキルも登録でき、CLIやClaude Codeプラグイン経由で導入できる。
[GitHub] Stars: 25,726
コーディングエージェントで動画編集を自動化するオープンソースのスキル。browser-use/video-useは、Claude Codeなどに指示するだけで素材フォルダからfinal.mp4を生成する。音声認識による単語単位のタイムスタンプを主な情報源とし、LLMが映像を直接見ずテキストとして読む設計を特徴とする。フィラー除去、カラー補正、字幕焼き込み、アニメーション生成を担い、カット境界ごとに自己評価して最大3回修正を繰り返す。戦略承認後に実行し、セッションをproject.mdに記録する。
Hacker News コメント