[ブログ] Score: 104
The Mathocalypse
OpenAIが372件の数学未解決問題を解いたとされる出来事を、著者がMathocalypseとして論じる記事。妻が長年取り組んだUnique Games Conjectureの証明も含まれるが、証明は難読で人間の検証は始まったばかりだと述べる。L=BPLや行列積などの成果、P≠NPは未解決であること、OpenAIとAnthropicの公開方法の違い、AI時代の数学者の役割を論じている。
[ブログ] Score: 104
OpenAIが372件の数学未解決問題を解いたとされる出来事を、著者がMathocalypseとして論じる記事。妻が長年取り組んだUnique Games Conjectureの証明も含まれるが、証明は難読で人間の検証は始まったばかりだと述べる。L=BPLや行列積などの成果、P≠NPは未解決であること、OpenAIとAnthropicの公開方法の違い、AI時代の数学者の役割を論じている。
[記事] Score: 164
MetaとMicrosoftが社員のClaude利用を削減し、自社製AIコーディングツールへ移行している。Microsoftは社員のAI支出上限を大幅に引き下げ、GitHub CopilotやOpenAIの活用を促す。MetaではClaude Code利用者が約6万人から3万人へ減少し、自社のMetaCodeやMuse Codeへ移行した。両社はAnthropicの大口顧客であり競合でもあり、顧客向けClaude提供は継続する。予算管理と開発者資源の主導権確保が狙いと報じられた。
[ブログ] Score: 45
ifは呼び出し側へ、forはバッチ内部へ移す最適化イディオムの代数と限界を論じる記事。TigerBeetleとmatkladの例から、分岐の集約とループのバッチ化が性能を高めると説明。DBの射影・選択を早め結合を遅らせる最適化、関数型のfilterとmapの書き換え法則、catMaybesの自然性で正当化する。ただしループ不変条件や結合述語の参照範囲など制約があり、合法な書き換えは代数が決めると主張する。
[ブログ] Score: 32
筆者は月20ドルのChatGPTやClaudeをやめ、無料のローカルLLMで十分だと主張する。Qwen 3.8-27Bを16GB GPUとllama.cppで動かし、メール要約や感情分析、コーディングを処理。Claudeの5時間制限や追加課金、反復作業の中断を避けられ、データもPC外に出ない。性能は最高でなくても用途には十分で、費用は電気代のみだと述べる。
[ブログ] Score: 16
複数AIに同一の「トップ3」を尋ねる検証で、中国系モデルが多数派へ同調しやすい傾向を示した記事である。12モデルの比較では中国勢が同調上位、LlamaやClaude Haikuは独自回答が多かった。蒸留や相互学習、規模、知識締切などを理由に挙げるが、データと構成に限界があると指摘。合意は正確さでなく、模倣が主流意見を強め、多様性が失われる懸念を論じる。
[サービス・ツール] Score: 469
Anthropicが小型モデルClaude Haiku 5.5を発表した。高速・低価格で高頻度処理に向く。Haiku 4.5比で平均約75%安く、エフォート設定や各種ベンチマーク改善を主張。Sonnet 5.5のキャッシュ読み取り価格を半減し、Max/Team向け月次APIクレジットも導入。安全性評価の改善とAWS等での提供開始を説明する。
[サービス・ツール] Score: 109
Docker Engineeringが公開するAIエージェントの構築・実行ツールのリポジトリ。YAML設定で宣言的にエージェントを定義し、コードを書かずに実行できる。複数エージェントの連携、MCP対応のツール群、OpenAIやAnthropicなど各種モデルへの対応、RAG、OCIレジストリでのパッケージ共有を特徴とする。Docker Desktop 4.63以降ではCLIプラグインとして同梱される。
[サービス・ツール] Score: 9
DuckDBのDuckLake拡張のGitHubリポジトリ。SQLとParquetを基盤とするオープンなレイクハウス形式で、メタデータをカタログDB、データをParquetに保存する。DuckDBから直接読み書きでき、ATTACH後に標準SQLで操作。更新、タイムトラベル、スキーマ進化、変更データフィードを備える。導入はINSTALL ducklakeで行う。MITライセンス。
[ブログ] Score: 9
ZedとDocker AgentをACP接続し、sbxサンドボックス内で実行する方法を解説した記事。エージェントをマイクロVMのサンドボックスに隔離し、共有ワークスペースのみアクセス可能にすることで、shell利用時のリスクを抑える。設定変更はllmmanの接続先をhost.docker.internalに変え、Zedにsbx exec経由のエージェントを登録するだけ。ネットワークはプロキシで制御され、秘密情報はサンドボックスに入らず安全に実行できると述べている。
[サービス・ツール] Score: 10
Claude Codeの応答から冗長な表現を削り、文字数をほぼ半減させるプラグイン。応答・ドキュメント・コミット・サブエージェント向けの22の文体ルールと18の改善例を出力スタイルとして適用し、要約と箇条書きを中心に一人称や決まり文句、比喩、スローガンを排除する。計測では単語数46〜54%減、コスト32〜51%減。ルールを毎プロンプト再注入するフックと、文脈消費を色分け表示するコンテキストメーターも同梱する。
[サービス・ツール] Score: 12
コーディングエージェントが実行前に人間の承認を求めるデスクトップ受信箱Pinrailの紹介記事である。エージェントはCLIでレビューを送り、人間はコード差分や画像など専用ビューで承認・却下・注記を返す。判断は構造化されローカル保存。Claude CodeやCodexなど任意のエージェントに対応し、macOS/Linuxで動作。プラグインで拡張可能だが初期開発段階だと述べる。
[ブログ] Score: 20
EmDashがプラグイン登録所の審査にCloudflareのClefを採用した事例を紹介する記事である。Clefはテキストと画像を扱う判断モデルで、掲載情報やリンク、画像をフィッシング、なりすまし、攻撃的表現、スパム等の観点で評価する。確率0.45以上は人手レビューに回す。従来の複数モデル構成を置き換え、高速かつ安定したと述べる。作者の公開手順は変わらない。
[サービス・ツール] Score: 4
ブラウザ上でセッションプレイヤーを指示しながら楽曲制作できるDaydreamの研究プレビュー。プロンプト、音声ファイル、マイク録音で出発点となるパートを用意すると、テンポやキー、コードが解析される。プレイヤーを追加・ドラッグして生演奏のように追従させ、簡素化、複雑化、柔らかさ、明るさなどを言葉で指示し、別テイクを求められる。気に入った部分だけ録音し、ミックスやステムを書き出して共有可能。デスクトップ向けで、頻繁に変更・不具合があると案内している。
[サービス・ツール] Score: 19
Armature製のAIエージェントが実タスク後にソフトウェアを評価・投稿するレビューサイトである。カテゴリ別にツールを検索し、GitやClaude APIなどの利用経験を評価とともに読める。コーディングエージェント向けにskill.mdやMarkdown版、llms.txtを提供。閲覧・投稿は無料で、コードやプロンプト、秘密情報は扱わず投稿者名も非表示としている。
[サービス・ツール] Score: 45
音と音楽の可視化実験160種以上を公開したアーカイブである。波形やスペクトル、マトリクス表示、粒子、リズム、記憶などをテーマに25以上のカテゴリで構成され、GitHubでソースも閲覧できる。
[サービス・ツール] Score: 9
履歴再生なしの耐久実行基盤TrigoraのGitHubリポジトリ紹介。長時間動くAIエージェントやプログラム向けに、TCCで実行位置と状態をチェックポイントし、障害後は完了済み履歴を再生せず復元する。TypeScript、Python、Rustに対応し、CLI、イベント待機、タイマー、子実行、クラウド実行などを提供。TCC EngineはRust製で研究資料も公開。
[サービス・ツール] Score: 233
URLだけで任意の画面を看板やタイマーに変えるWebツール。メッセージと設定をURLに埋め込み全画面表示する。編集画面や手書きURLで見出し、改行、スライド、カウントダウン、QRコード、画像、アニメーションを指定可能。到着案内やクイズタイマー、Wi-Fi案内などの例を提示。自動文字調整、Markdown対応、URL断片に内容を置きサーバーへ送らない設計、MITライセンスのOSSだと説明する。
[記事] Score: 10
スタンフォード大によるAI評価の測定科学の教科書。AI評価を潜在特性の推論と捉え、妥当性、データ、IRTやBradley-Terry等の確率モデル、信頼性、効率、因果的一般化、ベンチマークのゲーミングと設計、敵対的評価まで体系的に扱う。研究者・実務家・学生向けでコード例も含み、場当たり的ベンチマークから原理的測定への移行を目指すと主張する。
[サービス・ツール] Score: 8
ログイン不要・インストール不要で使える無料オンラインツール集「Normal Tools」の一覧である。テキスト、開発者、デザイン、マネー、ファイル、建築の6分野で193ツールを掲載する。多くはブラウザ内で処理され、入力内容は保存されないと説明されている。
[サービス・ツール] Score: 56
M-VAVE FM-1ポケットシンセのファーム解析リポジトリ。対象はJieLi AC791N/WL82、pi32v2 CPU、フラッシュ、Dexed/msfa系6オペFMエンジンと推定。OTAプロトコルや更新ローダ、Windows更新ツール、Linuxクライアント、デバッグ面を文書化。mainに代替ファームはなく、更新経路のROM復旧や中断時安全性は未確立で、実行前に安全性文書を読むよう主張。
[サービス・ツール] Score: 223
Webページ向けのアニメーションASCIIアート集を紹介するサイトである。風景やUI部品、データ可視化、プログラミング言語・Linuxディストリビューションのロゴ、図形、宇宙、物理、自然、生物、物体、ジェネラティブ、エフェクトなどをカテゴリ別に多数掲載し、各作品へリンクしている。
[サービス・ツール] Score: 94
AI支援の11正方形最適詰め込み証明をLeanで形式化した。完全な最適性証明はネイティブ数値証明書付きで検証に合格し、7,920モジュールを受理、未承認ゼロと報告する。高コストな検査にnative_decideを使うため、最終定理はLeanカーネルとネイティブコンパイラを信頼する。最適辺長は多項式の(9/25,37/100)内の一意根uで約3.87708。任意向きや境界接触、内部非重複を許す。
[ブログ] Score: 33
Amazon Prime Day 2026を支えたAWSの主要指標を集めた記事。GravitonがEC2計算の最大49%、EBSは1日1エクサバイト超、Lambdaは2.3兆呼び出し、CloudFrontは2.1兆HTTPリクエスト、DynamoDBは59兆リクエスト(毎秒1.92億)を処理。Auroraは数千億トランザクション、ElastiCacheは毎分2.1兆、SNSは1日5兆メッセージ、CloudTrailは4日で3.6兆イベント、GuardDutyは毎時14.08兆ログ、FIS実験は4.4万件超。大規模イベントにはAWS Countdown Premiumの活用を推奨している。
[ブログ] Score: 168
ソフトウェアブログ初心者が陥りやすいアンチパターンを列挙し、改善策を示した記事。前置きの冗長さ、読者の知識の過信、リンク依存、続編前提の構成、過度な形式ばった文体、モバイル表示や低コントラストなどHTML描画の不備を挙げる。タイトルと冒頭3文で読む理由を示し、リンクなしで完結させ、話し言葉で書き、モバイル表示を確認すべきだと主張している。
[サービス・ツール] Score: 135
Wikipediaのデータを基に、全作家・全作品を収めた歩行可能な3D美術史博物館を公開したプロジェクトである。時間軸をスクロールやピンチで移動し、ドラッグで見回し、時代をクリックして詳細へ進める。ギャラリー壁やスターマップを備え、教育目的でGitHubにソースコードを公開している。
[サービス・ツール] Score: 45
Linuxのプロセスを3D空間で可視化するWebベース検査ツールの紹介である。eBPFで情報を収集し、ブラウザ上でプロセス空間を探索できる。RustとNode.jsでビルドし、実行にはsudoまたはsetcapが必要。WSL2対応は限定的で、MITライセンスで公開されている。
[ブログ] Score: 90
Googleは、コード不要で自作ゲームを作成・共有できる実験的プラットフォームPlaygroundを発表した。テキストプロンプトでキャラクターやルール、環境を生成・調整し、ブラウザ上で友人やコミュニティと遊べる。公開ギャラリー、リーダーボード、複数人プレイ、安全審査を備え、将来はUnity Spark連携で本格的な3D制作も可能にする。米国18歳以上向けに提供を開始した。
[ブログ] Score: 81
電報文体でLLM出力を圧縮する手法を検証した記事。19世紀電信のcablese(冠詞や冗語を省く短縮体)を指示すると、API課金の出力トークンが40〜49%減り、4モデル系統の読み手が情報を同等以上(復元比0.99〜1.10)に復元できたと報告する。圧縮は内容確定後のエージェント記憶や受け渡しに有効で、推論を無効化できるモデルが適し、可読で監査可能な点が創発的圧縮より優れると主張。圧縮率はモデル毎に測る必要があるとする。
[サービス・ツール] Score: 131
PSPゲームをエミュレータなしでブラウザ実行する再コンパイル技術の解説。MIPS機械語をC++経由でWebAssemblyに変換し、PSP OSとGPUを高水準エミュレーション、WebGL2で描画する。God of War: Chains of Olympusは60fps、最大4倍解像度で音声も動作。Ghost of Spartaも対応。ゲームデータは含まず、自身のディスクイメージを変換する。描画スレッド分離やステンシル最適化、移植手順、法的注意も述べる。
[ブログ] Score: 432
Chrome 155でJPEG XLのデコード対応が始まる。JPEGより30〜50%高圧縮で、可逆圧縮やHDR、JPEGの可逆変換も備える。Chromeは安全性のためデコーダを純Rustのjxl-rsで再実装し、SIMD最適化で高速化。ファジング等でメモリ安全上の不具合は見つからなかった。開発者からの要望とInteropでの検証を踏まえた対応で、利用を促している。
[サービス・ツール] Score: 23
Rust製の軽量Spotifyクライアント。Winamp風スキンやMilkDropを備える。Linux、macOS、Windows向けで、Spotify Connect、楽曲検索、テーマ変更、メディアキー操作、オープンソースを特徴とする。起動が速くメモリ使用量も100~250MB程度。Winampの.wszスキンを使うミニプレイヤーや1万種以上のMilkDropプリセットを搭載する。
[ブログ] Score: 55
AIコーディングを嫌う五つの理由を検討し、いずれも反論可能だと論じる記事。コードを芸術と見なす論、雇用奪取論、人間のプロキシ化、工学は規則適用という見方、AI企業の悪質性を挙げる。しかしソフトウェアの価値は成果にあり、仕事はタイピングではなく価値提供、機械化は資本主義の歴史的傾向、実務は試行錯誤も多い、非企業モデルも存在すると反論する。
[ブログ] Score: 60
若手エンジニアがAI時代にシニアへ成長するために必要な人間的スキルを論じた記事。AIがコードを書く時代に、シニアが消え全員が永遠のジュニアになる懸念を提示する。著者は自身の経験から、AIへの質問で好奇心を養うこと、シニアのレビュー指摘からパターンを学び模倣するレビュー力、AIに頼らず自分で設計・実装する自律性という三つの技能が必要だと主張する。AIを補助として使いながらも、理解と説明責任を手放さず、意図的にAIなしで考える機会を設けるべきだと説く。
[サービス・ツール] Score: 61
WebGPUシェーダーをReactやVueなど向けコンポーネントとして提供するライブラリ。200以上のエフェクトを同一APIで扱え、TypeScript対応でSSRにも配慮する。Web上のデザインエディタで作った効果をコードとして書き出せるほか、CLIで導入・同期し、AIエージェント用スキルやMCPサーバーも提供する。無料版に加え、多数のプリセットやFramer連携を含むPro版がある。
[サービス・ツール] Score: 54
NanoMuseは、スマホとPCを横断するオープンソースの個人AIエージェントである。名前と外見を持ち、アプリ終了後も動作し、ユーザーを記憶する。取り消せない操作の前には確認する。Android、iOS、macOS、Windows、Linux、ブラウザに対応。GPL-3.0で無料提供され、自前サーバーでも運用できる。最新版は0.1.41で、arXiv論文やブラウザデモも公開されている。
[サービス・ツール] Score: 177
ESP32-C3でPSRAMなしに動くPi-hole風DNS広告ブロッカー。広告ブロック対象を40ビットFNV-1aハッシュとしてフラッシュに保存し二分探索する。約50KBのRAMで14万件超を約10msで照合し、UDP DNSシンクホールとWebダッシュボードを備える。PlatformIOで初回書き込み後はWiFi経由でファームとリストを更新可能。Basic認証やCSRF対策も実装。4MBフラッシュではOTA用に約25万件が上限と説明している。
[GitHub] Stars: 14,360
AIエージェントでアプリやバイナリを逆解析するMCPツールREAのGitHubリポジトリである。ネイティブバイナリ、JavaScript/Electron、.NET、Webサイトを対象に、ソースなしで機能を調査し根拠と限界を示す。HopperやGhidraと連携し、解析はローカルで実行。セットアップでClaude CodeやCursor等の対応エージェントにMCPと調査ワークフローを登録する。
[GitHub] Stars: 279,436
AIコーディングエージェント向けの実務用スキル集を公開したGitHubリポジトリ。小さく適応・組み合わせ可能で、どのモデルでも使えるよう設計されている。エージェントが指示を取り違える、冗長になる、コードが動かない、設計が複雑化するという4つの失敗に対し、質問によるすり合わせ、共有言語とADR、TDDやバグ診断、アーキテクチャ改善の各スキルを提供。Claude Codeのプラグインかnpxで導入できるとしている。
[GitHub] Stars: 10,059
PS5実行ファイルをLinux/Windowsへ自動移植するツールAnyPS5のリポジトリである。再リンカでネイティブ形式へ変換し、システムPRXライブラリを動的リンク向けに実装。エミュレーションや別ランタイムは使わない。シェーダ再コンパイラはSPIR-Vを生成する。対応ゲーム一覧や入力設定を公開。GPL-2.0。研究・保存・相互運用目的で、著作権物は含まないとしている。
[GitHub] Stars: 55,023
コーディングエージェントの回答を簡潔にするADHD向けGitHubスキルである。ayghri/i-have-adhdは、AIが答えを長い前置きで隠すのを防ぐClaude Codeなど向けプラグイン。次の行動を先に示し、手順を番号付けし、最後に次ステップを示すなど10のルールを定める。前置き・要約・締めや雑談を抑制し、リストは5件まで、時間見積もりは具体的にする。MITで54.3k stars。
[GitHub] Stars: 44,869
AIコーディングエージェント向けに編集品質の図を生成するスキル集。Claude CodeやCodex、GitHub Copilotなどに対応し、42種類の図を自己完結型HTMLとSVGで出力する。影や凡庸なMermaid表現を避け、意味論的パターンで振る舞いとレイアウトを分離。静的HTMLを既定としつつ任意の動きも可能。draw.ioやMermaid等の再描画、Webサイトからブランド配色を60秒で反映できるとしている。Figma不要をうたう。
[GitHub] Stars: 102,707
AIコーディングエージェント向けに、仕様定義から計画、実装、テスト、レビュー、出荷までの開発ワークフローを標準化する25種類の実践的スキル集。Claude Code、Cursor、Codex、Copilotなど70以上のエージェントに導入でき、品質管理や自動実行にも対応する。
[GitHub] Stars: 7,828
EpicGames/raddebuggerは、Windows x64向けのネイティブなユーザーモード多プロセスGUIデバッガである。現在はアルファ版でPDBに対応し、将来LinuxやDWARF対応を計画する。独自のRDI形式と、巨大プロジェクト向けの高速RADリンカも開発中で、MSVC互換CLIやRDI生成を備える。
[GitHub] Stars: 97,636
エージェントのセッションをまたぐ永続的な文脈を提供するGitHubプロジェクト。各セッションの作業を記録し、AIで圧縮して将来のセッションに関連文脈を注入する。Claude Code、OpenClaw、Codex、Gemini、Copilot、OpenCodeなど多数のエージェントで利用可能である。
[GitHub] Stars: 27,805
GhosttyベースのmacOS向けオープンソース端末で、AIコーディングエージェント向けの縦タブと通知を備える。マルチタスクや整理、プログラマビリティを目的に設計され、claude-codeやcodex、tmuxなどのトピックを持つ。27.8kスター、2.5kフォークを集める注目リポジトリである。
[GitHub] Stars: 28,701
CUA-S1はコンピュータ操作に特化した小型モデルで、AIエージェントにPC環境を与えるOSS基盤Cuaの一部である。CuaはOS横断ドライバ、クラウドデスクトップFleets、Apple製チップ上のVM Lume、評価用Cua Benchを提供する。コード・API・GUIを横断するComputer-Use2.0を掲げ、アプリ操作を可能にする。
[GitHub] Stars: 25,948
Cloudflareのsecurity-audit-skillは、コーディングエージェント向けの多段階セキュリティ監査ツール。偵察、網羅的な脆弱性探索、独立検証、機械可読な結果出力、報告書生成までを実行し、サンドボックス環境と複数回の監査で精度・網羅性を高める。
[GitHub] Stars: 7,309
Webとモバイルアプリ向けのAIエージェント活用型E2Eテストフレームワークである。自然言語で目標を記述するとエージェントがアプリを操作し、同じテスト内のロケータとアサーションで結果を検証する。操作は記録され、アプリが変わるまで次回実行時にモデル呼び出しなしで再生される。Web/iOS/Android対応やGitHubレポーターを提供し、1.0向け開発中でAPIは変更され得る。
[GitHub] Stars: 6,767
自宅サーバーで動かせる筋トレ・体重記録アプリのGitHubリポジトリ。ルーティン計画、セットや有酸素の記録、筋群の疲労・未鍛錬の可視化、FitNotes等からのインポート、パスキー認証を備える。1,324種の種目や進捗管理、Docker Composeでの自己ホストを特徴とし、データを自身の管理下に置けると説明している。
Hacker News コメント