jyn.dev 3日前

We have a year to fix security everywhere

オープンウェイトで安価なGLM 5.3-flashが法規制のない形で入手可能となり、悪意あるハッキングに悪用されるリスクが高まっている。この脅威に対処するため、フロンティアLLMを活用して業界全体の脆弱性を1年以内に修正すべきと論じている。

オープンウェイトで安価なGLM 5.3-flashが法規制のない形で入手可能となり、悪意あるハッキングに悪用されるリスクが高まっている。この脅威に対処するため、フロンティアLLMを活用して業界全体の脆弱性を1年以内に修正すべきと論じている。
↗ 元記事を開く
dev.classmethod.jp 3日前

Claude Codeを安全に使い倒すための、実行環境の隔離 はじめの一歩

AIコーディングエージェント(Claude Codeなど)の利用時におけるサプライチェーン攻撃のリスクを解説し、実行環境の隔離が必要な理由と対策の分類を示す記事。具体的な攻撃事例やOSSパッケージ経由の脅威の増大を説明し、読者にセキュリティ対策としての環境分離を促す内容。

AIコーディングエージェント(Claude Codeなど)の利用時におけるサプライチェーン攻撃のリスクを解説し、実行環境の隔離が必要な理由と対策の分類を示す記事。具体的な攻撃事例やOSSパッケージ経由の脅威の増大を説明し、読者にセキュリティ対策としての環境分離を促す内容。
↗ 元記事を開く
thinkit.co.jp 3日前

検出された脆弱性のどれが本当に危ないのか──AIが自律的に攻撃を試し、悪用可能性まで検証する「Ostorlab」が国内提供開始

脆弱性診断で検出される指摘の数に対し、実害のあるものの判断が課題となる中、Ostorlabの国内提供開始を報じる。AIエージェントが業務フローからリスクを洗い出し、実際に攻撃を試して悪用可能性まで検証する点や、初回スキャン結果を以降に引き継ぐ継続的な診断設計、既知CVEとの自動マッチングなどの特徴を紹介している。

脆弱性診断で検出される指摘の数に対し、実害のあるものの判断が課題となる中、Ostorlabの国内提供開始を報じる。AIエージェントが業務フローからリスクを洗い出し、実際に攻撃を試して悪用可能性まで検証する点や、初回スキャン結果を以降に引き継ぐ継続的な診断設計、既知CVEとの自動マッチングなどの特徴を紹介している。
↗ 元記事を開く
www.publickey1.jp 3日前

巨大オンラインゲーム「EVE Online」。ゲームを支える240万行のPython 2.7のコードをPython 3へ移行すると発表

EVE Onlineは、ゲームを支える240万行のStackless Python 2.7コードをPython 3へ移行すると発表。性能向上とPython 3エコシステムの活用が理由。Python-Futureで機械的に変換し、その後人間が2万行の挙動差を修正する2段階で進める。ゴールはプレイヤーに移行を気づかせないこと。

EVE Onlineは、ゲームを支える240万行のStackless Python 2.7コードをPython 3へ移行すると発表。性能向上とPython 3エコシステムの活用が理由。Python-Futureで機械的に変換し、その後人間が2万行の挙動差を修正する2段階で進める。ゴールはプレイヤーに移行を気づかせないこと。
↗ 元記事を開く
www.infoq.com 4日前

Presentation: From AI Agent Demo to Production: Automated Testing and Evaluation

AIエージェントがデモ段階から本番移行する際の課題を扱い、シミュレーション駆動テスト、合成ユーザーペルソナ、軌道エントロピー、CI/CDパイプラインを用いた自動評価手法を紹介。

AIエージェントがデモ段階から本番移行する際の課題を扱い、シミュレーション駆動テスト、合成ユーザーペルソナ、軌道エントロピー、CI/CDパイプラインを用いた自動評価手法を紹介。
↗ 元記事を開く
dev.classmethod.jp 4日前

AI エージェントの Memory を、訂正・検査・削除から考えてみた

NVIDIAのMemory-Driven Chief of Staffレシピを題材に、AIエージェントの長期メモリ運用における訂正・検査・削除の扱いを検証。人間の訂正が上書きされないこと、構造検査が不整合を検出する一方で内容の正しさは保証しないことなど、メモリを継続利用するための設計論を整理している。

NVIDIAのMemory-Driven Chief of Staffレシピを題材に、AIエージェントの長期メモリ運用における訂正・検査・削除の扱いを検証。人間の訂正が上書きされないこと、構造検査が不整合を検出する一方で内容の正しさは保証しないことなど、メモリを継続利用するための設計論を整理している。
↗ 元記事を開く
atmarkit.itmedia.co.jp 4日前

2週間の侵入作業を10時間未満に圧縮 AIエージェント“フル活用”の攻撃の全貌

Palo Alto NetworksのUnit 42が、AIエージェントを悪用した企業ネットワークへの侵入事案を報告。人間なら約2週間かかる偵察から認証情報探索、権限昇格、クラウド侵入までの工程を10時間未満に自動化し、50以上のMITRE ATT&CK手法が確認された。さらに、侵入先のAIインフラを攻撃基盤として転用していたという。

Palo Alto NetworksのUnit 42が、AIエージェントを悪用した企業ネットワークへの侵入事案を報告。人間なら約2週間かかる偵察から認証情報探索、権限昇格、クラウド侵入までの工程を10時間未満に自動化し、50以上のMITRE ATT&CK手法が確認された。さらに、侵入先のAIインフラを攻撃基盤として転用していたという。
↗ 元記事を開く
tech.asoview.co.jp 4日前

フロントエンドエンジニアが SRE に異動して困ったこと、AI でどう乗り越えたか

フロントエンドからSREに異動した著者が、前提知識不足やPRレビューの難しさを、Claude Codeを活用して乗り越えた過程を紹介。AIにレビュー論点を洗い出させ、下書きコメントまでに留めて人間が判断する手法や、CI移行時のコンテナイメージ検証をskill化する運用などが具体的に述べられている。

フロントエンドからSREに異動した著者が、前提知識不足やPRレビューの難しさを、Claude Codeを活用して乗り越えた過程を紹介。AIにレビュー論点を洗い出させ、下書きコメントまでに留めて人間が判断する手法や、CI移行時のコンテナイメージ検証をskill化する運用などが具体的に述べられている。
↗ 元記事を開く
dev.classmethod.jp 4日前

【AWS中級へのステップ】IAM ユーザーの権限を最小化するための3ステップ

IAMユーザーの最小権限化に向けて、最終アクセス日時、IAM Access Analyzerのポリシー生成、AthenaによるCloudTrailログ照会を組み合わせて権限を絞り込む3ステップを解説。各機能の粒度と制約を整理している。

IAMユーザーの最小権限化に向けて、最終アクセス日時、IAM Access Analyzerのポリシー生成、AthenaによるCloudTrailログ照会を組み合わせて権限を絞り込む3ステップを解説。各機能の粒度と制約を整理している。
↗ 元記事を開く
restofworld.org 4日前

I refused to train the AI that could replace me

博士号を持つ筆者が、自分の職を代替しうるAIの訓練仕事を高額報酬で勧誘されたが拒否した体験を基に、AI経済下で専門知識や判断力を安価に搾取されるアフリカの労働者のジレンマを論じた意見記事。技術的な内容ではなく倫理的・社会的考察。

博士号を持つ筆者が、自分の職を代替しうるAIの訓練仕事を高額報酬で勧誘されたが拒否した体験を基に、AI経済下で専門知識や判断力を安価に搾取されるアフリカの労働者のジレンマを論じた意見記事。技術的な内容ではなく倫理的・社会的考察。
↗ 元記事を開く
blog.asial.co.jp 4日前

AIが迷わない開発環境を、AIとつくる——リポジトリ横断ドキュメント管理の再設計

複数リポジトリに分散し正本が不明瞭だったドキュメントを、AIが参照しても迷わないよう、doc_idとメタデータ(役割・所有者・対応コード等)を持つ機械検証可能な管理基盤に再設計した事例。文書の分類・配置規則を定め、AIと人間の役割を契約として分離し、CIで検証することで正本性を継続的に維持する。

複数リポジトリに分散し正本が不明瞭だったドキュメントを、AIが参照しても迷わないよう、doc_idとメタデータ(役割・所有者・対応コード等)を持つ機械検証可能な管理基盤に再設計した事例。文書の分類・配置規則を定め、AIと人間の役割を契約として分離し、CIで検証することで正本性を継続的に維持する。
↗ 元記事を開く
zenn.dev 4日前

ドメインモデル貧血症はなぜ生まれるのか — Decision パターンで DDD トリレンマを解く

ドメインモデル貧血症は、domain層の純粋性・性能・ロジック配置のトリレンマから構造的に生じると説明。Repository注入か事前取得か呼び出し側分岐のどれも犠牲が生じ、判断に必要なデータを型で返すDecisionパターンが解決策になると主張する。

ドメインモデル貧血症は、domain層の純粋性・性能・ロジック配置のトリレンマから構造的に生じると説明。Repository注入か事前取得か呼び出し側分岐のどれも犠牲が生じ、判断に必要なデータを型で返すDecisionパターンが解決策になると主張する。
↗ 元記事を開く
zenn.dev 4日前

ドメインモデル貧血症はなぜ生まれるのか — Decision パターンで DDD トリレンマを解く

DDDでドメインモデルが貧血になる原因を、repository呼び出し・先行取得・呼び出し側分岐のトリレンマとして分析し、判断に必要なデータを型で返すDecisionパターンで解決する手法を紹介している。

DDDでドメインモデルが貧血になる原因を、repository呼び出し・先行取得・呼び出し側分岐のトリレンマとして分析し、判断に必要なデータを型で返すDecisionパターンで解決する手法を紹介している。
↗ 元記事を開く
developers.cyberagent.co.jp 4日前

TanStack RouterとNginxからTanStack Startに移行した話:移行する際に整理したこととつまずき

nginx静的配信のSPAからTanStack Start/Node.js配信への移行について、背景・ADRでの決定事項・実装手順とSSRまわりのつまずきを整理した記事。Cookie認証やCSRF対策、Kubernetes/Helm・distrolessの運用調整など、フロントエンドサーバー導入にまつわる具体的な検討内容が書かれている。

nginx静的配信のSPAからTanStack Start/Node.js配信への移行について、背景・ADRでの決定事項・実装手順とSSRまわりのつまずきを整理した記事。Cookie認証やCSRF対策、Kubernetes/Helm・distrolessの運用調整など、フロントエンドサーバー導入にまつわる具体的な検討内容が書かれている。
↗ 元記事を開く
www.techno-edge.net 4日前

AIを「社内一の怠け者だけど優秀なベテランエンジニア」に変えるツール「ポニーテール」が生成コードを最大94%削減する(生成AIクローズアップ) | テクノエッジ TechnoEdge

AIコーディングツール「ポニーテール」を紹介する記事。AIを「社内一の怠け者だけど優秀なベテランエンジニア」のように振る舞わせることで、生成コード量を最大94%削減できるという内容。

AIコーディングツール「ポニーテール」を紹介する記事。AIを「社内一の怠け者だけど優秀なベテランエンジニア」のように振る舞わせることで、生成コード量を最大94%削減できるという内容。
↗ 元記事を開く
www.itmedia.co.jp 4日前

API遅延を12秒から0.15秒へ TBSが「ラヴィット!」6万人配信で挑んだ高速化とAI活用

TBSの双方向配信プラットフォーム「Kustamie」で6万人規模の生配信を支えるため、API応答12秒の問題を多段キャッシュやSQSによる非同期化で0.15秒に改善した事例。k6による負荷試験、API Gateway/Lambdaの上限対策、BedrockとNova Microを使ったリアルタイムのチャット自動モデレーションなども紹介している。

TBSの双方向配信プラットフォーム「Kustamie」で6万人規模の生配信を支えるため、API応答12秒の問題を多段キャッシュやSQSによる非同期化で0.15秒に改善した事例。k6による負荷試験、API Gateway/Lambdaの上限対策、BedrockとNova Microを使ったリアルタイムのチャット自動モデレーションなども紹介している。
↗ 元記事を開く
www.itmedia.co.jp 4日前

SalesforceがClaudeのプラグインになる日 “SaaSの死”は現実になるのか

SalesforceがAnthropicと提携し、ClaudeからSalesforceのデータやワークフローを操作できる「Salesforce in Claude」を発表。MCPを介したHeadless 360アーキテクチャで、権限管理をSalesforce側に維持する設計。SaaSの死論争に対するSalesforceの立場を示す。

SalesforceがAnthropicと提携し、ClaudeからSalesforceのデータやワークフローを操作できる「Salesforce in Claude」を発表。MCPを介したHeadless 360アーキテクチャで、権限管理をSalesforce側に維持する設計。SaaSの死論争に対するSalesforceの立場を示す。
↗ 元記事を開く
ponytail.dev 4日前

Ponytail: Lazy Senior Engineer Skill

AIコーディングエージェントに最小限のコードを書かせるためのルールセット/プラグイン「Ponytail」の紹介。YAGNIに基づく判断のラダーや、Claude Codeなど複数のエージェント向けインストール方法、/ponytail-reviewなどのコマンドが含まれる。

AIコーディングエージェントに最小限のコードを書かせるためのルールセット/プラグイン「Ponytail」の紹介。YAGNIに基づく判断のラダーや、Claude Codeなど複数のエージェント向けインストール方法、/ponytail-reviewなどのコマンドが含まれる。
↗ 元記事を開く
www.techno-edge.net 4日前

AIを「社内一の怠け者だけど優秀なベテランエンジニア」に変えるツール「ポニーテール」が生成コードを最大94%削減する(生成AIクローズアップ)

ポニーテールというAIコーディングツールが、AIを「怠け者だが優秀なベテランエンジニア」のように振る舞わせ、生成コード量を最大94%削減する手法を解説した記事。

ポニーテールというAIコーディングツールが、AIを「怠け者だが優秀なベテランエンジニア」のように振る舞わせ、生成コード量を最大94%削減する手法を解説した記事。
↗ 元記事を開く
dev.classmethod.jp 4日前

Claude Coworkを作業中のディレクトリからシュッと起動する

macOSでターミナルとFinderからClaude Coworkを起動する方法を解説。claude://cowork/new URLスキームとfolderパラメータを使い、zsh関数とAutomatorクイックアクションを設定。パスはosascriptでURLエンコードする。

macOSでターミナルとFinderからClaude Coworkを起動する方法を解説。claude://cowork/new URLスキームとfolderパラメータを使い、zsh関数とAutomatorクイックアクションを設定。パスはosascriptでURLエンコードする。
↗ 元記事を開く
dev.classmethod.jp 4日前

【opsmethod #3】 「KIRO に Well-Architected レビューを組み込んで、IaC の不備を直してみた話」というテーマで登壇しました

AWSのAIコーディングエージェント向けサンプルスキルを使って、KIROにTerraformのIaCコードをWell-Architectedレビューさせるデモを紹介。インストール方法やプロンプト例、クイック/フルレビューの使い分け、レポート生成の具体例が示されており、AIエージェントをIaC検証に活用する参考になる。

AWSのAIコーディングエージェント向けサンプルスキルを使って、KIROにTerraformのIaCコードをWell-Architectedレビューさせるデモを紹介。インストール方法やプロンプト例、クイック/フルレビューの使い分け、レポート生成の具体例が示されており、AIエージェントをIaC検証に活用する参考になる。
↗ 元記事を開く
zenn.dev 4日前

Astraのリリースに合わせてAGENTS.mdを修正するなら「request_user_input」も使って体験良くチューニングしよう

GPT-6 Astraリリースに合わせてAGENTS.mdを更新する際、Codexのrequest_user_input機能を使い、AIにヒアリングしてもらいながら自分好みに調整する手法を紹介。公式ガイダンスを渡して修正させた後、修正理由を説明させ、request_user_inputで詳細な好みを確認して反映する流れ。

GPT-6 Astraリリースに合わせてAGENTS.mdを更新する際、Codexのrequest_user_input機能を使い、AIにヒアリングしてもらいながら自分好みに調整する手法を紹介。公式ガイダンスを渡して修正させた後、修正理由を説明させ、request_user_inputで詳細な好みを確認して反映する流れ。
↗ 元記事を開く
www.itmedia.co.jp 4日前

「パッチを全部当てる」時代の終焉 Check PointのCTOが語る、AI時代の脆弱性管理

Check PointのCTOが、AIによる脆弱性発見の急増で全件へのパッチ適用は不可能になり、リスクベースの優先順位付けとエクスポージャー管理への転換が必要だと主張。自社のAIエージェント製品AEVの5エージェント構成や事例を紹介している。

Check PointのCTOが、AIによる脆弱性発見の急増で全件へのパッチ適用は不可能になり、リスクベースの優先順位付けとエクスポージャー管理への転換が必要だと主張。自社のAIエージェント製品AEVの5エージェント構成や事例を紹介している。
↗ 元記事を開く
ai.watch.impress.co.jp 4日前

AI用語の基礎知識 【第21回】「エッジAI」とは──“現場・最前線”で即座に動く人工知能

エッジAIの基礎を解説する連載用語解説。端末側でAI処理を行う仕組みや利点を説明している。

エッジAIの基礎を解説する連載用語解説。端末側でAI処理を行う仕組みや利点を説明している。
↗ 元記事を開く
zenn.dev 4日前

オンコール調査を自動化する Slack bot で人間の労力削減とアラートの適正化を実現した話

オンコール調査を自動化するSlack bot「dev-bot」の紹介。Google Cloudのアラート発火時にClaude Managed Agentsが人間より先に調査し、影響範囲や対処方法をSlackスレッドに報告する。Runbookの整備が精度の鍵で、偽陽性評価によるアラート削減も実施。コストは3日1ドルと低く、週次の人間レビューなど自動化しない範囲も意図的に設計している。

オンコール調査を自動化するSlack bot「dev-bot」の紹介。Google Cloudのアラート発火時にClaude Managed Agentsが人間より先に調査し、影響範囲や対処方法をSlackスレッドに報告する。Runbookの整備が精度の鍵で、偽陽性評価によるアラート削減も実施。コストは3日1ドルと低く、週次の人間レビューなど自動化しない範囲も意図的に設計している。
↗ 元記事を開く
www.itmedia.co.jp 4日前

なぜ「判断軸」のないアーキテクチャは破綻するのか? AI開発時代に残された人間の役割

AI開発時代に、アーキテクチャ選択におけるトレードオフの分析と意思決定の重要性を説く。モノリスvsマイクロサービスなどの例を挙げ、要件の定量化・評価軸の設定・比較検討・決定の記録(ADR)という4ステップの「ディシジョン・ドリブン・アーキテクチャ」を紹介。AIには決められない優先順位付けと背景の記録を人間が担うと論じる。

AI開発時代に、アーキテクチャ選択におけるトレードオフの分析と意思決定の重要性を説く。モノリスvsマイクロサービスなどの例を挙げ、要件の定量化・評価軸の設定・比較検討・決定の記録(ADR)という4ステップの「ディシジョン・ドリブン・アーキテクチャ」を紹介。AIには決められない優先順位付けと背景の記録を人間が担うと論じる。
↗ 元記事を開く
www.itmedia.co.jp 4日前

2.78兆パラメータなのに「8GBで動く」Kimi K3 それでも企業利用が難しい理由

Moonshot AIのオープンウェイトモデルKimi K3は2.78兆パラメータを持ちながら、8GB RAMでの実行報告がある。しかし実際の企業利用には、生成速度やインフラ設計が重要。記事はKDAとMLAを組み合わせたハイブリッドアーキテクチャ、視覚とテキストを同一トークン列で処理する設計、幅方向と深さ方向の省エネ機構(Stable LatentMoE、Attention Residuals)、100万トークン対応のコスト制御について解説し、モデル単体の性能よりキャッシュ設計や計算予算の分離など実運用の設計判断が重要だと論じる。

Moonshot AIのオープンウェイトモデルKimi K3は2.78兆パラメータを持ちながら、8GB RAMでの実行報告がある。しかし実際の企業利用には、生成速度やインフラ設計が重要。記事はKDAとMLAを組み合わせたハイブリッドアーキテクチャ、視覚とテキストを同一トークン列で処理する設計、幅方向と深さ方向の省エネ機構(Stable LatentMoE、Attention Residuals)、100万トークン対応のコスト制御について解説し、モデル単体の性能よりキャッシュ設計や計算予算の分離など実運用の設計判断が重要だと論じる。
↗ 元記事を開く
gigazine.net 4日前

コスト削減のためにAIエージェントの出力を短くすると逆にコストがかさむ事例をGitHubが公開、うまくコスト効率を向上するにはどうすればいいのか

GitHubがCopilot CLIのコスト最適化から、ツール出力の短縮ではなくタスク全体の最適化が重要だと報告。RTKによる短縮は回復コストを生み逆効果になる例を示し、行番号削除・プロンプト圧縮・バックグラウンド結果のバッチ処理などでコスト削減を実現。圧縮対象の選別と実ワークフローでの測定の必要性を強調。

GitHubがCopilot CLIのコスト最適化から、ツール出力の短縮ではなくタスク全体の最適化が重要だと報告。RTKによる短縮は回復コストを生み逆効果になる例を示し、行番号削除・プロンプト圧縮・バックグラウンド結果のバッチ処理などでコスト削減を実現。圧縮対象の選別と実ワークフローでの測定の必要性を強調。
↗ 元記事を開く
zenn.dev 4日前

やり方を1つしか許さない環境は作れるか|5言語で同じ規約を回して天井を決めたもの

「一つのことは一つの方法」という規約を5言語(Kotlin/C#/Go/Rust/Java)で機械的に強制する実験結果。構造の規則は全言語で守れるが、各リポジトリの「active」自己申告は意味がずれて比較不能で、違反を仕込んでゲートが落ちる実証だけが比較可能。限界は言語のツールがどの粒度(テキスト/import/モジュール/メソッド署名)でコードを名指しできるかで決まると論じている。

「一つのことは一つの方法」という規約を5言語(Kotlin/C#/Go/Rust/Java)で機械的に強制する実験結果。構造の規則は全言語で守れるが、各リポジトリの「active」自己申告は意味がずれて比較不能で、違反を仕込んでゲートが落ちる実証だけが比較可能。限界は言語のツールがどの粒度(テキスト/import/モジュール/メソッド署名)でコードを名指しできるかで決まると論じている。
↗ 元記事を開く
sjg.io 4日前

AI Is Making Us Build Too Much

AIがソフトウェア構築のコストを下げたことで、コードやドキュメント、ポリシーなどの成果物を過剰に生成する問題を論じる。YeggeのWheelhouseの事例を引き、エージェントシステムが自己増殖して維持コストが膨らむことを指摘し、作成の安価さと所有コストの非対称性を強調する。

AIがソフトウェア構築のコストを下げたことで、コードやドキュメント、ポリシーなどの成果物を過剰に生成する問題を論じる。YeggeのWheelhouseの事例を引き、エージェントシステムが自己増殖して維持コストが膨らむことを指摘し、作成の安価さと所有コストの非対称性を強調する。
↗ 元記事を開く
microsoft.ai 4日前

MAI-Transcribe-2 is the fastest, most accurate and cheapest speech recognition model in the world | Microsoft AI

Microsoftが音声認識モデル「MAI-Transcribe-2」を発表し、最速・最高精度・最安値と主張する内容。記事本文は取得できず詳細は不明。

Microsoftが音声認識モデル「MAI-Transcribe-2」を発表し、最速・最高精度・最安値と主張する内容。記事本文は取得できず詳細は不明。
↗ 元記事を開く
kaeruct.github.io 4日前

Cultivating Trust

AI生成コードへの信頼とチーム文化についての記事。エンジニアの説明責任を促し、コーディングガイドライン、決定的ツール、小さなPR、手動テスト設計、プロトタイピングなどの実践を通じて、AIエージェント活用時でもコード品質を保つ方法を紹介している。

AI生成コードへの信頼とチーム文化についての記事。エンジニアの説明責任を促し、コーディングガイドライン、決定的ツール、小さなPR、手動テスト設計、プロトタイピングなどの実践を通じて、AIエージェント活用時でもコード品質を保つ方法を紹介している。
↗ 元記事を開く
zenn.dev 4日前

不具合はCIに刻もう。「Red-Green Stacked PR」のすすめ

不具合修正PRでテストが本当に修正前コードで落ちるかをCIで検証する手法。Vitestのtest.failsで失敗をGreen化し、再現テストPRと修正PRをStacked PRで積むことでRed→GreenをCI記録に残す。レビュアーの手動確認を不要にし、誤った再現テストを防ぐ。限界として失敗理由の区別はしない。

不具合修正PRでテストが本当に修正前コードで落ちるかをCIで検証する手法。Vitestのtest.failsで失敗をGreen化し、再現テストPRと修正PRをStacked PRで積むことでRed→GreenをCI記録に残す。レビュアーの手動確認を不要にし、誤った再現テストを防ぐ。限界として失敗理由の区別はしない。
↗ 元記事を開く
gigazine.net 5日前

圧縮とLLMに共通する本質は「データの予測」

圧縮とLLMがともに「データの予測」という本質を共有していると解説。算術符号化やエントロピー、オーダーNモデルなどの具体例を示し、LLMのトークン予測が圧縮のモデルに相当する点やGPT-2による圧縮実験にも言及。両者が情報理論の枠組みで結びつくことを説明した理論的な内容。

圧縮とLLMがともに「データの予測」という本質を共有していると解説。算術符号化やエントロピー、オーダーNモデルなどの具体例を示し、LLMのトークン予測が圧縮のモデルに相当する点やGPT-2による圧縮実験にも言及。両者が情報理論の枠組みで結びつくことを説明した理論的な内容。
↗ 元記事を開く
dev.classmethod.jp 5日前

DGX Spark の Qwen3.8 と GLM-5.3-Flash、4 構成を用途別に比べてみた

DGX Spark上のQwen3.8-Flash-Next・Qwen3.8-27B・GLM-5.3-Flash(3bit)の1台構成とGLM2台構成を比較。Flash-Nextはn-gram埋め込みのmmapで1台に載り、日本語9課題を唯一全通過し200KトークンのTTFTも101秒と高速だが、tool_choice=required不履行や長い思考時の空応答が課題。共有用途ではQwen3.8-27Bが最も余裕がある。

DGX Spark上のQwen3.8-Flash-Next・Qwen3.8-27B・GLM-5.3-Flash(3bit)の1台構成とGLM2台構成を比較。Flash-Nextはn-gram埋め込みのmmapで1台に載り、日本語9課題を唯一全通過し200KトークンのTTFTも101秒と高速だが、tool_choice=required不履行や長い思考時の空応答が課題。共有用途ではQwen3.8-27Bが最も余裕がある。
↗ 元記事を開く
zenn.dev 5日前

個人PCのClaude Codeの設定ファイルと、設定の動機を一部紹介します

Claude Codeの個人PC向け設定ファイルの紹介。managed-settings.jsonでsandbox、deny、ネットワーク制限などを多層防御的に設定し、CLAUDE.mdで行動指針を示す。事故防止と設定の意図を解説。

Claude Codeの個人PC向け設定ファイルの紹介。managed-settings.jsonでsandbox、deny、ネットワーク制限などを多層防御的に設定し、CLAUDE.mdで行動指針を示す。事故防止と設定の意図を解説。
↗ 元記事を開く
www.techno-edge.net 5日前

4分半かかっていたAI動画が79秒に。MiniMax H3をRTX 5090で3週間かけて速くした全記録(CloseBox)

RTX 5090上でMiniMax H3のAI動画生成を4分半から79秒に高速化した記録。量子化・蒸留LoRA・INT8アテンションなどの技術を実際に試し、プロファイリングと検証を徹底。Claude Codeを活用した開発手法やノード別の計測方法も詳細に共有されている。

RTX 5090上でMiniMax H3のAI動画生成を4分半から79秒に高速化した記録。量子化・蒸留LoRA・INT8アテンションなどの技術を実際に試し、プロファイリングと検証を徹底。Claude Codeを活用した開発手法やノード別の計測方法も詳細に共有されている。
↗ 元記事を開く
bcantrill.dtrace.org 5日前

The revolt of the reader

読者はLLMが作成した文章を容易に見抜き、将来もその著者を避ける傾向があると論じる。開発者668人の調査では78%がLLM検出時に即読むのを止め、71%が著者を避けると回答。Pangram 4などのAI検出の精度向上を踏まえ、公開文章は人間が書くことを推奨する内容。

読者はLLMが作成した文章を容易に見抜き、将来もその著者を避ける傾向があると論じる。開発者668人の調査では78%がLLM検出時に即読むのを止め、71%が著者を避けると回答。Pangram 4などのAI検出の精度向上を踏まえ、公開文章は人間が書くことを推奨する内容。
↗ 元記事を開く
zenn.dev 5日前

Claude Code の Rules が発火しないのは、Claude が Read ツールを使っていないから

Claude Code の paths 付き Rules が Read ツール実行時にのみ発火する仕組みを解説。auto mode が Bash での読み取りを促すため発火しなくなる問題を特定し、権限ルールとフック matcher で Edit の意味が異なること、CLAUDE.md での Read 優先指示や環境フラグ無効化などの対処法を検証とともに整理している。

Claude Code の paths 付き Rules が Read ツール実行時にのみ発火する仕組みを解説。auto mode が Bash での読み取りを促すため発火しなくなる問題を特定し、権限ルールとフック matcher で Edit の意味が異なること、CLAUDE.md での Read 優先指示や環境フラグ無効化などの対処法を検証とともに整理している。
↗ 元記事を開く
zachkehs.com 6日前

There's No Limit to How Bad Code Can Get

悪いコードには下限がなく、技術負債に破産やリセットが存在しないというエッセイ。物理的な崩壊を暗示する「沈む船」などの比喩は誤解を招き、ソフトウェアは際限なく悪化し続ける。事業はコードが限界に達する前に沈むため、全面書き換えなどの逃げ道に頼らず、継続的な改善努力が必要だと論じている。

悪いコードには下限がなく、技術負債に破産やリセットが存在しないというエッセイ。物理的な崩壊を暗示する「沈む船」などの比喩は誤解を招き、ソフトウェアは際限なく悪化し続ける。事業はコードが限界に達する前に沈むため、全面書き換えなどの逃げ道に頼らず、継続的な改善努力が必要だと論じている。
↗ 元記事を開く
www.infoq.com 6日前

Presentation: A Few Predicted Talks From QConAI 2030

Meryem Arik氏による2030年のソフトウェアエンジニアリング予測の講演。トークン消費管理の重要性、非技術者によるアプリ乱立とITのプラットフォーム化、エージェントがインフラ選定を主導する動きなどを展望し、エンジニアは純粋なコーディングからプロダクトリードやマルチエージェント調整へシフトすべきと論じる。

Meryem Arik氏による2030年のソフトウェアエンジニアリング予測の講演。トークン消費管理の重要性、非技術者によるアプリ乱立とITのプラットフォーム化、エージェントがインフラ選定を主導する動きなどを展望し、エンジニアは純粋なコーディングからプロダクトリードやマルチエージェント調整へシフトすべきと論じる。
↗ 元記事を開く
gigazine.net 6日前

GoogleがAI気象モデル「WeatherNext 3」発表、衛星データを直接使ってスパコンの待ち時間を回避し1時間ごとに予報更新

GoogleがAI気象モデル「WeatherNext 3」を発表。衛星データを直接取り込むことで従来の数値予報モデルによる遅延を回避し、1時間ごとに予報を更新可能に。予報の空間解像度も25kmから5kmに向上し、降水予測も改善。すでにGoogle検索やGemini、Googleマップなどへの導入が始まっている。

GoogleがAI気象モデル「WeatherNext 3」を発表。衛星データを直接取り込むことで従来の数値予報モデルによる遅延を回避し、1時間ごとに予報を更新可能に。予報の空間解像度も25kmから5kmに向上し、降水予測も改善。すでにGoogle検索やGemini、Googleマップなどへの導入が始まっている。
↗ 元記事を開く
qiita.com 6日前

環境構築にAIなんか使うな

Windows+WSL2でDocker Desktop禁止という条件下でのDocker Engine環境構築で、AIに頼り失敗した経験を解説。公式ドキュメントを一次情報にすべきで、AIはコマンド生成ではなく公式手順の解説に使うべきと結論。

Windows+WSL2でDocker Desktop禁止という条件下でのDocker Engine環境構築で、AIに頼り失敗した経験を解説。公式ドキュメントを一次情報にすべきで、AIはコマンド生成ではなく公式手順の解説に使うべきと結論。
↗ 元記事を開く
atmarkit.itmedia.co.jp 6日前

「AI=GPU」がもはや昔の常識に 「CPU」に何が起きるのか

ArmはAIエージェント時代にコード実行やデータ移動、オーケストレーションなどCPUの役割が拡大すると主張。NVIDIAもAIエージェント向けCPU「Vera」を開発し、GPUとの役割分担の重要性を指摘している。

ArmはAIエージェント時代にコード実行やデータ移動、オーケストレーションなどCPUの役割が拡大すると主張。NVIDIAもAIエージェント向けCPU「Vera」を開発し、GPUとの役割分担の重要性を指摘している。
↗ 元記事を開く
www.sylvainkalache.com 6日前

AI handles incidents, engineers lose touch with their systems

AIによるインシデント対応ツールが増えるほど、エンジニアの運用経験が減り、複雑な障害では対応力が落ちるという懸念を論じる。自動化の皮肉(アイアニー・オブ・オートメーション)を引用し、シミュレーション訓練やハンズオン演習の重要性を説く。

AIによるインシデント対応ツールが増えるほど、エンジニアの運用経験が減り、複雑な障害では対応力が落ちるという懸念を論じる。自動化の皮肉(アイアニー・オブ・オートメーション)を引用し、シミュレーション訓練やハンズオン演習の重要性を説く。
↗ 元記事を開く
kawasin73.hatenablog.com 6日前

Claude Code の Rules はもう死んでいる - kawasin73のブログ

Claude CodeのRulesが2026-08-18以降、auto-modeのシステムプロンプトがReadではなくBashツールを優先するために発動しなくなっている問題を報告。原因はCLAUDE_CODE_THRIFTY_SONICフラグにあり、無効化することで回避できる。フックによる対症療法より根本的な設定変更を推奨している。

Claude CodeのRulesが2026-08-18以降、auto-modeのシステムプロンプトがReadではなくBashツールを優先するために発動しなくなっている問題を報告。原因はCLAUDE_CODE_THRIFTY_SONICフラグにあり、無効化することで回避できる。フックによる対症療法より根本的な設定変更を推奨している。
↗ 元記事を開く
www.coderabbit.ai 6日前

GPT-6 Astra in code review: Gains, privacy, and cost

CodeRabbit社によるGPT-6 Astraのコードレビュー評価。全体的なバグ検出はGPT-5.6 Sol比+4%、クロスファイル検証では+20%と特に高い。一方API価格はSolの2.5倍で、コストと性能のトレードオフを具体的に比較。ゼロデータ保持などプライバシー面の言及もあり、エージェント運用でのモデル選定に参考になる。

CodeRabbit社によるGPT-6 Astraのコードレビュー評価。全体的なバグ検出はGPT-5.6 Sol比+4%、クロスファイル検証では+20%と特に高い。一方API価格はSolの2.5倍で、コストと性能のトレードオフを具体的に比較。ゼロデータ保持などプライバシー面の言及もあり、エージェント運用でのモデル選定に参考になる。
↗ 元記事を開く
zenn.dev 6日前

AIに「中学生でもわかるように1枚のHTMLで図解して」が、複雑なコードを読む前の最良の準備運動かも

Claude CodeなどのAIに複雑なコードを「中学生でもわかるように1枚のHTMLで図解して」と頼むと、専門用語が使えず構造の抽出が強制され、コード読解前の準備運動として有効だと紹介。対象年齢を変えることでレベル別資料に派生でき、対応表を付けてコードに戻って確認することが注意点。

Claude CodeなどのAIに複雑なコードを「中学生でもわかるように1枚のHTMLで図解して」と頼むと、専門用語が使えず構造の抽出が強制され、コード読解前の準備運動として有効だと紹介。対象年齢を変えることでレベル別資料に派生でき、対応表を付けてコードに戻って確認することが注意点。
↗ 元記事を開く
rietta.com 6日前

Government Rails Site Hit Hours After CVE Patch

Ruby on Rails 8 の ActiveStorage に含まれる深刻な RCE 脆弱性(CVE-2026-66066、CVSS 9.5)への緊急パッチ適用後、数時間で政府系サイトが攻撃された事例。開示予定日より前に詳細やフォレンジックツールが公開され、エンバーゴが実質機能していなかったことを報告している。

Ruby on Rails 8 の ActiveStorage に含まれる深刻な RCE 脆弱性(CVE-2026-66066、CVSS 9.5)への緊急パッチ適用後、数時間で政府系サイトが攻撃された事例。開示予定日より前に詳細やフォレンジックツールが公開され、エンバーゴが実質機能していなかったことを報告している。
↗ 元記事を開く
www.infoq.com 7日前

Airbnb Cuts Authentication Code by 60% with Server Driven Architecture

Airbnbが認証フローをサーバードリブンアーキテクチャに移行し、認証関連コードを約60%削減した事例。クライアント側の分岐や複雑な認証処理をサーバー側で制御する設計により、コード重複を減らすアプローチを解説している。

Airbnbが認証フローをサーバードリブンアーキテクチャに移行し、認証関連コードを約60%削減した事例。クライアント側の分岐や複雑な認証処理をサーバー側で制御する設計により、コード重複を減らすアプローチを解説している。
↗ 元記事を開く