トレンド一覧

Anthropic の AI ニュース

Anthropic に関する AI ニュースを新しい順に 636 件。3 時間おきに自動収集し、AI が要約しています。

Claude CodeやCursorなどのコードレビュー性能を検証

OWASP Benchmarkを用いて、Claude Code、Codex、Cursorのコードレビュー機能における脆弱性検出力を検証した。Opus 5、Fable 5.1、GPT-5.6、GPT-6などの最新モデル世代に刷新して計測し直している。

Zenn AI ・ 2026-09-05

60秒でKattoをClaudeに接続する(公式MCPサーバー)✂️

AI動画編集ツール「Katto」が公式MCP(Model Context Protocol)サーバーの提供を開始した。ユーザーはClaudeから自然言語で指示を出すだけで、YouTube動画のダウンロード、文字起こし、要所抽出、字幕付き縦型クリップ生成までを一括で実行できる。

Zenn AI ・ 2026-09-05

Claudeが11日で完了したフェルマーの最終定理の証明と数学界の反応

Claudeがわずか11日間でフェルマーの最終定理の証明を完了させたことについて、数学者たちの間で検証の妥当性やカーネルのバグを巡る議論が巻き起こっている。AIによる高度な数学的証明の達成と、その検証プロセスの課題が浮き彫りとなった。

Google News (Anthropic) ・ 2026-09-05

LLMを活用した要件定義書作成における成果と課題の検証

ヒアリングメモやSlackのやり取りをClaudeに読み込ませて要件定義書の初稿を生成させたところ、活用できる部分とそうでない部分が明確に分かれた。ゼロから書き起こす重い作業を効率化する一方で、実用に向けた向き不向きが浮き彫りになった。

Zenn LLM ・ 2026-09-05

Claude CodeとObsidianを組み合わせた開発・調査フローの構築

Claude CodeなどのAIツールを使って調査や実装を行った際、知見が流れてしまわないようObsidianに記録して後から振り返りやすい開発フローを構築する。AIによる自動化の恩恵を受けつつ、課題の経緯をドキュメントとして残す仕組みを解説する。

Zenn AI ・ 2026-09-05

Claude Codeを活用したAIコーディングのレビュー観点

Claude Codeを用いた開発において、人間がどのような観点でAIの成果物をレビューすべきかを解説している。構文エラーの少ないベストプラクティスに基づく処理に対し、人間が確認すべき問題になりやすい箇所をまとめている。

Zenn AI ・ 2026-09-05

Qwen3.8 27bを活用したローカル環境でのエージェントコーディング

Qwen3.8 27bモデルをローカルの24GB VRAM環境で稼働させ、10万トークンのコンテキストでエージェントコーディングに活用した検証。低コストかつ高速に日常的作業の8割から9割を代替できる実用性と、大規模モデルへの移行におけるハードウェア要件の課題を議論している。

r/LocalLLaMA ・ 2026-09-05

Claude Code の変異テストが、偽の緑を出していた

Claude Codeに書かせて運用している自動化機構の手作り変異テストにおいて、測定の失敗を不具合検出として誤認する「偽の緑」が発生した。意図した不具合を捕まえた赤と、測定失敗による赤を混同していた検証結果の記録である。

Zenn AI ・ 2026-09-05

AIエージェント向けアプリ開発の運用体系を定義するスキル構築

AIエージェントと個人アプリを開発する際セッションをまたぐと要件や前提が失われる問題を解決するため、新規リポジトリに運用インフラ一式を展開するスキル「app-kickoff」を構築した。プロンプトではなくリポジトリの構造で要件の脱落を防ぐ手法を解説している。

Zenn AI ・ 2026-09-05

SpotifyのPortal導入でClaude Codeのトークン使用量が90%削減

Spotifyが開発したPortalの活用により、Claude Codeを利用した際のトークン消費量を90%削減することに成功したというエンジニアリングブログの記事。コンテキスト管理を最適化する手法として注目を集めている。

Hacker News ・ 2026-09-04

Claude Codeとgit worktreeを活用した並列実行時の罠と運用境界線

Claude Codeのサブエージェントを`isolation: "worktree"`モードで運用し、独立したgit worktreeを持たせて並列実行した際に遭遇した罠について解説している。エラーを出さずに中身が異なる状態で完了してしまう問題への対策として、適切な分割の境界線と運用ルールが示されている。

Zenn AI ・ 2026-09-04

2026年9月期のLLMルーター運用における構成維持の判断

2026年9月のLLMルーター運用評価において、モデル割り当ての変更を必要とする事象が一切発生しなかったため構成の変更を行わなかった。主要な再評価トリガーであったClaude Sonnet 5の標準価格移行(値上げ)が撤回されたことにより、現行のコスト構造とモデル選定基準の妥当性が維持されることになった。

Zenn LLM ・ 2026-09-04

米国企業におけるオープンソースAIの急速な普及

米国企業の間で、AnthropicやOpenAIなどの商用モデルに加え、オープンソースAIの採用が急速に進んでいる。コスト削減やカスタマイズ性の高さが評価され、ビジネス現場での導入が広がっている。

Hacker News ・ 2026-09-04

エージェント駆動開発の設計パターン:Claude Codeから設計への転換

Claude Codeを使ったエージェント駆動開発の設計パターンを解説。エージェントループ、コンテキスト予算、ツールと権限ポリシー、フック制御、サブエージェント分割、モデル選択とコスト、検証ループなどの設計判断を言語化。実行可能なコードで裏付けられている。

Zenn AI ・ 2026-09-04