Xiaomi の Agent 型 AI コーディングツール MiMo Code、200 ステップタスクで Claude Code を上回る
Hiroba による自動要約
Xiaomi がオープンソースの Agent 型 AI コーディングハーネス MiMo Code を発表。200 ステップの超長期タスクで Claude Code を上回るパフォーマンスを示した。複雑で段階的なコーディングタスクの実行能力が向上。
読んで良かったら、シェアしてみてください。
同じタグの記事が他に 2743 件あります。
関連する記事
同じタグの記事

Andrej Karpathy の LLM Wiki パターンを MulmoClaude に実装した
ZennRAG の代替として、ソース投入時に知識を統合する LLM Wiki パターンを MulmoClaude に実装した記事。新しい資料を投入した際に Claude が既存の wiki ページを自動更新・相互参照・矛盾検出を行い、知識が蓄積される仕組みと、設計時に機械的検査と LLM 判定を分離することの重要性を解説。

Claude Code だけで要件定義から本番デプロイまで完走した話 - サモエドカフェのファンサイトを実働10時間で作った
Zenn個人開発者が Claude Code を要件定義から本番デプロイまで使い、サモエドカフェのファンサイト「アルファン」を実働10時間未満で完成させた。並列エージェントで7件の Issue を同時処理し、本番バグとデータ消失も AI の支援で復旧。開発のプロセスが「コード実装」から「仕様判断と品質確認」にシフトした実例

Claude「Computer Use」を本番環境で安定稼働させるための実践ガイド
ZennAnthropic公式がComputer Use機能を本番環境で信頼性高く動作させるためのノウハウを公開。クリック精度改善、Thinking Effortの選択、コンテキスト管理、デモンストレーション記録など4つのポイントを通じ、UIを自律操作するエージェントの実装と運用方法を解説している。

Claude Fable 5 の実運用コスト — 2週間のログ実測から見るコスト構造と削減策
ZennAnthropic の最上位モデル Claude Fable 5 は定価で入力 $10 / 出力 $50(100万トークン当たり)だが、実際のコスト決定要因はプロンプトキャッシュの効率にあり、96.6% が低単価のキャッシュ読込で構成される。2週間の Claude Code 実運用ログ(79 セッション)を分析した結果、稼働日平均 $84.13 、月換算で約 $1,700 に達し、エンタープライズ平均の 6 倍強だが、キャッシュ戦略の工夫でコスト削減の余地がある。