AI駆動開発部の日常
こんにちは、「AI駆動開発部の日常」へようこそ。 このポッドキャストは、日々AI駆動開発を行う、起業家の山本とエンジニアの阿部が、AI駆動開発のリアルを、ゆるく語り合う番組です。 【配信サービス】 ▼Spotify https://open.spotify.com/show/5b4x1u0M2f0Kmr1Xnv1Z7r?si=12580ee9ade0414e▼Youtubehttps://youtube.com/@ai-nichijo-fm ▼Apple Podcasts…
- Indexed episodes, last 90 days
- 15
- Latest publication
- Sep 17, 2026
- Audience
- Checking…
- Earliest in this view
- Jul 11, 2026
Latest episodes
63【圧倒的な速さ】DeepSeek-V4.1-Flashの実力 (opens the original)
Read excerpt
今回は、阿部さんがフロント実装でGLM-5.3-Flashに二日かかったタスクを、DeepSeek-V4.1-Flashに置き換えたら半日で終わった、という体験を起点に、速さの差がどこから来るのかを掘り下げました。 僕はまず「とにかく速い」という体感から入ったのですが、阿部さんの手元では同じ物量のフロント実装で日数が半分以下になった。コスパはGLM-5.3-Flashの方がまだ上、という前提は共有しつつ、速さ側の使い勝手で見方が分かれるところです。 最後まで「どっちが正解」にはせず、画像まで読めるようになったことや、ローカルで回す夢と並列数の現実も残った回でした。DeepSeek-V4.1-Flashをメインに据え始めた、という実感だけははっきりしています。 後半はOpenCode Goの月10ドル枠と、招待コードの話も出ています。 【関連リンク】 ▼DeepSeek-V4.1-Flash https://www.deepseek.com/news/deepseek-v4-1-flash/ ▼OpenCode Go https://opencode.ai/go ▼GLM-5.3-Fla
62【GPT-6 Astraの実力は?】Claude Fable 5.1との比較 (opens the original)
Read excerpt
今回は、OpenAIが出したGPT-6 Astraを触ってみて、少し前に取り上げたAnthropicのClaude Fable 5.1との使い分けを掘り下げました。 同じプロンプトでLPを作らせると、Claude CodeとCodex CLIは、素のままだとデザインの質に差がつきます。ところがClaude Designを挟んだ途端、評価がひっくり返る。知識のカットオフの違いが、エージェントやオーケストレーションのような新しい概念を扱う作業でどう表れるか、という見立ても出てきます。 阿部さんはGPT-6 Astraをオーケストレーターに据えた側。呼び出したサブエージェントを数秒おきに見に行くせいでトークンが燃える初期の問題、一週間分のリミットが30分で消えた体験、effortをLowに落としてからの落ち着き方まで、実際に起きたことが並びます。長いコンテキストで脱線しない粘り強さを買う阿部さんに対して、僕は指示に従いすぎるところが足かせにもなると見ています。 後半は、Anthropicのサブスクリプションで選べるモデルの顔ぶれと、上限に達したときに何が止まり何が残るのかという設計の違いへ。
61【調べるか、走らせるか?】進め方で変わるAI駆動開発の速度 (opens the original)
Read excerpt
今回は、初めてやることだらけの仕事で、まず調べてから動くのと、AIに先にやらせるのと、どちらが速いかという僕の持論をテーマに、AIで仕事を速くするコツを語り合いました。 わからないことがあると徹底的に調べて、一番正解らしいものを選びたがるのが人間の癖。阿部さんは学校の勉強や料理に例えて、まず調べるのは訓練の結果だと言います。中途半端に知っているがゆえに、AIへの頼み方の選択肢が頭の中で狭まってしまう、という指摘も。 後半は、本番リリース後のデータベース設計が気になって仕事が遅くなるという阿部さんの恐怖感から、スタートアップCTOの離職が増えている話題へ。仕組みは、0から1を作るならプラスにしかならないという考え方や、お客さんとの期待値調整を実験店舗で回す発想にまで話が広がります。 高速で進める一方でバグも出しまくるAnthropicのClaudeを引き合いに出しながら、許容できるインパクトを生めるなら、とりあえず動かす側に回る方が全員幸せかもしれない、というところまで二人の前提が動いた回でした。 【関連リンク】 ▼Claude Code https://claude.com/produ
60【Claude Fable 5.1の実力】ファーストインプレッション (opens the original)
Read excerpt
今回は、昨日突然出てきたAnthropicのClaude Fable 5.1を起点に、ファーストインプレッションを本音で話しました。 ベンチマークは軒並み上がっているのに、僕の使用感はまだClaude Fable 5から大きく動いていない。阿部さんも感覚としては変わらないと言いつつ、リミットの減りが穏やかになった気もする、と数字との間で印象が割れる。 セーフガードの誤判定が減った話や、effortをLowにしてもClaude Fable 5のMaxを超えるという数字はある。それでもキャッシュヒットを1時間に伸ばすと単価が上がるのか、トークン効率は本当に良くなったのか、答えより問いが増えた回かもしれません。 後半は、デザイン力が上がったという声がClaude Code側のハーネスの話なのか、モデル単体の話なのかも掘り下げています。 【関連リンク】 ▼Claude Fable 5.1 https://www.anthropic.com/claude-fable-and-mythos-5-1 【配信サービス】 ▼Spotify https://open.spotify.com/show/5b
59【GLM-5.3Flashの実力】コスパ最強の実行役 (opens the original)
Read excerpt
今回は、OpenRouterでOx Alphaとして無料公開されていたモデルの正体がZ.aiのGLM-5.3-Flashだと分かったことをきっかけに、実行役としてどこまで任せられるかを本音で話しました。 僕は無料期間中にClaudeの200ドル枠を複数アカウント回すくらい使い倒した一方、阿部さんは本格投入の直前で無料期間が終わってしまい、同じモデルへの温度差がはっきり出ています。DeepSeek V4 Proより桁違いに安いのに、Claude Opus 4.8に並ぶベンチマークもある。Flashという名前が頭をバグらせる、という話にもなりました。 相談はClaude Fable 5、レビューはCodex、実行はOpenCode上のGLM-5.3-Flash、という役割分担が僕たちの現場ではもう回り始めていて、GLM Coding Planのキャッシュヒットもかなり良い。これが当たり前になれば、安い実行役の常識が変わりそうです。 動画や画像まで見られる点も気になっています。ポッドキャスト以外の動画編集ワークフローにどう効くかは、もう少し使ってからシェアできたらと思っています。 【関連リン
Publishing over time
Last 90 days. Choose a month to open its work.
Recurring subjects
Named in the text we hold. One piece can cover several.
Not enough subject data for this period yet.
Audience
No verified audience measurement yet.
About this data
Counts cover the work we have indexed. Tone needs enough text and a confident classification. Excerpts and episode notes are not full articles or transcripts.
Identity or attribution wrong? Suggest a correction.