#AnthropicAPI
Citations: Advancing Source Verification in #AnthropicAPI & #Claude Models 📚

🔍 #Anthropic introduces Citations #API feature, enabling #Claude to ground responses in source documents with precise references

🧵 ↓ #ai
January 25, 2025 at 9:25 AM
Rapls AI Chatbot に thinking を入れるかは、まだ様子見です。

短いFAQ応答が大半で、そこに毎回思考トークンを払うのは割に合わない。込み入った質問だけ thinking に回す出し分けを考えています。全部に効かせる機能ではない、と。

#Claude #AnthropicAPI #生成AI
June 18, 2026 at 11:01 AM
Claude のBatch API、24時間以内に処理できれば50%引きで使える。

定期的なバッチ処理(記事の自動要約、ナレッジベースの定期更新など)で効果大。月数十ドルの差になる。

#Claude #AnthropicAPI
May 25, 2026 at 3:00 AM
失敗に備えて request_id をログに残しておくと、後が楽です。

レスポンスに付くリクエスト識別子を控えておけば、問い合わせのとき話が早い。「失敗しました」より「このIDが」のほうが、原因に近づけます。

#AnthropicAPI #Claude
July 10, 2026 at 5:00 AM
長いプロンプトを投げる前に、count_tokens で入力トークンだけ数えられます。

生成させずに測れるので、上限内かを事前に確認できる。429 を踏んでから気づくより、投げる前に分かるほうが運用が楽です。

#AnthropicAPI #Claude
June 21, 2026 at 11:00 AM
prompt caching はプレフィックス(前方)一致でしか効かない。

キャッシュしたい静的部分(システムプロンプト・長い文脈)を必ず先頭に置き、動的な user 入力は後ろに。順序を逆にすると、毎回キャッシュミスして 90% 削減の恩恵を取りこぼす。

#Claude #AnthropicAPI #生成AI
May 29, 2026 at 11:00 PM
thinking と tool_use を併せると、ツール呼び出しの合間にも考えさせられます。

検索結果を受けて「次に何を調べるか」を挟む流れ。ツールを跨いで進めるタスクほど、思考の継続が結果に効いてきます。

#Claude #AnthropicAPI #生成AI
June 18, 2026 at 1:00 AM
画像のトークン、ざっくり 幅×高さ÷750 で見積もれます。

大きい画像をそのまま投げると、テキストより重くなることがある。精度を保てる範囲で事前にリサイズすると、トークンがだいぶ節約できます。

#AnthropicAPI #Claude
June 21, 2026 at 9:00 AM
混雑エラーのときは、固定間隔ではなく指数バックオフを。1→2→4秒と待ちを伸ばす。

相手が混んでいる最中に等間隔で叩くと、混雑を長引かせるだけ。少しずつ引くのが、全体では早く終わります。

#AnthropicAPI #Claude
July 10, 2026 at 1:00 AM
Anthropic API、急にリクエストを増やすと 429(rate_limit_error)が返る。以前は同じ状況で 529(overloaded)だった。

429 はこちら側のレート超過、529 はサーバー側の過負荷。リトライ戦略を分けないと、無駄な再送でさらに詰まる。

#AnthropicAPI #生成AI
May 30, 2026 at 11:01 AM
自動リトライを組むとき、「何を再送していいか」を先に決めます。

生成が途中まで進んで切れたケースを丸ごと再送すると、二重処理になり得る。冪等な範囲に絞る。全部を無条件で再送、にしないのが安全です。

#AnthropicAPI #Claude
July 10, 2026 at 3:00 AM
thinking は budget_tokens で天井を決められます。

考える量に上限を設けるイメージ。難所には多め、軽い処理には少なめと配分すれば、青天井にならずコストが読める。難度に合わせて振るのがコツです。

#Claude #AnthropicAPI #生成AI
June 18, 2026 at 3:00 AM
Claude prompt caching、cache_control を付けても1024トークン未満はキャッシュされない仕様。

usage の cache_creation_input_tokens が0なら、hit/miss 以前にキャッシュ未登録。短いシステムプロンプトでキャッシュ効かない時はまずトークン数を確認。

#Claude #AnthropicAPI
May 20, 2026 at 11:00 PM
API のレスポンスで stop_reason を見落とすと、途中で切れた出力を完成扱いしてしまいます。

end_turn は自然終了、max_tokens は上限切れ、stop_sequence は指定文字列、tool_use はツール要求。max_tokens を end_turn と取り違えるのが怖い所です。

#AnthropicAPI #Claude
June 20, 2026 at 11:00 PM
ストリーミングが途中で切れても、続きからの再開はできません。基本は最初からやり直し。

だから、途中経過に副作用(DB書き込みなど)を持たせず、完了時にまとめて確定する設計にしておくと、切断に強くなります。

#AnthropicAPI #Claude
July 10, 2026 at 11:33 AM
429 が返ったら連打しない、が鉄則です。Retry-After ヘッダに「これだけ待って」と書いてあるので、その秒数だけ待つ。

サーバの指示に従うのが、結局いちばん早く復帰します。無視して叩くほど遠のきます。

#AnthropicAPI #Claude
July 9, 2026 at 11:00 PM
「JSON で返して」とプロンプトでお願いする方式は、たまに ```json で包まれたり前置きが付いて後処理が要る。

スキーマ指定(構造化出力)に切り替えると、パースしやすい出力に固定できる。プロンプトでお願いするより仕組みで縛るほうが安定する。

#生成AI #AnthropicAPI
June 3, 2026 at 11:03 AM
分岐の多い意思決定ほど thinking が向いています。

条件を並べてトレードオフを潰してから結論を出す、という流れを内部でやってくれる。一発で答えさせるより抜け漏れが減る、というのが触っての印象です。

#Claude #AnthropicAPI #生成AI
June 18, 2026 at 5:00 AM
tool_choice で、ツールを使わせる強さを決められます。

auto は任せる、any はどれか必ず、tool は特定の一つを強制、none は使わせない。構造化出力を必ず欲しいなら tool 強制、雑談に紛れさせたくないなら none、と使い分けます。

#AnthropicAPI #Claude
June 21, 2026 at 1:00 AM
prompt caching、前方一致でしか効かないのが落とし穴。

静的な部分(システムプロンプトや長い文脈)を必ず先頭に、動的な user 入力は後ろに置く。順序が逆だと毎回キャッシュミスして、90%削減の恩恵を取りこぼします。

#Claude #AnthropicAPI
June 14, 2026 at 1:00 AM
thinking のコスト、考えた分は出力トークンとして請求されます。

裏で大量に考えさせれば、その分そのまま乗る。「精度のために考えさせる」と「払う」はセット。budget で釣り合いを取る、が現実的な落としどころです。

#Claude #AnthropicAPI #生成AI
June 18, 2026 at 9:01 AM
「JSON で返して」とプロンプトでお願いする方式は、たまに ```json で包まれたり前置きが付いて後処理が要る。

スキーマ指定(構造化出力)に切り替えると、パースしやすい出力に固定できる。プロンプトでお願いするより仕組みで縛るほうが安定する。

#生成AI #AnthropicAPI
June 6, 2026 at 11:02 AM
prompt caching はプレフィックス(前方)一致でしか効かない。

キャッシュしたい静的部分(システムプロンプト・長い文脈)を必ず先頭に置き、動的な user 入力は後ろに。順序を逆にすると、毎回キャッシュミスして 90% 削減の恩恵を取りこぼす。

#Claude #AnthropicAPI #生成AI
June 3, 2026 at 11:00 PM