Claude Fable 5.1 ಅನ್ನು 1 September 2026 ರಂದು ಬಿಡುಗಡೆ ಮಾಡಲಾಯಿತು. ಇದರ Terminal-Bench-Science ಸ್ಕೋರ್ 24.7 % ರಿಂದ 52.6 % ಕ್ಕೆ ಏರಿತು—ಅಂದರೆ ಎರಡರಷ್ಟು ಹೆಚ್ಚಳವಾಗಿದೆ. ಅದೇ ಸಮಯದಲ್ಲಿ, Anthropic ತನ್ನ cache-read ಶುಲ್ಕವನ್ನು ಪ್ರತಿ ಮಿಲಿಯನ್ ಟೋಕನ್‌ಗಳಿಗೆ $1.00 ರಿಂದ $0.25 ಕ್ಕೆ ಇಳಿಸಿತು, ಇದು 75 % ಇಳಿಕೆಯಾಗಿದೆ. ಕಚ್ಚಾ ಕಾರ್ಯಕ್ಷಮತೆ (raw performance) ಮತ್ತು ಟೋಕನ್-ವೆಚ್ಚದ ಆರ್ಥಿಕತೆಯಲ್ಲಿನ ಈ ದ್ವಿಮುಖ ಬದಲಾವಣೆಯು, ಹೊಸ ಮಾಡೆಲ್‌ನ agentic boost ತಮ್ಮ workloads ಗಳನ್ನು ನಿಭಾಯಿಸಲು ಬೆಲೆ ಬದಲಾವಣೆಯನ್ನು ಸಮರ್ಥಿಸಿಕೊಳ್ಳುತ್ತದೆಯೇ ಎಂದು ನಿರ್ಧರಿಸಲು ಡೆವಲಪರ್‌ಗಳನ್ನು ಒತ್ತಾಯಿಸುತ್ತದೆ.

ಈ ಏರಿಕೆಯ ಮಹತ್ವವೇನು

Anthropic ನ “Fable” ಲೈನ್ ದೀರ್ಘಕಾಲದ, ಸ್ವಯಂ-ನಿರ್ದೇಶಿತ ಪ್ರಕ್ರಿಯೆಗಳನ್ನು ಗುರಿಯಾಗಿಸಿಕೊಂಡಿದೆ—ಅಂದರೆ ಡೇಟಾವನ್ನು ಪಡೆಯುವ, API ಕರೆಗಳನ್ನು ಸರಪಳಿ ಮಾಡುವ ಮತ್ತು ಮಾನವನ ಹಸ್ತಕ್ಷೇಪವಿಲ್ಲದೆ ಪುನರಾವರ್ತಿಸುವ ಸ್ವಾಯತ್ತ ಏಜೆಂಟ್‌ಗಳು (autonomous agents). Terminal-Bench-Science ಬೆಂಚ್‌ಮಾರ್ಕ್ ನಿಖರವಾಗಿ ಅದನ್ನೇ ಅಳೆಯುತ್ತದೆ: ಬಹು-ಹಂತದ ಕಾರ್ಯಗಳನ್ನು ಸರಿಯಾಗಿ ಪೂರ್ಣಗೊಳಿಸುವ ಮಾಡೆಲ್‌ನ ಸಾಮರ್ಥ್ಯ. ಸ್ಕೋರ್ ಎರಡರಷ್ಟು ಹೆಚ್ಚಿರುವುದು ತಾರ್ಕಿಕ ಆಳ (reasoning depth), ಯೋಜನೆಯ ಅನುಷ್ಠಾನ (plan execution) ಮತ್ತು ದೋಷ ನಿರ್ವಹಣೆಯಲ್ಲಿನ (error handling) ಗಮನಾರ್ಹ ಪ್ರಗತಿಯನ್ನು ಸೂಚಿಸುತ್ತದೆ.

ಸಿಂಗಲ್-ಶಾಟ್ ಕ್ವೇರಿಗಳ ಮೇಲೆ (single-shot queries) ಅವಲಂಬಿತವಾಗಿರುವ ಡೆವಲಪರ್‌ಗಳಿಗೆ—ಅಂದರೆ ಬಳಕೆದಾರರು ಕಷ್ಟಕರವಾದ ಪ್ರಶ್ನೆಯನ್ನು ಕೇಳುತ್ತಾರೆ ಮತ್ತು ಉತ್ತರವನ್ನು ನಿರೀಕ್ಷಿಸುತ್ತಾರೆ—ಈ ಸುಧಾರಣೆಯು ಅಲ್ಪ ಪ್ರಮಾಣದ್ದಾಗಿದೆ. ಬೆಂಚ್‌ಮಾರ್ಕ್ ಸೂಟ್ ಪ್ರಕಾರ, ಪ್ರತ್ಯೇಕ ಪ್ರಾಂಪ್ಟ್‌ಗಳಲ್ಲಿ (isolated prompts) Fable 5.1 ಮಾಡೆಲ್ Opus 5 ಅನ್ನು ಕೇವಲ ಸ್ವಲ್ಪ ಮಟ್ಟವೇ ಮೀರಿಸಿದೆ. ಅಂದರೆ, ಮಾಡೆಲ್‌ನ ಹೊಸ ಸಾಮರ್ಥ್ಯವು “agentic” ಬಳಕೆಯ ಪ್ರಕರಣಗಳಿಗೆ (use case) ಸಂಬಂಧಿಸಿದ್ದೇ ಹೊರತು, ಸಾಮಾನ್ಯ ಚಾಟ್ ಅಥವಾ Q&A ಗೆ ಅಲ್ಲ.

ವೆಚ್ಚದ ಲೆಕ್ಕಾಚಾರ

ಇನ್‌ಪುಟ್ ಮತ್ತು ಔಟ್‌ಪುಟ್ ಟೋಕನ್ ಬೆಲೆಗಳು ಸ್ಥಿರವಾಗಿವೆ, ಆದ್ದರಿಂದ ಪ್ರತಿ ಟೋಕನ್‌ಗೆ ತಗಲುವ ಮುಖ್ಯ ವೆಚ್ಚದಲ್ಲಿ ಬದಲಾವಣೆ ಆಗಿಲ್ಲ. ನಿಜವಾದ ಉಳಿತಾಯವು cache-read ರಿಯಾಯಿತಿಯಿಂದ ಬರುತ್ತದೆ. ಕ್ಯಾಷಿಂಗ್ (Caching) ಒಂದು ನಿರ್ದಿಷ್ಟ ಪ್ರಾಂಪ್ಟ್‌ಗೆ ಮಾಡೆಲ್ ನೀಡಿದ ಪ್ರತಿಕ್ರಿಯೆಯನ್ನು ಸಂಗ್ರಹಿಸುತ್ತದೆ ಮತ್ತು ಅದೇ ಪ್ರಾಂಪ್ಟ್ ಮತ್ತೆ ಬಂದಾಗ ಅದನ್ನು ಮರುಬಳಕೆ ಮಾಡುತ್ತದೆ, ಆಗ ಪೂರ್ಣ ಟೋಕನ್ ಬೆಲೆಯಲ್ಲಿ ಒಂದು ಸಣ್ಣ ಭಾಗವನ್ನು ಮಾತ್ರ ವಿಧಿಸಲಾಗುತ್ತದೆ. ಕ್ಯಾಷೆ ಹಿಟ್ ರೇಟ್ (cache hit rate) ಹೆಚ್ಚಿದ್ದರೆ, cache-read ಶುಲ್ಕವನ್ನು ಕಾಲು ಭಾಗಕ್ಕೆ ಇಳಿಸುವುದು ದೀರ್ಘಕಾಲದ ಏಜೆಂಟ್ ಕಾರ್ಯಗಳನ್ನು (agent runs) ಗಮನಾರ್ಹವಾಗಿ ಅಗ್ಗವಾಗಿಸಬಹುದು.

ಆದಾಗ್ಯೂ, ಕ್ಯಾಶ್ ದಕ್ಷತೆಯು (Cache efficiency) ಅಸ್ಥಿರವಾಗಿರುತ್ತದೆ. ಒಂದು ಸಣ್ಣ ಬದಲಾವಣೆ—ಟೈಮ್‌ಸ್ಟ್ಯಾಂಪ್, ಮರುಕ್ರಮಗೊಳಿಸಿದ ಪಟ್ಟಿ ಅಥವಾ ಒಂದು ಹೆಚ್ಚುವರಿ ಸ್ಪೇಸ್—ಸಂಗ್ರಹಿಸಲಾದ ಎಂಟ್ರಿಯನ್ನು ಅಮಾನ್ಯಗೊಳಿಸುತ್ತದೆ, ಇದರಿಂದ ಪೂರ್ಣ ಬೆಲೆಯಲ್ಲಿ ಕರೆ ಮಾಡಬೇಕಾಗುತ್ತದೆ. ಪ್ರಾಂಪ್ಟ್ ಪ್ರಿಫಿಕ್ಸ್ (prompt prefixes) ಅನ್ನು ಪ್ರಮಾಣೀಕರಿಸದ ಅಥವಾ ಡೈನಾಮಿಕ್ ಕಂಟೆಂಟ್ ಅನ್ನು ರಚಿಸುವ ಡೆವಲಪರ್‌ಗಳಿಗೆ, cache-read ಪ್ರಮಾಣವು ಶೂನ್ಯಕ್ಕೆ ಇಳಿದು, ನಿರೀಕ್ಷಿತ ಉಳಿತಾಯವು ಇಲ್ಲದಂತಾಗಬಹುದು.

ಯಾರು ಗೆಲ್ಲುತ್ತಾರೆ, ಯಾರು ಸೋಲುತ್ತಾರೆ

  • Agentic developers – ಸ್ವಾಯತ್ತ ಸಹಾಯಕರು (autonomous assistants), ವರ್ಕ್‌ಫ್ಲೋ ಆರ್ಕೆಸ್ಟ್ರೇಟರ್‌ಗಳು ಅಥವಾ ಬ್ಯಾಕ್‌ಗ್ರೌಂಡ್ ಬಾಟ್‌ಗಳನ್ನು ನಿರ್ಮಿಸುವ ತಂಡಗಳು ಕಾರ್ಯಕ್ಷಮತೆ ಮತ್ತು ವೆಚ್ಚ ಎರಡರಲ್ಲೂ ಲಾಭ ಪಡೆಯುತ್ತಾರೆ.
  • Chat-oriented services – ಚಿಕ್ಕದಾದ, ಮಾನವನಿಂದ ಪ್ರಾರಂಭವಾದ ಪ್ರಶ್ನೆಗಳಿಗೆ ಉತ್ತರಿಸುವ ಉತ್ಪನ್ನಗಳಿಗೆ ಹೆಚ್ಚಿನ ಪ್ರಯೋಜನವಿಲ್ಲ. ಪ್ರಾಂಪ್ಟ್‌ಗಳು ಪುನರಾವರ್ತನೆಯಾದಾಗ ಮಾತ್ರ ಕ್ಯಾಶ್ ರಿಯಾಯಿತಿ ಮುಖ್ಯವಾಗುತ್ತದೆ, ಆದರೆ ಚಾಟ್ ಪ್ರಾಂಪ್ಟ್‌ಗಳು ಹೆಚ್ಚಾಗಿ ವಿಶಿಷ್ಟವಾಗಿರುತ್ತವೆ. Opus 5 ಅನ್ನು ಬಳಸುವುದರಿಂದ ಸಮಾನವಾದ ಉತ್ತರ ಗುಣಮಟ್ಟವನ್ನು ನೀಡುವ ಜೊತೆಗೆ ವೆಚ್ಚವನ್ನು ಊಹಿಸಬಹುದಾದ ಮಟ್ಟದಲ್ಲಿ ಇರಿಸಿಕೊಳ್ಳಬಹುದು.
  • Ops teams – Fable 5.1 ಹೊಸ refusal code ಅನ್ನು ನೀಡಬಹುದು. ಒಂದು ವೇಳೆ ಅಪ್ಲಿಕೇಶನ್ ಈ ಕೋಡ್ ಅನ್ನು ಪರಿಶೀಲಿಸದಿದ್ದರೆ, ಬಳಕೆದಾರರು ಖಾಲಿ ಪ್ರತಿಕ್ರಿಯೆಗಳನ್ನು (blank responses) ನೋಡಬಹುದು. ದೃಢವಾದ error-fallback logic ಹೊಂದಿರುವ ತಂಡಗಳು ಬೇಗನೆ ಹೊಂದಿಕೊಳ್ಳುತ್ತವೆ; ಇಲ್ಲದ ತಂಡಗಳು ತಮ್ಮ ಪೈಪ್‌ಲೈನ್‌ಗಳನ್ನು ಸರಿಪಡಿಸಿಕೊಳ್ಳಬೇಕಾಗುತ್ತದೆ.

ಡೆವಲಪರ್‌ಗಳು ಈಗ ಏನು ಮಾಡಬೇಕು

  1. ನಿಮ್ಮ ಪ್ರಾಂಪ್ಟ್‌ಗಳನ್ನು cacheability ಗಾಗಿ ಆಡಿಟ್ ಮಾಡಿ – ಸ್ಥಿರವಾದ ಪ್ರಿಫಿಕ್ಸ್‌ಗಳನ್ನು ಗುರುತಿಸಿ ಮತ್ತು ನಿರ್ದಿಷ್ಟ ಕ್ರಮವನ್ನು (deterministic ordering) ಕಡ್ಡಾಯಗೊಳಿಸಿ. ಕ್ಯಾಶ್ ರಿಯಾಯಿತಿಯನ್ನು ಪಡೆಯಲು ಎಲ್ಲಾ ಕರೆಗಳಲ್ಲೂ ಒಂದೇ ರೀತಿಯ ಪ್ರಾಂಪ್ಟ್‌ಗಳನ್ನು ಬಳಸುವುದನ್ನು ಖಚಿತಪಡಿಸಿಕೊಳ್ಳಿ.
  2. ಸೈಡ್-ಬೈ-ಸೈಡ್ ಪರೀಕ್ಷೆಗಳನ್ನು ನಡೆಸಿ – ನಿಮ್ಮ ಸ್ವಂತ ಡೇಟಾವನ್ನು ಬಳಸಿ Fable 5.1 ನ “low-effort” ಸೆಟ್ಟಿಂಗ್‌ಗಳನ್ನು Opus 5 ನ “high-effort” ಸೆಟ್ಟಿಂಗ್‌ಗಳೊಂದಿಗೆ ಹೋಲಿಸಿ. ಬೆಂಚ್‌ಮಾರ್ಕ್‌ಗಳು ಸಹಾಯ ಮಾಡುತ್ತವೆ, ಆದರೆ ನೈಜ ಪ್ರಪಂಚದ latency, ಟೋಕನ್ ಬಳಕೆ ಮತ್ತು ಯಶಸ್ಸಿನ ದರಗಳು ವಿಭಿನ್ನವಾಗಿರಬಹುದು.
  3. Refusal handling ಅನ್ನು ಜಾರಿಗೆ ತರಲು – ಹೊಸ refusal status ಅನ್ನು ಪತ್ತೆಹಚ್ಚಿ ಮತ್ತು ವಿನಂತಿಯನ್ನು fallback ಮಾಡೆಲ್‌ಗೆ ಕಳುಹಿಸಿ ಅಥವಾ ಬಳಕೆದಾರರಿಗೆ ಸುಲಭವಾಗಿ ಅರ್ಥವಾಗುವ ಎರರ್ ಸಂದೇಶವನ್ನು ತೋರಿಸಿ. ಇದು ಪ್ರೊಡಕ್ಷನ್‌ನಲ್ಲಿ ಮೌನ ವೈಫಲ್ಯಗಳನ್ನು (silent failures) ತಡೆಯುತ್ತದೆ.

ವಿರೋಧಾತ್ಮಕ ಅಂಶ: ಅನೇಕರಿಗೆ ಇದು ಸಣ್ಣ ಮಟ್ಟದ ಲಾಭ ಮಾತ್ರ

ಪ್ರತಿಯೊಬ್ಬ ಡೆವಲಪರ್‌ಗೂ ಸ್ವಾಯತ್ತ ಏಜೆಂಟ್ ಅಗತ್ಯವಿಲ್ಲದಿರಬಹುದು. ನಿಮ್ಮ ಉತ್ಪನ್ನದ ಮುಖ್ಯ ಸಂವಹನವು ಕೇವಲ ಒಂದು ಪ್ರಶ್ನೆ-ಉತ್ತರ ವಿನಿಮಯವಾಗಿದ್ದರೆ, ಕಾರ್ಯಕ್ಷಮತೆಯ ವ್ಯತ್ಯಾಸವು (performance delta) ಅತ್ಯಲ್ಪವಾಗಿರುತ್ತದೆ. ಅಷ್ಟೇ ಅಲ್ಲದೆ, ಕ್ಯಾಶ್ ರಿಯಾಯಿತಿಯು ಕೇವಲ ಕೆಲವು ನಿರ್ದಿಷ್ಟ ಸಂದರ್ಭಗಳಲ್ಲಿ ಮಾತ್ರ ಲಭ್ಯವಿರುತ್ತದೆ; ಅನೇಕ SaaS ಪ್ಲಾಟ್‌ಫಾರ್ಮ್‌ಗಳು ಅತ್ಯಂತ ಬದಲಾಗುವ ಪ್ರಾಂಪ್ಟ್‌ಗಳನ್ನು ರಚಿಸುತ್ತವೆ, ಇದು ಕ್ಯಾಷಿಂಗ್ ಅನ್ನು ಸಂಪೂರ್ಣವಾಗಿ ವಿಫಲಗೊಳಿಸುತ್ತದೆ.

ಮುಂದೆ ಏನನ್ನು ಗಮನಿಸಬೇಕು

ಸಾರಾಂಶವೆಂದರೆ: Claude Fable 5.1 ದೀರ್ಘಕಾಲದ, ಸ್ವಯಂ-ನಿರ್ದೇಶಿತ AI ಏಜೆಂಟ್‌ಗಳಿಗೆ ಸ್ಪಷ್ಟವಾದ ಮತ್ತು ಅಳೆಯಬಹುದಾದ ಅಪ್‌ಗ್ರೇಡ್ ಅನ್ನು ನೀಡುತ್ತದೆ, ಮತ್ತು ಅದನ್ನೂ ಕೂಡ ಕ್ಯಾಶ್ ರೀಡ್‌ಗಳ ಮೇಲೆ ಭಾರಿ ರಿಯಾಯಿತಿಯನ್ನು ನೀಡುವ ಮೂಲಕ ಮಾಡುತ್ತದೆ. ಸ್ಥಿರವಾದ ಪ್ರಾಂಪ್ಟ್‌ಗಳನ್ನು ಬಳಸಬಲ್ಲ ಮತ್ತು ಬಹು-ಹಂತದ ತಾರ್ಕಿಕತೆಯಿಂದ ಪ್ರಯೋಜನ ಪಡೆಯಬಲ್ಲ workloads ಗಳಿಗೆ, ಇದನ್ನು ಅಳವಡಿಸಿಕೊಳ್ಳುವುದು ಉತ್ತಮ ನಿರ್ಧಾರವಾಗಿದೆ. ಸರಳವಾದ ಚಾಟ್ ಅಥವಾ ಕೇವಲ ಕ್ವೇರಿ ಸೇವೆಗಳಿಗೆ, ಕ್ಯಾಷಿಂಗ್ ಅನ್ನು ನಂಬಿಕೆಯಿಂದ ಬಳಸುವವರೆಗೆ ಹಳೆಯ Opus 5 ಹೆಚ್ಚು ಆರ್ಥಿಕ ಆಯ್ಕೆಯಾಗಿ ಉಳಿಯುತ್ತದೆ.