Claude Fable 5.1 ఇప్పుడు మార్కెట్లోకి వచ్చింది, మరియు సాధారణ చాట్ కోసం కొత్త మోడల్ ధర 25% తక్కువగా ఉంటుందని, అలాగే అనేక ఆటోమేషన్ సాధనాలను నడిపించే రిపీటెడ్-ప్రాంప్ట్ ఏజెంట్ లూప్స్ (repeated-prompt agent loops) కోసం 45% తక్కువగా ఉంటుందని Anthropic చెబుతోంది. ఈ ధర తగ్గింపు అనేది క్యాష్ చేయబడిన డేటా (cached data)—అంటే కంపెనీ ఇప్పటికే ప్రాసెస్ చేసి నిల్వ చేసిన సమాచారం—కు తక్కువ ఖర్చుతో యాక్సెస్ చేయడం వల్ల సాధ్యమవుతుంది.

ధర తగ్గడం ఎందుకు ముఖ్యం

లాంగ్వేజ్ మోడల్‌కు పెద్ద సంఖ్యలో కాల్స్ చేసే డెవలపర్‌ల బిల్లులు తరచుగా పెరుగుతుంటాయి, ఎందుకంటే ప్రతి రిక్వెస్ట్‌కు మోడల్ యొక్క per-token రేటు ప్రకారం బిల్లు చేయబడుతుంది, సదరు రిక్వెస్ట్ ప్రొవైడర్ ఇప్పటికే తన క్యాష్‌లో కలిగి ఉన్న కంటెంట్‌ను మళ్ళీ అడిగినా కూడా ఇది వర్తిస్తుంది. క్యాష్ చేయబడిన డేటాపై ఆధారపడటం ద్వారా, Fable 5.1 "స్టాండర్డ్" రిక్వెస్ట్‌ల ఖర్చును తగ్గిస్తుంది మరియు అనేక ఇటరేషన్ల (iterations) ద్వారా ఒకే సిస్టమ్ ప్రాంప్ట్ మరియు టూల్ స్కీమాను మళ్ళీ ఉపయోగించినప్పుడు మరింత ఎక్కువ డిస్కౌంట్‌ను అందిస్తుంది. ఏజెంట్ పైప్‌లైన్‌లను—అంటే స్వయంప్రతిపత్తి కలిగిన కోడ్ రివ్యూయర్‌లు, టికెట్-ట్రైయేజ్ బాట్‌లు లేదా డేటా-ఎక్స్‌ట్రాక్షన్ లూప్‌లు—నిర్మించిన టీమ్‌లకు, ఈ 45% ఆదా చాలా కీలకం కావచ్చు.

మార్పు చేయడం లాభదాయకమా కాదా అని ఎలా నిర్ణయించుకోవాలి

  1. మీ క్యాష్ హిట్ రేటును (cache hit rate) కొలవండి – మీ కాల్స్‌లో ఎక్కువ భాగం క్యాష్ చేయబడిన కంటెంట్‌ను ఉపయోగిస్తుంటే, తక్కువ per-token ఖర్చు నేరుగా తక్కువ బిల్లుకు దారితీస్తుంది.
  2. మీ వర్క్‌లోడ్ స్వభావాన్ని గుర్తించండి – ఒకే ప్రాంప్ట్ మరియు టూల్ నిర్వచనాలను కలిగి ఉండే రిపీటెటివ్ ఏజెంట్ లూప్‌లు 45% డిస్కౌంట్‌కు అర్హత పొందుతాయి. నిరంతరం మారుతూ ఉండే ప్రాంప్ట్‌లతో చేసే వన్-ఆఫ్ చాట్‌లకు కేవలం 25% తగ్గింపు మాత్రమే కనిపిస్తుంది.
  3. ఎండ్-టు-ఎండ్ టాస్క్ ఖర్చును పోల్చండి – కేవలం per-token ధరను మాత్రమే చూడకండి. ఒక టాస్క్‌ను ఎక్కువ కాల్స్‌గా విభజించమని మిమ్మల్ని బలవంతం చేసే తక్కువ ధర కలిగిన మోడల్, మొత్తం మీద ఎక్కువ ఖర్చు అయ్యేలా చేయవచ్చు.
  4. సైడ్-బై-సైడ్ టెస్ట్ నిర్వహించండి – ప్రస్తుత మోడల్‌ను ప్రొడక్షన్‌లో ఉంచుతూనే, మీ ట్రాఫిక్‌లో కొంత భాగానికి Fable 5.1ని ఉపయోగించండి. లాటెన్సీ (latency), టోకెన్ వినియోగం మరియు అవుట్‌పుట్ నాణ్యతలో వచ్చే మార్పులను గమనించండి.

మీ క్యాష్ హిట్ రేటు తక్కువగా ఉన్నా లేదా మీ వినియోగ విధానం కేవలం విభిన్నమైన సింగిల్ ప్రాంప్ట్‌లతో ఎక్కువగా ఉన్నా, ఆర్థిక ప్రయోజనం తక్కువగా ఉండవచ్చు. అటువంటప్పుడు, క్యాష్ రీయూజ్ కోసం ప్రాంప్ట్‌లను తిరిగి restucture చేసే వరకు ప్రస్తుత మోడల్‌తోనే కొనసాగడం తెలివైన నిర్ణయం కావచ్చు.

సేఫ్టీ మరియు సెక్యూరిటీ అప్‌గ్రేడ్‌లు

Anthropic మోడల్ యొక్క సేఫ్‌గార్డ్‌లను మరింత కఠినతరం చేసింది. కొత్త వెర్షన్ సాధారణ బయోలాజికల్ క్వెరీలను (biological queries) తక్కువగా బ్లాక్ చేస్తుంది, దీని అర్థం లైఫ్-సైన్స్ రంగంలోని డెవలపర్‌లు తక్కువ ఫాల్స్ పాజిటివ్‌లను (false positives) ఎదుర్కొంటారు. ఇది సాఫ్ట్‌వేర్ వల్నరబిలిటీలను (software vulnerabilities) గుర్తించే సామర్థ్యాన్ని కూడా జోడిస్తుంది, ఈ ఫీచర్ సెక్యూరిటీ-ఓరియెంటెడ్ టీమ్‌లకు ప్రత్యేక మోడల్ లేకుండానే రిస్క్ ఉన్న కోడ్‌ను గుర్తించడంలో సహాయపడుతుంది.

మోడల్ ఇప్పటికీ హై-రిస్క్ కార్యకలాపాలపై కఠినమైన పరిమితులను పాటిస్తుంది. ఇది పెనెట్రేషన్ టెస్టింగ్ (penetration testing) నిర్వహించలేదు లేదా ఎక్స్‌ప్లాయిట్ కోడ్‌ను (exploit code) సృష్టించలేదు; ఆ సినారియోలు Anthropic యొక్క Opus మోడల్ పరిధిలోకి వస్తాయి. కఠినమైన డేటా హ్యాండ్లింగ్ అవసరమయ్యే ఎంటర్‌ప్రైజ్‌ల కోసం, రాబోయే “Enterprise Frontier Safeguards” సున్నా డేటా రిటెన్షన్ (zero data retention) ని వాగ్దానం చేస్తున్నాయి, ఇది ఈ శరదృతువులో అందుబాటులోకి రానుంది. అప్పటి వరకు, APIకి పంపే ఏ డేటా అయినా మోడల్ మెరుగుదల కోసం నిల్వ చేయబడవచ్చు అని సంస్థలు భావించాలి.

కమిట్ చేసే ముందు ఏమి పరీక్షించాలి

  • క్యాష్ పనితీరు (Cache performance) – Fable 5.1 ధరల నిబంధనల ప్రకారం ఎంత శాతం రిక్వెస్ట్‌లు క్యాష్‌ను చేరుకుంటాయో లెక్కించడానికి మీ ప్రస్తుత లాగ్‌లను ఉపయోగించండి.
  • సేఫ్‌గార్డ్ బౌండరీస్ (Safeguard boundaries) – గతంలో బ్లాక్ చేయబడిన ప్రాంప్ట్‌లను (ఉదాహరణకు ప్రాథమిక జీవశాస్త్ర ప్రశ్నలు) మోడల్‌కు ఇచ్చి, అవి ఇప్పుడు అనుమతించబడుతున్నాయో లేదో తనిఖీ చేయండి.
  • బెంచ్‌మార్క్ స్కోర్‌లు (Benchmark scores) – ప్రారంభ కమ్యూనిటీ నివేదికల ప్రకారం Terminal-Bench 4.0 మరియు Humanity’s Last Exam లలో బలమైన ఫలితాలు వచ్చాయి. పనితీరు మెరుగుదలలు మీ నాణ్యత అంచనాలకు అనుగుణంగా ఉన్నాయో లేదో నిర్ధారించుకోవడానికి పబ్లిక్ బెంచ్‌మార్క్ విడుదలలను గమనిస్తూ ఉండండి.

ఈ రోజు ఎవరు పొందవచ్చు

Fable 5.1 క్లౌడ్ ప్లాట్‌ఫారమ్‌లు మరియు API ఎండ్‌పాయింట్ల ద్వారా బహిరంగంగా అందుబాటులో ఉంది. Anthropic యొక్క “Mythos 5.1” సైబర్‌సెక్యూరిటీ మరియు లైఫ్-సైన్స్ రీసెర్చ్ రంగంలోని కొద్దిమంది భాగస్వాములకు మాత్రమే పరిమితం చేయబడింది, కాబట్టి విస్తృత డెవలపర్ కమ్యూనిటీ ప్రస్తుతానికి Fable 5.1తోనే పనిచేయాల్సి ఉంటుంది.

ముగింపు

మీ అప్లికేషన్‌లు ఏజెంట్ లూప్‌లపై ఎక్కువగా ఆధారపడితే లేదా ప్రాంప్ట్‌లను మళ్ళీ మళ్ళీ ఉపయోగిస్తుంటే, క్యాష్డ్ ఆపరేషన్లపై 45% డిస్కౌంట్ Claude Fable 5.1కి మారడానికి బలమైన ఆర్థిక కారణాన్ని చూపుతుంది. ఎక్కువగా విభిన్నమైన, సింగిల్-షాట్ క్వెరీలను నిర్వహించే టీమ్‌లు కేవలం 25% తగ్గింపును మాత్రమే చూస్తాయి, ఇది మైగ్రేషన్ ప్రయత్నానికి సరిపోకపోవచ్చు. అప్‌గ్రేడ్ చేయబడిన సేఫ్‌గార్డ్‌లు నియంత్రిత రంగాలలో (regulated domains) మోడల్ యొక్క ఉపయోగితాను పెంచుతాయి, కానీ ఇంకా పెండింగ్‌లో ఉన్న జీరో-రిటెన్షన్ ఆప్షన్ వల్ల ఎంటర్‌ప్రైజ్‌లు స్వల్ప పరివర్తన కాలానికి (transition period) సిద్ధంగా ఉండాలి. క్యాష్ హిట్ రేట్లను కొలవండి, నియంత్రిత పైలట్ రన్ చేయండి మరియు టాస్క్-బేస్డ్ ఖర్చు పోలిక ఆధారంగా తుది నిర్ణయం తీసుకోండి.