মূল কনটেন্টে যান

AI বেঞ্চমার্ক

AI মডেল, মান ও খরচে তুলনা করা।

প্রকাশিত মডেল স্কোরের একটি ব্যবহারিক দৃশ্য, যা বিস্তারিত না হারিয়ে সক্ষমতা, বিভাগ অনুযায়ী শক্তি ও চালানোর খরচ তুলনা করতে সাহায্য করে।

লিডারবোর্ড দেখুনবেঞ্চমার্কের সূত্র সর্বশেষ নির্বাচিত রিলিজ · ২৫ জুন, ২০২৬

সর্বশেষ বেঞ্চমার্ক ও মডেল হালনাগাদ

এই পাতার লিডারবোর্ড LiveBench-এর 25 June রিলিজ, 22 September 2026-এ পুনরায় ধারণ করা। এতে এখন Grok 4.7 xHigh ও DeepSeek V4.1 Flash Max Effort অন্তর্ভুক্ত। নিচের মডেল নোটগুলো বিক্রেতাদের নিজস্ব পাতা থেকে, সেভাবেই চিহ্নিত।

Grok 4.6

Grok 4.5-এর মতোই $2 / $6 API মূল্য। xAI একটি Artificial Analysis Intelligence Index 61 জানায় — GPT-5.6 Sol Max-এর সমান, Fable 5 Max থেকে এক পয়েন্ট পেছনে। জ্ঞান-কাজের মূল্যায়নে শক্তিশালী; Terminal-Bench v3-এ 26%।

Grok 4.6 ব্রিফিং পড়ুন

DeepSeek V4.1 Flash

DeepSeek V4.1 Flash 10 Sep 2026-এ নতুন deepseek-flash API আইডিতে V4 Flash-এর জায়গা নিয়েছে, অফ-পিকে প্রতি ১M টোকেনে $0.15 / $0.60 এবং পিকে $0.30 / $1.20। 14 Sep থেকে V4 Pro অনুরোধও এতে পাঠানো হয়, তাই এখনই মডেল আইডি বদলান। LiveBench এখন V4.1 Flash Max Effort-কে সামগ্রিকে 81.1 স্কোর দেয়।

মডেল ট্র্যাকারে দেখুন

লিডারবোর্ডের সারি আসে শুধু প্রকাশিত LiveBench ডেটা থেকে। আমরা স্কোর বানাই না।

Best overall

Claude Fable 5.1 Max Effort leads this snapshot at 83.4 overall, $1.212 per successful task.

Best value per task

ox-alpha-max runs at $0.000 per successful task and still scores 69.2 overall.

Best open weights

DeepSeek V4.1 Flash Max Effort is the strongest open-weight model here at 81.1 overall — the option you can host yourself.

Best per capability

If your work is mostly one kind of task, these lead their category in this snapshot.

যুক্তি
GPT-6 Astra Max Effort 92.7
কোডিং
Claude 5.5 Opus Thinking Max Effort 89.3
এজেন্টিক কোডিং
DeepSeek V4.1 Flash Max Effort 77.3
গণিত
Claude 5.5 Opus Thinking Max Effort 97.1
ডেটা বিশ্লেষণ
GPT-6 Astra Max Effort 83.0
ভাষা
Claude Fable 5 Max Effort 90.7
নির্দেশ অনুসরণ
Gemini 3.8 Flash High 81.4

Every number above comes from the 2026-06-25 release dated 2026-06-25, published by a third-party benchmark and reproduced unaltered.

ক্ষেত্রটির আকার, দুটি ছবিতে।

প্রথম চার্ট উত্তর দেয় “কে সবচেয়ে শক্তিশালী”। দ্বিতীয়টি সেই প্রশ্নের উত্তর দেয় যা আসলে আপনার টাকা খরচ করায়: তাদের কোনটির জন্য টাকা দেওয়া সার্থক।

তারা কীভাবে র‍্যাঙ্ক করে

লম্বা মানে ভালো। বারগুলো ১০০-র মধ্যে সামগ্রিক স্কোর দেখায়; প্রতিটি বারের পাশের অঙ্ক সঠিক মান। সেই মডেলকে নিচের খরচের চার্টে নিতে একটি সারি বাছুন।

58-এর মধ্যে শীর্ষ 12 দেখানো হচ্ছে। প্রতিটি মডেলের জন্য পূর্ণ তুলনার দৃশ্যে যান।

মান বনাম খরচ

ওপরে মানে শক্তিশালী, বাঁয়ে মানে সস্তা — তাই সেরা কেনাকাটা ওপরের-বাঁয়ে। ক্রমিক সংখ্যার বিন্দুগুলো মূল্য-সীমান্ত: এর চেয়ে সস্তা কেউ বেশি স্কোর করে না। ধূসর বিন্দুগুলো স্কোর ও দাম দুটোতেই হেরে গেছে।

60657075808590০.০২৪ US$০.০৫০ US$০.১০০ US$০.২০০ US$০.৫০০ US$১.০০ US$১.৪৩৯ US$1234567Claude Fable 5.1 Max Effort83.4 · ১.২১২ US$সফল কাজ প্রতি খরচ (লগ স্কেল — প্রতিটি ধাপ গুণিতক, যোগফল নয়)সামগ্রিক

নির্বাচিত

Claude Fable 5.1 Max Effort

Anthropic

সামগ্রিক
83.4
প্রতি সফল কাজ
১.২১২ US$

#7 · মূল্য-সীমান্তে।

সেরা কেনাকাটা (সবচেয়ে সস্তা → সবচেয়ে শক্তিশালী)

  • তার দামে সেরা মূল্য
  • স্কোর ও দাম দুটোতেই পরাজিত

সঠিক স্কোর ও খরচ পড়তে একটি ক্রমিক সংখ্যার বিন্দুর (বা ডানদিকে তার সারির) ওপর হোভার বা ট্যাপ করুন। অ্যারো কী মডেলগুলোকে সস্তা থেকে দামির দিকে নিয়ে যায়।

একই 57টি সংখ্যা টেবিল হিসেবে পড়ুন
মান বনাম খরচ
মডেলপ্রতিষ্ঠানসামগ্রিকপ্রতি সফল কাজ
Claude Fable 5.1 Max Effort#7 · তার দামে সেরা মূল্যAnthropic83.4১.২১২ US$
Claude 5.5 Opus Thinking Max Effort#6 · তার দামে সেরা মূল্যAnthropic83.2০.৭৯৯ US$
Claude Fable 5 Max EffortAnthropic83.0১.৪৩৯ US$
GPT-6 Astra Max Effort#5 · তার দামে সেরা মূল্যOpenAI82.2০.৭৩৬ US$
GPT-6.1 Sol Max Effort#4 · তার দামে সেরা মূল্যOpenAI81.6০.১৪২ US$
Muse Spark 1.3 xHigh EffortMeta81.6০.২১৯ US$
DeepSeek V4.1 Flash Max Effort#3 · তার দামে সেরা মূল্যDeepSeek81.1০.০২৯ US$
GPT-5.6 Sol Max EffortOpenAI81.0০.৫১৫ US$
GPT-5.5 Thinking xHigh EffortOpenAI80.2০.৪৩৫ US$
Claude 5 Opus Thinking Max EffortAnthropic80.1০.৬৯৯ US$
GPT-6 Sol Max EffortOpenAI79.3০.২৬৮ US$
Kimi K3Moonshot AI79.2০.৩৪৮ US$
Gemini 3.7 Flash HighGoogle78.8০.১৫৭ US$
Qwen 3.8 MaxAlibaba78.5০.২৭৫ US$
Grok 4.6 xHighxAI78.0০.২০৭ US$
Muse Spark 1.2 xHigh EffortMeta78.0০.৩৭৫ US$
GPT-5.4 Thinking xHigh EffortOpenAI78.0০.৩৮৭ US$
GPT-5.6 Terra Max EffortOpenAI77.9০.৩৫২ US$
Claude Sonnet 5.5 xHigh EffortAnthropic77.8০.১৪১ US$
DeepSeek V4 Pro 0813DeepSeek77.4০.০৪৪ US$
Grok 4.7 xHighxAI77.4০.৭১৮ US$
Gemini 3.1 Pro Preview HighGoogle77.0০.২৮৬ US$
DeepSeek V4 Flash Vision ExpDeepSeek76.8০.০৫১ US$
Claude 4.7 Opus Thinking xHigh EffortAnthropic76.5০.৫২৮ US$
Qwen 3.8 Flash NextAlibaba76.2০.০৪২ US$
Claude 4.8 Opus Thinking Max EffortAnthropic76.2০.৯৮৩ US$
GLM-5.3Z.AI76.1০.৪৫০ US$
Claude Sonnet 5 xHigh EffortAnthropic76.0০.৫০৫ US$
Grok 4.5xAI75.8০.১৩১ US$
Gemini 3.8 Flash HighGoogle75.8০.৩০৭ US$
Qwen3.8 27BAlibaba75.3০.০৯৪ US$
Muse Spark 1.1 xHigh EffortMeta75.3০.১৯৮ US$
GPT-5.2 HighOpenAI74.6০.২৩৪ US$
Gemini 3.5 Flash HighGoogle74.6০.২৪৯ US$
Claude 4.6 Opus Thinking High EffortAnthropic74.5০.৪০৪ US$
DeepSeek V4 Flash 0731DeepSeek74.2০.০৬০ US$
GPT-5.2 CodexOpenAI74.0০.১৮৭ US$
GPT-5.6 Luna Max EffortOpenAI73.6০.১৬৯ US$
Gemini 3.6 Flash HighGoogle73.6০.২৩৫ US$
GLM-5.2Z.AI73.2০.২২৫ US$
Qwen 3.7 MaxAlibaba73.1০.১৮২ US$
Claude 4.6 Sonnet Thinking Medium EffortAnthropic73.0০.৩০৬ US$
Claude 4.5 Opus Thinking High EffortAnthropic72.6০.৬১০ US$
GPT-6 Luna Max Effort#2 · তার দামে সেরা মূল্যOpenAI72.0০.০২৬ US$
Inkling xHigh EffortThinking Machines71.9০.৩১০ US$
GLM-5.3 FlashZ.AI71.6০.০৩১ US$
Kimi K2.6 ThinkingMoonshot AI70.5০.১৬৯ US$
GPT-5.4 Nano xHighOpenAI69.6০.০৯১ US$
Qwen 3.6 PlusAlibaba68.9০.২২৭ US$
Kimi K2.7 CodeMoonshot AI68.4০.১০০ US$
Grok Build 0.1#1 · তার দামে সেরা মূল্যxAI67.8০.০২৪ US$
Nemotron 3 Ultra 550B A55BNVIDIA67.4০.৩৭১ US$
Minimax M3Minimax67.3০.০৬০ US$
GPT-5.4 Mini xHighOpenAI66.4০.৩৩৪ US$
Qwen 3.6 27BAlibaba64.0০.২০২ US$
Gemini 3.5 Flash-Lite HighGoogle63.9০.০৬৯ US$
Grok 4.3xAI62.3০.০৬১ US$

বিভাগের প্রোফাইল

সাতটি বিভাগের স্কোর তুলনা করতে লিডারবোর্ড থেকে সর্বোচ্চ তিনটি মডেল বাছুন।

  • Claude Fable 5.1 Max Effort83.4
  • ox-alpha-max69.2
  • DeepSeek V4.1 Flash Max Effort81.1
  • যুক্তি91.776.686.7
  • কোডিং86.475.880.0
  • এজেন্টিক কোডিং66.152.677.3
  • গণিত97.077.593.3
  • ডেটা বিশ্লেষণ80.375.879.3
  • ভাষা89.566.181.2
  • নির্দেশ অনুসরণ73.060.370.0

প্রতিটি ট্র্যাক ০ থেকে ১০০ পর্যন্ত চলে। আরও ডানে মানে শক্তিশালী; গাঢ় অঙ্কটি সেই সারির শীর্ষে থাকা।

এই স্কোরগুলো টেবিল হিসেবে পড়ুন
বিভাগের প্রোফাইল
বিভাগClaude Fable 5.1 Max Effortox-alpha-maxDeepSeek V4.1 Flash Max Effort
যুক্তি91.776.686.7
কোডিং86.475.880.0
এজেন্টিক কোডিং66.152.677.3
গণিত97.077.593.3
ডেটা বিশ্লেষণ80.375.879.3
ভাষা89.566.181.2
নির্দেশ অনুসরণ73.060.370.0

লিডারবোর্ড

প্রতিটি বিভাগ সাজান, তালিকা সংকীর্ণ করুন, এবং প্রকাশিত উপ-কাজের বিভাজনের জন্য একটি মডেল খুলুন।

  1. 01

    Claude Fable 5.1 Max Effort

    Anthropic

    83.4

    সামগ্রিক

    ১.২১২ US$

    প্রতি সফল কাজ

    গণিত97.0যুক্তি91.7ভাষা89.5
  2. 02

    Claude 5.5 Opus Thinking Max Effort

    Anthropic

    83.2

    সামগ্রিক

    ০.৭৯৯ US$

    প্রতি সফল কাজ

    গণিত97.1যুক্তি92.2কোডিং89.3
  3. 03

    Claude Fable 5 Max Effort

    Anthropic

    83.0

    সামগ্রিক

    ১.৪৩৯ US$

    প্রতি সফল কাজ

    গণিত96.0ভাষা90.7যুক্তি89.7
  4. 04

    GPT-6 Astra Max Effort

    OpenAI

    82.2

    সামগ্রিক

    ০.৭৩৬ US$

    প্রতি সফল কাজ

    গণিত96.8যুক্তি92.7ভাষা89.4
  5. 05

    GPT-6.1 Sol Max Effort

    OpenAI

    81.6

    সামগ্রিক

    ০.১৪২ US$

    প্রতি সফল কাজ

    গণিত96.8যুক্তি92.6ভাষা90.1
  6. 06

    Muse Spark 1.3 xHigh Effort

    Meta

    81.6

    সামগ্রিক

    ০.২১৯ US$

    প্রতি সফল কাজ

    গণিত95.9যুক্তি89.7ভাষা82.8
  7. 07

    DeepSeek V4.1 Flash Max Effort

    ওপেন

    DeepSeek

    81.1

    সামগ্রিক

    ০.০২৯ US$

    প্রতি সফল কাজ

    গণিত93.3যুক্তি86.7ভাষা81.2
  8. 08

    GPT-5.6 Sol Max Effort

    OpenAI

    81.0

    সামগ্রিক

    ০.৫১৫ US$

    প্রতি সফল কাজ

    গণিত96.2যুক্তি91.7ভাষা87.7
  9. 09

    GPT-5.5 Thinking xHigh Effort

    OpenAI

    80.2

    সামগ্রিক

    ০.৪৩৫ US$

    প্রতি সফল কাজ

    গণিত95.9যুক্তি89.7ভাষা87.4
  10. 10

    Claude 5 Opus Thinking Max Effort

    Anthropic

    80.1

    সামগ্রিক

    ০.৬৯৯ US$

    প্রতি সফল কাজ

    গণিত95.7যুক্তি91.2ভাষা88.7
  11. 11

    GPT-6 Sol Max Effort

    OpenAI

    79.3

    সামগ্রিক

    ০.২৬৮ US$

    প্রতি সফল কাজ

    গণিত96.4যুক্তি88.7ভাষা85.3
  12. 12

    Kimi K3

    ওপেন

    Moonshot AI

    79.2

    সামগ্রিক

    ০.৩৪৮ US$

    প্রতি সফল কাজ

    যুক্তি90.7ভাষা85.5গণিত84.4
  13. 13

    Gemini 3.7 Flash High

    Google

    78.8

    সামগ্রিক

    ০.১৫৭ US$

    প্রতি সফল কাজ

    গণিত93.5যুক্তি87.8ভাষা85.5
  14. 14

    Qwen 3.8 Max

    ওপেন

    Alibaba

    78.5

    সামগ্রিক

    ০.২৭৫ US$

    প্রতি সফল কাজ

    গণিত91.3যুক্তি88.2ভাষা79.7
  15. 15

    Muse Spark 1.2 xHigh Effort

    Meta

    78.0

    সামগ্রিক

    ০.৩৭৫ US$

    প্রতি সফল কাজ

    গণিত91.2যুক্তি90.0ভাষা78.6
  16. 16

    Grok 4.6 xHigh

    xAI

    78.0

    সামগ্রিক

    ০.২০৭ US$

    প্রতি সফল কাজ

    গণিত92.6যুক্তি90.5ভাষা83.7
  17. 17

    GPT-5.4 Thinking xHigh Effort

    OpenAI

    78.0

    সামগ্রিক

    ০.৩৮৭ US$

    প্রতি সফল কাজ

    গণিত94.1যুক্তি88.1ভাষা82.6
  18. 18

    GPT-5.6 Terra Max Effort

    OpenAI

    77.9

    সামগ্রিক

    ০.৩৫২ US$

    প্রতি সফল কাজ

    গণিত94.9যুক্তি90.6ভাষা82.9
  19. 19

    Claude Sonnet 5.5 xHigh Effort

    Anthropic

    77.8

    সামগ্রিক

    ০.১৪১ US$

    প্রতি সফল কাজ

    গণিত96.7কোডিং88.9যুক্তি86.8
  20. 20

    DeepSeek V4 Pro 0813

    ওপেন

    DeepSeek

    77.4

    সামগ্রিক

    ০.০৪৪ US$

    প্রতি সফল কাজ

    গণিত95.1যুক্তি85.8ভাষা82.1
  21. 21

    Grok 4.7 xHigh

    xAI

    77.4

    সামগ্রিক

    ০.৭১৮ US$

    প্রতি সফল কাজ

    গণিত95.7যুক্তি82.7ভাষা80.1
  22. 22

    Gemini 3.1 Pro Preview High

    Google

    77.0

    সামগ্রিক

    ০.২৮৬ US$

    প্রতি সফল কাজ

    গণিত91.0ভাষা85.4যুক্তি84.0
  23. 23

    DeepSeek V4 Flash Vision Exp

    ওপেন

    DeepSeek

    76.8

    সামগ্রিক

    ০.০৫১ US$

    প্রতি সফল কাজ

    গণিত87.8যুক্তি85.4ভাষা80.4
  24. 24

    Claude 4.7 Opus Thinking xHigh Effort

    Anthropic

    76.5

    সামগ্রিক

    ০.৫২৮ US$

    প্রতি সফল কাজ

    গণিত92.9যুক্তি87.2কোডিং82.1
  25. 25

    Claude 4.8 Opus Thinking Max Effort

    Anthropic

    76.2

    সামগ্রিক

    ০.৯৮৩ US$

    প্রতি সফল কাজ

    গণিত94.3যুক্তি89.2কোডিং81.8
  26. 26

    Qwen 3.8 Flash Next

    ওপেন

    Alibaba

    76.2

    সামগ্রিক

    ০.০৪২ US$

    প্রতি সফল কাজ

    যুক্তি87.4গণিত85.8নির্দেশ অনুসরণ77.1
  27. 27

    GLM-5.3

    ওপেন

    Z.AI

    76.1

    সামগ্রিক

    ০.৪৫০ US$

    প্রতি সফল কাজ

    গণিত87.9যুক্তি85.8ভাষা79.9
  28. 28

    Claude Sonnet 5 xHigh Effort

    Anthropic

    76.0

    সামগ্রিক

    ০.৫০৫ US$

    প্রতি সফল কাজ

    গণিত92.9যুক্তি88.7কোডিং80.7
  29. 29

    Grok 4.5

    xAI

    75.8

    সামগ্রিক

    ০.১৩১ US$

    প্রতি সফল কাজ

    গণিত90.8যুক্তি87.2ভাষা82.8
  30. 30

    Gemini 3.8 Flash High

    Google

    75.8

    সামগ্রিক

    ০.৩০৭ US$

    প্রতি সফল কাজ

    গণিত91.6যুক্তি89.3ভাষা87.8
  31. 31

    Qwen3.8 27B

    ওপেন

    Alibaba

    75.3

    সামগ্রিক

    ০.০৯৪ US$

    প্রতি সফল কাজ

    গণিত86.2যুক্তি80.0ডেটা বিশ্লেষণ76.6
  32. 32

    Muse Spark 1.1 xHigh Effort

    Meta

    75.3

    সামগ্রিক

    ০.১৯৮ US$

    প্রতি সফল কাজ

    যুক্তি87.7গণিত87.1কোডিং77.2
  33. 33

    GPT-5.2 High

    OpenAI

    74.6

    সামগ্রিক

    ০.২৩৪ US$

    প্রতি সফল কাজ

    গণিত93.2যুক্তি83.2ভাষা79.8
  34. 34

    Gemini 3.5 Flash High

    Google

    74.6

    সামগ্রিক

    ০.২৪৯ US$

    প্রতি সফল কাজ

    গণিত88.2ভাষা84.6যুক্তি82.0
  35. 35

    Claude 4.6 Opus Thinking High Effort

    Anthropic

    74.5

    সামগ্রিক

    ০.৪০৪ US$

    প্রতি সফল কাজ

    গণিত89.3যুক্তি88.7ভাষা83.3
  36. 36

    DeepSeek V4 Flash 0731

    ওপেন

    DeepSeek

    74.2

    সামগ্রিক

    ০.০৬০ US$

    প্রতি সফল কাজ

    গণিত86.8যুক্তি86.6ডেটা বিশ্লেষণ79.3
  37. 37

    GPT-5.2 Codex

    OpenAI

    74.0

    সামগ্রিক

    ০.১৮৭ US$

    প্রতি সফল কাজ

    গণিত88.8কোডিং83.6ডেটা বিশ্লেষণ78.2
  38. 38

    GPT-5.6 Luna Max Effort

    OpenAI

    73.6

    সামগ্রিক

    ০.১৬৯ US$

    প্রতি সফল কাজ

    গণিত87.2যুক্তি85.6কোডিং82.9
  39. 39

    Gemini 3.6 Flash High

    Google

    73.6

    সামগ্রিক

    ০.২৩৫ US$

    প্রতি সফল কাজ

    গণিত86.4যুক্তি85.1ভাষা83.9
  40. 40

    GLM-5.2

    ওপেন

    Z.AI

    73.2

    সামগ্রিক

    ০.২২৫ US$

    প্রতি সফল কাজ

    গণিত89.8কোডিং79.7যুক্তি78.6
  41. 41

    Qwen 3.7 Max

    Alibaba

    73.1

    সামগ্রিক

    ০.১৮২ US$

    প্রতি সফল কাজ

    গণিত85.2যুক্তি83.3ভাষা79.7
  42. 42

    Claude 4.6 Sonnet Thinking Medium Effort

    Anthropic

    73.0

    সামগ্রিক

    ০.৩০৬ US$

    প্রতি সফল কাজ

    গণিত87.0যুক্তি84.8কোডিং79.3
  43. 43

    Claude 4.5 Opus Thinking High Effort

    Anthropic

    72.6

    সামগ্রিক

    ০.৬১০ US$

    প্রতি সফল কাজ

    গণিত90.4ভাষা81.3যুক্তি80.1
  44. 44

    GPT-6 Luna Max Effort

    OpenAI

    72.0

    সামগ্রিক

    ০.০২৬ US$

    প্রতি সফল কাজ

    গণিত89.1যুক্তি81.8কোডিং79.0
  45. 45

    Inkling xHigh Effort

    ওপেন

    Thinking Machines

    71.9

    সামগ্রিক

    ০.৩১০ US$

    প্রতি সফল কাজ

    গণিত88.4যুক্তি78.3ভাষা73.5
  46. 46

    GLM-5.3 Flash

    ওপেন

    Z.AI

    71.6

    সামগ্রিক

    ০.০৩১ US$

    প্রতি সফল কাজ

    গণিত81.2কোডিং79.0যুক্তি77.6
  47. 47

    Kimi K2.6 Thinking

    ওপেন

    Moonshot AI

    70.5

    সামগ্রিক

    ০.১৬৯ US$

    প্রতি সফল কাজ

    গণিত84.3যুক্তি79.4কোডিং78.6
  48. 48

    GPT-5.4 Nano xHigh

    OpenAI

    69.6

    সামগ্রিক

    ০.০৯১ US$

    প্রতি সফল কাজ

    গণিত91.0যুক্তি81.1কোডিং70.8
  49. 49

    ox-alpha-max

    Stealth

    69.2

    সামগ্রিক

    ০.০০০ US$

    প্রতি সফল কাজ

    গণিত77.5যুক্তি76.6কোডিং75.8
  50. 50

    Qwen 3.6 Plus

    Alibaba

    68.9

    সামগ্রিক

    ০.২২৭ US$

    প্রতি সফল কাজ

    গণিত83.7কোডিং78.2যুক্তি75.8
  51. 51

    Kimi K2.7 Code

    ওপেন

    Moonshot AI

    68.4

    সামগ্রিক

    ০.১০০ US$

    প্রতি সফল কাজ

    যুক্তি82.8গণিত79.6ভাষা77.9
  52. 52

    Grok Build 0.1

    xAI

    67.8

    সামগ্রিক

    ০.০২৪ US$

    প্রতি সফল কাজ

    গণিত78.4যুক্তি76.4ভাষা72.5
  53. 53

    Nemotron 3 Ultra 550B A55B

    ওপেন

    NVIDIA

    67.4

    সামগ্রিক

    ০.৩৭১ US$

    প্রতি সফল কাজ

    গণিত88.7যুক্তি74.7নির্দেশ অনুসরণ73.4
  54. 54

    Minimax M3

    Minimax

    67.3

    সামগ্রিক

    ০.০৬০ US$

    প্রতি সফল কাজ

    গণিত76.9ভাষা76.8ডেটা বিশ্লেষণ76.2
  55. 55

    GPT-5.4 Mini xHigh

    OpenAI

    66.4

    সামগ্রিক

    ০.৩৩৪ US$

    প্রতি সফল কাজ

    গণিত78.5কোডিং71.6যুক্তি71.3
  56. 56

    Qwen 3.6 27B

    ওপেন

    Alibaba

    64.0

    সামগ্রিক

    ০.২০২ US$

    প্রতি সফল কাজ

    গণিত79.9কোডিং71.8ডেটা বিশ্লেষণ70.4
  57. 57

    Gemini 3.5 Flash-Lite High

    Google

    63.9

    সামগ্রিক

    ০.০৬৯ US$

    প্রতি সফল কাজ

    কোডিং76.1গণিত73.7ভাষা71.8
  58. 58

    Grok 4.3

    xAI

    62.3

    সামগ্রিক

    ০.০৬১ US$

    প্রতি সফল কাজ

    গণিত84.3ভাষা73.6যুক্তি70.8

খরচ হলো নির্বাচিত পরিধির জন্য সূত্র-প্রদত্ত সফল-কাজ-প্রতি-খরচের মান।

স্কোরগুলো একটি প্রকাশ্য তৃতীয় পক্ষের বেঞ্চমার্কের স্ন্যাপশট, অপরিবর্তিত রূপে পুনরুৎপাদিত। Dapols এর ওপর সফল-কাজ-প্রতি-খরচের বিশ্লেষণ যোগ করে।সূত্র দেখুন

A benchmark rank is not a hiring decision.

These scores say which model is strongest at a set of held-out tasks. They don’t say which one fits your workflow, your budget, or the tools you already pay for — and the cheapest model that clears your bar usually beats the highest scorer.