{"task":"Language Modelling","dataset":"Artificial Analysis Coding Index","metric_names":["Index"],"rows":[{"id":597949,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Claude Fable 5.1 (Adaptive Reasoning, Max Effort, Default Fallback) (Anthropic)","metrics":{"Index":"81.6"},"paper_url":null,"paper_title":null,"paper_date":"2026-09-01","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":597958,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Claude Fable 5.1 (Adaptive Reasoning, Xhigh Effort, Default Fallback) (Anthropic)","metrics":{"Index":"80.7"},"paper_url":null,"paper_title":null,"paper_date":"2026-09-01","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":597985,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Claude Fable 5.1 (Adaptive Reasoning, High Effort, Default Fallback) (Anthropic)","metrics":{"Index":"79.1"},"paper_url":null,"paper_title":null,"paper_date":"2026-09-01","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598156,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-5.6 Sol (xhigh) (OpenAI)","metrics":{"Index":"78.3"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-09","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598003,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Claude Opus 5 (Adaptive Reasoning, Max Effort) (Anthropic)","metrics":{"Index":"78"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-24","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598072,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-5.6 Sol (max) (OpenAI)","metrics":{"Index":"77.4"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-09","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598186,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-5.6 Sol (high) (OpenAI)","metrics":{"Index":"77.2"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-09","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":597994,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-6 Astra (high) (OpenAI)","metrics":{"Index":"77.1"},"paper_url":null,"paper_title":null,"paper_date":"2026-09-03","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598042,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Claude Fable 5.1 (Adaptive Reasoning, Medium Effort, Default Fallback) (Anthropic)","metrics":{"Index":"77.1"},"paper_url":null,"paper_title":null,"paper_date":"2026-09-01","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598033,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Claude Opus 5 (Adaptive Reasoning, Xhigh Effort) (Anthropic)","metrics":{"Index":"77"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-24","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":597967,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-6 Astra (max) (OpenAI)","metrics":{"Index":"76.9"},"paper_url":null,"paper_title":null,"paper_date":"2026-09-03","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598135,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Grok 4.6 (high) (SpaceXAI)","metrics":{"Index":"76.8"},"paper_url":null,"paper_title":null,"paper_date":"2026-08-12","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598024,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-6 Astra (medium) (OpenAI)","metrics":{"Index":"76.7"},"paper_url":null,"paper_title":null,"paper_date":"2026-09-03","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598198,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-5.6 Terra (max) (OpenAI)","metrics":{"Index":"76.7"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-09","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598015,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback) (Anthropic)","metrics":{"Index":"76.5"},"paper_url":null,"paper_title":null,"paper_date":"2026-06-09","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598051,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Claude Opus 5 (Adaptive Reasoning, High Effort) (Anthropic)","metrics":{"Index":"76.5"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-24","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598108,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Muse Spark 1.3 (xhigh) (Meta)","metrics":{"Index":"76.5"},"paper_url":null,"paper_title":null,"paper_date":"2026-09-02","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598228,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Gemini 3.8 Flash (high) (Google)","metrics":{"Index":"76.3"},"paper_url":null,"paper_title":null,"paper_date":"2026-09-02","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598319,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-5.6 Sol (medium) (OpenAI)","metrics":{"Index":"76.3"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-09","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598099,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Qwen3.8 Max (0902) (Alibaba)","metrics":{"Index":"76.2"},"paper_url":null,"paper_title":null,"paper_date":"2026-09-02","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598165,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Kimi K3 (max) (Kimi)","metrics":{"Index":"76.2"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-16","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598328,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Gemini 3.7 Flash (high) (Google)","metrics":{"Index":"76.1"},"paper_url":null,"paper_title":null,"paper_date":"2026-08-13","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":597976,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-6 Astra (xhigh) (OpenAI)","metrics":{"Index":"75.9"},"paper_url":null,"paper_title":null,"paper_date":"2026-09-03","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598144,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Grok 4.6 (xhigh) (SpaceXAI)","metrics":{"Index":"75.9"},"paper_url":null,"paper_title":null,"paper_date":"2026-08-12","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598060,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Muse Spark 1.3 (max) (Meta)","metrics":{"Index":"75.8"},"paper_url":null,"paper_title":null,"paper_date":"2026-09-02","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598090,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-6 Astra (low) (OpenAI)","metrics":{"Index":"75.7"},"paper_url":null,"paper_title":null,"paper_date":"2026-09-03","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598081,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Claude Fable 5.1 (Adaptive Reasoning, Low Effort, Default Fallback) (Anthropic)","metrics":{"Index":"75.2"},"paper_url":null,"paper_title":null,"paper_date":"2026-09-01","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598360,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-5.5 (xhigh) (OpenAI)","metrics":{"Index":"74.9"},"paper_url":null,"paper_title":null,"paper_date":"2026-04-23","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598126,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GLM-5.3 (max) (Z AI)","metrics":{"Index":"74.8"},"paper_url":null,"paper_title":null,"paper_date":"2026-08-18","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598174,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Grok 4.6 (medium) (SpaceXAI)","metrics":{"Index":"74.4"},"paper_url":null,"paper_title":null,"paper_date":"2026-08-12","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598117,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Claude Opus 5 (Adaptive Reasoning, Medium Effort) (Anthropic)","metrics":{"Index":"74.3"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-24","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598210,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Claude Opus 4.8 (Adaptive Reasoning, Max Effort) (Anthropic)","metrics":{"Index":"74.3"},"paper_url":null,"paper_title":null,"paper_date":"2026-05-28","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598266,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Gemini 3.8 Flash (medium) (Google)","metrics":{"Index":"74.1"},"paper_url":null,"paper_title":null,"paper_date":"2026-09-02","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598239,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Claude Opus 4.7 (Adaptive Reasoning, Max Effort) (Anthropic)","metrics":{"Index":"73.6"},"paper_url":null,"paper_title":null,"paper_date":"2026-04-16","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598562,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Gemini 3.8 Flash (low) (Google)","metrics":{"Index":"73.5"},"paper_url":null,"paper_title":null,"paper_date":"2026-09-02","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598275,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Qwen3.8-Flash-Next (Alibaba)","metrics":{"Index":"73.1"},"paper_url":null,"paper_title":null,"paper_date":"2026-08-26","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598337,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Grok 4.5 (high) (SpaceXAI)","metrics":{"Index":"72.4"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-08","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598284,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Muse Spark 1.2 (xhigh) (Meta)","metrics":{"Index":"72.2"},"paper_url":null,"paper_title":null,"paper_date":"2026-08-05","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598683,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Kimi K3 (low) (Kimi)","metrics":{"Index":"72"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-16","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598257,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Qwen3.8 2.4T A95B (Alibaba)","metrics":{"Index":"71.9"},"paper_url":null,"paper_title":null,"paper_date":"2026-08-12","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598248,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Qwen3.8 Max (Alibaba)","metrics":{"Index":"71.8"},"paper_url":null,"paper_title":null,"paper_date":"2026-08-03","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598402,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-5.5 (high) (OpenAI)","metrics":{"Index":"71.6"},"paper_url":null,"paper_title":null,"paper_date":"2026-04-23","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598219,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GLM-5.3-Flash (Z AI)","metrics":{"Index":"71.5"},"paper_url":null,"paper_title":null,"paper_date":"2026-08-26","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598302,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Gemini 3.7 Flash (medium) (Google)","metrics":{"Index":"71.5"},"paper_url":null,"paper_title":null,"paper_date":"2026-08-13","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598369,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Claude Sonnet 5 (Adaptive Reasoning, Max Effort) (Anthropic)","metrics":{"Index":"71.5"},"paper_url":null,"paper_title":null,"paper_date":"2026-06-30","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598520,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-5.5 (medium) (OpenAI)","metrics":{"Index":"71.5"},"paper_url":null,"paper_title":null,"paper_date":"2026-04-23","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598390,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-5.6 Luna (max) (OpenAI)","metrics":{"Index":"71.4"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-09","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598508,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Muse Spark 1.1 (xhigh) (Meta)","metrics":{"Index":"71.3"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-09","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598348,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-5.4 (xhigh) (OpenAI)","metrics":{"Index":"71.1"},"paper_url":null,"paper_title":null,"paper_date":"2026-03-05","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598411,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Gemini 3.7 Flash (low) (Google)","metrics":{"Index":"71"},"paper_url":null,"paper_title":null,"paper_date":"2026-08-13","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598381,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-5.6 Terra (xhigh) (OpenAI)","metrics":{"Index":"70.6"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-09","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598590,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Gemini 3.5 Flash (high) (Google)","metrics":{"Index":"70.1"},"paper_url":null,"paper_title":null,"paper_date":"2026-05-19","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598553,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-5.6 Sol (low) (OpenAI)","metrics":{"Index":"69.7"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-09","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598499,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Gemini 3.6 Flash (high) (Google)","metrics":{"Index":"69.2"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-21","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598478,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"DeepSeek V4 Flash 0731 (Reasoning, Max Effort) (DeepSeek)","metrics":{"Index":"69.1"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-31","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598420,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"DeepSeek V4 Pro 0813 (Reasoning, Max Effort) (DeepSeek)","metrics":{"Index":"68.8"},"paper_url":null,"paper_title":null,"paper_date":"2026-08-13","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598532,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GLM-5.2 (max) (Z AI)","metrics":{"Index":"68.8"},"paper_url":null,"paper_title":null,"paper_date":"2026-06-16","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598739,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Gemini 3.1 Pro Preview (Google)","metrics":{"Index":"68.8"},"paper_url":null,"paper_title":null,"paper_date":"2026-02-19","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598464,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-5.6 Luna (xhigh) (OpenAI)","metrics":{"Index":"68.6"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-09","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598541,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Qwen3.8 27B (xhigh) (Alibaba)","metrics":{"Index":"68.1"},"paper_url":null,"paper_title":null,"paper_date":"2026-08-14","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598490,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-5.6 Terra (high) (OpenAI)","metrics":{"Index":"67.1"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-09","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598293,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Claude Opus 5 (Adaptive Reasoning, Low Effort) (Anthropic)","metrics":{"Index":"66.9"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-24","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598794,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Claude Sonnet 5 (Non-reasoning, High Effort) (Anthropic)","metrics":{"Index":"66.4"},"paper_url":null,"paper_title":null,"paper_date":"2026-06-30","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598437,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Grok 4.6 (low) (SpaceXAI)","metrics":{"Index":"66.3"},"paper_url":null,"paper_title":null,"paper_date":"2026-08-12","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598762,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Qwen3.7 Max (Alibaba)","metrics":{"Index":"66"},"paper_url":null,"paper_title":null,"paper_date":"2026-05-19","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598831,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-5.6 Sol (Non-reasoning) (OpenAI)","metrics":{"Index":"65.1"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-09","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598455,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"DeepSeek V4 Flash Vision (Reasoning, Max Effort) (DeepSeek)","metrics":{"Index":"65"},"paper_url":null,"paper_title":null,"paper_date":"2026-08-21","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598718,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-5.6 Terra (medium) (OpenAI)","metrics":{"Index":"64.7"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-09","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598579,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Motif 3 (Motif Technologies)","metrics":{"Index":"63.5"},"paper_url":null,"paper_title":null,"paper_date":"2026-08-12","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598607,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-5.6 Luna (high) (OpenAI)","metrics":{"Index":"63.3"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-09","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598695,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Claude Sonnet 4.6 (Adaptive Reasoning, Max Effort) (Anthropic)","metrics":{"Index":"63"},"paper_url":null,"paper_title":null,"paper_date":"2026-02-17","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598446,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Agnes 2.5 Pro Beta (Sapiens AI)","metrics":{"Index":"62.3"},"paper_url":null,"paper_title":null,"paper_date":"2026-08-26","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598614,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Motif 3 (Beta) (Motif Technologies)","metrics":{"Index":"62"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-14","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598920,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Kimi K2.6 (Kimi)","metrics":{"Index":"61.8"},"paper_url":null,"paper_title":null,"paper_date":"2026-04-20","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598664,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"K2 Horizon 375B A23B (MBZUAI Institute of Foundation Models)","metrics":{"Index":"61.5"},"paper_url":null,"paper_title":null,"paper_date":"2026-09-03","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598943,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Quasar 438B (max, based on GLM-5.2) (Multiverse Computing)","metrics":{"Index":"61.2"},"paper_url":null,"paper_title":null,"paper_date":"2026-08-10","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598674,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-5.5 (low) (OpenAI)","metrics":{"Index":"60.9"},"paper_url":null,"paper_title":null,"paper_date":"2026-04-23","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598727,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Apodex 1.1 (Apodex)","metrics":{"Index":"60.8"},"paper_url":null,"paper_title":null,"paper_date":"2026-08-30","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599048,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Kimi K2.7 Code (Kimi)","metrics":{"Index":"60.8"},"paper_url":null,"paper_title":null,"paper_date":"2026-06-12","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599015,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"MiMo-V2.5-Pro (Xiaomi)","metrics":{"Index":"60.2"},"paper_url":null,"paper_title":null,"paper_date":"2026-04-22","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599582,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"KAT Coder Pro V2 (KwaiKAT)","metrics":{"Index":"59.5"},"paper_url":null,"paper_title":null,"paper_date":"2026-03-27","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598655,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"DeepSeek V4 Pro (Reasoning, Max Effort) (DeepSeek)","metrics":{"Index":"59.4"},"paper_url":null,"paper_title":null,"paper_date":"2026-04-24","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598842,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Nex-N2-Pro (Nex AGI)","metrics":{"Index":"59.1"},"paper_url":null,"paper_title":null,"paper_date":"2026-06-02","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598900,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Agnes 2.5 Pro Alpha (Sapiens AI)","metrics":{"Index":"58.8"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-24","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599078,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Hy3 (Tencent)","metrics":{"Index":"58.8"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-06","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598750,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"DeepSeek V4 Pro (Reasoning, High Effort) (DeepSeek)","metrics":{"Index":"58.7"},"paper_url":null,"paper_title":null,"paper_date":"2026-04-24","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598636,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Muse Spark (Meta)","metrics":{"Index":"58.6"},"paper_url":null,"paper_title":null,"paper_date":"2026-04-08","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598774,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"MiniMax-M3 (MiniMax)","metrics":{"Index":"58.6"},"paper_url":null,"paper_title":null,"paper_date":"2026-06-01","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598991,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Qwen3.8 27B (low) (Alibaba)","metrics":{"Index":"58.2"},"paper_url":null,"paper_title":null,"paper_date":"2026-08-14","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598874,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-5.6 Terra (low) (OpenAI)","metrics":{"Index":"58.1"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-09","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599147,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Ling-3.0-flash-VL (InclusionAI)","metrics":{"Index":"57"},"paper_url":null,"paper_title":null,"paper_date":"2026-09-10","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599513,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"MiMo-V2.5 (Xiaomi)","metrics":{"Index":"56.8"},"paper_url":null,"paper_title":null,"paper_date":"2026-04-22","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599362,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-5.5 (Non-reasoning) (OpenAI)","metrics":{"Index":"56.5"},"paper_url":null,"paper_title":null,"paper_date":"2026-04-23","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599226,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"DeepSeek V4 Flash (Reasoning, Max Effort) (DeepSeek)","metrics":{"Index":"56.2"},"paper_url":null,"paper_title":null,"paper_date":"2026-04-24","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598891,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Qwen3.8 27B (medium) (Alibaba)","metrics":{"Index":"56.1"},"paper_url":null,"paper_title":null,"paper_date":"2026-08-14","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599238,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-5.4 mini (xhigh) (OpenAI)","metrics":{"Index":"56.1"},"paper_url":null,"paper_title":null,"paper_date":"2026-03-17","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599632,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-5.4 nano (xhigh) (OpenAI)","metrics":{"Index":"56.1"},"paper_url":null,"paper_title":null,"paper_date":"2026-03-17","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599069,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Qwen3.7 Plus (Alibaba)","metrics":{"Index":"55.9"},"paper_url":null,"paper_title":null,"paper_date":"2026-06-01","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599003,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GLM-5.1 (Reasoning) (Z AI)","metrics":{"Index":"55.8"},"paper_url":null,"paper_title":null,"paper_date":"2026-04-07","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598954,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Qwen3.6 Plus (Alibaba)","metrics":{"Index":"54.5"},"paper_url":null,"paper_title":null,"paper_date":"2026-04-02","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599552,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Qwen3.6 27B (Reasoning) (Alibaba)","metrics":{"Index":"53.7"},"paper_url":null,"paper_title":null,"paper_date":"2026-04-22","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599057,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Inkling Small (Thinking Machines)","metrics":{"Index":"52.9"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-30","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598850,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Solar Pro 4 (Upstage)","metrics":{"Index":"52.7"},"paper_url":null,"paper_title":null,"paper_date":"2026-08-06","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599351,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"MiniMax-M2.7 (MiniMax)","metrics":{"Index":"52.6"},"paper_url":null,"paper_title":null,"paper_date":"2026-03-18","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598927,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"JT-4.1 Flash 236B A21B (China Mobile)","metrics":{"Index":"52.4"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-09","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599641,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-5.6 Terra (Non-reasoning) (OpenAI)","metrics":{"Index":"52.3"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-09","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599102,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Inkling (xhigh) (Thinking Machines)","metrics":{"Index":"52.1"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-15","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599656,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Claude 4.5 Sonnet (Reasoning) (Anthropic)","metrics":{"Index":"52.1"},"paper_url":null,"paper_title":null,"paper_date":"2025-09-29","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599170,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"DeepSeek V4 Flash (Reasoning, High Effort) (DeepSeek)","metrics":{"Index":"52"},"paper_url":null,"paper_title":null,"paper_date":"2026-04-24","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598934,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Grok Build 0.1 0616 (SpaceXAI)","metrics":{"Index":"51.5"},"paper_url":null,"paper_title":null,"paper_date":"2026-06-16","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599111,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-5.6 Luna (medium) (OpenAI)","metrics":{"Index":"50.7"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-09","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599731,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Ling 3.0 Flash (InclusionAI)","metrics":{"Index":"50.6"},"paper_url":null,"paper_title":null,"paper_date":"2026-08-04","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":600285,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"MiMo-V2-Flash (Non-reasoning) (Xiaomi)","metrics":{"Index":"49.8"},"paper_url":null,"paper_title":null,"paper_date":"2025-12-16","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599205,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-5.1 (high) (OpenAI)","metrics":{"Index":"49.4"},"paper_url":null,"paper_title":null,"paper_date":"2025-11-13","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599331,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Nemotron 3 Ultra 550B A55B (Reasoning) (NVIDIA)","metrics":{"Index":"49.3"},"paper_url":null,"paper_title":null,"paper_date":"2026-06-04","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599452,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Gemini 3.5 Flash-Lite (Google)","metrics":{"Index":"49.3"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-21","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599998,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Muse Glimmer (high) (Meta)","metrics":{"Index":"49"},"paper_url":null,"paper_title":null,"paper_date":"2026-08-10","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599891,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Qwen3.5 397B A17B (Reasoning) (Alibaba)","metrics":{"Index":"48.2"},"paper_url":null,"paper_title":null,"paper_date":"2026-02-16","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":600463,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Mistral Medium 3.5 (Mistral)","metrics":{"Index":"46.9"},"paper_url":null,"paper_title":null,"paper_date":"2026-04-29","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599319,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Kimi K2.5 (Reasoning) (Kimi)","metrics":{"Index":"46.8"},"paper_url":null,"paper_title":null,"paper_date":"2026-01-27","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":600440,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Gemini 2.5 Pro Preview (Mar' 25) (Google)","metrics":{"Index":"46.7"},"paper_url":null,"paper_title":null,"paper_date":"2025-03-25","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599806,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Qwen3.6 27B (Non-reasoning) (Alibaba)","metrics":{"Index":"46.6"},"paper_url":null,"paper_title":null,"paper_date":"2026-04-22","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599480,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GLM-5.2 (Non-reasoning) (Z AI)","metrics":{"Index":"46.5"},"paper_url":null,"paper_title":null,"paper_date":"2026-06-16","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599972,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GLM-4.6 (Reasoning) (Z AI)","metrics":{"Index":"45.8"},"paper_url":null,"paper_title":null,"paper_date":"2025-09-30","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":600264,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Qwen3.5 122B A10B (Reasoning) (Alibaba)","metrics":{"Index":"45.7"},"paper_url":null,"paper_title":null,"paper_date":"2026-02-24","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599527,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GLM-4.7 (Reasoning) (Z AI)","metrics":{"Index":"45.3"},"paper_url":null,"paper_title":null,"paper_date":"2025-12-22","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599831,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"LongCat 2.0 (LongCat)","metrics":{"Index":"45.3"},"paper_url":null,"paper_title":null,"paper_date":"2026-06-29","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599192,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Solar Open2 250B (Upstage)","metrics":{"Index":"45"},"paper_url":null,"paper_title":null,"paper_date":"2026-08-12","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599489,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Qwen3.8 27B (Non-reasoning) (Alibaba)","metrics":{"Index":"44.6"},"paper_url":null,"paper_title":null,"paper_date":"2026-08-14","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599591,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-5.6 Luna (low) (OpenAI)","metrics":{"Index":"44.2"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-09","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599604,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"DeepSeek V3.2 (Reasoning) (DeepSeek)","metrics":{"Index":"44.2"},"paper_url":null,"paper_title":null,"paper_date":"2025-12-01","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":600060,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Claude 4.5 Haiku (Reasoning) (Anthropic)","metrics":{"Index":"43.9"},"paper_url":null,"paper_title":null,"paper_date":"2025-10-15","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":600370,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"DeepSeek V3.1 Terminus (Reasoning) (DeepSeek)","metrics":{"Index":"43.5"},"paper_url":null,"paper_title":null,"paper_date":"2025-09-22","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":600344,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Gemma 4 31B (Reasoning) (Google)","metrics":{"Index":"43.4"},"paper_url":null,"paper_title":null,"paper_date":"2026-04-02","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":600033,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Qwen3.5 122B A10B (Non-reasoning) (Alibaba)","metrics":{"Index":"43.3"},"paper_url":null,"paper_title":null,"paper_date":"2026-02-24","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":600101,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Ring-2.6-1T (InclusionAI)","metrics":{"Index":"42.8"},"paper_url":null,"paper_title":null,"paper_date":"2026-05-08","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599123,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Grok 4.3 (high) (SpaceXAI)","metrics":{"Index":"42.2"},"paper_url":null,"paper_title":null,"paper_date":"2026-04-30","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599926,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Qwen3.6 35B A3B (Reasoning) (Alibaba)","metrics":{"Index":"41.9"},"paper_url":null,"paper_title":null,"paper_date":"2026-04-16","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599823,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"K-EXAONE 2.0 (LG AI Research)","metrics":{"Index":"40.6"},"paper_url":null,"paper_title":null,"paper_date":"2026-08-12","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":600420,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"o1 (OpenAI)","metrics":{"Index":"39.7"},"paper_url":null,"paper_title":null,"paper_date":"2024-12-05","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599843,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Step 3.7 Flash (StepFun)","metrics":{"Index":"39.6"},"paper_url":null,"paper_title":null,"paper_date":"2026-05-29","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":598963,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-5.5 Instant (June 2026) (OpenAI)","metrics":{"Index":"39.4"},"paper_url":null,"paper_title":null,"paper_date":"2026-06-25","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":600157,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-5.6 Luna (Non-reasoning) (OpenAI)","metrics":{"Index":"39.3"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-09","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":600168,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Gemma 4 26B A4B (Reasoning) (Google)","metrics":{"Index":"39.3"},"paper_url":null,"paper_title":null,"paper_date":"2026-04-02","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599436,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"A.X-K2 (SK Telecom)","metrics":{"Index":"38.8"},"paper_url":null,"paper_title":null,"paper_date":"2026-08-12","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599666,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"K2 Horizon 7B (MBZUAI Institute of Foundation Models)","metrics":{"Index":"38.6"},"paper_url":null,"paper_title":null,"paper_date":"2026-09-03","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599377,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-5 (high) (OpenAI)","metrics":{"Index":"37.8"},"paper_url":null,"paper_title":null,"paper_date":"2025-08-07","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":600711,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Nemotron 3 Super 120B A12B (Reasoning) (NVIDIA)","metrics":{"Index":"37.7"},"paper_url":null,"paper_title":null,"paper_date":"2026-03-11","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599906,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Claude 4 Sonnet (Reasoning) (Anthropic)","metrics":{"Index":"37.6"},"paper_url":null,"paper_title":null,"paper_date":"2025-05-22","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":600431,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Qwen3.5 35B A3B (Non-reasoning) (Alibaba)","metrics":{"Index":"37"},"paper_url":null,"paper_title":null,"paper_date":"2026-02-24","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":600867,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"North Mini Code (Cohere)","metrics":{"Index":"36.5"},"paper_url":null,"paper_title":null,"paper_date":"2026-06-09","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":600045,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Claude 3.7 Sonnet (Reasoning) (Anthropic)","metrics":{"Index":"36.4"},"paper_url":null,"paper_title":null,"paper_date":"2025-02-24","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":601532,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Qwen3 Coder Next (Alibaba)","metrics":{"Index":"36.2"},"paper_url":null,"paper_title":null,"paper_date":"2026-02-03","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":600513,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Grok 4.3 (Non-reasoning) (SpaceXAI)","metrics":{"Index":"35.2"},"paper_url":null,"paper_title":null,"paper_date":"2026-04-30","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":600309,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Gemini 3.1 Flash-Lite (Google)","metrics":{"Index":"34.7"},"paper_url":null,"paper_title":null,"paper_date":"2026-03-03","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":600586,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Nova 2.0 Pro Preview (medium) (Amazon)","metrics":{"Index":"34"},"paper_url":null,"paper_title":null,"paper_date":"2025-11-27","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":601258,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"o1-preview (OpenAI)","metrics":{"Index":"34"},"paper_url":null,"paper_title":null,"paper_date":"2024-09-12","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":600184,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Gemini 2.5 Pro (Google)","metrics":{"Index":"33.3"},"paper_url":null,"paper_title":null,"paper_date":"2025-06-05","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":600632,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Gemma 4 31B (Non-reasoning) (Google)","metrics":{"Index":"33.2"},"paper_url":null,"paper_title":null,"paper_date":"2026-04-02","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":599564,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"G9v3-39A5B (AI9Stars)","metrics":{"Index":"33.1"},"paper_url":null,"paper_title":null,"paper_date":"2026-08-20","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":600545,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"K-EXAONE (Reasoning) (LG AI Research)","metrics":{"Index":"32.1"},"paper_url":null,"paper_title":null,"paper_date":"2025-12-31","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":601797,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Devstral 2 (Mistral)","metrics":{"Index":"31.3"},"paper_url":null,"paper_title":null,"paper_date":"2025-12-09","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":601194,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Mercury 2 (Inception)","metrics":{"Index":"31.1"},"paper_url":null,"paper_title":null,"paper_date":"2026-02-20","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":600573,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Gemma 4 12B (Reasoning) (Google)","metrics":{"Index":"31"},"paper_url":null,"paper_title":null,"paper_date":"2026-06-03","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":601017,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"gpt-oss-120b (high) (OpenAI)","metrics":{"Index":"30.4"},"paper_url":null,"paper_title":null,"paper_date":"2025-08-05","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":602399,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Claude 3.5 Sonnet (Oct '24) (Anthropic)","metrics":{"Index":"30.2"},"paper_url":null,"paper_title":null,"paper_date":"2024-10-22","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":600480,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Granite 4.2 30B (IBM)","metrics":{"Index":"29.9"},"paper_url":null,"paper_title":null,"paper_date":"2026-08-25","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":602242,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Devstral Small 2 (Mistral)","metrics":{"Index":"29.3"},"paper_url":null,"paper_title":null,"paper_date":"2025-12-09","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":600678,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Qwen3.5 9B (Reasoning) (Alibaba)","metrics":{"Index":"28.7"},"paper_url":null,"paper_title":null,"paper_date":"2026-03-02","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":600407,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Qwen3.6 35B A3B (Non-reasoning) (Alibaba)","metrics":{"Index":"28.1"},"paper_url":null,"paper_title":null,"paper_date":"2026-04-16","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":600622,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Command A+ (Cohere)","metrics":{"Index":"27.8"},"paper_url":null,"paper_title":null,"paper_date":"2026-05-20","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":600699,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Nemotron 3.5 Lightning (NVIDIA)","metrics":{"Index":"26.8"},"paper_url":null,"paper_title":null,"paper_date":"2026-08-11","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":601222,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Mistral Small 4 (Reasoning) (Mistral)","metrics":{"Index":"26.6"},"paper_url":null,"paper_title":null,"paper_date":"2026-03-16","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":601097,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Ling 3.0 Tiny (InclusionAI)","metrics":{"Index":"26.5"},"paper_url":null,"paper_title":null,"paper_date":"2026-08-06","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":602740,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Mistral Small 3.1 (Mistral)","metrics":{"Index":"26.3"},"paper_url":null,"paper_title":null,"paper_date":"2025-03-17","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":600273,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"K2 Horizon 3.7B (MBZUAI Institute of Foundation Models)","metrics":{"Index":"26.1"},"paper_url":null,"paper_title":null,"paper_date":"2026-09-03","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":602891,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Claude 3.5 Sonnet (June '24) (Anthropic)","metrics":{"Index":"26"},"paper_url":null,"paper_title":null,"paper_date":"2024-06-21","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":600879,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Nova 2.0 Pro Preview (low) (Amazon)","metrics":{"Index":"25.9"},"paper_url":null,"paper_title":null,"paper_date":"2025-11-27","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":601412,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Trinity Large Thinking (Arcee AI)","metrics":{"Index":"25.8"},"paper_url":null,"paper_title":null,"paper_date":"2026-04-01","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":602082,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Gemini 2.0 Pro Experimental (Feb '25) (Google)","metrics":{"Index":"25.5"},"paper_url":null,"paper_title":null,"paper_date":"2025-02-05","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":601176,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Nemotron Cascade 2 30B A3B (NVIDIA)","metrics":{"Index":"25.3"},"paper_url":null,"paper_title":null,"paper_date":"2026-03-19","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":601700,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Ling 2.6 Flash (InclusionAI)","metrics":{"Index":"25.3"},"paper_url":null,"paper_title":null,"paper_date":"2026-04-21","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":601250,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"DeepSeek R1 (Jan '25) (DeepSeek)","metrics":{"Index":"24.6"},"paper_url":null,"paper_title":null,"paper_date":"2025-01-20","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":602774,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-4o (May '24) (OpenAI)","metrics":{"Index":"24.2"},"paper_url":null,"paper_title":null,"paper_date":"2024-05-13","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":601783,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Gemini 2.0 Flash Thinking Experimental (Jan '25) (Google)","metrics":{"Index":"24.1"},"paper_url":null,"paper_title":null,"paper_date":"2025-01-21","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":600791,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"EXAONE 4.5 33B (LG AI Research)","metrics":{"Index":"23.6"},"paper_url":null,"paper_title":null,"paper_date":"2026-04-09","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":602371,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Gemini 1.5 Pro (Sep '24) (Google)","metrics":{"Index":"23.6"},"paper_url":null,"paper_title":null,"paper_date":"2024-09-24","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":600781,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Qwen3.5 9B (Non-reasoning) (Alibaba)","metrics":{"Index":"23.5"},"paper_url":null,"paper_title":null,"paper_date":"2026-03-02","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":601145,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"HyperNova 60B 2605 (high, based on gpt-oss-120b) (Multiverse Computing)","metrics":{"Index":"23.2"},"paper_url":null,"paper_title":null,"paper_date":"2026-05-26","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":600758,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Nova 2.0 Lite (high) (Amazon)","metrics":{"Index":"23"},"paper_url":null,"paper_title":null,"paper_date":"2025-10-29","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":602175,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"DeepSeek V3 (Dec '24) (DeepSeek)","metrics":{"Index":"23"},"paper_url":null,"paper_title":null,"paper_date":"2024-12-26","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":600817,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Qwen3.5 4B (Reasoning) (Alibaba)","metrics":{"Index":"22.6"},"paper_url":null,"paper_title":null,"paper_date":"2026-03-02","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":601122,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Granite 4.2 8B (IBM)","metrics":{"Index":"22.4"},"paper_url":null,"paper_title":null,"paper_date":"2026-08-25","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":600921,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Qwen3 235B A22B 2507 (Reasoning) (Alibaba)","metrics":{"Index":"22.1"},"paper_url":null,"paper_title":null,"paper_date":"2025-07-25","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":602983,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-4 Turbo (OpenAI)","metrics":{"Index":"21.5"},"paper_url":null,"paper_title":null,"paper_date":"2023-11-06","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":601110,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Magistral Medium 1.2 (Mistral)","metrics":{"Index":"21.3"},"paper_url":null,"paper_title":null,"paper_date":"2025-09-18","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":601503,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"gpt-oss-120b (low) (OpenAI)","metrics":{"Index":"21.2"},"paper_url":null,"paper_title":null,"paper_date":"2025-08-05","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":601672,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"DeepSeek V3 0324 (DeepSeek)","metrics":{"Index":"21.2"},"paper_url":null,"paper_title":null,"paper_date":"2025-03-25","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":601204,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"K2 Think V2 (MBZUAI Institute of Foundation Models)","metrics":{"Index":"21"},"paper_url":null,"paper_title":null,"paper_date":"2025-12-15","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":601556,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Nova 2.0 Pro Preview (Non-reasoning) (Amazon)","metrics":{"Index":"20.9"},"paper_url":null,"paper_title":null,"paper_date":"2025-11-27","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":601925,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"gpt-oss-20b (high) (OpenAI)","metrics":{"Index":"20.7"},"paper_url":null,"paper_title":null,"paper_date":"2025-08-05","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":601607,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Mistral Medium 3.1 (Mistral)","metrics":{"Index":"20.5"},"paper_url":null,"paper_title":null,"paper_date":"2025-08-12","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":601429,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Qwen3.5 4B (Non-reasoning) (Alibaba)","metrics":{"Index":"20.3"},"paper_url":null,"paper_title":null,"paper_date":"2026-03-02","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":601519,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-4.1 mini (OpenAI)","metrics":{"Index":"20.2"},"paper_url":null,"paper_title":null,"paper_date":"2025-04-14","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":601688,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Mistral Large 3 (Mistral)","metrics":{"Index":"20.1"},"paper_url":null,"paper_title":null,"paper_date":"2025-12-02","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":603359,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Gemini 1.5 Pro (May '24) (Google)","metrics":{"Index":"19.8"},"paper_url":null,"paper_title":null,"paper_date":"2024-05-15","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":601740,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"DiffusionGemma 26B A4B (Google)","metrics":{"Index":"19.7"},"paper_url":null,"paper_title":null,"paper_date":"2026-06-10","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":602113,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Claude 3 Opus (Anthropic)","metrics":{"Index":"19.5"},"paper_url":null,"paper_title":null,"paper_date":"2024-03-04","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":603641,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Gemini 1.0 Ultra (Google)","metrics":{"Index":"17.6"},"paper_url":null,"paper_title":null,"paper_date":"2023-12-06","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":601885,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Granite 4.2 3B (IBM)","metrics":{"Index":"17.5"},"paper_url":null,"paper_title":null,"paper_date":"2026-08-25","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":601317,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Qwen3 Next 80B A3B (Reasoning) (Alibaba)","metrics":{"Index":"17.4"},"paper_url":null,"paper_title":null,"paper_date":"2025-09-11","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":601389,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"o3-mini (high) (OpenAI)","metrics":{"Index":"16.3"},"paper_url":null,"paper_title":null,"paper_date":"2025-01-31","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":601833,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Llama 4 Maverick (Meta)","metrics":{"Index":"16.3"},"paper_url":null,"paper_title":null,"paper_date":"2025-04-05","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":602448,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Solar Pro 3 (Upstage)","metrics":{"Index":"16.2"},"paper_url":null,"paper_title":null,"paper_date":"2026-04-06","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":602010,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Claude 3.5 Haiku (Anthropic)","metrics":{"Index":"15.9"},"paper_url":null,"paper_title":null,"paper_date":"2024-10-22","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":600076,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-5 mini (high) (OpenAI)","metrics":{"Index":"15.6"},"paper_url":null,"paper_title":null,"paper_date":"2025-08-07","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":602882,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Qwen3 32B (Reasoning) (Alibaba)","metrics":{"Index":"15.3"},"paper_url":null,"paper_title":null,"paper_date":"2025-04-28","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":602145,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Magistral Small 1.2 (Mistral)","metrics":{"Index":"14.7"},"paper_url":null,"paper_title":null,"paper_date":"2025-09-17","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":600799,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"MiniCPM5-2B (OpenBMB)","metrics":{"Index":"14.5"},"paper_url":null,"paper_title":null,"paper_date":"2026-09-07","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":602046,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"NVIDIA Nemotron 3 Nano 30B A3B (Reasoning) (NVIDIA)","metrics":{"Index":"14.4"},"paper_url":null,"paper_title":null,"paper_date":"2025-12-15","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":603409,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Celeris-1 (Celeris)","metrics":{"Index":"14.4"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-24","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":603512,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Ministral 3 14B (Mistral)","metrics":{"Index":"14.4"},"paper_url":null,"paper_title":null,"paper_date":"2025-12-02","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":603784,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Claude 2.1 (Anthropic)","metrics":{"Index":"14"},"paper_url":null,"paper_title":null,"paper_date":"2023-11-21","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":601489,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Nemotron 3 Nano Omni 30B A3B Reasoning (NVIDIA)","metrics":{"Index":"13.8"},"paper_url":null,"paper_title":null,"paper_date":"2026-04-29","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":603398,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Qwen3 14B (Reasoning) (Alibaba)","metrics":{"Index":"13.8"},"paper_url":null,"paper_title":null,"paper_date":"2025-04-28","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":603162,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-4 (OpenAI)","metrics":{"Index":"13.1"},"paper_url":null,"paper_title":null,"paper_date":"2023-03-14","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":603842,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Claude 2.0 (Anthropic)","metrics":{"Index":"12.9"},"paper_url":null,"paper_title":null,"paper_date":"2023-07-11","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":603011,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Mistral Small 3.2 (Mistral)","metrics":{"Index":"12.5"},"paper_url":null,"paper_title":null,"paper_date":"2025-06-20","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":601648,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Qwen3 30B A3B 2507 (Reasoning) (Alibaba)","metrics":{"Index":"12.1"},"paper_url":null,"paper_title":null,"paper_date":"2025-07-30","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":602532,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Llama 3.3 Instruct 70B (Meta)","metrics":{"Index":"11.9"},"paper_url":null,"paper_title":null,"paper_date":"2024-12-06","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":603224,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-4o mini (OpenAI)","metrics":{"Index":"11.4"},"paper_url":null,"paper_title":null,"paper_date":"2024-07-18","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":602435,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-4.1 nano (OpenAI)","metrics":{"Index":"11.1"},"paper_url":null,"paper_title":null,"paper_date":"2025-04-14","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":603864,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"GPT-3.5 Turbo (OpenAI)","metrics":{"Index":"10.7"},"paper_url":null,"paper_title":null,"paper_date":"2022-11-30","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":602685,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Granite 4.1 30B (IBM)","metrics":{"Index":"10.4"},"paper_url":null,"paper_title":null,"paper_date":"2026-04-29","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":604251,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Gemma 3 27B Instruct (Google)","metrics":{"Index":"10.1"},"paper_url":null,"paper_title":null,"paper_date":"2025-03-12","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":601419,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"G9v3-3B (AI9Stars)","metrics":{"Index":"9.9"},"paper_url":null,"paper_title":null,"paper_date":"2026-07-23","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":603879,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Ministral 3 8B (Mistral)","metrics":{"Index":"9.7"},"paper_url":null,"paper_title":null,"paper_date":"2025-12-02","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":602199,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Nanbeige4.1-3B (Nanbeige)","metrics":{"Index":"9.6"},"paper_url":null,"paper_title":null,"paper_date":"2026-02-11","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":603282,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Granite 4.1 8B (IBM)","metrics":{"Index":"9.5"},"paper_url":null,"paper_title":null,"paper_date":"2026-04-29","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":602031,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Gemma 4 E4B (Reasoning) (Google)","metrics":{"Index":"9.4"},"paper_url":null,"paper_title":null,"paper_date":"2026-04-03","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":604109,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Qwen3 8B (Reasoning) (Alibaba)","metrics":{"Index":"9"},"paper_url":null,"paper_title":null,"paper_date":"2025-04-28","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":603349,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Llama 4 Scout (Meta)","metrics":{"Index":"8.2"},"paper_url":null,"paper_title":null,"paper_date":"2025-04-05","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":602725,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"NVIDIA Nemotron 3 Nano 4B (NVIDIA)","metrics":{"Index":"8"},"paper_url":null,"paper_title":null,"paper_date":"2026-03-16","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":604164,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Claude Instant (Anthropic)","metrics":{"Index":"7.8"},"paper_url":null,"paper_title":null,"paper_date":"2023-03-14","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":602207,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"LFM2.5-2.6B (Liquid AI)","metrics":{"Index":"7.7"},"paper_url":null,"paper_title":null,"paper_date":"2026-08-04","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":602470,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Gemma 4 E2B (Reasoning) (Google)","metrics":{"Index":"7.2"},"paper_url":null,"paper_title":null,"paper_date":"2026-04-02","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":604438,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Gemma 3 12B Instruct (Google)","metrics":{"Index":"5.8"},"paper_url":null,"paper_title":null,"paper_date":"2025-03-12","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":603074,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Llama 3.1 Instruct 8B (Meta)","metrics":{"Index":"5.4"},"paper_url":null,"paper_title":null,"paper_date":"2024-07-23","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":604266,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Ministral 3 3B (Mistral)","metrics":{"Index":"4.8"},"paper_url":null,"paper_title":null,"paper_date":"2025-12-02","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":603631,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Granite 4.1 3B (IBM)","metrics":{"Index":"4.7"},"paper_url":null,"paper_title":null,"paper_date":"2026-04-29","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":603926,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"PALM-2 (Google)","metrics":{"Index":"4.6"},"paper_url":null,"paper_title":null,"paper_date":"2023-05-10","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":603431,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Phi-4 Mini Instruct (Microsoft)","metrics":{"Index":"3.8"},"paper_url":null,"paper_title":null,"paper_date":"2024-02-26","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":604447,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"K2 Horizon 0.9B (MBZUAI Institute of Foundation Models)","metrics":{"Index":"3.4"},"paper_url":null,"paper_title":null,"paper_date":"2026-09-03","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":604329,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Gemma 3n E4B Instruct (Google)","metrics":{"Index":"3.2"},"paper_url":null,"paper_title":null,"paper_date":"2025-06-26","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":603048,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Qwen3.5 2B (Reasoning) (Alibaba)","metrics":{"Index":"2.9"},"paper_url":null,"paper_title":null,"paper_date":"2026-03-02","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":604302,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Gemma 3 4B Instruct (Google)","metrics":{"Index":"2.7"},"paper_url":null,"paper_title":null,"paper_date":"2025-03-12","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":603452,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Qwen3.5 2B (Non-reasoning) (Alibaba)","metrics":{"Index":"2.4"},"paper_url":null,"paper_title":null,"paper_date":"2026-03-02","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":603924,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"Qwen3.5 0.8B (Non-reasoning) (Alibaba)","metrics":{"Index":"1.2"},"paper_url":null,"paper_title":null,"paper_date":"2026-03-02","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]},{"id":603728,"task":"Language Modelling","parent_task":null,"dataset":"Artificial Analysis Coding Index","model_name":"MiniCPM-V 4.6 1.3B (OpenBMB)","metrics":{"Index":"0.7"},"paper_url":null,"paper_title":null,"paper_date":"2026-05-11","code_links":[{"title":"artificialanalysis.ai","url":"https://artificialanalysis.ai/"}],"metrics_order":"[\"Index\"]","area":"Natural Language Processing","uses_additional_data":null,"source":"external","tags":[]}]}