
DeepSeek-V3
A strong Mixture-of-Experts (MoE) language model with 671B total parameters with 37B activated for each token. - Outil IA intelligent pour améliorer votre productivité.


DeepSeek's first-generation reasoning models. DeepSeek-R1-Zero, a model trained via large-scale reinforcement learning without supervised fine-tuning, demonstrated remarkable performance on reasoning. - Outil IA intelligent pour améliorer votre productivité.
90
Views
0
Likes
Jan 2026
Added
github.com
Website
Editorial Review
DeepSeek's first-generation reasoning models. DeepSeek-R1-Zero, a model trained via large-scale reinforcement learning without supervised fine-tuning, demonstrated remarkable performance on reasoning.
DeepSeek-R1 est un excellent outil dans la catégorie open-source-llm, adapté à tous les utilisateurs ayant besoin d'une assistance IA.
Visit the official website to get started
Have an AI tool to share?
Get your product in front of people actively exploring AI tools.
Submit Your Tool
A strong Mixture-of-Experts (MoE) language model with 671B total parameters with 37B activated for each token. - Outil IA intelligent pour améliorer votre productivité.
Qwen3 est la famille à poids ouverts Apache-2.0 publiée par Alibaba en 2025. Cette revue distingue Qwen3-2507 des modèles ouverts Qwen3.6 et des API Model Studio, puis évalue déploiement, contexte, raisonnement, coûts, licence, sécurité et alternatives.

Llama3 is a large language model developed by Meta AI. It is the successor to Meta's Llama2 language model. - Outil IA intelligent pour améliorer votre productivité.

Mixtral est la famille de modèles Apache-2.0 de Mistral AI, composée d'un mélange clairsemé d'experts, comprenant Mixtral 8x7B et 8x22B et des variantes d'instructions. Ce guide indépendant explique le routage, les paramètres actifs par rapport au total, les coûts de mémoire et de service, la quantification, l'évaluation, la sécurité et les alternatives modernes.