微信扫码
添加专属顾问
我要投稿
谷歌开源模型Gemma 3强势来袭,部署效率超越DeepSeek-V3/R1。 核心内容: 1. Gemma 3基于Gemini 2.0技术,提供1B-27B不同规模模型选择 2. 单GPU或TPU即可部署,支持多模态推理,128k token窗口 3. 支持35+种语言,训练使用6144张TPUv5P卡,无需GPU
1,基于 Gemini 2.0 技术打造 。
2,全家桶:1B、4B、12B 和 27B。
3,“世界上最好的单芯片模型”(单 GPU 或 TPU )。
4,最好的非推理开源模型:LMArena 表现优于 Llama-405B、DeepSeek-V3 和 o3-mini,仅次于DeepSeek R1。
5,多模态:拥有“高级文本和视觉推理能力”,可以在 4B+ 规模上“分析图像、文本和短视频”。
6,128k token上下文窗口,开箱即用。
7,支持超过 35 种语言,预训练支持超过 140 种语言。
8,无需GPU:训练27B用了6144张TPUv5P卡。
(对 Gemma 3 27B IT 模型在 Chatbot Arena 中的评估(Chiang 等,2024)。所有模型均通过盲测进行对比评估,由人工评审员以并排对比的方式进行评分。每个模型的评分基于 Elo 评级系统。Gemma-3-27B-IT 的数据为初步结果,于 2025 年 3 月 8 日 收到。)
53AI,企业落地大模型首选服务商
产品:场景落地咨询+大模型应用平台+行业解决方案
承诺:免费场景POC验证,效果验证后签署服务协议。零风险落地应用大模型,已交付160+中大型企业
2025-04-30
n8n:免费+开源的自动化神器,比dify更简单,比Make更强大!
2025-04-30
宝藏发现:Sim Studio,一款让AI工作流搭建变简单的开源利器
2025-04-29
我们有必要使用 Qwen3 吗?
2025-04-29
Qwen3开源发布:Think Deeper, Act Faster!社区推理、部署、微调、MCP调用实战教程来啦!
2025-04-29
阿里 Qwen3 技术详解: 4B 参数媲美 72B,MoE 架构的开源突破
2025-04-29
PAI-Model Gallery 支持云上一键部署 Qwen3 全尺寸模型
2025-04-29
Qwen3中性能最强MOE模型部署抛砖引玉 + 实测
2025-04-29
体验了最新的Qwen3之后,端侧之王果然没有让我失望!
2024-07-25
2025-01-01
2025-01-21
2024-05-06
2024-09-20
2024-07-20
2024-07-11
2024-06-12
2024-08-13
2024-12-26
2025-04-29
2025-04-28
2025-04-28
2025-04-28
2025-04-21
2025-04-19
2025-04-17
2025-04-15