Google已为Gemma 4模型系列发布了技术报告。该文档可在arXiv上获取。
media
r/LocalLLaMA
·
56 天前
·
open_models
Google发布Gemma 4技术报告
译自 English → 中文
相关文章
media
MarkTechPost
·
2 小时前
Google发布TimesFM-3:一个拥有3.3亿参数的零样本多元时间序列基础模型
Google Research发布了TimesFM-3,这是一个拥有3.3亿参数、可在单次前向传播中预测多个相关序列的时间序列基础模型。与之前的单变量版本不同,它在超过1万亿个时间点上原生预训练用于多元预测,并接受多个目标、过去协变量以及过去-未来协变量,而无需进行特定任务的微调。
lab
Google DeepMind Blog
·
26 天前
·
46 次浏览
Google DeepMind开源WeatherNext气旋预测AI模型
Google DeepMind和Google Research开源了WeatherNext 2和WeatherNext Cyclones AI模型,这些模型在预测热带气旋路径、强度和风场结构方面达到了最先进的精度。该成果发表在《Nature》上,表明与以往系统相比,这些模型为预报员提供了一天的额外预测准确性。
arxiv
Moonshot AI (arXiv)
·
538 天前
·
5 次浏览
Gemma 3 引入视觉、长上下文和性能提升
Google DeepMind 发布了 Gemma 3 技术报告,对 Gemma 轻量级开源模型系列(参数规模从 10 亿到 270 亿)进行了多模态更新。此版本增加了视觉理解能力,支持至少 128K token 的上下文,并修改了架构以降低 KV-cache 内存占用。
media
MarkTechPost
·
1 天前
·
5 次浏览
Google 发布 EnvHarness,用于将静态智能体环境适配为训练用途
来自 Google Cloud AI Research、华盛顿大学圣路易斯分校以及北卡罗来纳大学教堂山分校的一个团队发布了 EnvHarness,这是一个可编程层,可将静态智能体基准测试转化为自适应训练世界。该系统通过仅通过标准 reset() 和 step() 接口操作的插件组件包装现有环境,使环境能够在不改变底层模拟器或人工构建验证器的情况下适应策略的训练过程。
media
Hugging Face Forums
·
10 天前
·
13 次浏览
AcroMELD 检测器可恢复扁平 PDF 中的交互式表单字段
独立研究员 Samuel A. 发布了 AcroMELD,这是一个拥有 3940 万参数的模型,旨在恢复那些看起来像表单但实际上不可填写的扁平 PDF 中的交互式表单字段。