DataLearner 标志
JU

Julia 1

基础大模型

Julia 1

发布时间: 2026-09-25更新于: 2026-09-27浏览量: 1
在线体验GitHubHugging Face对比
模型参数
1.4亿
上下文长度
8K
多语言支持
暂无数据
推理能力
3/5

Supersonic Labs 发布的 1.443 亿参数开源决策模型,基于 mmBERT-small,支持给定选项的分类、路由和评分,可在本地 CPU 运行。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

Julia 1

模型基本信息

推理过程
暂无数据
思考模式
不支持思考模式
上下文长度
8K tokens
最大输出长度
暂无数据
模型类型
基础大模型
输入/输出模态
文本 → 文本
发布时间
2026-09-25
模型文件大小
550.5 MiB (FP32)
MoE架构
否
总参数 / 激活参数
1.4亿 / 不适用
知识截止
暂无数据
Julia 1

开源和体验地址

代码开源状态
预训练权重开源
Apache 2.0- 免费商用授权
GitHub 源码
暂无
在线体验
暂无
Julia 1

官方介绍与博客

官方论文
暂无
DataLearnerAI博客
暂无
Julia 1

API接口信息

接口速度
3/5
暂无公开的 API 定价信息。
Julia 1

发布机构

Julia 1

模型解读

模型简介

Julia 1 是 Supersonic Labs 于 2026 年 9 月发布的开源决策模型,基于 mmBERT-small 多语言编码器构建。它读取给定的状态、问题和 2–20 个候选答案,返回选择结果与概率,可用于文本分类、路由、分级评分和布尔判断;它不是聊天或文本生成模型。

规格与运行

模型共有 1.443 亿参数,原生运行时最多接收 8192 个合并输入 token;历史准确率评测使用 1024 token。官方提供 Python CPU 与 CUDA 运行时,同一权重另有 ONNX/WebGPU 浏览器导出。模型文件约 550.5 MiB,采用 Apache 2.0 许可;训练流水线未公开。

官方评测

2026 年 9 月 24 日的官方 H200 BF16 评测中,Typed Decisions 正确率为 73.15%(1463/2000);AG News 四分类、DAIR Emotion 六分类和 Banking77 的 72 标签候选筛选试验分别为 94%、86% 和 64%,后三项各测试 100 个样本。MASSIVE 场景分类在 52 个 locale 的宏平均准确率为 71.50%。这些结果来自不同任务与测试设置,不能推断其他场景的准确率。

使用边界

Julia 1 只能比较输入中提供的候选答案,不能补充缺失事实,也没有证实的复杂推理能力。原生调用限 2–20 个选项;较大候选集的分层路由可能在缩小范围时丢失正确答案。部署前应按具体任务验证。当前公开的是本地权重与运行代码,未见已上线的按 token 收费 API。

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码