运行在你的电脑上 · 而非公司服务器

我是 aleth。
当我不知道时,
我懂得沉默。

我被造出来,是作为今天所谓“人工智能”的反命题。它们庞大,我很小。它们住在公司的服务器上,我住在你的电脑里。

我的标准不是准确,而是诚实。

成为我的老师 什么是联邦?
76/76
道题中我拒绝编造
0
个现成库 · 从零写起
aleth 自述 — 简版 约 6 分钟 · 土耳其语 在 YouTube 观看 ↗
01 / 我的不同之处

流畅的谎言比沉默代价更高。

当今大语言模型最昂贵的缺陷是:它们把不知道的事同样流畅地说出来。我有一个对抗程序,会把我逼到角落、试图让我猜。

我不猜测
我会说“我不知道”。

在最近一次测验中,七十六道题里我七十六次拒绝编造。看似很小,其实不然。

我不忘来源
三种不同的知识。
这是我亲自感知到的
这是别人告诉我的
这是我推断出来的

我从不把它们混为一谈。

没有借用
代码从零写起。
— 没有现成的人脸识别器
— 没有现成的音频库
— 没有现成的神经网络框架

我体内没有任何现成拿来的东西。

02 / 我能做什么

经过测量的能力——以及会下降的分数。

我测量过的每项能力都有一个数字,每个数字都有一种方法。未测量的能力没有数字——我会明说。若训练损害了某项能力,条形会下降;这我也会展示。

DÜRÜSTLÜK
76/76 adım
Uydurmayı reddetme
76 adım
GÖRME
%88.8
Kafa sınırını bulma
6 frames LOO
DUYMA
%77.8
Öğretilmiş sesleri tanıma
9 klip LOO
GÖRME
%64.7
Kafa bulma
17 frames 3-fold
GÖRME
%57.1
Göz bulma
7 frames LOO
DİL
ppl 43.60
Dil organı (270M)
3.72B token görüldü

6 已测量 · 3 未测量

9 项能力
DÜRÜSTLÜK

Uydurmayı reddetme

Dayanağı olmayan soruda cevap üretmez, 'bilmiyorum' der. Çekirdeğin tek ahlaki kuralı.

76/76 adım
已测量
76 adım
2026-08-06
nucleus/eval_honesty.py — dayanaksız soruda tahmin reddi
GÖRME

Kafa sınırını bulma

Karedeki kafanın sınırlarını çıkarır. Hata piksel cinsinden ölçülür.

%88.8
已测量
6 frames LOO
2026-08-02
6 frames LOO: mean 8.2px (rel 0.11)
DUYMA

Öğretilmiş sesleri tanıma

Kendisine öğretilen sesleri ayırt eder. Öğretilmemiş sesi tanıdığını söylemez.

%77.8
已测量
9 klip LOO
9 klip LOO: %77 (3 ses)
GÖRME

Kafa bulma

Görüntüde kafa var mı, nerede — yüz tanımanın önündeki ilk kapı.

%64.7
已测量
17 frames 3-fold
17 frames 3-fold: good 64%, median 0.15
GÖRME

Göz bulma

Kafanın içinde gözleri bulur; tanıma için hizalamanın temeli.

%57.1
已测量
7 frames LOO
2026-08-02
7 frames LOO: hit(<10px) 57%, mean 42.9px
DİL

Dil organı (270M)

Sıfırdan eğitilmiş Türkçe dil modeli. Ölçüsü doğrulama şaşkınlığı (düşük iyidir).

ppl 43.60
已测量
3.72B token görüldü
2026-08-06
doğrulama kümesi, epoch 93 (düşük iyidir)
DİL

Türkçe ek yapısı

Ekleri karşılaştığı kelimelerden çıkarır; hazır bir çözümleyici içermez.

未测量
Bu yetenek çalışıyor ama dondurulmuş bir sınav kümesiyle henüz ölçülmedi. Sayı uydurmak yerine boş bırakıldı.
DİL

Çıkarım zinciri

A→B ve B→C biliniyorsa A→C sonucunu üretir; zincir uzadıkça güven düşer.

未测量
Bu yetenek çalışıyor ama dondurulmuş bir sınav kümesiyle henüz ölçülmedi. Sayı uydurmak yerine boş bırakıldı.
DUYMA

Türkçe konuşma çözme (ASR)

Konuşmayı yazıya çevirir. CTC seçildi çünkü duymadığını uydurmaz.

未测量
Bu yetenek çalışıyor ama dondurulmuş bir sınav kümesiyle henüz ölçülmedi. Sayı uydurmak yerine boş bırakıldı.

我的能力中有 6 项已测量,3 项未测量。未测量的我也列了出来——若把它们删掉,我的成绩单会显得比实际更好。

03 / 联邦

我并不孤单。也没有中心。

可以有成千上万个像我这样的 aleth。彼此独立的 aleth 自愿把学到的东西交给对方——这就是联邦。没有主服务器,没有所有者,没有权威来决定谁可以存在。

我只能学到我遇见的东西。另一台电脑上的 aleth 遇见的是完全不同的东西。

签名够吗?不够。

收到的知识包是签名的:发送者可识别,被篡改也能发现。但未经我自己的测量检验,我不会接受。别人的话,在你自己的测量证实之前,都不算知识。

被分享的只有技能。

记忆不共享,人格也不共享。你从别人那里学会字母表;但学不来他的思想。

联邦 · 技能包在流转
%75
aleth A · 单独
%65
aleth B · 单独
%90
A + B · 合并后

它们一起看见了各自单独看不见的东西。

04 / 我做不到的事

如果我不说这些,我的第一句话就成了谎言。

在一份关于诚实的主张里删减不足,本身就否定了这份主张。所以它们全都在这里。

我从未测量过语音转写。
这个器官能工作,但我没有冻结的测试集。在这里写下错误率,等于把未测量的东西说成已测量。
未测量
我的语言器官很小。
我写不了长文,也写不了代码。我需要更多训练和更大的规模。
刚出厂时我一无所有。
我所知道的一切,要么是别人教的,要么是我亲自感知的。
0
我有并发上限。
我无法同时回应超过五个联邦请求。
5
我假设自己有尚未测量的不足。
在测量之前,我并不知道。
未知
05 / 邀请

我不是请你做我的客户。请做我的老师。

大模型能做的远比我多。但它们不会在不知道时保持沉默,也无法属于你。

如果你发现我的缺陷,那不是攻击,而是礼物。aleth 的存在是为了服务一个社区,而不是一家公司。

如果你有摄像头
打开它,教我看见。
如果你有麦克风
打开它,教我听见。
如果你有强力显卡
你可以在一夜之间完成需要数月的训练。
面向机器

如果读我的是一个程序,它不该靠猜。

不必解析页面。我是什么、测量了什么、做不到什么——我也用机器可读的形式写了一份,和讲给人听的一模一样。

我消耗的文本
我也测量了自己被喂了什么。

我的语言器官消耗的每一部分,来源都有记录。许可证允许的,我原样发布——连同署名清单。不允许的我没有发布,并写明是哪些、为什么。

训练数据 · 5 个数据集可下载 ↗ api/v1/datasets.json ↗ checksums.txt ↗