無名プログラマー。(マジなのでできれば見てやってます。 バイブコーディングをメインにしています。(ご理解のほどお願い致します) 多分フォロバする

Github, Hugging Face, Zenn, X
Spark-X2.5-4B を日本語化しました。 Qwen3.8-27B から蒸留して ・中国語の混入 18%→0% ・日本語の自然さ 2.09→3.81(Qwen3.5-4B は3.32) ・一般常識 23→27/30問 ブラウザで試せます project.arils.jp/Spark (Web推論なので熱くなります) 数学(AIME 2026)の結果ももうすぐ出します
2
15
126
13,059
このベンチが有名になりすぎて 更新がされてないモデルだと間違えてそう 性能というかこういう問題はあるから戦車は車が必要ということを暗記してる的な (間違ってるかもしれない……でも多少は影響はあるんじゃないかな)
Gemini 3.5 Flash-LiteとGPT-5.6 Luna、Claude Sonnet 5.5、Apple IntelligenceのオンデバイスAIとクラウドで例の質問を比較してみた
1
5
1,128
atemoya retweeted
AI 🤏 SI 🚀
1
4
8
341
昨日から9Bの学習を回してるから評価してるけど、多分OxCoder-9Bの方が高性能(IFEvalみたいな指示追従性はNeoHorse-1 9Bの方が高い) ただ、OxCoder-9Bは正式にFable 5.1の回答を蒸留したものと書いてあるからAnthropic的な思想に基づいてクリーンな方を選んだ……
なぜか誰も話題にしていないOxCoder-9B。ベンチマークではOrnith1.5-9Bを超えている。Neohorse-9Bとどっちがいいんだろうなぁ! huggingface.co/OrionLLM/OxCo…
1
2
32
1,915
atemoya retweeted
クリエイターとして、自作ではないと言うのは超えてはならないラインだと思う。 価値を作るのがクリエイターであって、自作をするからこそ価値が生まれる。 誤解を招いた所は訂正もするし謝罪もするが、自作を撤回するつもりは無い。
4
1
14
2,293
もっと伸びていいだろこのモデル(OxCoder-9Bも含めて) どうしてXはこういうモデルを出してくれないんだ...... (作者の方に一言......頑張ってください!)
1
5
41
4,679
ブログサイト作りました。 project.arils.jp/blog 今の所Apple製品から見るのが一番綺麗に見れると思います......(OSによってUIが変わる)
1
6
1,274
ちなみにこれだけでなんのサイトを元にしたかわかった人はAIサイトをみすぎてると思います。
148
おお
1
1
18
674
だから学習データは全て、どんな早いでも、どんなベンチマークに強いでも、学習データがバイアスがあったらもう使い物にならない。ほぼ全ての中国製モデルこの問題がある。 ←Takenoko12345678/Qwen3.5-0.8B-Japanese-SFT →HauhauCS/Gemma4-12B-QAT-Uncensored-HauhauCS-Balanced
予告より早いですが、0.8Bの日本語モデルを公開しました。 Qwen3.5-0.8Bから、日本語の常識問題41.7%→69.4%で、GPUなしのPCでも1回1秒前後で返ってきます。 学習データも全部公開済みです。 ブラウザ推論はこちらから(プライベートモードでは使用できないみたいです。) project.arils.jp/local
1
1
2
195
atemoya retweeted
自作のAIチャット。 Geminiより速報に強いです。 検索も、Geminiと違って確実にします。
53
45
726
817,873
すごいし、UIも含めて日本語圏には親しみやすくていいと思うんだけど、 Gemini 3.5 Flash Liteを使ってるからGeminiと比較するのはいただけないかもしれない...... でも今後も頑張ってください!
自作のAIチャット。 Geminiより速報に強いです。 検索も、Geminiと違って確実にします。
1
5
2,904
面白そうなアーティファクチャ思いついた(似たやつはかなりある) 次のQwen 3.5 0.8B Scienceでは使おう......(精度は要チェックだから絶対使うとは言えないんだけれども......)
1
6
721
2000トークンで32000トークンを上限にした際の元のQwen 3.5 0.8Bとほぼ同じスコアを出せるようになったので、ここからさらにどう知識を増やすか、みたいな感じですね 楽しみに待っていただけると嬉しいです!
2
135
なんでこんな計算資源が湧いてくるんだか....脱帽
予告より早いですが、0.8Bの日本語モデルを公開しました。 Qwen3.5-0.8Bから、日本語の常識問題41.7%→69.4%で、GPUなしのPCでも1回1秒前後で返ってきます。 学習データも全部公開済みです。 ブラウザ推論はこちらから(プライベートモードでは使用できないみたいです。) project.arils.jp/local
1
1
4
320
昨日出した0.8Bモデルの強化版です。 1億トークンのWikipediaの記事、DPOを行い、より自然な日本語と知識量の向上を行いました。 project.arils.jp/local 0.8Bで多少しか変わってないと感じるかもしれませんが、今後は目に見えるような改善をしていこうと思っているので今後も応援して欲しいです!
2
12
77
3,173
モデル huggingface.co/Takenoko12345… 今日の朝からWeb推論はこのモデルに置き換え、朝のポストで新しいモデルを使うようにした人は関係がありません…… 0.8Bとかなり小さいので難しいですが、実用性を今後も上げていこうと思っています。 Qwen3.5-0.8B Scienceと9Bモデルはは今月か来月中に出します。
5
430
atemoya retweeted
うーん
2
2
79
16,137
フォロバですが、フォロー制限に引っかかっていてかなり時間がかかる見込みです…… 今フォローしてくれている方は気長にお待ちいただけると幸いです!
1
8
760
昼起きたらこんな小さなアカウントがものすごい伸びていて驚きです! ありがとうございます!
292