KALYPSO

KALYPSOデータまで公開の14Bコード生成モデル

KALYPSO-v1.1L は Qwen2.5-Coder-14B をベースに、18,049件の agentic とコーディングデータで微調整されたオープンな14Bモデル。重み・データセット・汚染除去フローまで公開し、再現性と透明性を重視した構成。

free
KALYPSOオープンソースAIコード生成AgenticコーディングQwen2.5-Coderデータセット公開データ汚染除去プログラミングモデルHugging FaceLLMファインチューニング
登録日
4.1 (0 レビュー数)

ログイン後に評価できます

最近 Hugging Face に登場した KALYPSO-v1.1L は、14B パラメータのコーディング特化モデルだ。ベースは実績のある Qwen2.5-Coder-14B。追加学習には「Kraken」と名付けられた 18,049 件の agentic およびコーディングデータセットを使い、HumanEval と MBPP に対するデータ汚染を除去してから調整している。

数字だけ見れば、いわゆるファインチューニングの一種に収まる。ただ、今回のリリースは「学習済み重みをどうぞ」では終わらない。モデル重み、学習データセット、前処理パイプラインが 3 点セットで全部公開されている。公開者側の言葉を借りれば、「inspect everything」。そう聞くと「何がそんなに珍しいの?」と思うかもしれないが、実際には学習データまで丸ごと出すプロジェクトは決して多くない。

「全部見せる」という公開作法

ここまでやる理由は、たぶん検証と再現に対するこだわりだろう。データセットが公開されていれば、モデルの予期しない動きを見つけたときに「どのサンプルが原因か」をあとから調べられる。再現実験のハードルがぐっと下がるのは、研究用途でも実務用途でも大きい。

しかも、このデータはただ集めただけではない。コード名つきの「Kraken」データセットとしてまとめられ、人間によるキュレーションを経た上で、評価セットの汚染を防ぐ処理まで明示されている。ベンチマーク対策としてのデータ汚染除去は、今の LLM 開発では避けて通れないテーマだ。HumanEval と MBPP の問題が学習データに混ざってしまうと、実力と違う数字が出る。そこに言及しているのは、透明性を本気で考えている証拠に見える。

18,049件という規模が示している方向性

18,049件という量は、事前学習で使う数百万件規模のコーパスと比べるとかなり小さい。つまり、このモデルは「知識を増やす」ために学習したのではなく、エージェント的なコード実行とツール操作に必要な振る舞いを磨き込むためのものだと考えるのが自然だ。

agentic なデータは、普通のコードスニペットより収集も整形も面倒だ。単に「関数を書け」ではなく、複数のステップを踏んで道具を使い、状況に応じてコードを実行するような流れが必要になる。そうしたデータを公開してくれたのは、まだ事例が少ない領域ではありがたい。

  • モデル重み・学習データ・処理パイプラインが一通り公開
  • Qwen2.5-Coder-14B という安定したベース
  • agentic coding に絞ったデータ設計で用途が明確

使う前に確認しておきたいこと

実際に試すルートはシンプルだ。Hugging Face のページから KALYPSO-v1.1L をダウンロードし、慣れた推論フレームワークでロードすれば動く。ただし 14B パラメータをローカルで回すには GPU メモリがそこそこ必要で、量子化やクラウド上の推論環境を用意しておかないと手元では厳しい。試しに小さめの入力で動かしながら、自分のユースケースに合うかを見るのが現実的だ。

一方、注意点もある。まだ詳細な技術レポートや他モデルとのベンチマーク比較が出ていないため、情報としては「公開データの分析」が中心になる。18K 件のデータでどこまで汎用的な能力を獲得するのか未知数で、あらゆるコードタスクをこなす万能モデルと期待するより、特定のシナリオ向けの素材と捉えたほうが正確かもしれない。実用に進む前に、データの中身とライセンスを一度は確認しておきたい。

KALYPSO の本当の価値は、スコアを競うことより、学習プロセス全体を「見える化」したことにある。

プログラミングモデルのデータエンジニアリングを調べている人や、agent 系のコード生成を自前で作り込んでいるチームには、具体例として非常に実用的なリファレンスになる。動かす前に、どのように作られたかを眺めてみるのも面白い。

メリット・デメリット

メリット

  • 重み・データセット・処理パイプラインが全て公開
  • Qwen2.5-Coder-14B という実績あるベース
  • agentic coding に特化したデータ設計

デメリット

  • 詳細な技術レポートとベンチマーク比較が未公開
  • 学習データが18K件と小規模
  • 14Bモデルのためローカル実行に高いGPUリソースが必要

よくある質問

KALYPSO とは?

14Bパラメータのオープンなプログラミングモデル。Qwen2.5-Coder-14Bをベースに、18,049件のデータで微調整され、重みとデータが公開されています。

KALYPSO は無料で使えますか?

モデル重みとデータセットは Hugging Face で公開されており、無料でダウンロードできます。ライセンスの詳細はリポジトリ確認が必要です。

学習データはどのように処理されていますか?

Kraken と呼ばれるデータセットを使い、18,049件の agentic とコーディング例を人工的に整理。HumanEval と MBPP に対する汚染除去も実施済みです。

どのような用途に向いていますか?

agentic なコード生成やツール利用の研究、あるいは 14B モデルをベースにした追加微調整。学習データの構成を学ぶ教材としても有用です。

ローカルで動かすには?

Hugging Face から重みを取得し、対応する推論フレームワークで読み込みます。14B モデルなので GPU メモリが必要で、量子化やクラウド環境も検討してください。

もっと見る

類似ツール

Locofy

Locofy

FigmaのデザインをReactやNext.jsのコードに変換するLocofy。CursorやClaude Codeと連携し、UI実装の効率化を狙う、デザイン転コードAIツールの実力を整理しました。

Template Empire

Template Empire

Template Empire 提供生产级 Next.js 全栈模板和 UI 套件, 最大特色是每个版本都要经过 15 个 AI 模型(Claude、Codex、Gemini)交叉审核和 23/24 道质量门, 并附签署版报告。全栈模板自带认证、支付、后台等模块, 支持 Docker, 一次性买断无订阅。

Polygram Coding Agent

Polygram Coding Agent

Polygram Coding Agent は IDE 向け AI プログラミング支援ツール。多エージェントワークフローとモデルルーティングを備え、VS Code / Cursor / Antigravity 上で企画・設計・実装までを一気通貫。モバイル/Web アプリのプロトタイプを素早く作りたい開発者向け。

Stellar AI

Stellar AI

Stellar AI 是一款面向游戏开发者的 AI 脚本生成器,专精 FiveM 的 QBCore/ESX 框架与 Roblox 平台。它无需繁琐提示词,用日常英语描述需求即可生成带 fxmanifest 的完整 Lua 脚本,还能修复报错代码。免费版即可体验,付费订阅从 £10/月起。

AuraIntel

AuraIntel 是一款实时 AI 编码助手,以桌面覆盖层形式运行,号称在 Zoom/Teams/Discord 屏幕共享时不可见。它能捕捉问题、生成代码并自动输入到光标处,瞄准编程面试场景。但官方技术细节与定价未公开,且其隐身设计引发学术诚信争议。

Penling

Penling はエージェント型仕様駆動ワークフローツールです。共有ワークスペースで仕様を共同定義し、AIがコードを生成してレビュー可能なPRを作成します。仕様ドキュメントを個人のCLIからチームコラボレーションスペースへ移行し、Google/Microsoft/GitHubログインに対応します。14日間の無料トライアルを提供しています。

オープンソース代替

DeepSeek-Reasonix: DeepSeekモデル向けに特化したターミナルAIコーディングエージェント

DeepSeek-Reasonixは、ターミナルベースのAIコーディングエージェントで、DeepSeekモデル向けに最適化されており、プレフィックスキャッシュに優しいプロンプトによりトークンコストを削減します。設定は単一のreasonix.tomlファイルに集約され、任意のOpenAI互換エンドポイントに切り替えることができます。プラグインレイヤーはMCPサーバーとExtension Protocol v1を統合し、ツールとリソースを提供します。Goで書かれており、静的シングルバイナリで、6つのプラットフォームにクロスコンパイル可能です。npmとHomeからもインストールできます。ライセンスはMITで、公式にはリポジトリのスター数は18803(収集時点)とされています。

code-graph-rag:知識グラフとLLMを活用したオープンソースRAGシステム

code-graph-ragは、知識グラフと大規模言語モデル(LLM)を活用して複雑な多言語モノレポをナビゲートするオープンソースのRAGシステムです。自然言語クエリ、深いコード理解、大規模なコードベースにわたる編集をサポートし、開発者が複雑なプロジェクトをより効率的に管理するのに役立ちます。プロジェクトは主にPythonで書かれており、MITライセンスを採用しています。収集時点で、このプロジェクトはGitHub上で2333のスターを獲得しています。

OpenMonoAgent.ai:ローカル大規模言語モデル駆動のターミナルプログラミングエージェント

OpenMonoAgent.aiは、オープンソースかつ永久無料のターミナルネイティブなプログラミングエージェントで、ローカル大規模言語モデルによって駆動されます。無限のトークン利用が可能で、プライバシー確保のため完全にローカルで動作します。開発者向けで、単一コマンドでインストールでき、サブスクリプション費用やデータ漏洩リスクを排除します。プロジェクトの主要言語はC#で、その他のライセンスを採用しています。

小程序雷达:微信ミニプログラムエコシステムのAI技術レーダー

小程序雷达は、オープンソースでAI駆動の微信ミニプログラム技術レーダーです。フレームワーク、コンポーネントライブラリ、ツール、SDKをフィルタリング可能で比較可能なデータに変換し、レーダー、比較、コンサルタント、ドクター、ウィークリービューを提供します。Next.js、TypeScript、Tailwind CSS、Drizzle ORMで構築され、236のリソースを収録し、GPL-3.0ライセンスを採用しています。

lanhu-mcp:オープンソースMCPサーバー、要件分析の効率を向上

lanhu-mcp は、AI駆動のチームコラボレーション向けに設計されたオープンソースのModel Context Protocol(MCP)サーバーです。要件文書を自動解析し、フロントエンドおよびバックエンドのコードを生成し、デザインリソースのダウンロードを提供します。このツールはPythonで構築されており、公式には要件分析の効率を最大200%向上させるとされています。既存の開発ワークフローにもシームレスに統合できます。プロトタイプ作成の迅速化や手動コーディング作業の削減に特に役立ちます。プロジェクトはMITライセンスを採用しており、収集時点で1614個のGitHubスターを保有しています。

Tabby:セルフホスト型AIプログラミングアシスタント、GitHub Copilotのローカル代替品

Tabbyはオープンソースのセルフホスト型AIプログラミングアシスタントであり、GitHub Copilotのローカルデプロイ代替品です。完全に自己完結型で、外部データベースを必要とせず、OpenAPIインターフェースを提供し、コンシューマーグレードGPUで動作し、RAGコード補完とチャット機能をサポートしています。プロジェクトはRust言語で開発され、Apache 2.0ライセンスでオープンソース化されています。