Downloads · 30 days
0
chocopan/chocopan-pre
chocopan-pre is a robotics model from chocopan. Use it for the robotics task on the model card, and read the license before you ship it in a product. It is set up for lerobot. The card lists the license as apache-2.0.
PARC2026予選 Track 1向けに、公開済みのロボット基盤モデル lerobot/smolvlaliberoplusを LoRA追加学習する参加者モデルのModel Cardです。前方・手先カメラ画像、ロボット状態、 言語指示から、Franka Emika Panda用の7次元relative EEF actionを生成します。
Downloads · 30 days
0
Access
Public
Updated Aug 1, 2026
Repo size
907 MB
Likes
0
Public
Click a slice to open those files.
.safetensors907 MB · 100%
From the Hugging Face model README
PARC2026予選 Track 1向けに、公開済みのロボット基盤モデル
lerobot/smolvla_libero_plusを
LoRA追加学習する参加者モデルのModel Cardです。前方・手先カメラ画像、ロボット状態、
言語指示から、Franka Emika Panda用の7次元relative EEF actionを生成します。
現在の状態: Model Cardのみを先行登録しています。学習済みweight、最終manifest、 checkpoint hash、性能値は未登録です。以下の
TBDは、最終提出に使用するcheckpointを 確定後、その実測値で更新します。このリポジトリを現時点で推論に使用することはできません。
| 項目 | 内容 |
|---|---|
| Model name | PARC2026 Track 1 SmolVLA LoRA |
| Version / run | TBD |
| Base model | lerobot/smolvla_libero_plus |
| Base revision | 7bb70aa5bc92b82c9239142775d3a173103567ff |
| VLM backbone | HuggingFaceTB/SmolVLM2-500M-Video-Instruct |
| VLM revision | 7b375e1b73b11138ff12fe22c8f2822d8fe03467 |
| Framework | LeRobot v0.6.0 / commit 30da8e687a6dfc617fcd94afc367ac7071c376ce(最終manifestで再確認) |
| Architecture | SmolVLM2 vision-language backbone + flow-matching action expert |
| Fine-tuning | LoRA(最終checkpointではbase weightへmerge予定) |
| Action chunk | あり、50 actions |
| Checkpoint SHA-256 | TBD |
| Intended hardware | NVIDIA L4 24 GB(大会評価環境) |
入力は次の情報です。
agentview_image: 前方カメラ画像、uint8 (128, 128, 3)robot0_eye_in_hand_image: 手先カメラ画像、uint8 (128, 128, 3)画像resize、state変換、normalizationはcheckpointに付属するLeRobotの
preprocessorで行います。出力は float32 (7,) のrelative EEF actionです。
[dx, dy, dz, droll, dpitch, dyaw, gripper]
推論時は50-step action chunkをキャッシュし、エピソード開始時の reset() でqueueと
内部状態を消去します。大会環境は外部ネットワークへ接続できないため、tokenizer、config、
pre/postprocessorを含む推論資産をcheckpointと一緒に固定・保存する設計です。
本モデルは実機での安全性を保証するものではありません。安全検証なしに実ロボットへ 展開しないでください。また、タスク固有FSM、ハードコード行動列、評価seed等をキーにした 行動表、成功条件や報酬への直接アクセス、評価観測を使った追加学習には使用しません。
学習元は
lerobot/libero_plusの
固定revision f3f49f426d75030177b18778374005bc12ccd588 です。
| 項目 | 全データ | 今回の選択データ |
|---|---|---|
| Tasks | 40 | 4 |
| Episodes | 14,347 | 80(各task 20) |
| Frames | 2,238,036 | 10,855 |
| FPS | 20 | 20 |
選択した公開Track 1 base taskは次の4つです。
pick up the black bowl in the top drawer of the wooden cabinet and place it on the platepick up the tomato sauce and place it in the basketpick up the milk and place it in the basketput the bowl on the stove各taskのepisodeは固定revision内の並び全体へ均等に分散するよう選択し、収集条件の偏りを 抑えています。評価時の観測やtrajectoryは保存せず、後続の学習にも使用しません。
以下はMain run Aの予定値です。実行後、parc_training_manifest.json と照合して確定します。
| Hyperparameter | Value |
|---|---|
| Training steps | 3,000 |
| Batch size | 1 |
| Learning rate | 3e-4 → 3e-5 |
| Warmup | 100 steps |
| LoRA rank / alpha | 16 / 16 |
| Seed | 42 |
| Mixed precision | fp16 on NVIDIA T4 |
視覚encoderを固定し、action expertのattention projection、state/action projectionなどを LoRAの主な学習対象とする計画です。最終的な学習対象parameter名とtrainable parameter数は 学習ログから追記します。
PARC2026の評価はtask successとcollisionをgateにし、実行効率と軌道の滑らかさを含む 非公開の重み・正規化式で総合します。ローカル環境で確認できる指標はsuccess rate、steps、 trajectory length、jerk、SPARC、EEF rotation、collisionです。
成功にはtask goalの達成に加え、操作対象以外の物体の初期位置からの変位が各軸の絶対値の
和で1 mm以下であることが必要です。また、/act と /reset は各request 10秒以内、
server startupは既定120秒以内、Track全体は1時間以内である必要があります。
| Run | Data | Steps | Final loss | Local success | Max /act | Omnicampus score |
|---|---|---|---|---|---|---|
| Random connectivity | - | - | - | 0% | 0.003 s | - |
| Smoke | 4 tasks × 5 episodes | 500 | TBD | TBD | TBD | Not submitted |
| Main A | 4 tasks × 20 episodes | 3,000 | TBD | TBD | TBD | TBD |
| Main B (optional) | 4 tasks × 20 episodes | 8,000 | TBD | TBD | TBD | TBD |
結果を記録する際はepisode数、最大step数、task一覧、seed、GPU、checkpoint SHA-256も併記し、 異なる条件の値を同じrunとして混在させません。
最終checkpointには parc_training_manifest.json を添付し、以下を機械可読な形で保存します。
最終レポート提出前に、次の TBD を必ず確定します。
/act latency固定した lerobot/libero_plus revisionには、確認時点で独立したdataset cardまたはlicense tagが
ありません。そのため最終レポートでは、講座提供データとしての利用、repositoryとrevision、
元LIBERO demonstrationsの出所とライセンスを併記します。提出物へ同梱する第三者コードは、
各ライセンス文と配布条件を個別に維持します。
これはPARC2026参加者によるprivateな作業用repositoryであり、大会運営による公式モデルでは ありません。大会資料 Version 1.0(2026-07-31)では、最終モデルに参加者自身が学習し、 Action生成へ実質的に寄与する要素を含めること、ならびに2ページ以内のレポートでモデル、 学習、試行錯誤、権利関係を申告することが求められています。