オープンソースの画像テキストカード Skill:「AI 感のある添え画像」にさよなら

·Toolin 編集部

guizang-social-card-skill はオープンソースの AI 画像テキストカード生成ツール。11種類のコンテンツカテゴリ適応、雑誌級の組版エンジン、無料商用画像素材ライブラリを内蔵し、RedNote レベルの添え画像をワンクリックで生成します。

オープンソースの画像テキストカード Skill:「AI 感のある添え画像」にさよなら

RedNote や WeChat 公式アカウントなどのフィード型プラットフォームで画像テキストコンテンツを作っているなら、高確率でこの問題に遭遇したことがあるでしょう。文章は良いのに、添え画像を見た瞬間に AI 生成とわかる——大きな色面、emoji の詰め込み、どこも同じ Tailwind 風スタイル。

guizang-social-card-skill は画像テキストクリエイターのために設計されたオープンソース Skill で、「AI 制と見分けがつかない」添え画像カードの生成を目標にしています。雑誌級の組版エンジン、11種類のコンテンツカテゴリ自動適応ルール、無料商用画像素材ライブラリ接入、そしてスクリーンショット美化システム一式を内蔵しています。

GitHub:https://github.com/op7418/guizang-social-card-skill

どの問題を解決するのか

圧倒的多数の AI 生成画像テキストカードツールには、3つの共通の欠点があります:

  1. スタイルが単調 —— 映画レビューを書いても製品レビューでも、出来上がるカードの見た目がどれも同じ
  2. 文字重ねの失敗 —— 白い文字を明るい背景に重ねる、文字が顔を隠す、画像全体に横断して構図を台無しにする
  3. 画像ソースの悩み —— 自分で画像をアップするか、emoji を使うか、一目で AI とわかるイラストを生成するしかない

この Skill はこれらの問題を1つずつ解決しています。

核心機能の分解

11種類のコンテンツカテゴリ自動適応

同じ文章でも、映画レビューと言えば映画ポスター風のカードを、製品レビューと言えばデバイスフレーム付きの比較画像を出してくれます。旅行、仕事、映像、デジタルガジェット、読書、グルメなど、よくある11種類の画像テキストカテゴリの適応ルールを内蔵しています。

カテゴリ適応例

各カテゴリには独立したビジュアル言語があります。旅行コンテンツは暖色の雑誌風、仕事のノウハウはダークなグリッド風、グルメの店訪問は高彩度の大画像フルスクリーンです。

旅行ブロガー向けには地図コンポーネントまで用意されており、店の位置や旅行ルートを上にマーキングできます。AI が自動で注記を生成します。

文字重ねの3ステップ処理

文字を画像にどう重ねるかは、画像テキストカードで最も難しい部分です。この Skill は3ステップで行います:

  1. 主体の識別 —— 顔、製品、文字密集領域をレイアウトが自動で避ける
  2. 配置先の色と明度の計算 —— 文字色、マスクを付けるかどうか、影の濃さを決定
  3. フォントサイズと改行の自适应 —— 配置領域の大きさに応じて動的に調整。フォントサイズを固定してはみ出させるのではない

文字重ねの効果

3大無料画像素材ライブラリによる自動添え画像

既定で Pexels、Unsplash、Wallhaven の3つの無料商用可の画像素材ライブラリに接続しています。Skill は本文段落の意味に基づいて検索語を自動で発行し、画像を取得し、レイアウトに合わせて切り抜き、顔や主体が切れないようにします。

素材ライブラリ例

スクリーンショット美化の4点セット

ソフトウェアのスクリーンショット、チャット履歴、製品インターフェースといったコンテンツには、Skill が自動で macOS / iOS 風のデバイスフレームを付け、異なる質感の背景(方眼紙、ドットグリッド、暖白またはダーク)を組み合わせて、スクリーンショットが製品公式の宣伝画像のように見えるようにします。

スクリーンショット美化例

2つのビジュアルシステム + 28個のレイアウトスケルトン

  • 雑誌風:大きな余白、セリフの大見出し、非対称レイアウト。『The New Yorker』の表紙組版のようなスタイル
  • グリッド風:強いグリッド、サンセリフ、幾何学感。スイス流のグラフィックデザインの系譜

2つのビジュアルシステム

28個のレイアウトスケルトンは雑誌、ポスター、アルバムジャケット、映画ポスターから厳選されています。AI は検証済みのスケルトンに「充填」するだけでよく、成果物の安定性が大幅に向上します。

インストール方法

Codex、OpenClaw、Claude Code、WorkBuddy の中でこう言ってください:

この Skill をインストールして:https://github.com/op7418/guizang-social-card-skill

サポートする出力比率:3:4(主戦場、スマートフォンのフィード向けに最適化)、21:9、1:1。

向いている人

  • RedNote / WeChat 公式アカウントの画像テキストクリエイター
  • 添え画像を頻繁に作る必要がある運用担当者
  • AI 生成添え画像の品質に満足していないコンテンツチーム

関連記事

ClawGym:Agent の訓練・評価一体化オープンソースフレームワーク
AI製品

ClawGym:Agent の訓練・評価一体化オープンソースフレームワーク

人民大学が Claw Agent のデータ+訓練+評価を一気通貫でつなぐフレームワークをオープンソース化。13.5K の実行可能タスクを含み、サンドボックス並列強化学習をサポート

Toolin 編集部
Codex Computer Use が Windows に登場:実践ガイド
AIチュートリアル

Codex Computer Use が Windows に登場:実践ガイド

OpenAI Codex が Windows PC の操作を正式サポート。完全な有効化手順、制限事項の説明、スマホからのリモートコントロール方法を紹介

Toolin 編集部
Gamma-World:オープンソースのマルチエージェント世界モデル
AI製品

Gamma-World:オープンソースのマルチエージェント世界モデル

NVIDIA が清華大学と共同でマルチエージェント世界モデルをオープンソース化。2人での訓練から4人へ直接汎化し、ゼロショットでの多人数シーンのリアルタイム推演をサポート

Toolin 編集部
Step 3.7 Flash を Claude Code に接続:実測ガイド
AIチュートリアル

Step 3.7 Flash を Claude Code に接続:実測ガイド

StepFun のオープンソース Flash モデルを Claude Code に接続する実測レポート。複雑な Agent ワークフローで、中国製モデルがクローズドソース基盤の代わりを果たせるかを検証

Toolin 編集部
Syll:清華大学がオープンソース化したマルチモーダル全インタラクションエージェントフレームワーク
AI製品

Syll:清華大学がオープンソース化したマルチモーダル全インタラクションエージェントフレームワーク

GUI、CLI、MCP の3つの操作方式をサポートし、デモンストレーションによる教示で再利用可能なスキルを自動生成。ローカルデプロイでデータプライバシーを保護

Toolin 編集部
SkillOpt:ニューラルネットワークのようにAgentスキル文書を訓練する
AI製品

SkillOpt:ニューラルネットワークのようにAgentスキル文書を訓練する

Microsoftがオープンソース化したテキスト空間最適化フレームワーク。Agentのスキル文書を自動進化させ、52項目の評価すべてで最高性能を達成。

Toolin 編集部