PDF.CN

使用 macOS 工具、ImageMagick、SVG 与 AI 图像生成技术来创建和编辑图标、favicon、图片及配色方案。

设计多媒体 3 小时前

火山引擎AI服务图像生成工作流。适用于文生图、风格变体、提示词优化、确定性图像生成参数设置及问题排查。

设计多媒体 2 小时前

使用 ElevenLabs 语音转文字(Scribe v2)转录音频文件。

设计多媒体 3 小时前

VAPMedia API 技能,用于图像、视频、音乐和媒体的编辑,通过 VAP 实现,使用当前 Media API 端点的 VAP 产品密钥。

设计多媒体 3 小时前

涵盖基础、模式与反模式的全面 UI 设计技能。包括布局、排版、色彩、间距、无障碍、动效及组件设计。适用于构建 Web 界面、审查设计质量或打造独特 UI。

设计多媒体 2 小时前

使用 sherpa-onnx 的 Piper 语音实现本地文字转语音。100% 离线,无需 API 密钥。适用于用户请求语音回复、音频回复、口述答案或需要朗读的场景。支持多语言,包括德语(thorsten)和英语(ryan)语音。输出兼容 Telegram 的语音笔记,使用 [[audio_as_voice]] 标签。

设计多媒体 3 小时前

专业UI生成与现有界面优化技能。当用户请求生成UI界面、设计页面、优化现有界面、创建组件库、设计系统、App界面、Web界面、Dashboard、Landing Page,或任何涉及视觉交互设计时,必须触发此技能。参考Google Material Design、Apple HIG以及Pinterest级别审美标准,输出大气简约、高级美学的UI代码。即使用户仅说“帮我做个界面”“优化一下UI”“设计一个页面”,也必须触发。

设计多媒体 3 小时前

AI图像生成与编辑:文生图、图+文生图、风格转换;用于绘图、生成、编辑和风格转换。支持比例(1:1、3:2、16:9、21:9等)和分辨率(标准、2K、4K)。

设计多媒体 3 小时前

通过 inference.sh CLI 使用 FLUX、Gemini、Grok、Seedream、Reve 以及 50 多种模型生成 AI 图像。

设计多媒体 3 小时前

使用 songsee CLI 从音频生成频谱图和特征面板可视化。

设计多媒体 3 小时前