[verdetto][prompt generato][fonte: descript.com]
Posso vibecodare Descript?
// si costruisce in un weekend, ma restano buchi veri
Puoi costruirti il taglio guidato dalla trascrizione per clip semplici, ma l'editor di Descript, la pipeline media, gli strumenti AI per voce e video, la pubblicazione e la collaborazione sono un prodotto serio.
confidenza: alta
cos’è: Editor audio e video basato sul testo, con trascrizione e strumenti AI
Indice di costruibilità · gioco editoriale
- Prezzo 24 $/mese peso: più 2
- Tempo più giorni peso: più 1
- Categoria audio e video non pesa
- Moat qualità di esecuzione · modelli proprietari · collaborazione peso: meno 4
- Confidenza alta peso: più 1
- Cosa perdi 6 voci peso: meno 3
- Sito descript.com (si apre in una nuova scheda) non pesa
Il moat pesa più del prezzo: rifarlo è un progetto, non una sera.
Gioco editoriale: il verdetto dice se un agente può, l’indice se conviene.
Cosa costruisci
Trascrivere il materiale, mappare le parole sui timestamp, far sì che cancellare del testo tagli audio e video, poi renderizzare con ffmpeg.
cosa ti serve
- ffmpeg
- speech-to-text e allineamento
- un editor desktop o web
- una pipeline di rendering video
- storage in hosting, opzionale
Un ottimo caso di confine: il clone giocattolo è facile, ma la profondità del prodotto è sotto gli occhi di tutti.
Il prompt
Un weekend con un agente di coding. I buchi che restano sono qui sotto, in «cosa perdi».
Build me a text-based clip cutter to replace Descript for simple edits. Requirements:
- A local web app: Node + Express with a plain JS frontend, binds to localhost.
- I drop an audio/video file into ./media/; the app transcribes it with whisperX
for word-level timestamps, or the OpenAI Whisper API if a key is in .env.
- The transcript renders as clickable words. I select and delete words or whole
sentences; deleted spans go into a cut list I can undo from.
- Render: build one ffmpeg trim/concat command that removes the cut spans from
the original and writes ./output/<name>-cut.mp4 (or .mp3 for audio-only).
- Pad each cut by about 80 ms so words are not clipped mid-syllable.
- Save each project as JSON next to the media file (transcript + cut list) so an
edit can be reopened later.
- No accounts, no telemetry; everything stays on my machine except the optional
Whisper API call.
- Out of scope: multitrack timeline, overdub or AI voices, filler-word
auto-removal, cloud anything. This is a cutter, not an editor.
- README: installing ffmpeg and whisperX, and a warning that local
transcription of long video is slow on CPU. Prompt generato dai dati della scheda, non ancora rivisto a mano. In inglese di proposito — è la lingua in cui gli agenti di coding rendono meglio.
Cosa perdi
- un editor non lineare rifinito
- gli strumenti overdub e di voce
- i workflow sulle parole riempitive
- i template
- la collaborazione in cloud
- l'affidabilità del rendering
Perché pagano ancora
Si paga per non costruire e non dover accudire un editor multimediale, non solo per la trascrizione.
moat: Qualità di esecuzione Modelli proprietari Collaborazione cos’è un moat
pipeline media e collaborazione
Alternative gratuite
Non hai voglia di costruirtelo? Queste esistono già, sono gratis o open source, e le abbiamo controllate una per una.
Scartate (1) — e perché
- whisper.cpp (si apre in una nuova scheda) — Motore di trascrizione eccellente; manca completamente l'editor audio e video finito che ci starebbe intorno.
Chi l’ha già costruito
Partire da qui è vibecoding lo stesso: il prompt serve quando lo vuoi esattamente a modo tuo.
- Kdenlive (si apre in una nuova scheda) — Mature open-source video editor; useful alternative but not text-first SaaS clone. (alive)
Sei d’accordo?
La bilancia dei voti
Ancora nessun voto: il tuo è il primo.
Nessun voto ancora — il primo pesa.