Geen account nodig. 10 opnames per dag. Anderen geven je drie bestanden per dag en noemen het onbeperkt. Bestanden tot 60 minuten hier, en het resetten om middernacht.
Met de Whisper-plug-ins voor Obsidian kunt u de server kiezen waarmee ze communiceren. De meeste mensen laten het op OpenAI staan en betalen $0,006 voor elke minuut die ze dicteren. Verander één veld naar ScribeGrab en dezelfde plug-in blijft werken: op mijn grafische kaart, gratis, zonder API-sleutel.
In de instellingen van de plugin is een API-URL doos, ingevuld met https://api.openai.com/v1/audio/transcriptionsVervang het door:
https://scribegrab.com/v1/audio/transcriptions
Dat is de hele configuratie. Het eindpunt gebruikt de transcriptie-API van OpenAI: hetzelfde multipart-formulier, dezelfde JSON-uitvoer, dus de plug-in merkt niet of maakt het uit dat deze niet langer met OpenAI communiceert.
Authorization kop wordt geaccepteerd en weggegooid.Veldnamen hieronder zijn van nikdanilov's Whisper-plugin, de populaire. Andere plugins gebruiken dezelfde woorden in een andere volgorde.
| Instelling | Wat u hierin invoert |
|---|---|
| Whisper API-sleutel | Laat dit leeg. Het wordt genegeerd, zelfs als u het invult. |
| API-URL | https://scribegrab.com/v1/audio/transcriptions |
| Model | Alles whisper-1 Prima. Elke aanvraag heeft hetzelfde model, want dat is de enige op de kaart. |
| Taal | Leeg voor automatisch detecteren (ongeveer 100 talen), of een code zoals en, nl, de. Het woord auto is ook begrepen. |
| Prompt | Geaccepteerd en genegeerd. Hints voor de woordenschat worden hier niet doorgegeven aan het model. |
| Temperatuur | Geaccepteerd en genegeerd — de transcriber gebruikt zijn eigen reservecascade. |
| Responformat | json is wat plugins verwachten. text, srt, vtt en verbose_json Ook werken. |
Voordat u het vertrouwt met een echte opname, kunt u vanuit de terminal elk audi bestand erop loslaten:
curl https://scribegrab.com/v1/audio/transcriptions \ -F [email protected] \ -F model=whisper-1 {"text":"This is the first sentence of the memo."}
Voeg toe -F response_format=srt voor tijdgecodeerde ondertitels, of verbose_json voor een segmentlijst met begin- en eindtijden. Het verzoek blijft open totdat het transcript bestaat, precies zoals OpenAI's — Een voice-note van twee minuten komt meestal terug in een paar seconden.
Dit is de computer van één persoon, geen cloudregio. Alles hieronder is dezelfde regel als waarop de website zelf draait, geen speciale API-laag:
verbose_json is de gewone versie. Je krijgt id, start, end en text per segment. Interne statistieken van het model (avg_logprob, tokens, no_speech_prob) zijn er niet — Ik laat liever een veld buiten staan dan een nummer te verzinnen.Je audio gaat naar een machine in mijn huis, wordt getranscribeerd, en het geüploade bestand is verwijderd zodra het transcript bestaat. Het transcript zelf wordt gewist binnen 45 minuten (24 uur als u kocht een maand pas — dat langere venster is deel van waar de pas voor is). Niets wordt bewaard, verkocht of gebruikt om iets te trainen, en uw opname wordt nooit doorgestuurd naar OpenAI, Google of een andere API het hele punt van deze site Het betaalt ook niet per minuut. Details in de Privacybeleid.
Dat gezegd hebbende: het is nog steeds mijn machine. Als een opname zo vertrouwelijk is dat de server van een vreemde een probleem vormt, kunt u beter een model lokaal uitvoeren — dat advies kost mij niets en het is het juiste advies.
Alles wat u kunt instellen een OpenAI basis URL kan dit gebruiken: diction starters, shell scripts, a Makefile dat ondertitelt je scherm opnames. Als uw gereedschap vraagt om een basis-URL in plaats van een volledig eindpunt, geef het https://scribegrab.com/v1 En het zal de rest zelf toevoegen.
ScribeGrab is niet gelieerd aan OpenAI of Obsidian; "OpenAI-compatibel" betekent hier dat het dezelfde aanvraag accepteert en een antwoord in dezelfde vorm teruggeeft.
Heb je Obsidian al gesproken? Als de bron een PDF is in plaats van een audiobestand, PDF van ScanReviver naar Markdown zet het op dezelfde manier — Kopjes gehouden als rubrieken, klaar voor dezelfde kluis.
Ook een foto van het whiteboard gemaakt tijdens diezelfde vergadering? Whiteboardfoto van ScanReviver naar PDF Reinigt het in een rechte PDF die u kunt laten vallen in dezelfde notities map.
De kosten voor de servers zijn al betaald, dus je audio kost mij alleen elektriciteit en verder niets. De advertenties op de website dekken dat. De truc is de wachtrij en het ontbreken van een uptimegarantie – dat is het, en beide staan hierboven vermeld.
Dat is de plugin, nog voordat het bij mij aankomt: de meeste weigeren clips van minder dan een seconde te verzenden. Praat een paar seconden langer.
Het eerste betekent dat het bestand is ingekort of beschadigd — Er staat niets in hoe lang het is, en ik weiger alles wat ik niet kan meten in plaats van het voor altijd op de kaart te laten kauwen. Browser opnames die de lengte open laten (de gebruikelijke .webm van een plugin) zijn prima: die krijgen goed gemeten. Het tweede betekent dat er echt geen geluid in zit, wat gebeurt met stille schermopnames.
Niet via dit eindpunt — OpenAI's API heeft er geen veld voor. De website doet: plak de link op de YouTube-pagina.
Door Sam Ridder Ik bouw en gebruik ScribeGrab op mijn eigen hardware, op mijn eigen. Wie ik ben.