The link is forbidden! This needs fixing. Usual suspects: a missing
index.html or Overview.html, or a missing ACL.
Jeg kan godt læse hvad der står, men forstår ikke hvad jeg skal gøre
ved det?
mvh
--
Morten Snedker
www.planprojekt.dk | www.dbconsult.dk
Privat: www.vinthervej2.dk
>The link is forbidden! This needs fixing. Usual suspects: a missing
>index.html or Overview.html, or a missing ACL.
Ahh...det er fordi jeg har en default.shtml..ik'?
Jeg kalder den shtml fordi jeg har SSI - så det er der vel ikke så
meget at gøre ved?
>>The link is forbidden! This needs fixing. Usual suspects: a missing
>>index.html or Overview.html, or a missing ACL.
>
>Ahh...det er fordi jeg har en default.shtml..ik'?
Det kan jeg ikke forestille mig. "Efternavnet" bør ikke have nogen
effekt som sådan. Jeg har lige prøvet med
<http://opera.softwolves.dk/>, hvor der også anvendes SSI (for
tiden), men blot med et .o som "efternavn"....
http://validator.w3.org/checklink?uri=http%3A%2F%2Fopera.softwolves.dk%2F&hide_type=all&depth=&check=Check
....Det virker fint.
Det ser mere ud som om, selve adressen, når link-tjekkeren tjekker
den, resulterer i et 403/Forbidden[1] fra din server, og så vidt jeg
kan se, vil din server ikke behandle en forespørgsel, hvor der kun
ønskes et HTTP-head uden krop[2]
Prøv evt. selv på http://www.rexswain.com/httpview.html
>Jeg kalder den shtml fordi jeg har SSI - så det er der vel ikke så
>meget at gøre ved?
Du kan fint kalde det noget andet, hvis du vil. Det skal indstilles
på serveren.
______________
[1]
10.4.4 403 Forbidden
The server understood the request, but is refusing to fulfill it.
Authorization will not help and the request SHOULD NOT be repeated.
If the request method was not HEAD and the server wishes to make
public why the request has not been fulfilled, it SHOULD describe
the reason for the refusal in the entity. If the server does not
wish to make this information available to the client, the status
code 404 (Not Found) can be used instead
-- http://www.w3.org/Protocols/rfc2616/rfc2616-sec10.html
[2] http://www.w3.org/Protocols/rfc2616/rfc2616-sec9.html#sec9.4
--
What is life, except excuse for death,
or death, but an escape from life. -Ukendt
Fly Opera - http://www.opera.com/
>Det ser mere ud som om, selve adressen, når link-tjekkeren tjekker
>den, resulterer i et 403/Forbidden[1] fra din server, og så vidt jeg
>kan se, vil din server ikke behandle en forespørgsel, hvor der kun
>ønskes et HTTP-head uden krop[2]
Jeg prøver lige igen. Link-tjekkeren efterspørger hver enkelt
link-adresse, men ikke på normal vis. Den ønsker ikke at modtage
hele siden, den måtte finde der, men kun metadata omkring siden mv.
Den sender derfor en HEAD-forespørgsel mod normalt en GET. Det vil
din server dog ikke behandle, så den svarer med et 403/Forbidden,
dvs. at den har modtaget og forstået det, men nægter at behandle
det.
HVordan du får din server til at godtage en sådan HEAD-forespørgsel
ved jeg dog ikke.
For mig ligner det at serveren kommer med en 403: forbidden når en robot
forsøger at følge linket.
Har du noget spændende opsætning af serveren der giver andre vilkår for
robotters færdsel på siderne, end for almindelige brugere? Så vidt jeg
kan se så kan det ikke have med robots.txt at gøre, da jeg dels ikke kan
se at du har en sådan, og dels ikke mener at det skulle give _den_ fejl.
Lidt googling på andre som har haft samme problem (og dem er der mange
af, det kunne godt tyde på at W3C kunne være meget bruger-hjælpende ved
at uddybe den fejlmeddelelse) bringer dig måske tættere på en løsning,
den her ser spændende ud
<http://mail.wikipedia.org/pipermail/wikitech-l/2004-October/025672.html>
Det er noget langhåret stads, men det her ser også relevant ud_
<http://lists.w3.org/Archives/Public/www-validator/2004Sep/0085.html>
Jeg har brugt den her query:
<http://www.google.com/search?q=%22missing+ACL%22+link+validation>
- også i groups (hvor der er nogle regulære svar på de danske grupper!):
<http://groups.google.com/groups?q=%22missing%20ACL%22%20link%20validation&sa=N&tab=wg>
mvh
Jesper Brunholm
Jeg skal ikke forsøge at gøre mig klog på det her, men så ville den vel
brokke sig over 405 sådan som den gør her:
<http://www.ukoln.ac.uk/interop-focus/gpg/qa/2005-03/link.htm>?
mvh
Jesper Brunholm
>Jeg skal ikke forsøge at gøre mig klog på det her, men så ville den vel
>brokke sig over 405 sådan som den gør her:
><http://www.ukoln.ac.uk/interop-focus/gpg/qa/2005-03/link.htm>?
telnet www.planprojekt.dk 80
HEAD / HTTP/1.1
Host: www.planprojekt.dk
HTTP/1.1 403 Forbidden
Content-Length: 1758
Content-Type: text/html
Server: Microsoft-IIS/6.0
X-Powered-By: ASP.NET
Date: Thu, 28 Sep 2006 21:54:02 GMT
>>Jeg skal ikke forsøge at gøre mig klog på det her, men så ville den vel
>>brokke sig over 405 sådan som den gør her:
>><http://www.ukoln.ac.uk/interop-focus/gpg/qa/2005-03/link.htm>?
>
>telnet www.planprojekt.dk 80
>HEAD / HTTP/1.1
>Host: www.planprojekt.dk
>
>HTTP/1.1 403 Forbidden
>Content-Length: 1758
>Content-Type: text/html
>Server: Microsoft-IIS/6.0
>X-Powered-By: ASP.NET
>Date: Thu, 28 Sep 2006 21:54:02 GMT
... og det virker med en normal GET...
|telnet www.planprojekt.dk 80
|GET / HTTP/1.1
|Host: www.planprojekt.dk
|
|HTTP/1.1 200 OK
|Date: Thu, 28 Sep 2006 22:24:24 GMT
|Server: Microsoft-IIS/6.0
|X-Powered-By: ASP.NET
|Content-Length: 2876
|Content-Type: text/html
|
|<!DOCTYPE html PUBLIC "-//W3C//DTD XHTML 1.0
|....
Endeligt fra min log tidligere, hvor vi kan se, link-tjekkeren
faktisk anvender HEAD:
128.30.52.13 - - [28/Sep/2006:21:45:01 +0200] "GET /robots.txt
HTTP/1.1" 404 292 "-" "W3C-checklink/4.2.1 [4.21] libwww-perl/5.803"
128.30.52.13 - - [28/Sep/2006:21:45:02 +0200] "GET / HTTP/1.1" 200
3452 "-" "W3C-checklink/4.2.1 [4.21] libwww-perl/5.803"
128.30.52.13 - - [28/Sep/2006:21:45:05 +0200] "HEAD /links.o
HTTP/1.1" 200 0 "-" "W3C-checklink/4.2.1 [4.21] libwww-perl/5.803"
128.30.52.13 - - [28/Sep/2006:21:45:07 +0200] "HEAD /omwebstedet.o
HTTP/1.1" 200 0 "-" "W3C-checklink/4.2.1 [4.21] libwww-perl/5.803"
128.30.52.13 - - [28/Sep/2006:21:45:08 +0200] "HEAD /startmedopera.o
HTTP/1.1" 200 0 "-" "W3C-checklink/4.2.1 [4.21] libwww-perl/5.803"
....
jamen - fornemt - undskyld min uvidende påstand! :-)
Jeg håber spørgeren kan få løst problemet, og gerne poste her hvordan
(set i lyset af antallet af folk der har haft problemet kan det nok være
interessant).
mvh
Jesper Brunholm
[snip GET & HEAD]
Jamen er vi så ikke der, hvor Morten mapper GET mod index.shtml mens HEAD er
mappet mod index.html (som ikke findes)?
--
Med venlig hilsen
Stig Johansen
>Jeg håber spørgeren kan få løst problemet, og gerne poste her hvordan
>(set i lyset af antallet af folk der har haft problemet kan det nok være
>interessant).
Det ligger superlavt på prioritetslisten, men når/hvis jeg kommer til
det, skal jeg nok gi' et pip. Tak for responsen.
mvh
--
Morten Snedker
http://www.planprojekt.dk | http://www.dbconsult.dk
Privat: http://www.vinthervej2.dk
>[snip GET & HEAD]
>Jamen er vi så ikke der, hvor Morten mapper GET mod index.shtml mens HEAD er
>mappet mod index.html (som ikke findes)?
Ikke helt. Når han angiver en webside, han ønsker at linktjekke, så
bliver denne side naturligvist hentet ned som normalt (GET siden)
for at læse dens indhold, dvs. for at kunne udtrække alle linksne på
siden og tjekke dem. Hvert enkelt link på siden tjekkes (bl.a. for
at se, om det er dødt, går jeg ud fra). Det gør de så her ved at
HEAD'e siden i stedet for at GET'e den, men det er jo den samme
adresse, der ville blive tilgået i begge tilfælde, så der er ikke
tale om forskellige mapping. Både et GET og et HEAD til den samme
adresse burde give den samme.
> Stig Johansen <stig_johansen_it_at_=(@)hotmail.com> posting:
>
>>[snip GET & HEAD]
>>Jamen er vi så ikke der, hvor Morten mapper GET mod index.shtml mens HEAD
>>er mappet mod index.html (som ikke findes)?
>
> Ikke helt. Når han angiver en webside, han ønsker at linktjekke, så
> bliver denne side naturligvist hentet ned som normalt (GET siden)
> for at læse dens indhold, dvs. for at kunne udtrække alle linksne på
> siden og tjekke dem. Hvert enkelt link på siden tjekkes (bl.a. for
> at se, om det er dødt, går jeg ud fra). Det gør de så her ved at
> HEAD'e siden i stedet for at GET'e den, men det er jo den samme
> adresse, der ville blive tilgået i begge tilfælde, så der er ikke
> tale om forskellige mapping. Både et GET og et HEAD til den samme
> adresse burde give den samme.
Jeg trot, vi taler forbi hinanden, men men jeg kan godt se, at jeg
formulerede mig forkert. Når jeg skrev Morten, mente jeg "Morten's server"
og ikke personen. Jeg kan ikke lige huske præcis opsætning af IIS, men et
eller andet sted angiver man default document.
Nevermind - for at afprøve teorien prøvede jeg at lave en fuldt kvalificeret
HEAD:
lwork1:/home/sj # telnet www.planprojekt.dk 80
Trying 80.198.226.94...
Connected to www.planprojekt.dk.
Escape character is '^]'.
HEAD /default.shtml HTTP/1.1
Host: www.planprojekt.dk
HTTP/1.1 403 Forbidden
Content-Length: 1758
Content-Type: text/html
Server: Microsoft-IIS/6.0
X-Powered-By: ASP.NET
Date: Sat, 30 Sep 2006 06:20:24 GMT
Som du kan se, så giver den også en 403'er.
Men læg mærke til, at der er en Content-Length på 1758, som formentlig er
størrelsen på den uparsede fil på Morten's server.
På GET'en får vi en Content-Length på 2878, som er den parsede størrelse.
En ny teori er, at HEAD på SSI dokumenter simpelthen ikke er understøttet på
IIS.
>En ny teori er, at HEAD på SSI dokumenter simpelthen ikke er understøttet på
>IIS.
Det tror jeg, du har ret i. Jeg prøvede lige at lave en søgning på
IIS vs HEAD og kom bl.a. frem til flg. fra
http://groups.google.com/group/dk.edb.internet.webdesign.html/browse_thread/thread/45d18c99f7e47f51/d22e3c8ee3673f48?lnk=st&q=%22head+requests%22+IIS+403&rnum=2&hl=da#d22e3c8ee3673f48
|Det viser siger, at IIS ikke accepterer HEAD-requests for
|.shtml- extensions som default, men dette kan ændres under
|egenskaber for sit "web site" ved at vælge fanebladet "Home
|Directory" og trykke "Configuration"."